Lớp canonical

Kho tri thức

Kho tri thức là nơi lưu bài chi tiết từng repo, công nghệ và nền tảng AI. Đây là lớp duy nhất được phép giữ link GitHub gốc, để các lớp còn lại có thể trỏ về nguồn nội bộ ổn định.

Nguồn sự thậtGiữ thông tin chi tiết, tag, use case và nguồn gốc repo.
Liên kết nội bộBản tin, chủ đề và ý tưởng nên trỏ về đây.
Kiểm chứngĐọc bài chi tiết trước khi chọn repo để productize.
  • Open-LLM-VTuber

    Open-LLM-VTuber

    Open-LLM-VTuber — Open-LLM-VTuber cho phép trò chuyện với bất kỳ LLM nào bằng giọng nói rảnh tay, ngắt lời được, kèm nhân vật avatar Live2D chạy hoàn

    Đọc tiếp

  • fastrtc

    fastrtc

    fastrtc — FastRTC là thư viện Python giúp dựng ứng dụng âm thanh/video thời gian thực qua WebRTC hoặc WebSocket chỉ với vài dòng code. Nó giấu hết phầ

    Đọc tiếp

  • bolna

    bolna

    bolna — Bolna là framework mã nguồn mở tập trung vào điện thoại: ghép ASR + LLM + TTS để tạo agent gọi/nghe điện tự động, tích hợp sẵn Twilio, Plivo,

    Đọc tiếp

  • ten-framework

    ten-framework

    ten-framework — TEN Framework là bộ khung mã nguồn mở để dựng agent hội thoại bằng giọng nói theo mô hình đồ thị các node (STT, LLM, công cụ, bộ nhớ,

    Đọc tiếp

  • graphify

    graphify

    graphify: biến codebase kèm docs, SQL, config, PDF thành knowledge graph truy vấn được bằng AST cục bộ, không cần vector store — bối cảnh chuẩn cho agent.

    Đọc tiếp

  • herdr

    herdr

    herdr: runtime bằng Rust cho coding agent — cấp công cụ, quản phiên và tài nguyên có kỷ luật, làm nền cho đội agent lập trình song song.

    Đọc tiếp

  • agent-browser

    agent-browser

    agent-browser: CLI Rust tốc độ cao cho AI agent điều khiển trình duyệt thật — mở trang, click, điền form, trích dữ liệu, dễ nhúng vào mọi pipeline.

    Đọc tiếp

  • PaddlePaddle/PaddleOCR

    PaddlePaddle/PaddleOCR

    PaddleOCR là bộ công cụ OCR nhẹ, mạnh của Baidu hỗ trợ 100+ ngôn ngữ, có cả biến thể VLM, biến ảnh/PDF thành dữ liệu có cấu trúc cho AI — một trong…

    Đọc tiếp

  • datalab-to/surya

    datalab-to/surya

    Surya là bộ công cụ OCR đa năng: nhận dạng chữ, phân tích bố cục, thứ tự đọc và nhận diện bảng trên 90+ ngôn ngữ — lõi thị giác cho các pipeline tà…

    Đọc tiếp

  • google/langextract

    google/langextract

    LangExtract của Google là thư viện trích xuất thông tin có cấu trúc từ văn bản lộn xộn bằng LLM, kèm source grounding (chỉ đúng vị trí nguồn) và tr…

    Đọc tiếp