Lớp canonical
Kho tri thức
Kho tri thức là nơi lưu bài chi tiết từng repo, công nghệ và nền tảng AI. Đây là lớp duy nhất được phép giữ link GitHub gốc, để các lớp còn lại có thể trỏ về nguồn nội bộ ổn định.
-

Open-LLM-VTuber
Open-LLM-VTuber — Open-LLM-VTuber cho phép trò chuyện với bất kỳ LLM nào bằng giọng nói rảnh tay, ngắt lời được, kèm nhân vật avatar Live2D chạy hoàn
-

fastrtc
fastrtc — FastRTC là thư viện Python giúp dựng ứng dụng âm thanh/video thời gian thực qua WebRTC hoặc WebSocket chỉ với vài dòng code. Nó giấu hết phầ
-

bolna
bolna — Bolna là framework mã nguồn mở tập trung vào điện thoại: ghép ASR + LLM + TTS để tạo agent gọi/nghe điện tự động, tích hợp sẵn Twilio, Plivo,
-

ten-framework
ten-framework — TEN Framework là bộ khung mã nguồn mở để dựng agent hội thoại bằng giọng nói theo mô hình đồ thị các node (STT, LLM, công cụ, bộ nhớ,
-

graphify
graphify: biến codebase kèm docs, SQL, config, PDF thành knowledge graph truy vấn được bằng AST cục bộ, không cần vector store — bối cảnh chuẩn cho agent.
-

herdr
herdr: runtime bằng Rust cho coding agent — cấp công cụ, quản phiên và tài nguyên có kỷ luật, làm nền cho đội agent lập trình song song.
-

agent-browser
agent-browser: CLI Rust tốc độ cao cho AI agent điều khiển trình duyệt thật — mở trang, click, điền form, trích dữ liệu, dễ nhúng vào mọi pipeline.
-

PaddlePaddle/PaddleOCR
PaddleOCR là bộ công cụ OCR nhẹ, mạnh của Baidu hỗ trợ 100+ ngôn ngữ, có cả biến thể VLM, biến ảnh/PDF thành dữ liệu có cấu trúc cho AI — một trong…
-

datalab-to/surya
Surya là bộ công cụ OCR đa năng: nhận dạng chữ, phân tích bố cục, thứ tự đọc và nhận diện bảng trên 90+ ngôn ngữ — lõi thị giác cho các pipeline tà…
-

google/langextract
LangExtract của Google là thư viện trích xuất thông tin có cấu trúc từ văn bản lộn xộn bằng LLM, kèm source grounding (chỉ đúng vị trí nguồn) và tr…