SenseVoice

FunAudioLLM SenseVoice - kho tri thuc AIToEarn

SenseVoice (FunAudioLLM) là mô hình nhận dạng giọng nói (ASR) mã nguồn mở đa ngôn ngữ, nhận diện tiếng Trung, Quảng Đông, Anh, Nhật, Hàn; đồng thời phát hiện cảm xúc và sự kiện âm thanh, tốc độ suy luận rất nhanh.

Ứng dụng

  • Bóc băng, tạo phụ đề tự động cho video/podcast đa ngôn ngữ
  • Phân tích cuộc gọi tổng đài: nội dung + cảm xúc khách hàng để chấm điểm chất lượng
  • Ghi chú cuộc họp, tìm kiếm nội dung trong kho audio doanh nghiệp

Hướng kiếm tiền: Dựng dịch vụ transcription + phân tích cảm xúc cuộc gọi tính theo phút cho trung tâm chăm sóc khách hàng, rẻ hơn nhiều so với API cloud.

⭐ 9.4k (ghi nhận) · nhóm: Nhận dạng giọng nói (ASR) · license: MIT

Mở repo trên GitHub

Được nhắc trong bản tin

Đi tiếp: Xem Tổng hợp giải pháp để đóng gói repo này thành dịch vụ.

Bước tiếp theo

Biến điều vừa đọc thành hành động

Lưu bài để đọc lại, tạo kế hoạch 7 ngày hoặc mở playbook phù hợp.




route
Xem playbook liên quan
Đi từ kiến thức sang hướng triển khai phù hợp.