SenseVoice (FunAudioLLM) là mô hình nhận dạng giọng nói (ASR) mã nguồn mở đa ngôn ngữ, nhận diện tiếng Trung, Quảng Đông, Anh, Nhật, Hàn; đồng thời phát hiện cảm xúc và sự kiện âm thanh, tốc độ suy luận rất nhanh.
Ứng dụng
- Bóc băng, tạo phụ đề tự động cho video/podcast đa ngôn ngữ
- Phân tích cuộc gọi tổng đài: nội dung + cảm xúc khách hàng để chấm điểm chất lượng
- Ghi chú cuộc họp, tìm kiếm nội dung trong kho audio doanh nghiệp
Hướng kiếm tiền: Dựng dịch vụ transcription + phân tích cảm xúc cuộc gọi tính theo phút cho trung tâm chăm sóc khách hàng, rẻ hơn nhiều so với API cloud.
⭐ 9.4k (ghi nhận) · nhóm: Nhận dạng giọng nói (ASR) · license: MIT
Được nhắc trong bản tin
Đi tiếp: Xem Tổng hợp giải pháp để đóng gói repo này thành dịch vụ.
