Speech-to-Speech
AssessKỹ thuật
Công nghệ chuyển đầu vào giọng nói trực tiếp thành đầu ra giọng nói.
Vì sao ở đây
Xếp vào Assess: 3 bài bằng chứng từ 1 nguồn, chủ yếu là ra mắt sản phẩm, 1 bài trong 30 ngày qua. Độ tin cậy 42%.
Bằng chứng (3)
- 7Hugging Face Blog·15/7/2026researchHume AI giới thiệu Real World VoiceEQ để đo chất lượng AI giọng nói
Hume AI ra mắt Real World VoiceEQ, một bộ benchmark nhằm đo chất lượng “giống người” của AI giọng nói trên các mảng nhận dạng giọng nói, chuyển văn bản thành giọng nói, thoại-đối-thoại và hiểu giọng nói. Được xây dựng từ hơn 1 triệu đánh giá của con người, bộ đo này kiểm tra hơn 40 mô hình trên 15+ chiều đánh giá và cho thấy các hệ thống hiện nay đang ngày càng chuyên biệt thay vì có một mô hình tốt nhất duy nhất.
- 6Hugging Face Blog·27/5/2026product_launchReachy Mini giờ có thể chạy hoàn toàn cục bộ
Hugging Face cho biết bộ xử lý hội thoại của Reachy Mini giờ có thể chạy hoàn toàn trên phần cứng cục bộ thay vì gửi âm thanh lên máy chủ. Giải pháp này dùng chuỗi speech-to-speech gồm llama.cpp, Silero VAD, Parakeet-TDT 0.6B v3 cho STT và Qwen3-TTS, cho phép trò chuyện riêng tư, ngoại tuyến với robot.
- 7Hugging Face Blog·24/3/2026framework_updateHugging Face giới thiệu EVA để đánh giá tác nhân giọng nói
Các nhà nghiên cứu AI của ServiceNow giới thiệu EVA, một khung đánh giá đầu cuối cho tác nhân giọng nói hội thoại, đo đồng thời độ chính xác nhiệm vụ và chất lượng tương tác bằng lời nói. Khung này đưa ra hai điểm số EVA-A và EVA-X, kèm bộ dữ liệu hàng không cùng kết quả benchmark cho các hệ thống cascade và audio-native.