Fish Audio
Hanabi AI Inc.
Tổng hợp giọng nói thời gian thực giàu cảm xúc và nhân bản giọng từ 15 giây, hỗ trợ hơn 30 ngôn ngữ.

Nền tảng
Tổng quan
Fish Audio là nền tảng AI giọng nói do Hanabi AI Inc. vận hành. Mô hình mới nhất S2.1 Pro được mô tả là mô hình giọng nói thời gian thực giàu biểu cảm nhất và kiểm soát được cảm xúc, cho phép chỉ định cảm xúc và cách nói bằng các thẻ như [laughing] hay [whispering]. Nền tảng có nhân bản giọng nói chỉ từ 15 giây âm thanh, nhận dạng giọng nói và API cho tác nhân giọng nói, hỗ trợ hơn 30 ngôn ngữ, với thư viện công khai hơn 2 triệu giọng. Gói miễn phí chỉ dành cho sử dụng cá nhân; dùng cho mục đích thương mại cần gói trả phí. Giao diện có nhiều ngôn ngữ.
Tính năng chính
- Tổng hợp giọng nói với thẻ cảm xúc (S2.1 Pro)
- Nhân bản giọng nói từ 15 giây âm thanh
- Nhận dạng giọng nói (Speech to Text)
- API cho tác nhân giọng nói
- Hỗ trợ hơn 30 ngôn ngữ
- Thư viện hơn 2 triệu giọng
- Giao diện nhiều ngôn ngữ
Mục đích sử dụng đề xuất
Sản xuất âm thanh
- Lồng tiếng video
- Sách nói
- Giọng nhân vật
- Chatbot giọng nói
Bảng giá
Giá chưa được xác minh — vui lòng kiểm tra trang web chính thức.
Ảnh chụp màn hình

Công cụ AI liên quan
ElevenLabs
ElevenLabs là dịch vụ AI có thể ứng dụng trong thuyết minh hoặc lồng tiếng dưới dạng AI tạo giọng nói.
Cartesia
API tổng hợp giọng nói và nhận dạng giọng nói theo thời gian thực, hướng đến xây dựng tác nhân giọng nói.
Murf AI
Murf AI là dịch vụ thuộc lĩnh vực AI tạo giọng nói, có thể ứng dụng cho lồng tiếng (thuyết minh) và sản xuất video.
Hume AI
API giọng nói xoay quanh cảm xúc: tổng hợp giọng nói, giao diện giọng nói hội thoại và đo biểu cảm.