Fish Audio
Hanabi AI Inc.
สังเคราะห์เสียงแบบเรียลไทม์ที่ถ่ายทอดอารมณ์ได้ดี และโคลนเสียงจากไฟล์ 15 วินาที รองรับกว่า 30 ภาษา

แพลตฟอร์ม
ภาพรวม
Fish Audio คือแพลตฟอร์ม AI ด้านเสียงที่ดำเนินงานโดย Hanabi AI Inc. โดยอธิบายโมเดลล่าสุด S2.1 Pro ว่าเป็นโมเดลเสียงแบบเรียลไทม์ที่แสดงอารมณ์ได้ดีที่สุดและควบคุมอารมณ์ได้ สามารถกำกับอารมณ์และลีลาการพูดด้วยแท็กอย่าง [laughing] หรือ [whispering] แพลตฟอร์มมีทั้งการโคลนเสียงจากไฟล์เสียง 15 วินาที การรู้จำเสียงพูด และ API สำหรับเอเจนต์เสียง รองรับมากกว่า 30 ภาษา และมีคลังเสียงสาธารณะมากกว่า 2 ล้านเสียง แพ็กเกจฟรีใช้ได้เฉพาะส่วนบุคคล การใช้งานเชิงพาณิชย์ต้องสมัครแพ็กเกจเสียเงิน อินเทอร์เฟซรองรับหลายภาษา
ฟีเจอร์หลัก
- สังเคราะห์เสียงพร้อมแท็กอารมณ์ (S2.1 Pro)
- โคลนเสียงจากไฟล์ 15 วินาที
- รู้จำเสียงพูด (Speech to Text)
- API สำหรับเอเจนต์เสียง
- รองรับมากกว่า 30 ภาษา
- คลังเสียงมากกว่า 2 ล้านเสียง
- อินเทอร์เฟซหลายภาษา
การใช้งานที่แนะนำ
งานเสียง
- เสียงบรรยายวิดีโอ
- หนังสือเสียง
- เสียงตัวละคร
- แชทบอทด้วยเสียง
ราคา
ยังไม่ได้ยืนยันข้อมูลราคา โปรดตรวจสอบที่เว็บไซต์ทางการ
ภาพหน้าจอ

เครื่องมือ AI ที่เกี่ยวข้อง
ElevenLabs
ElevenLabs เป็นบริการ AI สร้างเสียงที่นำไปใช้กับการบรรยายและการพากย์เสียงได้
Cartesia
API สังเคราะห์เสียงและรู้จำเสียงพูดแบบเรียลไทม์ เน้นการสร้างเอเจนต์เสียง
Murf AI
Murf AI เป็นบริการ AI ด้านการสร้างเสียงด้วย AI ที่นำไปใช้งานได้ เช่น การบรรยาย (Narration) หรือ การผลิตวิดีโอ
Hume AI
API เสียงที่เน้นเรื่องอารมณ์ ทั้งสังเคราะห์เสียง อินเทอร์เฟซเสียงสนทนา และการวัดการแสดงออก