博客
產品動態、模型指南,以及 AI 語音相關的實戰工作流。
Research2026-07-01
Fish Audio S2.1 Pro: high-quality AI text to speech and voice cloning
A next-generation multilingual TTS model for creators and developers.
TTS 模型指南2026-03-19
小米 MiMo-V2-TTS:文本驅動的高表達 TTS
從自由文本風格指令到非語言事件與演唱能力:MiMo-V2-TTS 把“表達”做成了真正的語音生成能力。
Prompt 模板2026-03-19
MiMo-V2-TTS 風格指令寫法
把情緒、語速、停連、音色質感和表演意圖寫成 1-2 句,形成可複製的配音模板。
非語言事件2026-03-19
MiMo-V2-TTS 非語言事件寫法
停頓、呼吸、嘆氣、咳嗽、笑聲這些細節,決定了“像機器人”還是“像真人表演”。
演唱能力2026-03-19
MiMo-V2-TTS 演唱能力與提示詞
把“像在唱”的意圖寫清楚:節奏、情緒張力、收尾方式,能顯著改變聽感。
教程2026-03-13
如何用 Fish Audio API 製作有聲書
Fish Audio 是目前最自然的 AI 語音模型之一。本文介紹如何通過 Kitta Audio(基於 Fish Audio API 構建)完成一本有聲書的完整製作流程。
創作者指南2026-03-13
Fish Audio 聲音克隆 YouTube 創作者完整指南
克隆一次你的聲音,為所有視頻生成配音——無需每次錄音。本文介紹如何通過 Kitta Audio(基於 Fish Audio API)建立高效的 YouTube 配音工作流。
產品發佈2026-03-02
Kitta Audio S2 模型發佈:AI語音合成進入2.0時代
更自然的情感表達、更精細的控制能力、更低的延遲——Kitta Audio S2開啟AI語音新紀元
對比評測2025-03-14
2025 年最佳 ElevenLabs 替代方案
ElevenLabs 很流行,但不是唯一選擇。這裡整理了值得考慮的 AI 語音工具,以及 Kitta Audio 為什麼更突出。
應用場景2025-03-14
有聲書聲音克隆:用 AI 製作專業旁白
AI 聲音克隆正在重塑有聲書製作——更低成本、更快交付、更一致的聲音表現。
應用場景2025-03-14
AI 配音:用 AI 把視頻配成任意語言
傳統配音昂貴且週期長。AI 配音可以在數小時內完成多語種本地化,而不是數週。