Kitta Audio
产品
产品
产品概览
探索一体化创作套件
声音库
适用于任意角色的音色
创建
文字转语音
生成拟人化 AI 语音
多人对话
为多角色剧本生成对话音频
语音转文字
转录音频和视频
声音设计
生成专属音色
变声器
即将上线
用任意音色输出音频
人声分离
提取清晰语音
语音克隆
克隆你的声音
音效
即将上线
生成任意声音
配音
即将上线
本地化音频内容
音乐
即将上线
将创意变成歌曲
图片
文本生成图片
视频
用文本或图片生成视频
S2
Fish Audio S2.1 Pro
支持多说话人、多轮生成,并可通过自然语言描述控制声音表现。
API
平台
概览文档API 参考文档API 密钥API 价格API 调试台
API
文字转语音
通过 API 生成语音
音乐
即将上线
通过 API 创作歌曲
语音转文字
批量转录语音
音效
即将上线
通过 API 生成音效
实时语音转文字
实时转录语音
语音克隆
克隆音色用于 TTS
语音引擎
即将上线
让智能体具备语音能力
智能体
即将上线
几分钟内部署语音智能体
配音
即将上线
通过 API 翻译视频和音频
API
Fish Audio API 快速开始
在线调试语音生成、转写与账户密钥
文字转语音
将文本转为自然流畅的语音,多模型可切换
语音转文字
高精度音频转文字,支持多语种
声音克隆
短样本一键克隆声音
配音广场
浏览公开音色并选择参考声线
AI 图片
提示词生成高质量图像
AI 视频
文字描述生成视频与风格
数字人 / 对口型
音画同步,适用于虚拟人与讲解
工作台
语音合成工作台,创建和管理您的配音项目
短视频与配音
适合社媒、广告与信息流内容
有声书与播客
长文本朗读与自然停顿
教育与培训
课程讲解与企业内训话术
公司
关于博客
资源
Coze
Tavo
SillyTavern
Dify
Open WebUI
AnythingLLM
Home Assistant
n8n
推广伙伴计划
即将上线
API 在线调试
在线试用 REST 接口与示例请求
API 密钥
在账号中心创建与管理 API 密钥
价格

让声音更有生命力

注册

从情绪化语音生成到高拟真声音复刻,覆盖内容配音和专业音频制作,帮助创作者、开发者和团队构建一站式 AI配音 工作流。

10/1000
积分消耗预览
Fish Audio S2.1 Pro Flash

1汉字 = 1积分,其他字符 = 0.5积分

情感标签(如 (happy)、(sad) 等)不计入积分消耗

字符11(9 汉字 + 2 其他)
倍数x0.5
共消耗5
10/1000
积分消耗预览
Fish Audio S2.1 Pro Flash

1汉字 = 1积分,其他字符 = 0.5积分

情感标签(如 (happy)、(sad) 等)不计入积分消耗

字符11(9 汉字 + 2 其他)
倍数x0.5
共消耗5

AI配音结果

暂无生成成结果

由 Fish Audio S2.1 Pro 提供支持
解锁全部音频功能

Kitta Audio AI配音效果演示

体验Kitta Audio超真实的AI配音克隆效果,采用业界领先的 Fish Audio AI 语音技术,从专业播音到知名艺人,完美还原每个声音的独特魅力

在一个 AI 工作台中创作、编辑和本地化语音内容

立即体验

生成超真实语音,把脚本变成配音,克隆富有表现力的声音,并为视频、有声书、播客和全球化内容准备专业音频。

在遥远的奥罗拉星外层大气中,天空闪烁着破碎的光,仿佛整颗星球的面纱由悬浮在太空中的彩色玻璃织成。

传感器以不规则的节奏跳动,那是任何算法都难以解释的信号。

描述场景并生成电影感配音 ...

一体化 AI 编辑器

在同一创作流程中编写脚本、设计场景,并生成可直接使用的专业配音。

在古老的埃尔多利亚大地上,天空闪烁着光芒,森林的风低语着秘密,住着一条名叫 Zephyros 的龙。它温柔、智慧,眼睛像古老的星辰。

中文
Amy
播放

超逼真语音

在 83 种语言中生成可控、富有表现力的语音,适配每一种故事。

音乐

一键生成录音棚级别的音乐,无论风格、类型、人声或纯乐器。

音效

自定义音效、音景和环境音,或在音效库中搜索。

音色

克隆专属声音、用提示词设计音色,或探索声音库中的上千种音色。

图片与视频

为视频、短剧、动画和全球化内容准备配音与本地化音频。

Kitta Audio API

用强大的 API 构建一切语音工作流

查看文档

文字转语音 API

面向生产环境的语音合成能力,可选择模型、控制稳定性、降低延迟并输出多语言语音。

Fish Audio S2.1 Pro

适合高品质内容的富表现力、可控语音,支持更广语言范围。

MiniMax Speech 2.8

适合角色对白和内容旁白的稳定、高表现力音色。

Qwen Audio 3.0

适合大规模生成的高性价比音色。

语音转文字 API

高精度 ASR,支持音频和视频转写,可用于说话人分离与分钟级计费场景。

Fish Audio ASR

稳定可靠的多语言音视频转写。

对口型 API

为配音和数字人工作流,根据音频和视频生成同步口型。

const response = await fetch('https://kittaai.com/api/open/tts', {
  method: 'POST',
  headers: {
    Authorization: 'Bearer YOUR_API_KEY',
    'Content-Type': 'application/json',
  },
  body: JSON.stringify({
    reference_id: 'YOUR_VOICE_MODEL_ID',
    text: '把这段产品介绍生成清晰自然的中文配音。',
  }),
});

const audioBlob = await response.blob();
S2.1 Pro
MiniMax Speech 2.8
Qwen Audio 3.0
const response = await fetch('https://kittaai.com/api/open/v1/media/lip-sync/jobs', {
  method: 'POST',
  headers: { Authorization: 'Bearer YOUR_API_KEY' },
  body: JSON.stringify({
    video_url: 'https://example.com/video.mp4',
    audio_url: 'https://example.com/audio.mp3',
  }),
});

const task = await response.json();

Kitta Audio AI配音核心功能

专业声音克隆技术

用短音频创建专属声音,保留音色、语气和表达细节,适合角色配音与品牌声音资产。

智能文字转语音

输入脚本即可生成清晰语音,支持长文本朗读、课程讲解、播客旁白和商业配音。

多语言AI配音

S2.1 Pro 支持83种语言,同一套声音可用于多语言视频、有声书和课程本地化。

专业音频处理

内置降噪、音量均衡和音质增强,减少后期修音成本,让输出更稳定。

快速生成

云端生成与批量处理适合高频创作流程,短内容可在约20秒内完成。

广泛应用场景

覆盖短剧、漫剧、视频旁白、有声书、教育课程、播客和游戏角色等内容场景。

灵活的价格方案

为不同文字转语音需求提供最优选择

免费套餐

 
¥0/字
免费
访客每日 3 次免费体验
注册即送 1000 积分
基础系统音色
AI配音最大长度 200 字
无需信用卡

Plus 月付

 
¥29/月
会员权益
声音克隆与自定义音色
所有系统音色
AI配音最大长度 1万字
多人剧本等所有高级AI功能
优先客服支持
订阅积分
每月 2 万积分(余额可持续累积)
AI配音至少 2 万字
语音转文字至少 100 分钟
对口型视频至少 200 秒
AI图片至少 125 张
AI视频至少 60 次
推荐

Pro 月付

 
¥99/月
会员权益
声音克隆与自定义音色
所有系统音色
AI配音最大长度 1万字
多人剧本等所有高级AI功能
优先客服支持
订阅积分
每月 10 万积分(余额可持续累积)
AI配音至少 10 万字
语音转文字至少 500 分钟
对口型视频至少 1000 秒
AI图片至少 625 张
AI视频至少 300 次

Max 月付

 
¥249/月
会员权益
声音克隆与自定义音色
所有系统音色
AI配音最大长度 1万字
多人剧本等所有高级AI功能
优先客服支持
订阅积分
每月 30 万积分(余额可持续累积)
AI配音至少 30 万字
语音转文字至少 1500 分钟
对口型视频至少 3000 秒
AI图片至少 1875 张
AI视频至少 900 次

需要API或开发票等定制服务?请联系我们的客服

生成前即可查询所有公开业务、模型、计费单位和对应积分。 查看完整积分规则 →

Kitta Audio AI配音常见问题

了解语言支持、声音克隆、API、费用和内容制作场景

基于 Fish Audio S2.1 Pro,Kitta Audio 支持 83 种语言的文字转语音与多语言配音,包括中文、英文、日语、韩语、西班牙语、法语、德语、俄语、阿拉伯语等。多数情况下只需要输入目标语言文本,系统会自动处理语言识别与生成。

建议使用本人或已授权的清晰录音,尽量减少背景噪声、混响和多人说话。短样本可以快速体验,更长、更稳定的样本通常有助于提升音色还原和语气一致性。请不要上传未获授权的真人声音素材。

Kitta Audio 适合短剧和漫剧配音、视频旁白、YouTube 或 TikTok 内容、有声书、播客、教育课程、游戏角色语音和多语言本地化。对于需要频繁改稿、批量生成或多角色配音的团队,AI 配音能明显缩短制作周期。

AI 文字转语音更适合快速试音、批量产出、多语言版本和持续迭代,不需要反复预约录音棚或等待返稿。真人配音仍然适合对表演细节要求极高的最终成片;两者也可以结合使用,用 AI 先完成草稿和多语言版本验证。

是否可商用取决于当前套餐、使用政策和声音授权情况。你可以先用免费额度测试音质、语气和工作流;如果要用于广告、课程、影视、游戏或客户项目,建议使用已授权声音,并按当前付费方案和服务条款执行。

可以。开发者可以通过 Fish Audio API 工作流接入文本转语音、声音模型和音频生成能力。通常只需要在请求中选择对应模型参数,即可在原型测试、内容工具、自动化配音或多语言产品中集成。

建议使用清晰的文本分段、自然标点和明确的说话场景,避免一次输入过长且缺少停顿的内容。选择合适音色后,可以先生成短段试听,再调整文本、语气提示、语速和音量,最后用于完整内容生产。

产品

  • 文字转语音
  • 多人对话
  • 语音转文字
  • 声音设计
  • 变声器即将上线
  • 人声分离
  • 声音克隆
  • 音效即将上线
  • 配音即将上线
  • 音乐即将上线
  • 图片
  • 视频

解决方案

  • 短视频与配音
  • 有声书与播客
  • 教育与培训

研究

  • Fish Audio S1
  • Fish Audio S2 Pro
  • Fish Audio S2.1 Pro

资源

  • 文档
  • API 参考文档
  • 模型库
  • 声音克隆教程
  • 产品对比

公司

  • 关于
  • 博客
Kitta AudioPowered by Fish Audio
© 2026 Kitta Audio。保留所有权利。Kitta AI|隐私政策|服务条款|举报滥用|support@kittaai.com
support@kittaai.com

Kitta Audio 由 Kitta AI 独立运营,非 Fish Audio 官方服务。