Kitta AI
Produkte
Produkte
Produktübersicht
Entdecken Sie die All-in-one-Kreativsuite
Stimmenbibliothek
Stimmen für jede Rolle und Figur
Erstellen
Text zu Sprache
Erzeugen Sie natürliche KI-Sprache
Mehrsprecher-Dialog
Erstellen Sie Dialogaudio aus Skripten mit mehreren Rollen
Sprache zu Text
Transkribieren Sie Audio und Video
Stimmendesign
Erzeugen Sie eigene Stimmen
Stimmenveränderer
Demnächst
Geben Sie Audio mit jeder Stimme aus
Stimmisolierung
Extrahieren Sie klare Sprache
Stimmenklonen
Klonen Sie Ihre Stimme
Soundeffekte
Demnächst
Erzeugen Sie beliebige Klänge
Synchronisation
Demnächst
Lokalisieren Sie Audioinhalte
Musik
Demnächst
Verwandeln Sie Ideen in Songs
Bilder
Erzeugen Sie Bilder aus Text
Videos
Erzeugen Sie Video aus Text oder Bildern
S2
Fish Audio S2.1 Pro
Mehrsprecher- und Mehr-Runden-Generierung mit Steuerung der Stimmwirkung per natürlicher Sprache.
API
Plattform
ÜbersichtDokumentationAPI-ReferenzAPI-SchlüsselAPI-PreiseAPI Playground
API
Text zu Sprache
Erzeugen Sie Sprache über die API
Musik
Demnächst
Erstellen Sie Songs über die API
Sprache zu Text
Transkribieren Sie Sprache stapelweise
Soundeffekte
Demnächst
Erzeugen Sie Soundeffekte über die API
Echtzeit-Sprache zu Text
Transkribieren Sie Sprache in Echtzeit
Stimmenklonen
Klonen Sie Stimmen für TTS
Sprach-Engine
Demnächst
Geben Sie Agenten Sprachfunktionen
Agenten
Demnächst
Stellen Sie Sprachagenten in Minuten bereit
Synchronisation
Demnächst
Übersetzen Sie Video und Audio über die API
API
Fish Audio API Schnellstart
Testen Sie Spracherzeugung, Transkription und Kontoschlüssel online
Text-zu-Sprache
Mit Fish Audio, MiniMax, Qwen u. a. in natürliche Sprache umwandeln
Sprache zu Text
Hochgeladenes Audio präzise transkribieren
Stimmklon
Ihre Stimme in etwa einer Minute aus kurzen Samples
Stimmengalerie
Öffentliche Modelle ansehen und Referenzstimme wählen
KI-Bild
Bilder mit führenden Modellen aus Prompts erzeugen
KI-Video
Videos aus Textbeschreibungen und Stilen erstellen
Lippensync & Digital Human
Sprache und Bild für Avatare und Präsentationen synchronisieren
Stimm-Workspace
Workspace für Sprachsynthese und Projekte
Kurzvideo & Synchronisation
Schnelle Voiceovers für Social, Ads und UGC
Hörbuch & Podcast
Lange Erzählungen mit natürlichem Tempo
Bildung & Training
Klare Vorlesestimmen für Kurse und interne Kommunikation
Unternehmen
Über unsRatgeber
Ressourcen
Coze
Tavo
SillyTavern
Dify
Open WebUI
AnythingLLM
Home Assistant
n8n
Partnerprogramm
Demnächst
API-Spielplatz
REST-Endpunkte online mit API-Key testen
API-Schlüssel
Tokens erstellen und verwalten
Preise

API-Dokumentation und Playground

Wählen Sie eine API, um Endpoints, Parameter und Live-Tests mit Ihrem API-Schlüssel zu sehen.

API-Schlüssel erstellen oder verwaltenAuthentifizierung mit API-SchlüsselAPI-Schnellstart
  • Text zu Sprache (HTTP)

    REST-Synthese mit Sprachmodell-ID und Engine-Optionen.

    POST/api/open/v1/speech/tts
  • Text zu Sprache (HTTP) WebSocket

    Sprachstreaming per WebSocket für Echtzeit-Anwendungen.

    WS/v1/tts/live
  • Text zu Sprache (HTTP v2) WebSocket v2

    Sprachstreaming per WebSocket für Echtzeit-Anwendungen.

    WS/v2/tts/live
  • Asynchrones TTS — Job erstellen

    Erstellen Sie einen langlaufenden TTS-Job und pollen Sie das Ergebnis.

    POST/api/open/v1/speech/tts/jobs
  • Asynchrones TTS — Jobs auflisten

    Listen Sie aktuelle asynchrone TTS-Jobs Ihres API-Keys auf.

    GET/api/open/v1/speech/tts/jobs
  • Asynchrones TTS — Job abfragen

    Rufen Sie Status und Ausgabe eines TTS-Jobs per ID ab.

    GET/api/open/v1/speech/tts/jobs/{taskId}
  • Sprache zu Text

    Audio von einer öffentlichen URL transkribieren.

    POST/api/open/v1/speech/transcriptions
  • Stimmklon - Modell erstellen

    Referenz-Audio hochladen und ein Stimmenmodell erstellen.

    POST/api/open/v1/voices
  • Stimmklon — Modell abrufen

    Rufen Sie ein einzelnes Stimmmodell per ID ab.

    GET/api/open/v1/voices/{voiceId}
  • Stimmklon - Modell löschen

    Ein Stimmenmodell per ID entfernen.

    DELETE/api/open/v1/voices/{voiceId}
  • Stimmklon - Modelle listen

    Öffentliche und persönliche Stimmenmodelle anzeigen.

    GET/api/open/v1/voices
  • Stimmdesign — erstellen

    Erzeugen Sie Vorschaukandidaten aus einem Prompt.

    POST/api/open/v1/voice-designs
  • Stimmdesign — Stimme speichern

    Speichern Sie einen Kandidaten als dauerhaftes Stimmmodell.

    POST/api/open/v1/voice-designs/{designId}/voices
  • Stimmdesign — Vorschaudio

    Laden Sie authentifiziertes Vorschaudio eines Kandidaten herunter.

    GET/api/open/v1/voice-designs/{designId}/candidates/{candidateId}/audio
  • Lip-sync - Aufgabe erstellen

    Eine Aufgabe zur Lip-sync-Videogenerierung erstellen.

    POST/api/open/v1/media/lip-sync/jobs
  • Lip-sync - Aufgabe abfragen

    Status und Ergebnis per ID abfragen.

    GET/api/open/v1/media/lip-sync/jobs/{jobId}
  • Lip-sync - Aufgaben listen

    Lip-sync-Aufgaben und Statistiken anzeigen.

    GET/api/open/v1/media/lip-sync/jobs
  • Medienmodelle

    Listen Sie verifizierte KI-Bild- und Videomodelle auf.

    GET/api/open/v1/media/models
  • Bild — Job erstellen

    Erstellen Sie einen KI-Bilderzeugungs- oder Bearbeitungsjob.

    POST/api/open/v1/media/images/jobs
  • Bild — Job abfragen

    Rufen Sie einen KI-Bildjob per ID ab.

    GET/api/open/v1/media/images/jobs/{jobId}
  • Video — Job erstellen

    Erstellen Sie einen KI-Videogenerierungsjob.

    POST/api/open/v1/media/videos/jobs
  • Video — Job abfragen

    Rufen Sie einen KI-Videojob per ID ab.

    GET/api/open/v1/media/videos/jobs/{jobId}
  • Benutzerprofil

    Verbleibende API-Quote und Kontoinformationen anzeigen.

    GET/api/open/v1/profile
  • Benutzerprofil — aktualisieren

    Aktualisieren Sie Open-API-Profileinstellungen.

    POST/api/open/v1/profile