Produktübersicht
Mitsuko ist ein KI-gestütztes Tool für professionelle Untertitelübersetzung und Audio-Transkription mit folgenden Kernfunktionen:
- Untertitelübersetzung: Unterstützt SRT- und ASS-Dateien mit KI-Modellen wie Gemini, Claude und GPT
- Audio-Transkription: Erzeugt perfekt synchronisierte Untertitel aus Audiodateien
- Kontextextraktion: Sichert konsistente Übersetzungen über mehrere Szenen und Episoden
Hauptvorteile:
- Kontextbewusst: Bevorzugt sinnvolle statt wörtliche Übersetzungen
- Kulturelle Anpassung: Berücksichtigt kulturelle Unterschiede und Redewendungen
- Tonangleichung: Passt Übersetzungen an Charakterstimmen an
Produktfunktionen
Untertitelübersetzung
- Kontextbewusst: Sinn vor wörtlicher Übersetzung
- Tonangleichung: Anpassung an Charakterstimmen
- Kulturelle Anpassung: Berücksichtigung kultureller Nuancen
- Benutzerdefinierte Anweisungen: Steuerung des Übersetzungsprozesses
Audio-Transkription
- Präzise Zeitachsen: Perfekte Synchronisation mit Audio
- Intelligente Segmentierung: Satz- und klauselbasierte Aufteilung
- Benutzerdefinierte Anweisungen: Optimierung der Ergebnisse
- Mehrfachquellen: Extraktion aus Untertiteln, Audio oder Text
- Strukturierte Dokumente: Erzeugung kontextueller Referenzen
- Episodenübergreifende Konsistenz: Einheitliche Übersetzungen
Technische Grundlagen
Der Arbeitsablauf von Mitsuko:
flowchart TD
A[Eingabe Untertitel/Audio] --> B[Kontextextraktion]
B --> C[KI-Modell-Verarbeitung]
C --> D[Übersetzung/Transkription]
D --> E[Ergebnisausgabe]
Preisgestaltung
Mitsuko verwendet ein flexibles Credit-System mit folgenden Modellkosten:
| Modelltyp |
Input Token Kosten |
Output Token Kosten |
Kontextlänge |
Max Tokens |
| DeepSeek R1 |
0.607 |
2.41 |
128k |
128k |
| Gemini 2.5 Pro |
1.5 |
12 |
1M |
66k |
| Claude 3.7 Sonnet |
3.6 |
18 |
200k |
64k |
| GPT-4o |
3 |
12 |
128k |
16k |
Audio-Transkriptionskosten:
- Kosten variieren nach Audiolänge (z.B. 2760 Credits/Minute für ≤100 Minuten)

Anwendung
- Datei hochladen: Untertitel oder Audio bereitstellen
- Modell wählen: KI-Modell auswählen
- Anweisungen hinzufügen (optional): Übersetzung steuern
- Verarbeitung starten: Automatische Übersetzung/Transkription
- Ergebnis herunterladen: Fertige Datei erhalten
Vorteile
- Hochwertige Übersetzungen: Besser als herkömmliche Tools
- Kontextverständnis: Natürliche, konsistente Ergebnisse
- Flexibles Preismodell: Credits für verschiedene Bedürfnisse
- Multi-Modell-Support: Nutzung verschiedener KI-Modelle
Nachteile
- Credit-Kosten: Höhere Modelle sind teurer
- Einarbeitungszeit: Benutzerdefinierte Anweisungen erfordern Übung
Fallbeispiel
Originaluntertitel (wütender Charakter):
もう我慢できない!
Mitsuko-Übersetzung (kontextbewusst):
I've had enough of this!
Traditionelle Übersetzung (wörtlich):
I cannot endure anymore!
Support & Service
- Discord-Community: Unterstützung via Discord
- GitHub: Open-Source-Projekte
- Kundenservice: Kontakt über Website
Häufige Fragen
SRT und ASS
Mit benutzerdefinierten Anweisungen
Basierend auf Input/Output Tokens
Präzise synchronisierte Untertitel
Ja, abhängig vom Modell
Aus Untertiteln, Audio oder Text
Ja, mit Dateigrößenbeschränkung
Kommentare