Um aus einem PDF Sprache zu machen, öffne PDF in Audio, lade die Datei hoch, wähle eine Stimme und lade ein MP3 oder WAV herunter. File Transmute extrahiert den Text und synthetisiert ihn mit einer neuronalen Stimme, die auf deinem Gerät läuft — dein Dokument wird also nie hochgeladen.
Warum Sprachausgabe nützlich ist
Zuhören lässt dich Berichte, Artikel und Lernstoff durcharbeiten, während du pendelst, gehst oder deine Augen ausruhst — und es ist eine echte Hilfe zur Barrierefreiheit. Der Haken bei den meisten Sprachausgabe-Diensten ist, dass sie deinen Text hochladen und jedes Zeichen abrechnen. Eine Stimme auf dem Gerät beseitigt beide Probleme.
Natürliche Stimmen, auf dem Gerät
File Transmute führt ein neuronales Sprachmodell mit 82 Millionen Parametern (Kokoro) direkt in deinem Browser über WebAssembly aus. Das Modell wird bei der ersten Nutzung einmalig heruntergeladen und synthetisiert dann lokal: Dein Text verlässt das Gerät nie, und es gibt keine Kosten oder Grenzen pro Zeichen.
So konvertierst du
- Aus einem Dokument: PDF in Audio oder Word in Audio — der Text wird extrahiert und dann gesprochen.
- Aus getipptem oder eingefügtem Text: Sprachausgabe.
- Wähle eine Stimme und exportiere als MP3 oder WAV; das Audio wird auf deinem Gerät erzeugt und sofort heruntergeladen.
Tipp: Hol dir zuerst sauberen Text
Bei einem gescannten PDF (einem Bild von Text) führe zuerst Bild in Text (OCR) oder PDF in Text aus, damit die Wörter erkannt werden, und gib das dann in die Sprachausgabe ein, um das beste Ergebnis zu erzielen.