Kurzfazit: Für alle, die mit dem Handy Podcasts, Sprachnachrichten oder Vorträge aufnehmen und von Tontechnik nichts wissen wollen: Auphonic entfernt Rauschen und Hall, gleicht die Lautstärke an und macht in 10 Minuten aus deiner Rohaufnahme eine saubere MP3. Das kostet 0 € für bis zu 2 Stunden Audio im Monat, ohne Kreditkarte. Die ehrliche Grenze: Jede Gratis-Produktion enthält einen Auphonic-Jingle, und Auphonic darf deine Aufnahme zur Verbesserung seiner Algorithmen nutzen.
Der Kühlschrank brummt, das Zimmer hallt, mal bist du zu leise, mal zu laut, und zwischen den Sätzen hängt ein Ähm am nächsten. Auphonic repariert das ohne Tontechnik-Wissen: Datei hochladen, Haken setzen, rechnen lassen. Die 10 Minuten sind Stufe 1, die 40 Minuten die ganze Anleitung.
Was das kostet
| Baustein | Preis | Ehrliche Grenze |
|---|---|---|
| Auphonic Free | 0 € pro Monat | 2 Stunden Audio im Monat, Auphonic-Jingle in jeder Produktion, keine Spracherkennung, nicht genutzte Stunden verfallen am Monatsende |
| Auphonic One-Time Credits (optional) | 11 € netto für 5 Stunden | Kein Jingle, die Credits verfallen nie |
| Auphonic S (optional) | 12 € netto pro Monat für 9 Stunden, jährlich bezahlt 10 € pro Monat | Nicht genutzte Stunden verfallen am Monatsende |
| Smartphone mit Sprachmemo-App | 0 €, vorhandenes Gerät | Je näher du am Mikrofon sprichst, desto weniger muss Auphonic retten |
| ChatGPT, Claude oder Gemini für die Prompts (optional) | 0 € im Gratisplan | Nutzungslimits je nach Anbieter |
Quellen: die Auphonic-Preisseite und die Pricing FAQ, abgerufen am 3. Oktober 2026, alle Auphonic-Preise ohne Mehrwertsteuer. Für dieses Tutorial zählt die erste Zeile: Pro Produktion berechnet Auphonic mindestens 3 Minuten, deine Testaufnahme kostet also 3 von 120 Freiminuten. Neu rechnen mit anderen Einstellungen kostet nichts.
Stufe 1: Anfänger, deine erste saubere Aufnahme in 10 Minuten
Was du brauchst
- Einen Rechner mit Browser, installiert wird nichts.
- Eine E-Mail-Adresse oder ein Google- oder Apple-Konto.
- Eine Aufnahme deiner Stimme, ein bis drei Minuten lang, oder eine vorhandene Sprachnachricht.
- Ein bisschen Englisch: Die Auphonic-Website gibt es nur auf Englisch.
Schritt für Schritt
- Aufnehmen: Nimm mit der Sprachmemo-App deines Handys zwei Minuten in einem normalen Zimmer auf, frei oder mit dem Text aus dem Starter-Prompt unten. Wähl die beste Qualität, Auphonic rät in der Produktionshilfe bei MP3 zu mindestens 192 kbit/s.
- Datei auf den Rechner holen: per Mail, AirDrop, Kabel oder Cloud. Auphonic nimmt laut Produktionshilfe unter anderem M4A, MP3, WAV, OPUS, OGG und Videodateien an.
- Konto anlegen: Auf auphonic.com/accounts/register klickst du Create an Auphonic Account oder nimmst Sign in with Google beziehungsweise Sign in with Apple. Im Formular füllst du Username, E-mail und zweimal das Passwort aus und klickst Create Account, Zahlungsdaten fragt es nicht ab.
- Neue Produktion öffnen: Eingeloggt gehst du auf auphonic.com/engine/upload, laut Hilfe der direkte Weg zu einer neuen Produktion. Eine Produktion ist bei Auphonic genau eine bearbeitete Datei.
- Datei hochladen: Im Bereich für die Quelldatei (in der Hilfe Audio or Video Source) lädst du deine Aufnahme im Browser hoch.
- Algorithmen prüfen: Unter Audio Algorithms sind laut Auphonics Optionsliste Adaptive Leveler (gleicht laute und leise Stellen an), Filtering und Loudness Normalization mit dem Loudness Target „-16 LUFS (Podcasts and Mobile)“ voreingestellt. Prüf, ob zusätzlich Noise Reduction eingeschaltet ist, und wähl als Denoising Method „Dynamic: keep speech and music, remove everything else“. Cut Fillers und Cut Silence bleiben beim ersten Durchlauf aus.
- Starten: Klick auf Start Production. Eine feste Bearbeitungszeit nennt Auphonic nicht, nach erfolgreicher Verarbeitung leitet es dich laut Hilfe auf die Ergebnisseite weiter.
- Vergleichen: Der Auphonic Editor auf der Ergebnisseite zeigt Eingangsdatei (Input) und Ergebnis (Output) als Wellenform. Laut Editor-Hilfe spielt immer nur eine Spur, ein Klick auf die Spur schaltet um. Hör dieselbe Stelle erst im Input, dann im Output, am besten mit Kopfhörern.
- Herunterladen: Lade die fertige Datei auf der Ergebnisseite herunter.
Die leise und die laute Passage zeigen dir den Leveler bei der Arbeit, die Ähms brauchst du in Stufe 2.
So klingt ein gutes Ergebnis: Laute und leise Stellen liegen nah beieinander, das Brummen zwischen den Sätzen ist weg, deine Stimme klingt näher und klarer. Irgendwo in der Datei hörst du außerdem den Auphonic-Jingle, das ist der Preis des Gratisplans.
Wenn du kaum einen Unterschied hörst: Dann war deine Aufnahme schon sauber, oder du hörst über Laptop-Lautsprecher. Nimm Kopfhörer, oder nimm noch einmal neben einem laufenden Lüfter auf.
Das ist dein erstes Ergebnis: deine eigene Aufnahme, entrauscht, ausgeglichen und auf Podcast-Lautstärke gebracht, als Datei auf deinem Rechner.
Akademie-Training Platz vormerkbar
KI-Kompetenz nach Art. 4 KI-VO
490 € pro Platz, netto zzgl. USt. Einsteiger · 6 Wochen, online, im eigenen Tempo
Stufe 2: Fortgeschritten, Rauschen, Hall und Ähms gezielt einstellen
Ändere die Einstellungen immer in derselben Produktion über Edit Production, statt die Datei neu hochzuladen. Laut Editor-Hilfe ist das Neurechnen über Edit Production oder Apply Changes kostenlos, eine neue Produktion kostet wieder Credits. Weitere Regler zeigt Auphonic, wenn du rechts neben einem Algorithmus auf das Schieberegler-Symbol klickst. Die Werte stammen aus der Algorithmen-Doku und der Optionsliste der Auphonic-Schnittstelle, abgerufen am 3. Oktober 2026.
| Was dich stört | Einstellung | Wert für den Anfang |
|---|---|---|
| Lüfter, Straße, Kühlschrank | Denoising Method plus Rauschminderung, je nach Version Remove Noise oder Noise Reduction Amount | „Dynamic“, „100 dB (full)“ |
| Hall im Bad oder leeren Zimmer | Remove Reverb | voll, bei sterilem Klang niedriger |
| Hörbare Atemzüge | Remove Breaths | „12 dB (medium)“, nur mit Dynamic oder Speech Isolation |
| Musik oder Fernseher im Hintergrund | Denoising Method | „Speech Isolation“, entfernt alles außer Sprache |
| Ähm, äh, mh | Cut Fillers | an, laut Doku auch mit deutschen Daten trainiert |
| Lange Pausen | Cut Silence | an, gewollte Pausen zwischen Sätzen bleiben laut Doku erhalten |
| Dumpfer Klang, Messenger- oder Telefonqualität | Filtering Method | „Voice AutoEQ + Bandwidth extension“ oder „Studio Voice (Beta)“ |
| Lebendige Erzählung klingt platt | Leveler Strength | „70% (DynRange +3dB)“ statt 100 % |
| Ziel ist YouTube oder Spotify | Loudness Target | „-14 LUFS“, für Podcasts bleibt es bei -16 |
Die Voice AutoEQ entschärft laut Doku scharfe S-Laute und Plopp-Geräusche, Plopps am wirksamsten zusammen mit Dynamic oder Speech Isolation, so wie im Rezept.
Im Editor siehst du jeden Schnitt als markierten Bereich. Einen misslungenen wählst du aus, deaktivierst ihn mit Deactivate Cut oder der Taste C und klickst Apply Changes. Studio Voice (Beta) rekonstruiert laut Auphonic-Blog eine klare Stimme aus komprimierten Aufnahmen wie Videocalls, auch nur für einzelne Abschnitte. Es gehört zum Bereich Filtering, den die Preisseite auch im Gratisplan führt, und kann als Beta noch Fehler machen.
Die drei Fehler, die dir garantiert begegnen
Deine Stimme klingt blechern oder wie ein Roboter. Bei starkem Störgeräusch oder viel Hall muss jeder Entrauscher harte Entscheidungen treffen und verzerrt laut Auphonic manchmal die Stimme. Stell die Rauschminderung auf „12 dB (medium)“ und lass etwas Raumklang stehen, oder wähl „Studio Voice (Beta)“ als Filtering Method. Es läuft nach dem Entrauscher und repariert genau diese Schäden.
Ein Schnitt klickt oder verschluckt ein Wortende. Die Doku empfiehlt Cut Fillers nur zusammen mit Dynamic oder Speech Isolation, sonst erzeugen Rauschen und Hall Artefakte an den Schnittstellen. Schalte Dynamic ein, deaktivier den Schnitt im Editor oder wähl als Cut Mode „Set Cuts To Silence“. Dann blendet Auphonic die Stelle nur aus.
In deiner Datei läuft eine Melodie, die du nie aufgenommen hast. Das ist der Auphonic-Jingle, den laut Preisseite jede Gratis-Produktion enthält. Privat ignorierst du ihn. Zum Veröffentlichen brauchst du Credits, Produktionen damit enthalten laut Preisseite keinen Jingle, das kleinste Paket kostet 11 € netto für 5 Stunden.
Passt alles, speicherst du die Einstellung als Preset: Über auphonic.com/engine/preset legst du laut Preset-Hilfe eines an und wählst es künftig beim Anlegen jeder Produktion aus.
Stufe 3: Experte, als Podcastfolge oder Video veröffentlichen
Das richtige Ausgabeformat
Unter Output Files legst du fest, was Auphonic erzeugt, auch mehrere Formate auf einmal. Für einen Podcast nimmst du MP3. Für Instagram, LinkedIn oder YouTube wählst du Audiogram (Waveform Video): laut Produktionshilfe ein Video mit animierter Wellenform vor deinem Cover Image. Beides ist laut Preisseite im Gratisplan enthalten. Das Cover lädst du unter Basic Metadata hoch, die Folgenbeschreibung gehört unter Extended Metadata ins Feld Summary / Description.
Kapitel und Beschreibung mit einem Prompt
Kapitelmarken setzt du im Gratisplan von Hand, automatisch erzeugt Auphonic sie nur mit Credits. Laut Produktionshilfe kannst du sie als Textdatei importieren, eine Zeile pro Kapitel mit Zeitstempel und Titel. Notier dir beim Durchhören, wann ein neues Thema beginnt:
Den dritten Block speicherst du als kapitel.txt und importierst ihn bei den Kapitelmarken. Schneidet Auphonic Pausen heraus, passt es die Kapitelzeiten laut Doku selbst an.
Intro und Outro: Auphonic hängt beide automatisch an, gleicht laut Produktionshilfe aber nur ihre Lautstärke an, ohne Entrauschen oder Leveler. Schick dein eingesprochenes Intro deshalb erst als eigene Produktion durch Auphonic. Die Intro-Länge zählt laut Pricing FAQ mit: 20 Minuten Folge plus 1 Minute Intro verbrauchen 21 Minuten.
Veröffentlichen
Du lädst die MP3 selbst bei deinem Podcast-Host hoch, oder Auphonic liefert direkt aus. Laut Hilfe zu den externen Diensten gehören YouTube, Buzzsprout, Spreaker, Acast, RSS.com sowie die deutschen Hosts LetsCast.fm und Podcaster.de dazu. Die automatische Veröffentlichung ist laut Preisseite auch im Gratisplan enthalten.
Ehrliche Grenzen
- 2 Stunden im Monat. Für eine wöchentliche Folge von 30 Minuten reicht das nicht ganz.
- Keine Spracherkennung im Gratisplan. Transkript, automatische Shownotes und Kapitel sowie eingebrannte Untertitel gibt es nur mit Credits.
- Datenschutz. Laut Datenschutzerklärung verarbeitet Auphonic vor allem auf Servern bei Hetzner in Deutschland, Mediendateien aus der EU bleiben in der EU. Hochgeladene Inhalte darf Auphonic aber zur Verbesserung seiner Algorithmen nutzen und dafür anhören lassen, ein Opt-out gibt es nur für Geschäftskunden. Lade keine vertraulichen Gespräche hoch und frag andere Stimmen in deiner Aufnahme vorher um Erlaubnis. Das ist keine Rechtsberatung.
- Automatische Löschung. Produktionen löscht Auphonic laut Datenschutzerklärung nach 21 Tagen, Video-Produktionen nach 7 Tagen. Lade Ergebnisse gleich herunter.
Auphonic oder Descript
Auphonic poliert nur den Klang. Willst du Sätze umstellen oder Versprecher im Transkript wegschneiden, ist Descript das bessere Werkzeug.
Häufige Fragen zu Sprachaufnahmen mit Auphonic
Kann ich eine Sprachaufnahme kostenlos verbessern?
Ja, mit Auphonic für bis zu 2 Stunden Audio im Monat. Rausch- und Hallentfernung, Leveler und der Schnitt von Füllwörtern sind enthalten, dafür steckt in jeder Gratis-Produktion ein Auphonic-Jingle (Preisseite, abgerufen am 3. Oktober 2026).
Was kostet Auphonic ohne Jingle?
Mindestens 11 € netto, so viel kosten 5 Stunden One-Time-Credits, die nie verfallen. Das kleinste Abo S kostet 12 € netto im Monat für 9 Stunden, jährlich bezahlt 10 € im Monat.
Wie verbessere ich den Ton meines Podcasts?
Mit drei Einstellungen: Noise Reduction mit der Methode Dynamic, dem Adaptive Leveler und dem Loudness Target von -16 LUFS. Noch mehr bringt eine Aufnahme nah am Mikrofon in einem Raum mit Teppich oder Sofa.
Kann Auphonic Hall entfernen?
Ja. Mit den Methoden Static, Dynamic oder Speech Isolation entfernt Remove Reverb den Hall, standardmäßig vollständig. Klingt es zu trocken, stellst du einen niedrigeren Wert ein.
Funktioniert das auch mit WhatsApp-Sprachnachrichten oder Videos?
Ja. Auphonic nimmt laut Produktionshilfe OPUS- und OGG-Dateien an, in denen Messenger-Sprachnachrichten oft vorliegen, bei Videos bearbeitet es die Tonspur. Für stark komprimierte Aufnahmen ist Studio Voice (Beta) gedacht.
Auphonic oder Descript, was ist besser für Anfänger?
Für sauberen Klang ohne Schnittarbeit Auphonic. Descript lohnt sich, sobald du im Transkript schneiden willst, laut unserer Descript-Seite exportiert der Gratisplan dort aber nur in 720p mit Wasserzeichen.
Gibt es Auphonic auf Deutsch?
Nein, die Website gibt es nur auf Englisch. Deutsche Aufnahmen verarbeitet Auphonic trotzdem, der Füllwort-Schnitt kennt laut Doku auch „ähm“.
Dein nächster Schritt
Was du bei der Aufnahme vermeidest, musst du hinterher nicht wegrechnen: nah ans Mikrofon, weiche Möbel im Raum. Den Rest erledigt Auphonic, und mit deinem Preset wird jede weitere Folge zur Sache von zwei Minuten.
Deine erste saubere Aufnahme ist 10 Minuten entfernt. Leg dein Konto auf auphonic.com an. Danach führen drei Wege weiter:
- Dein erstes Transkript mit Whisper: Im Gratisplan von Auphonic fehlt die Spracherkennung. Whisper schreibt deine Aufnahme kostenlos auf deinem eigenen Rechner ab, ohne Upload.
- Deine eigene KI-Stimme mit ElevenLabs: Eine saubere Aufnahme deiner Stimme ist das beste Ausgangsmaterial für eine KI-Stimme.
- Auphonic im Detail: alle Preise, Spracherkennung, Datenschutz und Alternativen im Überblick.
Wie gut kennst du Auphonic jetzt?
10 Fragen, vom Gratisplan bis zum Füllwort-Schnitt. Wer mindestens 8 richtig beantwortet, bekommt ein Zertifikat zum Teilen.