Auphonic
Auphonic GmbH
Redaktionelle Einschätzung auf Basis öffentlich zugänglicher Quellen (Anbieterangaben, Preislisten, unabhängige Bewertungsplattformen), kein Hands-on-Produkttest, sofern nicht ausdrücklich anders angegeben. Die Sternebewertung ist eine Meinung der Redaktion.
Auphonic im Team einführen? KI-Training anfragen
Österreichisches Podcast-Nachbearbeitungstool, das Audiokorrekturen (Lautstärke-Normalisierung nach EBU R128, Rauschunterdrückung, Pegelausgleich) und KI-Transkription in einem Schritt kombiniert. Nutzt OpenAI Whisper (selbst gehostet) für rund 100 Sprachen und liefert Transkript, Kapitelmarken und Shownotes direkt im Editor. Verarbeitet wird auf Servern in Deutschland, damit ist Auphonic einer der wenigen Anbieter, die Broadcast-Audioqualität und Volltext-Transkription mit EU-Datenhaltung in einem Arbeitsschritt verbinden.
Kosten: Kostenlos 2 Std./Monat mit Auphonic-Jingle und ohne Spracherkennung; Recurring-Abos netto monatlich S 12 € (9 Std.), M 28 € (21 Std.), L 58 € (45 Std.), XL 117 € (100 Std.), XXL 250 € (250 Std.), jährlich bezahlt 10, 23, 48, 97 und 210 € pro Monat; One-Time-Credits 11 € für 5 Std. bis 2.520 € für 3.000 Std. (0,84 €/Std.), verfallen nie; alle Preise ohne MwSt.
Kategorien
Stärken
- Audioproduktion und Transkription in einem Schritt, kein separates Tool für Lautstärke-Normalisierung
- Verarbeitung auf Servern in Deutschland (Hetzner), Mediendateien von EU-Nutzern bleiben in der EU
- Automatische EBU R128/LUFS-Normalisierung: Audio wird broadcast-tauglich für ARD, ZDF, Spotify
- Transkription, Kapitelmarken und Shownotes in einem Durchlauf, bearbeitbar im integrierten Editor
- Rund 100 Sprachen via selbst gehostetem Whisper, darunter Deutsch mit solider Qualität
- Gratisplan mit 2 Std. im Monat enthält alle Audio-Algorithmen, inklusive Rauschentfernung und Füllwort-Schnitt
- One-Time-Credits verfallen nie, ideal für unregelmäßige Produktionen
- Integrationen mit Podcast-Hosts (Buzzsprout, Libsyn, LetsCast.fm, Podcaster.de), YouTube, SoundCloud, Zapier, n8n, CLI, API
Einschränkungen
- Transkriptionsqualität bei starkem Dialekt, Übersprechen oder schlechter Audioqualität begrenzt
- Deutsch-Qualität hängt von Whisper ab, kein eigenes deutschoptimiertes Modell
- KI-generierte Shownotes auf Englisch deutlich besser als auf Deutsch
- Keine Echtzeit- oder Live-Transkription, reines Batch-Tool
- Gratisplan mit Auphonic-Jingle in jeder Produktion, ohne Spracherkennung, automatische Shownotes und Kapitel
- Inhalte dürfen zur Verbesserung der Algorithmen genutzt werden, ein Training-Opt-out gibt es nur für Geschäftskunden auf Anfrage
- Editor-Oberfläche ist funktional, aber nicht so poliert wie bei Descript oder Riverside
Passt gut zu
Wann ja, wann nein
Wann ja
- Du produzierst regelmäßig Podcasts oder Audio-Beiträge und brauchst Broadcast-Qualität
- Du willst Audioproduktion und Transkription in einem Schritt erledigen
- Du arbeitest in einer DSGVO-sensiblen Branche und brauchst EU-Hosting
- Du produzierst unregelmäßig und willst keine Monatsgebühr, One-Time-Credits verfallen nicht
Wann nein
- Du brauchst Echtzeit- oder Live-Transkription (z. B. Untertitel im Stream)
- Du willst eine vollwertige Audio-DAW mit Multitrack-Editing, Auphonic ist Nachbearbeitung, nicht Schnitt
- Du brauchst perfekte deutsche Shownotes ohne Nachbearbeitung
- Du willst Videos schneiden und gestalten, nicht nur Ton und Untertitel verbessern (dann eher Descript oder CapCut)
Kurzfazit
Auphonic ist die naheliegende Wahl für deutschsprachige Podcasts, die Broadcast-taugliches Audio und Transkription aus einer Hand brauchen. Der Gratisplan bereinigt 2 Stunden Audio im Monat, mit Auphonic-Jingle und ohne Spracherkennung, Abos beginnen bei 12 € netto für 9 Stunden. Verarbeitet wird auf Servern in Deutschland. Die Schwächen: Deutsche Transkripte brauchen eine Korrekturrunde, und Aufnahmen dürfen ins Training der Algorithmen fließen, abschalten können das nur Geschäftskunden. Wer Wortpassagen schneiden will, ist bei Descript besser aufgehoben.
Für wen ist Auphonic?
Podcast-Produzenten und Redaktionen: Wer mehr als gelegentlich Audio veröffentlicht, spart mit Auphonic das Jonglieren zwischen drei oder vier Tools. Lautstärke-Normalisierung nach EBU R128, automatischer Pegelausgleich zwischen Sprechern, optionale Rauschunterdrückung und Transkription laufen in einem Schritt, das Ergebnis ist Spotify-konform und gleich mit Shownotes vorbereitet.
Verlage und Medienhäuser mit DSGVO-Anforderungen: Die Verarbeitung auf Servern in Deutschland ist das stärkste Verkaufsargument gegenüber US-zentrischen Wettbewerbern. Wer journalistisch arbeitet, Quellenschutz wahren muss oder mit Interviewpartnern aus regulierten Branchen spricht, findet hier einen Anbieter ohne US-Rechenzentrum, sollte aber vor dem ersten Upload das Training-Opt-out für Geschäftskunden beantragen (siehe DSGVO-Abschnitt).
Hörbuch- und Audiobook-Produktionen: Für lange Aufnahmen mit Sprecherwechseln sind der Intelligent Leveler und die Multitrack-Funktionen (mit automatischer Ducking-Logik) ein realer Produktivitätshebel. Kapitelmarken werden automatisch gesetzt, das Transkript wird als Begleitmaterial gleich mitgeneriert.
Bildung und Wissenschaft: Vorlesungsaufzeichnungen, Konferenzvorträge oder Interview-Studien können in einem Lauf auf Hörqualität gebracht und transkribiert werden, relevant für Universitäten, die DSGVO-konform arbeiten müssen und keine US-Cloud zulassen.
Solo-Podcaster: Schon der S-Plan (12 € netto im Monat, jährlich bezahlt 10 €, 9 Std.) enthält Spracherkennung, Shownotes und Kapitel ohne Jingle, nur Priority Processing und Team-Konten bleiben dem Jahres- und Business-Plan vorbehalten. Wer einmal die Woche eine 45-Minuten-Episode produziert, bewegt sich genau in dieser Größenordnung, günstiger als die meisten DAW+Transkriptions-Bundles. Wer nur Ton säubern will und mit dem Auphonic-Jingle leben kann, kommt mit den 2 Gratisstunden im Monat aus.
Weniger geeignet für: Live-Streamer (Auphonic ist Batch, keine Echtzeit-Verarbeitung), Video-First-Produktionen mit echtem Bildschnitt (dafür ist Descript besser), Anwender, die einen vollwertigen Multitrack-Editor brauchen (Adobe Audition oder Reaper), und alle, die ohne Nachkorrektur perfekte deutsche Shownotes erwarten.
Preise im Detail
Alle Preise netto, Stand 3. Oktober 2026.
| Plan | Preis | Was du bekommst |
|---|---|---|
| Free | 0 € | 2 Std./Monat, Auphonic-Jingle in jeder Produktion, alle Audio-Algorithmen (Leveler, Rausch- und Hallentfernung, Filter, Lautheit, Füllwort- und Pausenschnitt), Multitrack nur unter 20 Min., keine Spracherkennung, keine automatischen Shownotes und Kapitel, Freistunden verfallen am Monatsende |
| One-Time Credits | 11 € für 5 Std. (2,20 €/Std.), 147 € für 100 Std. (1,47 €/Std.), 2.520 € für 3.000 Std. (0,84 €/Std.) | Credits verfallen nie, kein Jingle, alle Funktionen außer Priority Processing und Team-Konten |
| S | 12 €/Monat, jährlich 10 €/Monat (120 €/Jahr) | 9 Std./Monat, kein Jingle, Spracherkennung, Shownotes, Watch Folders |
| M | 28 €/Monat, jährlich 23 €/Monat | 21 Std./Monat, passt zu 1–2 wöchentlichen Episoden |
| L | 58 €/Monat, jährlich 48 €/Monat | 45 Std./Monat, Redaktions-Volumen |
| XL | 117 €/Monat, jährlich 97 €/Monat | 100 Std./Monat, Verlage und größere Teams |
| XXL | 250 €/Monat, jährlich 210 €/Monat | 250 Std./Monat |
| Business | auf Anfrage | über 1.000 Std./Monat, individuelle Verträge, manuelle Rechnung, Priority Processing, Team-Konten |
Einordnung: Die Preisseite nennt alle Beträge ohne Mehrwertsteuer, Unternehmen aus der EU kaufen mit USt-IdNr. ohne. Die 2 Gratisstunden reichen für eine ganze Folge im Monat oder für viele kurze Testläufe, denn Auphonic berechnet mindestens 3 Minuten pro Produktion, und Einstellungen an derselben Produktion zu ändern und neu zu rechnen kostet nichts. Für Solo-Podcaster sind der S-Plan (12 € netto im Monat) oder One-Time-Credits der Sweetspot, letztere verfallen nie, du zahlst in Wochen ohne Produktion also nichts. Redaktionen mit ein bis zwei wöchentlichen Episoden landen meist beim M-Plan (21 Std.). Abgerechnet wird die Länge der Eingangsdatei inklusive Intro, bei Multitrack die Länge der fertigen Ausgabedatei, egal wie viele Spuren du hochlädst. Verbraucht werden zuerst die Abo-Stunden, dann One-Time-Credits, zuletzt die Gratisstunden. Jahresabos und Business-Pläne enthalten Priority Processing und Team-Konten; wer in größerem Umfang produziert, sollte direkt anfragen.
Stärken im Detail
Alles in einem Lauf, und genau das ist der Hebel. Konkurrenten machen entweder Audioproduktion (Adobe Audition, Hindenburg) oder Transkription (Otter, rev.com) oder Shownote-Generation (Castmagic). Auphonic kombiniert alle drei in einer Pipeline. Du lädst eine Rohdatei hoch, drückst „Start” und bekommst nach wenigen Minuten ein gemastertes Audiofile, ein Transkript (TXT/SRT/VTT/JSON), Kapitelmarken und einen Shownote-Entwurf. Das spart nicht nur Zeit, sondern auch Konsistenz: alle Outputs stammen aus derselben Quelle.
EBU R128 / LUFS-Normalisierung als Default. Auphonic war eines der ersten Consumer-Tools, das den Broadcast-Standard EBU R128 automatisch umsetzt. Das Ergebnis: Episoden klingen auf Spotify, Apple Podcasts und im Radio gleich laut, ohne dass du den Limiter selbst ansetzen musst. Wer schon einmal eine zu leise produzierte Episode nachträglich anpassen musste, erkennt den Wert sofort.
EU-Hosting in Deutschland. Anthropic, OpenAI, ElevenLabs, AssemblyAI, die meisten KI-Audio-Stacks führen am Ende in die USA. Auphonic ist die Auphonic GmbH aus Graz, verarbeitet laut Datenschutzerklärung vor allem auf Servern bei Hetzner in Deutschland und legt Mediendateien von EU-Nutzern entweder dort oder in Cloudflare-R2-Speichern ab, die auf den EU-Rechtsraum beschränkt sind. Auch die Spracherkennung läuft auf Auphonic-eigenen Servern. Für deutschsprachige Verlage, öffentlich-rechtliche Anstalten und Bildungseinrichtungen ist das ein starkes Argument, mit einer Einschränkung: Cloudflare ist ein US-Unternehmen und steht als Unterauftragsverarbeiter auf der Liste.
Whisper als Transkriptions-Backend. Auphonic nutzt OpenAI Whisper für die Spracherkennung, das aktuell beste Open-Source-Modell für mehrsprachige Transkription. Für Deutsch erreicht Whisper bei sauberen Aufnahmen Wortfehlerraten von 5–10 %, was eine Korrekturrunde notwendig macht, aber den manuellen Transkriptionsaufwand massiv reduziert.
Multitrack mit automatischem Ducking. Wer Interviews auf getrennten Spuren aufnimmt (Riverside, SquadCast, Zoom-Audio mit Einzelspuren), kann diese parallel hochladen. Auphonic mischt automatisch ab, dämpft das Mikrofon des Sprechers, der gerade nicht redet (Ducking), entfernt seit Oktober 2025 auch Mic-Bleed und liefert ein professionell gemixtes Endprodukt. Das ist ein Feature, das im Profi-Studio mehrere Plugins und manuelles Tweaking erfordert.
Integrationen ohne Bastelei. Die Veröffentlichung an Podcast-Hosts (Buzzsprout, Libsyn, Spreaker, Acast, RSS.com, aus Deutschland LetsCast.fm und Podcaster.de), Cloud-Speicher (Dropbox, Google Drive, S3) und YouTube läuft direkt aus dem Production-Job heraus, auch im Gratisplan. Für Redaktionen mit eigenem CMS gibt es eine offene REST-API, seit März 2026 ergänzt durch ein CLI für Skript-basierte Workflows und seit September 2026 durch eine n8n-Integration.
Faire Preise und keine Bindung. One-Time-Credits verfallen nie. Wer im Sommer Pause macht oder unregelmäßig produziert, zahlt nur die tatsächlich verarbeiteten Stunden. Diese Flexibilität ist im SaaS-Markt selten geworden und ein klarer Pluspunkt für Indie-Produzenten.
Schwächen ehrlich betrachtet
Deutscher Whisper-Output ist nicht fehlerfrei. Bei sauberen Studioaufnahmen funktioniert die deutsche Transkription gut, aber Fachbegriffe, Eigennamen, regionale Aussprache und Dialekte führen regelmäßig zu Fehlern. Plane mindestens 15–30 Minuten Nachbearbeitung pro Stunde Audio ein, der integrierte Editor ist dafür ausreichend, aber die Korrektur bleibt manuell. Kommerzielle Transkriptionsdienste mit deutsch optimierten Modellen liefern bei rein deutschem Material teilweise bessere Roh-Outputs.
Shownotes auf Deutsch sind ausbaufähig. Die automatische Shownote-Generierung ist auf Englisch deutlich treffsicherer als auf Deutsch, was an den dahinterliegenden LLM-Prompts liegt. Wer Shownotes professionell veröffentlicht, wird sie ohnehin neu schreiben; als Erstentwurf taugen sie, aber rohgekupfert wird sie kein seriöses Medium verwenden.
Keine Echtzeit-Transkription. Auphonic ist ein Batch-Tool. Wer live Untertitel braucht (Konferenz-Stream, Webinar, Tagung), muss zu spezialisierten Anbietern wie Otter.ai oder Web Captioner greifen. Auphonic verarbeitet immer fertige Aufnahmen.
Editor-UX ist funktional, nicht modern. Der Web-Editor erfüllt seinen Zweck, aber die Bedienung wirkt im Vergleich zu Descript oder Riverside altbacken. Wer eine fließende, „Word-für-Audio”-Erfahrung sucht, wird mit Auphonic nicht glücklich. Die Stärke liegt im automatisierten Hintergrund, nicht im Editor-Erlebnis.
Kein vollwertiger Schnitt. Auphonic schneidet seit April 2026 zwar einfache Pausen und Stillen automatisch aus Videos, ersetzt aber keinen klassischen Audio-Editor. Wer Wortpassagen umstellen, ganze Abschnitte herausschneiden oder kreative Übergänge bauen will, braucht weiterhin eine DAW (Reaper, Audition, Hindenburg) oder ein Tool wie Descript.
Video-Workflow ist Beifang, kein Kern. Seit Juli 2026 brennt Auphonic Untertitel direkt ins Video ein, mit 22 Schriften und Wort-für-Wort-Hervorhebung. Weil die Untertitel aus der Spracherkennung stammen, geht das nur mit bezahlten Credits, und Bildschnitt, Einblendungen oder Übergänge gibt es weiterhin nicht. Für Video-First-Produktionen brauchst du deshalb meist einen zweiten Schritt, entweder im Schnittprogramm (DaVinci Resolve, Premiere) oder in Descript.
Deine Aufnahmen dürfen ins Training fließen. Laut Datenschutzerklärung nutzt Auphonic hochgeladene Inhalte, um seine Audio-Algorithmen zu verbessern, Mitarbeitende dürfen sie dafür anhören, Ausschnitte können intern gespeichert bleiben. Ein Opt-out gibt es nur für Geschäftskunden, und nur auf Anfrage. Wer vertrauliche Interviews verarbeitet, beantragt es vor dem ersten Upload.
Alternativen im Vergleich
| Wenn du… | …nimm stattdessen |
|---|---|
| Video-First arbeitest und im Transkript schneiden willst | Descript |
| Eine vollwertige Audio-DAW willst | Adobe Creative Cloud (Audition) |
| Pure Transkription ohne Audioproduktion brauchst | Whisper direkt oder NotebookLM |
| Studio-Aufnahme und Postproduktion in einem Tool willst | Riverside.fm |
Erwähnenswert ohne eigene Tool-Seite: Hindenburg Pro (klassische Podcast-DAW mit eigener Auto-Mixing-Funktion), Castmagic und Podcastle (Shownote- und Repurposing-Fokus), rev.com (manuelle Transkription, teurer, aber höhere Qualität für regulierte Branchen). Auphonic bleibt die einzige uns bekannte Lösung, die Broadcast-Audio + KI-Transkription + EU-Hosting in einem Anbieter bündelt, das ist der Grund, warum Verlage und öffentlich-rechtliche Sender es seit Jahren einsetzen.
So steigst du ein
Schritt 1: Lege ein kostenloses Konto auf auphonic.com an. Die 2 Freistunden pro Monat reichen für eine komplette Folge oder viele kurze Testläufe, und Einstellungen an derselben Produktion zu ändern und neu zu rechnen kostet keine Credits. Lade eine echte Folge hoch (MP3 oder WAV), nicht eine synthetische Beispieldatei, du willst sehen, wie Auphonic mit deiner Mikrofon-Charakteristik und deinem Raumklang umgeht.
Schritt 2: Aktiviere in den Service-Einstellungen „Speech Recognition” (Modell „Whisper”, erst mit bezahlten Credits, der Gratisplan hat keine Spracherkennung) und stelle die Sprache explizit auf Deutsch, automatische Erkennung funktioniert, ist aber bei Mischsprachen unzuverlässig. Aktiviere die automatischen Kapitel und Shownotes (ebenfalls nur mit Credits) und „Loudness Normalization” (Standard: -16 LUFS für Podcasts, -23 LUFS für Broadcast). Multitrack-Aufnahmen lädst du als getrennte Spuren hoch, damit Ducking funktioniert.
Schritt 3: Prüfe im integrierten Transkript-Editor die Ausgabe und korrigiere Namen, Fachbegriffe und Dialektpassagen. Exportiere das fertige Audio (MP3/AAC/Opus), das Transkript (TXT/SRT/VTT/JSON) und die Shownotes. Richte für wiederkehrende Episoden ein „Preset” ein, damit übernimmst du dieselben Service-Einstellungen automatisch. Für vollautomatische Workflows: API oder CLI nutzen, Watch-Folder einrichten, Auto-Publishing an deinen Podcast-Host aktivieren.
Wenn du lieber Schritt für Schritt vorgehst: In unserem Tutorial Deine erste Aufnahme in Studioklang mit Auphonic machst du im Gratisplan aus einer Handyaufnahme in 10 Minuten eine saubere MP3, mit kopierbaren Einstellungen gegen Rauschen, Hall und Ähms.
Ein konkretes Beispiel
Die Redaktion eines deutschen Fachverlags in Köln produziert wöchentlich eine 45-minütige Interview-Podcast-Episode mit zwei Gästen. Bisher liefen drei Tools parallel: Adobe Audition für Lautstärke-Normalisierung und Mix (ca. 90 Minuten Arbeitszeit pro Folge), ein externer Transkriptionsdienst zu rund 48 € pro Episode, und Notion für die manuelle Shownote-Erstellung (60 Minuten). Mit Auphonic im M-Plan (28 € netto im Monat, 21 Std. Volumen) läuft jetzt alles in einem Job: die drei Mikrofon-Spuren werden als Multitrack hochgeladen, Auphonic mischt automatisch ab, normalisiert auf -16 LUFS, transkribiert, setzt Kapitelmarken und liefert einen Shownote-Entwurf. Die Redakteurin korrigiert anschließend in 25 Minuten das Transkript (Eigennamen, Fachbegriffe), kürzt die Shownotes auf das Wesentliche und lädt die Folge direkt zum Podcast-Host LetsCast.fm hoch. Zeitersparnis pro Episode: ca. 2,5 Stunden. Jahres-Einsparung gegenüber dem externen Dienst: rund 2.160 € (48 € × 52 Wochen − 336 € Jahresgebühr). Das DSGVO-Argument war der Grund, warum die Verlagsleitung diesen Weg überhaupt freigegeben hat, eine Lösung mit US-Hosting wäre wegen Interview-Vorbereitung und O-Tönen aus regulierten Branchen nicht durchsetzbar gewesen.
Nicht sicher, ob Auphonic zu euch passt?
Wir helfen bei der Tool-Auswahl und begleiten die Einführung in euren Arbeitsalltag, unverbindlich und kostenlos im Erstgespräch.
DSGVO & Datenschutz
- Datenhosting: Laut Datenschutzerklärung verarbeitet Auphonic vor allem auf Servern der Hetzner Online GmbH in Deutschland. Mediendateien von EU-Nutzern liegen entweder dort oder in Cloudflare-R2-Speichern, die auf den EU-Rechtsraum beschränkt sind. Cloudflare Inc. (USA) steht deshalb mit Auftragsverarbeitungsvertrag auf der Liste der Unterauftragsverarbeiter, für den automatischen Videoschnitt zusätzlich CloudConvert aus Grünwald.
- Transkriptions-Backend: Whisper läuft auf Auphonic-eigener Infrastruktur, nicht über die OpenAI-API. Für die Spracherkennung verlassen die Audiodaten laut Auphonic die eigenen Server nicht.
- Datennutzung: Hochgeladene Inhalte darf Auphonic zur Verbesserung seiner Audio-Algorithmen verwenden, Mitarbeitende oder Beauftragte dürfen sie dafür anhören, Ausschnitte können intern gespeichert werden. Geschäftskunden können auf Anfrage ein Training-Opt-out setzen lassen, bei Team-Konten gilt es für alle Mitglieder. Für private Konten nennt Auphonic kein Opt-out.
- Aufbewahrung: Produktionen samt Dateien und Metadaten löscht Auphonic automatisch, nach 21 Tagen bei Audio und nach 7 Tagen bei Video- und API-Produktionen. Presets und Kontoeinstellungen bleiben, bis du sie löschst. Lade fertige Dateien also zeitnah herunter.
- Auftragsverarbeitung (AVV): Einen Standard-AVV zum Herunterladen haben wir auf der Website nicht gefunden, individuelle Verträge nennt die Preisseite nur für den Business-Plan. Für Standard-Abos fragst du direkt bei Auphonic an.
- Konto und Login: 2-Faktor-Authentifizierung seit September 2025 verfügbar, sollte aktiviert werden, sobald sensible Aufnahmen im Account liegen.
- Empfehlung für Unternehmen: Für regulierte Branchen ist Auphonic eine der saubereren Optionen, weil Verarbeitung und Spracherkennung in der EU bleiben. Vor dem ersten sensiblen Upload das Training-Opt-out beantragen und den AVV klären.
Gut kombiniert mit
- Riverside.fm, Riverside ist das Studio für die Aufnahme (lokale High-Quality-Spuren), Auphonic übernimmt die Nachbearbeitung. Beide gemeinsam decken den kompletten Remote-Interview-Workflow ab, ohne dass du Audio Engineering selbst beherrschen musst.
- Descript, wenn du Wortpassagen umsortieren, Versprecher schnell rausschneiden oder Overdubs einbauen willst, ist Descript der bessere Editor. Auphonic kommt danach für die finale Klangoptimierung und Veröffentlichung an den Podcast-Host.
- Notion, die Auphonic-Shownotes landen via Zapier oder API direkt in einer Notion-Datenbank, wo Redaktion und Marketing sie weiterverarbeiten. Damit wird die Podcast-Produktion in den allgemeinen Content-Workflow integriert.
Häufige Fragen zu Auphonic
Ist Auphonic kostenlos?
Ja, für 2 Stunden verarbeitetes Audio im Monat. Gratis-Produktionen enthalten einen Auphonic-Jingle, Spracherkennung sowie automatische Shownotes und Kapitel fehlen, Multitrack geht nur unter 20 Minuten. Rauschentfernung, Leveler, Lautheitsnormalisierung und der automatische Schnitt von Füllwörtern und Pausen sind dagegen enthalten. Nicht genutzte Freistunden verfallen am Monatsende.
Was kostet Auphonic?
Das kleinste Abo (S) kostet 12 € netto im Monat für 9 Stunden, jährlich bezahlt 10 € im Monat. M kostet 28 € für 21 Stunden, L 58 € für 45 Stunden, XL 117 € für 100 Stunden und XXL 250 € für 250 Stunden. One-Time-Credits verfallen nie, sie kosten 11 € für 5 Stunden und sinken bis auf 0,84 € pro Stunde bei 3.000 Stunden (Stand 3. Oktober 2026, alle Preise ohne Mehrwertsteuer).
Gibt es Auphonic auf Deutsch?
Nein, Website und Registrierung gibt es nur auf Englisch. Deutsche Aufnahmen verarbeitet Auphonic trotzdem: Der Füllwort-Schnitt ist laut Dokumentation auch mit deutschen Daten trainiert und erkennt „ähm”, die Whisper-Spracherkennung beherrscht rund 100 Sprachen.
Ist Auphonic DSGVO-konform?
Auphonic bezeichnet sich als DSGVO-konform und verarbeitet vor allem auf Servern in Deutschland, Mediendateien von EU-Nutzern bleiben in der EU. Zwei Punkte solltest du kennen: Inhalte dürfen zur Verbesserung der Algorithmen genutzt werden, ein Opt-out gibt es nur für Geschäftskunden auf Anfrage. Und Produktionen werden nach 21 Tagen (Audio) beziehungsweise 7 Tagen (Video und API) automatisch gelöscht.
Unser Fazit
Auphonic verdient 4 von 5 Sternen. Das Tool macht das, was es verspricht, exzellent, Broadcast-taugliches Audio plus Transkription in einem Schritt, mit EU-Hosting und fairer Preisgestaltung. Im deutschsprachigen Raum kennen wir keinen Anbieter, der diese Kombination so kompakt liefert. Den fünften Stern verliert es durch zwei Punkte: Die Whisper-Transkription ist auf Deutsch solide, aber nicht so gut wie spezialisierte deutsche Anbieter; und die Editor-Oberfläche fühlt sich neben modernen Wettbewerbern (Descript, Riverside) altbacken an. Für reine Audio-Produktionen mit DSGVO-Anspruch bleibt Auphonic die erste Wahl, für Video-First-Workflows oder maximalen Editor-Komfort gibt es bessere Optionen.
Was wir bemerkt haben
- Oktober 2026, Preise neu abgeglichen. Die Abos kosten netto 12 € (S), 28 € (M), 58 € (L), 117 € (XL) und 250 € (XXL) im Monat, jährlich bezahlt 10 bis 210 €. Bis September standen hier Werte, die zur heutigen Preisseite nicht passen (S 9 €, XXL auf Anfrage), und ein Stundenpreis mit „ca.”. Die Preisseite nennt alle Beträge ohne Mehrwertsteuer.
- Oktober 2026, Korrektur zu Hosting und Datennutzung. Laut Datenschutzerklärung verarbeitet Auphonic vor allem auf Servern bei Hetzner in Deutschland, nicht in Österreich, wie wir bisher schrieben. Österreichisch ist der Anbieter. Außerdem dürfen Inhalte zur Verbesserung der Algorithmen genutzt werden, und Produktionen werden nach 21 Tagen (Audio) beziehungsweise 7 Tagen (Video, API) gelöscht. Unsere frühere Angabe „keine Verwendung für Modelltraining” war falsch. Podigee, das wir als Integration genannt hatten, steht nicht in Auphonics Liste der externen Dienste.
- September 2026, Auphonic ist als Integration in n8n verfügbar (25. September), und die Gain-Kurve des Leveler lässt sich im Editor von Hand nachbearbeiten (10. September).
- Juli 2026, Untertitel lassen sich direkt ins Video einbrennen (29. Juli), mit 22 Schriften und Wort-für-Wort-Hervorhebung. Voraussetzung ist die Spracherkennung, also bezahlte Credits.
- Juli 2026, Studio Voice (Beta) rekonstruiert Stimmen aus komprimierten, übersteuerten oder verrauschten Aufnahmen, etwa Messenger-Sprachnachrichten oder Videocalls (21. Juli). Auswählbar als „Filtering Method”.
- April 2026, Auphonic hat automatisches Video-Cutting eingeführt (Silence Cutter und Filler-Word-Entfernung auch für Video). Damit wird die Pipeline für Vlog- und Video-Podcast-Produzenten interessanter, eingebrannte Untertitel kamen erst im Juli dazu.
- März 2026, Ein offizielles CLI ist verfügbar. Für Redaktionen mit Skript-basierten Workflows (Watch-Folder, automatische Ablieferung) eine echte Erleichterung, bisher war API-Integration der einzige programmatische Weg.
- Dezember 2025, Ein Denoising-Editor wurde eingeführt, mit dem sich Rauschen selektiv (statt pauschal über die ganze Datei) entfernen lässt. Praktisch für Aufnahmen mit Phasen, in denen Klimaanlage oder Lüfter nur stellenweise stören.
- Oktober 2025, Mic-Bleed-Removal für Multitrack-Aufnahmen ergänzt. Das war ein Schmerzpunkt für Remote-Interviews, bei denen Gäste in Lautsprechern statt Kopfhörern hörten, wird jetzt automatisch sauber getrennt.
- September 2025, 2-Faktor-Authentifizierung im Account verfügbar. Für Redaktionen mit mehreren Bearbeitern und sensiblen Aufnahmen ein überfälliger Schritt.
- 2024–2026, Auphonic ist konsequent bei der EU-Datenhaltung geblieben, obwohl viele Wettbewerber inzwischen Hybrid-Architekturen mit US-Backends fahren. Diese Linientreue ist im KI-Audio-Markt selten und ein Hauptgrund, warum öffentlich-rechtliche Sender und große Verlage das Tool verwenden.
Quellen
- Auphonic – Pricing. https://auphonic.com/pricing (abgerufen am 2026-10-03). Kostenlos 2 Std./Monat, Jingle bei Gratis-Produktionen, Freistunden verfallen am Monatsende; Free ohne Spracherkennung, automatische Shownotes und Kapitel, Multitrack unter 20 Min., ohne Watch Folders und Batch; Recurring netto monatlich S 12 €, M 28 €, L 58 €, XL 117 €, XXL 250 € für 9, 21, 45, 100 und 250 Std., jährlich 10, 23, 48, 97 und 210 € pro Monat (S 120 € im Jahr); One-Time 11 € bzw. 12 USD für 5 Std. (2,20 € bzw. 2,40 USD pro Std.), 147 € für 100 Std. (1,47 €/Std.), 2.520 € für 3.000 Std. (0,84 €/Std.), verfallen nie; Preise ohne MwSt.; Priority Processing und Team-Konten nur im Jahres- und Business-Plan.
- Auphonic – Pricing FAQ. https://auphonic.com/help/web/pricing_faq.html (abgerufen am 2026-10-03). Abrechnung nach Länge der Eingangsdatei inklusive Intro, mindestens 3 Min. pro Produktion; Multitrack nach Länge der Ausgabedatei; Einstellungen an derselben Produktion ändern und neu rechnen kostet nichts; Credits bei Unzufriedenheit erstattbar; Reihenfolge Recurring, One-Time, Gratis.
- Auphonic – Datenschutzerklärung. https://auphonic.com/privacy (abgerufen am 2026-10-03). Verarbeitung vor allem auf Hetzner-Servern in Deutschland, Medien von EU-Nutzern dort oder in Cloudflare R2 mit EU-Bindung; Inhalte dürfen zur Verbesserung der Algorithmen genutzt und dafür angehört werden, Training-Opt-out nur für Geschäftskunden auf Anfrage; Löschung von Produktionen nach 21 Tagen (Audio) bzw. 7 Tagen (Video, API).
- Auphonic – Unterauftragsverarbeiter. https://auphonic.com/subprocessors (abgerufen am 2026-10-03). Hetzner Online GmbH (Gunzenhausen) für Server und Backups, Cloudflare Inc. (USA) für Medienspeicher und Auslieferung, CloudConvert nur für Video-Schnitt, jeweils mit Auftragsverarbeitungsvertrag.
- Auphonic – Spracherkennung, Shownotes und Kapitel. https://auphonic.com/help/algorithms/speech_recognition.html (abgerufen am 2026-10-03). Auphonic Whisper ASR selbst gehostet, rund 100 Sprachen, Audio verlässt für die Spracherkennung die Auphonic-Server nicht; weitere Backends Google, Wit.ai, Amazon Transcribe, Speechmatics.
- Auphonic – External Services. https://auphonic.com/help/web/services.html (abgerufen am 2026-10-03). Veröffentlichung u. a. an YouTube, Buzzsprout, Libsyn, Spreaker, Acast, RSS.com, LetsCast.fm und Podcaster.de, Dateitransfer per Dropbox, Google Drive, S3, Anbindung an Zapier und n8n.
- Auphonic Blog – Burn-In Subtitles. https://auphonic.com/blog/2026/07/29/burn-in-subtitles/ (abgerufen am 2026-10-03). Seit 29. Juli 2026 brennt Auphonic Untertitel aus der Spracherkennung direkt ins Video, 22 Schriften, Wort-für-Wort-Hervorhebung, auch über API und CLI.
- Auphonic Blog – Studio Voice (Beta). https://auphonic.com/blog/2026/07/21/studio-voice-beta/ (abgerufen am 2026-10-03). Seit 21. Juli 2026 rekonstruiert Studio Voice (Beta) Stimmen aus komprimierten, übersteuerten oder verrauschten Aufnahmen, wählbar als Filtering Method.
- Auphonic – Über uns. https://auphonic.com/about_us (abgerufen am 2026-10-03). Auphonic GmbH, Homebase Graz (Österreich), gegründet 2013, über 2 Mio. Nutzer; KI-basierte Audio-Algorithmen als automatisierter Postproduktions-Webservice.
Diesen Inhalt teilen:
Empfohlen in 1 Use Cases
Verlag & Medienproduktion
Empfohlen für diese Branchen
Arthur Atlas
KI-Analyst
So entsteht diese Bewertung
Diese Seite bewerten wir redaktionell, mit kräftiger Unterstützung von Arthur Atlas, unserem KI-Analysten. Er prüft Bewertungen nach und markiert veraltete Angaben, sobald sich der Markt dreht. Unsere Angaben stammen überwiegend aus öffentlich zugänglichen Quellen wie Anbieter-Website, Doku und Preislisten. Preise und Funktionen können sich ändern.
Hinweis: Diese Angaben können veraltet oder fehlerhaft sein. Prüfe im Zweifel immer direkt auf der Website des Anbieters.
Preise geändert, Feature veraltet oder etwas fehlt?
Wir freuen uns über Hinweise und Ergänzungen.
Du arbeitest bei Auphonic GmbH?
Gib uns einen Testzugang, dann schauen wir tiefer rein und ergänzen die Bewertung aus erster Hand.
KI-Tools und Trends
KI-Wochenbriefing: jeden Freitag KI-News, Praxistipps und Tools
Kostenlos abonnieren, jederzeit abmeldbar, kein Spam.