Praxis

Von Audacity zu KI-Audio

Audacity ist ein quelloffener Audioeditor für Aufnahme und Schnitt. KI-Audio ergänzt diese Handarbeit heute um Transkription (Audio zu Text) und Sprachsynthese (Text zu Audio) – teils mit offenen, lokal nutzbaren Modellen.

Früher: Audacity und der freie Audioschnitt

Audacity machte Audiobearbeitung für viele zugänglich: aufnehmen, schneiden, Effekte anwenden – quelloffen und kostenlos. Es steht beispielhaft für den Open-Source-Gedanken, den das damalige bomots.de vermittelte: mächtige Werkzeuge verständlich erklären.

Heute: KI unterstützt die Audioarbeit

KI ersetzt den Editor nicht, sondern erweitert ihn. Zwei Felder sind besonders praktisch:

  • Transkription: gesprochene Sprache automatisch verschriftlichen – mit offenen Modellen auch lokal und datensparsam.
  • Sprachsynthese: Text als natürliche Sprache ausgeben, etwa für Vertonungen.
Von Audioschnitt zu KI-Audio
Damals (Audacity)Heute (KI-Audio)
manueller Schnittautomatische Transkription für Protokolle/Untertitel
Effekte/FilterSprachsynthese und Klangwerkzeuge
lokale Dateienoffene Modelle lokal nutzbar (Datenschutz)
Rechte an Stimmen

Bei Stimmen gilt: nur mit Einwilligung klonen. Persönlichkeitsrechte und – bei täuschenden Inhalten – Kennzeichnungspflichten beachten.

Quellen und weiterführende Informationen

  1. Audacity: Offizielle Projektseite. Projektseite · abgerufen am 06.08.2026
  2. OpenAI: Whisper (offenes Spracherkennungsmodell). Repository · abgerufen am 06.08.2026

Häufige Fragen

Kann ich Audio lokal und datensparsam transkribieren?

Ja. Mit offenen Spracherkennungsmodellen ist lokale Transkription ohne Upload möglich – auf schwächerer Hardware nur langsamer.