Sprache verarbeiten
Sprachprodukte — Voicemail, Support-Anrufe, IVR-Ansagen, Narration, Sprachnotizen — brauchen einen Weg von der Aufnahme über günstige Speicherung bis zur Wiedergabe. AudioDN deckt den gesamten Kreislauf ab: Sprache aufnehmen oder hochladen, eine sprachoptimierte Opus-Variante erzeugen, das große Original löschen und nur das winzige Archiv streamen, das Hörer brauchen.
Opus ist für Sprache und Streaming mit niedriger Bitrate gebaut. Bei 32 kbps Mono klingt es oft klarer als deutlich größere MP3/AAC-Kodierungen derselben Voicemail — und Ihre Speicherkurve bricht ein, sobald Sie das Original-WAV entfernen.
Sprache erfassen
Zwei gängige Wege bringen Sprache in AudioDN. Bevorzugen Sie bei der Aufnahme die höchste verfügbare Qualität, damit die Opus-Kodierung von einem sauberen Signal ausgeht — den Rest übernimmt AudioDN.
Im Browser aufnehmen
Die Webkomponente <audiodn-recorder> nimmt vom Mikrofon auf, zeigt eine Live-Wellenform und
Vorschau und lädt dann einen einzelnen Track hoch. Der Browser bevorzugt Opus in WebM/Ogg, wenn verfügbar (MP4/AAC
unter Safari), sodass der Upload selbst bereits sprachfreundlich ist. Nutzen Sie einen Client-Side-Upload-Key oder
übergeben Sie eine serverseitig erstellte Upload-Session.
Vollständige Attribute, Events und Themes: Recorder-Komponenten-Docs.
Live-Demo
Tippen zum Aufnehmen, Clip anhören, dann senden. Erfordert Mikrofonberechtigung.
Vom Mikrofon aufnehmen, Vorschau anhören und dann einen einzelnen Sprachtrack zu AudioDN hochladen.
Eine bestehende Aufnahme hochladen
Telefon-Apps, Zoom-Exporte, günstige Rekorder und Studio-WAVs können alle in derselben Collection landen. Laden Sie
über die Uploader-Komponente oder die
Upload-Sessions-API hoch — Session erstellen, Track erstellen, Bytes per
PUT senden, dann warten, bis track_status_id ready ist (oder auf einen Track-Webhook hören),
bevor Sie abspielen.
Warum Opus für Sprache
Sprache ist meist mono mit engen Dynamiken. Ein mehr-megabyte großes WAV (oder ein musikorientiertes HQ-AAC) für immer
zu behalten, verbraucht Speicher und Bandbreite ohne wahrnehmbaren Gewinn. Eine dedizierte sprachoptimierte
Opus-Variante (in diesem Beispiel voice genannt) gibt jedem Upload eine vorhersehbare, sprachoptimierte
Datei für Player, Download-Endpunkte oder Cold Storage.
| Stufe | Typischer Footprint (~45s Mono) | Hinweise |
|---|---|---|
| Quell-WAV (48 kHz / 16-Bit) | ~4 MB | Verlustfreie Aufnahme |
Opus voice @ 32 kbps Mono | ~180 KB | Klare Sprache; ideal für Voicemail- & IVR-Bibliotheken |
Opus voice @ 64 kbps Mono | ~360 KB | Mehr Spielraum für laute Leitungen oder stärkere Akzente |
Das ist etwa eine 20×–40×-Verkleinerung gegenüber dem Quell-WAV, bevor Sie das Original löschen. Im Bibliotheksmaßstab — Tausende Nachrichten — wechseln Sie von „alles für immer behalten“ zu „behalten, was Hörer tatsächlich abspielen.“
Zu einer Voice-Opus-Variante transkodieren
Es gibt keine eingebaute Variante namens voice — das ist nur der index-Name, den wir für
dieses Beispielkonto gewählt haben. Konfigurieren Sie eine transcode-Variante mit
codec: “opus” und geben Sie ihr einen beliebigen eindeutigen Index (voice,
speech, vm, …). Für Sprache starten Sie bei 32 kbps Mono — deutlich kleiner
als Musik-Presets, trotzdem verständlich auf Ohrhörern und Handys. Erhöhen Sie auf 64 kbps, wenn Sie
mehr Treue für laute Quellen brauchen. Tags und Cover-Art entfernen; sie verschwenden nur Bytes bei Voicemail.
Legen Sie das Rezept einmal im
Dashboard fest, damit jeder Upload automatisch diese
benannte Datei erhält, oder hängen Sie sie an einen fertigen Track über die Variants-API an. Der index
muss eindeutig sein — ein Bitrate-Rezept pro Index.
Feldreferenz: Variants-API. Überblick der Variantentypen: Variant Types.
Das Original löschen, wenn Sie zufrieden sind
Während Sie Rezepte noch abstimmen, behalten Sie den Original Upload, damit Sie Varianten neu erzeugen können. Sobald
voice richtig klingt und Sie keine Neuverarbeitung mehr brauchen, löschen Sie das Original, um das große
WAV (oder eine andere Quelle) aus dem Speicher freizugeben. Danach kann AudioDN für diesen Track keine neuen Varianten
mehr erzeugen — nur die verbleibenden Dateien (wie voice) bleiben für Wiedergabe und Download verfügbar.
Trade-off-Details: Original Upload. Muster für Voicemail- /
Archivprodukte: hohe Qualität hochladen → auf voice warten → Original löschen → für immer nur
variants=“voice” ausliefern.
Nur die Voice-Variante abspielen
Richten Sie den Player auf den Track und fordern Sie Ihre Sprach-Opus-Variante anhand des Index an, den Sie
konfiguriert haben — hier variants=“voice” — mit einem Client-Side-Player-Key. Hörer laden nie
die mehr-megabyte große Quelle herunter — nur die Opus-Datei, die Sie behalten haben.
Abhängigkeit
npm install @audiodn/components Verwendung
<script type="module">
import '@audiodn/components/player';
</script>
<audiodn-player
api-key="YOUR_PLAYER_API_KEY"
scope="track"
id="TRACK_ID"
variants="voice"
size="regular"
></audiodn-player> Live-Demo
Dieser Player fordert variants=“voice” an — den Index einer sprachoptimierten Opus-Variante, die
für dieses Demo-Konto angelegt wurde (Sie können Ihre beliebig benennen). Der Track ist ein
Anrufbeantworter-Sample; hören Sie den Footprint, den Sie ausliefern können.
Demo-Voicemail — generiertes Beispiel für dieses Beispiel (Anrufbeantworter-Signalton + Nachricht).
Weitere Player-Optionen: Player-Komponenten-Docs.
Checkliste
Sprache landet in AudioDN — über <audiodn-recorder>, den Uploader oder die Upload-Sessions-API.
Eine sprachoptimierte Opus-Transcode-Variante existiert unter dem Index Ihrer Wahl (dieses Beispiel nutzt
voice), Mono und 32 (oder 64) kbps — siehe Variants-API.Hören Sie diese Variante anhand des Index und bestätigen Sie, dass die Sprachqualität für Ihr Produkt ausreicht.
Löschen Sie den Original Upload, wenn Sie keine Varianten mehr neu erzeugen müssen — behalten Sie nur das günstige Opus-Archiv.