Launch-Aktion: Die Pläne Creator und Business sind für begrenzte Zeit rabattiert. Preise ansehen

Sprache verarbeiten

Sprachprodukte — Voicemail, Support-Anrufe, IVR-Ansagen, Narration, Sprachnotizen — brauchen einen Weg von der Aufnahme über günstige Speicherung bis zur Wiedergabe. AudioDN deckt den gesamten Kreislauf ab: Sprache aufnehmen oder hochladen, eine sprachoptimierte Opus-Variante erzeugen, das große Original löschen und nur das winzige Archiv streamen, das Hörer brauchen.

Opus ist für Sprache und Streaming mit niedriger Bitrate gebaut. Bei 32 kbps Mono klingt es oft klarer als deutlich größere MP3/AAC-Kodierungen derselben Voicemail — und Ihre Speicherkurve bricht ein, sobald Sie das Original-WAV entfernen.

Sprache erfassen

Zwei gängige Wege bringen Sprache in AudioDN. Bevorzugen Sie bei der Aufnahme die höchste verfügbare Qualität, damit die Opus-Kodierung von einem sauberen Signal ausgeht — den Rest übernimmt AudioDN.

Im Browser aufnehmen

Die Webkomponente <audiodn-recorder> nimmt vom Mikrofon auf, zeigt eine Live-Wellenform und Vorschau und lädt dann einen einzelnen Track hoch. Der Browser bevorzugt Opus in WebM/Ogg, wenn verfügbar (MP4/AAC unter Safari), sodass der Upload selbst bereits sprachfreundlich ist. Nutzen Sie einen Client-Side-Upload-Key oder übergeben Sie eine serverseitig erstellte Upload-Session.

Vollständige Attribute, Events und Themes: Recorder-Komponenten-Docs.

Live-Demo

Tippen zum Aufnehmen, Clip anhören, dann senden. Erfordert Mikrofonberechtigung.

Vom Mikrofon aufnehmen, Vorschau anhören und dann einen einzelnen Sprachtrack zu AudioDN hochladen.

Eine bestehende Aufnahme hochladen

Telefon-Apps, Zoom-Exporte, günstige Rekorder und Studio-WAVs können alle in derselben Collection landen. Laden Sie über die Uploader-Komponente oder die Upload-Sessions-API hoch — Session erstellen, Track erstellen, Bytes per PUT senden, dann warten, bis track_status_id ready ist (oder auf einen Track-Webhook hören), bevor Sie abspielen.

Warum Opus für Sprache

Sprache ist meist mono mit engen Dynamiken. Ein mehr-megabyte großes WAV (oder ein musikorientiertes HQ-AAC) für immer zu behalten, verbraucht Speicher und Bandbreite ohne wahrnehmbaren Gewinn. Eine dedizierte sprachoptimierte Opus-Variante (in diesem Beispiel voice genannt) gibt jedem Upload eine vorhersehbare, sprachoptimierte Datei für Player, Download-Endpunkte oder Cold Storage.

StufeTypischer Footprint (~45s Mono)Hinweise
Quell-WAV (48 kHz / 16-Bit)~4 MBVerlustfreie Aufnahme
Opus voice @ 32 kbps Mono~180 KBKlare Sprache; ideal für Voicemail- & IVR-Bibliotheken
Opus voice @ 64 kbps Mono~360 KBMehr Spielraum für laute Leitungen oder stärkere Akzente

Das ist etwa eine 20×–40×-Verkleinerung gegenüber dem Quell-WAV, bevor Sie das Original löschen. Im Bibliotheksmaßstab — Tausende Nachrichten — wechseln Sie von „alles für immer behalten“ zu „behalten, was Hörer tatsächlich abspielen.“

Zu einer Voice-Opus-Variante transkodieren

Es gibt keine eingebaute Variante namens voice — das ist nur der index-Name, den wir für dieses Beispielkonto gewählt haben. Konfigurieren Sie eine transcode-Variante mit codec: “opus” und geben Sie ihr einen beliebigen eindeutigen Index (voice, speech, vm, …). Für Sprache starten Sie bei 32 kbps Mono — deutlich kleiner als Musik-Presets, trotzdem verständlich auf Ohrhörern und Handys. Erhöhen Sie auf 64 kbps, wenn Sie mehr Treue für laute Quellen brauchen. Tags und Cover-Art entfernen; sie verschwenden nur Bytes bei Voicemail.

Legen Sie das Rezept einmal im Dashboard fest, damit jeder Upload automatisch diese benannte Datei erhält, oder hängen Sie sie an einen fertigen Track über die Variants-API an. Der index muss eindeutig sein — ein Bitrate-Rezept pro Index.

Feldreferenz: Variants-API. Überblick der Variantentypen: Variant Types.

Das Original löschen, wenn Sie zufrieden sind

Während Sie Rezepte noch abstimmen, behalten Sie den Original Upload, damit Sie Varianten neu erzeugen können. Sobald voice richtig klingt und Sie keine Neuverarbeitung mehr brauchen, löschen Sie das Original, um das große WAV (oder eine andere Quelle) aus dem Speicher freizugeben. Danach kann AudioDN für diesen Track keine neuen Varianten mehr erzeugen — nur die verbleibenden Dateien (wie voice) bleiben für Wiedergabe und Download verfügbar.

Trade-off-Details: Original Upload. Muster für Voicemail- / Archivprodukte: hohe Qualität hochladen → auf voice warten → Original löschen → für immer nur variants=“voice” ausliefern.

Nur die Voice-Variante abspielen

Richten Sie den Player auf den Track und fordern Sie Ihre Sprach-Opus-Variante anhand des Index an, den Sie konfiguriert haben — hier variants=“voice” — mit einem Client-Side-Player-Key. Hörer laden nie die mehr-megabyte große Quelle herunter — nur die Opus-Datei, die Sie behalten haben.

Abhängigkeit

npm install @audiodn/components

Verwendung

<script type="module">
  import '@audiodn/components/player';
</script>

<audiodn-player
  api-key="YOUR_PLAYER_API_KEY"
  scope="track"
  id="TRACK_ID"
  variants="voice"
  size="regular"
></audiodn-player>

Live-Demo

Dieser Player fordert variants=“voice” an — den Index einer sprachoptimierten Opus-Variante, die für dieses Demo-Konto angelegt wurde (Sie können Ihre beliebig benennen). Der Track ist ein Anrufbeantworter-Sample; hören Sie den Footprint, den Sie ausliefern können.

Demo-Voicemail — generiertes Beispiel für dieses Beispiel (Anrufbeantworter-Signalton + Nachricht).

Weitere Player-Optionen: Player-Komponenten-Docs.

Checkliste

  • Sprache landet in AudioDN — über <audiodn-recorder>, den Uploader oder die Upload-Sessions-API.

  • Eine sprachoptimierte Opus-Transcode-Variante existiert unter dem Index Ihrer Wahl (dieses Beispiel nutzt voice), Mono und 32 (oder 64) kbps — siehe Variants-API.

  • Hören Sie diese Variante anhand des Index und bestätigen Sie, dass die Sprachqualität für Ihr Produkt ausreicht.

  • Löschen Sie den Original Upload, wenn Sie keine Varianten mehr neu erzeugen müssen — behalten Sie nur das günstige Opus-Archiv.

Veröffentlicht