Oferta de lanzamiento: Los planes Creator y Business tienen descuento por tiempo limitado. Ver precios

Gestionar la voz

Los productos de voz — buzón de voz, llamadas de soporte, avisos IVR, narración, notas de voz — necesitan un camino desde la captura hasta el almacenamiento económico y la reproducción. AudioDN cubre el ciclo completo: grabar o subir habla, generar una variante Opus optimizada para voz, eliminar el original voluminoso y transmitir solo el archivo diminuto que los oyentes necesitan.

Opus está diseñado para el habla y el streaming a baja tasa de bits. A 32 kbps mono suele sonar más claro que codificaciones MP3/AAC mucho más grandes del mismo mensaje de voz — y tu curva de almacenamiento se desploma cuando eliminas el WAV original.

Introducir la voz

Dos caminos habituales llevan el habla a AudioDN. Prefiere la mayor calidad disponible en el momento de la captura para que la codificación Opus parta de una señal limpia — luego deja que AudioDN se encargue del resto.

Grabar en el navegador

El componente web <audiodn-recorder> captura desde el micrófono, muestra una forma de onda en vivo y una vista previa, y luego sube una sola pista. El navegador prefiere Opus en WebM/Ogg cuando está disponible (MP4/AAC en Safari), de modo que la propia subida ya es amigable con la voz. Usa una clave Client-Side Upload o pasa una sesión de carga creada en el servidor.

Atributos, eventos y temas completos: Documentación del componente Recorder.

Demo en vivo

Toca para grabar, previsualiza el clip y luego envíalo. Requiere permiso de micrófono.

Graba desde el micrófono, previsualiza y sube una sola pista de voz a AudioDN.

Subir una grabación existente

Apps de teléfono, exportaciones de Zoom, grabadoras económicas y WAV de estudio pueden llegar a la misma colección. Sube con el componente Uploader o la API de Upload Sessions — crea una sesión, crea una pista, haz PUT de los bytes y espera hasta que track_status_id sea ready (o escucha un webhook de pista) antes de reproducir.

Por qué Opus para la voz

El habla suele ser mono con dinámicas estrechas. Conservar para siempre un WAV de varios megabytes (o un AAC HQ orientado a música) consume almacenamiento y ancho de banda casi sin ganancia perceptual. Una variante Opus dedicada al habla (en este ejemplo se llama voice) da a cada subida un archivo predecible y afinado para el habla que puedes entregar a reproductores, endpoints de descarga o almacenamiento en frío.

EtapaHuella típica (~45s mono)Notas
WAV de origen (48 kHz / 16 bits)~4 MBCaptura sin pérdida
Opus voice @ 32 kbps mono~180 KBHabla clara; ideal para bibliotecas de buzón de voz e IVR
Opus voice @ 64 kbps mono~360 KBMás margen para líneas ruidosas o acentos más densos

Eso es aproximadamente una reducción de 20×–40× frente al WAV de origen antes de borrar el original. A escala de biblioteca — miles de mensajes — pasas de «guardar todo para siempre» a «guardar lo que los oyentes realmente reproducen».

Transcodificar a una variante Opus de voz

No existe una variante integrada llamada voice — es solo el nombre de index que elegimos para esta cuenta de ejemplo. Configura una variante transcode con codec: “opus” y dale el índice único que quieras (voice, speech, vm, …). Para el habla, empieza en 32 kbps mono — mucho más pequeña que los presets de música, aún inteligible en auriculares y móviles. Sube a 64 kbps cuando necesites más fidelidad en fuentes ruidosas. Elimina etiquetas y carátula; solo desperdician bytes en buzón de voz.

Configura la receta una vez en el panel para que cada subida obtenga automáticamente ese archivo con nombre, o añádela a una pista lista con la API de Variants. El index debe ser único — una receta de bitrate por índice.

Referencia de campos: API de Variants. Resumen de tipos de variante: Variant Types.

Elimina el original cuando estés satisfecho

Mientras afinas las recetas, conserva el Original Upload para poder regenerar variantes. Cuando voice suene bien y ya no necesites reprocesar, elimina el original para recuperar el WAV grande (u otra fuente) del almacenamiento. Después, AudioDN no puede crear nuevas variantes para esa pista — solo los archivos restantes (como voice) siguen disponibles para reproducción y descarga.

Detalles del compromiso: Original Upload. Patrón para productos de buzón de voz / archivo: subir alta calidad → esperar voice → eliminar original → entregar solo variants=“voice” para siempre.

Reproducir solo la variante de voz

Apunta el reproductor a la pista y solicita tu variante Opus de habla por el índice que configuraste — aquí variants=“voice” — con una clave Client-Side Player. Los oyentes nunca descargan la fuente de varios megabytes — solo el archivo Opus que decidiste conservar.

Dependencia

npm install @audiodn/components

Uso

<script type="module">
  import '@audiodn/components/player';
</script>

<audiodn-player
  api-key="YOUR_PLAYER_API_KEY"
  scope="track"
  id="TRACK_ID"
  variants="voice"
  size="regular"
></audiodn-player>

Demo en vivo

Este reproductor solicita variants=“voice” — el índice de una variante Opus afinada para el habla añadida a esta cuenta demo (puedes llamar a la tuya como quieras). La pista es una muestra de contestador; escucha la huella que puedes entregar.

Demo de buzón de voz: muestra generada para este ejemplo (tono de contestador + mensaje).

Más opciones del reproductor: Documentación del componente Player.

Lista de comprobación

  • La voz llega a AudioDN — vía <audiodn-recorder>, el Uploader o la API de Upload Sessions.

  • Existe un transcode Opus afinado para el habla bajo el índice que elijas (este ejemplo usa voice), mono y 32 (o 64) kbps — ver API de Variants.

  • Escucha esa variante por índice y confirma que la calidad del habla es suficiente para tu producto.

  • Elimina el Original Upload cuando ya no necesites regenerar variantes — conserva solo el archivo Opus económico.

Publicado