# Gestionar la voz | Ejemplos de AudioDN

> Captura voz desde el micrófono o sube grabaciones, almacena el habla como una variante Opus diminuta, elimina el original y reproduce solo lo que los oyentes necesitan.

Source: https://audiodeliverynetwork.com/es/examples/handling-voice/

---

# Gestionar la voz

Los productos de voz — buzón de voz, llamadas de soporte, avisos IVR, narración, notas de voz — necesitan un camino desde la captura hasta el almacenamiento económico y la reproducción. AudioDN cubre el ciclo completo: grabar o subir habla, generar una variante **Opus** optimizada para voz, eliminar el original voluminoso y transmitir solo el archivo diminuto que los oyentes necesitan.

Opus está diseñado para el habla y el streaming a baja tasa de bits. A 32 kbps mono suele sonar más claro que codificaciones MP3/AAC mucho más grandes del mismo mensaje de voz — y tu curva de almacenamiento se desploma cuando eliminas el WAV original.

## Introducir la voz

Dos caminos habituales llevan el habla a AudioDN. Prefiere la mayor calidad disponible en el momento de la captura para que la codificación Opus parta de una señal limpia — luego deja que AudioDN se encargue del resto.

### Grabar en el navegador

El componente web `<audiodn-recorder>` captura desde el micrófono, muestra una forma de onda en vivo y una vista previa, y luego sube una sola pista. El navegador prefiere Opus en WebM/Ogg cuando está disponible (MP4/AAC en Safari), de modo que la propia subida ya es amigable con la voz. Usa una clave Client-Side Upload o pasa una sesión de carga creada en el servidor.

Atributos, eventos y temas completos: [Documentación del componente Recorder](/docs/components/recorder).

### Demo en vivo

Toca para grabar, previsualiza el clip y luego envíalo. Requiere permiso de micrófono.

Graba desde el micrófono, previsualiza y sube una sola pista de voz a AudioDN.

### Subir una grabación existente

Apps de teléfono, exportaciones de Zoom, grabadoras económicas y WAV de estudio pueden llegar a la misma colección. Sube con el [componente Uploader](/docs/components/uploader) o la [API de Upload Sessions](/docs/api/upload-sessions) — crea una sesión, crea una pista, haz PUT de los bytes y espera hasta que `track_status_id` sea `ready` (o escucha un webhook de pista) antes de reproducir.

## Por qué Opus para la voz

El habla suele ser mono con dinámicas estrechas. Conservar para siempre un WAV de varios megabytes (o un AAC HQ orientado a música) consume almacenamiento y ancho de banda casi sin ganancia perceptual. Una variante Opus dedicada al habla (en este ejemplo se llama `voice`) da a cada subida un archivo predecible y afinado para el habla que puedes entregar a reproductores, endpoints de descarga o almacenamiento en frío.

| Etapa | Huella típica (~45s mono) | Notas |
| --- | --- | --- |
| WAV de origen (48 kHz / 16 bits) | ~4 MB | Captura sin pérdida |
| Opus `voice` @ 32 kbps mono | ~180 KB | Habla clara; ideal para bibliotecas de buzón de voz e IVR |
| Opus `voice` @ 64 kbps mono | ~360 KB | Más margen para líneas ruidosas o acentos más densos |

Eso es aproximadamente una reducción de **20×–40×** frente al WAV de origen antes de borrar el original. A escala de biblioteca — miles de mensajes — pasas de «guardar todo para siempre» a «guardar lo que los oyentes realmente reproducen».

## Transcodificar a una variante Opus de voz

No existe una variante integrada llamada `voice` — es solo el nombre de `index` que elegimos para esta cuenta de ejemplo. Configura una variante `transcode` con `codec: “opus”` y dale el índice único que quieras (`voice`, `speech`, `vm`, …). Para el habla, empieza en **32 kbps mono** — mucho más pequeña que los presets de música, aún inteligible en auriculares y móviles. Sube a **64 kbps** cuando necesites más fidelidad en fuentes ruidosas. Elimina etiquetas y carátula; solo desperdician bytes en buzón de voz.

Configura la receta una vez en el [panel](https://account.audiodeliverynetwork.com/variants) para que cada subida obtenga automáticamente ese archivo con nombre, o añádela a una pista lista con la API de Variants. El `index` debe ser único — una receta de bitrate por índice.

Referencia de campos: [API de Variants](/docs/api/variants). Resumen de tipos de variante: [Variant Types](/docs/variant-types).

## Elimina el original cuando estés satisfecho

Mientras afinas las recetas, conserva el Original Upload para poder regenerar variantes. Cuando `voice` suene bien y ya no necesites reprocesar, elimina el original para recuperar el WAV grande (u otra fuente) del almacenamiento. Después, AudioDN no puede crear nuevas variantes para esa pista — solo los archivos restantes (como `voice`) siguen disponibles para reproducción y descarga.

Detalles del compromiso: [Original Upload](/docs/variant-types#original-upload). Patrón para productos de buzón de voz / archivo: subir alta calidad → esperar `voice` → eliminar original → entregar solo `variants=“voice”` para siempre.

## Reproducir solo la variante de voz

Apunta el reproductor a la pista y solicita tu variante Opus de habla por el índice que configuraste — aquí `variants=“voice”` — con una clave Client-Side Player. Los oyentes nunca descargan la fuente de varios megabytes — solo el archivo Opus que decidiste conservar.

#### Dependencia

 

```
npm install @audiodn/components
```

```
<script type="module" src="https://unpkg.com/@audiodn/components@latest/dist/player.js"></script>
```

#### Uso

```
<script type="module">
  import '@audiodn/components/player';
</script>

<audiodn-player
  api-key="YOUR_PLAYER_API_KEY"
  scope="track"
  id="TRACK_ID"
  variants="voice"
  size="regular"
></audiodn-player>
```

### Demo en vivo

Este reproductor solicita `variants=“voice”` — el índice de una variante Opus afinada para el habla añadida a esta cuenta demo (puedes llamar a la tuya como quieras). La pista es una muestra de contestador; escucha la huella que puedes entregar.

Demo de buzón de voz: muestra generada para este ejemplo (tono de contestador + mensaje).

Más opciones del reproductor: [Documentación del componente Player](/docs/components/player).

## Lista de comprobación

-   La voz llega a AudioDN — vía [<audiodn-recorder>](/docs/components/recorder), el [Uploader](/docs/components/uploader) o la [API de Upload Sessions](/docs/api/upload-sessions).
    
-   Existe un transcode Opus afinado para el habla bajo el índice que elijas (este ejemplo usa `voice`), mono y 32 (o 64) kbps — ver [API de Variants](/docs/api/variants).
    
-   Escucha esa variante por índice y confirma que la calidad del habla es suficiente para tu producto.
    
-   Elimina el Original Upload cuando ya no necesites regenerar variantes — conserva solo el archivo Opus económico.
    

Publicado 22 de julio de 2026
