Optimizar para voz
Convierte mensajes de contestador, grabaciones de llamadas y notas de voz en algo que realmente puedas escalar. Sube lo que produzca el grabador, deja que AudioDN genere un archivo Opus afinado para voz a 32 o 64 kbps, y luego elimina el original para conservar — y transmitir — solo el archivo diminuto que necesitan los oyentes.
Opus está pensado para voz y streaming a bajo bitrate. A 32 kbps mono a menudo suena más claro que encodes MP3/AAC mucho más grandes del mismo mensaje de buzón de voz — y tu curva de almacenamiento se derrumba cuando eliminas el WAV original.
Qué puedes publicar
Usa este patrón siempre que la voz sea el producto: buzón de voz, archivos de llamadas de soporte, prompts de IVR,
narración y memos de voz. Esas fuentes suelen ser mono con dinámica estrecha — conservar un WAV de varios megabytes
(o un AAC HQ orientado a música) para siempre quema almacenamiento y ancho de banda casi sin ganancia perceptiva.
Una variante dedicada voice da a cada carga un archivo predecible y afinado para voz que puedes pasar
a players, endpoints de descarga o almacenamiento frío.
| Etapa | Huella típica (~45 s mono) | Notas |
|---|---|---|
| WAV de origen (48 kHz / 16-bit) | ~4 MB | Captura sin pérdida / muestra usada abajo |
Opus voice @ 32 kbps mono | ~180 KB | Voz clara; ideal para bibliotecas a escala de buzón de voz e IVR |
Opus voice @ 64 kbps mono | ~360 KB | Más margen para líneas ruidosas o acentos más densos |
Eso es aproximadamente una reducción de 20×–40× frente al WAV de origen antes de eliminar el original. A escala de biblioteca — miles de mensajes — pasas de “guardar todo para siempre” a “guardar lo que los oyentes realmente reproducen.”
1. Sube cualquier grabación de voz, sea cual sea su calidad
Omite la compresión agresiva en el cliente. Apps de teléfono, exportaciones de Zoom, grabadoras baratas y WAVs de estudio pueden aterrizar en la misma colección — AudioDN analiza el archivo y construye variantes a partir de la mejor fuente disponible. Prefiere la mayor calidad que tengas en el momento de la carga (WAV / FLAC / AIFF cuando sea posible) para que el encode Opus parta de una señal limpia.
Este recorrido usa una muestra generada de contestador — un beep clásico seguido de una madre imponente preguntando, con máximo timing cómico, cuándo llegan los nietos. Descarga el WAV de origen si quieres ejecutar la carga tú mismo: answering-machine-message.wav.
Crear una sesión de carga
Ejemplo de solicitud
# COLLECTION_ID: uuid de la colección a la que subir
curl -X POST "https://api.audiodelivery.net/v1/upload_session" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"collection_id": "COLLECTION_ID",
"expires_in": 7200
}' Crear una pista en la sesión
Ejemplo de solicitud
# SESSION_ID: upload_session_id de la llamada anterior
curl -X POST "https://api.audiodelivery.net/v1/upload/SESSION_ID/track" \
-H "Content-Type: application/json" \
-d '{
"file_name": "answering-machine-message.wav"
}' Subir los bytes del archivo
# Haz PUT de los bytes de la grabación a track_upload.upload_url.
# Cualquier audio compatible funciona — empieza con la mayor calidad que tengas (aquí se muestra WAV).
curl -X PUT "$UPLOAD_URL" \
--data-binary @answering-machine-message.wav \
-H "Content-Type: audio/wav" Haz polling de GET /v1/track/:track_id hasta que track_status_id sea ready.
Las variantes a nivel de organización terminan en este paso — incluido un archivo Original Upload si esa receta
está habilitada. Detalles de la sesión de carga:
API de sesiones de carga.
2. Transcodifica a una variante Opus de voz
Crea una variante transcode llamada voice con codec: “opus”. Para voz,
empieza en 32 kbps mono — drásticamente más pequeña que los presets de música, y sigue siendo
inteligible en auriculares y teléfonos. Sube a 64 kbps cuando necesites más fidelidad para fuentes
ruidosas. Elimina tags y cover art; solo desperdician bytes en buzones de voz.
Configura la receta una vez en el dashboard para que cada carga obtenga un archivo voice
automáticamente, o añádela a una pista ready con la API de variantes (abajo). En este endpoint solo se permiten
codecs con pérdida — Opus es exactamente lo que quieres aquí.
Recomendado: Opus mono a 32 kbps
Ejemplo de solicitud
# TRACK_ID: uuid de la pista ready
curl -X POST "https://api.audiodelivery.net/v1/track/TRACK_ID/variant" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"variant_type_id": "transcode",
"index": "voice",
"codec": "opus",
"bitrate": 32,
"is_stereo": false,
"is_strip_tags": true,
"is_strip_cover": true
}' Opcional: 64 kbps si necesitas más margen
Alternate Request
# TRACK_ID: uuid de la pista ready
curl -X POST "https://api.audiodelivery.net/v1/track/TRACK_ID/variant" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"variant_type_id": "transcode",
"index": "voice",
"codec": "opus",
"bitrate": 64,
"is_stereo": false,
"is_strip_tags": true,
"is_strip_cover": true
}' El index debe ser único
El valor de index (voice) no debe colisionar con una variante existente de organización o
de pista. Elige una receta de bitrate por index — no hagas POST de 32 y 64 contra el mismo nombre
voice.
La pista vuelve a processing mientras se construye Opus y luego regresa a ready.
Referencia de parámetros: API de variantes.
3. Elimina el original cuando estés satisfecho
Mientras sigues afinando recetas, conserva el Original Upload para poder regenerar variantes. Una vez que
voice suene bien y ya no necesites reprocesar, elimina el original para recuperar el WAV grande (u
otro origen) del almacenamiento. Después de eso, AudioDN no puede generar nuevas variantes para esa pista — solo
los archivos restantes (como voice) siguen disponibles para reproducción y descarga.
En el dashboard, abre la pista → files / variants, confirma que voice está ready y luego elimina el
Original Upload. Consulta Original Upload para el compromiso: los
originales son un seguro; cuando estés contento con el resultado Opus, son sobre todo nostalgia cara.
Patrón para productos de buzón de voz / archivo: carga de alta calidad → espera a voice → elimina el
original → entrega solo variants=“voice” para siempre.
4. Reproduce solo la variante de voz
Apunta el player a la pista y solicita variants=“voice” con una clave Client-Side Player.
Los oyentes nunca descargan el origen de varios megabytes — solo el archivo Opus que decidiste conservar.
Dependencia
npm install @audiodn/components Uso
<script type="module">
import '@audiodn/components/player';
</script>
<audiodn-player
api-key="YOUR_PLAYER_API_KEY"
scope="track"
id="9b46405d-edc0-497c-9c36-4c97ceb15337"
variants="voice"
size="regular"
></audiodn-player> Demo en vivo
La reproducción es la variante Opus voice de la muestra del contestador — escucha la huella que
puedes publicar.
Demo de buzón de voz: muestra generada para este ejemplo (tono de contestador + mensaje).
Más opciones del player: Documentación del componente Player.
Lista de comprobación
- Sube la fuente de voz de mayor calidad que tengas (se muestra WAV; cualquier formato compatible funciona).
Existe un transcode
voiceconcodec: “opus”, mono y 32 (o 64) kbps.- Escucha
variants=“voice”y confirma que la calidad de voz es suficiente para tu producto. - Elimina el Original Upload cuando ya no necesites regenerar variantes — conserva solo el archivo Opus barato.