Deepgram
Transcripción Deepgram para notas de voz entrantes
Deepgram es una API de voz a texto. En OpenClaw se usa para ''transcripción de audio/notas de voz entrantes'' vía ''tools.media.audio''.
Cuando está habilitado, OpenClaw sube el archivo de audio a Deepgram e inyecta la transcripción en el pipeline de respuesta (''{{Transcript}}'' + bloque ''[Audio]''). Esto ''no es streaming''; usa el endpoint de transcripción pre-grabada.
Sitio web: https://deepgram.com
Documentación: https://developers.deepgram.com
Inicio rápido
1. Establece tu clave API:
DEEPGRAM_API_KEY=dg_...
2. Habilita el proveedor:
{
tools: {
media: {
audio: {
enabled: true,
models: [{ provider: "deepgram", model: "nova-3" }],
},
},
},
}Opciones
- ''model'': id del modelo Deepgram (predeterminado: ''nova-3'')
- ''language'': pista de idioma (opcional)
- ''tools.media.audio.providerOptions.deepgram.detect_language'': habilitar detección de idioma (opcional)
- ''tools.media.audio.providerOptions.deepgram.punctuate'': habilitar puntuación (opcional)
- ''tools.media.audio.providerOptions.deepgram.smart_format'': habilitar formato inteligente (opcional)
Ejemplo con idioma:
{
tools: {
media: {
audio: {
enabled: true,
models: [{ provider: "deepgram", model: "nova-3", language: "en" }],
},
},
},
}Ejemplo con opciones de Deepgram:
{
tools: {
media: {
audio: {
enabled: true,
providerOptions: {
deepgram: {
detect_language: true,
punctuate: true,
smart_format: true,
},
},
models: [{ provider: "deepgram", model: "nova-3" }],
},
},
},
}Notas
- La autenticación sigue el orden estándar de auth del proveedor; ''DEEPGRAM_API_KEY'' es el camino más simple.
- Sobrescribe endpoints o headers con ''tools.media.audio.baseUrl'' y ''tools.media.audio.headers'' cuando uses un proxy.
- La salida sigue las mismas reglas de audio que otros proveedores (límites de tamaño, timeouts, inyección de transcripción).