Higiene de Transcripciones
Referencia: reglas de sanitización y reparación de transcripciones específicas por proveedor
Este documento describe correcciones específicas por proveedor aplicadas a transcripciones antes de una ejecución
(construyendo contexto del modelo). Estos son ajustes en memoria usados para satisfacer requisitos
estrictos del proveedor. No reescriben la transcripción JSONL almacenada en disco.
El alcance incluye:
- Sanitización de id de llamada de herramienta
- Reparación de emparejamiento de resultado de herramienta
- Validación / ordenamiento de turnos
- Limpieza de firma de pensamiento
- Sanitización de payload de imagen
Si necesitas detalles de almacenamiento de transcripción, ver:
Regla global: sanitización de imagen
Los payloads de imagen siempre se sanitizan para prevenir rechazo del lado del proveedor debido a límites
de tamaño (reducir/recomprimir imágenes base64 sobredimensionadas).
Implementación:
- ''sanitizeSessionMessagesImages'' en ''src/agents/pi-embedded-helpers/images.ts''
- ''sanitizeContentBlocksImages'' en ''src/agents/tool-images.ts''
Comportamiento histórico (pre-2026.1.22)
Antes del release 2026.1.22, OpenClaw aplicaba múltiples capas de higiene de transcripción:
- Una extensión transcript-sanitize se ejecutaba en cada construcción de contexto y podía:
- Reparar emparejamiento de uso/resultado de herramienta.
- Sanitizar ids de llamada de herramienta (incluyendo un modo no estricto que preservaba ''_''/''-'').
- El runner también realizaba sanitización específica por proveedor, lo que duplicaba trabajo.
- Mutaciones adicionales ocurrían fuera de la política del proveedor, incluyendo:
- Eliminar etiquetas ''<final>'' del texto del asistente antes de persistir.
- Descartar turnos de error de asistente vacíos.
Esta complejidad causó regresiones entre proveedores (notablemente emparejamiento ''openai-responses'' ''call_id|fc_id''). La limpieza 2026.1.22 eliminó la extensión, centralizó la lógica en el runner, e hizo OpenAI ''intocable'' más allá de la sanitización de imagen.