AI-translated from English; not yet reviewed by a fluent editor.
# Cómo consultar un ticket de soporte con Cloudflare Clef-omni
> Clef-omni de Cloudflare acepta el estado de un ticket, preguntas tipadas y entradas opcionales de imagen, audio o vídeo. Esta guía documental cubre su solicitud de Workers AI, respuesta, precio y límites.
By BIG CHANGE Editorial
Published: 2026-10-10T13:09:00.735Z
Updated: 2026-10-10T13:09:00.735Z
Canonical: https://bigchange.ai/blog/cloudflare-clef-omni-support-ticket-guide

AI-generated conceptual illustration by BIG CHANGE.
Cloudflare lanzó Clef-omni el 9 de octubre como un modelo de decisión alojado en Workers AI que puede examinar texto junto con una imagen, un clip de audio o un vídeo. Para quien desarrolla una aplicación, la prueba útil es concreta: dar al modelo el estado del ticket y un conjunto fijo de preguntas, revisar sus respuestas y dejar la decisión de enrutamiento en manos de una persona. Esta guía sigue [la documentación actual del modelo de Cloudflare](https://developers.cloudflare.com/workers-ai/models/clef-omni/) y el [ejemplo de lanzamiento](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/). BIG CHANGE no ha ejecutado la API ni medido su precisión con tickets de soporte.
El ID del modelo es `@cf/cloudflare/clef-omni` en Workers AI. Es un modelo de decisión: quien realiza la llamada define preguntas tipadas y opciones permitidas, y recibe puntuaciones para esas opciones. No redacta una respuesta de soporte. Cloudflare también ha publicado pesos abiertos, pero los pasos siguientes usan su endpoint alojado. Las cifras de velocidad y benchmarks de Cloudflare son afirmaciones propias; no demuestran cómo funcionará este flujo de trabajo con tus tickets.
## Preparar el acceso y un conjunto acotado de preguntas
Necesitas una cuenta de Cloudflare con acceso a Workers AI, su ID de cuenta, un token de API de Workers AI y Python con `requests` instalado, o una herramienta capaz de realizar la misma solicitud HTTP. [La guía de configuración REST de Cloudflare](https://developers.cloudflare.com/workers-ai/get-started/rest-api/) muestra dónde copiar el ID de cuenta y crear el token en el panel. Un token creado manualmente necesita los permisos `Workers AI - Read` y `Workers AI - Edit`. No incluyas el token en el ticket ni en el control de versiones del código fuente.
Enviar un ticket real o un archivo adjunto envía contenido del cliente a Cloudflare para su procesamiento. [La página de uso de datos de Workers AI de Cloudflare](https://developers.cloudflare.com/workers-ai/platform/data-usage/) afirma que no usa ese contenido para entrenar modelos ofrecidos en Workers AI ni para mejorar servicios sin consentimiento explícito; también indica que el contenido puede almacenarse si Workers AI se usa con un servicio de almacenamiento como R2 o KV. Antes de enviar tickets de clientes, revisa el contrato aplicable con Cloudflare y las reglas de datos de clientes de tu organización, y minimiza o redacta información personal cuando sea práctico. La declaración de que Cloudflare no entrena con esos datos no establece por sí sola que puedas enviar los datos de un cliente concreto.
Empieza con texto para inspeccionar la respuesta antes de añadir medios. El propio ejemplo de soporte de Cloudflare usa el estado `Checkout has been failing for every customer for the last hour` y plantea tres preguntas: si es urgente (`noul`, de tipo sí/no), qué equipo debe atenderlo (`choice`) y cuál es la gravedad del impacto (`score`). Es un ejemplo documentado, no un incidente observado. La API acepta una cadena o un objeto/array estructurado como `state`. El mapa `questions` debe contener de 1 a 64 IDs de preguntas; cada una tiene un tipo e instrucciones, mientras que `choice` y `score` usan criterios para definir las respuestas permitidas.
## Enviar la solicitud de texto
Configura `CLOUDFLARE_AUTH_TOKEN` en tu entorno y sustituye el ID de cuenta de abajo. Esta solicitud en Python adapta el [endpoint y los campos exactos del ejemplo del modelo de Cloudflare](https://developers.cloudflare.com/workers-ai/models/clef-omni/):
```python
import os
import requests
account_id = "your-account-id"
token = os.environ["CLOUDFLARE_AUTH_TOKEN"]
payload = {
"model": "clef-omni",
"state": "Checkout has been failing for every customer for the last hour.",
"questions": {
"urgent": {
"type": "noul",
"instructions": "Is this support request urgent?",
},
"team": {
"type": "choice",
"instructions": "Which team should handle this request?",
"criteria": {
"billing": "Payments, invoices, and refunds",
"technical": "Outages, errors, and configuration",
"sales": "Plans and upgrades",
},
},
"severity": {
"type": "score",
"instructions": "How severe is the customer impact?",
"criteria": ["No impact", "Minor", "Major", "Critical"],
},
},
}
response = requests.post(
f"https://api.cloudflare.com/client/v4/accounts/{account_id}/ai/run/@cf/cloudflare/clef-omni",
headers={"Authorization": f"Bearer {token}"},
json=payload,
timeout=60,
)
response.raise_for_status()
print(response.json())
```
Para una comprobación correcta, busca en la respuesta las entradas de `answers` correspondientes a los mismos `urgent`, `team` y `severity` IDs. Cloudflare describe el primero como una probabilidad de urgencia, el segundo como el equipo seleccionado con probabilidades para sus opciones, y el tercero como una puntuación ponderada por probabilidades cuyo nivel mínimo es cero. La API también documenta los campos de respuesta `model` y `usage`. Inspecciona el JSON completo devuelto a tu cuenta antes de asignarlo a campos de una aplicación. Una probabilidad es la salida del modelo para la pregunta y el estado proporcionados, no una garantía de que un ticket real pertenezca a esa cola. Antes de actuar, una persona debe comparar el ticket y cualquier adjunto con la ruta propuesta y las pruebas.
## Añadir una foto, grabación o vídeo
La [solicitud de lanzamiento](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/) de Cloudflare coloca los medios opcionales en arrays separados de `images`, `audio` y `videos` como datos base64 incrustados en `data:` URLs. Por ejemplo, la muestra usa `data:image/png;base64,...`, `data:audio/mpeg;base64,...` y `data:video/mp4;base64,...`. Para añadir un archivo local a la carga útil de Python antes de `requests.post`, codifícalo y añade la URL de datos al array correspondiente:
```python
import base64
from pathlib import Path
def add_media(payload, field, file_path, mime_type):
raw = Path(file_path).read_bytes()
encoded = base64.b64encode(raw).decode("ascii")
payload.setdefault(field, []).append(f"data:{mime_type};base64,{encoded}")
# Examples: use only the files present in the ticket, with their real MIME types.
# add_media(payload, "images", "photo.png", "image/png")
# add_media(payload, "audio", "recording.mp3", "audio/mpeg")
# add_media(payload, "videos", "clip.mp4", "video/mp4")
```
Ejecuta `add_media` antes del POST. Mantén `state` factual y describe qué es cada adjunto; pregunta solo aquello que puedan responder el ticket y los medios disponibles. El ejemplo de lanzamiento de Cloudflare usa una foto de una unidad, una grabación de sonido y un vídeo de un ventilador para plantear tres preguntas de sí/no sobre detalles visibles y audibles. Una aplicación de soporte puede conservar sus propios campos del ticket en `state` y sus propias colas permitidas en `criteria`, pero debe contrastar esas definiciones con su flujo de trabajo real. El servicio no acepta URLs de medios remotos.
Comprueba los límites antes de codificar. La [página del modelo](https://developers.cloudflare.com/workers-ai/models/clef-omni/) permite hasta cuatro imágenes PNG, JPEG o WebP, de un máximo de 4 MiB y 16 megapíxeles cada una, con un total de imágenes decodificadas de 8 MiB. Permite hasta cuatro clips de audio, cada uno de hasta 8 MiB y 300 segundos, y dos vídeos, cada uno de hasta 16 MiB y 60 segundos. El límite total decodificado combinado de audio y vídeo es de 16 MiB. El vídeo se muestrea a dos fotogramas por segundo; la banda sonora se usa junto con los fotogramas cuando todos los vídeos de la solicitud tienen una. Si un adjunto es demasiado grande o largo, pide a una persona seleccionar un fragmento pertinente más pequeño o usa una revisión solo de texto y examina el medio original por separado. No trates un archivo recortado o acortado como evidencia completa.
## Comprobar costes, contexto y vías de error
Cloudflare muestra actualmente Clef-omni a **0,15 USD por millón de tokens de entrada** y afirma que no cobra los tokens de salida. Los medios se convierten en tokens de entrada a esa tarifa. Su página del modelo indica aproximadamente 780 tokens por minuto de audio y hasta unos 15.400 tokens por minuto de vídeo a resolución máxima, además de tokens de audio si el vídeo tiene sonido. El coste de imagen depende de la imagen redimensionada y tiene un máximo de 1.024 tokens por imagen. Son reglas de facturación, no un precio fijo por adjunto.
El modelo alojado tiene un contexto de 64.000 tokens. Los medios y las preguntas cuentan para ese límite. Si lo superan, Cloudflare dice que la solicitud falla; de lo contrario, el texto largo en `state` puede truncarse para ajustarse. Por tanto, recibir una respuesta no demuestra que el modelo haya considerado cada línea de un ticket largo. Si falla una solicitud, inspecciona el error HTTP y reduce o elimina adjuntos dentro de los límites documentados antes de reintentar. Si tiene éxito, verifica que aparezcan los IDs de preguntas esperados, conserva el ticket original para su revisión y compara la ruta propuesta con las pruebas. Las probabilidades del modelo pueden ayudar a quien revisa a centrar la atención, pero una garantía de servicio o un umbral automático seguro exigiría evaluarlo con tus propios tickets etiquetados.
## El gran cambio
El lanzamiento de Cloudflare del 9 de octubre añade audio y vídeo a la ruta alojada del modelo de decisión Clef, ya utilizada para preguntas tipadas sobre texto e imágenes. Un desarrollador puede enviar el estado de un ticket con medios compatibles y recibir respuestas asociadas a un esquema fijo mediante una sola solicitud de Workers AI. El equipo de la aplicación aún debe decidir qué preguntas incluir en ese esquema, probar el rendimiento con sus propios tickets y exigir aprobación humana antes de responder o cambiar el enrutamiento.
## Fuentes y lecturas adicionales
- [Documentación del modelo Cloudflare Clef-omni](https://developers.cloudflare.com/workers-ai/models/clef-omni/), consultada el 10 de octubre de 2026. Referencia principal para el ID del modelo alojado, campos y ejemplo de API, límites de medios y contexto, formato de respuesta y precio indicado por token. La documentación describe el comportamiento del servicio; BIG CHANGE no ejecutó la solicitud.
- [Publicación de lanzamiento de Clef-omni de Cloudflare](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/), 9 de octubre de 2026. Establece la fecha de lanzamiento y ofrece el ejemplo de solicitud con medios incrustados. Las cifras de rendimiento y benchmarks son afirmaciones de Cloudflare.
- [Configuración REST de Cloudflare Workers AI](https://developers.cloudflare.com/workers-ai/get-started/rest-api/), última actualización el 15 de septiembre de 2026 y consultada el 10 de octubre. Muestra cómo obtener el ID de cuenta y el token de API e identifica los permisos necesarios para un token creado manualmente.
- [Uso de datos de Cloudflare Workers AI](https://developers.cloudflare.com/workers-ai/platform/data-usage/), última actualización el 21 de abril de 2026 y consultada el 10 de octubre. Explica el tratamiento del contenido del cliente por Cloudflare, su restricción declarada sobre entrenamiento y mejora del servicio sin consentimiento explícito, el posible almacenamiento al usar otro servicio de almacenamiento y el límite impuesto por el acuerdo aplicable. No determina si un desarrollador puede enviar un ticket o grabación concretos.
## Sources
- [Documentación del modelo Cloudflare Clef-omni](https://developers.cloudflare.com/workers-ai/models/clef-omni/) — ID del modelo alojado, esquema de solicitud y salida, límites de medios, facturación por tokens, precio y contexto; documentación, no una prueba de BIG CHANGE.
- [Introducing Clef-omni](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/) — Fecha de lanzamiento y ejemplo de solicitud con medios incrustados; las afirmaciones del proveedor sobre rendimiento y benchmarks no son pruebas independientes.
- [Get started: Workers AI REST API](https://developers.cloudflare.com/workers-ai/get-started/rest-api/) — Configuración del ID de cuenta, token de Workers AI y permisos para un token creado manualmente.
- [Workers AI data usage](https://developers.cloudflare.com/workers-ai/platform/data-usage/) — Última actualización el 21 de abril de 2026; Cloudflare afirma que procesa entradas para proporcionar Workers AI y no las usa para entrenar o mejorar servicios sin consentimiento explícito; puede almacenarlas al usarse un servicio de almacenamiento. Revisa los acuerdos aplicables y las reglas de datos.
El boletín de BIG CHANGE
La visión global, a tu ritmo.
Historias recientes sobre IA y robótica, cambios que vale la pena observar e ideas prácticas para usar. Elige un informe diario, un resumen semanal o una perspectiva mensual.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
Tu privacidad, tu elección.
El almacenamiento necesario ayuda a proteger el sitio y a recordar tus preferencias. Google Analytics opcional permanece desactivado hasta que lo autorices. Puedes leer todas las historias usando solo el almacenamiento necesario. Detalles de privacidad