LE MONDE NE S’ARRÊTE PAS.RSS
BIG CHANGE.

Édition Markdown

AI-translated from English; not yet reviewed by a fluent editor.

# Comment vérifier un ticket d’assistance avec Cloudflare Clef-omni

> Cloudflare Clef-omni accepte l’état d’un ticket, des questions typées et, en option, une image, un fichier audio ou une vidéo. Ce guide fondé uniquement sur la documentation couvre la requête Workers AI, la réponse, le prix et les limites.

By BIG CHANGE Editorial

Published: 2026-10-10T13:09:00.735Z
Updated: 2026-10-10T13:09:00.735Z
Canonical: https://bigchange.ai/blog/cloudflare-clef-omni-support-ticket-guide

![A hand rests on a mouse beside a monitor showing an unlabeled ticket and attachment list, with a printed equipment image in the foreground.](https://bigchange.ai/api/media/file/clef-omni-ticket-review-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE.

Le 9 octobre, Cloudflare a lancé Clef-omni comme modèle décisionnel hébergé dans Workers AI, capable d’examiner du texte avec une image, un extrait audio ou une vidéo. Pour un développeur d’application, le test utile reste ciblé : fournir au modèle l’état du ticket et un ensemble fixe de questions, examiner ses réponses et laisser une personne décider de l’acheminement. Ce guide suit la [documentation actuelle du modèle de Cloudflare](https://developers.cloudflare.com/workers-ai/models/clef-omni/) et l’ [exemple de lancement](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/). BIG CHANGE n’a pas appelé l’API ni mesuré sa précision sur des tickets d’assistance.

L’identifiant du modèle est `@cf/cloudflare/clef-omni` dans Workers AI. C’est un modèle décisionnel : l’appelant définit des questions typées et des choix autorisés, puis reçoit des scores pour ces choix. Il ne rédige pas de réponse d’assistance. Cloudflare a également publié des poids ouverts, mais les étapes ci-dessous utilisent son point de terminaison hébergé. Les chiffres de vitesse et de benchmark de Cloudflare sont ses propres affirmations ; ils ne démontrent pas les performances de ce flux sur vos tickets.

## Préparer l’accès et un ensemble limité de questions

Vous avez besoin d’un compte Cloudflare avec accès à Workers AI, de son identifiant de compte, d’un jeton d’API Workers AI et soit de Python avec `requests` installé, soit d’un outil capable d’envoyer la même requête HTTP. [Le guide de configuration REST de Cloudflare](https://developers.cloudflare.com/workers-ai/get-started/rest-api/) indique où copier l’identifiant du compte et créer le jeton dans le tableau de bord. Un jeton créé manuellement doit disposer des autorisations `Workers AI - Read` et `Workers AI - Edit` . Gardez le jeton hors du ticket et du système de gestion du code source.

L’envoi d’un vrai ticket ou d’une pièce jointe transmet le contenu du client à Cloudflare pour traitement. [La page de Cloudflare sur l’utilisation des données de Workers AI](https://developers.cloudflare.com/workers-ai/platform/data-usage/) indique que ces contenus ne servent pas à entraîner les modèles proposés sur Workers AI ni à améliorer les services sans consentement explicite ; elle précise aussi qu’ils peuvent être stockés si Workers AI est utilisé avec un service de stockage tel que R2 ou KV. Avant d’envoyer des tickets clients, vérifiez votre accord Cloudflare applicable et les règles de votre organisation concernant les données clients ; réduisez ou masquez les informations personnelles lorsque c’est possible. La déclaration de Cloudflare sur l’absence d’entraînement ne suffit pas à établir que vous êtes autorisé à envoyer les données d’un client précis.

Commencez par du texte afin d’examiner la réponse avant d’ajouter des médias. L’exemple d’assistance de Cloudflare utilise l’état `Checkout has been failing for every customer for the last hour` et pose trois questions : le cas est-il urgent (`noul`, de type oui/non), quelle équipe doit le traiter (`choice`) et quelle est la gravité de l’impact (`score`) ? Il s’agit d’un exemple documenté, pas d’un incident observé. L’API accepte une chaîne ou un objet/tableau structuré comme `state`. La table `questions` doit contenir de 1 à 64 identifiants de question ; chacun possède un type et des instructions, tandis que `choice` et `score` utilisent des critères pour définir les réponses autorisées.

## Envoyer la requête textuelle

Définissez `CLOUDFLARE_AUTH_TOKEN` dans votre environnement et remplacez l’identifiant du compte ci-dessous. Cette requête Python reprend le [point de terminaison et les champs exacts de l’exemple de modèle Cloudflare](https://developers.cloudflare.com/workers-ai/models/clef-omni/) :

```python
import os
import requests

account_id = "your-account-id"
token = os.environ["CLOUDFLARE_AUTH_TOKEN"]

payload = {
    "model": "clef-omni",
    "state": "Checkout has been failing for every customer for the last hour.",
    "questions": {
        "urgent": {
            "type": "noul",
            "instructions": "Is this support request urgent?",
        },
        "team": {
            "type": "choice",
            "instructions": "Which team should handle this request?",
            "criteria": {
                "billing": "Payments, invoices, and refunds",
                "technical": "Outages, errors, and configuration",
                "sales": "Plans and upgrades",
            },
        },
        "severity": {
            "type": "score",
            "instructions": "How severe is the customer impact?",
            "criteria": ["No impact", "Minor", "Major", "Critical"],
        },
    },
}

response = requests.post(
    f"https://api.cloudflare.com/client/v4/accounts/{account_id}/ai/run/@cf/cloudflare/clef-omni",
    headers={"Authorization": f"Bearer {token}"},
    json=payload,
    timeout=60,
)
response.raise_for_status()
print(response.json())
```

Pour une vérification réussie, recherchez les entrées `answers` de la réponse sous les mêmes identifiants `urgent`, `team` et `severity` . Cloudflare décrit la première comme une probabilité d’urgence, la deuxième comme l’équipe choisie avec les probabilités de ses options et la troisième comme un score pondéré par les probabilités, dont le niveau minimal est zéro. L’API documente aussi les champs de réponse `model` et `usage` . Examinez le JSON complet renvoyé à votre compte avant de le mapper dans une application. Une probabilité est la sortie du modèle pour la question et l’état fournis, pas la garantie qu’un vrai ticket relève de cette file. Avant toute action, demandez à une personne de comparer le ticket et ses pièces jointes à l’acheminement proposé.

## Ajouter une photo, un enregistrement ou une vidéo

La [requête de lancement de Cloudflare](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/) place les médias facultatifs dans des tableaux distincts `images`, `audio` et `videos` , sous forme d’URL base64 `data:` intégrées. Par exemple, son échantillon utilise `data:image/png;base64,...`, `data:audio/mpeg;base64,...` et `data:video/mp4;base64,...`. Pour ajouter un fichier local à la charge utile Python avant `requests.post`, encodez-le et ajoutez l’URL de données au tableau correspondant :

```python
import base64
from pathlib import Path

def add_media(payload, field, file_path, mime_type):
    raw = Path(file_path).read_bytes()
    encoded = base64.b64encode(raw).decode("ascii")
    payload.setdefault(field, []).append(f"data:{mime_type};base64,{encoded}")

# Examples: use only the files present in the ticket, with their real MIME types.
# add_media(payload, "images", "photo.png", "image/png")
# add_media(payload, "audio", "recording.mp3", "audio/mpeg")
# add_media(payload, "videos", "clip.mp4", "video/mp4")
```

Exécutez `add_media` avant le POST. Gardez `state` factuel et décrivez chaque pièce jointe ; ne posez que des questions auxquelles le ticket et les médias disponibles peuvent répondre. L’exemple de lancement de Cloudflare utilise la photo d’un appareil, un enregistrement sonore et une vidéo de ventilateur pour poser trois questions oui/non sur des détails visibles et audibles. Une application d’assistance peut conserver ses propres champs de ticket dans `state` et ses propres files autorisées dans `criteria`, mais elle doit confronter ces définitions au flux de travail réel. Le service n’accepte pas les URL de médias distants.

Vérifiez les limites avant l’encodage. La [page du modèle](https://developers.cloudflare.com/workers-ai/models/clef-omni/) autorise jusqu’à quatre images PNG, JPEG ou WebP, chacune de 4 Mio et 16 mégapixels au maximum, pour 8 Mio d’images décodées au total. Elle autorise jusqu’à quatre extraits audio, chacun de 8 Mio et 300 secondes au maximum, ainsi que deux vidéos de 16 Mio et 60 secondes au maximum chacune. La limite totale des fichiers audio et vidéo décodés est de 16 Mio. La vidéo est échantillonnée à deux images par seconde ; sa bande sonore est utilisée avec les images lorsque chaque vidéo de la requête en possède une. Le coût d’une image dépend de sa taille après redimensionnement et est plafonné à 1 024 jetons par image. Si une pièce jointe est trop volumineuse ou trop longue, demandez à une personne de sélectionner un extrait pertinent plus court ou faites une vérification textuelle et examinez séparément le média original. Ne considérez pas un fichier recadré ou raccourci comme une preuve complète.

## Vérifier le coût, le contexte et les échecs

Cloudflare affiche actuellement Clef-omni au prix de **$0,15 par million de jetons d’entrée** et indique ne pas facturer les jetons de sortie. Les médias sont convertis en jetons d’entrée à ce tarif. La page du modèle indique environ 780 jetons par minute audio et jusqu’à environ 15 400 jetons par minute vidéo à résolution maximale, auxquels s’ajoutent les jetons audio si la vidéo comporte du son. Le coût d’une image dépend de sa version redimensionnée et est plafonné à 1 024 jetons par image. Il s’agit de règles de facturation, pas d’un prix fixe par pièce jointe.

Le modèle hébergé dispose d’un contexte de 64 000 jetons. Les médias et les questions comptent dans cette limite. S’ils la dépassent, Cloudflare indique que la requête échoue ; sinon, un long texte dans `state` peut être tronqué pour tenir dans la fenêtre. Une réponse renvoyée ne prouve donc pas que le modèle a pris en compte chaque ligne d’un long ticket. En cas d’échec, examinez l’erreur HTTP et réduisez ou retirez les pièces jointes dans les limites documentées avant de réessayer. En cas de réussite, vérifiez la présence des identifiants de question attendus, conservez le ticket d’origine pour examen et comparez l’acheminement proposé aux éléments disponibles. Les probabilités du modèle peuvent aider un réviseur à cibler son attention, mais une garantie de service ou un seuil automatique sûr nécessiterait une évaluation sur vos propres tickets étiquetés.

## Le grand changement

La version du 9 octobre de Cloudflare ajoute l’audio et la vidéo au parcours hébergé du modèle décisionnel Clef, déjà utilisé pour des questions typées sur du texte et des images. Un développeur peut envoyer l’état d’un ticket accompagné de médias pris en charge et recevoir, en une seule requête Workers AI, des réponses associées à un schéma fixe. L’équipe applicative doit encore décider quelles questions intégrer à ce schéma, tester les performances sur ses propres tickets et exiger une approbation humaine avant toute réponse ou action de routage.

## Sources et lectures complémentaires

- [Documentation du modèle Cloudflare Clef-omni](https://developers.cloudflare.com/workers-ai/models/clef-omni/), consultée le 10 octobre 2026. Référence principale pour l’identifiant du modèle hébergé, les champs et l’exemple de l’API, les limites des médias et du contexte, la forme des réponses et le prix par jeton indiqué. La documentation décrit le comportement du service ; BIG CHANGE n’a pas exécuté la requête.
- [Publication de lancement de Cloudflare Clef-omni](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/), 9 octobre 2026. Établit la date de lancement et fournit l’exemple de requête avec médias intégrés. Les chiffres de performance et de benchmark sont des affirmations de Cloudflare.
- [Configuration REST de Cloudflare Workers AI](https://developers.cloudflare.com/workers-ai/get-started/rest-api/), mise à jour le 15 septembre 2026 et consultée le 10 octobre. Explique comment obtenir l’identifiant de compte et le jeton d’API et précise les autorisations requises pour un jeton créé manuellement.
- [Utilisation des données de Cloudflare Workers AI](https://developers.cloudflare.com/workers-ai/platform/data-usage/), mise à jour le 21 avril 2026 et consultée le 10 octobre. Explique le traitement du contenu client par Cloudflare, la restriction déclarée concernant l’entraînement et l’amélioration des services sans consentement explicite, le stockage possible lorsqu’un service distinct est utilisé et la limite liée à l’accord applicable. Elle ne détermine pas si un développeur peut soumettre un ticket ou un enregistrement précis.

## Sources

- [Documentation du modèle Cloudflare Clef-omni](https://developers.cloudflare.com/workers-ai/models/clef-omni/) — Identifiant du modèle hébergé, schéma de requête et de sortie, limites des médias, facturation des jetons, prix et contexte ; documentation, pas un test de BIG CHANGE.
- [Introducing Clef-omni](https://blog.cloudflare.com/clef-faster-cheaper-multimodal/) — Date de lancement et exemple de requête avec médias intégrés ; les affirmations du fournisseur sur les performances et benchmarks ne constituent pas des preuves indépendantes.
- [Premiers pas : API REST Workers AI](https://developers.cloudflare.com/workers-ai/get-started/rest-api/) — Identifiant de compte, configuration du jeton Workers AI et autorisations d’un jeton créé manuellement.
- [Utilisation des données Workers AI](https://developers.cloudflare.com/workers-ai/platform/data-usage/) — Mise à jour le 21 avril 2026 ; Cloudflare indique traiter les entrées pour fournir Workers AI et ne pas les utiliser pour l’entraînement ou l’amélioration du service sans consentement explicite ; elles peuvent être stockées lorsqu’un service de stockage est utilisé. Vérifiez les accords et règles de données applicables.