News

Cloudflare lance Clef-omni et met à jour les tarifs de Clef

Cloudflare ajoute Clef-omni pour les tâches de décision multimodales, réduit le prix d'entrée de Clef-flash et indique un service hébergé Clef plus rapide.
Oct 11, 2026·4 min read
Cloudflare lance Clef-omni et met à jour les tarifs de Clef

#

Points clés

  • Clef-omni accepte du texte, des images, de l'audio et de la vidéo dans une seule requête.
  • Il attribue un score à des options de réponse définies par l'appelant au lieu de générer du texte libre.
  • Cloudflare a publié des poids ouverts sur Hugging Face et propose le modèle sur Workers AI.
  • Clef-flash bénéficie désormais d'un prix d'entrée hébergé plus bas et d'une fenêtre de contexte hébergée plus petite.
  • Cloudflare indique que le service hébergé de Clef est plus rapide après des changements d'infrastructure.

Ce que Cloudflare a annoncé

L'annonce du 9 octobre de Cloudflare ajoute un nouveau modèle à la famille Clef : Clef-omni. L'entreprise le décrit comme un modèle de décision pour des entrées multimodales. Il peut prendre ensemble du texte, des images, de l'audio et de la vidéo dans une seule requête.

Cloudflare indique que le modèle ne génère pas de texte libre. À la place, il évalue des options de réponse définies par l'appelant. Cela rend le modèle adapté à des tâches de décision structurées plutôt qu'à de la génération ouverte.

L'entreprise précise que Clef-omni est disponible sur Workers AI. Elle a aussi publié des poids ouverts sur Hugging Face. L'annonce indique que l'implémentation utilise une base mixture-of-experts Qwen3-Omni-30B-A3B-Instruct et supprime les composants de sortie vocale.

Comment le modèle est censé fonctionner

Le document source inclut un exemple d'API documenté. Dans cet exemple, une requête comprend une image, un enregistrement audio et une vidéo. La requête inclut aussi des questions structurées sur un appareil.

Cet exemple montre le schéma d'utilisation prévu du modèle. Il combine plusieurs types de médias et demande au modèle de choisir parmi des réponses définies. C'est une configuration pratique pour des flux de décision où la sortie doit rester structurée.

Clef-omni rejoint la famille Clef présentée la semaine précédente. La mise à jour du 9 octobre ajoute la prise en charge native de l’audio et de la vidéo, aux côtés du texte et des images.

Mises à jour de Clef et Clef-flash

Le même billet du 9 octobre signale aussi des changements pour d'autres offres Clef. Cloudflare indique que le prix d'entrée hébergé de Clef-flash passe de 0,09 $ à 0,038 $ par million de jetons d'entrée. Il précise aussi que la fenêtre de contexte hébergée passe de 64 000 jetons à 24 000 jetons.

Cloudflare ajoute une distinction importante. Il indique que les poids publiés sont inchangés et conservent toujours une capacité de contexte entraînée plus longue pour l'auto-hébergement. Cela signifie que le service hébergé et les poids auto-hébergés ne sont pas décrits de la même manière.

Le billet précise aussi que le service hébergé du modèle Clef original est désormais jusqu'à deux fois plus rapide selon les mesures de Cloudflare. Cloudflare attribue cela à des changements d'infrastructure. Il indique que les poids du modèle eux-mêmes sont inchangés.

Benchmarks et interprétation

Cloudflare publie des résultats de benchmark pour Clef-omni, Clef, Clef-flash et Jev sur des tâches de décision. Il s'agit de chiffres fournis par le fournisseur. Ils varient selon la tâche.

Cela compte pour l'interprétation. La source ne présente pas les benchmarks comme une preuve indépendante d'une supériorité universelle. Elle ne prétend pas non plus qu'un modèle est le meilleur pour chaque charge de travail.

La lecture la plus prudente est plus étroite. L'annonce montre que Cloudflare positionne ces modèles pour des tâches de décision, avec différents compromis en matière de modalité, de vitesse, de tarification et de mode de déploiement.

Considérations opérationnelles

La source met en avant quelques considérations pratiques. Premièrement, les tarifs hébergés et les limites de contexte peuvent changer. Deuxièmement, la latence peut varier selon le déploiement. Troisièmement, la disponibilité peut aussi varier selon le déploiement et les évolutions futures.

L'annonce distingue aussi le comportement hébergé des poids publiés. Cette distinction est importante pour les équipes qui souhaitent auto-héberger. La source indique que les poids publiés conservent une capacité de contexte entraînée plus longue, tandis que la fenêtre de contexte de Clef-flash hébergé est plus petite.

Comme le modèle attribue un score à des options définies par l'appelant, les utilisateurs ont besoin de prompts structurés et d'ensembles de réponses. Ce n'est pas un risque en soi, mais une exigence opérationnelle. La sortie du modèle dépend de la manière dont les options sont formulées.

Pertinence pour le Maroc

La source ne signale aucun lancement, client, réglementation ou effet mesuré spécifique au Maroc. Une leçon globale possible est que les modèles de décision multimodaux peuvent convenir à des flux de travail structurés où les sorties doivent rester contraintes.

Conclusion

La mise à jour de Cloudflare élargit la famille Clef avec un modèle de décision multimodal et ajuste les détails de tarification et de service pour les modèles existants. L'annonce est surtout forte sur le positionnement produit et les options de déploiement.

Elle reste aussi prudente sur ses affirmations. Les benchmarks sont fournis par le fournisseur, et la source ne les présente pas comme une preuve universelle. Pour les lecteurs, le principal enseignement est simple : Cloudflare mise sur une décision structurée et multimodale avec différents compromis entre hébergement et auto-hébergement.

Suivez-nous sur Google

Ajoutez Intelligence Artificielle Maroc à vos sources préférées pour retrouver davantage de nos actualités pertinentes dans la recherche Google.

Nous ajouter comme source préférée
Développement de plateformes IA

Que souhaitez-vous construire ?

Nous construisons des plateformes IA sur mesure, des produits SaaS, des applications métier intelligentes et des systèmes d’automatisation.

Ce formulaire est réservé aux demandes de projets, et non aux questions générales sur l’intelligence artificielle.

Nom *
E-mail professionnel *
Organisation (facultatif)
Solution *
Courte description du projet *

Related Articles

featured
J
Jawad
·Oct 11, 2026

Précis, mais pas humble : ce que les agents LLM ignorent de l'incertitude

featured
J
Jawad
·Oct 11, 2026

BrickBench teste la conception LEGO agentique sous contraintes

featured
J
Jawad
·Oct 11, 2026

Comment Postman exécute Agent Mode sur Amazon Bedrock

featured
J
Jawad
·Oct 11, 2026

Planification efficace pour les clusters GPU : déploiement interne d'Ai2