CloudflareがJevっぽい意思決定モデル「Clef」を公開、画像入力に対応しベンチマークではJev超えだがJev作者はベンチマークそのものに懐疑的
Cloudflareが意思決定モデル「Clef」をオープンモデルとして公開しました。意思決定モデルの流行の切っ掛けとなったJevと異なり、画像の入力にも対応しているのが特徴です。
Introducing Clef: our open-source decision models, and new RL fine-tuning platform | Cloudflare Blog
https://blog.cloudflare.com/clef-decision-models/
2026年9月15日にJevが登場した後、同様の機能を持った意思決定モデルが続々と登場しています。意思決定モデルはLLMと異なるアプローチでタスクを処理し、入力に対する判断を出力することが可能。処理結果は多数の選択肢それぞれについてスコアが出力される仕組みで、適切な用途で使えばLLMより圧倒的に高速かつ低コストでタスクを処理できます。
そんな意思決定モデルの1つとしてCloudflareが開発したのがClefです。「Clef」という名称は、楽譜で音の高さを決める「Clef(音部記号)」から取られています。
Jevはテキストの入力にのみ対応していますが、Clefは画像の入力にも対応しているのが特徴です。通常版の「Clef」と軽量版の「Clef-flash」が存在しており、ClefはベンチマークテストでJevを超えるスコアを記録しています。以下のグラフは横軸が出力にかかる時間、縦軸が意思決定モデルのベンチマークテスト「Decision Index 0.2.1」のスコアを示しており、ClefがJevと比べて高速かつ高スコアであることが分かります。
Cloudflareの脅威インテリジェンスチームはすでにClefを用いてウェブサイトの分類を実行しているとのこと。Clefは「ファッションサイトである可能性が95%」「オンラインストアである可能性が85%」「詐欺サイトである可能性が1%未満」といったように検証対象のウェブサイトのカテゴリを分類可能。分類処理をgpt-oss-120bで実行すると4.7秒かかりますが、Clefなら2.2秒で完了できます。また、Clefは複数の選択肢を処理できるのも強みです。
ClefとClef-flashはオープンモデルとして公開されており、以下のリンク先からダウンロードできます。ライセンスはApache License 2.0です。
Cloudflare/clef · Hugging Face
https://huggingface.co/Cloudflare/clef
Cloudflare/clef-flash · Hugging Face
https://huggingface.co/Cloudflare/clef-flash
すでにOllamaがClefシリーズの実行をサポートしています。
— ollama (@ollama) October 3, 2026.@Cloudflare's decision models are available on Ollama!
Decision models allow you to classify an image, label a bug report or route a support ticket to the right team.
Clef (27B):
ollama pull clefClef Flash (9B):
ollama pull clef-flash pic.twitter.com/hxohKeomvT
なお、ベンチマークスコアでJevを上回る意思決定モデルが次々と登場する中で、Jevの開発者であるディオゴ・アルメイダ氏はベンチマークテストの有効性に対して疑問を呈しています。例えば日本時間の2026年10月5日には「ベンチマークテストのために最適化されたモデルと、真の信頼性を重視するモデルの間には決定的な違いがあり、その違いはベンチマークスコアには現れません。(LLMでこの現象を学んできました……)」とポストしています。
— Diogo Almeida (@CompleteSkeptic) October 4, 2026there's a critical difference between benchmaxxed models and ones made by people who truly care about reliability that, by definition, doesn't show up on benchmarks
(we've somewhat learned this for string LLMs...) https://t.co/u808vG8Eap
また、2026年10月2日には「Jevの市場進出戦略担当者はすでにフォーチュン500企業の4分の1で導入を進めている」と述べ、Jevの優位性をアピールしています。
— Diogo Almeida (@CompleteSkeptic) October 1, 2026me to our GTM guy: do enterprises want benchmarks
him: no, the fast ones have already benchmarked their internal use cases. the slow ones are copying the fast ones.
he's onboarded a quarter of the fortune 500 already 🥵
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.

