広告

話題

Cloudflareの決定モデル「Clef」と「Clef-Flash」とは?候補を確率で評価する仕組みと提供状況

デイリートピックス編集部公開: 2026/10/03約3分で読めます3 views
広告

問い合わせの振り分けや緊急度の判定では、あらかじめ決めた候補から答えを選ぶ処理が使われます。Cloudflareが2026年10月1日に発表した「Clef」と「Clef-Flash」は、状況と質問を受け取り、選択肢ごとの確率を返す「決定モデル」です。

候補ごとの確率を返す仕組み

一般的な大規模言語モデル(LLM)は自由な文章の生成に使われます。Clefは、入力された状況について、指定された質問の選択肢を評価します。質問には、はい・いいえで答える形式、複数の候補から選ぶ形式、段階で評価する形式があります。

たとえば、問い合わせの内容と担当部署の候補を入力すると、モデルは候補ごとの確率を返します。プログラムはその値を振り分けや担当者への確認依頼に利用できます。ただし、モデルが返す確率は、選択した答えの正しさや実際の発生確率を保証しません。振り分けの基準や人が確認する条件は、利用する側が設計します。

モデルの規模と公開形態

Cloudflareの公開資料によると、Clefは270億、Clef-Flashは90億のパラメータを持ちます。両モデルはテキストやJSONに加え、画像や動画も入力できます。Cloudflareは両モデルをWorkers AIで提供し、モデルの重みをApache 2.0ライセンスでHugging Faceに公開しました。

Cloudflareのモデルカードは、ClefのAPIがJev/SystemOneと互換性を持つと説明しています。ただし、公開資料だけでは、すべての入力や動作について完全な互換性があるかまでは確認できません。

性能比較で確認できる範囲

Cloudflareが発表記事に掲載した評価表では、Clefがすべての項目で最高点を取ったわけではありません。測定に使ったハードウェア、入力の長さ、試行回数なども記事からは十分に確認できません。掲載値はCloudflareによる特定の評価結果であり、あらゆる業務での精度や速度を示すものではありません。

Cloudflareは、ウェブサイトを取得・描画して分類する自社の処理例で、Clefが2.2秒、gpt-oss-120bが4.7秒だったと報告しました。この数字は処理全体の時間です。モデル単体の推論時間や、一般的な利用環境での速度を比較した結果ではありません。

微調整サービスの発表時点の状況

Cloudflareは、顧客の用途に合わせた微調整を担当チームが支援すると発表しました。一方、利用者自身が微調整を進めるセルフサービス基盤は、発表記事では今後構築する計画として説明されています。発表時点で一般提供されていたとは確認できません。

Cloudflareは、AIエージェントの判断にClefを使い、その後の文章作成などを別のLLMに任せる構成も示しています。Clefが返す確率やCloudflareの評価値だけで、個別の業務における判定精度は確定しません。

出典

広告

出典・参考リンク

広告

あわせて読みたい