スナック3行まとめ
- Cloudflare Auto Routerが、リクエストごとにAIモデルを自動選択するパブリックベータとして公開されました。
- 簡単な作業ではコストを重視し、難しい作業では回答品質の見込みに比重を置いてモデルを選びます。
- ベータ期間中はルーター自体が無料ですが、選ばれたモデルの利用料金はかかります。
Cloudflareは2026年9月30日、AIアプリやツールを運用する開発者・企業向けに、AI GatewayのAuto Routerをパブリックベータとして公開しました。毎回同じ高性能モデルに任せるのではなく、依頼に必要な能力と利用コストを考えてモデルを選び分ける機能です。

スナックガールズのひとこと
レッド: 創作ツールで短い文を整えるくらいなら、小さめのモデルに任せてみたいな。難しいアイデアを詰めるときに、強いモデルの出番が来る使い方は楽しそう。
ネア: ゲームの世界設定を何往復も相談するとき、最初に決めた細かい設定まで話がつながるのか気になります。モデルが切り替わる場面を、じっくり見てみたいですね。
メール要約と難しい作業で、モデルを選び分ける
AI Gatewayでモデル識別子をcloudflare/autoにすると、リクエストごとに候補からモデルが選ばれます。ChatGPTアプリのモデル切り替え設定ではなく、AIアプリやツールを運用する側が使う機能です。
判断には、直近の発言を優先した会話情報から推定する作業の種類や難易度、各モデルの性能データと利用料金を使います。メールやチャットの要約なら費用を重視し、難しい依頼なら回答品質の見込みを重視するため、常に最安モデルを選ぶわけではありません。

社内では最大30%の節約、成功率には差も
Cloudflareは、OpenCodeでの初期の社内利用で、最先端の高性能モデルだけを使う場合と比べて最大30%のコスト削減が見られたとしています。同社内での測定値であり、すべての利用環境で同じ削減率になるとは限りません。
同社が行った別の社内ベンチマークでは、メールや予定表、ファイルなどを扱う97の模擬タスクを、各モデルで3回ずつ試しています。報告された成功率はcloudflare/autoが86.6%、Claude Opus 5.5が96.6%、GPT-6 Solが84.2%でした。この試験ではOpusの成功率が最も高く、費用を抑えながら同じ成功率を維持できたという結果ではありません。
長い会話では、モデルを替える費用も考える
候補になるのは、リクエストの形式や実行方式に対応し、設定済みの認証情報、課金設定、アクセス制御、支出上限に合うモデルです。障害中の提供元やモデルは候補から外れ、最初に選んだモデルが処理できなければ、別の候補を試せます。
長い会話では、過去の入力を再利用するキャッシュの読み書き費用も考慮します。モデルを替えると文脈を新たに処理し直す費用がかかるため、会話が長いほど切り替えの負担を重く見積もります。別のモデルでは、それまでの推論内容を読み取れず、考え直しが必要になる場合もあります。
無料なのはルーター、API対応の拡充はこれから
ベータ期間中はAuto Router自体が無料ですが、回答を生成するモデルの利用料金まで無料になるわけではありません。
今後の計画には、候補モデルの拡充、データを保持しない要件に沿った候補の絞り込み、提供元の処理余力の考慮、依頼に応じた推論量の選択があります。Responses APIとWebSocketsへの全面対応も今後の予定で、今回提供済みの機能として案内されたものではありません。
モデル切り替えで推論の文脈を失いにくくするため、同じモデル系統を優先する仕組みも将来の計画です。また、費用との兼ね合いを設けずに回答品質の見込みを優先するcloudflare/auto-bestも予定されています。
出典・確認日: Cloudflare・2026年10月1日
