本記事は2026年10月4日時点の
はじめに:そのタスク、本当にOpusが必要ですか
Claude Codeで
軽い/model で
この
Jevとは:文章を書かない「判定専用」モデル
Jevは、
使い方も
| 質問の | 返ってくる | モデル振り分けでの |
|---|---|---|
| Choice | 選択肢の | 「機械的/通常/複雑/高難度」の |
| Score | 尺度上の | 必要な |
| Noul | 真である | 「本番環境や |
出力の
価格は
Claude Codeへの組み込み方は2通り
Jevで
| jev-router | jev-model-router | |
|---|---|---|
| 仕組み | ANTHROPIC_BASE_URLで | Claude Codeの |
| 既定で | メイン会話の | サブエージェントの |
| 動作要件 | Node.js 22以上、 | Claude Code 2.1.259以上、CLAUDE_CODE_ENABLE_FUNCTION_HOOKS=1 |
| 見える | ブラウザの | 判定結果を |
| 提供形態 | OSS | Claude Code Templatesの |
プロキシ型の~/.claude/settings.json に
# 導入(Jev用のAPIキーを対話で入力)
npx @ediri/jev-router setup
# settings.json に追加される設定
{
"env": {
"ANTHROPIC_BASE_URL":"http://127.0.0.1:4000",
"CLAUDE_CODE_GATEWAY_HINT_HEADERS":"1",
"CLAUDE_CODE_AUTO_COMPACT_WINDOW":"160000",
"ENABLE_TOOL_SEARCH":"true"
}
}
な@ediri/ の
設計の肝:なぜ「上げる方向にしか動かない」のか
「依頼ごとに
1. 判定するのは「人が書いたとき」だけ
Claude CodeはCLAUDE_CODE_GATEWAY_HINT_HEADERS を
2. セッション内では、モデルを下げない
一度
3. 「上げる」より「下げる」に高い確信を求める
判定には
4. 安いモデルで「壊れない」ための地味な変換
個人的に
- 出力上限の
調整 ——Claude Codeは出力上限に 128,000トークンを 要求しますが、 Haiku 4.5は 64,000を 超えると 拒否する ため、 上限を 引き下げます - 非対応パラメータの
除去 ——Haiku 4.5が受け付けない 適応的thinkingや effortの 指定を 取り 除きます - 会話中の
systemメッセージの ——Claude 5系向けに畳み込み 会話の 途中へ 入る systemメッセージを、 直前の ユーザーメッセージ内へ 移します - MCPツール検索の
維持 ——ゲートウェイ経由だとClaude Codeは MCPの ツール検索を 止め、 全ツール定義を 毎回 送ります。 作者の 検証では 1リクエスト約20万トークンに 膨らみ、 毎回 圧縮が 走った ため、 ENABLE_TOOL_SEARCH=trueを自動で 設定します
この
本当に安くなるのか:公開実測が示す逆転現象
設計が
| タスク | Jevあり | Jevなし | 差 |
|---|---|---|---|
| 定型的な | Haikuを | 0.2060ドル | -84.9% |
| ユーティリティの | Sonnetを | 0.3460ドル | -30.8% |
| 深い | Opus・推論を | 0.9657ドル | +235% |
| サブエージェントの | 平均1.9074ドル | 平均2.0646ドル | 有意差なし |
単純な
ここから
当社の見立て:導入前に確認したい4つのこと
当社は
- 依頼の
中身が ——判定の社外の 判定APIに 送られる ために、 人が 書いた メッセージが Jevの API (TypeSafe AIまたは OpenRouter)へ 送られます。 秘密情報の スキャナは ある ものの、 業務内容 その ものは 社外に 出ます。 顧客案件では Claude本体と 同じ 基準で 送信先を 審査する 必要が あります - 中継サーバーが
単一障害点に ——プロキシ型は、なる 常駐サービスが 止まると Claude Code自体が 接続できなくなります。 jev-router doctorによる 状態確認を 運用に 組み込むと 安心です - 既存の
ゲートウェイとは ——社内の同居できない LiteLLMなど別の ゲートウェイを 経由している 環境では、 認証情報の 取り違えを 防ぐ ためsetupが 設定の 変更を 拒否します。 チーム全体の 費用管理が 目的なら、 LiteLLMのような チーム向けゲートウェイの 方が 適していると README自身が 案内しています - Anthropic公式の
機能ではない ——いずれもコミュニティ製で、 Claude Codeの 内部仕様 (ヒントヘッダーや リクエスト形式)に 依存しています。 Claude Codeの 更新で 挙動が 変わる 可能性を 織り 込んで おくべきでしょう
試すなら、jev-router report で
よくある質問(FAQ)
- Q. Jevとは
何ですか? - A. TypeSafe AIが
2026年9月に 公開した 判定専用の AIモデルです。 文章は 一切生成せず、 入力された テキストや JSONに 対して、 あらかじめ型で 定義した 質問 (選択・採点・真偽)の 答えと 確率だけを 返します。 速さと 安さを 優先した 設計で、 Claude Codeの モデル振り分けのような 「軽い 判断」を 大量に こなす用途に 向いています。 - Q. Claude Code本体に
モデルの 自動選択機能は ないのですか? - A. 2026年10月時点では、
タスクの 難しさを 見て Haiku・Sonnet・Opusを 自動で 切り 替える 公式機能は ありません。 計画モードは Opus、 実行は Sonnetと 使い分ける opusplanのような 固定の 組み合わせは ありますが、 発言ごとの 判定は jev-routerなどの サードパーティ製ツールで 実現します。 - Q. 指示の
内容が 社外に 送られる 心配は ありませんか? - A. jev-routerは
判定の ために、 人が 書いた メッセージを Jevの API (TypeSafe AIまたは OpenRouter) へ 送ります。 APIキーなどの 秘密情報は 送信前に スキャナで 検出されますが、 業務内容 その ものは 社外に 出ます。 守秘義務の ある 案件で 使う 場合は、 Claude本体と 同じ 基準で 送信先を 審査してください。
まとめ
Jevは、
今回の
当社では、
参考文献・出典
- TypeSafe AI
「Introduction」 (Jevの 質問の 型 Choice / Score / Noul と 返り値) — docs.typesafe.ai/introduction - TypeSafe AI 公式サイト
(価格、 確信度つき判定の 説明) — typesafe.ai - Engin Diri
「Route every Claude Code message to the right model with Jev」 Pulumi Blog、 2026年9月28日 (設計意図、 しきい値、 AWS研究の 引用、 判定1回あたりの 費用) — pulumi.com/blog - dirien/jev-router
(README:セットアップ、 追加される 環境変数、 Haiku向けの リクエスト変換、 他ルーターとの 比較) — github.com/dirien/jev-router - Claude Code Templates
「Jev Model Router」 (function hooksに よる Mod型の 仕様と 設定項目) — aitmpl.com - あんで
ぃ氏に よる jev-model-routerの 費用実測記事、 note、 2026年9月24日 — note.com/andygrave - Anthropic
「LLM gateway configuration」 (Claude Codeの ゲートウェイ構成) — code.claude.com/docs/en/llm-gateway
※本記事の