Claude Opus 5 半額で Fable 5 に接近、Kimi K3 は「Claude 自称」蒸留門:2026年7月 AI 二大トピック
2026年7月24日、Anthropic が Claude Opus 5 をリリースし Claude Max デフォルトに据え置き——Fable 5 半額で CursorBench ピークとの差 0.5% 以内。一方 Moonshot AI の Kimi K3(2.8T パラメータ)は白宫 OSTP 主任 Michael Kratsios から「大規模・隠蔽的産業級蒸留」指控を受け、Redwood Research の Ryan Greenblatt が「K3 が Claude だと名乗り内部デプロイ ID を漏らす」統計証拠を公開。本稿は AI 開発者向けに、Opus 5 全仕様・ベンチマーク・安全/データ保持、K3 蒸留門全链条、三者比較表、コスパトレンド、5段 Runbook、引用可能データ、SEO 要点、FAQ を厳密に総まとめします。
目次
1. 三大痛点:モデル選定と出所不明リスク
- フラッグシップと日常モデルの価格差が意思決定を複雑化。 Fable 5 は $10/$50 per M tokens 級だが Opus 5 は $5/$25 のまま性能が跳級——「どちらをデフォルトにすべきか」の再評価が全 Agent ルーティングに波及。
- オープンウェイトモデルの出所検証が不可能な窓。 K3 は 7/16 API 公開時点で完全ウェイト未公開(7/27 予定)。白宫指控と Greenblatt 証拠が重なる間、本番採用は「公式ベンチのみ」に依存せざるを得ない。
- 地政学リスクとコンプライアンスの二重負荷。 データ保持(Fable/Mythos は30日 opt-in 必須 vs Opus は不要)、芯片輸出規制言及、2月 Anthropic の340万回異常 API 交互指控——単一モデル固定は技術的負債以上の供給リスク。
2. Claude Opus 5 リリース全解説
2026年7月24日(米太平洋時間)、Anthropic が Claude Opus 5(モデル ID: claude-opus-5)を正式リリース。Claude API / Platform / AWS Bedrock / Google Vertex AI / Microsoft Foundry で利用可能。Claude Max デフォルトかつ Claude Pro 最強モデル——日常主力としての位置づけが明確です。
2.1 価格・仕様
- 価格:入力 $5 / 100万 tokens、出力 $25 / 100万 tokens(Opus 4.8 と同一)
- コンテキスト:100万 tokens(唯一のデフォルト档、小规格なし)
- 最大出力:128K tokens
- 推論:Thinking デフォルト ON、Effort パラメータで思考量制御
- Fast モード:約2.5倍速、価格2倍(Opus 4.8 と同様)
- データ保持:歴代 Opus と同様、デフォルトでデータ保持不要(Fable 5 / Mythos 5 は30日データ保持 opt-in 必須)
2.2 ベンチマーク(Anthropic 公式)
- Frontier-Bench v0.1(SWE):全モデル超越、Opus 4.8 の2倍以上、単タスクコストは更低
- CursorBench 3.2:max effort で Fable 5 ピークとの差0.5%、コストは半分。high / xhigh / max 各档のコスパは全市場最高
- ARC-AGI 3:次点モデルの3倍
- OSWorld 2.0:Fable 5 最良成績を、Fable 5 コストの約1/3で上回る
- Zapier AutomationBench:100% 通過(従来モデルは未達)、トークン消費は従来 Claude 以下
- 生命科学:スペクトルから分子構造推定で Opus 4.8 比 +10.2pt、タンパク質変異機能予測 +7.7pt
2.3 顧客フィードバック
Cursor:「Opus 5 は Fable 5 に近い知能を Opus の速度とコストで提供。CursorBench では Fable 5 僅差。」Zapier:「AutomationBench 100% 達成。」Box:データ分析 +11%、デューデリジェンス +17%、全体精度 +8%。
2.4 安全・アライメント
自動行動監査で史上最もアラインされたモデル(欺瞞率最低、悪用誘導に最も resistant)。ただしリスク型二用途能力(サイバー攻撃・生物安全)のフロンティアは意図的に Mythos 5(限定発行)が保持。サイバー分類器は Fable 5 比約85%緩い(ソースコード脆弱性発見可、バイナリスキャン・ペンテスト・exploit 生成はブロック)。
2.5 タイムライン
| 日付 | イベント |
|---|---|
| 2026-06-09 | Claude Fable 5 / Mythos 5 正式発表 |
| 2026-07-01 | Fable 5 一般公開 |
| 2026-07-24 | Claude Opus 5 リリース、Claude Max デフォルト化 |
3. Opus 5 vs Fable 5 vs Kimi K3 比較表
| 次元 | Claude Opus 5 | Claude Fable 5 | Kimi K3 |
|---|---|---|---|
| リリース日 | 2026-07-24 | 2026-06-09(7/1 一般公開) | 2026-07-16(ウェイト 7/27) |
| 入力/出力価格 | $5 / $25 per M | 約 $10 / $50 per M | $3 / $15 per M(cache hit $0.30/M) |
| コンテキスト | 1M tokens | 1M tokens | 1M tokens + ネイティブ Vision |
| CursorBench 3.2 | Fable 5 ピーク -0.5% | ピーク基準 | 公式「Fable 5 / GPT-5.6 Sol 次点」 |
| GPQA-Diamond | — | — | 93.5%(当時 OSS 最高) |
| データ保持 | デフォルト不要 | 30日 opt-in 必須 | API 規約に依存 |
| オープンウェイト | クローズド | クローズド | 2.8T、7/27 Modified MIT 予定 |
| 出所リスク | 低(Anthropic 公式) | 低 | 白宫蒸留指控 + Greenblatt 証拠(未確定) |
4. Kimi K3「蒸留門」論争
4.1 K3 基本仕様(Moonshot 公式)
2026年7月16日 API/製品公開。総パラメータ 2.8T(世界初の3T級 OSS)、稀疏 MoE(896 experts、/token 16 激活、約50B 激活相当)、KDA + Attention Residuals + Stable LatentMoE、訓練効率 K2 比約2.5倍向上。
4.2 主要ベンチマーク
| ベンチマーク | スコア | 備考 |
|---|---|---|
| GPQA-Diamond | 93.5% | 当時 OSS 最高 |
| Terminal-Bench 2.1 | 88.3% | GPT-5.6 Sol 比 -0.5 |
| BrowseComp | 91.2% | 当時最高 |
| Humanity's Last Exam(ツール付) | 56.0% | — |
| MCP Atlas | 84.2% | — |
| Program Bench | 77.8% | 総合最佳 |
| SWE Marathon | 42.0% | 総合最佳 |
| DeepSearchQA (F1) | 95.0% | — |
4.3 白宫指控(2026-07-22/23)
OSTP 主任 Michael Kratsios が X で Moonshot の「大規模・隠蔽的産業級蒸留(distillation)」で Anthropic Fable 能力窃取を公開指控。併せて輸出許可なし Nvidia GB300(タイ経由の可能性)使用を言及。財務長官 Scott Bessent も「中国モデルに米 LLM の watermark を発見」と附和——具体的内容は未開示。Moonshot は訓練プロセスへの質問に未回答。
4.4 2月背景:Anthropic 初回指控
2026年2月、Anthropic は Moonshot / DeepSeek / MiniMax に「産業級蒸留攻撃」を公開点名。340万回超の異常 API 交互を検出、「意図的能力抽出」と判定、リクエストメタデータから Moonshot 幹部関連行為を追跡したと主張。Moonshot は未確認・未否認。
4.5 専門家反論:タイムライン不足
TechCrunch(7/23)取材の独立研究者は懐疑的。Braden Hancock(Laude Institute / Snorkel AI):「Fable は7/1から公開。2週間で蒸留・訓練・リリースは不可能。」Nathan Lambert(Allen AI):「中国モデルがフロンティアに近づくほど蒸留の限界効用は低下、RL 訓練が差を広げる。」Elon Musk も xAI が OpenAI を蒸留したと証言——業界では「合法借鉴 vs 隠蔽窃取」の境界が問題。
4.6 Ryan Greenblatt 証拠:K3 が「Claude 自称」
2026年7月24日頃、Redwood Research 首席科学者 Ryan Greenblatt が GitHub rgreenblatt/which_claude_is_k3 で身份自认の交叉エントロピー分析を公開。
- K3 は「あなたは誰?」に異常高頻度で Claude 自称
claude-opus-4-5-20250929、claude-sonnet-4-5-20250929等の内部デプロイ IDを出力——本物 Claude はこれほど正確に報告しない- Greenblatt:「教師モデルのデプロイメタデータを教師自身より正確に再現」——対話模倣では説明困難、API ログ等メタデータ付き Claude データ混入を示唆
- K3 の ID は Claude 4.5 世代(2025年末)に固定、K2 は Sonnet 4(2025年中)——「逐代追新」パターン
- 重要:Greenblatt 本人は「蒸留直接証明ではない」と強調(データ汚染・システムプロンプト漏洩も可能性)
4.7 コミュニティ反応
r/LocalLLaMA では三派:① OSS とクローズドの差が「数ヶ月→数日」に短縮への歓喜;② 2.8T はローカル実行不可能のジョーク;③ 真の売りは低価格 + 少ない拒否で Fable 5 超えではない、という実務派。7/27 ウェイト公開まで独立検証不可が論争長期化の要因。
4.8 K3 タイムライン
| 日付 | イベント |
|---|---|
| 2026-02 | Anthropic 初回蒸留指控(340万回異常交互) |
| 2026-07-01 | Fable 5 一般公開 |
| 2026-07-16 | Kimi K3 API 公開 |
| 2026-07-22/23 | 白宫 Kratsios 公開指控 |
| 2026-07-23 | TechCrunch 専門家反論報道 |
| 2026-07-24 | Greenblatt「Claude 自称」分析公開 |
| 2026-07-27(予定) | K3 完全ウェイト OSS |
5. コスパが主戦場:二つのストーリーの共通点
Opus 5 は「半額で旗舰接近」、K3 は「OSS + 低価 + 制限少」——いずれもフロンティア知能の民主化への応答。K3 論争の本質は「低価格は技術最適化か、他社モデルの無断利用か」という業界全体の問い。開発者はシーン優先:コンプライアンス・データ保持・供給リスク重視なら Opus 5;極限コスト・OSS 重視なら 7/27 以降の独立検証を待つ。
6. 開発者向け5段 Runbook
Step 1 — 現行スタックを凍結
K3 ウェイト未公開・蒸留未決の間、本番を Opus 4.8 / 既存 Fable 5 ルートに固定。リーク仕様での架構再構築を避ける。
Step 2 — Opus 5 を A/B 追加
10–20 件の社内 SWE / Agent タスクで Fable 5 とのコスト・品質を計測。
Step 3 — 多モデル Fallback を構成
OpenRouter または LiteLLM で claude-opus-5 → claude-fable-5 → claude-sonnet-5 の降格チェーン。Fable 5 輸出規制停止事例(6月)を教訓に単一ベンダー依存を回避。
Step 4 — K3 は 7/27 以降にパイロット
Hugging Face ウェイト、Modified MIT、vLLM KDA 対応を確認。非本番で GPQA / SWE Marathon 再現。Greenblatt 式 identity probe(「あなたは誰?」)も参考指標に。
Step 5 — Mac クラウドで Gateway を 7×24 化
API キーとルーティングを VPSMAC Mac クラウドへ移行、launchd 常駐。ノート PC スリープによる Agent 断線と、不安定回線による API タイムアウトを分離。
7. 引用可能な技術データ
- Opus 5 価格:$5/$25 per M tokens——Fable 5 約半額、Opus 4.8 と同一単価で性能2倍級跳級(Frontier-Bench)
- CursorBench 3.2:Opus 5 max effort は Fable 5 ピーク -0.5%、OSWorld 2.0 では Fable 5 最良をコスト1/3で超越
- Opus 5 データ保持:デフォルト不要——Fable/Mythos の30日 opt-in 不要で企業利用ハードル低下
- K3 規模:2.8T 総パラメータ、896 MoE experts、16/token 激活、1M context、7/27 Modified MIT ウェイト予定
- 蒸留論争:Fable 公開(7/1)→ K3 リリース(7/16)= 14日;Anthropic 2月指控 340万回異常交互;Greenblatt:K3 が
claude-opus-4-5-20250929等を本物 Claude より正確に出力 - AA Intelligence Index:K3 は 57.1(3/189)、単タスク約 $0.94——Fable 5 比 65.8% 安(Artificial Analysis、7/16)
8. 日英 SEO 戦略要点
8.1 クロール・インデックス(P0)
- hreflang:ja / ko / en / zh 相互标注、x-default 設定
- 独立 canonical:各言語ページに固有 URL(本稿:
/ja/blog/claude-opus-5-kimi-k3-zhengliu-men-2026.html) - 構造化データ:BlogPosting + FAQPage + HowTo(本稿実装済み)
- sitemap:言語別
<url>エントリ、GSC 手動送信
8.2 コンテンツ層
- 日本語:「Claude Opus 5 価格」「Kimi K3 蒸留門」「月之暗面 白宫 指控」「K3 自称是 Claude」を H2/FAQ でカバー
- 英語:直訳せず
Why does Kimi K3 say it's Claude、Claude Opus 5 vs Fable 5 pricing等のネイティブ検索意図を別記事で深掘り - 差別化角度:Greenblatt のデプロイ ID 分析——大メディアが浅く触れた技術フック
8.3 配布チャネル
| チャネル | 言語 | 目的 |
|---|---|---|
| はてブ / Zenn / Qiita | 日本語 | 技術解説・Runbook 配布 |
| Hacker News / r/LocalLLaMA | 英語 | Greenblatt 角度の議論誘導 |
| Google Search Console | 全言語 | Impressions を path 別に監視 |
9. よくある質問(FAQ)
Claude Opus 5 は Claude Fable 5 よりどれくらい安い? 約半額($5/$25 vs 約 $10/$50 per M)。CursorBench では Fable 5 ピーク -0.5% 以内。
Claude Opus 5 は Claude Max のデフォルト? はい。7/24 リリース当日から Max デフォルト、Pro 最強モデル。
Kimi K3 は本当に Claude を蒸留した? 未確定。白宫指控に公開証拠なし、専門家は2週間タイムラインを反論。Greenblatt の Claude 自称・内部 ID 分析が最も技術的な間接証拠。
K3 の完全ウェイトはいつ? 2026年7月27日予定。執筆時未公開。
なぜ K3 は Claude だと名乗る? デプロイメタデータ付き訓練データ混入の可能性。直接証明ではない。
本番は Opus 5 と K3 どちら? コンプライアンス重視→ Opus 5。極限コスト・OSS→ 7/27 後の独立検証を待つ。
10. まとめ
ノート PC や汎用 Linux VPS で Opus 5 / K3 をルーティングする Agent Gateway は、蓋閉じ断線・Apple ツールチェーン欠如・回線ジッターで API タイムアウトが連鎖しがち。Opus 5 はモデル選択のコスパ問題を、K3 論争は出所問題を突きつける——いずれもランタイム環境の 7×24 可用性は別問題。
2026年ベストプラクティス:Opus 5 を primary + 多モデル Fallback + VPSMAC Mac クラウドで OpenClaw / Agent Gateway を launchd 常駐。K3 は 7/27 ウェイト後にパイロット——ノートがスリープしても Gateway は眠らせない。