Claude Opus 5 は半額で旗艦級に迫る、Kimi K3 は「Claude 名乗り」蒸留論争:今週の AI 二大事件

約 18 分で読めます · MACCOME · 最終更新:2026 年 7 月 25 日

対象読者:Claude / Kimi の選定を検討している開発者、AI コンプライアンスとサプライチェーンリスクに関心のある技術責任者です。今週の二大事件は一見無関係ですが、どちらも「コストパフォーマンス」と「モデル能力の真の出所」を問います。7 月 24 日 Anthropic が Claude Opus 5 を公開し Claude Max のデフォルトに設定。7 月 16 日にリリースされた Kimi K3 はホワイトハウスから Claude 蒸留を公然と指摘され、独立研究者が K3 がClaude 名乗り・内部デプロイ ID を漏らすことを発見しました。本記事で得られるもの:Opus 5 vs Fable 5 比較表、K3 蒸留論争の完全タイムライン、Greenblatt 技術証拠の解説、6 ステップ選定 Runbook、FAQ。構成:課題 → Opus 5 解説 → K3 論争 → 比較マトリクス → Runbook → まとめと転換。K3 のパラメータとベンチマーク詳細はKimi K3 徹底レビューをご覧ください。

bolt

TL;DR — 30 秒結論

  • Opus 5(7/24):Opus 4.8 と同じ $5/$25 per 1M。CursorBench 3.2 ピークは Fable 5 より 0.5% 低いだけでコスト約半分。Claude Max デフォルト、データ保持はデフォルトで強制なし。
  • K3 蒸留論争(7/22–24):ホワイトハウス OSTP 長 Kratsios が「隠蔽的産業級蒸留」+ 違法 GB300 チップを指控。Fable 5 公開から 2 週間しか経っておらず、専門家は時間線に疑問。
  • 最も硬い証拠:Redwood Research の Ryan Greenblatt が K3 が異常に高頻度で Claude 名乗り、claude-opus-4-5-20250929 等の内部 ID を漏らすことを発見——本物 Claude より正確。
  • 7/27 検証待ち:K3 完全重みは 7 月 27 日公開予定。外部からはまだアーキテクチャとスコアを独立再現できません。

6 つの課題:今週二大事件の下で開発者が陥りやすい落とし穴

  1. 「半額 Opus」を「Fable 5 全面代替」と誤読する:Opus 5 は Agent プログラミングと自動化で旗艦に迫りますが、Anthropic は意図的にサイバー攻撃・生物安全など二用途能力のフロンティア更新を避けています——Mythos 5 がその位置を占めます。
  2. ホワイトハウスの声明を確定事実とする:Kratsios と Bessent の公開指控には検証可能な証拠が付いていません。月之暗面は訓練プロセスへの質問に未回答ですが、「未回答 ≠ 有罪」です。
  3. 蒸留タイムラインを無視する:Fable 5 は 7 月 1 日に一般公開。K3 リリース(7/16)までわずか 2 週間——深度 RL 式蒸留は算力と API コスト上ほぼ不可能と複数の独立研究者が指摘しています。
  4. 「K3 が Claude 名乗り」の技術シグナルを見落とす:政治声明より分析価値が高く——訓練データにデプロイメタデータ付き Claude サンプルが混入した可能性を示唆しますが、Greenblatt は蒸留発生の直接証明にはならないと強調しています。
  5. コンプライアンスとデータ保持の盲点:Fable 5 / Mythos 5 は 30 日データ保持を受け入れる必要があります。Opus 5 は Opus 系列同様デフォルトで強制保持なし——エンタープライズ選定では個別確認が必要です。
  6. ノート PC でマルチモデル Agent スタックを回す:Opus 5 + K3 混合ルーティング、長コンテキストセッション、Gateway には 7×24 オンラインノードが必要で、ローカルはフタ閉じで即切断されます。

Claude Opus 5 リリース:旗艦ではないが、最も使う価値のある Claude かもしれない

2026 年 7 月 24 日(米国太平洋時間)、Anthropic は Claude Opus 5(モデル ID:claude-opus-5)を正式リリースし、同日 Claude Max デフォルトモデルに設定しました。Claude Pro ユーザーも現在最強 Opus 版を利用できます。ポジショニングは明確です:日常主力モデル。知能は旗艦 Fable 5 に迫り、価格は約半分です。

価格据え置き、性能は「跳級」

Opus 5 の価格は Opus 4.8 と完全同一:入力 $5 / 100 万 tokens、出力 $25 / 100 万 tokens。100 万 token コンテキストはデフォルトかつ唯一の設定、最大出力 128K。Thinking はデフォルト ON、Effort パラメータで思考量を制御。Fast モードはデフォルトの約 2.5 倍速、価格は 2 倍です。

Anthropic 公式ベンチマーク Highlights:

  • Frontier-Bench v0.1(ソフトウェアエンジニアリング):全モデル超越、Opus 4.8 の2 倍以上、タスク単価はさらに低い。
  • CursorBench 3.2:max effort で Fable 5 ピークとわずか 0.5% 差、コスト約半分。high / xhigh / max 各段階で「同コスト性能」が市場全モデルを上回る。
  • ARC-AGI 3(新規問題):スコアは「次点モデル」の3 倍
  • OSWorld 2.0(コンピュータ操作):Fable 5 最高スコアを Fable 5 コストの 1/3 未満で超過。
  • Zapier AutomationBench:エンドツーエンド商用自動化通過率は次点の約1.5 倍。最低 effort でも他モデルを上回る。Zapier は Opus 5 が同ベンチで100% 通過し、従来モデルが通せなかったタスクも通過したと評価。

Cursor チームの評価:「Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. On CursorBench it's just under Fable 5 and has many of the same behaviors.」

研究・エンタープライズ実測

構造生物学、有機化学、バイオインフォマティクスで Opus 4.8 を全面超越:スペクトルから分子構造推定の内部評価で 10.2 ポイント高、タンパク質配列変異機能予測で 7.7 ポイント高。Box 顧客データ:データ分析ワークフロー +11%、デューデリジェンス +17%、全体精度 +8%。

アラインメントと安全:最も「従順」な世代だが、二用途フロンティアは意図的に未更新

自動化行動監査では Opus 5 はこれまでで最もアラインメントされた Claude:欺瞞行為率最低、悪用誘導が最も困難。ただしリスク型二用途能力(サイバー攻撃、生物安全)ではフロンティアを更新せず、制限配布の Mythos 5 が保持。サイバーセキュリティ分類器は Fable 5 より約 85% 緩い——ソースレベル脆弱性発見は可能、バイナリスキャン・ペンテスト・exploit 生成等は引き続きブロック。

見落とされがち:デフォルトでデータ保持強制なし

Opus 5 は歴代 Opus と同様、デフォルトアクセスでデータ保持を強制しません。Fable 5 / Mythos 5 は 30 日データ保持ポリシーの受け入れが必要です。コンプライアンス重視シーンでは、Fable 5 ではなく Opus 5 を選ぶ決定的理由になり得ます。

次元Claude Opus 5Claude Fable 5
リリース日2026-07-242026-06-09(7/1 一般利用可)
入力 / 出力価格$5 / $25 per 1M tokens約 $10 / $50 per 1M tokens
CursorBench 3.2(max)Fable 5 ピークと 0.5% 差ピーク基準
Claude Max デフォルトはい(リリース日から)いいえ
データ保持デフォルトで強制なし30 日保持 opt-in 必要
二用途フロンティア(サイバー/生物)意図的に未更新より強い(Mythos 5 が制限最強)

Kimi K3「蒸留門」:ホワイトハウス参戦、専門家がタイムラインを疑問視、Greenblatt が新証拠を発掘

Opus 5 が「通常の新製品リリース」なら、Kimi K3 の展開ははるかに複雑です。月之暗面は 7 月 16 日に K3(2.8T パラメータ、1M コンテキスト、スパース MoE)をリリース。公式は総合能力が Fable 5 と GPT-5.6 Sol に次ぐと自称。完全重みは 7 月 27 日 公開予定——論争勃発時点では外部検証不可でした。

ホワイトハウスの突然の参戦

2026 年 7 月 22–23 日、ホワイトハウス科学技術政策局(OSTP)長 Michael Kratsios が X で投稿し、月之暗面が「大規模かつ隠蔽的な産業級蒸留(distillation)」で Anthropic Fable モデル能力を窃取したと指控。未許可 Nvidia GB300 チップ使用(タイ経由サーバーで間接取得の可能性)にも言及。財務長官 Scott Bessent も「多くの中国モデルで米国大モデルのウォーターマークを発見」と附和しましたが、具体的な意味は説明していません。

これは憑空ではありません:2026 年 2 月 Anthropic は月之暗面・DeepSeek・MiniMax の「産業級蒸留攻撃」を公開指控し、月之暗面の340 万回超の異常 API インタラクションを特定、「明らかに通常利用パターンから逸脱」とし、リクエストメタデータで一部行為が月之暗面幹部に関連すると主張しました。月之暗面は正面確認も否定もしていません。

独立専門家:時間が足りない

TechCrunch(7/23)は複数研究者に取材し、「2 週間で K3 を蒸留」への懐疑が広がっています。Snorkel AI 共同創業者 Braden Hancock:

「Fable は 7 月 1 日から一般公開。2 週間でこれだけのデータを蒸留し、モデル訓練まで完了してリリースするのは不可能です。」

Allen Institute for AI 研究員 Nathan Lambert は、中国モデルがフロンティアに迫るにつれ単純 SFT 式蒸留の限界効用は小さく、真の差はより時間のかかる強化学習にあると指摘。蒸留がこれほど有効なら追従者は GLM や K3 を蒸留で追いついているはずだが、そうなっていないと述べています。

Elon Musk は裁判で xAI が Grok 訓練時に OpenAI モデルを蒸留したことを認め、業界では一般的だと発言——「蒸留」自体は違法ではなく、「通常の技術参考」と「隠蔽的産業級窃取」の境界が問題です。

最も硬い証拠:K3 が「Claude 名乗り」する

Redwood Research 主任科学者 Ryan Greenblatt(7/24 頃、GitHub:rgreenblatt/which_claude_is_k3)が複数モデルの自己認識行動をクロスエントロピー比較し、以下を発見しました:

  • Kimi K3 が異常に高頻度で Claude 名乗りclaude-opus-4-5-20250929claude-sonnet-4-5-20250929 等の Claude 公式内部デプロイ ID まで漏らす。
  • 本物 Claude Sonnet 4.5 は「Claude Sonnet 4.5 です」としか言わない。Opus 4.5 はバージョン番号を報告しないか誤る——教師モデル自身より K3 の方が正確
  • K3 の自称バージョンは「Claude 4.5 世代」(2025 年末)に固定され、現行 Fable/Mythos ではない。前世代 K2 はより古い Claude Sonnet 4 を指す——「世代を追う」パターンが見える。

Greenblatt の解釈:訓練データにデプロイメタデータ付き Claude データ(API ログやラベル付き合成データ)が混入した可能性が高く、「会話スタイル模倣」では説明しにくいより具体的な蒸留形態。ただしこれらの発見は蒸留発生の直接証明にはならない——ID 混同はデータ汚染、システムプロンプト漏洩、公開データセット合成サンプルでも起こり得ます。

コミュニティの態度:見物以上に「使えるか、値するか」

Reddit r/LocalLLaMA では三つの声:オープンソースとクローズドの差が「月」から「日」に縮まった歓声。2.8T はほぼ誰もローカルで回せないという冗談。実務派は K3 の売りは低価格 + 少拒否であり「Fable 5 打倒」ではないと見る。7 月 27 日重み公開前は、アーキテクチャとスコアを外部独立検証できません。

日付イベント
2026-02Anthropic が月之暗面/DeepSeek/MiniMax「産業級蒸留攻撃」を初公開指控(340 万+ 異常インタラクション)
2026-07-01Claude Fable 5 が一般公開
2026-07-16Kimi K3 API/製品正式リリース(2.8T、完全重みは 7/27 待ち)
2026-07-22/23ホワイトハウス OSTP 長 Kratsios が蒸留 + 違法チップを公開指控
2026-07-23TechCrunch が専門家の蒸留タイムライン懐疑を報道
2026-07-24Claude Opus 5 リリース;Greenblatt が「K3 Claude 名乗り」統計を公開
2026-07-27(予定)Kimi K3 完全重み OSS 公開、外部独立検証可能に

Claude Opus 5 vs Kimi K3:今週の事件後のクイック意思決定マトリクス

選定次元Claude Opus 5 寄りKimi K3 寄り(7/27 検証待ち)
コンプライアンス / データ保持デフォルト強制保持なし;Anthropic エンタープライズチェーン成熟OSS 重み + 低価格だが蒸留指控とサプライチェーンリスク未解明
Agent / プログラミングCursorBench、AutomationBench、OSWorld 公式データが先行Program Bench、SWE Marathon 自報強、外部再現は重み待ち
コストFable 級能力を半額、$5/$25公式は Fable 5 / GPT-5.6 Sol を大幅下回るポジショニング
審査 / 拒否最強アラインメント世代、二用途は制限ありコミュニティは「少拒否」が実売りの一つと評価
検証可能性全面利用可(API / Bedrock / Vertex 等)7/27 前はアーキテクチャとスコアを独立検証不可

6 ステップ Runbook:今週二大事件後の選型と Agent デプロイ

  1. シーン優先度を明確化:Agent プログラミング、自動化、コンプライアンス保持が核心なら Opus 5 を優先評価(プログラミングアシスタント選定マトリクスの組み合わせスタックも参照)。極限コスト + OSS 制御なら 7/27 後に K3 を再テスト。
  2. データ保持とコンプライアンス条項を確認:エンタープライズで Opus 5(デフォルト強制保持なし)と Fable 5 / Mythos 5(30 日保持 opt-in)を比較。跨境・政府系プロジェクトは法務レビューを別途実施。
  3. Effort 段階でコスト探索:Opus 5 Thinking はデフォルト ON——CursorBench 系タスクは high/max で品質を測り、低 effort で Zapier 系自動化が基準を満たすか確認し、token 浪費を避ける。
  4. K3 は「証拠の階層化」を維持:政治指控(ホワイトハウス)→ タイムライン反論(専門家)→ 技術間接証拠(Greenblatt)の 3 層を記録。7/27 重み公開後に identity prompt と benchmark 再現。
  5. マルチモデル Gateway を構成:専用ノードに OpenClaw または Kimi Code + OpenRouter ルーティングをデプロイし、ノート PC スリープによる長セッション中断を回避。API Key と provider fallback は環境ごとに分離。
  6. 7/27 後に追検証:重み公開後 GPQA-Diamond、BrowseComp、「あなたは誰ですか」identity テストを比較し、内部モデルルーティング表を更新、意思決定根拠をアーカイブ。

技術レビューに書くべき 3 つの硬いデータ

  • Opus 5 / Fable 5 コスパのはさみ:CursorBench 3.2 max effort ピーク差 0.5%、token 単価は Fable 5 の約 50%($5/$25 vs 約 $10/$50 per 1M)——Anthropic は「半額で旗艦に迫る」で市場のコスパ要求に直接応答。
  • ARC-AGI 3 三倍 gap:Opus 5 は「未見の新問題」評価で次点の 3 倍。OSWorld 2.0 は Fable コスト <1/3 で Fable 最高を超過——Agent 汎化とコンピュータ操作が今回最も目立つ定量化シグナル。
  • K3 ID 混同統計:Greenblatt のクロスエントロピー分析で K3 が「あなたは誰」と聞かれると Claude 内部デプロイ ID を異常に高頻度出力claude-opus-4-5-20250929 等)。バージョンは Fable/Mythos ではなく Claude 4.5 世代に固定——蒸留論争でこれまで最も技術含金量が高く競合の少ない角度Why does Kimi K3 say it's Claude)。

二つを並べて見る:主戦場はコスパ

Opus 5 は「半額で旗艦に迫る」で市場のコスパ要求に応え、Kimi K3 は「OSS + 低価格 + 少制限」で市場を衝撃。K3 を巡る論争の本質は、各社がコスパ戦争の中で「あなたの低価格は技術最適化か、他人モデルの無断利用か」を公然と問うことです。

一般開発者と企業にとって:まずシーン、次にスタンス。コンプライアンス、データ保持、サプライチェーン敏感 → Opus 5 のコスパは非常に高い。極限コストと OSS 制御 → 7/27 重み公開後に K3 を実測。

ローカルノート PC で Opus 5 / K3 / マルチ provider Gateway を切り替える場合、フタ閉じスリープ、ネットワークジッター、キー散在が三大隠れコスト——長セッション Agent と自動化タスクには専用 7×24 オンラインノードが必要です。MACCOME Mac クラウドホストは実 macOS、SSH 引き渡し、環境分離を提供し、Claude Code、OpenClaw、マルチモデルルーティングを専用インスタンスで安定稼働させます。プランと料金はMac mini クラウドレンタル料金をご覧ください。

データ出典:Anthropic 公式リリース(anthropic.com/news/claude-opus-5)、Moonshot/Kimi 技術ブログ、TechCrunch、Ryan Greenblatt GitHub(rgreenblatt/which_claude_is_k3)、CNBC / The Verge。ベンチマークは各社自報または第三者統計、2026 年 7 月 25 日時点。

よくある質問

Claude Opus 5 は Claude Fable 5 よりどれくらい安いですか?

同じ token 単価比較では Opus 5 は Fable 5 の約半分です(Fable 5 約 $10/$50 per 100 万入力/出力 token、Opus 5 は $5/$25 を維持)。CursorBench 3.2 ピークは Fable 5 と 1% 未満の差です。

Claude Opus 5 は現在 Claude Max のデフォルトモデルですか?

はい。2026 年 7 月 24 日リリース当日から Opus 5 が Claude Max デフォルトモデルとなり、Claude Pro ユーザーが利用できる最強版です。

Kimi K3 は本当に Claude を蒸留したのでしょうか?

本文公開時点では論争中で最終確定されていません。ホワイトハウス指控には公開証拠がありません。独立専門家は 2 週間での深度蒸留は非現実的と指摘。Ryan Greenblatt が発見した「K3 Claude 名乗り・内部バージョン漏洩」が現時点で最も技術含金量の高い間接証拠です。詳細はKimi K3 徹底レビューをご覧ください。

Kimi K3 の完全重みはいつダウンロードできますか?

公式は 2026 年 7 月 27 日を公約。本文公開時点では未公開で、外部研究者はアーキテクチャとスコアを完全独立検証できません。

なぜ Kimi K3 は Claude だと名乗るのでしょうか?

Greenblatt の統計分析では K3 が ID 質問で Claude および内部デプロイ ID(claude-opus-4-5-20250929 等)を異常に高頻度出力し、本物 Claude より正確——デプロイメタデータ付き Claude サンプル混入の可能性を示唆しますが、蒸留の単独証明にはなりません。データ汚染やプロンプト漏洩の可能性もあります。

本番環境で Opus 5 / K3 混合 Agent を 7×24 稼働させるには?

専用 Mac クラウドホストに Gateway とマルチ provider ルーティングをデプロイし、ノート PC スリープによる中断を回避することを推奨します。MACCOME Mac クラウドレンタルプランでノード構成と料金をご確認ください。