claude-opus-4-5-20250929 など内部デプロイ ID を出力する分析を公開しました。本記事では Claude Opus 5 vs Fable 5 のベンチマークと料金、Kimi K3 が Claude と名乗る理由、Moonshot が Claude を盗んだのか というタイムライン上の疑問、開発者向け 6 ステップルーティング、7 月 27 日の重み公開の意味を解説します。Kimi K3 オープンウェイト解説と OpenRouter API ルーティングガイドもあわせてご覧ください。Claude Opus 5 リリース:Fable 5 半額、Claude Max 新デフォルト
Anthropic は 2026 年 7 月 24 日(米国太平洋時間)に Claude Opus 5 を公開し、直ちに Claude Max のデフォルトモデルに設定しました。Claude Pro 加入者が利用できる最強の日常モデルです。モデル ID:claude-opus-5。Claude API、AWS Bedrock、Google Vertex AI、Microsoft Foundry で利用可能です。料金は 入力 $5/M、出力 $25/M のまま(Opus 4.8 と同一)ですが、エージェント、コーディング、リサーチ各ワークロードで性能が大きく向上しています。
ポジショニングは意図的です。Opus 5 は旗艦ではなく、Anthropic が「実際に使ってほしい」日常モデル——Fable 級の知能を、Fable 価格や 30 日間データ保持義務なしで提供します。
| 仕様 | Claude Opus 5 |
|---|---|
| リリース日 | 2026 年 7 月 24 日 |
| 料金 | 入力 $5/M · 出力 $25/M(Opus 4.8 と同じ) |
| コンテキスト | 1M tokens(デフォルトかつ唯一のティア) |
| 最大出力 | 128K tokens |
| 推論 | Thinking デフォルト ON;Effort パラメータで深度制御 |
| データ保持 | 強制なし(Fable 5 / Mythos 5 の 30 日 opt-in ポリシーと対比) |
| 高速モード | 約 2.5× 速度、2× 価格(Opus 4.8 と同じ) |
ベンチマークハイライト(Anthropic 公式):
Frontier-Bench v0.1:全モデルを上回る。ソフトウェアエンジニアリングタスクで Opus 4.8 の 2 倍以上、タスクあたりコストはより低い。
CursorBench 3.2:max effort で Fable 5 ピークとの差 0.5% 以内、コストは 半分。high / xhigh / max ティアで最高の性能対価比。
ARC-AGI 3:新規問題解決で次点モデルの 3 倍。
OSWorld 2.0:Fable 5 最高スコアを、コスト 3 分の 1 未満で上回る。
Zapier AutomationBench:エンドツーエンドのアカウントヘルスワークフロー 100% 合格——従来モデルは 0%。
研究 / ライフサイエンス:分光から構造推論 +10.2 点;タンパク変異機能予測 +7.7 点。Box 報告では全体精度 +8%、データ分析 +11%、デューデリジェンス +17%。
安全性とアライメント:Anthropic の自動行動監査では Opus 5 がこれまでで最もアラインされたモデル——欺瞞率最低、悪用への誘導が最も困難、不可逆操作で最も安全。Opus 5 は意図的にデュアルユースサイバー・バイオリスクではリードしません(Mythos 5 がそのティア)。サイバー分類器の介入は Fable 5 より約 85% 少ない——ソースコード脆弱性発見には使えますが、バイナリスキャン、ペンテスト、exploit 生成はブロックされます。
Kimi K3 蒸留論争:ホワイトハウス非難と「2 週間タイムライン」問題
Moonshot AI(月之暗面)は 2026 年 7 月 16 日に Kimi K3 を公開しました——2.8T パラメータのスパース MoE(896 エキスパート、16 活性化)、1M コンテキスト、ネイティブビジョン、Kimi Delta Attention ベース。完全重みは 7 月 27 日公開予定です。ベンチマークは強力:93.5% GPQA-Diamond、91.2% BrowseComp。Fable 5 と GPT-5.6 Sol に次ぐ位置づけで、価格ははるかに低い。アーキテクチャと API の詳細は Kimi K3 オープンウェイト公開ガイドをご覧ください。
6 日後、物語は地政学へと転じました。
| 日付 | 出来事 |
|---|---|
| 2026 年 2 月 | Anthropic が Moonshot、DeepSeek、MiniMax を工業蒸留と非難;340 万超の異常 API 呼び出しを引用、リクエストメタデータが Moonshot 幹部に至ると主張 |
| 2026 年 7 月 1 日 | Claude Fable 5 が一般公開(以前は限定 rollout) |
| 2026 年 7 月 16 日 | Kimi K3 API と製品が稼働開始 |
| 2026 年 7 月 22–23 日 | ホワイトハウス OSTP 長官 Michael Kratsios が Moonshot を「大規模かつ隠密な工業蒸留」+ タイ経由の未許可 Nvidia GB300 チップ使用と非難 |
| 2026 年 7 月 23 日 | TechCrunch が蒸留タイムラインへの専門家の懐疑を報道 |
| 2026 年 7 月 24 日 | Ryan Greenblatt が「K3 が Claude 名乗り」統計分析を公開 |
| 2026 年 7 月 27 日 | K3 完全重み公開予定——独立検証待ち |
7 月 22–23 日、Michael Kratsios(ホワイトハウス OSTP)が X で Moonshot の Anthropic Fable 能力窃取を目的とした蒸留、およびタイ経由の輸出規制対象 Nvidia GB300 チップ使用を非難しました。財務長官 Scott Bessent も米国 LLM の「透かし」が中国モデルに現れたと発言しましたが、具体的内容は示していません。Moonshot は学習プロセスに関する問い合わせに応答していません。Kratsios も公開証拠を提示していません。
Fable 5 が一般公開されたのは 7 月 1 日以来です。2 週間でそれほどのデータを蒸留し、モデルを学習してリリースするのは不可能です。——Braden Hancock、Laude Institute / Snorkel AI 共同創業者
TechCrunch は複数の独立研究者に取材し、タイムラインだけでも Kimi K3 蒸留論争に疑問を呈しました。Nathan Lambert(Allen Institute for AI)は、中国のラボが強化学習へ移行するにつれ蒸留の限界効用は逓減すると指摘——蒸留だけで K3 を説明できるなら、競合はすでに GLM や K3 を複製しているはず、と論じます。Elon Musk は xAI が Grok 構築時に OpenAI モデルを蒸留したと証言し、業界では一般的な慣行だと述べています。争点は「蒸留が存在するか」ではなく、「通常の技術借用」と「隠密な工業窃盗」の境界です。
注意:7 月 25 日時点で K3 の完全重みは未公開です。外部研究者はパラメータ数、アーキテクチャ、ベンチマーク再現を独立検証できません——論争が未決着の大きな理由です。
Kimi K3 が Claude 名乗りする理由:Greenblatt のデプロイ ID 証拠
Moonshot が Claude を盗んだのか という議論で、最も技術的に説得力があるのは政治 rhetoric ではなく行動証拠です。7 月 24 日前後、Redwood Research 首席科学者 Ryan Greenblatt がクロスエントロピー分析(GitHub:rgreenblatt/which_claude_is_k3)を公開し、各モデルの identity プロンプト応答を比較しました。
所見:Kimi K3 は Claude 名乗りに偏りすぎる——曖昧な表現ではなく、Anthropic 内部デプロイ ID 文字列をそのまま出力する場合があります:
claude-opus-4-5-20250929 claude-sonnet-4-5-20250929
本物の Claude モデルはこう振る舞いません。Claude Sonnet 4.5 は「Claude Sonnet 4.5 です」と答えます。Opus 4.5 はバージョン文字列を省略するか誤ります。K3 は教師モデル自身の説明よりデプロイメタデータを正確に再現します——会話模倣だけでは説明しにくい現象です。
| モデル | 自己 ID シグナル | ロックされる世代 |
|---|---|---|
| Kimi K2 | Claude Sonnet 4 を指す | 2025 年中盤 Claude 世代 |
| Kimi K3 | Claude Opus 4.5 / Sonnet 4.5 デプロイ ID を指す | 2025 年末「Claude 4.5 世代」——Fable / Mythos ではない |
| 実際の Claude モデル | 人間可読な製品名のみ | 現行製品ライン |
Greenblatt の解釈:学習データにデプロイメタデータ付き Claude 出力——API ログや metadata タグ付き合成データ——が含まれていた可能性が高い。これは一般的なスタイル模倣より弁解しにくい蒸留形態です。世代パターン(K2 → Sonnet 4、K3 → Opus 4.5)は、各 Kimi リリースが当時最新の Claude 世代を取り込んだことを示唆します。
示唆すること:内部デプロイ文字列を含む Claude ラベルデータでの学習——公開チャット transcript だけではない。
証明しないこと:Greenblatt はこれが蒸留の決定的証拠ではないと明言——汚染、漏洩 system prompt、公開合成データセットでも理論上は identity 混乱を説明可能。
重要な理由:一連の saga で初の技術的(非政治的)証拠——ホワイトハウス rhetoric より強く、学習ログの決定的証拠より弱い。
コミュニティの読み(r/LocalLLaMA):オープン/クローズド差が「日」単位に縮む興奮;2.8T はローカル実行不能という冗談;実用派は K3 の売りは価格 + 拒否が少ないことで、Fable 5 超えではない、と評価。
コンプライアンス表現:蒸留疑惑を引用する際は「 alleged」「Greenblatt の分析による」「報道による」と表現してください。identity 混乱は証拠であり、判決ではありません。
開発者向け 6 ステップ:Opus 5 vs Fable 5 vs Kimi K3 ルーティング
| モデル | 入力($/M) | 出力($/M) | コンテキスト | データ保持 |
|---|---|---|---|---|
| Claude Opus 5 | $5.00 | $25.00 | 1M | 強制なし |
| Claude Fable 5 | ~$10.00 | ~$50.00 | 1M | 30 日 opt-in 必須 |
| Kimi K3 | $3.00 | $15.00 | 1M | Moonshot API 規約 |
| GPT-5.6 Sol | ~$5.00 | ~$15.00 | 400K | OpenAI 規約 |
Claude Opus 5 vs Fable 5 では、CursorBench 差は 0.5%、価格差は約 50% です。コンプライアンス重視のワークロードでは、Opus 5 の保持なしデフォルトが Fable のわずかなベンチマーク優位を上回る場合があります。OpenRouter 経由でプロバイダ横断の統一請求が可能です。
6 つの運用ステップ:
コンプライアンスを先に評価:データ保持、輸出規制リスク、ベンダー出自が重要なら、Moonshot が蒸留疑惑に応答するまで Opus 5 の保持なしポリシーと Anthropic 契約が K3 より優先。Fable 5 は 30 日保持 opt-in が必要。
自社 eval セットで Opus 5 と Fable 5 を比較:CursorBench 級コーディングタスクと自社 Agent harness を実行。Opus 5 $5/$25 vs Fable ~$10/$50——0.5% 差が許容できるか検証してから旗艦料金を払う。
7 月 27 日 K3 重みを待つ:Hugging Face 重み公開と独立チームによるベンチマーク再現まで、K3 アーキテクチャ主張に本番ルーティングをコミットしない。API 試用は可、アーキテクチャ依存の判断は不可。
Greenblatt の所見を自社検証:K3、Fable 5、Opus 5 に identity プロンプトを実行。自社 system prompt 設定で K3 がデプロイ ID を出力するか確認し、コンプライアンスチーム向けに記録。
混合モデルルーティング:日常 coding + Agent → Opus 5;前沿 repo bug → Fable 5;コスト重視 bulk + 1M コンテキスト → K3 API;ターミナル重度 → GPT-5.6 Sol。論争未決の週に単一モデル all-in しない。
政策動向を監視:米国のオープンウェイト規制、チップ輸出執行、Moonshot 7 月 27 日ライセンス条項を追跡。Anthropic 2 月の 340 万回呼び出し非難と 7 月のホワイトハウスエスカレーションは API ToS やルーティングポリシー変更を引き起こす可能性があります。
from openai import OpenAI
client = OpenAI(
api_key="your_openrouter_key",
base_url="https://openrouter.ai/api/v1"
)
response = client.chat.completions.create(
model="anthropic/claude-opus-5",
messages=[{"role": "user", "content": "あなたは誰ですか?モデル名とバージョンのみで答えてください。"}]
)価格戦、3 つのハードナンバー、7 月 27 日が変えること
両方のニュースは同じ業界シフトを指しています。前沿知能のコモディティ化が加速しています。Anthropic は Opus 価格据え置きで Opus 5 を出荷し、旗艦と日常モデルの差を縮めました。Moonshot はオープンウェイト、1M flat コンテキスト、攻撃的 API 料金を押し出し——Claude 出力に便乗したと非難されました。Kimi K3 蒸留論争は、誰かが零頭のコストで前沿に迫ったとき「より良いエンジニアリングか、借りた知能か」という、すべてのラボが直面する問いの最初の公開論点です。
| シナリオ | 推奨パス | 理由 |
|---|---|---|
| コンプライアンス重視の企業 | Claude Opus 5 API | 強制保持なし;Fable 級ベンチマーク;Anthropic 契約の明確さ |
| 前沿 coding / repo bug | Claude Fable 5 API | FrontierSWE、GDPval v2 がリード、コストは二次的 |
| コスト + 1M コンテキスト実験 | Kimi K3 API(7/27 前)→ 7/27 後自ホスト | $3/$15 と 1M flat;重み確認前に全押ししない |
| 出自未決リスク | 7/27 + 独立監査を待つ | Greenblatt 証拠は示唆的だが決定的ではない;重み公開で外部検証が可能に |
| マルチモデル Agent 本番 | OpenRouter 混合ルーティング | 単一請求レイヤー;インフラ再デプロイなしでモデル切替 |
開発者向け:コンプライアンスとデータ保持が重要なら、今週 Opus 5 が簡単なアップグレードです。絶対最低コストが勝ち、出自リスクが許容できるなら、7 月 27 日に外部者が数値を確認できるようになってから K3 を再評価してください。
0.5% / 50%:Opus 5 は CursorBench 3.2 max effort で Fable 5 との差 0.5% 以内、token あたりコストは約半分($5/$25 vs ~$10/$50)。
340 万 / 2 週間:Anthropic 2 月非難は 340 万超の異常 API 呼び出しを引用;Fable 5 公開から K3 ローンチまで約 2 週間——タイムライン懐疑派の核心論点。
2.8T / 7 月 27 日:K3 は 2.8T パラメータを主張——最大級のオープンウェイト公開待ち;外部検証が蒸留論争全体の関門。
まとめ:Opus 5 は Anthropic の価格戦への実務的回答——旗艦級 Agent 性能を、Fable 価格や保持摩擦なしで。K3 蒸留 saga は compelling なコストストーリーに出自の問いを上乗せしました。自社ワークロードで検証し、コンプライアンスが必要なら identity チェックを実行し、7 月 27 日を Moonshot 主張の最初の本番テストと捉えてください。
個人 Mac だけでマルチモデル Agent ワークフローを回すと、スリープや回線断で長コンテキストジョブが中断しやすくなります。7/27 自ホスト待ちには 64+ 加速カードのスーパーノードが必要で、多くのチームには非現実的です。単一クローズド API 依存では K3 の 1M flat 料金優位を活かしにくい。iOS CI/CD、Claude Code / Kimi Code 常駐 Agent、7×24 AI 本番環境には、KVMNODE 専用 Mac Mini M4 クラウドレンタルが通常はより適したホストです。Apple Silicon 統一メモリ、sudo 開放、日/週/月の柔軟契約。詳細は 料金ページ、ヘルプセンター、または 直接注文をご覧ください。
データ基準日:2026 年 7 月 25 日 · ベンチマークに Anthropic と Moonshot 自己報告数値を含む · 出典:anthropic.com/news/claude-opus-5、TechCrunch、Ryan Greenblatt GitHub(rgreenblatt/which_claude_is_k3)、Moonshot/Kimi 公式ブログ、CNBC、The Verge、r/LocalLLaMA