适用读者:正在评估 Claude / Kimi 选型、关注 AI 合规与供应链风险的开发者与技术负责人。📌 本周两件大事表面无关,实则都指向「性价比」与「模型能力真实来源」:7 月 24 日 Anthropic 发布 Claude Opus 5 并设为 Claude Max 默认模型;7 月 16 日上线的 Kimi K3 则遭白宫公开指控「蒸馏 Claude」,且独立研究者发现 K3 会自称是 Claude 并吐出内部部署 ID。你将获得:Opus 5 与 Fable 5 对比表、K3 蒸馏门完整时间线、Greenblatt 技术证据解读、六步选型 Runbook 与 FAQ。结构:痛点 → Opus 5 解读 → K3 争议 → 对比矩阵 → Runbook → 收束转化。K3 参数与基准详见Kimi K3 深度评测。
TL;DR — 30 秒结论
claude-opus-4-5-20250929 等内部 ID——比真 Claude 自己报得还准。2026 年 7 月 24 日(美国太平洋时间),Anthropic 正式发布 Claude Opus 5(模型 ID:claude-opus-5),并同步将其设为 Claude Max 默认模型,Claude Pro 用户也可使用当前最强 Opus 档位。定位清晰:日常主力模型,智能水平接近旗舰 Fable 5,价格约为 Fable 5 的一半。
Opus 5 定价与 Opus 4.8 完全相同:输入 $5 / 百万 tokens,输出 $25 / 百万 tokens。100 万 token 上下文为默认且唯一档位,最大输出 128K;Thinking 默认开启,由 Effort 参数控制思考量。Fast 模式速度约为默认 2.5 倍,价格为基础价 2 倍。
Anthropic 官方基准 Highlights:
Cursor 团队评价:「Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. On CursorBench it's just under Fable 5 and has many of the same behaviors.」
结构生物学、有机化学、生物信息学全面超过 Opus 4.8:从光谱推断分子结构内部评测高 10.2 个百分点;蛋白质序列变异功能预测高 7.7 个百分点。Box 客户数据:数据分析工作流 +11%,尽职调查 +17%,整体准确率 +8%。
自动化行为审计显示 Opus 5 是迄今为止最对齐的 Claude:欺骗行为率最低、最难被诱导滥用。但在风险型双用途能力(网络攻击、生物安全)上未刷新前沿,仍由受限发行的 Mythos 5 保持。网络安全分类器比 Fable 5 宽松约 85%——可用于源码级漏洞发现,仍屏蔽二进制漏洞扫描、渗透测试、exploit 生成等。
Opus 5 与历代 Opus 一致,默认访问不强制数据留存;Fable 5 / Mythos 5 需接受 30 天数据留存政策。合规敏感场景下,这可能是选 Opus 5 而非 Fable 5 的关键理由。
| 维度 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 发布日期 | 2026-07-24 | 2026-06-09(7/1 公众可用) |
| 输入 / 输出定价 | $5 / $25 per 1M tokens | 约 $10 / $50 per 1M tokens |
| CursorBench 3.2(max) | 与 Fable 5 峰值差 0.5% | 峰值基准 |
| Claude Max 默认 | 是(发布日起) | 否 |
| 数据留存 | 默认不强制 | 需接受 30 天留存 |
| 双用途前沿(网安/生物) | 故意未刷前沿 | 更强(Mythos 5 受限最强) |
若 Opus 5 是「正常发新品」,Kimi K3 的剧情则复杂得多。月之暗面 7 月 16 日发布 K3(2.8T 参数、1M 上下文、稀疏 MoE),官方自称整体能力仅次于 Fable 5 与 GPT-5.6 Sol;完整权重承诺 7 月 27 日 放出——争议爆发时外部尚无法独立验证。
2026 年 7 月 22–23 日,白宫科技政策办公室(OSTP)主任 Michael Kratsios 在 X 发文,指控月之暗面通过「大规模、隐蔽的产业级蒸馏(distillation)」窃取 Anthropic Fable 模型能力,并提及涉嫌使用未获出口许可的 Nvidia GB300 芯片(可能经泰国服务器间接获取)。财政部长 Scott Bessent 附和称在「很多中国模型上发现了美国大模型的水印」,但未说明水印具体指什么。
这并非空穴来风:2026 年 2 月 Anthropic 已公开指控月之暗面、DeepSeek、MiniMax「产业级蒸馏攻击」,称识别出月之暗面超过 340 万次异常 API 交互,「明显偏离正常使用模式」,并称已通过请求元数据追踪到部分行为与月之暗面高层相关。月之暗面从未正面确认或否认。
TechCrunch(7/23)采访多位研究者,普遍对「两周内蒸馏出 K3」存疑。Snorkel AI 联合创始人 Braden Hancock:
「Fable 从 7 月 1 日才开始公开可用,你不可能在两周内蒸馏出这么多数据、训练完模型还发布出来。」
Allen Institute for AI 研究员 Nathan Lambert 认为,随着中国模型逼近前沿,简单监督微调式蒸馏边际收益变小,真正拉开差距的是更耗时的强化学习——若蒸馏真这么好用,追赶者早该靠蒸馏追平 GLM 或 K3,但事实并非如此。
Elon Musk 曾在庭审中承认 xAI 训练 Grok 时蒸馏过 OpenAI 模型,并称行业常见——「蒸馏」本身不违法,核心在于「正常技术借鉴」与「隐蔽工业级窃取」的边界如何界定。
Redwood Research 首席科学家 Ryan Greenblatt(7/24 左右,GitHub:rgreenblatt/which_claude_is_k3)对多模型身份自认行为做交叉熵对比,发现:
claude-opus-4-5-20250929、claude-sonnet-4-5-20250929。Greenblatt 解读:更可能指向训练数据混入带部署元数据标注的 Claude 数据(API 日志或打标合成数据),是一种更具体、更难用「模仿对话风格」解释的蒸馏形式。但他强调:这些发现不能直接证明蒸馏发生——身份混淆也可能来自数据污染、系统提示泄露或公开数据集合成样本。
Reddit r/LocalLLaMA 上三方声音:欢呼开源与闭源差距缩短到「天」而非「月」;调侃 2.8T 几乎没人本地跑;务实派认为 K3 卖点是低价 + 少拒答,而非「打败 Fable 5」。7 月 27 日权重放出前,架构与跑分仍无法外部独立验证。
| 日期 | 事件 |
|---|---|
| 2026-02 | Anthropic 首次公开指控月之暗面/DeepSeek/MiniMax「产业级蒸馏攻击」(340 万+ 异常交互) |
| 2026-07-01 | Claude Fable 5 面向公众开放 |
| 2026-07-16 | Kimi K3 API/产品正式发布(2.8T,完整权重待 7/27) |
| 2026-07-22/23 | 白宫 OSTP 主任 Kratsios 公开指控蒸馏 + 违规芯片 |
| 2026-07-23 | TechCrunch 刊发专家质疑蒸馏时间线 |
| 2026-07-24 | Claude Opus 5 发布;Greenblatt 发布「K3 自称 Claude」统计 |
| 2026-07-27(计划) | Kimi K3 完整权重开源,外部可独立验证 |
| 选型维度 | 倾向 Claude Opus 5 | 倾向 Kimi K3(待 7/27 验证) |
|---|---|---|
| 合规 / 数据留存 | 默认不强制留存;Anthropic 企业链路成熟 | 开源权重 + 低价,但蒸馏指控与供应链风险未澄清 |
| Agent / 编程 | CursorBench、AutomationBench、OSWorld 官方数据领先 | Program Bench、SWE Marathon 自报强,外部复现待权重 |
| 成本 | 半价 Fable 级能力,$5/$25 | 官方定位大幅低于 Fable 5 / GPT-5.6 Sol |
| 审查 / 拒答 | 对齐最强一代,双用途仍有限制 | 社区认为「少拒答」是真实卖点之一 |
| 可验证性 | 已全面可用(API / Bedrock / Vertex 等) | 7/27 前架构与跑分无法独立验证 |
claude-opus-4-5-20250929),且版本锁定 Claude 4.5 世代而非 Fable/Mythos——这是蒸馏争议中迄今最具技术含金量、竞争最小的英文长尾角度(Why does Kimi K3 say it's Claude)。Opus 5 用「半价逼近旗舰」回应市场对性价比的诉求;Kimi K3 用「开源 + 低价 + 少限制」冲击市场;围绕 K3 的争议,本质是各家在性价比战争里对「你的低价是靠技术优化还是靠白嫖别人模型」的公开摊牌。
对普通开发者与企业:先看场景,再看立场。合规、数据留存、供应链敏感 → Opus 5 性价比很高;极限成本与开源可控 → 等 7/27 权重后再实测 K3。
若在本地笔记本上切换 Opus 5 / K3 / 多 provider Gateway,合盖睡眠、网络抖动与密钥散落是三大隐性成本——长会话 Agent 与自动化任务需要专用 7×24 在线节点。MACCOME Mac 云主机提供真实 macOS、SSH 交接与环境隔离,让 Claude Code、OpenClaw 与多模型路由在专用实例上稳定运行。方案与定价见Mac mini 云租用价格。
数据来源:Anthropic 官方发布(anthropic.com/news/claude-opus-5)、Moonshot/Kimi 技术博客、TechCrunch、Ryan Greenblatt GitHub(rgreenblatt/which_claude_is_k3)、CNBC / The Verge。基准为各厂商自报或第三方统计,截止 2026 年 7 月 25 日。
常见问题
Claude Opus 5 比 Claude Fable 5 便宜多少?
价格完全相同的 token 单价下,Opus 5 约为 Fable 5 的一半(Fable 5 约 $10/$50 每百万输入/输出 token,Opus 5 维持 $5/$25);CursorBench 3.2 峰值与 Fable 5 相差不到 1%。
Claude Opus 5 现在是 Claude Max 的默认模型吗?
是的,2026 年 7 月 24 日发布当天起 Opus 5 成为 Claude Max 默认模型,也是 Claude Pro 用户可用的最强版本。
Kimi K3 真的蒸馏了 Claude 吗?
截至本文发布仍属争议、未被最终证实。白宫指控缺乏公开证据;独立专家从时间线认为两周内深度蒸馏不现实;Ryan Greenblatt 发现的「K3 自称是 Claude 并吐出内部版本号」是目前最具技术含量的间接证据。详见Kimi K3 深度评测。
Kimi K3 的完整权重什么时候能下载?
官方承诺 2026 年 7 月 27 日;本文发布时尚未放出,外部研究者尚无法完全独立验证架构与跑分。
为什么 Kimi K3 会说自己是 Claude?
Greenblatt 的统计分析显示 K3 在被问身份时异常高频输出 Claude 及内部部署 ID(如 claude-opus-4-5-20250929),比真 Claude 自己报得还准——可能指向训练数据混入带元数据标注的 Claude 样本,但不能单独证明蒸馏;也可能是数据污染或提示泄露。
如何在生产环境 7×24 运行 Opus 5 / K3 混合 Agent?
推荐在专用 Mac 云主机部署 Gateway 与多 provider 路由,避免笔记本睡眠中断。查看MACCOME Mac 云租用方案获取节点配置与定价。