Claude Opus 5 半價登場,Kimi K3 卻自稱 Claude:
蒸餾爭議全解析

若你是開發者、AI 技術負責人或預算決策者,2026 年 7 月下旬連續兩則大模型新聞方向截然相反:7 月 24 日 Anthropic 推出 Claude Opus 5,以接近 Fable 5 的能力、約一半的 token 成本成為 Claude Max 預設模型;八天前的 7 月 16 日,月之暗面發布 Kimi K3 後,白宮指控其蒸餾 Claude,研究員 Ryan Greenblatt 更發現 K3 在身份探測中自稱 Claude 並洩漏內部部署 ID。本文提供七項選型痛點、Opus 5 完整規格與 Claude Opus 5 vs Fable 5 對照表、Kimi K3 蒸餾爭議時間線、Greenblatt 身份洩漏證據、六步選型手冊、五則 FAQ 與可引用技術數據,以及 Agent 工作流的 Mac 執行面建議。節點定價見 NOVAKVM 定價頁,下單見 訂購頁。架構細節可交叉閱讀 Kimi K3 深度評測

  • Fable 5 仍受出口管制封鎖:Mythos 級旗艦自 6 月 12 日起依美國商務部規則全球停用,多數團隊無法以任何價格取得 Fable 5——Opus 5 已成 Anthropic 日常工作的實際上限。
  • 標價隱藏 effort 分級成本:Opus 5 列出 $5/$25 每百萬 token,與 Opus 4.8 相同,但 CursorBench 最高 effort 的 Agent 迴圈仍可能快速燒 token;預算模型須按任務追蹤實際用量,不能只看牌價。
  • 開源模型的血統不確定性:Kimi K3 蒸餾爭議迫使企業在能力與供應鏈、IP 風險之間取捨——尤其在 7 月 27 日權重公開前,外部無法完整驗證架構聲明。
  • 政治指控缺乏可審計附件:白宮 OSTP 主任 Michael Kratsios 於 7 月 22–23 日在 X 發文指控月之暗面工業級蒸餾,但未公開可審計佐證;合規團隊無法將其直接寫入供應商風險登記冊。
  • 時間線質疑雙向成立:Fable 5 自 7 月 1 日才廣泛公開,K3 於 7 月 16 日上架——僅兩週,純 Fable 蒸餾敘事難以自圓其說;但 Greenblatt 的 Claude 身份洩漏指向較早的 Claude 4.5 世代資料,而非 Fable 本身。
  • 自架 K3 非筆電級專案:2.8T MoE 權重需資料中心規模 GPU 叢集。追逐最低 API 單價的團隊,仍須可靠的遠端建置環境跑 Kimi Code 與 Agent 迴圈。
  • Anthropic 產品線的資料保留政策分裂:Opus 5 維持預設存取下無強制保留;Fable 5 與 Mythos 5 須 opt-in 30 天保留——合規門檻上 Opus 5 更寬鬆。

Anthropic 於 2026 年 7 月 24 日(美國太平洋時間)發布 Claude Opus 5,並立即設為 Claude Max 預設模型——同為 Claude Pro 使用者可存取的最強 tier。模型 ID:claude-opus-5。平台:Claude API、AWS Bedrock、Google Vertex AI、Microsoft Foundry。

Claude Opus 5 vs Fable 5 — 定價與產品矩陣
維度 Claude Opus 5 Claude Fable 5
輸入價格 $5 / 百萬 token $10 / 百萬 token
輸出價格 $25 / 百萬 token $50 / 百萬 token
相對 Fable 5 成本 約 50% 每 token 旗艦基準
上下文視窗 100 萬 token(單一 tier) 100 萬 token
最大輸出 128K token 128K token
CursorBench 3.2(max effort) 與 Fable 5 峰值差距 <0.5% 峰值參考分
Frontier-Bench v0.1 較 Opus 4.8 2 倍以上,領先已列模型 發布文未作主要對照
資料保留 預設存取無強制保留 須 opt-in 30 天保留
可用性(2026 年 7 月) Max / Pro / API 全球上線 自 6 月 12 日出口指令起停用
預設推理 預設開啟 thinking;Effort 參數控制深度 Mythos 級延伸推理

Claude Opus 5 定價未較 Opus 4.8 上調——能力提升純屬每美元效能增益。Anthropic 發布基準重點在 Agent 與程式設計工作負載:

  • Frontier-Bench v0.1:Opus 5 在軟體工程任務上較 Opus 4.8 翻倍以上,單任務成本更低。
  • CursorBench 3.2:max effort 下與 Fable 5 峰值差距 0.5% 以內,token 成本約一半;high、xhigh、max tier 的性價比領先。
  • ARC-AGI 3:新穎問題求解約為次佳模型的 3 倍。
  • OSWorld 2.0:以不足 Fable 5 最佳分數三分之一成本超越其紀錄。
  • Zapier AutomationBench:100% 通過端到端帳戶健康工作流——此前無 Claude 模型完成。

「Claude Opus 5 以 Opus 的速度與成本交付接近 Fable 5 的智慧。CursorBench 上略低於 Fable 5,但行為模式高度相似。」—— Cursor 團隊,Anthropic 發布材料

對齊方面,Anthropic 自動化稽核將 Opus 5 列為迄今最 aligned 的模型——欺騙率最低、最難被濫用。雙用途網路與生物前沿仍限縮於 Mythos 5。Opus 5 網路安全分類器觸發頻率較 Fable 5 約低 85%,可在阻擋二進位掃描、滲透測試自動化與 exploit 生成的同時,支援原始碼級漏洞發現。

月之暗面於 2026 年 7 月 16 日推出 Kimi K3——2.8 兆總參數的稀疏 MoE(每 token 啟用 896 個專家中的 16 個)、100 萬 token 上下文、原生視覺,API 定價 $3/$15 每百萬 token。完整開源權重排定 7 月 27 日。架構與基準表見 Kimi K3 評測

月之暗面是否「偷了 Claude」?指控升級極快。7 月 22–23 日,OSTP 主任 Michael Kratsios 在 X 發文稱月之暗面從 Anthropic Fable 模型進行「大規模、隱蔽的工業蒸餾以竊取專有美國技術」,並另指控可能經泰國路由使用出口受限的 Nvidia GB300 晶片。財長 Scott Bessent 呼應官員正在中國模型中「發現美國 LLM 的浮水印特徵」——但未定義浮水印在此語境下的技術含義。

這並非首輪交鋒。2026 年 2 月,Anthropic 公開點名月之暗面、DeepSeek、MiniMax,稱逾 340 萬次異常 API 互動符合刻意能力萃取,並透過請求中繼資料追溯至月之暗面資深員工。月之暗面尚未確認或否認。

為什麼 Kimi K3 會說自己是 Claude?政治標題退場後,這成為技術討論重心。TechCrunch(7 月 23 日)引述研究員質疑純 Fable 蒸餾的時間線:

「Fable 自 7 月 1 日才公開。你不可能在兩週內蒸餾那麼多資料、訓練模型並發布。」—— Braden Hancock,Laude Institute / Snorkel AI 共同創辦人

「隨著中國模型逼近前沿、訓練重心轉向強化學習,蒸餾的邊際效益正在遞減。」—— Nathan Lambert,Allen Institute for AI

約 7 月 24 日,Redwood Research 首席科學家 Ryan Greenblatt 發布模型自稱身份的 交叉熵分析(GitHub:rgreenblatt/which_claude_is_k3)。發現:Kimi K3 過度自稱 Claude——且非泛泛而談,而是輸出精確的內部部署字串,例如:

K3 身份洩漏範例
claude-opus-4-5-20250929
claude-sonnet-4-5-20250929
真實 Claude Sonnet 4.5:「我是 Claude Sonnet 4.5」(不含內部 deploy ID)
真實 Claude Opus 4.5:常省略或誤述 deploy 中繼資料

Greenblatt 的解讀:學生模型比教師模型更準確地複製部署中繼資料,與隨意風格模仿不符,較符合在帶 API 部署標籤的 Claude 輸出上訓練——日誌或合成資料集——這是比通用聊天爬取更窄的蒸餾通道。K3 洩漏的身份指向 Claude 4.5 世代(2025 年底),而非現行 Fable/Mythos;據報 Kimi K2 信號指向更早的 Claude Sonnet 4——呈現世代追趕模式。

Greenblatt 明確警告這不能證明蒸餾。污染、外洩 system prompt 或公開合成資料集理論上可產生類似痕跡。結合 Anthropic 2 月申訴,仍是整起爭議中最強技術數據點——尚非法庭證物。

Kimi K3 蒸餾爭議時間線
日期 事件
2026-02 Anthropic 指控月之暗面 / DeepSeek / MiniMax 工業蒸餾;引用 340 萬+ 異常 API 呼叫
2026-07-01 Claude Fable 5 廣泛公開(出口關閉後有限再存取背景)
2026-07-16 Kimi K3 API 與產品發布;宣稱 2.8T MoE
2026-07-22/23 白宮 Kratsios 蒸餾 + GB300 晶片指控(X)
2026-07-23 TechCrunch 專家時間線質疑報導
2026-07-24 Claude Opus 5 發布;Greenblatt K3 身份分析流傳
2026-07-27(預定) Kimi K3 完整權重公開供獨立驗證

  1. 先畫合規門檻:若需無強制資料保留,Opus 5 在政策上優於 Fable/Mythos。若供應商血統須審計,在 7 月 27 日後權重與獨立評測落地前,將 K3 視為條件式選項。
  2. 用真實工作負載定價,非排行榜:將 50 個代表性任務分別跑 Opus 5 與現行模型(Opus 4.8、GPT-5.6 Sol 或 K3 API)。記錄輸入/輸出 token、effort tier 與通過率——CursorBench 1% 以內差距在你們 repo 形狀上可能消失。
  3. 確認 Anthropic 存取 tier:核實 Claude Max 或 Pro 是否已預設路由 Opus 5。API 使用者應明確指定 claude-opus-5 並依延遲預算設定 Effort;Fast 模式約 2.5 倍速、2 倍價。
  4. 對任何開源模型跑身份探測:正式採用 K3 前,在不同 temperature 下複製 Greenblatt 式「你是誰?」提示。輸出中反覆出現 Claude 部署 ID 是訓練資料譜系審查的警訊。
  5. 現在就建多供應商路由:2026 年 7 月發布節奏下硬編碼單一供應商代價高昂。以 LiteLLM 或等效方案做備援路由——合規路徑用 Opus 5,成本敏感批次用 K3 或 DeepSeek V4,各路線設預算上限。
  6. 配置常駐執行環境:長 Agent 工作階段(Claude Code、Kimi Code、Cursor agents)需要永不休眠的機器。在將正式環境排程或 CI 指向雲端 API 前,於專用 Mac 節點驗證工作流程——遠端存取設定見 雲端說明中心

Q:Claude Opus 5 比 Claude Fable 5 便宜多少?
A:牌價每 token 約一半——$5/$25 vs $10/$50 每百萬輸入/輸出 token。CursorBench 3.2 max effort 下,Opus 5 與 Fable 5 峰值差距 0.5% 以內,單任務成本約一半。

Q:Claude Opus 5 是否為 Claude Max 預設模型?
A:是,自 2026 年 7 月 24 日起生效。亦為 Claude Pro 訂閱者可用的最強模型。

Q:月之暗面是否真的從 Claude 蒸餾 Kimi K3?
A:未定案。白宮聲明未附公開證據。純 Fable、兩週蒸餾的時間線反駁具說服力。Greenblatt 發現 K3 自稱 Claude 並洩漏內部 deploy ID 是目前最佳技術間接信號——仍非證明。

Q:為什麼 Kimi K3 會說自己是 Claude?
A:統計身份探測顯示 K3 過度輸出 Claude 自述,並輸出如 claude-opus-4-5-20250929 等真實 Claude 極少主動透露的字串。較可能解釋為帶中繼資料的訓練資料;Greenblatt 未宣稱確定。

Q:Kimi K3 完整權重何時公開?
A:月之暗面承諾 2026 年 7 月 27 日。在此之前,外部對參數規模、架構與基準的驗證仍不完整。

  • Opus 5 牌價 $5/$25:與 Opus 4.8 相同;預設 100 萬 token 上下文(來源:Anthropic Opus 5 發布文)。
  • CursorBench 與 Fable 5 差距 <0.5%:max effort tier(來源:Anthropic 發布基準)。
  • Frontier-Bench 較 Opus 4.8 2 倍以上:軟體工程測試套件(來源:Anthropic 發布基準)。
  • K3 2.8T MoE:896 專家中 16 個活躍;API 7 月 16 日上線(來源:Moonshot/Kimi 發布材料)。
  • 340 萬+ 異常 API 呼叫:Anthropic 2026 年 2 月對月之暗面蒸餾指控(來源:Anthropic 公開聲明)。
  • K3 Claude deploy ID 洩漏:Greenblatt 分析約 2026 年 7 月 24 日(來源:rgreenblatt/which_claude_is_k3)。

兩則新聞指向同一方向:前沿智慧正在快速商品化,競爭焦點從原始分數轉向成本、合規與血統。Opus 5 是 Anthropic 在自家產品線內的降價回應;K3 是月之暗面更低價的開源權重反擊——附帶 7 月 27 日權重可能放大或部分緩解的聲譽成本。

替代方案在日常 Agent 工作中的三項短板:(1)從會休眠的筆電跑 Opus 5 或 K3 API 迴圈——OAuth 工作階段中斷、長上下文 Agent 狀態消失、可重現建置停滯。(2)全部路由雲端 API 而無本地驗證路徑——蒸餾指控或出口規則一夜改變供應商存取時,沒有沙箱環境測試備援方案。(3)為兩週 Kimi K3 評估買 Mac Studio——閒置折舊高於為短期 Agent 實驗租用專用節點。

對部署 Claude Code、Kimi Code 或多供應商 LiteLLM 技術棧的團隊,NOVAKVM Mac Mini 裸機雲端租賃通常是更優解:專屬 Apple Silicon、多區域節點、按日/週/月計費、7×24 在線,支撐無法容忍休眠或共享 VM Metal 損失的 Agent 迴圈。M4 Pro tier 對照見 NOVAKVM 定價頁,試用下單見 訂購頁,遠端連線見 雲端說明中心

以下連結為撰寫本文時引用的公開來源。若上游文件更新,請以原文為準。本文不構成法律或投資建議。

Anthropic — Claude Opus 5 發布公告

TechCrunch — 專家質疑 Kimi K3 蒸餾時間線

Ryan Greenblatt — which_claude_is_k3 身份分析

Moonshot AI — Kimi K3 技術文