2026 Claude Opus 5 半價逼近 Fable 5、Kimi K3 蒸餾門自稱 Claude:雙模型部署決策指南
2026 年 7 月 24 日 Anthropic 發布 Claude Opus 5 並設為 Claude Max 預設,定價維持 $5/$25 每百萬 tokens,基準上逼近 Fable 5 卻只要約一半成本;同一週,月之暗面 Kimi K3(2.8T 參數,7 月 16 日 API 上線)遭白宮指控「產業級蒸餾」,Redwood Research 的 Ryan Greenblatt 更發現 K3 會自稱 Claude 並吐出內部部署 ID。若您正在為 OpenClaw Agent 或 CI 腳本選主模型,本文以決策視角拆解三類痛點、三模型對比表、五步選型與可引用數字,並說明為何 7×24 場景宜託管在遠端 Mac。
1. 三類痛點:性價比、來源可信度與運維連續性
本週兩則新聞表面無關,卻共同戳中工程團隊的三個決策盲點:
- 痛點一:旗艦能力與帳單的剪刀差。 Fable 5 效能頂尖,但 $10/$50 量級定價與 30 天資料留存政策,讓不少 Pro/Max 用戶「想用又不敢默認開」。Opus 5 用相同 token 單價換取接近旗艦的 CursorBench 分數,決策難點變成「還差那 0.5% 是否值得多付一倍」。
- 痛點二:開源模型的「能力來源」無法稽核。 Kimi K3 標榜 2.8T 與 GPQA-Diamond 93.5%,但完整權重要到 7 月 27 日才釋出;蒸餾指控與 Greenblatt 的身份統計讓「低價高性能」背後的訓練資料譜系成為合規與品牌風險。
- 痛點三:模型再強,宿主斷線就歸零。 無論走 Anthropic API 還是 Moonshot 端點,OpenClaw Agent 的長時工具迴圈、SSH 回調與 SFTP 同步都依賴常線上 macOS 宿主;筆電合蓋或 Docker 重建未持久化金鑰,比選錯模型更常導致生產事故。
2. Claude Opus 5:Max 預設與「半價旗艦」定位
2026 年 7 月 24 日(太平洋時間),Anthropic 正式釋出 claude-opus-5,同步調整產品策略:Claude Max 預設模型改為 Opus 5,Claude Pro 用戶亦可使用目前公開通道中的最強版本。定價與 Opus 4.8 完全相同——輸入 $5/輸出 $25 每百萬 tokens,上下文預設 100 萬 tokens,Thinking 預設開啟。
官方基準傳遞的核心訊息是「效能跳級、帳單不漲」:Frontier-Bench v0.1 軟體工程任務上,Opus 5 分數為 Opus 4.8 的兩倍以上且單任務成本更低;CursorBench 3.2 在 max effort 僅比 Fable 5 峰值低 0.5%;ARC-AGI 3 得分為次優模型的 3 倍;OSWorld 2.0 用不到 Fable 5 三分之一成本即超越其最佳成績。對企業而言,Box 回報資料分析工作流提升 11%、盡職調查場景提升 17%。
另一個易被忽略的決策因子:Opus 5 延續歷代 Opus 政策,預設存取不強制 30 天資料留存;Fable 5/Mythos 5 則要求接受留存條款。若您的 Agent 處理客戶原始碼或內部文件,這條邊界有時比 0.5% 基準差距更關鍵。
3. Kimi K3 蒸餾門:白宮指控、時間線質疑與自稱 Claude 證據
月之暗面於 7 月 16 日發布 Kimi K3:總參數 2.8 萬億,稀疏 MoE(896 專家、每 token 啟動 16 個,約等效 500 億激活參數),100 萬 token 上下文與原生視覺理解。官方自評整體能力僅次 Claude Fable 5 與 GPT-5.6 Sol,定價遠低於兩者。
7 月 22–23 日,白宮 OSTP 主任 Michael Kratsios 在 X 公開指控 Moonshot 以「大規模、隱蔽的產業級蒸餾」竊取 Fable 能力,並提及疑似未經出口許可的 Nvidia GB300 晶片;財長 Scott Bessent 附和「在中國模型上發現美國大模型水印」。這並非首次——Anthropic 早在 2026 年 2 月指控月之暗面等廠商逾 340 萬次異常 API 互動。
TechCrunch 7 月 23 日引述多位研究者質疑時間線:Fable 5 自 7 月 1 日才公開可用,至 K3 發布僅 兩週,Snorkel AI 共同創辦人 Braden Hancock 直言「不可能在兩週內蒸餾、訓練並發布如此強的模型」。Allen AI 的 Nathan Lambert 則指出,隨中國模型逼近前沿,單純蒸餾邊際效益遞減,差距更多來自強化學習訓練。
本事件最具技術含量的轉折,來自 Ryan Greenblatt 7 月 24 日左右的統計分析(GitHub:rgreenblatt/which_claude_is_k3):Kimi K3 被問「你是誰」時,異常高頻自稱 Claude,甚至輸出 claude-opus-4-5-20250929、claude-sonnet-4-5-20250929 等Claude 官方內部部署 ID——而真實 Claude 模型自身往往不會如此精準報出這些字串。Greenblatt 強調這不能直接證明蒸餾,但比政治喊話更接近可驗證的訓練資料污染假設;K3 身份訊號鎖定在 Claude 4.5 世代(2025 年末),K2 則指向更早的 Sonnet 4,呈現「逐代追新」規律。
4. Opus 5/Fable 5/Kimi K3 決策對比表
| 維度 | Claude Opus 5 | Claude Fable 5 | Kimi K3 |
|---|---|---|---|
| 定價(每百萬 tokens) | $5 輸入/$25 輸出 | 約 $10/$50 量級 | 官方宣稱遠低於 Fable 5 |
| CursorBench 3.2(max) | 距 Fable 5 峰值 -0.5% | 基準峰值 | 官方自評次於 Fable 5 |
| 資料留存 | 預設不強制 30 天留存 | 需接受 30 天留存政策 | 自架可控(權重 7/27 釋出) |
| Claude Max 預設 | 是(2026-07-24 起) | 否 | 不適用 |
| 供應鏈/合規風險 | Anthropic 官方 SLA | 同上 + 留存條款 | 蒸餾指控未證實;身份混淆統計需納入評估 |
| 適合場景 | 日常 Agent、合規敏感程式碼 | 極限基準、可接受留存 | 極低成本實驗;權重釋出後自架驗證 |
5. 五步 HowTo:從合規盤點到 API 路由驗收
- 盤點合規與資料留存需求: 列出 Prompt 是否含客戶原始碼、是否需禁止第三方訓練使用。拒絕強制留存的團隊,Opus 5 通常優於 Fable 5;在 K3 權重未驗證前,涉密流量勿走 Moonshot 端點。
- 對照工作負載與基準分層: 程式碼 Agent 優先看 CursorBench 與 Frontier-Bench;端到端自動化看 Zapier AutomationBench(Opus 5 曾達 100% 通過率);科研管線則對照結構生物學內部評測(Opus 5 光譜反推分子結構 +10.2 個百分點)。
- 對開源模型執行身份探測: 在 K3 完整權重釋出前,以固定 Prompt 集(含「你是誰」「報告模型版本」)做 ≥100 次抽樣;若部署 ID 字串出現率異常,應在架構審查中標記為「訓練資料譜系不明」。
- 設定 API 路由與 fallback: OpenClaw 或 OpenRouter 將
anthropic/claude-opus-5設為 primary,Sonnet 5 或 GPT 系列為 secondary;監控 429 與成本/dashboard,避免單一端點限流拖垮整條 Agent 鏈路。 - 託管至常線上遠端 Mac 並驗收: 執行
openclaw gateway restart與channels status --probe,確認 API 金鑰、Skills 目錄與 SFTP 工作區在同一 launchd 守護節點;對照agent.jsonl時間戳完成端到端驗收。
# OpenClaw 場景:切換主模型後必做驗收
openclaw gateway restart
openclaw channels status --probe
openclaw doctor
6. 可引用關鍵數字與時間線
- Opus 5 定價: $5/$25 每百萬 input/output tokens(與 Opus 4.8 相同,約 Fable 5 一半)。
- CursorBench 3.2: Opus 5 max effort 距 Fable 5 峰值 0.5%。
- Frontier-Bench v0.1: Opus 5 超過 Opus 4.8 2 倍以上。
- ARC-AGI 3: Opus 5 為次優模型 3 倍。
- Kimi K3 參數: 2.8T 總參數,7 月 16 日 API 上線,完整權重承諾 7 月 27 日釋出。
- GPQA-Diamond: K3 官方 93.5%(發布時開源模型最高)。
- 蒸餾時間窗口: Fable 5 公開(7/1)→ K3 發布(7/16)= 14 天。
- Anthropic 2 月指控: 月之暗面疑似 340 萬+ 異常 API 互動。
7. 常見問題 FAQ
Claude Opus 5 比 Fable 5 便宜多少? 約一半 token 成本($5/$25 vs $10/$50 量級),CursorBench 差距不到 1%。
Claude Opus 5 現在是 Max 預設嗎? 是,自 2026 年 7 月 24 日起為 Claude Max 預設,亦為 Pro 最強公開模型。
Kimi K3 真的蒸餾了 Claude 嗎? 未證實。白宮指控缺公開證據;專家質疑兩週時間線;Greenblatt 的「自稱 Claude + 內部 ID」是目前最強技術間接證據,但非定論。
K3 完整權重何時可下載? 官方承諾 2026 年 7 月 27 日;釋出前外部無法獨立驗證架構與基準。
8. 總結:選模型先看場景,Agent 還需穩定宿主
Opus 5 用「帳單不漲、能力跳級、無強制留存」回應性價比訴求,對多數 OpenClaw 與 CI 場景已是比 Fable 5 更務實的預設升級。Kimi K3 則代表「開源 + 低價 + 無審查」的另一極,但在權重釋出與蒸餾爭議塵埃落定前,不宜把涉密 Agent 預設路由押在其 API 上。
無論選 Anthropic 官方還是 Moonshot 端點,模型 API 只解決「誰來推理」;7×24 工具迴圈、SSH 回調與 SFTP 同步仍需要不間斷的 macOS 宿主。筆電合蓋、本機 Docker 重建未持久化金鑰,或海外代理導致回調逾時,往往比 0.5% 基準差距更早拖垮生產。
若您要讓 Claude Opus 5 驅動的 Agent 與 Xcode 建置、rsync 產物目錄長期共存於同一節點,使用 SFTPMAC 專業遠端 Mac 租賃是更穩妥的承載選擇:Apple Silicon 統一記憶體適合多 Agent 編排,原生 macOS 權限模型便於收緊 allowedPaths,骨幹網路降低 API 回調延遲,讓本週的模型選型真正落地為不間斷的自動化,而非「換了最強模型卻仍合蓋失聯的實驗品」。