テックトレンド

默默把模型降級,是信任問題|Fable 5與開源權重

發布2026-08-14濱本 隆太

2026年6月,Anthropic把部分Fable 5請求轉給Opus 4.8。官方理由是安全。同一商品名稱背後換成別的東西,仍是採購問題。本文說明我為何站在Grok、部分中國開源權重實驗室,以及NVIDIA Nemotron這一側。

默默把模型降級,是信任問題|Fable 5與開源權重
分享

大家好,我是株式會社TIMEWELL的濱本。

2026年6月,Anthropic推出Claude Fable 5。All-In節目裡,David Sacks講得很直。系統若判定你不配用最前線功能,就安靜把你切到較弱的模型。帳單仍是原價。問粒線體也掉。Ben Thompson問GLP-1與癌症風險也掉。X上已經有人寫成「AI史上最大的信任違反」。

我不會把那串貼文當一手資料。官方發布比截圖謹慎。核心仍在。你以為買的是這個商品,名稱沒變、東西變了,那是採購問題,然後才是安全演說。今天先把事實切開,再寫我為什麼站在Grok、部分中國開源權重,以及NVIDIA的打開方式這一側。

官方寫了什麼,319頁裡又埋了什麼

先記日期。2026年6月9日,Anthropic同時推出Claude Fable 5與Claude Mythos 5。底層權重相同。對外一般供應的是Fable,先給Project Glasswing資安防守方的是Mythos。Fable上面有分類器。被標成資安、生物與化學、或蒸餾(把能力抽去訓練對手模型)的請求,改由次一級的Claude Opus 4.8回答。官方說網張得保守,無害問題也會被撈到,平均不到5%的工作階段。也說每次發生都會告知1

所以不是「全部都是祕密工程」。生物與資安那張寬網,當天正文就有。價錢也有。輸入每百萬token 10美元,輸出50美元,不到Mythos Preview的一半1

爆炸的是下一層。319頁系統卡裡,埋了對前沿LLM開發、也就是「看起來像在養競爭模型」的用法。研究社群反彈。6月10日,Anthropic對WIRED與Fortune說,會讓frontier LLM development的防護變看得見23。Sacks與All-In稱為Orwellian的,核心在這裡。

先說清楚。Sacks也是白宮AI顧問。6月12日起大約三週,商務部出口管制讓Fable與Mythos在全球下線,7月1日才回來。那是另一場,他離得很近4。節目發言不是判決。粒線體、肥料那些故事,也不在Anthropic公開的評測表上。但Anthropic自己承認,生物與化學的網張太快、太寬,無害的科學問題也會掉1。方向與那些軼事並不相反。

我在意的不是分類器寬。安全網可以寬。我在意的是同一組SKU。名字還叫Fable 5,東西換了。發布文承諾會通知。走API、走代理人迴圈時,畫面角落一行字到不了簽字的人。若帳單仍用Fable單價,更糟。現在的產品頁補了:被轉走的請求不收Fable價5。事後修正這件事本身,就說明第一版設計過不了採購這一關。

把 AI 驅動開發,做到現場真的能用

WARP 是不讓您停在「追趨勢」的實務課程。由曾在大型企業負責 DX 與資料策略的專家陪跑到能實際運作為止。

問題在名稱,不在安全故事

公司用模型名下單。指定Fable 5,用那個品質估工、驗收。幕後分類器覺得研究太敏感,把這一輪交給Opus 4.8。團隊以為自己用付了錢的產品做完了。

拒絕是誠實的。拒絕看得見。你可以改提示、換模型、重談約。默默降級會變成雜訊。沒有人負責。代理人重試五十次時,雜訊同時打到帳單與交期。

X上的貼文往人格靠:建檔、分出誰配用最前線。官方用詞比較冷。請求分類。蒸餾、資安、生物。不是人格測驗。實務感覺仍近。長對話、研究筆記、還沒寫完的假說。分類器看上下文,網愈張愈大。粒線體會掉,新藥牆撞也會掉。GLP-1會掉,醫療事業盡職調查也會掉。紙上是安全。實務是把核心工作安靜搬到另一個商品。

我不要叫它「安全過頭」。我要叫它靜默更換SKU。零售是標示問題。軟體是不改版本號就換二進位。我看不出AI有特權,讓標籤不動、內容換掉。

我在Grok 4.6那篇寫過,現在前線分數很擠。公司裡也有人說Fable 5與Grok 4.6體感接近。市場這麼擠,名稱背後被掉包,比較就毀了。評測用Fable。線上敏感問題用Opus回。投影片還在。工作不在。

30天保存是另一條線

同一次發布還帶了資料規則。Mythos級與之後的covered models,提示詞與輸出留30天。不用來訓練。人要讀,只能走受控路徑,留下無法竄改的日誌。30天後刪,例外是安全調查與法令。改到的是簽了零資料保存的企業。消費者方案本來就在存6

這跟降級不是同一件事。短窗看跨請求攻擊,安全理由成立。Anthropic寫了Best-of-N越獄會送幾百個只差一點的提示6。這段我跟得上。

我跟不上的,是最前線偏偏拿掉ZDR。你最想丟機密的模型,偏偏強制留下。合約寫「不留」的公司,偏偏摸不到真正要的SKU。這不是「有錢才能買合規」。你付了,最強的那檔特權反而消失。

Grok的公開FAQ不一樣。API預設為稽核留30天,不用來訓練。ZDR是設定。打開後,輸入輸出不寫進磁碟7。不是高階方案贈品。設定是否每次都生效,是另一題。2026年7月有報導說Grok Build上傳了整個倉、隱私開關沒作用。SpaceXAI說上線以來都尊重ZDR。這場還沒結。方針好,不等於現場有動。前一篇我也這樣寫。即便如此,「最前線不沒收ZDR」與「最前線逼你放棄ZDR」,在採購上是兩種商品。

我為何站在打開權重的那一側

開源權重不是光環。中國實驗室丟出檢查點,不會因此成聖。NVIDIA公開資料集,地緣政治也不會消失。我買的不是道德。我買的是一件實務:權重在自己手上,同一名稱被掉包時,使用端察覺得到。

NVIDIA Nemotron最乾淨。官方寫了,權重、訓練資料、配方都公開。2026年8月11日推出Nemotron 3.5 Lightning,標榜筆電一張GPU就能跑,放在Hugging Face89。黃仁勳才對華府說「過早限制會把創新推到海外」,沒過幾週就公開。企業可以自己評、自己微調,不必信API對面。

中國這邊,我一直看重Kimi。分數是上段,不是便宜貨架。「因為便宜才用」已經過時。我不是因為開源就信它。我信的是,同一組雜湊可以反覆跑自家二十題,雜湊變了就知道被換了。

美國開源權重的討論也一樣。為了安全而關。為了怕擴散而關。兩邊都有理由。Fable 5示範的是:關著做安全,產品形態很容易變成「默默降級」。分類器只活在提供者裡。使用者只能從答案稍微變差,去猜自己是不是被換了。

在自己邊界裡跑開源權重,對日本與台灣企業已是現實選項。我也寫過,沒有東京區域的Grok,合約寫「資料留在國內」的案子連評選都進不去。ZEROCK跑在日本AWS,就是為了這個。權重固定在自己籬笆裡推論。對靜默更換SKU,這是我目前最乾淨的答案。

限制當然有。開源權重一樣有拒答層。拿來當託管API,又回到對面。沒有完美玻璃箱。能釘住雜湊的合約,與不能釘住的合約,仍是兩種貨。我選前者。

下週合約審查可以加的一段

我不是要人丢掉封閉API。日文最終稿、長時間自主作業,有些場景封閉模型仍穩。2026年8月,公開榜上Claude系仍略高一兩分。問題不是「誰最聰明」,是「聰明的條件,買方看不看得到」。

我自己會加四行。未經通知,不得把請求轉離客戶指定的模型。若轉,回應必須帶回模型ID。價錢跟實際推論的模型走。會讓ZDR失效的模型,當另一個SKU報價。Fable 5後來的公開頁,有往其中幾條靠。若第一天就這樣出,All-In燒不起這麼大。

安全要有。想擋住生物與資安濫用,我理解。只是不要用「同一名稱換貨」來實作。拒絕就拒絕。要降,降到使用者看得見。要保存,就用採購的語言寫清,為什麼只有最前線失去ZDR。

上週寫文字浮水印時,我把它比成安全帶。默默換模型不是安全帶。那比較像車在開,有人把煞車與油門對調。乘客不知道,信任回不來。

TIMEWELL的WARP比較少看排行榜表演,比較先問模型釘在哪、日誌要留什麼、允不允許轉送。若已經覺得「比較安全,所以可以關」這句太薄,歡迎從個別諮詢開始談。

那則貼文說開發者社群不會忘。可以。不該忘的不是罵名。是合約裡的一行。

參考文獻

Footnotes

  1. Anthropic, Claude Fable 5 and Claude Mythos 5(2026-06-09) 2 3

  2. Maxwell Zeff, Anthropic Walks Back Policy That Could Have ‘Sabotaged’ AI Researchers Using Claude(WIRED, 2026-06-10)

  3. Fortune, Anthropic's AI will now tell users when requests are downgraded for safety(2026-06-11)

  4. Anthropic, Redeploying Fable 5(2026-06-30)

  5. Anthropic, Claude Fable

  6. Anthropic Help, Data retention practices for Covered Models 2

  7. SpaceXAI Docs, FAQ - API Security

  8. NVIDIA, NVIDIA Nemotron

  9. CNBC, Nvidia unveils first open-source AI model since CEO urged Washington to back open models(2026-08-11)

本文在製作過程中使用了AI,並於發布前由人工查核一手資料並完成編輯。

貴公司對AI的理解到哪裡?

5分鐘的免費檢測,涵蓋從AI理解到資安意識共7個面向。

如果這篇文章對您有幫助,歡迎分享

分享

訂閱電子報

每週為您送上 AI 應用與出口管制的最新資訊

您登錄的電子郵件地址僅用於電子報寄送。

AI駆動開発を、動かせるところまで

記事で読んだ話を、自分の手で動かせるようにする実践プログラムがWARPです。元大手DX・データ戦略の専門家が伴走します。

相關文章