テックトレンド

SpaceXAI三天內推出了什麼|Grok 4.6、Build、Bot,以及「我們必須在AI上取勝」

發布2026-08-13濱本 隆太

2026年8月11日Grok Bot,12日Grok 4.6。SpaceXAI在數日內連續推出代理產品與新模型。把公開的基準測試老實讀一遍,10項裡拿下最高分的只有3項,真正值得看的地方在別處。馬斯克的內部發言、價格結構,以及與中國業者的差距,一次整理。

SpaceXAI三天內推出了什麼|Grok 4.6、Build、Bot,以及「我們必須在AI上取勝」
分享

您好,我是TIMEWELL的濱本隆太。

**8月11日Grok Bot,12日Grok 4.6。**SpaceXAI在數日內連續推出代理產品與新模型。Grok Build也剛在前幾天出了正式版。

基準測試要小心讀。把廠商自己公開的比較表老實數一遍,並沒有話題講得那麼一面倒。即便如此,我同意「認真出手了」這個評價,理由在表的另一處,以及價格

先把立場寫清楚。**我們現在主推Grok。**日常實務的主力是Grok Build,Codex也一起用。理由寫在後面的價格那一節,以目前的判斷是:以性價比來看,Grok的優勢正在變得明確。

這三天推出了什麼

先排事實。

Grok 4.62026年8月12日公開1。前一代Grok 4.5是7月8日公開,大約一個月就更新。

Grok Bot8月11日進入測試版2。定位相當強勢:一組常時運作的AI代理擁有自己的專屬雲端環境,登入客戶既有工具,在無人監督下完成多階段作業。先從Mac、iOS開始,Windows與Linux桌面版也已推出。以內含在SuperGrok Heavy等既有高階方案的形式提供2

Grok Build是寫程式的代理。在專案資料夾裡以命令列工具運作,對程式庫用自然語言下指令。預想的用法是「說明這個儲存庫的結構」「幫這個API加上速率限制」這類事情2。7月28日早期測試,8月7日推出v1.0.03

公司本身也變了。2026年2月2日,SpaceX以全股票交換收購xAI,5月xAI作為獨立公司解散,7月6日公開了SpaceXAI這個新名稱與標誌4。6月也完成了IPO。也就是說,現在的Grok,跟火箭公司、社群平台住在同一棟屋頂下。

把基準測試老實讀一遍

我把送來的表,用勝負數過一遍。

基準測試 Grok 4.6 High Grok 4.5 High GPT-5.6 Sol Max Fable 5 Max
AA Intelligence Index 61 56 61 62
GDPVal-AA v2 1753 1526 1728 1741
CursorBench v3.2 69.9% 66.7% 67.2% 70.5%
DeepSWE v1.1 65.9% 54% 73% 70%
FrontierCode v1.1 61.3% 56.6% 60.6% 64.9%
APEX-Agents 57.5% 47.1% 56.7% 59.2%
Terminal-Bench v3.0 26% 15.7% 34.6% 34.1%
APEX-SWE 56.4% 53.6% 未列出 58.8%
AA-Briefcase 1577 1313 1502 1574
Harvey LAB (Vals) 15.8% 12.9% 2.5% 11.3%

10項之中,Grok 4.6拿下最高分的是3項。Fable 5 Max佔5項,GPT-5.6 Sol Max佔2項。而且這是SpaceXAI自己公開的比較表,註腳寫著「第三方模型的分數取自行公布值或公開值之中較佳者」5。廠商可以往自己有利的方向做的表,結果是這樣。

所以「一面倒大勝」這種讀法,我不會用。

真正值得看的地方在別處。相對前一代的升幅。

AA Intelligence Index從56到61。GDPVal-AA v2從1526到1753。DeepSWE v1.1從54%到65.9%。APEX-Agents從47.1%到57.5%。AA-Briefcase從1313到1577。Terminal-Bench從15.7%到26%。

**一個月動了這麼多。**絕對值有沒有拿下第一,不如這條斜率來得可怕。下一次若用同樣的幅度往上走,名次就會變。

對廠商表的懷疑,可以用第三方指標核對。Artificial Analysis Intelligence Index v4.1.1把GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR這9項合成一個指標6

上位是這樣。**Claude Opus 5(max)63、Claude Fable 5(含備援)62、GPT-5.6 Sol(max)61,然後Grok 4.6(high)61。**接著Kimi K3(max)60、Qwen3.8 Max 58、GPT-5.6 Terra(max)與Muse Spark 1.2為57、Grok 4.5(high)56、Claude Sonnet 5(max)556

也就是說,第三方合成指標裡,**Grok 4.6與GPT-5.6 Sol同為61,距首位Claude Opus 5差2分。**從前一代的56往上走了5分,進了第一集團。廠商表的主張,在這裡大致站得住。

把 AI 驅動開發,做到現場真的能用

WARP 是不讓您停在「追趨勢」的實務課程。由曾在大型企業負責 DX 與資料策略的專家陪跑到能實際運作為止。

不把模型做大,卻把分數拉上來

技術上最有意思的是這裡。

Grok 4.6的參數數是1.5兆,與Grok 4.5同一個V9基底。改善集中在後訓練,也就是監督式微調與強化學習1。不是把模型做大再硬砸。

我覺得這對整個產業都有提示。因為它是基底不動,只靠後訓練就大幅超過前一代的實例。從用規模法則硬推的時代,轉到同一塊底子怎麼收工的勝負,這個讀法多了一個佐證。

不過弱點也寫得很清楚。Terminal-Bench v3.0是26%,對上GPT-5.6的34.6%、Fable 5的34.1%,明顯偏低。這項基準測的是在終端機上走完長步驟的能力,這裡就是弱。

**偏偏同一週推出的Grok Build與Grok Bot,賣的正好是這種能力。**產品發表與實測值之間有這段落差,考慮導入的人最好先知道。代理產品是示範與實務落差最大的領域。

馬斯克在公司內部說的話

產品背後的意志。

在SpaceX的全員會議上,馬斯克對員工這樣說。大約29分鐘的影像,發在SpaceX的X帳號7

我們必須在AI上取勝。因為未來壓倒性地屬於AI與機器人7

數字也相當具體。SpaceX的AI營收將「大概在9月」超過其他所有事業線,第四季再拉開。AI算力希望在2027年底達到10吉瓦。接著他說:

若能在明年底前把10GW的AI上線,年營收會達到3,000億到5,000億美元7

他還說「大概四到五年內,AI會佔SpaceX價值的99%7。火箭公司的經營者,在內部說自家價值的99%將不再是火箭。

而這筆營收會成為Starship與火星計畫的本錢,這條線會穿過Tesla、SpaceX、xAI共同的晶片廠Terafab7。Terafab我在SpaceX與Tesla的Terafab整理過,包含公布數字與報導對不上的地方。

讀的時候要小心:**這是目標,不是實績。**10GW、3,000億美元、99%,都還沒達成。對內打氣的成分當然有。不過我更看重的是,立下這種規模目標的組織,真的在一個月內更新了模型,同一週推出兩項代理產品這個事實。不是話,是出貨的速度在表明意志。

價格該怎麼看。以及與中國業者的差距

這是這次最大的變化。我認為比性能更重的競爭一手,是價格。

Grok 4.6的API價格是每百萬token輸入2美元、輸出6美元。與Grok 4.5相同,沒有調漲8。xAI自己把這定位成「其他前沿模型的半價8

性能往上走一代,價格按兵不動。**實質上是降價。**而且這一手,對成本會隨token量等比增加的開發者與代理建構者,是直球。

把第三方指標跟價格並排,位置就清楚了。

模型 AA Index 輸入(每百萬token) 輸出(每百萬token)
Grok 4.6 61 2.00美元 6.00美元
Kimi K3(max) 60 3.00美元 15.00美元
Qwen3.8 Max 58 未能確認公開價格 未能確認公開價格
Grok 4.5 56 2.00美元 6.00美元
DeepSeek V4 Flash 52 0.14美元 0.28美元

跟Kimi K3比,Grok 4.6分數高1分,輸出價格不到一半9。這裡值得盯。中國業者常被理解成「用便宜硬砸」,但已經走進上位帶的Kimi K3一點也不便宜。同一個分數帶裡最便宜的,變成Grok。

另一方面,DeepSeek V4 Flash是輸入0.14美元、輸出0.28美元9。差了兩個量級。不過AA Index是52,跟Grok 4.6差9分。**這不是同一塊場地。**用途收窄、用便宜的方式跑,選DeepSeek;需要前沿級能力,選Grok。是這樣的分工。

補充一句,中國業者真正的差異化軸,與其說是價格本身,不如說是開放權重。SWE-bench Verified從80.2%到80.6%這0.4分的帶裡排了5個模型,其中DeepSeek V4 Pro Max公開了權重9。若你看重的是能在自家環境跑,這個選項依然強。

不過條件也要寫上。**提示超過20萬token,輸入就變成4美元、輸出12美元,直接翻倍。**網頁搜尋、X搜尋、程式執行各按每1,000次5美元另計8。長時間跑的代理,正好會走進這個倍價區間與搜尋計費。只拿價目表估,會估歪。

即便如此,我們仍推薦Grok的理由

立場寫清楚。以目前的性價比來看,我認為Grok正在拉開一個身位。

理由有三個。

**第一,同一個分數帶裡最便宜。**AA Index拿下61,輸入2美元、輸出6美元,在第一集團裡位置明顯有利。跟高1分的Fable 5、高2分的Claude Opus 5比,日常業務要跑的量一加上去,差距就會發酵。

**第二,沒有漲價就把世代往上推。**我不把它讀成一次性促銷,而是把價格維持成競爭軸的表態。對上馬斯克的內部發言,可以看出他們把營收的拿法放在規模,而不是模型單價。

**第三,因為我們真的在用。**日常實務的主力是Grok Build。Codex也一起用。不是價目表比較,是每天作業跑下來的手感:每一塊錢能做完的工作量不錯。

手感講具體一點。**Grok Build的使用感,跟Fable 5沒有明顯落差。**把程式讀進去再改的一連串作業裡,很少覺得明顯比較差。再疊上價格一半,就構成選擇的理由。能直接處理多模態,在實務上比想像中更有用。螢幕截圖、圖面、手寫筆記。先轉成文字再丟進去的那一步沒了。不起眼,但每天都在生效。

不過**日文生成能力,還留著一部分不自然。**措辭會彆扭,敬語體與口語體會混在一起。這裡Claude比較穩。要用日文交出最終成品的業務,還是得動手修。希望它快點追上,這是老實話。

**第四,影像、聲音、影片能在同一個地方做。**這一點意外地很少被提起,實務上差距很大。

Grok以Grok Imagine提供影像與影片生成。影像一張0.02美元,品質優先模式1K是0.05美元、2K是0.07美元10。8月7日推出Grok Imagine Image 2.0,對指示的跟隨與編輯有改善3

影片也加強了。Grok Imagine Video 1.5支援文字生成影片、影像生成影片、參考影像生成影片,文字與影像的生成是原生1080p。可產出1秒到15秒的片段,API價格480p每秒0.05美元、720p每秒0.07美元10

然後是聲音。7月29日推出語音對語音的Grok Voice Think Fast 2.0,8月5日成為預設。價格是語音每分鐘0.08美元3

我盯著的是,**影片生成裡,聲音走同一條路徑。**音樂、音效、對白,不是另開一道語音處理,而是在同一次生成裡做出來。設定是每秒0.08美元10。不用先做影片再配音。

**這是Claude沒有的領域。**Claude不生成影像、也不生成聲音與影片。文字與程式非常強,但成品一旦超出文字,它根本沒上場。以我們的用途來說,簡報圖、說明影片、語音導覽就屬於這一類。

**這段差距,跟模型聰不聰明是另一條軸。**基準測試的分數上看不到。只是當你想把公司內部用的工具收斂時,「同一個地方就能出影像、影片、聲音」這個條件,會直接減少合約與維運的條數。我把它看成明確的優勢。

為了公平,弱點再寫一次。**Terminal-Bench是26%,明顯偏低。**要長時間、自己走完步驟的場面,其他模型還是比較穩。我們併用多個模型,就是為了補這裡,以及日文。**不是往一個收,而是在價格划算的領域把Grok放厚。**以目前來說,這是實務上的答案。

而且**再過幾週就是Grok 4.7。**2.1兆參數,這次基底本身會變大1。想到這一次是「不大規模、靠後訓練拿下5分」,下一次我覺得可以期待。若日文在那裡改善,我們的分工會再單純一階。

另外,**中國業者裡,我們對Kimi K3評價很高。**AA Index 60就是第一集團本身,早就過了「因為便宜才用」的階段。輸出15美元,比Grok貴,所以沒當成我們的主力,但實力是真的。再用價格帶把中國業者一筆勾掉,已經跟現況不合。

SpaceXAI在價格以外瞄準的位置也看得到。代理的完成度與整合。Grok Bot「擁有專屬雲端環境、登入既有工具、無人監督地跑」這個設計,是選擇連同會動的環境一起賣,而不只賣模型。開放權重自己跑的那一方最麻煩的部分,原封不動做成了產品。

不過,東京區域用不了

我是站在推薦的立場寫,但**對日本企業來說,最大的顧慮在這裡。**不是價格,也不是性能。

Grok沒辦法指定東京區域來用。

Amazon Bedrock在2026年6月上了Grok。不過上的是Grok 4.3,不是這次的4.611。而那個4.3支援區域內推論的,是美國西部(奧勒岡)、美國東部(維吉尼亞北部)、美國東部(俄亥俄)。7月也部署到AWS GovCloud(US-West),一樣是美國11

亞太(東京)不在其中。

資料留存也有條件。依AWS的說明,只指定store=false並不保證零留存。要確定為零,有效的資料留存模式必須是none,而且該模型必須允許這個模式11

在日本做事,這一點會卡住。

理由不是情緒,是程序。個人資料的跨境移轉需要本人同意,或是提供移轉目的地體制的資訊。有些產業,主管機關的指引會問資料在哪。而最現實的,是與客戶的合約、以及內部規章。寫著「資料必須留在國內」的合約並不罕見。技術再好,有這一行就用不了。

也就是說,日本企業的實務裡,**模型選用會多出「能不能在東京區域跑」這一欄。**而且這一欄比基準測試的分數、比價格更早生效。對不上,其他欄位看都還沒看到就掉了。

我們把用途拆開,也有這層原因。**區域限制碰不到的領域,把Grok放厚;資料所在會卡住的領域,用能在國內跑的組態。**ZEROCK跑在日本國內的AWS伺服器上,就是為了回應後者。

這不只是Grok的問題。**AI模型的供給集中在美中本身,對日本就是結構性的依賴。**同樣形狀的問題,我把它擴到定位、能源、糧食,寫在準天頂衛星7號機與日本的依賴結構。公司內部資料要交到哪裡,整理在直接把資料交給LLM廠商會帶來的風險

另一方面,ZDR的設計我給予肯定

跟區域分開來看,**資料留存本身的設計值得肯定。**這裡寫公平一點。

xAI的預設是,API的請求與回應為了稽核會在伺服器上保存30天(靜態加密)。不過不會用這些資料來訓練,30天後自動刪除12

然後,開啟ZDR(Zero Data Retention,零資料留存)之後,API的輸入(提示)與輸出(生成的token)不會持久化到磁碟12。就我們確認的範圍,這是用設定開啟,不是靠買高階方案,也不另外收費。這一點我覺得就是好。

價目裡沒有做成「要守住資料就去簽高階約」那種階梯。**沒有把法遵需求,變成付得起的公司才有的福利。**看起來像小事,直接影響內部簽核好不好過。

要注意的有兩點。其一,ZDR是以團隊為單位,沒辦法針對單一API金鑰分別開啟12。其二,Grok Build走API金鑰的使用會遵守ZDR,但若ZDR是關閉的,就必須用CLI的/privacy指令把資料留存停掉12。不是預設全部停,導入時要親手碰一次。

不過,這裡也不是雙手贊成就能寫完的故事。**2026年7月有報導指出,Grok Build把整個程式庫上傳到xAI的儲存,當時的隱私設定並未如預期運作。**SpaceXAI的說明是,Grok Build自提供以來就完全尊重ZDR,CLI隨時可以關閉上傳,那個選擇也一直被尊重13。**事實關係仍有出入。**本文不判定哪一邊正確。

實務上的教訓很清楚。**政策寫得好,與實作真的照那樣動,是兩件事。**我們把Grok Build當主力是事實,但會依資料的性質拆開用。這一段應該自己確認行為再判斷。同樣結構的故事,我寫在租戶隔離為什麼會「後來」才壞掉

老實說,**東京區域若解開,我們的分工會單純得多。**ZDR這塊底已經在,剩下的就是所在地。比起Grok 4.7模型變好,我更在等這個。

把開放權重放在自家環境跑,這個選項本身對日本企業是現實的討論對象。把資料放進多租戶SaaS時會碰到的問題,整理在租戶隔離為什麼會「後來」才壞掉

日本企業該怎麼面對

整理一下。

2026年8月11日Grok Bot,12日Grok 4.6。公司2月被SpaceX吸收,7月改稱SpaceXAI。馬斯克在內部說「我們必須在AI上取勝」,並提出2027年底AI算力10GW、AI將佔SpaceX價值99%的展望。

廠商公開表裡10項中3項是最高分。不過第三方的Artificial Analysis Intelligence Index也已經來到61,與GPT-5.6 Sol同分,距首位Claude Opus 5差2分。而且是沒有把模型做大、靠後訓練拿下5分。弱點是Terminal-Bench與日文生成,前者正好疊在新產品的主戰場上。

然後價格按兵不動,輸入2美元、輸出6美元。同一個分數帶裡最便宜,比低1分的Kimi K3(輸入3美元、輸出15美元)輸出還不到一半。性能往上走、價格不動的實質降價,我認為是這次最重的一手。

實務上怎麼做。**不要把模型鎖死成一個。**以目前來說,我覺得這是答案。一個月名次就能動成這樣的市場,按特定模型去深做,下一次更新就要重做。提示詞與評測,都用換得掉模型的形狀來持有。

再來,**先決定自家業務要量什麼。**這張表裡也一樣,GDPVal、Briefcase、法務強的模型,跟終端機作業強的模型不是同一個。**基準測試的綜合分,跟自家用途幾乎無關。**哪怕只切出20件實際任務,讓候選模型解同一組題。那才是唯一像樣的比較。

老實說,這個領域光追就耗神。一個月換一代,再過幾週Grok 4.7預告要以2.1兆參數推出1。全部持續評下去是不可能的。所以,追的對象不要放在「模型」,放在「自家怎麼量」,比較撐得住。

我們現在的位置再寫一次:**主力是Grok Build,日文最終成品與長時間自主作業用其他模型補。**若Grok 4.7把日文改善了,這套分工也許就不必了。我帶著期待在等。

還有一件容易忘的:**選用的軸,不只是基準測試的分數。**影像、聲音、影片能不能在同一個地方做,分數表上哪兒都看不到,卻決定合約與維運的條數。你是做什麼的公司,該看的欄位就不一樣。

對日本企業,還有**比分數更早生效的一欄。能不能在東京區域跑。**Grok目前對不上。合約寫著「資料留在國內」的案子,性能與價格根本進不了討論。這一欄該最先看。放到最後看,全部重來。

想討論AI運用的設計、哪個模型放在哪裡,WARP的想法或許有幫助。若要針對具體情況談,歡迎從這裡聯絡。


Footnotes

  1. Grok 4.6於2026年8月12日公開。參數數1.5兆,與Grok 4.5同一個V9基底,改善據稱為後訓練(監督式微調及強化學習),而非靠規模擴大。重點放在長時間運作的代理,以及互動、視覺作業。更大的2.1兆參數Grok 4.7預告將在數週後接續推出。官方發布見 https://x.ai/news/grok-4-6 (本文撰寫時,我方存取遭Cloudflare阻擋,內容依引用該發布的二手資料確認)https://kie.ai/blog/what-is-grok-4-6https://www.buildfastwithai.com/blogs/grok-4-6-preview 2 3 4

  2. Grok Bot於2026年8月11日進入測試版。據稱為一組常時運作的AI代理,擁有專屬雲端環境,登入客戶既有工具,在無人監督下完成多階段作業。除Mac、iOS外,亦提供Windows、Linux桌面版,Android稍後。內含於既有高階訂閱(SuperGrok Heavy等)。https://www.unite.ai/xai-launches-grok-bot-always-on-ai-teammates-with-their-own-cloud-computers/ / Grok Build是寫程式的代理,在專案資料夾內以命令列工具運作,對程式庫以自然語言下指令。先以早期測試提供給SuperGrok Heavy訂戶。https://www.eweek.com/news/xai-grok-build-coding-agent/ 2 3

  3. Grok Build的發布紀錄。2026年7月28日Build Mode早期測試,2026年8月7日v1.0.0(儀表板及CLI修正)。https://releasebot.io/updates/xai 2 3

  4. 2026年2月2日,SpaceX以全股票交換收購xAI,xAI成為SpaceX全資子公司(xAI每股換0.1433股SpaceX股)。2026年5月xAI作為獨立公司解散,AI部門改稱SpaceXAI。2026年7月6日新名稱與標誌在X公開。合併後的公司包含SpaceX、xAI、X。https://finance.yahoo.com/technology/ai/articles/xai-makes-rebrand-spacexai-complete-215010760.htmlhttps://www.socialmediatoday.com/news/spacex-rebrands-as-spacexai/824656/

  5. 本文參照的基準測試比較表,由SpaceXAI公開。該表註腳寫著「Third-party model scores best of self-reported or publicly available.(第三方模型的分數取自行公布值或公開值之中較佳者)」。必須以廠商自己做的比較為前提來讀。本文為此並記第三方指標Artificial Analysis Intelligence Index。

  6. Artificial Analysis Intelligence Index v4.1.1。由GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR共9項合成。刊出的主要分數為Claude Opus 5(max)63、Claude Fable 5(含備援)62、GPT-5.6 Sol(max)61、Grok 4.6(high)61、Kimi K3(max)60、Qwen3.8 Max 58、Muse Spark 1.2(xhigh)57、GPT-5.6 Terra(max)57、Grok 4.5(high)56、Claude Sonnet 5(max)55、GLM-5.2(max)53、GPT-5.6 Luna(max)52、DeepSeek V4 Flash 0731(max)52、Gemini 3.6 Flash 52、MiniMax-M3 45、MiMo-V2.5-Pro 43、Inkling 42、Nemotron 3 Ultra 38、Gemini 3.5 Flash-Lite 37、Muse Glimmer(high)35、Mistral Medium 3.5 30、Gemma 4 31B 30。https://artificialanalysis.ai/ 2

  7. SpaceX全員會議上Elon Musk的發言。約29分鐘影像發在SpaceX的X帳號。「we must win on AI, because the future is overwhelmingly AI and robots」、AI營收將「大概在9月」超過其他所有事業線並於第四季再拉開的展望、2027年底AI算力瞄準10吉瓦、「if we bring 10GW of AI online by the end of next year, it will be $300 billion to $500 billion a year in revenue」、「Probably in four or five years, AI will be 99% of the value of SpaceX」,以及這筆營收成為Starship與火星計畫本錢、並穿過Tesla、SpaceX、xAI共同晶片廠Terafab的記述,均出自該報導。https://www.teslarati.com/spacexs-next-trillion-dollar-bet-has-nothing-to-do-with-rockets-musk-tells-staff/ / 本文撰寫時,這些仍是目標與展望,並非已達成的實績。 2 3 4 5

  8. Grok 4.6的API價格為每百萬token輸入2.00美元、輸出6.00美元。與前一代Grok 4.5(2026年7月8日公開)同額、未調漲,xAI將此定位為「half the price of other frontier models(其他前沿模型的半價)」。https://www.basenor.com/blogs/news/xai-launches-grok-4-6-1753-elo-half-the-price-of-rival-frontier-models / 上下文長度50萬token。提示達20萬token以上,輸入4.00美元、輸出12.00美元,價格翻倍。網頁搜尋、X搜尋、程式執行各按每1,000次5.00美元另計,collection搜尋每1,000次2.50美元。消費端SuperGrok Heavy月費300美元、SuperGrok 30美元、SuperGrok Lite 10美元。快取輸入的折扣率,來源分別寫0.30美元(減85%)與0.50美元(減75%),本文不當作確定值。https://benchlm.ai/xai/api-pricinghttps://www.aipricing.guru/xai-pricing/ 2 3

  9. DeepSeek-V4-Flash每百萬token輸入0.14美元、輸出0.28美元。DeepSeek-V4-Pro輸入0.435美元、輸出0.87美元。Kimi K2.6為0.95美元/4.00美元,256K上下文,SWE-bench Verified 80.2%,開放權重。Kimi K3為3美元/15美元。SWE-bench Verified從80.2%到80.6%的帶裡,DeepSeek V4 Pro Max、Gemini 3.1 Pro、MiniMax M3、Qwen3.7 Max、Kimi K2.6五個模型並列,這個帶的輸出價格從每百萬token 2.40美元(MiniMax M3)到12美元(Gemini 3.1 Pro)拉開。DeepSeek V4 Pro Max以開放權重提供。https://deepseek.ai/pricinghttps://benchlm.ai/moonshot/api-pricinghttps://www.morphllm.com/llm-api 2 3

  10. Grok Imagine是負責影像與影片生成的模型群。影像一張0.02美元(高速),品質優先級距1K為0.05美元、2K為0.07美元。影片(1.0及1.5)可產出1秒到15秒、最高1080p的片段,並在同一路徑生成聲音。API價格480p每秒0.05美元、720p每秒0.07美元,同一路徑生成聲音則每秒0.08美元(音樂、音效、對白不經另開語音處理,在同一次生成內完成)。Grok Imagine Video 1.5支援文字生成影片、影像生成影片、參考影像生成影片,文字及影像的生成支援原生1080p。https://www.aipricing.guru/xai-pricing/https://felloai.com/grok-imagine-video-generation/https://invideo.io/blog/grok-imagine-ai-generator/ / 本文撰寫時,Anthropic的Claude未提供影像、聲音、影片的生成功能。 2 3

  11. Amazon Bedrock上xAI模型的提供情況。2026年6月Grok 4.3於Amazon Bedrock開始提供,2026年7月亦於AWS GovCloud(US-West)開始提供。支援區域內推論的是美國西部(奧勒岡)、美國東部(維吉尼亞北部)、美國東部(俄亥俄),本文撰寫時亞太(東京,ap-northeast-1)不在其中。Bedrock上提供的是Grok 4.3,不是2026年8月12日公開的Grok 4.6。資料留存方面,AWS表示僅指定store=false並不保證零留存,要確定為零的持久留存,有效的資料留存模式必須是none,且該模型必須允許這個模式。https://aws.amazon.com/about-aws/whats-new/2026/06/grok-amazon-bedrock/https://aws.amazon.com/about-aws/whats-new/2026/07/grok-4-3-bedrock-govcloud/https://docs.aws.amazon.com/bedrock/latest/userguide/models-regions.htmlhttps://www.techi.com/grok-bedrock-portability-retention-regions/ 2 3

  12. xAI關於資料留存的規格。預設下API的請求及回應為稽核目的在伺服器保存30天(靜態加密),不以該資料訓練,30天後自動刪除。開啟ZDR(Zero Data Retention)後,API請求的輸入(提示)及輸出(生成的token)不會持久化到磁碟。ZDR是以團隊為單位的設定,無法只對特定API金鑰開啟。https://docs.x.ai/developers/faq/security / ZDR能以設定開啟、不另外收費,是本文撰寫時就我方確認範圍所做的記述。另xAI官方帳號說明「For teams using zero data retention, no trace and code data is ever retained. All API key use of Grok Build also respects ZDR. If ZDR is disabled, the /privacy command is available in the CLI to disable data retention, which also deletes previously synced data.」https://x.com/SpaceXAI/status/2076692402442846289 2 3 4

  13. 2026年7月,有報導指出Grok Build不只上傳讀過的檔案,而是把整個Git儲存庫上傳到xAI的儲存,當時的隱私設定並未如預期運作。https://thehackernews.com/2026/07/grok-build-uploads-entire-git.htmlhttps://www.techtimes.com/articles/320420/20260714/grok-build-shipped-entire-codebases-xai-cloud-privacy-toggle-did-nothing.htm / 對此SpaceXAI說明,Grok Build自提供以來就完全尊重ZDR,使用者隨時可用CLI關閉資料上傳,該選擇也一直被尊重。https://x.com/SpaceXAI/status/2077494536788664782 / 事實關係雙方說明仍有出入,本文不判定哪一邊正確。

本文在製作過程中使用了AI,並於發布前由人工查核一手資料並完成編輯。

貴公司對AI的理解到哪裡?

5分鐘的免費檢測,涵蓋從AI理解到資安意識共7個面向。

如果這篇文章對您有幫助,歡迎分享

分享

訂閱電子報

每週為您送上 AI 應用與出口管制的最新資訊

您登錄的電子郵件地址僅用於電子報寄送。

AI駆動開発を、動かせるところまで

記事で読んだ話を、自分の手で動かせるようにする実践プログラムがWARPです。元大手DX・データ戦略の専門家が伴走します。

相關文章