您好,我是TIMEWELL的濱本隆太。
**8月11日Grok Bot,12日Grok 4.6。**SpaceXAI在數日內連續推出代理產品與新模型。Grok Build也剛在前幾天出了正式版。
基準測試要小心讀。把廠商自己公開的比較表老實數一遍,並沒有話題講得那麼一面倒。即便如此,我同意「認真出手了」這個評價,理由在表的另一處,以及價格。
先把立場寫清楚。**我們現在主推Grok。**日常實務的主力是Grok Build,Codex也一起用。理由寫在後面的價格那一節,以目前的判斷是:以性價比來看,Grok的優勢正在變得明確。
這三天推出了什麼
先排事實。
Grok 4.6於2026年8月12日公開1。前一代Grok 4.5是7月8日公開,大約一個月就更新。
Grok Bot於8月11日進入測試版2。定位相當強勢:一組常時運作的AI代理擁有自己的專屬雲端環境,登入客戶既有工具,在無人監督下完成多階段作業。先從Mac、iOS開始,Windows與Linux桌面版也已推出。以內含在SuperGrok Heavy等既有高階方案的形式提供2。
Grok Build是寫程式的代理。在專案資料夾裡以命令列工具運作,對程式庫用自然語言下指令。預想的用法是「說明這個儲存庫的結構」「幫這個API加上速率限制」這類事情2。7月28日早期測試,8月7日推出v1.0.03。
公司本身也變了。2026年2月2日,SpaceX以全股票交換收購xAI,5月xAI作為獨立公司解散,7月6日公開了SpaceXAI這個新名稱與標誌4。6月也完成了IPO。也就是說,現在的Grok,跟火箭公司、社群平台住在同一棟屋頂下。
把基準測試老實讀一遍
我把送來的表,用勝負數過一遍。
| 基準測試 | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54% | 73% | 70% |
| FrontierCode v1.1 | 61.3% | 56.6% | 60.6% | 64.9% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | 未列出 | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
10項之中,Grok 4.6拿下最高分的是3項。Fable 5 Max佔5項,GPT-5.6 Sol Max佔2項。而且這是SpaceXAI自己公開的比較表,註腳寫著「第三方模型的分數取自行公布值或公開值之中較佳者」5。廠商可以往自己有利的方向做的表,結果是這樣。
所以「一面倒大勝」這種讀法,我不會用。
真正值得看的地方在別處。相對前一代的升幅。
AA Intelligence Index從56到61。GDPVal-AA v2從1526到1753。DeepSWE v1.1從54%到65.9%。APEX-Agents從47.1%到57.5%。AA-Briefcase從1313到1577。Terminal-Bench從15.7%到26%。
**一個月動了這麼多。**絕對值有沒有拿下第一,不如這條斜率來得可怕。下一次若用同樣的幅度往上走,名次就會變。
對廠商表的懷疑,可以用第三方指標核對。Artificial Analysis Intelligence Index v4.1.1把GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR這9項合成一個指標6。
上位是這樣。**Claude Opus 5(max)63、Claude Fable 5(含備援)62、GPT-5.6 Sol(max)61,然後Grok 4.6(high)61。**接著Kimi K3(max)60、Qwen3.8 Max 58、GPT-5.6 Terra(max)與Muse Spark 1.2為57、Grok 4.5(high)56、Claude Sonnet 5(max)556。
也就是說,第三方合成指標裡,**Grok 4.6與GPT-5.6 Sol同為61,距首位Claude Opus 5差2分。**從前一代的56往上走了5分,進了第一集團。廠商表的主張,在這裡大致站得住。
不把模型做大,卻把分數拉上來
技術上最有意思的是這裡。
Grok 4.6的參數數是1.5兆,與Grok 4.5同一個V9基底。改善集中在後訓練,也就是監督式微調與強化學習1。不是把模型做大再硬砸。
我覺得這對整個產業都有提示。因為它是基底不動,只靠後訓練就大幅超過前一代的實例。從用規模法則硬推的時代,轉到同一塊底子怎麼收工的勝負,這個讀法多了一個佐證。
不過弱點也寫得很清楚。Terminal-Bench v3.0是26%,對上GPT-5.6的34.6%、Fable 5的34.1%,明顯偏低。這項基準測的是在終端機上走完長步驟的能力,這裡就是弱。
**偏偏同一週推出的Grok Build與Grok Bot,賣的正好是這種能力。**產品發表與實測值之間有這段落差,考慮導入的人最好先知道。代理產品是示範與實務落差最大的領域。
馬斯克在公司內部說的話
產品背後的意志。
在SpaceX的全員會議上,馬斯克對員工這樣說。大約29分鐘的影像,發在SpaceX的X帳號7。
我們必須在AI上取勝。因為未來壓倒性地屬於AI與機器人7
數字也相當具體。SpaceX的AI營收將「大概在9月」超過其他所有事業線,第四季再拉開。AI算力希望在2027年底達到10吉瓦。接著他說:
若能在明年底前把10GW的AI上線,年營收會達到3,000億到5,000億美元7
他還說「大概四到五年內,AI會佔SpaceX價值的99%」7。火箭公司的經營者,在內部說自家價值的99%將不再是火箭。
而這筆營收會成為Starship與火星計畫的本錢,這條線會穿過Tesla、SpaceX、xAI共同的晶片廠Terafab7。Terafab我在SpaceX與Tesla的Terafab整理過,包含公布數字與報導對不上的地方。
讀的時候要小心:**這是目標,不是實績。**10GW、3,000億美元、99%,都還沒達成。對內打氣的成分當然有。不過我更看重的是,立下這種規模目標的組織,真的在一個月內更新了模型,同一週推出兩項代理產品這個事實。不是話,是出貨的速度在表明意志。
價格該怎麼看。以及與中國業者的差距
這是這次最大的變化。我認為比性能更重的競爭一手,是價格。
Grok 4.6的API價格是每百萬token輸入2美元、輸出6美元。與Grok 4.5相同,沒有調漲8。xAI自己把這定位成「其他前沿模型的半價」8。
性能往上走一代,價格按兵不動。**實質上是降價。**而且這一手,對成本會隨token量等比增加的開發者與代理建構者,是直球。
把第三方指標跟價格並排,位置就清楚了。
| 模型 | AA Index | 輸入(每百萬token) | 輸出(每百萬token) |
|---|---|---|---|
| Grok 4.6 | 61 | 2.00美元 | 6.00美元 |
| Kimi K3(max) | 60 | 3.00美元 | 15.00美元 |
| Qwen3.8 Max | 58 | 未能確認公開價格 | 未能確認公開價格 |
| Grok 4.5 | 56 | 2.00美元 | 6.00美元 |
| DeepSeek V4 Flash | 52 | 0.14美元 | 0.28美元 |
跟Kimi K3比,Grok 4.6分數高1分,輸出價格不到一半9。這裡值得盯。中國業者常被理解成「用便宜硬砸」,但已經走進上位帶的Kimi K3一點也不便宜。同一個分數帶裡最便宜的,變成Grok。
另一方面,DeepSeek V4 Flash是輸入0.14美元、輸出0.28美元9。差了兩個量級。不過AA Index是52,跟Grok 4.6差9分。**這不是同一塊場地。**用途收窄、用便宜的方式跑,選DeepSeek;需要前沿級能力,選Grok。是這樣的分工。
補充一句,中國業者真正的差異化軸,與其說是價格本身,不如說是開放權重。SWE-bench Verified從80.2%到80.6%這0.4分的帶裡排了5個模型,其中DeepSeek V4 Pro Max公開了權重9。若你看重的是能在自家環境跑,這個選項依然強。
不過條件也要寫上。**提示超過20萬token,輸入就變成4美元、輸出12美元,直接翻倍。**網頁搜尋、X搜尋、程式執行各按每1,000次5美元另計8。長時間跑的代理,正好會走進這個倍價區間與搜尋計費。只拿價目表估,會估歪。
即便如此,我們仍推薦Grok的理由
立場寫清楚。以目前的性價比來看,我認為Grok正在拉開一個身位。
理由有三個。
**第一,同一個分數帶裡最便宜。**AA Index拿下61,輸入2美元、輸出6美元,在第一集團裡位置明顯有利。跟高1分的Fable 5、高2分的Claude Opus 5比,日常業務要跑的量一加上去,差距就會發酵。
**第二,沒有漲價就把世代往上推。**我不把它讀成一次性促銷,而是把價格維持成競爭軸的表態。對上馬斯克的內部發言,可以看出他們把營收的拿法放在規模,而不是模型單價。
**第三,因為我們真的在用。**日常實務的主力是Grok Build。Codex也一起用。不是價目表比較,是每天作業跑下來的手感:每一塊錢能做完的工作量不錯。
手感講具體一點。**Grok Build的使用感,跟Fable 5沒有明顯落差。**把程式讀進去再改的一連串作業裡,很少覺得明顯比較差。再疊上價格一半,就構成選擇的理由。能直接處理多模態,在實務上比想像中更有用。螢幕截圖、圖面、手寫筆記。先轉成文字再丟進去的那一步沒了。不起眼,但每天都在生效。
不過**日文生成能力,還留著一部分不自然。**措辭會彆扭,敬語體與口語體會混在一起。這裡Claude比較穩。要用日文交出最終成品的業務,還是得動手修。希望它快點追上,這是老實話。
**第四,影像、聲音、影片能在同一個地方做。**這一點意外地很少被提起,實務上差距很大。
Grok以Grok Imagine提供影像與影片生成。影像一張0.02美元,品質優先模式1K是0.05美元、2K是0.07美元10。8月7日推出Grok Imagine Image 2.0,對指示的跟隨與編輯有改善3。
影片也加強了。Grok Imagine Video 1.5支援文字生成影片、影像生成影片、參考影像生成影片,文字與影像的生成是原生1080p。可產出1秒到15秒的片段,API價格480p每秒0.05美元、720p每秒0.07美元10。
然後是聲音。7月29日推出語音對語音的Grok Voice Think Fast 2.0,8月5日成為預設。價格是語音每分鐘0.08美元3。
我盯著的是,**影片生成裡,聲音走同一條路徑。**音樂、音效、對白,不是另開一道語音處理,而是在同一次生成裡做出來。設定是每秒0.08美元10。不用先做影片再配音。
**這是Claude沒有的領域。**Claude不生成影像、也不生成聲音與影片。文字與程式非常強,但成品一旦超出文字,它根本沒上場。以我們的用途來說,簡報圖、說明影片、語音導覽就屬於這一類。
**這段差距,跟模型聰不聰明是另一條軸。**基準測試的分數上看不到。只是當你想把公司內部用的工具收斂時,「同一個地方就能出影像、影片、聲音」這個條件,會直接減少合約與維運的條數。我把它看成明確的優勢。
為了公平,弱點再寫一次。**Terminal-Bench是26%,明顯偏低。**要長時間、自己走完步驟的場面,其他模型還是比較穩。我們併用多個模型,就是為了補這裡,以及日文。**不是往一個收,而是在價格划算的領域把Grok放厚。**以目前來說,這是實務上的答案。
而且**再過幾週就是Grok 4.7。**2.1兆參數,這次基底本身會變大1。想到這一次是「不大規模、靠後訓練拿下5分」,下一次我覺得可以期待。若日文在那裡改善,我們的分工會再單純一階。
另外,**中國業者裡,我們對Kimi K3評價很高。**AA Index 60就是第一集團本身,早就過了「因為便宜才用」的階段。輸出15美元,比Grok貴,所以沒當成我們的主力,但實力是真的。再用價格帶把中國業者一筆勾掉,已經跟現況不合。
SpaceXAI在價格以外瞄準的位置也看得到。代理的完成度與整合。Grok Bot「擁有專屬雲端環境、登入既有工具、無人監督地跑」這個設計,是選擇連同會動的環境一起賣,而不只賣模型。開放權重自己跑的那一方最麻煩的部分,原封不動做成了產品。
不過,東京區域用不了
我是站在推薦的立場寫,但**對日本企業來說,最大的顧慮在這裡。**不是價格,也不是性能。
Grok沒辦法指定東京區域來用。
Amazon Bedrock在2026年6月上了Grok。不過上的是Grok 4.3,不是這次的4.611。而那個4.3支援區域內推論的,是美國西部(奧勒岡)、美國東部(維吉尼亞北部)、美國東部(俄亥俄)。7月也部署到AWS GovCloud(US-West),一樣是美國11。
亞太(東京)不在其中。
資料留存也有條件。依AWS的說明,只指定store=false並不保證零留存。要確定為零,有效的資料留存模式必須是none,而且該模型必須允許這個模式11。
在日本做事,這一點會卡住。
理由不是情緒,是程序。個人資料的跨境移轉需要本人同意,或是提供移轉目的地體制的資訊。有些產業,主管機關的指引會問資料在哪。而最現實的,是與客戶的合約、以及內部規章。寫著「資料必須留在國內」的合約並不罕見。技術再好,有這一行就用不了。
也就是說,日本企業的實務裡,**模型選用會多出「能不能在東京區域跑」這一欄。**而且這一欄比基準測試的分數、比價格更早生效。對不上,其他欄位看都還沒看到就掉了。
我們把用途拆開,也有這層原因。**區域限制碰不到的領域,把Grok放厚;資料所在會卡住的領域,用能在國內跑的組態。**ZEROCK跑在日本國內的AWS伺服器上,就是為了回應後者。
這不只是Grok的問題。**AI模型的供給集中在美中本身,對日本就是結構性的依賴。**同樣形狀的問題,我把它擴到定位、能源、糧食,寫在準天頂衛星7號機與日本的依賴結構。公司內部資料要交到哪裡,整理在直接把資料交給LLM廠商會帶來的風險。
另一方面,ZDR的設計我給予肯定
跟區域分開來看,**資料留存本身的設計值得肯定。**這裡寫公平一點。
xAI的預設是,API的請求與回應為了稽核會在伺服器上保存30天(靜態加密)。不過不會用這些資料來訓練,30天後自動刪除12。
然後,開啟ZDR(Zero Data Retention,零資料留存)之後,API的輸入(提示)與輸出(生成的token)不會持久化到磁碟12。就我們確認的範圍,這是用設定開啟,不是靠買高階方案,也不另外收費。這一點我覺得就是好。
價目裡沒有做成「要守住資料就去簽高階約」那種階梯。**沒有把法遵需求,變成付得起的公司才有的福利。**看起來像小事,直接影響內部簽核好不好過。
要注意的有兩點。其一,ZDR是以團隊為單位,沒辦法針對單一API金鑰分別開啟12。其二,Grok Build走API金鑰的使用會遵守ZDR,但若ZDR是關閉的,就必須用CLI的/privacy指令把資料留存停掉12。不是預設全部停,導入時要親手碰一次。
不過,這裡也不是雙手贊成就能寫完的故事。**2026年7月有報導指出,Grok Build把整個程式庫上傳到xAI的儲存,當時的隱私設定並未如預期運作。**SpaceXAI的說明是,Grok Build自提供以來就完全尊重ZDR,CLI隨時可以關閉上傳,那個選擇也一直被尊重13。**事實關係仍有出入。**本文不判定哪一邊正確。
實務上的教訓很清楚。**政策寫得好,與實作真的照那樣動,是兩件事。**我們把Grok Build當主力是事實,但會依資料的性質拆開用。這一段應該自己確認行為再判斷。同樣結構的故事,我寫在租戶隔離為什麼會「後來」才壞掉。
老實說,**東京區域若解開,我們的分工會單純得多。**ZDR這塊底已經在,剩下的就是所在地。比起Grok 4.7模型變好,我更在等這個。
把開放權重放在自家環境跑,這個選項本身對日本企業是現實的討論對象。把資料放進多租戶SaaS時會碰到的問題,整理在租戶隔離為什麼會「後來」才壞掉。
日本企業該怎麼面對
整理一下。
2026年8月11日Grok Bot,12日Grok 4.6。公司2月被SpaceX吸收,7月改稱SpaceXAI。馬斯克在內部說「我們必須在AI上取勝」,並提出2027年底AI算力10GW、AI將佔SpaceX價值99%的展望。
廠商公開表裡10項中3項是最高分。不過第三方的Artificial Analysis Intelligence Index也已經來到61,與GPT-5.6 Sol同分,距首位Claude Opus 5差2分。而且是沒有把模型做大、靠後訓練拿下5分。弱點是Terminal-Bench與日文生成,前者正好疊在新產品的主戰場上。
然後價格按兵不動,輸入2美元、輸出6美元。同一個分數帶裡最便宜,比低1分的Kimi K3(輸入3美元、輸出15美元)輸出還不到一半。性能往上走、價格不動的實質降價,我認為是這次最重的一手。
實務上怎麼做。**不要把模型鎖死成一個。**以目前來說,我覺得這是答案。一個月名次就能動成這樣的市場,按特定模型去深做,下一次更新就要重做。提示詞與評測,都用換得掉模型的形狀來持有。
再來,**先決定自家業務要量什麼。**這張表裡也一樣,GDPVal、Briefcase、法務強的模型,跟終端機作業強的模型不是同一個。**基準測試的綜合分,跟自家用途幾乎無關。**哪怕只切出20件實際任務,讓候選模型解同一組題。那才是唯一像樣的比較。
老實說,這個領域光追就耗神。一個月換一代,再過幾週Grok 4.7預告要以2.1兆參數推出1。全部持續評下去是不可能的。所以,追的對象不要放在「模型」,放在「自家怎麼量」,比較撐得住。
我們現在的位置再寫一次:**主力是Grok Build,日文最終成品與長時間自主作業用其他模型補。**若Grok 4.7把日文改善了,這套分工也許就不必了。我帶著期待在等。
還有一件容易忘的:**選用的軸,不只是基準測試的分數。**影像、聲音、影片能不能在同一個地方做,分數表上哪兒都看不到,卻決定合約與維運的條數。你是做什麼的公司,該看的欄位就不一樣。
對日本企業,還有**比分數更早生效的一欄。能不能在東京區域跑。**Grok目前對不上。合約寫著「資料留在國內」的案子,性能與價格根本進不了討論。這一欄該最先看。放到最後看,全部重來。
想討論AI運用的設計、哪個模型放在哪裡,WARP的想法或許有幫助。若要針對具體情況談,歡迎從這裡聯絡。
Footnotes
-
Grok 4.6於2026年8月12日公開。參數數1.5兆,與Grok 4.5同一個V9基底,改善據稱為後訓練(監督式微調及強化學習),而非靠規模擴大。重點放在長時間運作的代理,以及互動、視覺作業。更大的2.1兆參數Grok 4.7預告將在數週後接續推出。官方發布見 https://x.ai/news/grok-4-6 (本文撰寫時,我方存取遭Cloudflare阻擋,內容依引用該發布的二手資料確認)https://kie.ai/blog/what-is-grok-4-6 / https://www.buildfastwithai.com/blogs/grok-4-6-preview ↩ ↩2 ↩3 ↩4
-
Grok Bot於2026年8月11日進入測試版。據稱為一組常時運作的AI代理,擁有專屬雲端環境,登入客戶既有工具,在無人監督下完成多階段作業。除Mac、iOS外,亦提供Windows、Linux桌面版,Android稍後。內含於既有高階訂閱(SuperGrok Heavy等)。https://www.unite.ai/xai-launches-grok-bot-always-on-ai-teammates-with-their-own-cloud-computers/ / Grok Build是寫程式的代理,在專案資料夾內以命令列工具運作,對程式庫以自然語言下指令。先以早期測試提供給SuperGrok Heavy訂戶。https://www.eweek.com/news/xai-grok-build-coding-agent/ ↩ ↩2 ↩3
-
Grok Build的發布紀錄。2026年7月28日Build Mode早期測試,2026年8月7日v1.0.0(儀表板及CLI修正)。https://releasebot.io/updates/xai ↩ ↩2 ↩3
-
2026年2月2日,SpaceX以全股票交換收購xAI,xAI成為SpaceX全資子公司(xAI每股換0.1433股SpaceX股)。2026年5月xAI作為獨立公司解散,AI部門改稱SpaceXAI。2026年7月6日新名稱與標誌在X公開。合併後的公司包含SpaceX、xAI、X。https://finance.yahoo.com/technology/ai/articles/xai-makes-rebrand-spacexai-complete-215010760.html / https://www.socialmediatoday.com/news/spacex-rebrands-as-spacexai/824656/ ↩
-
本文參照的基準測試比較表,由SpaceXAI公開。該表註腳寫著「Third-party model scores best of self-reported or publicly available.(第三方模型的分數取自行公布值或公開值之中較佳者)」。必須以廠商自己做的比較為前提來讀。本文為此並記第三方指標Artificial Analysis Intelligence Index。 ↩
-
Artificial Analysis Intelligence Index v4.1.1。由GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR共9項合成。刊出的主要分數為Claude Opus 5(max)63、Claude Fable 5(含備援)62、GPT-5.6 Sol(max)61、Grok 4.6(high)61、Kimi K3(max)60、Qwen3.8 Max 58、Muse Spark 1.2(xhigh)57、GPT-5.6 Terra(max)57、Grok 4.5(high)56、Claude Sonnet 5(max)55、GLM-5.2(max)53、GPT-5.6 Luna(max)52、DeepSeek V4 Flash 0731(max)52、Gemini 3.6 Flash 52、MiniMax-M3 45、MiMo-V2.5-Pro 43、Inkling 42、Nemotron 3 Ultra 38、Gemini 3.5 Flash-Lite 37、Muse Glimmer(high)35、Mistral Medium 3.5 30、Gemma 4 31B 30。https://artificialanalysis.ai/ ↩ ↩2
-
SpaceX全員會議上Elon Musk的發言。約29分鐘影像發在SpaceX的X帳號。「we must win on AI, because the future is overwhelmingly AI and robots」、AI營收將「大概在9月」超過其他所有事業線並於第四季再拉開的展望、2027年底AI算力瞄準10吉瓦、「if we bring 10GW of AI online by the end of next year, it will be $300 billion to $500 billion a year in revenue」、「Probably in four or five years, AI will be 99% of the value of SpaceX」,以及這筆營收成為Starship與火星計畫本錢、並穿過Tesla、SpaceX、xAI共同晶片廠Terafab的記述,均出自該報導。https://www.teslarati.com/spacexs-next-trillion-dollar-bet-has-nothing-to-do-with-rockets-musk-tells-staff/ / 本文撰寫時,這些仍是目標與展望,並非已達成的實績。 ↩ ↩2 ↩3 ↩4 ↩5
-
Grok 4.6的API價格為每百萬token輸入2.00美元、輸出6.00美元。與前一代Grok 4.5(2026年7月8日公開)同額、未調漲,xAI將此定位為「half the price of other frontier models(其他前沿模型的半價)」。https://www.basenor.com/blogs/news/xai-launches-grok-4-6-1753-elo-half-the-price-of-rival-frontier-models / 上下文長度50萬token。提示達20萬token以上,輸入4.00美元、輸出12.00美元,價格翻倍。網頁搜尋、X搜尋、程式執行各按每1,000次5.00美元另計,collection搜尋每1,000次2.50美元。消費端SuperGrok Heavy月費300美元、SuperGrok 30美元、SuperGrok Lite 10美元。快取輸入的折扣率,來源分別寫0.30美元(減85%)與0.50美元(減75%),本文不當作確定值。https://benchlm.ai/xai/api-pricing / https://www.aipricing.guru/xai-pricing/ ↩ ↩2 ↩3
-
DeepSeek-V4-Flash每百萬token輸入0.14美元、輸出0.28美元。DeepSeek-V4-Pro輸入0.435美元、輸出0.87美元。Kimi K2.6為0.95美元/4.00美元,256K上下文,SWE-bench Verified 80.2%,開放權重。Kimi K3為3美元/15美元。SWE-bench Verified從80.2%到80.6%的帶裡,DeepSeek V4 Pro Max、Gemini 3.1 Pro、MiniMax M3、Qwen3.7 Max、Kimi K2.6五個模型並列,這個帶的輸出價格從每百萬token 2.40美元(MiniMax M3)到12美元(Gemini 3.1 Pro)拉開。DeepSeek V4 Pro Max以開放權重提供。https://deepseek.ai/pricing / https://benchlm.ai/moonshot/api-pricing / https://www.morphllm.com/llm-api ↩ ↩2 ↩3
-
Grok Imagine是負責影像與影片生成的模型群。影像一張0.02美元(高速),品質優先級距1K為0.05美元、2K為0.07美元。影片(1.0及1.5)可產出1秒到15秒、最高1080p的片段,並在同一路徑生成聲音。API價格480p每秒0.05美元、720p每秒0.07美元,同一路徑生成聲音則每秒0.08美元(音樂、音效、對白不經另開語音處理,在同一次生成內完成)。Grok Imagine Video 1.5支援文字生成影片、影像生成影片、參考影像生成影片,文字及影像的生成支援原生1080p。https://www.aipricing.guru/xai-pricing/ / https://felloai.com/grok-imagine-video-generation/ / https://invideo.io/blog/grok-imagine-ai-generator/ / 本文撰寫時,Anthropic的Claude未提供影像、聲音、影片的生成功能。 ↩ ↩2 ↩3
-
Amazon Bedrock上xAI模型的提供情況。2026年6月Grok 4.3於Amazon Bedrock開始提供,2026年7月亦於AWS GovCloud(US-West)開始提供。支援區域內推論的是美國西部(奧勒岡)、美國東部(維吉尼亞北部)、美國東部(俄亥俄),本文撰寫時亞太(東京,ap-northeast-1)不在其中。Bedrock上提供的是Grok 4.3,不是2026年8月12日公開的Grok 4.6。資料留存方面,AWS表示僅指定
store=false並不保證零留存,要確定為零的持久留存,有效的資料留存模式必須是none,且該模型必須允許這個模式。https://aws.amazon.com/about-aws/whats-new/2026/06/grok-amazon-bedrock/ / https://aws.amazon.com/about-aws/whats-new/2026/07/grok-4-3-bedrock-govcloud/ / https://docs.aws.amazon.com/bedrock/latest/userguide/models-regions.html / https://www.techi.com/grok-bedrock-portability-retention-regions/ ↩ ↩2 ↩3 -
xAI關於資料留存的規格。預設下API的請求及回應為稽核目的在伺服器保存30天(靜態加密),不以該資料訓練,30天後自動刪除。開啟ZDR(Zero Data Retention)後,API請求的輸入(提示)及輸出(生成的token)不會持久化到磁碟。ZDR是以團隊為單位的設定,無法只對特定API金鑰開啟。https://docs.x.ai/developers/faq/security / ZDR能以設定開啟、不另外收費,是本文撰寫時就我方確認範圍所做的記述。另xAI官方帳號說明「For teams using zero data retention, no trace and code data is ever retained. All API key use of Grok Build also respects ZDR. If ZDR is disabled, the /privacy command is available in the CLI to disable data retention, which also deletes previously synced data.」https://x.com/SpaceXAI/status/2076692402442846289 ↩ ↩2 ↩3 ↩4
-
2026年7月,有報導指出Grok Build不只上傳讀過的檔案,而是把整個Git儲存庫上傳到xAI的儲存,當時的隱私設定並未如預期運作。https://thehackernews.com/2026/07/grok-build-uploads-entire-git.html / https://www.techtimes.com/articles/320420/20260714/grok-build-shipped-entire-codebases-xai-cloud-privacy-toggle-did-nothing.htm / 對此SpaceXAI說明,Grok Build自提供以來就完全尊重ZDR,使用者隨時可用CLI關閉資料上傳,該選擇也一直被尊重。https://x.com/SpaceXAI/status/2077494536788664782 / 事實關係雙方說明仍有出入,本文不判定哪一邊正確。 ↩






