馬斯克的AI助手,也開始請Claude來幹活了!
10月7日,馬斯克在X上宣布,Grok Bot將根據具體任務選用最合適的後端模型,並直接點名Claude Opus 5.5、Midjourney和Suno。
他給出的標準簡單直接:
哪個最有可能給你帶來最好的結果,就用哪個。
誰好用,就用誰。
網友ExiledonMoon調侃,連馬斯克的AI助手,也開始找Claude幫忙幹活了。
另一位網友Token Maxxer則提醒:馬斯克列出的名單還包括「其他領先的API」。OpenAI只是沒有被點名,並未被明確排除。
這也留下了一個懸念:OpenAI的模型,會不會也成為Grok Bot的外援?
至少,Claude已經開始上崗。
據9to5Mac同日報道,Grok Bot已經可以使用Claude Opus 5.5。
你把任務交給馬斯克的AI助手,背後幹活的可能是Claude。
一邊與Anthropic爭奪用戶,一邊調用Claude,馬斯克為什麼願意這樣做?
借對手的模型爭取自己的用戶
從馬斯克強調的「最佳結果」來看,他考慮得很實際:
先讓Grok Bot把用戶的活幹好,不必讓自家模型包辦所有環節。
如果某項任務借助Claude能做得更好,接入它,就有機會減少用戶因體驗不佳而轉向其他產品的情況。
更關鍵的是,即便背後幹活的是Claude,用戶交代需求、連接工具、跟進任務的地方,仍然可以是Grok Bot。
Anthropic提供部分模型能力,Grok Bot負責組織這些能力、交付結果。只要任務完成得好,用戶就有理由繼續使用這個助手。
因此,調用對手的模型,也可以成為爭取用戶的一種手段。
即使部分工作由Claude完成,用戶下一次有任務,也可能先打開Grok Bot。
Grok Bot想接下的是一整件事
馬斯克此次提到的Grok Bot,在8月11日推出Beta版。
這款智能助手自帶雲電腦,可以在上面替用戶執行任務。
按照官方介紹,Bot可以使用工具、登錄應用、跨軟件處理工作;多個Bot還能相互溝通、分享任務背景,分工協作。
用戶離開電腦後,工作也能繼續。
多個Grok Bot交接任務、匯報進展。
此次馬斯克提到了Grok Bot,不等於X上的Grok聊天功能也要全面換用Claude。
除了Claude,名單中還有圖像生成工具Midjourney和音樂生成工具Suno,橫跨了文字、圖像和音樂,對應的是一個很實際的需求:完成一整件事,往往需要幾種能力配合。
比如做一條短視頻,要寫文案、準備封面,還要配上一段音樂。
找幾個AI幫忙,素材可能很快就有了。但解釋要求、搬運文件、協調修改,往往還得你在不同窗口之間來回處理。
如果Grok Bot能根據任務調用合適的模型,把這些環節銜接起來,就有機會替你接下部分協調工作。
用戶想要的很簡單:少在幾個模型和工具之間來回切換,同一個需求不用解釋好幾遍。
連選哪個模型也想替你省了
模型接得越多,會不會反而讓用戶犯起「選擇困難症」?
打開助手,還得先想一遍:寫程式該用Claude還是Grok?做圖又該換哪個工具?
Grok Bot的官方文件,已經給出了設計思路:
模型選擇由平台管理,沒有面向使用者的模型選擇選單,實際使用的模型組合也可能隨時間變化。
換句話說,你交代任務,系統替你選模型。
你不必為了寫一段程式,先研究誰最近升級了;也不用為了做一張圖,翻遍各家工具的能力清單。
不過,這不代表使用者不需要知道用了什麼、花了多少。
官方文件提到,用量分析會顯示實際用了哪個模型,費用也按所用模型計算。
這些資訊能幫助使用者了解錢花在哪裡,判斷這次任務是否划算。
讓AI選模型到底靠不靠譜?
把選擇交給系統之後,問題來了:讓AI替人選模型,有什麼優勢,這樣的選擇又靠不靠譜?
讓一個模型給其他模型分配工作,已經有了先例。
早在2023年,HuggingGPT就嘗試讓ChatGPT拆解使用者任務,根據Hugging Face上的模型介紹挑選合適的模型,再由系統呼叫這些模型執行任務、彙總結果。
OpenAI最近開放公測的Decisions API,也為這類選擇提供了工具。
開發者給出任務資訊和候選選項,由GPT-6 Luna返回判斷,再讓應用根據判斷執行下一步。
用在多模型助手裡,它就可以輔助決定:當前任務該交給哪個模型。
自動選擇的優勢,尤其體現在一項工作需要反覆呼叫模型的時候。
簡單的資訊整理、複雜的推理、最後的文字潤色,對模型能力的要求並不一樣。系統如果能逐步判斷,就有機會把更強、更貴的模型用在真正需要它的環節。
這類做法,已有研究驗證了成本上的收益。
2024年的RouteLLM研究顯示,在MT-Bench評測中,透過在GPT-4和Mixtral之間分配請求,系統可以在達到約95%的GPT-4評測表現時,相比全部使用GPT-4降低超過85%的成本。
RouteLLM在MT-Bench中的模型分配效果。
但這項結果比較的是自動分配與固定使用GPT-4,不能完全證明AI比人更會選模型,也不能等同於Grok Bot的實測成績,Grok Bot具體如何選擇模型,還需要更多公開資訊才能判斷。
而且,「合適」沒有一個適用於所有人的答案。
有人趕時間,有人想省錢,也有人願意多花一些時間和費用,換取更好的結果。同樣是生成圖片,一張臨時配圖和一組能直接發布的海報,完成標準就不一樣。
AI助手得先弄清這些要求,再決定呼叫哪些能力。否則,模型再強,也可能做不出使用者想要的結果。
對使用者來說,自動選擇到底能不能省心,還得把檢查、修改和返工的時間一起算進去。
誰能成為使用者的第一選擇?
這場競爭裡,還有剛剛推出Dots的OpenAI。
9月29日,OpenAI發布全天候智慧體Dots,同樣自帶雲端電腦,可以連接應用,在使用者離開後繼續推進工作。
Dots根據新要求修改發布素材。
它與Grok Bot爭奪的,是同一個機會:成為使用者願意長期把任務交給它的AI助手。
但助手之間的競爭,也可能與模型呼叫上的合作同時存在。
假如未來Grok Bot接入OpenAI模型,使用者就可能把任務交給馬斯克的助手,再由OpenAI的模型完成其中一部分工作。OpenAI提供模型能力,兩家的助手仍然繼續爭取使用者。
目前,這還只是可能性。馬斯克此次明確點名了Claude,尚未確認是否接入OpenAI模型。
當不同助手有機會呼叫相近甚至相同的模型,誰更理解使用者、誰能接著完成上一次的工作,就可能成為影響選擇的關鍵。
如果一個助手已經知道你的文案偏好、圖片風格,也能找到之前的檔案,下一次有任務時,你自然更容易先想到它。
換用其他助手,則可能意味著重新交代背景、連接工具,再磨合一遍工作方式。
接入Claude,為Grok Bot增加了可呼叫的模型能力。
接下來,這些能力還要轉化成使用者能感受到的好處:
需求變了,能不能接著改;工作做到一半,能不能繼續推進;交來的結果,還需要使用者花多少功夫來收尾……
這些體驗,都會影響到使用者下一次把任務交給誰。
參考資料:
https://x.com/testingcatalog/status/2107803665457189061
https://x.com/elonmusk/status/2107724314451878104
https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot
https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com
本文來自微信公眾號 「新智元」(ID:AI_era),作者:ASI啟示錄;編輯:元宇












