Asystent AI Muska również zaczął zatrudniać Claude'a do pracy!
7 października Musk ogłosił na X, że Grok Bot wybierze najbardziej odpowiedni model backendowy na podstawie konkretnego zadania, i bezpośrednio wymienił Claude Opus 5.5, Midjourney i Suno.
Podane przez niego kryterium było proste i bezpośrednie:
Którykolwiek najprawdopodobniej przyniesie ci najlepszy wynik, użyj tego.
Ktokolwiek działa dobrze, użyj go.
Internauta ExiledonMoon zażartował, że nawet asystent AI Muska zaczął prosić Claude'a o pomoc w pracy.
Inny internauta, Token Maxxer, przypomniał: lista podana przez Muska obejmuje również "inne wiodące API". OpenAI po prostu nie zostało wymienione i nie zostało wyraźnie wykluczone.
To również pozostawia suspens: czy modele OpenAI również staną się zewnętrznym wsparciem dla Grok Bot?
Przynajmniej Claude już zaczął pracę.
Według raportu 9to5Mac z tego samego dnia, Grok Bot może już używać Claude Opus 5.5.
Przekazujesz zadanie asystentowi AI Muska, a tym, kto wykonuje pracę za kulisami, może być Claude.
Konkurując z Anthropic o użytkowników, jednocześnie wzywa Claude'a. Dlaczego Musk jest skłonny to zrobić?
Pożyczanie modelu rywala, aby pozyskać jego własnych użytkowników
Sądząc po "najlepszym wyniku", który podkreślił Musk, jego myślenie jest bardzo praktyczne:
Najpierw pozwól Grok Bot dobrze wykonać pracę użytkownika; nie ma potrzeby, aby jego własny model obsługiwał każdą część.
Jeśli pewne zadanie można lepiej wykonać za pomocą Claude'a, to zintegrowanie go może pomóc zmniejszyć szanse, że użytkownicy zwrócą się do innych produktów z powodu złego doświadczenia.
Co bardziej krytyczne, nawet jeśli tym, kto wykonuje pracę za kulisami, jest Claude, miejsce, w którym użytkownicy zgłaszają swoje potrzeby, łączą narzędzia i śledzą zadania, nadal może być Grok Bot.
Anthropic zapewnia część możliwości modelu, podczas gdy Grok Bot odpowiada za organizację tych możliwości i dostarczanie wyników. Dopóki zadanie jest dobrze wykonane, użytkownicy mają powód, aby nadal korzystać z tego asystenta.
Dlatego wywoływanie modelu rywala może również stać się środkiem do pozyskiwania użytkowników.
Nawet jeśli część pracy zostanie wykonana przez Claude'a, następnym razem, gdy użytkownicy będą mieli zadanie, mogą nadal najpierw otworzyć Grok Bot.
To, co Grok Bot chce podjąć, to całość
Wspomniany przez Muska Grok Bot uruchomił wersję Beta 11 sierpnia.
Ten inteligentny asystent jest wyposażony w chmurę komputerową, na której może wykonywać zadania dla użytkowników.
Zgodnie z oficjalnym wprowadzeniem, Bot może używać narzędzi, logować się do aplikacji i obsługiwać pracę w różnych programach; wiele Botów może również komunikować się ze sobą, dzielić kontekst zadania oraz dzielić pracę i współpracować.
Po tym, jak użytkownik odejdzie od komputera, praca może być kontynuowana.
Wiele Grok Botów przekazuje sobie zadania i raportuje postępy.
To, że Musk tym razem wspomniał o Grok Bot, nie oznacza, że funkcja czatu Grok na X również całkowicie przełączy się na Claude.
Oprócz Claude, lista obejmuje również narzędzie do generowania obrazów Midjourney i narzędzie do generowania muzyki Suno, obejmując tekst, obrazy i muzykę, co odpowiada bardzo praktycznej potrzebie: ukończenie całej rzeczy często wymaga współpracy kilku zdolności.
Na przykład, aby zrobić krótki film, musisz napisać scenariusz, przygotować okładkę, a także dodać utwór muzyczny.
Poproś kilka AI o pomoc, a materiały mogą być gotowe bardzo szybko. Ale wyjaśnianie wymagań, przenoszenie plików i koordynowanie poprawek często wciąż wymaga od ciebie przechodzenia tam i z powrotem między różnymi oknami.
Jeśli Grok Bot może wywołać odpowiedni model zgodnie z zadaniem i połączyć te kroki, ma szansę przejąć część pracy koordynacyjnej za ciebie.
To, czego chcą użytkownicy, jest bardzo proste: mniej przełączania się tam i z powrotem między kilkoma modelami i narzędziami oraz niekoniecznie wyjaśnianie tej samej potrzeby kilka razy.
Chce nawet oszczędzić ci wyboru, którego modelu użyć
Im więcej modeli podłączy, czy zamiast tego da użytkownikom „trudność wyboru”?
Otwierając asystenta, wciąż musisz najpierw przemyśleć: czy do pisania kodu powinienem użyć Claude czy Grok? A na które narzędzie powinienem się przełączyć, aby zrobić obrazy?
Oficjalna dokumentacja Grok Bot już przedstawiła podejście do projektu:
Wybór modelu jest zarządzany przez platformę, nie ma widocznego dla użytkownika menu wyboru modelu, a rzeczywista kombinacja używanych modeli może zmieniać się w czasie.
Innymi słowy, przydzielasz zadanie, a system wybiera dla ciebie model.
Nie musisz badać, kto niedawno się zaktualizował, tylko po to, by napisać fragment kodu; ani nie musisz przeglądać list możliwości różnych narzędzi tylko po to, by zrobić obraz.
Jednak nie oznacza to, że użytkownicy nie muszą wiedzieć, co zostało użyte i ile wydano.
Oficjalna dokumentacja wspomina, że analityka użycia pokaże, który model został faktycznie użyty, a koszty są obliczane na podstawie użytego modelu.
Te informacje mogą pomóc użytkownikom zrozumieć, gdzie idą ich pieniądze, i ocenić, czy zadanie było tego warte.
Czy pozwolenie AI na wybieranie modeli jest naprawdę niezawodne?
Po przekazaniu wyboru systemowi pojawia się pytanie: jakie zalety ma pozwolenie AI na wybieranie modeli za ludzi i czy taki wybór jest niezawodny?
To, że jeden model przydziela pracę innym modelom, ma już precedensy.
Już w 2023 roku HuggingGPT próbował sprawić, by ChatGPT rozkładał zadania użytkownika, wybierał odpowiednie modele na podstawie opisów modeli na Hugging Face, a następnie system wywoływał te modele do wykonania zadań i agregował wyniki.
Niedawno otwarte publiczne beta Decisions API OpenAI również zapewnia narzędzie do tego rodzaju wyboru.
Deweloperzy dostarczają informacje o zadaniu i opcje kandydujące, GPT-6 Luna zwraca osąd, a następnie aplikacja wykonuje następny krok na podstawie tego osądu.
Używany w asystencie wielomodelowym, może pomóc zdecydować: któremu modelowi należy przekazać bieżące zadanie.
Zaleta automatycznego wyboru jest szczególnie widoczna, gdy zadanie wymaga wielokrotnego wywoływania modeli.
Prosta organizacja informacji, złożone rozumowanie i końcowe dopracowanie tekstu mają różne wymagania dotyczące możliwości modeli. Jeśli system może oceniać krok po kroku, ma szansę użyć silniejszych, droższych modeli tylko na etapach, które naprawdę ich potrzebują.
Ten rodzaj podejścia został już potwierdzony przez badania pod względem korzyści kosztowych.
Badanie RouteLLM z 2024 roku wykazało, że w ocenie MT-Bench, rozdzielając żądania między GPT-4 i Mixtral, system mógł osiągnąć około 95% wydajności oceny GPT-4, jednocześnie zmniejszając koszty o ponad 85% w porównaniu z używaniem wyłącznie GPT-4.
Wydajność alokacji modeli RouteLLM w MT-Bench.
Ale ten wynik porównuje automatyczną alokację ze stałym używaniem GPT-4; nie może w pełni udowodnić, że AI lepiej wybiera modele niż ludzie, ani nie można go utożsamiać z rzeczywistymi wynikami testów Grok Bot. Jak Grok Bot konkretnie wybiera modele, wciąż wymaga więcej publicznych informacji, aby to ocenić.
Co więcej, „odpowiedni” nie ma odpowiedzi, która pasuje do wszystkich.
Niektórzy się spieszą, niektórzy chcą oszczędzać pieniądze, a niektórzy są gotowi poświęcić więcej czasu i pieniędzy w zamian za lepsze wyniki. Nawet w przypadku generowania obrazów, tymczasowa ilustracja i zestaw plakatów gotowych do bezpośredniej publikacji mają różne standardy ukończenia.
Asystent AI musi najpierw zrozumieć te wymagania, zanim zdecyduje, które możliwości wywołać. W przeciwnym razie, niezależnie od tego, jak silny jest model, może nadal nie wygenerować wyniku, którego chce użytkownik.
Dla użytkowników, czy automatyczny wybór naprawdę może ich odciążyć, wciąż trzeba uwzględnić czas spędzony na sprawdzaniu, poprawianiu i ponownym wykonywaniu pracy.
Kto może stać się pierwszym wyborem użytkownika?
W tej konkurencji jest także OpenAI, które właśnie uruchomiło Dots.
29 września OpenAI wydało całodobowego agenta Dots, który również jest wyposażony w komputer w chmurze, może łączyć się z aplikacjami i może kontynuować pracę po odejściu użytkownika.
Dots modyfikuje materiały do publikacji zgodnie z nowymi wymaganiami.
To, o co konkuruje z Grok Bot, to ta sama szansa: stać się asystentem AI, któremu użytkownicy są gotowi powierzać zadania w długim okresie.
Ale konkurencja między asystentami może również współistnieć ze współpracą w wywoływaniu modeli.
Jeśli w przyszłości Grok Bot połączy się z modelami OpenAI, użytkownicy mogą przekazywać zadania asystentowi Muska, a następnie modele OpenAI wykonają część pracy. OpenAI dostarcza możliwości modeli, podczas gdy asystenci obu firm nadal konkurują o użytkowników.
Obecnie to wciąż tylko możliwość. Musk tym razem wyraźnie wymienił Claude i nie potwierdzono jeszcze, czy modele OpenAI zostaną podłączone.
Kiedy różni asystenci mają możliwość wywoływania podobnych, a nawet tych samych modeli, kto lepiej rozumie użytkownika i kto może kontynuować od ostatniego zadania, może stać się kluczowymi czynnikami wpływającymi na wybór.
Jeśli asystent już zna twoje preferencje dotyczące copywritingu i styl obrazu, a także może znaleźć poprzednie pliki, to następnym razem, gdy będziesz mieć zadanie, naturalnie pomyślisz o nim najpierw.
Przejście do innego asystenta może oznaczać ponowne wyjaśnienie tła, ponowne połączenie narzędzi i ponowne przechodzenie przez docieranie się stylu pracy.
Połączenie z Claude dodaje Grok Bot możliwości wywoływania modeli.
Następnie te możliwości wciąż muszą przełożyć się na korzyści, które użytkownicy mogą odczuć:
Jeśli wymagania się zmienią, czy można je dalej poprawiać? Jeśli praca jest w połowie gotowa, czy można kontynuować jej rozwijanie? Przy dostarczonych wynikach, ile wysiłku użytkownik musi jeszcze włożyć, aby je dokończyć...
Te doświadczenia wpłyną na to, komu użytkownik powierzy następne zadanie.
Materiały referencyjne:
https://x.com/testingcatalog/status/2107803665457189061
https://x.com/elonmusk/status/2107724314451878104
https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot
https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com
Ten artykuł pochodzi z publicznego konta WeChat „Xin Zhi Yuan” (ID: AI_era), autor: ASI Revelation; redaktor: Yuan Yu












