Musk intègre Claude à Grok Bot : le meilleur outil, c'est celui qui marche

Grok BotAgent IAClaudeOpenAIRoutage multi-modèlesMusk
il y a 1 heureSource: blockweeks.com
Musk intègre Claude à Grok Bot : le meilleur outil, c'est celui qui marche

L'assistant IA de Musk a aussi commencé à embaucher Claude pour faire le travail !

Le 7 octobre, Musk a annoncé sur X que Grok Bot sélectionnera le modèle backend le plus approprié en fonction de la tâche spécifique, et a directement nommé Claude Opus 5.5, Midjourney et Suno.

Grok Bot

Le critère qu'il a donné était simple et direct :

Celui qui est le plus susceptible de vous apporter le meilleur résultat, utilisez-le.

Celui qui fonctionne bien, utilisez-le.

Grok Bot

L'internaute ExiledonMoon a plaisanté en disant que même l'assistant IA de Musk a commencé à demander de l'aide à Claude pour le travail.

Un autre internaute, Token Maxxer, a rappelé : la liste donnée par Musk inclut aussi « d'autres API de premier plan ». OpenAI n'a simplement pas été nommé, et n'a pas été explicitement exclu.

Cela laisse également un suspense : les modèles d'OpenAI deviendront-ils aussi des renforts externes pour Grok Bot ?

Au moins, Claude a déjà commencé le travail.

Selon un rapport du même jour de 9to5Mac, Grok Bot peut déjà utiliser Claude Opus 5.5.

Grok Bot

Vous confiez la tâche à l'assistant IA de Musk, et celui qui fait le travail en coulisses pourrait bien être Claude.

Alors qu'il rivalise avec Anthropic pour les utilisateurs, il fait aussi appel à Claude. Pourquoi Musk est-il prêt à faire cela ?

Emprunter le modèle d'un rival pour conquérir ses propres utilisateurs

À en juger par le « meilleur résultat » que Musk a souligné, sa réflexion est très pragmatique :

Laissez d'abord Grok Bot bien faire le travail de l'utilisateur ; il n'est pas nécessaire que son propre modèle gère chaque partie.

Si une certaine tâche peut être mieux accomplie avec Claude, alors l'intégrer peut aider à réduire les chances que les utilisateurs se tournent vers d'autres produits en raison d'une mauvaise expérience.

Plus crucial encore, même si celui qui fait le travail en coulisses est Claude, l'endroit où les utilisateurs expriment leurs besoins, connectent des outils et suivent les tâches peut toujours être Grok Bot.

Anthropic fournit une partie de la capacité du modèle, tandis que Grok Bot est responsable d'organiser ces capacités et de livrer les résultats. Tant que la tâche est bien accomplie, les utilisateurs ont une raison de continuer à utiliser cet assistant.

Par conséquent, appeler le modèle d'un rival peut aussi devenir un moyen de gagner des utilisateurs.

Même si une partie du travail est accomplie par Claude, la prochaine fois que les utilisateurs auront une tâche, ils pourraient encore ouvrir Grok Bot en premier.

Ce que Grok Bot veut prendre en charge, c'est l'ensemble

Le Grok Bot mentionné par Musk cette fois a lancé sa version Beta le 11 août.

Cet assistant intelligent est livré avec un ordinateur cloud, sur lequel il peut exécuter des tâches pour les utilisateurs.

Selon la présentation officielle, Bot peut utiliser des outils, se connecter à des applications et gérer le travail à travers les logiciels ; plusieurs Bots peuvent également communiquer entre eux, partager le contexte des tâches et répartir le travail et collaborer.

Une fois que l'utilisateur quitte l'ordinateur, le travail peut continuer.

Grok Bot

Plusieurs Grok Bots se transmettent des tâches et signalent leur progression.

Le fait que Musk mentionne Grok Bot cette fois ne signifie pas que la fonction de chat Grok sur X basculera également entièrement vers Claude.

Outre Claude, la liste comprend également l'outil de génération d'images Midjourney et l'outil de génération de musique Suno, couvrant le texte, les images et la musique, ce qui correspond à un besoin très pratique : mener à bien une chose entière nécessite souvent la collaboration de plusieurs capacités.

Par exemple, pour réaliser une courte vidéo, il faut écrire le scénario, préparer la couverture et aussi ajouter une musique.

Demandez de l'aide à quelques IA, et les matériaux peuvent être prêts très rapidement. Mais expliquer les exigences, déplacer les fichiers et coordonner les révisions vous obligent souvent encore à faire des allers-retours entre différentes fenêtres.

Si Grok Bot peut appeler le modèle approprié en fonction de la tâche et enchaîner ces étapes, il a la possibilité de prendre en charge une partie du travail de coordination pour vous.

Ce que les utilisateurs veulent est très simple : basculer moins souvent entre plusieurs modèles et outils, et ne pas avoir à expliquer plusieurs fois le même besoin.

Il veut même vous éviter de choisir quel modèle utiliser

Plus il se connecte à de modèles, cela va-t-il au contraire donner aux utilisateurs une « difficulté de choix » ?

En ouvrant un assistant, vous devez encore d'abord réfléchir : dois-je utiliser Claude ou Grok pour écrire du code ? Et vers quel outil dois-je basculer pour créer des images ?

La documentation officielle de Grok Bot a déjà exposé l'approche de conception :

La sélection du modèle est gérée par la plateforme, il n'y a pas de menu de sélection de modèle destiné à l'utilisateur, et la combinaison réelle de modèles utilisés peut changer avec le temps.

En d'autres termes, vous assignez la tâche, et le système choisit le modèle pour vous.

Vous n'avez pas à vous renseigner sur qui a été mis à jour récemment juste pour écrire un morceau de code ; ni à parcourir les listes de capacités de divers outils juste pour créer une image.

Cependant, cela ne signifie pas que les utilisateurs n'ont pas besoin de savoir ce qui a été utilisé et combien cela a coûté.

La documentation officielle mentionne que les analyses d'utilisation montreront quel modèle a été réellement utilisé, et les coûts sont calculés en fonction du modèle utilisé.

Ces informations peuvent aider les utilisateurs à comprendre où va leur argent et à juger si la tâche en valait la peine.

Laisser l'IA choisir les modèles est-il vraiment fiable ?

Après avoir confié le choix au système, la question se pose : quels avantages y a-t-il à laisser l'IA choisir les modèles pour les gens, et un tel choix est-il fiable ?

Qu'un modèle assigne du travail à d'autres modèles a déjà des précédents.

Dès 2023, HuggingGPT a tenté de faire décomposer les tâches des utilisateurs par ChatGPT, de sélectionner des modèles appropriés en fonction des descriptions de modèles sur Hugging Face, puis de faire appeler ces modèles par le système pour exécuter les tâches et agréger les résultats.

L'API Decisions, récemment ouverte en bêta publique par OpenAI, fournit également un outil pour ce type de sélection.

Grok Bot

Les développeurs fournissent les informations sur la tâche et les options candidates, GPT-6 Luna renvoie un jugement, puis l'application exécute l'étape suivante en fonction de ce jugement.

Utilisé dans un assistant multi-modèles, il peut aider à décider : à quel modèle la tâche actuelle doit être confiée.

L'avantage de la sélection automatique est particulièrement évident lorsqu'une tâche nécessite d'appeler répétitivement des modèles.

L'organisation simple d'informations, le raisonnement complexe et la finalisation du texte ont des exigences différentes en matière de capacités des modèles. Si le système peut juger étape par étape, il a la possibilité d'utiliser des modèles plus puissants et plus coûteux uniquement dans les étapes qui en ont vraiment besoin.

Ce type d'approche a déjà été validé par la recherche pour ses avantages en termes de coûts.

L'étude RouteLLM de 2024 a montré que dans l'évaluation MT-Bench, en répartissant les requêtes entre GPT-4 et Mixtral, le système pouvait atteindre environ 95 % des performances d'évaluation de GPT-4 tout en réduisant les coûts de plus de 85 % par rapport à l'utilisation entièrement de GPT-4.

Grok Bot

Performance d'allocation des modèles de RouteLLM dans MT-Bench.

Mais ce résultat compare l'allocation automatique avec l'utilisation fixe de GPT-4 ; il ne peut pas prouver pleinement que l'IA est meilleure que les humains pour choisir les modèles, ni être assimilé aux résultats de test réels de Grok Bot. La manière dont Grok Bot choisit spécifiquement les modèles nécessite encore plus d'informations publiques pour être jugée.

De plus, « approprié » n'a pas de réponse qui s'applique à tout le monde.

Certaines personnes sont pressées, d'autres veulent économiser de l'argent, et d'autres encore sont prêtes à consacrer plus de temps et d'argent en échange de meilleurs résultats. Même pour générer des images, une illustration temporaire et un ensemble d'affiches prêtes à être publiées directement ont des normes d'achèvement différentes.

L'assistant IA doit d'abord comprendre ces exigences avant de décider quelles capacités invoquer. Sinon, peu importe la puissance du modèle, il peut encore échouer à produire le résultat souhaité par l'utilisateur.

Pour les utilisateurs, savoir si la sélection automatique peut vraiment leur épargner des soucis doit encore prendre en compte le temps passé à vérifier, réviser et refaire le travail.

Qui peut devenir le premier choix de l'utilisateur ?

Dans cette compétition, il y a aussi OpenAI, qui vient de lancer Dots.

Le 29 septembre, OpenAI a publié l'agent disponible 24 heures sur 24 Dots, qui est également livré avec un ordinateur cloud, peut se connecter à des applications et peut continuer à faire avancer le travail après le départ de l'utilisateur.

Grok Bot

Dots modifie les supports de publication selon les nouvelles exigences.

Ce pour quoi il rivalise avec Grok Bot est la même opportunité : devenir l'assistant IA auquel les utilisateurs sont prêts à confier des tâches sur le long terme.

Mais la concurrence entre assistants peut aussi coexister avec la coopération dans l'invocation de modèles.

Si à l'avenir Grok Bot se connecte aux modèles d'OpenAI, les utilisateurs pourraient confier des tâches à l'assistant de Musk, puis les modèles d'OpenAI accompliraient une partie du travail. OpenAI fournit des capacités de modèle, tandis que les assistants des deux entreprises continuent de se disputer les utilisateurs.

Actuellement, cela ne reste qu'une possibilité. Musk a explicitement nommé Claude cette fois, et il n'a pas encore été confirmé si les modèles d'OpenAI seront connectés.

Lorsque différents assistants ont la possibilité d'appeler des modèles similaires, voire identiques, celui qui comprend mieux l'utilisateur et qui peut reprendre à partir de la dernière tâche peuvent devenir les facteurs clés influençant le choix.

Si un assistant connaît déjà vos préférences en matière de rédaction et votre style d'image, et peut également retrouver les fichiers précédents, alors la prochaine fois que vous aurez une tâche, vous penserez naturellement à lui en premier.

Passer à un autre assistant peut signifier réexpliquer le contexte, reconnecter les outils et refaire l'apprentissage du style de travail.

La connexion à Claude ajoute à Grok Bot des capacités de modèle appelables.

Ensuite, ces capacités doivent encore se traduire en avantages que les utilisateurs peuvent ressentir :

Si les exigences changent, peut-il continuer à les réviser ? Si le travail est à moitié fait, peut-il continuer à avancer ? Pour les résultats livrés, combien d'efforts l'utilisateur doit-il encore fournir pour les finaliser...

Ces expériences affecteront toutes à qui l'utilisateur confiera la prochaine tâche.

Documents de référence :

https://x.com/testingcatalog/status/2107803665457189061

https://x.com/elonmusk/status/2107724314451878104

https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot

https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com

Cet article provient du compte public WeChat « Xin Zhi Yuan » (ID : AI_era), auteur : ASI Revelation ; éditeur : Yuan Yu