O assistente de IA de Musk também começou a contratar Claude para fazer o trabalho!
Em 7 de outubro, Musk anunciou no X que o Grok Bot selecionará o modelo de backend mais adequado com base na tarefa específica, e nomeou diretamente Claude Opus 5.5, Midjourney e Suno.
O padrão que ele deu foi simples e direto:
Qualquer que seja o mais provável de trazer o melhor resultado para você, use esse.
Quem trabalha bem, use-os.
O internauta ExiledonMoon brincou que até o assistente de IA de Musk começou a pedir ajuda a Claude para fazer o trabalho.
Outro internauta, Token Maxxer, lembrou: a lista que Musk deu também inclui "outras APIs líderes". A OpenAI simplesmente não foi nomeada, e não foi explicitamente excluída.
Isso também deixa um suspense: os modelos da OpenAI também se tornarão reforços externos para o Grok Bot?
Pelo menos, Claude já começou no trabalho.
De acordo com um relatório do mesmo dia do 9to5Mac, o Grok Bot já pode usar o Claude Opus 5.5.
Você entrega a tarefa ao assistente de IA de Musk, e quem faz o trabalho nos bastidores pode ser o Claude.
Enquanto compete com a Anthropic por usuários, ele também está chamando o Claude. Por que Musk está disposto a fazer isso?
Pegar emprestado o modelo de um rival para conquistar seus próprios usuários
A julgar pelo "melhor resultado" que Musk enfatizou, seu pensamento é muito prático:
Primeiro deixe o Grok Bot fazer bem o trabalho do usuário; não há necessidade de seu próprio modelo lidar com cada parte.
Se uma certa tarefa puder ser feita melhor com o Claude, então integrá-lo pode ajudar a reduzir as chances de os usuários recorrerem a outros produtos por causa de uma experiência ruim.
Mais criticamente, mesmo que quem faça o trabalho nos bastidores seja o Claude, o lugar onde os usuários declaram suas necessidades, conectam ferramentas e acompanham tarefas ainda pode ser o Grok Bot.
A Anthropic fornece parte da capacidade do modelo, enquanto o Grok Bot é responsável por organizar essas capacidades e entregar os resultados. Contanto que a tarefa seja concluída bem, os usuários têm motivos para continuar usando este assistente.
Portanto, chamar o modelo de um rival também pode se tornar um meio de conquistar usuários.
Mesmo que parte do trabalho seja concluída pelo Claude, na próxima vez que os usuários tiverem uma tarefa, eles ainda podem abrir o Grok Bot primeiro.
O que o Grok Bot quer assumir é o todo
O Grok Bot mencionado por Musk desta vez lançou sua versão Beta em 11 de agosto.
Este assistente inteligente vem com um computador em nuvem, no qual pode executar tarefas para os usuários.
De acordo com a introdução oficial, o Bot pode usar ferramentas, fazer login em aplicativos e lidar com trabalho em vários softwares; vários Bots também podem se comunicar entre si, compartilhar o contexto da tarefa e dividir o trabalho e colaborar.
Depois que o usuário sai do computador, o trabalho pode continuar.
Vários Grok Bots transferem tarefas e relatam o progresso.
O fato de Musk mencionar o Grok Bot desta vez não significa que a função de chat do Grok no X também mudará totalmente para o Claude.
Além do Claude, a lista também inclui a ferramenta de geração de imagens Midjourney e a ferramenta de geração de música Suno, abrangendo texto, imagens e música, correspondendo a uma necessidade muito prática: concluir uma coisa inteira geralmente exige várias capacidades trabalhando juntas.
Por exemplo, para fazer um vídeo curto, você precisa escrever o roteiro, preparar a capa e também adicionar uma peça musical.
Peça ajuda a algumas IAs e os materiais podem ficar prontos muito rapidamente. Mas explicar os requisitos, mover arquivos e coordenar revisões muitas vezes ainda exige que você vá e volte entre diferentes janelas.
Se o Grok Bot puder chamar o modelo apropriado de acordo com a tarefa e conectar essas etapas, ele tem a chance de assumir parte do trabalho de coordenação para você.
O que os usuários querem é muito simples: alternar menos entre vários modelos e ferramentas e não ter que explicar a mesma necessidade várias vezes.
Ele até quer poupar você de escolher qual modelo usar
Quanto mais modelos ele conecta, será que isso, em vez disso, dá aos usuários uma "dificuldade de escolha"?
Ao abrir um assistente, você ainda precisa pensar primeiro: devo usar Claude ou Grok para escrever código? E para qual ferramenta devo mudar para fazer imagens?
A documentação oficial do Grok Bot já deixou clara a abordagem de design:
A seleção do modelo é gerenciada pela plataforma, não há menu de seleção de modelo voltado ao usuário, e a combinação real de modelos usados pode mudar com o tempo.
Em outras palavras, você atribui a tarefa e o sistema escolhe o modelo para você.
Você não precisa pesquisar quem foi atualizado recentemente só para escrever um trecho de código; nem precisa vasculhar as listas de capacidades de várias ferramentas só para fazer uma imagem.
No entanto, isso não significa que os usuários não precisem saber o que foi usado e quanto foi gasto.
A documentação oficial menciona que a análise de uso mostrará qual modelo foi realmente usado, e os custos são calculados com base no modelo utilizado.
Essas informações podem ajudar os usuários a entender para onde vai o dinheiro e julgar se a tarefa valeu a pena.
Deixar a IA escolher modelos é realmente confiável?
Depois de entregar a escolha ao sistema, surge a pergunta: quais vantagens tem deixar a IA escolher modelos para as pessoas, e essa escolha é confiável?
Ter um modelo atribuindo trabalho a outros modelos já tem precedentes.
Já em 2023, o HuggingGPT tentou fazer o ChatGPT decompor as tarefas do usuário, selecionar modelos adequados com base nas descrições de modelos no Hugging Face e, em seguida, fazer o sistema chamar esses modelos para executar tarefas e agregar resultados.
A API Decisions, recentemente aberta em beta pública pela OpenAI, também fornece uma ferramenta para esse tipo de seleção.
Os desenvolvedores fornecem informações da tarefa e opções candidatas, o GPT-6 Luna retorna um julgamento, e então o aplicativo executa o próximo passo com base nesse julgamento.
Usado em um assistente multimodelo, pode ajudar a decidir: para qual modelo a tarefa atual deve ser entregue.
A vantagem da seleção automática é especialmente evidente quando uma tarefa exige chamadas repetidas a modelos.
Organização simples de informações, raciocínio complexo e polimento final de texto têm requisitos diferentes para as capacidades dos modelos. Se o sistema puder julgar passo a passo, ele tem a oportunidade de usar modelos mais fortes e mais caros apenas nas etapas que realmente precisam deles.
Esse tipo de abordagem já foi validado por pesquisas quanto aos seus benefícios de custo.
O estudo RouteLLM de 2024 mostrou que, na avaliação MT-Bench, ao distribuir solicitações entre GPT-4 e Mixtral, o sistema poderia alcançar cerca de 95% do desempenho de avaliação do GPT-4 enquanto reduzia os custos em mais de 85% em comparação com o uso integral do GPT-4.
Desempenho da alocação de modelos do RouteLLM no MT-Bench.
Mas esse resultado compara a alocação automática com o uso fixo do GPT-4; não pode provar completamente que a IA é melhor em escolher modelos do que os humanos, nem pode ser equiparado aos resultados reais dos testes do Grok Bot. Como o Grok Bot especificamente escolhe modelos ainda requer mais informações públicas para julgar.
Além disso, "adequado" não tem uma resposta que se aplique a todos.
Algumas pessoas estão com pressa, algumas querem economizar dinheiro, e algumas estão dispostas a gastar mais tempo e dinheiro em troca de melhores resultados. Mesmo para gerar imagens, uma ilustração temporária e um conjunto de pôsteres prontos para publicar diretamente têm padrões diferentes de conclusão.
O assistente de IA deve primeiro entender esses requisitos antes de decidir quais capacidades invocar. Caso contrário, por mais forte que seja o modelo, ele ainda pode falhar em produzir o resultado que o usuário deseja.
Para os usuários, se a seleção automática pode realmente poupar preocupações ainda tem que levar em conta o tempo gasto verificando, revisando e refazendo o trabalho.
Quem pode se tornar a primeira escolha do usuário?
Nesta competição, há também a OpenAI, que acaba de lançar o Dots.
Em 29 de setembro, a OpenAI lançou o agente 24 horas Dots, que também vem com um computador na nuvem, pode se conectar a aplicativos e pode continuar avançando no trabalho depois que o usuário sai.
Dots modifica materiais de publicação de acordo com novos requisitos.
O que ele disputa com o Grok Bot é a mesma oportunidade: tornar-se o assistente de IA em quem os usuários estão dispostos a confiar tarefas a longo prazo.
Mas a competição entre assistentes também pode coexistir com a cooperação na invocação de modelos.
Se no futuro o Grok Bot se conectar aos modelos da OpenAI, os usuários podem entregar tarefas ao assistente de Musk, e então os modelos da OpenAI completam parte do trabalho. A OpenAI fornece capacidades de modelo, enquanto os assistentes das duas empresas continuam a competir por usuários.
No momento, isso ainda é apenas uma possibilidade. Musk nomeou explicitamente o Claude desta vez, e ainda não foi confirmado se os modelos da OpenAI serão conectados.
Quando diferentes assistentes têm a oportunidade de chamar modelos semelhantes ou até os mesmos, quem entende melhor o usuário e quem pode continuar a partir da última tarefa podem se tornar os fatores-chave que afetam a escolha.
Se um assistente já conhece suas preferências de redação e estilo de imagem, e também pode encontrar arquivos anteriores, então na próxima vez que você tiver uma tarefa, você naturalmente pensará nele primeiro.
Mudar para outro assistente pode significar reexplicar o contexto, reconectar ferramentas e passar pelo estilo de trabalho磨合 tudo de novo.
Conectar-se ao Claude adiciona capacidades de modelo invocáveis ao Grok Bot.
Em seguida, essas capacidades ainda precisam se traduzir em benefícios que os usuários possam sentir:
Se os requisitos mudarem, ele consegue continuar revisando? Se o trabalho estiver pela metade, ele consegue continuar avançando? Para os resultados entregues, quanto esforço o usuário ainda precisa gastar para finalizá-los...
Essas experiências afetarão a quem o usuário entregará a próxima tarefa.
Materiais de referência:
https://x.com/testingcatalog/status/2107803665457189061
https://x.com/elonmusk/status/2107724314451878104
https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot
https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com
Este artigo vem da conta pública do WeChat "Xin Zhi Yuan" (ID: AI_era), autor: ASI Revelation; editor: Yuan Yu













