Musks KI-Assistent hat auch angefangen, Claude für die Arbeit einzustellen!
Am 7. Oktober kündigte Musk auf X an, dass Grok Bot je nach Aufgabe das am besten geeignete Backend-Modell auswählen wird, und nannte direkt Claude Opus 5.5, Midjourney und Suno.
Der von ihm angegebene Standard war einfach und direkt:
Welches am wahrscheinlichsten das beste Ergebnis für Sie erzielt, verwenden Sie dieses.
Wer gut funktioniert, den verwenden Sie.
Der Netzbürger ExiledonMoon scherzte, dass sogar Musks KI-Assistent angefangen hat, Claude um Hilfe bei der Arbeit zu bitten.
Ein anderer Netzbürger, Token Maxxer, erinnerte daran: Die von Musk angegebene Liste enthält auch „andere führende APIs“. OpenAI wurde einfach nicht genannt und nicht ausdrücklich ausgeschlossen.
Dies lässt auch eine Spannung offen: Werden auch OpenAIs Modelle zu externen Verstärkungen für Grok Bot werden?
Zumindest hat Claude bereits mit der Arbeit begonnen.
Laut einem Bericht von 9to5Mac vom selben Tag kann Grok Bot bereits Claude Opus 5.5 verwenden.
Sie übergeben die Aufgabe an Musks KI-Assistenten, und derjenige, der die Arbeit hinter den Kulissen erledigt, könnte Claude sein.
Während er mit Anthropic um Nutzer konkurriert, ruft er auch Claude an. Warum ist Musk bereit, dies zu tun?
Das Modell eines Rivalen ausleihen, um dessen eigene Nutzer zu gewinnen
Gemessen an dem „besten Ergebnis“, das Musk betonte, ist sein Denken sehr praktisch:
Lassen Sie zuerst Grok Bot die Arbeit des Nutzers gut erledigen; es ist nicht nötig, dass sein eigenes Modell jeden Teil übernimmt.
Wenn eine bestimmte Aufgabe mit Claude besser erledigt werden kann, dann kann die Integration dazu beitragen, die Wahrscheinlichkeit zu verringern, dass Nutzer wegen einer schlechten Erfahrung zu anderen Produkten wechseln.
Noch entscheidender ist, dass selbst wenn derjenige, der die Arbeit hinter den Kulissen erledigt, Claude ist, der Ort, an dem Nutzer ihre Bedürfnisse äußern, Tools verbinden und Aufgaben nachverfolgen, immer noch Grok Bot sein kann.
Anthropic stellt einen Teil der Modellfähigkeit bereit, während Grok Bot dafür verantwortlich ist, diese Fähigkeiten zu organisieren und die Ergebnisse zu liefern. Solange die Aufgabe gut erledigt wird, haben Nutzer einen Grund, diesen Assistenten weiter zu verwenden.
Daher kann das Aufrufen des Modells eines Rivalen auch zu einem Mittel werden, Nutzer zu gewinnen.
Selbst wenn ein Teil der Arbeit von Claude erledigt wird, werden Nutzer beim nächsten Mal, wenn sie eine Aufgabe haben, möglicherweise immer noch zuerst Grok Bot öffnen.
Was Grok Bot übernehmen will, ist das Ganze
Der von Musk diesmal erwähnte Grok Bot startete seine Beta-Version am 11. August.
Dieser intelligente Assistent kommt mit einem Cloud-Computer, auf dem er Aufgaben für Nutzer ausführen kann.
Laut offizieller Einführung kann Bot Werkzeuge nutzen, sich in Anwendungen einloggen und Arbeit über Software hinweg erledigen; mehrere Bots können auch miteinander kommunizieren, Aufgabenkontext teilen und Arbeit aufteilen und zusammenarbeiten.
Nachdem der Benutzer den Computer verlassen hat, kann die Arbeit fortgesetzt werden.
Mehrere Grok Bots übergeben Aufgaben und melden Fortschritt.
Dass Musk diesmal Grok Bot erwähnt, bedeutet nicht, dass die Grok-Chat-Funktion auf X ebenfalls vollständig auf Claude umgestellt wird.
Neben Claude umfasst die Liste auch das Bildgenerierungswerkzeug Midjourney und das Musikgenerierungswerkzeug Suno, die Text, Bilder und Musik abdecken und einem sehr praktischen Bedürfnis entsprechen: Die Fertigstellung einer ganzen Sache erfordert oft mehrere Fähigkeiten, die zusammenarbeiten.
Um beispielsweise ein Kurzvideo zu erstellen, müssen Sie das Skript schreiben, das Cover vorbereiten und auch ein Stück Musik hinzufügen.
Bitten Sie ein paar KIs um Hilfe, und die Materialien sind möglicherweise sehr schnell fertig. Aber das Erklären der Anforderungen, das Verschieben von Dateien und das Koordinieren von Überarbeitungen erfordern oft immer noch, dass Sie zwischen verschiedenen Fenstern hin- und herwechseln.
Wenn Grok Bot je nach Aufgabe das passende Modell aufrufen und diese Schritte verbinden kann, hat es die Chance, einen Teil der Koordinationsarbeit für Sie zu übernehmen.
Was Benutzer wollen, ist sehr einfach: weniger zwischen mehreren Modellen und Werkzeugen hin- und herwechseln und nicht denselben Bedarf mehrmals erklären müssen.
Es will Sie sogar davon befreien, auszuwählen, welches Modell Sie verwenden
Je mehr Modelle es verbindet, wird es den Benutzern stattdessen „Auswahlschwierigkeiten“ bereiten?
Wenn Sie einen Assistenten öffnen, müssen Sie immer noch zuerst durchdenken: Soll ich Claude oder Grok zum Schreiben von Code verwenden? Und zu welchem Werkzeug sollte ich für die Bilderstellung wechseln?
Die offizielle Dokumentation von Grok Bot hat den Designansatz bereits dargelegt:
Die Modellauswahl wird von der Plattform verwaltet, es gibt kein benutzerseitiges Menü zur Modellauswahl, und die tatsächlich verwendete Kombination von Modellen kann sich im Laufe der Zeit ändern.
Mit anderen Worten: Sie weisen die Aufgabe zu, und das System wählt das Modell für Sie aus.
Sie müssen nicht recherchieren, wer kürzlich ein Upgrade erhalten hat, nur um ein Stück Code zu schreiben; noch müssen Sie die Fähigkeitslisten verschiedener Werkzeuge durchgehen, nur um ein Bild zu erstellen.
Dies bedeutet jedoch nicht, dass Benutzer nicht wissen müssen, was verwendet wurde und wie viel ausgegeben wurde.
Die offizielle Dokumentation erwähnt, dass Nutzungsanalysen zeigen werden, welches Modell tatsächlich verwendet wurde, und die Kosten basierend auf dem verwendeten Modell berechnet werden.
Diese Informationen können Benutzern helfen zu verstehen, wohin ihr Geld fließt, und zu beurteilen, ob die Aufgabe es wert war.
Ist es wirklich zuverlässig, die KI Modelle auswählen zu lassen?
Nachdem die Auswahl dem System übergeben wurde, stellt sich die Frage: Welche Vorteile hat es, die KI Modelle für Menschen auswählen zu lassen, und ist eine solche Auswahl zuverlässig?
Dass ein Modell Arbeit an andere Modelle vergibt, hat bereits Präzedenzfälle.
Bereits 2023 versuchte HuggingGPT, ChatGPT dazu zu bringen, Benutzeraufgaben zu zerlegen, geeignete Modelle basierend auf Modellbeschreibungen auf Hugging Face auszuwählen und dann das System diese Modelle aufrufen zu lassen, um Aufgaben auszuführen und Ergebnisse zu aggregieren.
Die kürzlich von OpenAI geöffnete öffentliche Beta Decisions API bietet ebenfalls ein Werkzeug für diese Art der Auswahl.
Entwickler stellen Aufgabeninformationen und Kandidatenoptionen bereit, GPT-6 Luna gibt ein Urteil zurück, und dann führt die Anwendung basierend auf diesem Urteil den nächsten Schritt aus.
In einem Multi-Modell-Assistenten eingesetzt, kann es helfen zu entscheiden: An welches Modell soll die aktuelle Aufgabe übergeben werden.
Der Vorteil der automatischen Auswahl zeigt sich besonders dann, wenn eine Aufgabe das wiederholte Aufrufen von Modellen erfordert.
Einfache Informationsorganisation, komplexes Schlussfolgern und abschließendes Textpolieren stellen unterschiedliche Anforderungen an die Fähigkeiten der Modelle. Wenn das System Schritt für Schritt urteilen kann, hat es die Möglichkeit, stärkere und teurere Modelle nur in den Phasen einzusetzen, die sie wirklich benötigen.
Diese Art von Ansatz wurde bereits durch Forschung hinsichtlich seines Kostenvorteils validiert.
Die RouteLLM-Studie aus dem Jahr 2024 zeigte, dass das System in der MT-Bench-Bewertung durch die Verteilung von Anfragen zwischen GPT-4 und Mixtral etwa 95 % der Bewertungsleistung von GPT-4 erreichen konnte, während die Kosten im Vergleich zur vollständigen Nutzung von GPT-4 um mehr als 85 % gesenkt wurden.
Die Modellzuweisungsleistung von RouteLLM in MT-Bench.
Dieses Ergebnis vergleicht jedoch die automatische Zuweisung mit der festen Nutzung von GPT-4; es kann nicht vollständig beweisen, dass KI besser darin ist, Modelle auszuwählen, als Menschen, und es kann auch nicht mit den tatsächlichen Testergebnissen von Grok Bot gleichgesetzt werden. Wie Grok Bot konkret Modelle auswählt, erfordert noch mehr öffentliche Informationen, um beurteilt zu werden.
Darüber hinaus hat „geeignet“ keine Antwort, die für alle gilt.
Manche Menschen haben es eilig, manche wollen Geld sparen, und manche sind bereit, mehr Zeit und Geld zu investieren, um bessere Ergebnisse zu erzielen. Selbst bei der Bilderzeugung haben eine temporäre Illustration und ein Satz direkt veröffentlichungsreifer Poster unterschiedliche Fertigstellungsstandards.
Der KI-Assistent muss diese Anforderungen zuerst verstehen, bevor er entscheidet, welche Fähigkeiten er aufruft. Andernfalls kann selbst das stärkste Modell möglicherweise immer noch nicht das vom Benutzer gewünschte Ergebnis liefern.
Für Benutzer muss die Frage, ob die automatische Auswahl ihnen wirklich Sorgen ersparen kann, immer noch die Zeit berücksichtigen, die für Überprüfung, Überarbeitung und erneute Arbeit aufgewendet wird.
Wer kann die erste Wahl des Benutzers werden?
In diesem Wettbewerb gibt es auch OpenAI, das gerade Dots auf den Markt gebracht hat.
Am 29. September veröffentlichte OpenAI den Rund-um-die-Uhr-Agenten Dots, der ebenfalls mit einem Cloud-Computer ausgestattet ist, sich mit Anwendungen verbinden kann und die Arbeit weiter vorantreiben kann, nachdem der Benutzer gegangen ist.
Dots ändert Veröffentlichungsmaterialien gemäß neuen Anforderungen.
Womit es mit Grok Bot konkurriert, ist dieselbe Gelegenheit: der KI-Assistent zu werden, dem Benutzer langfristig Aufgaben anvertrauen.
Aber der Wettbewerb zwischen Assistenten kann auch mit Zusammenarbeit beim Modellaufruf koexistieren.
Wenn Grok Bot in Zukunft eine Verbindung zu OpenAI-Modellen herstellt, könnten Benutzer Aufgaben an Musks Assistenten übergeben, und dann erledigen OpenAI-Modelle einen Teil der Arbeit. OpenAI stellt Modellfähigkeiten bereit, während die Assistenten der beiden Unternehmen weiterhin um Benutzer konkurrieren.
Derzeit ist dies noch nur eine Möglichkeit. Musk nannte diesmal ausdrücklich Claude, und es ist noch nicht bestätigt, ob OpenAI-Modelle verbunden werden.
Wenn verschiedene Assistenten die Möglichkeit haben, ähnliche oder sogar dieselben Modelle aufzurufen, könnten, wer den Benutzer besser versteht und wer von der letzten Aufgabe aus fortfahren kann, zu den Schlüsselfaktoren werden, die die Wahl beeinflussen.
Wenn ein Assistent bereits Ihre Textpräferenzen und Ihren Bildstil kennt und auch frühere Dateien finden kann, werden Sie das nächste Mal, wenn Sie eine Aufgabe haben, natürlich zuerst an ihn denken.
Zu einem anderen Assistenten zu wechseln, könnte bedeuten, den Hintergrund erneut zu erklären, Tools erneut zu verbinden und den Arbeitsstil noch einmal磨合 durchlaufen zu müssen.
Die Verbindung mit Claude fügt Grok Bot aufrufbare Modellfähigkeiten hinzu.
Als Nächstes müssen diese Fähigkeiten noch in Vorteile übersetzt werden, die Nutzer spüren können:
Wenn sich die Anforderungen ändern, kann es dann weiter überarbeitet werden? Wenn die Arbeit zur Hälfte erledigt ist, kann sie dann weiter vorangetrieben werden? Für die gelieferten Ergebnisse, wie viel Aufwand muss der Nutzer noch aufwenden, um sie fertigzustellen...
Diese Erfahrungen werden alle beeinflussen, wem der Nutzer die nächste Aufgabe übergibt.
Referenzmaterialien:
https://x.com/testingcatalog/status/2107803665457189061
https://x.com/elonmusk/status/2107724314451878104
https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot
https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com
Dieser Artikel stammt vom WeChat-öffentlichen Konto „Xin Zhi Yuan“ (ID: AI_era), Autor: ASI Revelation; Redakteur: Yuan Yu













