Elon Musks SpaceXAI versucht mit einem neuen Modell im KI-Rennen aufzuholen. Laut Unternehmensangaben baut Grok 4.6 auf dem Vorgänger Grok 4.5 auf, legt aber einen besonderen Fokus auf Agenten, die über längere Zeiträume hinweg agieren und anspruchsvollere interaktive Aufgaben erledigen.Anzeige

So gut schlägt sich Grok 4.6 im Vergleich

Mit Grok 4.6 will das Startup zu den Frontier-Modellen der Konkurrenz aufschließen. Laut dem unabhängigen Benchmark-Anbieter Artificial Analysis ist das durchaus gelungen: Im Artificial Analysis Intelligence Index erreicht das neu veröffentlichte KI-Modell 61 Punkte und liegt damit gleichauf mit GPT-5.6 Sol von OpenAI. Nur Anthropics Claude Fable und Claude Opus schneiden mit 62 und 63 Punkten etwas besser ab. Besonders stark ist Grok 4.6 bei agentischen Aufgaben.

Beim „GDPval-AA v2“-Benchmark, der realistische berufliche Arbeitsaufträge testet, erzielte Grok 4.6 einen Elo-Wert von 1753 und landete damit nur knapp hinter Claude Opus 5. Laut Ankündigung bewältigt das Modell „komplexe Aufgaben über viele Schritte hinweg, sei es bei der Recherche zu einem Thema, der Analyse von Informationen, der Arbeit an einer Codebasis oder der Umsetzung einer Idee in eine ausgereifte Anwendung oder ein Arbeitsergebnis“.Anzeige