Grok 4.6 vorgestellt: Neue Maßstäbe für Agenten-KI und Coding

AI generated

xAI hat mit Grok 4.6 die nächste Generation seiner KI-Serie veröffentlicht. Das neue Modell setzt besonders auf langfristige Agenten-Aufgaben und anspruchsvolle interaktive sowie visuelle Projekte. Entdecken Sie, was die neue Version alles kann.

Grok 4.6: Neue Generation der Agenten-KI

Grok 4.6 baut konsequent auf den Stärken seines Vorgängers Grok 4.5 auf. Der Fokus liegt dabei auf langlaufenden Agenten und ambitionierter interaktiver sowie visueller Arbeit. Das Modell behält auch bei komplexen Aufgaben über viele Schritte hinweg den Überblick. Ob Recherche, Analyse umfangreicher Daten, Arbeit über eine gesamte Codebasis oder die Umsetzung einer Idee in eine fertige Anwendung – Grok 4.6 begleitet den gesamten Prozess.

Spitzenwerte bei Benchmarks

Bei verschiedenen Benchmarks für agentenbasiertes Coding und Wissensarbeit erreicht Grok 4.6 Spitzenwerte. Auf dem Artificial Analysis Intelligence Index, einem zusammengesetzten Score aus neun verschiedenen Benchmarks, erreicht das Modell das Niveau von GPT-5.6 Sol.

So wurde Grok 4.6 trainiert

Die Entwickler setzten bei Grok 4.6 auf ein längeres ergänzendes Training im Vergleich zu Grok 4.5. Dabei kamen kuratierte modellgenerierte Daten für Reasoning und fortgeschrittene technische Konzepte zum Einsatz. Zusätzlich flossen hochwertige Engineering-Daten sowie ein verbesserter Optimizer und Trainingsansatz ein.

Auf dieser Basis folgten SFT- und RL-Stufen. Das Team nutzte Grok 4.5, um SFT-Trajektorien in den Bereichen Reasoning, Agenten-Harnesses sowie Domains wie STEM, Software-Engineering und Wissensarbeit neu zu generieren. Problematische Spuren filterte das Team mit modellbasierten Checks heraus.

Agentenbasiertes Reinforcement Learning

Grok 4.6 trainierte auf einer breiten Palette agentischer RL-Aufgaben. Dazu zählen Wissensarbeit, allgemeines Coding und domänenspezifische Umgebungen für Kernel-Optimierung, Webentwicklung, computergestütztes Design und mehr.

Grok 4.6 in der Praxis: Von der Idee zur Anwendung

Bei der Prüfung auf anspruchsvolle Projekte zeigte sich Grok 4.6 besonders stark in der Umsetzung breiter Produktideen in funktionierende erste Versionen. Das Modell recherchiert unbekannte Domains, strukturiert die Anwendung, implementiert Kerninteraktionen und verfeinert das Ergebnis über mehrere Feedback-Runden hinweg.

Auf längeren Trajektorien zeigt das Modell zudem verstärktes Selbsttesting und Verifikation. Es prüft eigene Ergebnisse, bevor es zum nächsten Schritt übergeht.

Stärken bei visuellen und interaktiven Projekten

Grok 4.6 liefert bei visuellen und interaktiven Projekten deutlich stärkere erste Entwürfe als sein Vorgänger. Bei konkreten Produktideen gelingt es dem Modell, Struktur und visuelle Sprache einer Anwendung in einem Durchgang zu etablieren. Das macht es besonders wertvoll für Projekte, bei denen der schnellste Weg zu einem guten Ergebnis darin liegt, mit einer substanziellen Grundlage zu starten und anschließend zu iterieren.

Sicherheit und Fähigkeiten im Einklang

Die Sicherheitsvorkehrungen von Grok 4.6 wurden an die erweiterten Fähigkeiten des Modells angepasst und kalibriert. Der Sicherheits-Stack soll Nutzen und Sicherheit über legitime Anwendungsfälle hinweg maximieren.

Das umfasst unter anderem das Patchen von Schwachstellen, die Beschleunigung von Engineering-Design-Zyklen und die Unterstützung bei der KI-Forschung. Vor der Bereitstellung durchlief das Modell die umfangreichste bisherige Testserie für Fähigkeiten und Sicherheitskalibrierung. Auch nach dem Deployment stehen umfangreiche Tests durch Dritte an.

Verfügbarkeit und Preise

Grok 4.6 ist ab sofort in Cursor und Grok Build verfügbar. Über die SpaceXAI API sowie Partner wie OpenRouter, Vercel und Cloudflare kann das Modell ebenfalls genutzt werden.

Die Preise starten bei 2 Dollar pro Million Input-Tokens und 6 Dollar pro Million Output-Tokens. Eine schnelle Variante ist zum doppelten Preis erhältlich. In der ersten Woche erhalten Nutzer von Cursor und Grok Build das doppelte Kontingent an Inklusivnutzung.

Quelle: https://cursor.com/blog/grok-4-6

Dieser Inhalt wurde mithilfe künstlicher Intelligenz erstellt.
Becker Julian