GPT-6 Astra gilt schon jetzt als überholt
Entwickler cozyblaze: Astra sei das schlechteste Modell, das wir je bekommen werden.
Symbolbild, KI-generiert.
GPT-6 Astra hat das Puzzlespiel Portal in rund 24 Stunden vollständig autonom durchgespielt, ohne menschliches Eingreifen nach der Zielvorgabe. Entwickler cozyblaze veröffentlichte Code und Dokumentation auf GitHub und erwartet, dass künftige Agenten deutlich mehr können.
Die Belege
- Laufzeit rund 24 Stunden ohne menschliches Eingreifen nach Zielvorgabe.
- Code und Dokumentation von Entwickler cozyblaze auf GitHub veröffentlicht.
- Entwickler-Fazit: Astra sei das schlechteste Modell, das wir je bekommen werden.
Der Zusammenhang
Das Experiment testete, ob ein Sprachmodell ein komplexes Rätselspiel ohne Zwischenanweisungen lösen kann, nachdem lediglich das Ziel vorgegeben wurde. Code und Dokumentation sind öffentlich auf GitHub einsehbar, was eine Nachprüfung durch Dritte ermöglicht.
Warum das zählt
Für Produktteams, die Agenten für mehrstufige Aufgaben ohne Zwischen-Feedback entwickeln, liefert der offene Code eine nachvollziehbare Referenz zur Bewertung von Planungsfähigkeit und Fehlerkorrektur der Modelle. Die Aussage des Entwicklers deutet auf schnelle weitere Fortschritte hin.
Ein Spiel-Durchlauf ist kein Produktivbeweis, zeigt aber Planungs- und Durchhaltefähigkeit über viele Schritte hinweg. Die Erwartung weiterer Fortschritte sollte Unternehmen zu frühzeitiger Agenten-Governance bewegen, nicht zu vorschnellem breiten Rollout.
Technische Teams sollten die veröffentlichte GitHub-Dokumentation prüfen, um Planungsfähigkeiten von Astra für eigene Agenten-Use-Cases zu bewerten.
Was diese Meldung nicht belegt: Die Einschätzung künftiger Modellfähigkeiten stammt allein vom Entwickler, nicht von OpenAI oder unabhängigen Tests.
Text KI-gestützt erstellt und am 08.09.2026 im Zwei-Instanzen-Verfahren gegen die erfassten Radar-Rohdaten geprüft. Fehler gefunden? Korrektur melden · Unsere Grundsätze