„AGI ist da"? GPT-6 Astra, Agenten-Schwarm & Mistrals 3-Mrd.-Runde – Philipp Müller & Daniel Höpfner (Prompted)
13. September 2026 · 36 Min.
GPT‑6 Astra zeigt deutliche Fortschritte in agentischen, visuellen und mathematischen Aufgaben, doch Benchmarks, Harness‑Effekte und IP/Safety‑Fragen relativieren die Behauptung, dass AGI bereits erreicht sei — Philipp Müller und Daniel Höpfner ordnen die Technik, Agentenverhalten und Mistrals 3‑Mrd.-Finanzierung ein.
Philipp Müller und Daniel Höpfner analysieren OpenAIs neue Modellvariante GPT‑6 Astra: technisch erkennbare Stärken in visuellem Verständnis, Agentensteuerung und formaler Mathematik stehen gegen widersprüchliche Benchmark‑Aussagen und unbeantwortete Fragen zu Harnesses und IP. Sie berichten von einem überraschenden Agenten‑Schwarm, der in einem deutschen Wiki Notizen hinterließ, und diskutieren Implikationen für Safety und Forschungspraxis. Abschließend ordnen sie Mistrals 3‑Milliarden‑Finanzierung und europäische Manufaktur‑Strategien im KI‑Markt ein sowie weitere KI‑News wie DeepMinds Alpha‑Genome‑Atlas und kurze Systemausfälle großer Modelle.
Zahlen & Fakten
99,9 %
OpenAI‑Angabe zur Performance von GPT‑6 Astra im ARC‑AGI‑Benchmark.
62,7 %
ARC Foundation‑Bewertung der Performance im ARC‑AGI‑Benchmark, laut Erwähnung in der Folge.
20 Millionen Dollar
Vermutete Token‑/Rechenkosten (ca. 20 Millionen Dollar) für OpenAIs Agentenläufe.
Weitere 3 Zahlen & Fakten anzeigenWeniger anzeigen
3 Milliarden
Finanzierungsbetrag, den Mistral in der genannten Runde aufgenommen hat.
10.000 Agenten
Angabe, dass OpenAI angeblich 10.000 Agenten zur Recherche/Proof‑Erzeugung eingesetzt haben soll.
zwei Stunden
Ungefährer Zeitraum, während dem ChatGPT, Claude und Grok gleichzeitig nicht erreichbar waren.
Themen & Erkenntnisse
Quellen
• StudieARC‑AGI‑Benchmark (ARC Foundation) – Benchmark‑Framework zur Messung von AGI‑ähnlichen Aufgaben
• Alpha‑Genome‑Atlas (Datensatz) – Google DeepMind (API‑zugänglicher genomischer Datensatz, in der Folge diskutiert)
Alle Quellen findest du in der vollständigen FolgeKIDieser Inhalt wurde KI-gestützt erstellt und redaktionell geprüft.
Ähnliche Folgen
Doppelgänger Tech Talk · 11. Sept. 2026
10% Risiko zu sterben, 10% mehr Wachstum | 200 Millionen Destillationsanfragen | Kapital schlägt Arbeit #596
Die rasche Entwicklung von KI bringt erhebliche wirtschaftliche Chancen, gleichzeitig aber reale Sicherheits- und Verteilungsrisiken, die Regulierung, Monitoring und gegebenenfalls ein verlangsamter Entwicklungspfad erfordern.
KI-Update – heise · 11. Sept. 2026
KI-Update IFA-Spezial: KI in der Popkultur – zwischen Vision und Wunschdenken
Isabel Grünewald und Dr. Sabrina Patsch zeigen, dass Filmdarstellungen von KI unsere Erwartungen prägen, viele Szenarien dramaturgisch überzeichnen, reale KI‑Systeme aber vor praktischen technischen und sicherheitsrelevanten Herausforderungen stehen.
Startup Insider · 14. Sept. 2026
Gier oder Vernunft? AI-Boom, Defense und Physical AI – Susie Meier (DTCP)
Der AI‑Boom ist extrem konzentriert: Susi Mayer erklärt, dass große Kapitalströme vor allem an wenige AI‑Winners fließen, während Europa insbesondere in Defense, Physical AI und Edge‑/Industrial‑AI echte Chancen besitzt.
Startup Insider · 13. Sept. 2026
Anthropic wirft chinesischen KI-Laboren Missbrauch vor & OpenAI prüft KI-Bremse
Die Folge fasst aktuelle KI‑Konflikte und politische Entscheidungen zusammen: Anthropic erhebt Missbrauchsvorwürfe gegen chinesische KI‑Labore, OpenAI prüft eine Verlangsamung der KI‑Entwicklung und das Bundeskabinett beschließt erweiterte KI‑Befugnisse für deutsche Geheimdienste; ergänzend werden Raumfahrtaufträge, Rüstungsaufträge und mehrere Finanzierungs‑ und Börsennachrichten berichtet.
Der Tag · 14. Sept. 2026
Wie gefährlich sind KI-Agenten?
KI-Agenten bergen durch Skalierung, Prompt‑Injection und Missbrauch reale Risiken, die schwer zu kontrollieren sind, so der Informatiker Andreas Butz.
@mediasres – Deutschlandfunk · 14. Sept. 2026
Unkontrollierbare Risiken? Die Sicherheitsdebatte um die Gefahren von KI
Warnungen vor unkontrollierbaren KI-Risiken werden ernst genommen, aber journalistisch überprüft und kontextualisiert.