INNOQ Podcast
INNOQ Podcast
INNOQ Podcast

AI News #8

13. Juli 2026 · 39 Min.

Ole Wendland und Fabian Walther fassen aktuelle Model-News zusammen: Im Zentrum stehen Effizienz, Tokenkosten und neue Benchmarks sowie Sicherheitsfragen wie Prompt Injection.

Ole Wendland und Fabian Walther besprechen die aktuelle Welle an Modell-Updates (Anthropic Fable/Sonnet, OpenAI Soul/Terra/Luna, SpaceX xAI GROK), neue Benchmarks (DeepSWE, Frontier Code) und praktische Fragen zur Token-Ökonomie. Sie diskutieren Kostenvergleiche, Effizienzvorteile neuer Modelle, lokale Open-Weight-Experimente und ein Paper zu Prompt Injection, das Role-Confusion-Probleme analysiert. Abschließend geht es um Auswirkungen auf Entwicklungsteams, Budgeting und Compliance bei lokalen bzw. Cloud-basierten Modellen.

Zahlen & Fakten

300 $

Geschätzte Token-Kosten, die ein Host in einer Woche verbraucht hat.

13 %

Merge-Rate von Opus 4.8 auf dem höchsten Difficulty-Level im Frontier-Code-Benchmark.

6 %

Merge-Rate von GPT 5.5 auf dem höchsten Difficulty-Level im Frontier-Code-Benchmark.

Weitere 10 Zahlen & Fakten anzeigen

20 %

Merge-Rate in leichteren Kategorien für eines der getesteten Modelle (Frontier Code).

30 %

Merge-Rate in leichteren Kategorien für eines der getesteten Modelle (Frontier Code).

6 $ für 1.000.000 Tokens

Im Gespräch genannter Preis für GROK: ca. 6 Dollar pro Million Output-Tokens.

136 $

Median-Ausgabe pro Jahr pro Mitarbeiter für Token-Nutzung in der analysierten Studie.

150–250 $/Monat

Von Anthropic genannter durchschnittlicher Cloud-Code-Bedarf pro Entwickler (Monatswerte).

1 Mrd.

Von Anthropic für Q3 prognosteter Gewinn.

4–5×

Ungefährer Faktor, um den Sonnet 5 in manchen Coding-Aufgaben mehr Tokens/Kosten verbrannte als Fable mit niedrigem Thinking-Effort.

1,5 Billionen

Angegebene Parametergröße des neuen GROK-Modells (Approximation im Gespräch).

30 GB

Ungefähres RAM-Budget, das ein lokal quantisiertes Modell (4‑Bit) benötigt.

8 H100 GPUs

Geschätzte Hardware-Anforderung, um die große Variante von GLM 5.2 mit 8‑Bit-Quantisierung zu betreiben.

Diese Folge steckt voller Zahlen – neugierig?

Themen & Erkenntnisse

Anthropic, Fable und Token-Ökonomie · ab 02:05: Fable-Quota, Sonnet 5 vs. günstigere Modelle: Tokeneffizienz ist oft wichtiger als Modellklasse.
Große Model-News und Benchmarks (OpenAI, SpaceX, Frontier Code) · ab 12:50: Vorstellung neuer Modelle (OpenAI, GROK) und Benchmarks; Frontier Code prüft, ob Code wirklich mergebar ist.
Lokale Modelle, praktische Experimente und Security-Paper · ab 26:28: Erfahrungen mit lokalen Modellen (Ornith, GLM) und ein Paper zu Prompt-Injection/Role-Confusion.

KIDieser Inhalt wurde KI-gestützt erstellt und redaktionell geprüft.

Ähnliche Folgen

Doppelgänger Tech Talk · 10. Juli 2026

Scam-Anruf für Herrn Philipp | USA und China ziehen KI-Zäune hoch | Lovable auf $13 Mrd. #578

Aktuelle KI- und Tech-News: große Modell-Releases und Produkt-Updates, wachsende geopolitische Spannungen um Modellnutzung und -vertrieb, mehrere große Finanzierungen sowie lokale Initiativen zur Umnutzung von Büroflächen.

Startup Insider · 15. Juli 2026

Deepmind-Chef warnt vor KI-Risiken & Fraunhofer eröffnet drei Humanoid-Robotik-Labs

Die Folge fasst akute KI‑Sicherheitsfragen (Vorfall mit OpenAIs GPT‑5.6 SOL, breite Warnungen von Ökonom*innen) sowie technische und wirtschaftliche Entwicklungen wie neue Fraunhofer‑Labs und mehrere Startup‑Finanzierungen zusammen.

Payment & Banking Fintech Podcast · 14. Juli 2026

#66 Ai in Finance: Der Chat ist tot, es lebe der Agent

KI-Modelle wandeln sich vom einfachen Frage‑Antwort‑Chat zu ausführenden, agentischen Systemen, die über Workflows, Plugins und Server‑Browser eigenständig Aufgaben ausführen und Ergebnisse liefern.

Bits und so · 12. Juli 2026

Bits und so #1014 (Sonne, Mond und Sterne)

Apple verklagt OpenAI (und einzelne Ex‑Apple‑Mitarbeiter) wegen angeblicher Abwerbung und Mitnahme von Hardware‑Geheimnissen — ein Symbol für die Spannung zwischen etabliertem Hardware‑Know‑how und neuen KI‑Ambitionen.

Startup Insider · 12. Juli 2026

1,2 Bio. $ Bewertung für Anthropic & EU AI Act ab August 2026

Anthropic erreicht eine Bewertung von 1,2 Billionen Dollar, während europäische KI-Startups wie Merkor, Oxylabs und Gradium mit Milliardenfinanzierungen wachsen.

Future Weekly · 16. Juli 2026

#533 - Fable Verlängerung, KI Proteste & Schwedens Gründungskarenz

Künstliche Intelligenz verändert Arbeitswelten, Marktstrukturen und Politik: Während Tool‑Rennen (Fable vs. GPT) Nutzerstress und neue Proteste hervorrufen, zeigen politische Ideen wie Schwedens Gründungskarenz konkrete Wege, Unternehmertum zu entlasten.