Ole Wendland und Fabian Walther fassen aktuelle Model-News zusammen: Im Zentrum stehen Effizienz, Tokenkosten und neue Benchmarks sowie Sicherheitsfragen wie Prompt Injection.
Ole Wendland und Fabian Walther besprechen die aktuelle Welle an Modell-Updates (Anthropic Fable/Sonnet, OpenAI Soul/Terra/Luna, SpaceX xAI GROK), neue Benchmarks (DeepSWE, Frontier Code) und praktische Fragen zur Token-Ökonomie. Sie diskutieren Kostenvergleiche, Effizienzvorteile neuer Modelle, lokale Open-Weight-Experimente und ein Paper zu Prompt Injection, das Role-Confusion-Probleme analysiert. Abschließend geht es um Auswirkungen auf Entwicklungsteams, Budgeting und Compliance bei lokalen bzw. Cloud-basierten Modellen.
Zahlen & Fakten
300 $
Geschätzte Token-Kosten, die ein Host in einer Woche verbraucht hat.
13 %
Merge-Rate von Opus 4.8 auf dem höchsten Difficulty-Level im Frontier-Code-Benchmark.
6 %
Merge-Rate von GPT 5.5 auf dem höchsten Difficulty-Level im Frontier-Code-Benchmark.
Weitere 10 Zahlen & Fakten anzeigenWeniger anzeigen
20 %
Merge-Rate in leichteren Kategorien für eines der getesteten Modelle (Frontier Code).
30 %
Merge-Rate in leichteren Kategorien für eines der getesteten Modelle (Frontier Code).
6 $ für 1.000.000 Tokens
Im Gespräch genannter Preis für GROK: ca. 6 Dollar pro Million Output-Tokens.
136 $
Median-Ausgabe pro Jahr pro Mitarbeiter für Token-Nutzung in der analysierten Studie.
150–250 $/Monat
Von Anthropic genannter durchschnittlicher Cloud-Code-Bedarf pro Entwickler (Monatswerte).
1 Mrd.
Von Anthropic für Q3 prognosteter Gewinn.
4–5×
Ungefährer Faktor, um den Sonnet 5 in manchen Coding-Aufgaben mehr Tokens/Kosten verbrannte als Fable mit niedrigem Thinking-Effort.
1,5 Billionen
Angegebene Parametergröße des neuen GROK-Modells (Approximation im Gespräch).
30 GB
Ungefähres RAM-Budget, das ein lokal quantisiertes Modell (4‑Bit) benötigt.
8 H100 GPUs
Geschätzte Hardware-Anforderung, um die große Variante von GLM 5.2 mit 8‑Bit-Quantisierung zu betreiben.
Rubriken
Themen & Erkenntnisse
KIDieser Inhalt wurde KI-gestützt erstellt und redaktionell geprüft.
Ähnliche Folgen
Doppelgänger Tech Talk · 10. Juli 2026
Scam-Anruf für Herrn Philipp | USA und China ziehen KI-Zäune hoch | Lovable auf $13 Mrd. #578
Aktuelle KI- und Tech-News: große Modell-Releases und Produkt-Updates, wachsende geopolitische Spannungen um Modellnutzung und -vertrieb, mehrere große Finanzierungen sowie lokale Initiativen zur Umnutzung von Büroflächen.
Startup Insider · 15. Juli 2026
Deepmind-Chef warnt vor KI-Risiken & Fraunhofer eröffnet drei Humanoid-Robotik-Labs
Die Folge fasst akute KI‑Sicherheitsfragen (Vorfall mit OpenAIs GPT‑5.6 SOL, breite Warnungen von Ökonom*innen) sowie technische und wirtschaftliche Entwicklungen wie neue Fraunhofer‑Labs und mehrere Startup‑Finanzierungen zusammen.

Payment & Banking Fintech Podcast · 14. Juli 2026
#66 Ai in Finance: Der Chat ist tot, es lebe der Agent
KI-Modelle wandeln sich vom einfachen Frage‑Antwort‑Chat zu ausführenden, agentischen Systemen, die über Workflows, Plugins und Server‑Browser eigenständig Aufgaben ausführen und Ergebnisse liefern.
Bits und so · 12. Juli 2026
Bits und so #1014 (Sonne, Mond und Sterne)
Apple verklagt OpenAI (und einzelne Ex‑Apple‑Mitarbeiter) wegen angeblicher Abwerbung und Mitnahme von Hardware‑Geheimnissen — ein Symbol für die Spannung zwischen etabliertem Hardware‑Know‑how und neuen KI‑Ambitionen.
Startup Insider · 12. Juli 2026
1,2 Bio. $ Bewertung für Anthropic & EU AI Act ab August 2026
Anthropic erreicht eine Bewertung von 1,2 Billionen Dollar, während europäische KI-Startups wie Merkor, Oxylabs und Gradium mit Milliardenfinanzierungen wachsen.
Future Weekly · 16. Juli 2026
#533 - Fable Verlängerung, KI Proteste & Schwedens Gründungskarenz
Künstliche Intelligenz verändert Arbeitswelten, Marktstrukturen und Politik: Während Tool‑Rennen (Fable vs. GPT) Nutzerstress und neue Proteste hervorrufen, zeigen politische Ideen wie Schwedens Gründungskarenz konkrete Wege, Unternehmertum zu entlasten.