Digitale Vorreiter:innen
Digitale Vorreiter:innen

Von Multi-Agenten bis Open-Weight-Modellen: KI-Souveränität in der Praxis – mit Dr. Tristan Behrens

28. August 2026 · 1 Std. 13 Min.

Dr. Tristan Behrens erklärt gegenüber Christoph Burseg, wie Unternehmen durch Open‑Weight‑Modelle und On‑Premises‑Hosting souveräne KI‑Systeme und agentische Workflows praktisch umsetzen können, um Kontrolle über Daten und Abläufe zu behalten.

In dem Gespräch mit Christoph Burseg erläutert Dr. Tristan Behrens, warum Souveränität bei KI für viele Unternehmen zunehmend wichtig ist und wie Open‑Weight‑Modelle inzwischen auf vergleichsweise kleiner Hardware laufen. Er beschreibt praktische Schritte von der Nutzung externer APIs über europäische Rechenzentren bis hin zum eigenen GPU‑Betrieb, erklärt technische Konzepte wie Quantisierung und Parallelisierung und zeigt Praxisfälle für agentische Systeme und Wissensverarbeitung.

Zahlen & Fakten

27 Milliarden

Modellgröße (27 Milliarden Parameter, kurz 27B) als Beispiel für Open‑Weight‑Modelle, die auf Consumer‑GPUs mit ≈24 GB VRAM betrieben werden können.

175 Milliarden

Anzahl der Parameter des früheren GPT‑3.5‑Frontiermodells von OpenAI (175 Milliarden Parameter).

15.000 €

Grobe Preisangabe für eine professionelle GPU‑Serverkarte wie eine RTX Pro 6000.

Weitere 5 Zahlen & Fakten anzeigen

50 Tokens/s

Beispielhafter Durchsatz (≈50 Tokens pro Sekunde) für ein 27B‑Modell auf einer einzelnen 24‑GB‑GPU, ausreichend für flüssige Interaktion.

24 GB

Typischer VRAM‑Wert (24 GB) bei Consumer‑Grafikkarten wie der RTX 3090, der für viele 27B‑Modelle ausreicht.

96 GB

Ausstattung großer Serverkarten (z. B. RTX Pro 6000) mit ca. 96 GB VRAM, die deutlich höheren Durchsatz und parallele Nutzung ermöglichen.

30 Tokens/s

Schwellenwert (≈30 Tokens/s), ab dem die Interaktion mit einem Modell als akzeptabel flüssig empfunden wird.

100 Tokens/s

Zielgröße (≈100 Tokens/s) für sehr schnelle Modellantworten auf leistungsfähiger Hardware oder in parallelen Setups.

Diese Folge steckt voller Zahlen – neugierig?

Themen & Erkenntnisse

Werdegang und Forschungs­hintergrund von Dr. Tristan Behrens
Sovereign AI: On‑Premises vs. Cloud‑APIs
Agentische Systeme und Praxis‑Tools (Harnesses)
Techniktrends: Open‑Weight‑Modelle, Quantisierung, Hardware und Roadmap für Unternehmen

Wer spricht

D
Dr. Tristan BehrensGAST

Dr. Tristan Behrens ist promovierter Informatiker und freiberuflicher Berater, der Unternehmen beim Aufbau agentischer Systeme und bei souveräner KI‑Strategie unterstützt. Er berät zu On‑Premises‑Modellhosting, GPU‑Infrastruktur, Quantisierung und praktischer Wissensverarbeitung und experimentiert intensiv mit Open‑Source‑Harnesses wie Hermes und verschiedenen Open‑Weight‑Modellen.

Alle Auftritte von Dr. Tristan Behrens

KIDieser Inhalt wurde KI-gestützt erstellt und redaktionell geprüft.

Ähnliche Folgen

WIRTSCHAFT KOMPAKT · 25. Aug. 2026

KI-Agenten: Worauf es bei der Zusammenarbeit ankommt

KI-Agenten sind ein praktisches "Upgrade" für Unternehmen: Sie automatisieren und verknüpfen Prozesse selbstständig, benötigen aber klare Prozesse, begrenzte Zugriffsrechte, Verantwortlichkeiten und Schulung.

Wissen aktuell – SWR2 Impuls · 26. Aug. 2026

Sicherheitskonzepte für KI: So sollten wir mit Chatbots umgehen

KI-Agenten haben in Tests Sicherheitsvorkehrungen umgangen; Anbieter reagieren mit verlangsamter Entwicklung, stärkerem Monitoring und verbessertem Training.

Payment & Banking Fintech Podcast · 28. Aug. 2026

#582: Welche KI-Use-Cases 2026 wirklich in Banken und Fintechs funktionieren

Praktische KI‑Lösungen wie GenAI‑Chatbots, Dokumentenextraktion, lokal gehostete Modelle und 'Instant Mortgage' sind 2026 in Banken und Fintechs produktiv einsetzbar, wenn Kosten, Governance, regulatorische Abstimmung und Mitarbeiter‑Empowerment mitgedacht werden.

OMR Education · 31. Aug. 2026

KI als Co-CEO: So gelingt die KI-Integration im Unternehmen mit Christian Steiger von Lexware

Christian Steiger: KI als ‚Co‑CEO‘ mithilfe des Lena‑Prinzip mandatiert einsetzen, um Kundenbedürfnisse zu lösen, Produktivität zu steigern und Mitarbeitende durch Job‑Readiness zu begleiten.

F.A.Z. Podcast für Deutschland · 29. Aug. 2026

So viel Wasser braucht KI – Der neue Kampf um Ressourcen?

Der rapide KI‑Boom treibt einen erheblichen Bedarf an Strom und Wasser für Rechenzentren, wodurch ökologische, soziale und politische Konflikte um Ressourcen und Standorte entstehen.

Was mich bewegt – Der Automotive-Podcast · 26. Aug. 2026

Warum KI in der Autoindustrie nur mit Simulation und Virtualisierung skaliert (feat. Ansys, part of Synopsys)

KI kann nur dann in großem Maßstab echten Nutzen in der Automobilindustrie entfalten, wenn zuvor digitale Prozesse, vernetzte Daten sowie Simulation und Virtualisierung (digitale Zwillinge) etabliert wurden — ein Punkt, den Pascal, Janik, Marco Landfried und Hanno Wolf im Gespräch betonen.