KI-Gilde
Prompt und Antwort
Ein KI-generierter Podcasts rund um die Entwicklung von und mit KI. News, Updates und interessante Hintergrundinformationen für den professionellen Einsatz von KI hinaus. Ohne Hype und Buzzwords. Die KI-Gilde ist ein Angebot der YnotBetter UG.
Where to listen?
Podcasts in the app Replaio Radio Coming soonPodcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts
Episodes
154 - LLMs automatisiert knacken 27.04.2026 6:30
Sicherheitsleitplanken bei KIs sind keine harten Grenzen, sondern eine gefährliche Illusion. In dieser Folge zeigen wir, wie Forscher von Palo Alto und Unit 42 mithilfe von genetischen Algorithmen und automatisiertem Prompt-Fuzzing jedes bekannte Large Language Model (LLM) erfolgreich knacken konnten. Wir erklären die Mechanismen dahinter und diskutieren folgende Kernpunkte: Automatisierte Jailbre...
153 - Agenten verstehen: Warum Agenten am Multi-Turn scheitern 24.04.2026 18:12
In Folge 12 von "Agenten verstehen" widmen wir uns lokalen Modellen wie Gemma 4 und Qwen 3.6. Wir klären, warum lokale Agenten trotz gigantischer Kontextfenster bei längeren Dialogen (Multi-Turn) oft völlig den Faden verlieren und wie wir das architektonisch lösen. Die Themen dieser Folge: Der Multi-Turn-Kollaps: Warum Sprachmodelle durch "Aufmerksamkeitsverfall" (Attention Dec...
152 - KI-Modellbezeichnungen 22.04.2026 5:40
In dieser Folge des KI-Gilde Podcasts entschlüsseln wir die kryptischen Dateinamen lokaler KI-Modelle, die auf den ersten Blick wie zufällige Zeichenketten wirken. Am Beispiel eines komplexen Namens wie "Qwen3.6-35B-A3B-UD-IQ4_NL_XL.gguf" erklären wir die genaue Bauanleitung hinter den Modellen: Parameter und Mixture of Experts: Was der Unterschied zwischen den gesamten 35 Milliarden und...
151 - PromptFoo 20.04.2026 5:55
In dieser Episode des KI-Gilde Podcasts dreht sich alles um PromptFoo und die systematische Evaluierung von Large Language Models (LLMs). Statt Prompts nur nach Bauchgefühl zu testen, ermöglicht PromptFoo eine automatisierte Matrixevaluierung durch harte Regeln und semantische Prüfungen, bei denen ein anderes Sprachmodell als strenger Schiedsrichter fungiert. Wir beleuchten zudem, wie der „PromptF...
150 - Agenten verstehen: Kommunikationskanäle 17.04.2026 28:36
Willkommen zur 11. Folge der Serie "Agenten verstehen" im KI Gilde Podcast. In dieser Episode dreht sich alles um die Kommunikation mit autonomen KI-Agenten (wie dem Hermes-Agenten) und deren Anbindung an Alltags-Messenger wie WhatsApp, Slack oder Telegram . Wir beleuchten die wichtigsten technischen Hürden und eleganten Lösungen moderner Agenten-Systeme: Gateway-Architekturen: Wie e...
149 - deathbyclawd.com 15.04.2026 6:52
In dieser Folge des KI Gilde Podcasts analysieren wir den Überlebensscanner deathbyclawd.com . Diese Seite berechnet einen sogenannten "Todespunktestand", der vorhersagt, wie schnell große Sprachmodelle herkömmliche SaaS-Produkte (Software as a Service) ersetzen werden. Die Kernthemen der Episode: Das Ende der Benutzeroberfläche: Warum viele teure Software-Abonnements im Kern nur simpl...
148 - LiteLLM 13.04.2026 7:23
In dieser Episode des KI Gilde Podcasts stellen wir das Tool LiteLLM vor, eine zentrale Vermittlungsstelle, die speziell für Entwickler und Plattformteams evaluiert wurde. LiteLLM löst das Problem der Modell-Fragmentierung, indem es als intelligentes Netzwerk zwischen der eigenen Anwendung und über 100 verschiedenen LLM-Anbietern fungiert. Die wichtigsten Themen dieser Folge auf einen Blick:...
147 - Agenten verstehen Teil 10: soul.md 10.04.2026 23:43
In dieser Folge von "Agenten verstehen" geht es um die "Seele" der Maschine. Wir klären, wie wir KI-Agenten aus ihrer täglichen Amnesie befreien und ihnen mit einer simplen Textdatei (soul.md) eine feste, konsistente Identität geben. Die Themen dieser Folge: Die Seele der Maschine: Warum simple Textdateien für die Identität eines Agenten robuster und fehlerresistenter sind und...
146 - Unsloth Studio 08.04.2026 6:27
In Episode 146 des KI Gilde Podcasts dreht sich alles um das neue Unsloth Studio. Mit dieser Plattform lassen sich große Sprachmodelle (LLMs) mit privaten Unternehmensdaten komplett lokal auf der eigenen Grafikkarte trainieren, ohne dass Daten an Cloud-Anbieter abfließen. Das Studio senkt den Grafikspeicher-Bedarf (VRAM) um bis zu 70 % und verdoppelt gleichzeitig die Trainingsgeschwindigkeit. Die...
145 - Odysee beim Agenten-Setup 06.04.2026 5:15
KI-Gilde Podcast Folge 145: Agent Learnings – Die Tücken lokaler KI-Agenten In dieser Episode nehmen wir euch mit auf unsere Odyssee: Die lokale Einrichtung des Hermes-Agenten als Projektmanagement-Assistent mit Googles neuem Gemma 4 Modell. Wir sprechen ungeschönt über die realen Hürden abseits des Hypes: Infrastruktur & Backend: Von Architektur-Problemen auf dem Mac Mini bis hin zur absurde...
144 - Agenten verstehen Teil 9: Hermes Agent 03.04.2026 27:39
In der neunten Folge des KI Gilde Podcasts zerlegen wir den revolutionären Hermes-Agenten . Wir werfen einen Blick hinter die perfekte Illusion: Nach außen ein simples Sprachmodell, im Hintergrund eine hochkomplexe, autonome Maschine. Die Themen dieser Folge: Die perfekte Illusion: Wie Hermes über eine Standard-Schnittstelle Millionen bestehende Anwendungen zum Agenten aufrüstet, ohne dass auch nu...
143 - Voxtral 01.04.2026 5:40
In dieser Folge des KI Gilde Podcasts dreht sich alles um Voxtral , ein bahnbrechendes Text-to-Speech-Modell mit 4 Milliarden Parametern. Mit einer extrem schnellen Reaktionszeit von nur 70 bis 90 Millisekunden durchbricht es bisherige Grenzen und ermöglicht durch die parallele Verarbeitung von Semantik und Akustik absolut flüssige Echtzeitgespräche. Wir beleuchten zudem das Drama um den Release:...
142 - TurboQuant 30.03.2026 6:11
In dieser Folge des KI Gilde Podcasts analysieren wir "TurboQuant", eine Technologie, die das VRAM-Speicherproblem bei langen KI-Unterhaltungen durch geniale mathematische Datenkompression löst. Mithilfe polarer Transformation und dynamischer Fehlerkorrektur schrumpft der Speicherbedarf ohne messbaren Qualitätsverlust auf ein Sechstel. Unsere Praxistests auf einer Nvidia RTX 4090 belegen...
141 - Agenten verstehen Teil 8: NanoClaw & Nanobot (Re-Upload) 27.03.2026 15:39
Re-Upload In dieser Folge von "KI-Agenten besser verstehen" holen wir die Theorie in die harte Praxis. Wir vergleichen zwei reale, produktionsfähige Systeme (nanobot und nanoclaw) und ziehen die ultimativen Lehren für die echte Welt: Agenten sind keine Magie, sondern handfestes Software-Engineering. Die Themen dieser Folge: Die große Entzauberung: Warum ein Agent im Kern kein intelligent...
140 - KI-Prozessoren 25.03.2026 6:47
In Folge 140 des KI Gilde Podcasts analysieren wir, ob die allgegenwärtigen neuen KI-Prozessoren (NPUs) von Intel und AMD nur cleveres Marketing oder ein echtes Upgrade sind. Wir erklären den Unterschied zwischen extrem effizienten NPUs und leistungshungrigen Grafikkarten und zeigen, warum die neuen Chips im Laptop-Alltag massiv Strom sparen, wenn lokale KI-Modelle ausgeführt werden. Außerdem bel...
139 - Cognee 23.03.2026 7:18
In dieser Folge des KI Gilde Podcasts dreht sich alles um Cognee , ein System, das großen Sprachmodellen ein echtes, lernendes Langzeitgedächtnis verleiht. Während herkömmliche KI-Modelle nach jedem Task wieder bei null anfangen und Standard-Abrufsysteme bei komplexen Verknüpfungen Ausfallraten von bis zu 40 % haben, strukturiert Cognee Informationen völlig neu. Das System kombiniert dafür drei ve...
138 - Agenten verstehen Teil 7: Multi-Agenten-Konzepte 20.03.2026 36:14
In Teil 7 der Serie "Agenten verstehen" geht es an das absolute Fundament: Die Architektur von Multi-Agenten-Systemen. Wir klären, warum ein unstrukturierter "Sack voll Agenten" im Chaos endet und wie man KI-Teams stattdessen zuverlässig orchestriert. Die Themen dieser Folge: * Die Agenten-Falle: Warum ein einzelnes Modell bei zu vielen Werkzeugen kognitiv kollabiert und unstru...
137 - Time to first Token 18.03.2026 7:18
In Folge 137 des KI Gilde Podcasts dreht sich alles um die "Time to First Token" – die entscheidende Wartezeit, bevor ein lokales KI-Sprachmodell die erste Silbe generiert. Wir beleuchten, was in der rechenintensiven Prefill-Phase passiert und warum der Aufbau des sogenannten Key-Value-Caches als Gedächtnis des Modells bei großen Kontexten schnell über 80 GB Arbeitsspeicher verschlingt....
136 - Googles Embedding-Modelle 16.03.2026 7:29
In der Folge 136 des KI Gilde Podcasts klären wir ein verbreitetes Missverständnis auf: Googles neue Embedding-Generation besteht nicht aus einem einzigen System, sondern aus zwei völlig unterschiedlichen Modellen für verschiedene Einsatzgebiete. Wir vergleichen die beiden neuen Architekturen: Embedding Gemma: Ein kleines, quelloffenes Modell, das extrem effizient ist und sich perfekt für datensch...
135 - Agenten verstehen Teil 6: Model Routing 13.03.2026 24:18
Die Themen dieser Folge: Die Multi-Modell-Strategie: Warum es ineffizient und teuer ist, für jede einfache Aufgabe immer das leistungsstärkste Sprachmodell zu nutzen. Kosten & Effizienz: Wie einfache Triage-Entscheidungen blitzschnell und günstig von kleinen Modellen gelöst werden und nur bei echten Problemen auf teure Hochleistungsmodelle eskaliert wird. Datenschutz & DSGVO: Wie das Syste...
134 - Qwen 3.5 11.03.2026 14:14
In Episode 134 des KI Gilde Podcasts klären wir, ob das neue Modell Qwen 3.5 die ultimative Allzweckwaffe für die lokale Ausführung auf dem eigenen Rechner ist. Wir analysieren die Architektur des gigantischen, multimodalen Sprachmodells, das mit 36 Billionen Token trainiert wurde und nativ 2011 Sprachen sowie komplexe Dokumentenlayouts versteht. Die Highlights der Folge: Architektur & Skalier...
133 - Anthropic vs. Pentagon 09.03.2026 5:30
In Folge 133 des KI Gilde Podcasts beleuchten wir den historischen Konflikt zwischen dem KI-Unternehmen Anthropic und dem Pentagon. Nach einem 200-Millionen-Dollar-Vertrag für hochmoderne KI-Modelle weigerte sich Anthropic, seine Technologie für Massenüberwachung und vollautonome Waffensysteme bedingungslos zur Verfügung zu stellen. Daraufhin stufte der US-Präsident das Unternehmen im Februar 2026...
132 - Agenten verstehen: Agenten-Schwärme 06.03.2026 15:40
In Teil 5 von "Agenten verstehen" stößt der allwissende Einzel-Agent an seine kognitiven Grenzen. Die Lösung: Der Agenten-Schwarm. Wir zeigen, wie spezialisierte KI-Teams zusammenarbeiten, ohne im Chaos zu versinken. Die Themen dieser Folge: Das Ende des Generalisten: Warum ein einzelnes Modell durch Fehlerfortpflanzung ("Kaskadeneffekte") scheitert und wie ein Triage-System Au...
131 - kostenfreie LLM-APIs 04.03.2026 6:24
In dieser Episode des KI Gilde Podcasts (Folge 131) analysieren wir kostenfreie APIs für Large Language Models (LLMs) beim Bau von Prototypen. Wir klären, warum Tech-Giganten teure Rechenleistung scheinbar verschenken – die wahren Motive reichen von Kundenbindung über Hardware-Demonstrationen bis hin zum massenhaften Datensammeln für Modelltrainings. Die wichtigsten Themen im Überblick: Aggregator...
130 - Pinokio 02.03.2026 6:15
In Folge 130 des KI Gilde Podcasts geht es um Pinokio – eine echte Revolution für lokale KI-Anwendungen. Erfahre, wie du komplexe KI-Programme und autonome Agenten mit nur einem Klick direkt auf deinem eigenen Rechner ausführst, ganz ohne teure Abos oder Server-Kenntnisse. Die Themen dieser Folge: Die Technik: Wie Pinokio durch simple Textdateien ("Bauanleitungen") und isolierte Ordner n...
Similar podcasts
Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.