Skip to content
Artwork for Ai Talk Podcast by Dominik Wojcik
News

Ai Talk Podcast by Dominik Wojcik

Dominik Wojcik

Wir sprechen über KI, LLMs, AI Agents, SEO und Online Marketing. Im Fokus stehen neue Tools, aktuelle Entwicklungen, praktische Learnings und die Frage, was davon wirklich nützlich ist und was eher Hype bleibt.

  • 16 episodes
  • Updated July 28

Episodes16

  • July 28 · 31 min

    Abyss Underwater Shooter Game – Claude Opus 5 baut ein 3D-Browsergame in 21 Stunden

    Ich teste Claude Opus 5 mit einem einzigen Prompt: Ein vollständiges Unterwasser-Ego-Shooter-Browsergame soll entstehen – mit Physik, God Rays, synthetischen Soundeffekten und KI-Gegnern. Das Experiment läuft 21 Stunden, verbraucht rund 15 Millionen Output-Token und koordiniert 67 Sub-Agents. Das Ergebnis heißt „Abyss", läuft im Browser auf Three.js und WebGL und erreicht einen Kritiker-Score von 6,33. Meinen größten Fehler benenne ich dabei offen. 00:00:04 Einstieg und Kontext 00:01:15 Dominiks Einordnung 00:01:41 Der Prompt 00:03:47 Sub-Agents, Kritiker-Loop und Ultra Code Mode 00:06:45 Gameplay-Demo: Abyss Control Deep 00:09:38 Visuelle Details und Soundeffekte 00:13:12 Chatverlauf und Entwicklungsprozess 00:14:50 Fehler: VPS ohne GPU 00:15:43 Server-Absturz durch Sub-Agent-Überlastung 00:17:52 104 Fehler gefunden 00:18:20 RAM-Crash und Selbstreparatur 00:19:17 Zwischenstatus Sonntagfrüh 00:22:19 Performance-Benchmark: von 3,92 auf 5,35 00:23:24 Die Zahlen: 67 Agents, 15 Mio. Token, 3 MB 00:24:14 Kritiker-Endscore 6,33 00:25:34 2.300 Screenshots und 68 Stunden CPU-Renderzeit 00:26:09 Mit GPU: 2,5 Stunden statt 68 Stunden 00:27:22 Dominiks Fazit und Prompt-Strategie 00:29:19 Vision: SaaS-Subscriptions durch agent-gebaute Software ablösen 00:30:34 Opus 5 vs. Fable 5

  • July 22 · 27 min

    Reachy Mini im Praxistest: Aufbau, KI-Integration und Smart-Home-Vision

    Der Reachy Mini von Pollen Robotics kommt als Bausatz, läuft auf einem Raspberry Pi und lässt sich mit eigenen KI-Features erweitern. In dieser Folge geht es um Aufbau, Hardware-Innenleben, OpenAI Realtime 2.1 als Sprachschnittstelle, lokale Gesichtserkennung via InsideFace, Wake-Word-Training und die Vision eines smarten Home Assistants mit echtem LLM im Hintergrund. Kapitel: 00:00:13 Intro: Was ist der Reachy Mini? 00:00:35 Preise, Versionen und Lieferzeit 00:01:23 Unboxing und Aufbau 00:02:15 Live-Demo: Erste Interaktion mit Wall-E 00:03:35 Demo: Wetter und Kalender per Sprachbefehl 00:05:09 Eigene Erweiterungen 00:06:27 Sprachmodell: OpenAI Realtime 2.1 vs. Mini-Modell 00:12:22 Dashboard und Lüfter-Anpassung 00:13:38 Hardware-Innenleben: Kamera, Motoren, Raspberry Pi 00:15:17 Gesichtserkennung und Long-Term Memory 00:19:00 Entwicklung mit Fable 5 und dem offiziellen SDK 00:19:11 Remote-Zugriff und Weiterentwicklung 00:19:30 Geplante Smart-Home-Integrationen 00:20:23 Hardware: Akku und Positionierung 00:21:09 Kostenwarnung zur Real Time API 00:21:33 Passivmodus und Wake-Word-Strategie 00:22:23 Wake-Word-Training mit Google Colab 00:23:05 Autarker Betrieb auf Raspberry Pi 00:23:31 Praxisprobleme und Feintuning 00:25:14 Vision: Smartes Alexa-Äquivalent mit LLM 00:26:31 Vergleich: Reachy 2 als größere Alternative Shownotes: - Reachy Mini Produktseite von Pollen Robotics: https://pollen-robotics.com/reachy-mini/

  • July 18 · 57 min

    Fable 5 entwickelt Retro Fußball Manager Spiel!

    Dominik präsentiert Matchday Legends – einen Retro-Fußballmanager, den er in rund drei Wochen vollständig mit Fable 5 via Claude Code entwickelt hat. Das Spiel ist kostenlos unter matchdaylegends.com verfügbar und integriert LLM-Funktionen für Spielberichte, Fanpost, Halbzeitansprachen und Pressekonferenzen. Dazu ordnet Dominik die aktuelle Modelllandschaft ein: Kimi 3.0 gilt ihm als erste chinesische Frontier-Alternative auf Claude-5-Niveau. 00:00:08 Fable 5 bleibt in 200-Dollar-Subscriptions 00:01:30 Kimi 3.0 als neue Frontier-Alternative 00:04:19 Modellgrößen: Kimi 3.0 vs. Fable 5 00:06:14 Projektvorstellung: Matchday Legends 00:07:31 Inspiration: Retro-Fußballmanager der 90er 00:10:50 Spielkonzept und LLM-Integration 00:12:36 Live-Demo: Matchday Legends 00:17:05 Aufstellungsfeld und Positionssystem 00:18:19 Spielermoral und Stimmungssystem 00:19:13 Einzelgespräche mit Spielern 00:21:50 Fitness, Form und Spielsimulation 00:22:57 Trainingsplan und Trainingslager 00:24:21 Einzeltraining und Spielerentwicklung 00:25:40 Scouting-System 00:26:24 Stadionausbau und Fanshop 00:28:07 Transfermarkt und Transferfenster 00:30:03 Finanzsystem: Kredit, Sponsoren, Kontostand 00:31:23 Ligen, Wettbewerbe und Spielplan 00:33:08 KI-generierte Spielberichte 00:34:20 Manager-Karriere: Experience, Perks und Vitrinen 00:35:19 Kisten-System und Drop-Rates 00:37:04 Community-Features und geplante KI-Bug-Umsetzung 00:37:25 Adminbereich: LLM-Kosten und Nutzungsübersicht 00:38:01 Asset Manager: Spielerportraits per Banana generieren 00:40:06 KI-generierte Fanpost 00:40:49 Live-Spielsimulation: HSV vs. FC München 00:42:27 Halbzeitansprache und KI-Bewertung 00:46:39 Kabinenbericht nach Spieltag 00:47:16 Pressekonferenz mit vollem Spielkontext 00:51:05 Saisonablauf und Spielstruktur 00:51:35 Entwicklung mit Fable 5 und Claude Code 00:52:14 Aktueller Stand: Bugs und geplante Features 00:53:07 LLM als Kern-Feature 00:54:34 Matchday Legends als Progressive Web App 00:55:07 Geschäftsmodell: Free to Play, keine Werbung 00:56:03 Outro und Feedback-Aufruf Shownotes: - Matchday Legends — Der Retro-Fußballmanager: https://matchdaylegends.com/

  • July 7 · 29 min

    China sperrt KI-Modelle ab – Hy3, Atlas 300N & Modell-Gerüchte

    Chinas Handelsministerium hat Meetings mit Alibaba, ByteDance und Z.ai abgehalten, um den Zugang zu Frontier-Modellen für ausländische Nutzer einzuschränken – betroffen wären auch Open-Weight-Modelle. Gleichzeitig veröffentlicht China neue Modelle wie Tencents Hunyuan Hy3 und Meituans LongCat-Avatar, und auf der Hardware-Seite taucht die Huawei Atlas 300N mit 96 GB VRAM für rund 2.100 € als mögliche Inferenz-Alternative auf. Dazu: bestätigte und unbestätigte Modell-Releases, Samsung-Quartalszahlen und die Frage, ob der KI-Hype sich abkühlt. 00:00:08 China erwägt Zugangsrestriktionen für KI-Modelle 00:01:38 Auswirkungen auf Europa 00:02:41 Fable 5: Status, Qualitätsveränderungen und Subscription-Ende 00:06:06 Samsung-Quartalszahlen und KI-Aktienmarkt 00:08:03 GPT-Realtime-2.1-mini in der API 00:09:03 Grok 4.5, GPT-5.6 und Gemini 3.5 Pro: Gerüchte einordnen 00:12:23 Gemini 3.5 Pro: Erste Eindrücke 00:14:32 Tencent Hunyuan Hy3: Preise, Lizenz und Benchmarks 00:19:00 Meituan LongCat-Avatar: Open-Source-Videotool 00:20:39 Huawei Atlas 300N: 96 GB GPU für ~2.100 € 00:22:03 Einschränkungen der Huawei-Karte 00:24:07 Inferenz vs. Training: Lokale GPU oder Cloud 00:25:13 Chinesischer neuromorpher Chip und DeepSeek-eigener Chip 00:27:13 Einschätzung: Chip-Lücke schließt sich in 2–3 Jahren 00:29:05 Modell-Ausblick: Opus 4.8 und möglicher Codex-Release Shownotes: - Samsung-Gewinn, Aktieneinbruch und KI-Bubble-These: https://x.com/Danny_Crypton/status/2074428783961027060 - China erwägt Exportrestriktionen für Frontier-Modelle: https://x.com/jukan05/status/2074443936865960205 - DeepSeek entwickelt eigenen Chip (Reuters, nicht verifizierbar): https://www.reuters.com/world/china/chinas-deepseek-developing-its-own-ai-chip-sources-say-2026-07-07/ - GPT-Realtime-2.1-mini offiziell in der API: https://x.com/OpenAIDevs/status/2074255408013955466 - Grok 4.5 UI-Spuren entdeckt: https://x.com/testingcatalog/status/2074214554523816272 - Meituan LongCat-Avatar Open Source: https://x.com/CopyRebeldia/status/2074301966566765056 - GPT-5.6 und Gemini 3.5 Pro als Gerüchte: https://x.com/goodworse/status/2074239359990280462 - Hunyuan Hy3 Benchmark gegen Fable 5 und Sonnet: https://x.com/thehypedotnews/status/2074259599658562023 - GPT-5.6 Gerücht ohne offizielle Bestätigung: https://x.com/bridgemindai/status/2074085552194801920 - Hunyuan Hy3 Kostenvergleich mit Gemini 3.5: https://x.com/atomic_chat_hq/status/2074202885517443364 - Hy3 API-Preise auf OpenRouter: https://openrouter.ai/tencent/hy3:free - Reddit : https://www.reddit.com/r/LocalLLaMA/comments/1up9x38/so_anyone_copped_one_of_these/

  • July 3 · 49 min

    Reaction Podcast - Palantir, Alex Karp & die KI-Machtfrage: Application Layer, Token-Ökonomie und globale KI-Kräfteverhältnisse

    Alex Karp, CEO von Palantir, gibt ein CNBC-Interview anlässlich eines Nvidia-Deals – und liefert dabei eine scharfe Analyse der KI-Ökonomie. Der Host ordnet Karps Thesen ein: Wo stimmt er zu, wo widerspricht er, und was bedeutet das für Unternehmen, die heute mit KI arbeiten? 00:00:07 Intro & Kontext 00:01:08 Nvidia-Palantir-Deal 00:03:54 Palantirs Architektur 00:05:06 Karps Kritik an Frontier Labs 00:07:05 Token Chilling 00:10:03 Enterprise-Kontrolle 00:11:35 Host widerspricht beim Datenschutz 00:13:50 Die 30-Prozent-Forderung 00:17:37 Wo Geld verdient wird 00:18:13 Palantir als Proof-of-Concept 00:19:14 Datenstrukturen als Voraussetzung 00:20:43 Open-Weight vs. Open Source 00:21:14 Sicherheitsrisiko chinesische Modelle 00:24:56 Backend-Blindheit bei CEOs 00:25:58 Open-Weight als Frontier-Alternative 00:26:27 Kostenrechnung Open-Weight 00:29:41 Palantir & Nvidia: Eigene Infrastruktur 00:32:25 Modell-Agnostizismus als Strategie 00:35:57 Anthropic in Palantir-Produkten 00:38:08 Globale KI-Machtzentren 00:41:17 China: Rückstand mit Siebenmeilenstiefeln 00:46:38 Host-Fazit zum Dario-Interview 00:47:08 KI-Modelle separieren sich 00:48:09 Wer profitiert wirklich von KI 00:48:40 Frontier-Modelle sicher einsetzen

  • July 1 · 36 min

    AI Talk #11 – Fable 5 zurück, Sonnet 5, OpenAI halbiert Inferenzkosten, Gemini Omni Flash, Zero Coding Harness, NotebookLM Short Videos

    Claude Fable 5 kehrt nach Gesprächen mit der US-Regierung global zurück, Anthropic führt Claude Sonnet 5 als neues Default-Modell ein, OpenAI halbiert intern die Inferenzkosten, Google bringt Gemini Omni Flash und Nano Banana 2 Lite, das Coding-Framework Zero behauptet fünffache Geschwindigkeit gegenüber OpenClaude, NotebookLM generiert 60-Sekunden-Kurzvideos, und rund um Claude Code kursiert ein unbestätigter Backdoor-Vorwurf. Dazu: Meta sperrt Claude Code und Codex für interne Entwickler, und Meituan LongCat 2.0 als Randthema. Kapitel: 00:00:04 Intro & Themenübersicht 00:01:37 Claude Fable 5 ist zurück 00:05:23 Fable 5 00:06:08 Claude Sonnet 5 00:14:11 OpenAI halbiert Inferenzkosten intern 00:16:00 KV-Caching als mögliche Technik erklärt 00:19:05 Google Nano Banana 2 Lite 00:20:00 Google Gemini Omni Flash 00:22:33 Zero Coding Harness 00:25:05 NotebookLM Short Videos 00:27:24 Meituan LongCat 2.0 00:31:11 Claude Code Backdoor-Vorwurf 00:33:36 Meta sperrt Claude Code und Codex Shownotes: - Anthropic kündigt Rückkehr von Claude Fable 5 an: https://x.com/AnthropicAI/status/2072163884430229756 - OpenAI halbiert Inferenzkosten, Gross Margin steigt: https://x.com/MTSlive/status/2072010661102830050 - Gemini Omni Flash – Video-Editing zu 0,10 $/Sek: https://x.com/Hesamation/status/2072011610802077782 - Nano Banana 2 Lite und Gemini Omni Flash: https://x.com/OfficialLoganK/status/2071988351083921690 - Zero Coding Harness – 5x schneller als OpenClaude: https://x.com/kevincodex/status/2071779695616749887 - Sonnet 5 Kosten laut Brian Roemmele: https://x.com/BrianRoemmele/status/2072084339265835125 - NotebookLM Short Video Overviews angekündigt: https://x.com/NotebookLM/status/2071987494799716626 - Claude Sonnet 5 offiziell eingeführt: https://x.com/claudeai/status/2072017450611142835 - Claude Code Backdoor-Vorwurf auf Reddit (unbestätigt): https://www.reddit.com/r/ClaudeAI/comments/1ujila1/anthropic_embedded_spyware_in_claude_code_and/ - Claude Code Zeitzonenprüfung – chinesischsprachiger Bericht: https://x.com/AISuperDomain/status/2071872960114417727 - Meta sperrt Claude Code und Codex intern: https://x.com/Polymarket/status/2071623403669180483 - Meituan LongCat 2.0 – 1,6T Parameter, MoE, 1M: https://x.com/Meituan_LongCat/status/2071783587205308721

  • June 27 · 47 min

    ChatGPT 5.6 gestoppt, Alibaba destilliert Claude, OpenAI Codex-Zahlen & Jalapeño Chip

    AI Talk #10 – Die Trump-Administration greift aktiv in KI-Releases ein, Alibaba destilliert Claude im großen Stil, und OpenAIs interne Codex-Zahlen zeigen, wie weit Agentic AI bereits in den Arbeitsalltag vorgedrungen ist. Themen dieser Folge: 00:00:08 | Intro & Wochenüberblick 00:04:38 | Trump-Administration bremst Modell-Releases 00:06:14 | ChatGPT 5.6 – Enterprise-Rollout und GPT-5.5 Instant 00:07:42 | Weißes Haus Feedback-Session vom 9. Juni 00:13:02 | Alibaba destilliert Claude – 25.000 Accounts, 28,8 Millionen Exchanges 00:15:19 | Wie Destillation funktioniert – Host-Eigenexperiment 00:19:30 | Cursor-Forschung: Benchmarks ohne Web-Zugang 00:21:20 | Eigener Domain-Benchmark als realistischer Prüfstand 00:24:47 | OpenAI intern: Codex-Adoption von ChatGPT zu 97,9 % Codex-Token-Anteil 00:27:39 | Externe Kunden und Consumer-Nutzung von Codex 00:31:02 | Finance, Legal, Recruiting – Non-Developer-Adoption bei OpenAI 00:32:19 | Token-Explosion nach Abteilungen 00:36:01 | Ornith-1.0: Selbstlernendes Open-Source-Coding-Modell 00:37:38 | OpenRouter MCP-Server: Modellauswahl direkt im Agenten 00:40:12 | Elon Musk postet "Citizen Vigilante" auf X 00:45:03 | OpenAI & Broadcom: Eigener KI-Chip Jalapeño 00:46:14 | Outro & Verabschiedung Shownotes: GPT-5.5 Instant rollt jetzt für Pro, Plus und Free aus – offizieller Post von ChatGPT. https://x.com/ChatGPTapp/status/2069851262498291919 Leak zu GPT-5.6: Enterprise-Testing läuft, neue "max reasoning effort"-Stufe, keine Preisänderungen. https://x.com/synthwavedd/status/2070201847655112820 Trump-Administration und OpenAI: Lutnick kontaktiert Altman, White House fordert Kunden-für-Kunden-Genehmigung. https://x.com/leomschwartz/status/2070242943563075752 The Information – Hintergrundartikel zum Trump-OpenAI-Konflikt (Paywall). https://www.theinformation.com/articles/trump-administration-asks-openai-stagger-release-new-model-security-concerns Anthropic meldet Alibaba-Destillationsangriff: 28,8 Millionen Exchanges über knapp 25.000 Fake-Accounts. https://x.com/MTSlive/status/2070141140607832353 Polymarket zur Frage, ob Claude Fable bis Juli wiederhergestellt wird – 56 % Wahrscheinlichkeit. https://x.com/Polymarket/status/2069892570214179081 Cursor-Forschung: Modelle wie Opus 4.8 und Composer 2.5 rufen Benchmark-Lösungen aus dem Internet oder der Git-History ab. https://x.com/cursor_ai/status/2070195789121671624 OpenAI-Post zu internen Codex-Adoptionsdaten – Agenten transformieren die Arbeit in allen Abteilungen. https://x.com/OpenAI/status/2070196105745518913 OpenAI-Blogpost: Wie Agenten die Arbeit bei OpenAI intern verändern – Economic Research Paper zu Codex. http://openai.com/index/how-agents-are-transforming-work/ OpenRouter MCP-Server: Live-Modell-Intelligence mit 400+ Modellen direkt im Agenten. https://x.com/OpenRouter/status/2070160491360780798 DeepReinforce veröffentlicht Ornith-1.0 – selbstlernendes Open-Source-Coding-Modell mit 397B MoE und 9B Edge-Variante. https://x.com/testingcatalog/status/2070153054679179400 OpenAI stellt ersten eigenen KI-Chip Jalapeño vor, entwickelt mit Broadcom. https://x.com/OpenAI/status/2069770172802773292

  • June 23 · 38 min

    AI Talk #9 – Sakana Ai, ByteDance SeeDance 2.5, ElevenLabs Ads Engine, Sonnet 5 Leak & Deals

    ByteDance veröffentlicht Seedance 2.5: native 4K-Auflösung, Videos bis 30 Sekunden, 50 Referenzmaterialien und 3D-Modell-Support. Seedance 2.0 bekommt ebenfalls ein 4K-Update. ByteDance bleibt damit State of the Art bei KI-generierten Videos – Physik und Bewegungsabläufe sind aber noch die erkennbare Schwachstelle. ElevenLabs stellt die Ads Engine vor: Bestehende Ad-Kampagnen lassen sich automatisch in 50 Sprachen übertragen, inklusive Review-Funktion. Wer Bild-Text-Kombinationen übersetzt, sollte den Review-Schritt einplanen. Geleakte Infos zu Sonnet 5 deuten auf ein 1-Million-Token-Kontextfenster, stärkere Coding-Performance und ein besseres Preis-Leistungs-Verhältnis als Opus und Fable hin. Der Release wurde für diese Woche erwartet. Sakana AI aus Japan – mitgegründet von einem der Autoren des „Attention is all you need"-Papers – zeigt einen Multi-Modell-Orchestrator, der Open- und Closed-Source-Modelle über eine Standard-API anspricht. Das Produkt läuft unter dem Namen Sakana Ultra, kostet ca. 25–30 Dollar und ist aktuell nicht in der EU zugelassen. Externe Praxistests von Marc Santos und lmjunkie zeigen: Herstellerversprechen und Benchmark-Ergebnisse fallen in der Praxis teils deutlich auseinander. Google investiert 75 Millionen Dollar in eine Forschungspartnerschaft mit Studio Zwei (A24), um AI-Tools direkt in Filmprozesse zu integrieren und Feedback von Kreativen für die Modellentwicklung zu nutzen. Reflection AI mietet Compute bei SpaceX Colossus für 150 Millionen Dollar pro Monat bis 2029 – Gesamtvolumen 6,3 Milliarden Dollar, mit GB 300 Chips aus State Center Zwei. Cursor trainiert ebenfalls bei Colossus; ein Cursor-Modell könnte das erste konkrete Ergebnis aus dieser Infrastruktur sein. Kapitel: 00:00:05 Intro & Wochenüberblick 00:00:32 ByteDance Seedance 2.5 00:10:16 Seedance 2.0 Update 00:10:39 ElevenLabs Ads Engine 00:14:59 Sonnet 5 Leaks 00:19:06 Sakana AI – Multi-Modell-Orchestrator 00:20:31 Sakana Ultra – Funktionsweise 00:22:13 Sakana Ultra – Benchmarks vs. Realität 00:23:01 Sakana Ultra – Preis und EU-Verfügbarkeit 00:25:30 Praxistest Marc Santos: Sakana Ultra vs. Claude Opos 4.8 00:27:58 Praxistest llmjunkie: Enttäuschung und Limit-Problem 00:30:20 Google investiert 75 Mio. Dollar in Studio Zwei 00:35:14 SpaceX Colossus – Reflections-Deal 00:37:38 Cursor trainiert bei Colossus Shownotes: Google DeepMind und A24 kündigen eine Forschungspartnerschaft zur Integration von AI-Tools in Filmprozesse an. https://blog.google/innovation-and-ai/models-and-research/google-deepmind/deepmind-a24-research-partnership/?utm_source=x&utm_medium=social&utm_campaign=&utm_content= SpaceX schließt laut CNBC-Bericht einen Compute-Deal mit Reflection AI über bis zu 6,3 Milliarden Dollar bis 2029. https://de.finance.yahoo.com/nachrichten/bericht-spacex-schlie%C3%9Ft-6-3-164616506.html ElevenLabs stellt die Ads Engine vor: Ad-Kampagnen automatisch in 50 Sprachen übersetzen und direkt zurück in die Ad-Plattform pushen. https://x.com/ElevenLabs/status/2069111326987673761 ByteDance veröffentlicht Seedance 2.5 mit 4K-Auflösung, 30-Sekunden-Videos und 50 Referenzmaterialien. https://x.com/xiaohu/status/2069267306182762907 Leak zu Claude Sonnet 5 mit internem Codenamen Fennec, 1M-Token-Kontextfenster und starker Coding-Performance. https://x.com/LuminaXspace/status/2068720875340210329 Google investiert in das Filmstudio hinter A24 – WSJ-Bericht zum Deal. https://www.wsj.com/tech/ai/google-investing-in-backrooms-studio-a24-e7585ebe sakana.ai https://sakana.ai/

  • June 19 · 48 min

    GLM-5.2 ist da! ChatGPT-5.6-Leaks und Midjourney baut was komplett Irres – AI Talk #8

    AI Talk #8 – 19.06.2026 Drei parallele Bewegungen prägen diese Woche: Open-Source-Modelle holen ernsthaft auf, Coding-Tools bauen sich zu vollständigen Entwicklungsplattformen aus – und Midjourney überrascht mit einem Pivot, der nichts mehr mit Bildgenerierung zu tun hat. GLM-5.2 von ZAI.org (Zhipu AI) springt im internen Mobile-Dev-Benchmark von 21/70 auf 48/70 – Claude Fable 5 liegt bei 56/70. Im Kilo-Code-Benchmark trennen GLM-5.2 (9,0) und Fable 5 (9,1) nur noch 0,1 Punkte. Dank Unsloth-Quantisierung schrumpft das Modell von 1,51 TB auf 238 GB und läuft auf einem 256-GB-Mac. Trainiert wurde es vollständig auf Huawei Ascend Chips – kein Nvidia. Emad Mostaque schätzt die Trainingskosten auf rund 25 Mio. USD, davon 80 % Post-Training. Wir ordnen ein, was der „DeepSeek-R1-Moment"-Vergleich wert ist – und warum der interne Benchmark kritisch zu betrachten ist. Cursor hielt seine erste eigene Konferenz ab und kündigte gleich drei Dinge an: Cursor Mobile (iOS-Beta auf TestFlight), Origin (ein GitHub-Konkurrent für die agentische Ära, mit automatischer Merge-Konflikt-Lösung und Graphit-Integration) sowie ein eigenes Modell mit 1,5 Billionen Parametern, trainiert auf 100.000 GPUs. Dazu kursiert ein unbestätigter Tweet über eine SpaceX-Übernahme für 60 Mrd. USD – wir ordnen das klar ein. Bei OpenAI: Noam Shazeer – Transformer-Mitbegründer, zuletzt bei Google und Character.AI – wechselt zu OpenAI. Codex bekommt ein iOS-Build-Plugin mit SwiftUI-Previews und Hot Reload sowie eine frühe Implementierung des Chrome DevTools Protocol. Und Leaks deuten auf GPT-5.6 am 23. Juni hin: rund 3× günstiger als Fable, bis zu 1,5M Token Kontext – laut Insider aber kein Fable-Klasse-Modell. Das eigentliche Ziel soll ein „Auto Research Assistant" sein, gefolgt von Vera-Rubin-Class-Modellen Ende des Jahres. Midjourney kündigt den weltweit ersten Ganzkörper-Ultraschall-CT-Scanner an: Nutzer werden während des Scans in Wasser getaucht, 3D-Körperkarten in unter einer Minute, mehr als 25 Organe, keine Strahlung, FDA-Prozess läuft, Marktstart Ende 2027. Die einzige Quelle ist ein Sekundär-Tweet – wir ordnen die technischen Claims entsprechend ein. Dazu praktische Tool-Tipps: Jina ist jetzt kostenlos als Web-Scraping-API verfügbar. Exa Agent bietet Web-Research für unter 50 % der Kosten von GPT-5.5 und Opus. Und Headroom – ein Open-Source-Tool von Netflix-Engineer Tejas Chopra – reduziert Token-Verbrauch durch Context-Trimming: seine eigene Rechnung sank von 280 USD auf 110 USD, die Community hat damit zusammen über 700.000 USD gespart, das Repo hat über 37.000 Stars. --- Shownotes: GLM-5.2 Benchmark-Ankündigung von Zixuan Li – interner Mobile-Dev-Benchmark, 48/70 vs. Claude Fable 5 mit 56/70: https://x.com/ZixuanLi_/status/2067803136283005393 Emad Mostaque zu GLM-5.2 – Training auf Huawei Ascend, geschätzte Kosten ~25 Mio. USD, ZAI.org-Marktkapitalisierung: https://x.com/EMostaque/status/2067208281727054123 Noam Shazeer bestätigt Wechsel zu OpenAI – eigener Post des Transformer-Mitbegründers: https://x.com/NoamShazeer/status/2067400851438932297 OpenAI Codex iOS-Build-Plugin – SwiftUI-Previews und Hot Reload direkt in Codex, kein Copy-Paste-Loop mehr: https://x.com/kedytcom/status/2067190011192078535 GPT-5.6-Leak (ChrissGPT) – iterative Verbesserung auf 5.5, kein Fable-Klasse-Modell https://x.com/ChrissGPT/status/2066917962704171443 GPT-5.6-Leak (KaiXCreator) – gerüchteter Release 23. Juni, https://x.com/KaiXCreator/status/2066070890794962949 Watcher.Guru zu SpaceX/Cursor https://x.com/WatcherGuru/status/2066844381504561211 Madni Aghadi zur Cursor Compile-Konferenz https://x.com/hey_madni/status/2067153200852193339 Midjourney kündigt Ganzkörper-Ultraschall-CT-Scanner an https://x.com/CultureCrave/status/2067447354962362475 Exa Agent https://x.com/ExaAILabs/status/2066946215250690228 Headroom von Tejas Chopra (Netflix) – https://x.com/heynavtoor/status/2063225203946402146

  • June 16 · 45 min

    Fable 5 abgeschaltet: China-Verdacht, Jailbreaks & was jetzt kommt | AI Talk #7

    Anthropics mächtigstes Modell Fable 5 wurde auf Druck der US-Regierung deaktiviert – und die Hintergründe sind widersprüchlicher als die offizielle Kommunikation vermuten lässt. In dieser Folge geht es um die zwei konkurrierenden Erklärungen: David Sacks nennt einen Jailbreak als Auslöser, ein Semafor-Bericht deutet auf chinesischen Zugriff hin – Anthropic selbst sagt, China sei in den Gesprächen mit der Regierung nie Thema gewesen. Dazu kommt ein handfester Interessenkonflikt: Amazon-Forscher sollen hinter dem Jailbreak-Report stehen, der den US-Crackdown auslöste. Technisch wird es beim Blick auf die Jailbreak-Methoden: Homoglyphen, Unicode, kyrillische Zeichen, Fiction Framing und Decomposition-Recomposition – Techniken, die zeigen, wie fragil Guardrails wirklich sind. Als direkten Ersatz stellt Dominik die OpenRouter Fusion API vor: Mehrere LLMs arbeiten parallel, ein Judge-Modell synthetisiert die Ergebnisse. Der Anspruch – Fable-5-Niveau bei halbem Preis – wird kritisch eingeordnet, inklusive Benchmark-Einschränkungen und einem Bug beim Judge-Modell. Weitere Themen: Kimi 2.7 mit 33 % weniger Thinking Tokens, ein Leak zu GPT-6 mit 10-Millionen-Token-Kontextfenster, GLM-Aktie +50 % als Profiteur der US-Exportbeschränkungen, explodierende GPU-Preise für lokale Inferenz (+55 % bei der Nvidia RTX Pro 6000) und ein GitHub-Repository mit geleakten System Prompts – darunter Fable 5 mit 3.800 Zeilen und rund 70.000 Token. Kapitel: 00:00:06 Intro & Überblick 00:00:34 Fable 5 abgeschaltet 00:06:17 Hintergründe: China-Verdacht & Exportbeschränkungen 00:07:48 Jailbreaks: Wie Fable 5 gebrochen wurde 00:10:05 Interessenkonflikt Amazon & Anthropic 00:11:13 Konsequenzen für Nutzer & Rückerstattung 00:16:06 OpenRouter Fusion API – Konzept & Funktionsweise 00:17:37 Fusion-Benchmark: Besser als Claude 4 Solo? 00:19:16 Multi-LLM-Orchestrierung als Kostenstrategie 00:22:10 Kimi 2.7: Ehrlichere KI, 33 % weniger Thinking Tokens 00:24:58 WM 2026 als KI-Datenprojekt 00:31:09 GPT-6 Leak: 10 Millionen Token Kontextfenster 00:33:13 GLM-Aktie +50 %: Profiteur der US-Exportbeschränkungen 00:37:00 Nvidia RTX Pro 6000: +55 % teurer 00:38:59 GitHub der Woche: Geleakte System Prompts 00:41:37 Strategie: Fremde System Prompts als Qualitätshebel 00:42:21 Outro Shownotes: The Verge berichtet über den Verdacht, dass eine China-nahe Gruppe Zugriff auf Anthropics Mythos hatte – Hintergrund zu den Exportbeschränkungen: https://www.theverge.com/ai-artificial-intelligence/949644/china-white-house-anthropic-mythos Pliny the Liberator dokumentiert öffentlich den Jailbreak von Fable 5 mit konkreten Techniken: https://x.com/elder_plinius/status/2064776322979676227 OpenRouter stellt die Fusion API vor – Prompts parallel an mehrere Modelle, ein Judge synthetisiert die Antwort: https://x.com/OpenRouter/status/2065856853989270011/photo/1 Screenshot-Leak: GPT-6 mit 10-Millionen-Token-Kontextfenster in Codex gesichtet – unbestätigt: https://x.com/Amank1412/status/2065821124299194800 BofA-Analyse zur WM 2026 als KI-Datenprojekt: 90 Petabyte direkte Turnierdaten, bis zu 2 Exabyte gesamt: https://finance.yahoo.com/news/the-first-ai-world-cup-is-an-11-billion-money-machine-chart-of-the-day-133000537.html PC Games Hardware zur Nvidia RTX Pro 6000: Preis von 8.565 $ auf 13.250 $ gestiegen, Treiber ist GDDR7-Knappheit: https://www.pcgameshardware.de/Grafikkarten-Grafikkarte-97980/News/RTX-Pro-6000-Preis-13250-US-Dollar-1545247/ GitHub-Repository mit geleakten System Prompts von Claude Fable 5, Opus 4.8, GPT 5.5, Gemini 3.5 und weiteren Modellen – wird laufend aktualisiert: https://github.com/asgeirtj/system_prompts_leaks Newsletter von Dominik Wojcik – KI-News, Tool-Tipps und Strategien kompakt aufbereitet: https://wojcik.de/newsletter#anmelden - Quelle zu Reddit - Please wait for verification: https://www.reddit.com/r/ClaudeAI/comments/1u4dij4/megathread_for_us_government_suspension_of_fable/

  • June 12 · 35 min

    Bis zu 14.000€ Token-Wert für 200€ Abo!, Google erfolgreich verklagt, etc...| AI Talk 11.06.2026

    OpenAI und Anthropic subventionieren ihre Abo-Modelle massiv – und eine neue Analyse zeigt, wie extrem das Missverhältnis wirklich ist. 00:00:06 | Intro & Themenüberblick Worum es geht: Preiskampf, Fable-Test, Google-Haftung 00:00:34 | Claude Fable – Ersteindruck Mythos-Architektur, Stärken im Coding, Schwächen in anderen Wissensbereichen 00:01:13 | Fable vs. Opus 4.8 Direktvergleich im Host-Workflow – Opus 4.8 bleibt vorn 00:03:09 | Fable fliegt aus Subscriptions Zugang endet ~22. Juni; danach nur noch API zu 50 $/1M Token 00:05:00 | Subscription vs. API – Die Subventions-Analyse SemiAnalysis-Daten: Token-Gegenwert je Plan von Claude Pro bis ChatGPT Pro 00:07:00 | Die 14.000-Dollar-Zahl erklärt ChatGPT Pro (200 $/Monat) entspricht ~14.000 $ API-Gegenwert; Claude Max (200 $) ~8.000 $ 00:08:07 | Break-even und Margenrisiko Anthropic break-even bei ~20 % Auslastung; OpenAI-200-$-Plan rentiert sich nur unter 5,7 % 00:09:52 | Preiskampf: OpenAI senkt Token-Preise WSJ-Bericht: OpenAI plant massive Preissenkungen als Reaktion auf Fable 00:11:12 | Fable-API-Preis und Einordnung Aktuell 50 $/1M Token (vorher 125 $) – immer noch ~2× teurer als Opus 00:13:46 | Empfehlung: Welche Tools jetzt nutzen? Cursor, Claude Code, ChatGPT Pro – solange die Subventionierung anhält 00:16:04 | Google AI Overviews – Klage und SEO-Konsequenzen Zwei Verlage klagen; nur ~1 % der Nutzer klicken auf Quellenangaben 00:19:02 | EU-Haftungsurteil: Google haftet für falsche Overviews Regelung vom 3. Juni, 9 Monate Übergangsfrist, Einspruchsrecht für Publisher 00:20:51 | Googles rechtliche Gegenwehr Revision wahrscheinlich; langfristige Konsequenzen noch offen 00:21:48 | Apex Agents Benchmark: Gemini Flash 3.5 vs. Claude Sonnet 5 Gemini Flash 3.5 ~50 %, Claude Sonnet 5 ~45 % – gezieltes Agentic-Training als Erklärung 00:23:20 | Gemini 3.5 Pro – Vorsicht mit dem Hype Early-Access-Feedback bisher verhalten 00:28:12 | Tool-Tipp: TextLottie Lottie-Animationen direkt aus Codex/Claude Code generieren 00:30:27 | Praxistest: Website-Rebuild mit Claude/Fable Komplette Homepage inkl. CMS und dynamischer Hero-Animation 00:33:58 | Fazit & Ausblick Subscription-Fenster nutzen, Preiskampf beobachten, Google-Entwicklung verfolgen --- Shownotes: WSJ berichtet über geplante drastische Preissenkungen bei OpenAI als Reaktion auf Anthropics neues Modell: https://www.wsj.com/tech/ai/openai-considers-drastic-price-cuts-anticipating-war-for-users-with-anthropic-9b8c178e?mod=e2tw SemiAnalysis analysiert Subscription- vs. API-Margen bei OpenAI und Anthropic – inklusive Break-even-Berechnung: https://x.com/SemiAnalysis_/status/2064815042374074396 Heise berichtet über das Münchner Urteil: Google muss für falsche Aussagen in AI Overviews haften: https://www.heise.de/en/news/LG-Munich-I-Google-ordered-to-pay-for-false-statements-in-AI-summaries-11327217.html Jake warnt davor, Token-Kosten auf Basis von Durchschnittspreisen zu berechnen – Modelle verbrauchen sehr unterschiedliche Mengen: https://x.com/JakeKAllDay/status/2064870609796898862/photo/1 TextLottie: Open-Source-Skill für Codex und Claude Code, der Lottie-Animationen direkt aus dem Coding-Agenten generiert: https://x.com/konstipaulus/status/2064011863889788972 - Quelle zu: https://www.theinformation.com/newsletters/the-briefing/german-court-ruling-google-spotlights-ai-liability-question - Maßgeschneiderte KI-Strategien und -Lösungen – von der Idee über das Modell-Training bis zur produktiven Integration: https://wojcik.de - The biggest IPO in history is now 4x oversubscribed, with SpaceX $SPCX drawing $250B in demand against a $75B raise: https://x.com/NoLimitGains/status/2064439231968166348

  • June 9 · 52 min

    Loops statt Prompten, Claude Mythos Leaks & Personal-Wechsel | AI Talk Mo. 08.06.2026

    Zwei Themen dominieren die KI-Woche – und beide zeigen, wie schnell sich Begriffe und Erwartungen verselbstständigen, bevor die Realität sie einholt. Peter Steinbergers Tweet vom 7. Juni hat 2,2 Millionen Views gesammelt. Sechs Wörter: „You should be designing loops that prompt your agents." Problem: In den Replies streiten alle darüber, was das überhaupt bedeutet. Die Folge erklärt Boris Chernys Definition vom WorkOS-Event, zeigt die fünfjährige Entwicklungsgeschichte von ReAct über AutoGPT bis zur heutigen Orchestrierungsebene – und nimmt den Cron-Job-Einwand ernst. Dazu ein konkretes Praxisbeispiel: 90 Minuten autonomes Codex-Coding, 630.000 Tokens, ein eigener LLM-Benchmark steigt von 90,1 auf 91,0 Prozent. Parallel brodelt der Hype um Claude Mythos. Leak-Outputs aus der DevMode-Community zeigen einen macOS-Klon mit 50.000 Tokens und funktionierendem Browser, einen Cut-the-Rope-Nachbau mit Level-Editor und Musik-Generierung über Code – alles auf Low Thinking Effort. Anthropic-interne Daten sollen 52-fache Trainings-Code-Speedups in bestimmten Optimierungsaufgaben zeigen. Polymarket sah die Release-Wahrscheinlichkeit innerhalb einer Woche bei 40 Prozent – vier Tage zuvor lag sie noch bei 3 Prozent. Preisgerüchte: rund 125 Dollar pro einer Million Output-Token, zwei Versionen für Endnutzer und Enterprise. Außerdem: Clive Chan verlässt OpenAI nach 2,4 Jahren im Custom-Chip-Programm und wechselt zu Anthropic. OpenAI plant den eigenen Inferenz-Chip für H2 2026. Apple WWDC bringt ein neues Siri, möglicherweise mit Gemini-Backend. Und Ramp-Kreditkartendaten für Juni zeigen: Anthropic führt im B2B-Wachstum – OpenAI taucht nicht mehr unter den Top-Playern auf. 00:00:08 Intro & Format 00:03:17 Claude Mythos – erste Community-Outputs 00:06:00 Generierungszeit und Kosten 00:07:13 GPT-5.06 – erste Infos aus internen Tests 00:15:33 Mythos-Preise und zwei Versionen 00:18:21 Release-Prognose via Polymarket 00:20:32 Mythos-Preise konkret: $125 pro 1M Output-Token 00:21:22 Gemini 3.5 Pro Leak 00:25:32 Peter Steinbergers viraler Loop-Tweet 00:26:44 Loop vs. Prompt – was ist der Unterschied? 00:29:31 Praxisbeispiel: 90 Minuten autonomes Codex-Coding 00:32:53 Sub-Agents und parallele Loops 00:36:37 Warnung: Token-Kosten können explodieren 00:38:15 Loop-Coding erklärt: Der Mensch schreibt die Schleife 00:40:18 Verifikation als wichtigster Erfolgsfaktor 00:40:43 Das größte Risiko bei AI-Agents 00:41:05 Skills sind das Asset, nicht der Loop 00:41:35 Vom Prompt Engineer zum Agent-Orchestrator 00:42:22 Brain Drain: Chip-Ingenieur wechselt von OpenAI zu Anthropic 00:43:38 OpenAIs eigener Inferenz-Chip 00:44:01 Apple WWDC: Neues Siri mit Gemini-Backend? 00:46:27 Ramp-Marktdaten Juni: Wer wächst wirklich? 00:47:21 Anthropic führt – OpenAI verliert Boden 00:48:37 Abschluss & Ausblick Shownotes: Der virale Tweet, der die Debatte ausgelöst hat – mit Einordnung der Loop-Definition und fünfjähriger Entwicklungsgeschichte: https://x.com/mvanhorn/status/2063865685558903149 Weitere Mythos-Outputs auf Low Effort, mit Hinweis auf deutlich bessere Ergebnisse bei xHigh/Max: https://x.com/Lentils80/status/2063686677160149501 Mythos-Output-Thread mit Pixel Art, Piano-Musik-Visualizer und Cut-the-Rope-Nachbau aus der DevMode-Community: https://x.com/mirochill/status/2062931007725015356 Mythos generiert Musik über Code – Einordnung als „First Principles"-Ansatz für Audio: https://x.com/chetaslua/status/206361381924369210 Polymarket-Einordnung: Release-Wahrscheinlichkeit von 3 % auf 40 % in vier Tagen, Modell kurz in Anthropic-UI aufgetaucht: https://x.com/goodworse/status/2063579122555662763 Mythos vs. GPT-5.6 – Vergleich von Leak-Outputs, mit Hinweis auf möglichen IPO-Hype als Verzerrungsfaktor: https://x.com/notjazii/status/2063272880708956258 Clive Chan verlässt OpenAI nach 2,4 Jahren im Custom-Chip-Programm und wechselt zu Anthropic: https://x.com/itsclivetime/status/2063356118525792542

  • June 5 · 52 min

    LoRA Fine-Tuning für SEO: Mein eigenes LLM Experiment

    In dieser AI Talk Folge geht es um mein Experiment, ein eigenes SEO LLM per LoRA Fine-Tuning zu trainieren. Ich spreche darüber, wie ich aus meinem SEO Benchmark Trainingsdaten erstelle, warum gute Datensätze wichtiger sind als reine Menge und wie ich ein Open-Weight-Modell gezielt für technische SEO-Aufgaben, strukturierte Daten, Onpage, Offpage, Crawling und Agent-Workflows optimieren möchte. Außerdem geht es um Qwen 3.6, lokale LLMs, RunPod, GPU-Setups, Benchmarks, Student-Teacher-Ansätze und die Frage, ob ein kleineres Modell nah genug an große Topmodelle herankommen kann, um in echten Workflows deutlich günstiger eingesetzt zu werden. Ein großer Teil der Folge zeigt auch, warum Fine-Tuning ein iterativer Prozess ist: trainieren, testen, Fehler analysieren, Trainingsdaten verbessern und erneut benchmarken. Kapitel: 00:00 Einstieg: Warum ein eigenes SEO LLM? 02:42 SEO Benchmark, Student-Teacher-Prinzip und Modellvergleich 05:12 Codex, Claude Code, Cursor und aktuelle Coding-Tools 07:48 Trainingsstatus, Setup und lokale Modelle 13:15 Qwen 3.6 als Basis für das Fine-Tuning 17:48 Aufbau der SEO-Trainingsdaten 24:45 Training starten, Datensätze kuratieren und LoRA verstehen 30:42 Benchmark-Test mit dem neuen Modell 32:36 Iteration: Trainieren, testen, verbessern 39:02 Erste Ergebnisse, Rückschritte und Learnings 46:38 Analyse mit starken Modellen und Vorbereitung für V4 57:14 Neuer Trainingslauf mit optimierten Beispielen 58:15 Nächster Schritt: Tool- und Function-Calling-Training 59:54 Fazit: Wie ich LLMs optimiere 01:02:05 Warum Benchmark und Trainingsdaten getrennt bleiben müssen 01:03:06 Ziel: Ein günstigeres spezialisiertes SEO Brain Modell

  • June 2 · 52 min

    Meta AI Hack, Nvidia DGX Power & eigene SEO Modelle: Warum AI Agents noch wackeln

    In dieser AI Talk Folge geht es um Nvidia DGX Spark, lokale LLMs, neue Open-Weight-Modelle, Minimax M3, Coding-Benchmarks, ein neues Video-Modell von xAI und den Meta Support Assistant Hack. Außerdem zeige ich mein nächstes Experiment: ein eigenes SEO LLM per LoRA Fine-Tuning. Dafür will ich aus meinem SEO Benchmark Trainingsdaten bauen und ein Modell stärker auf technische SEO-Aufgaben, Crawling, Onpage, Offpage und Agent-Workflows optimieren. Kapitelübersicht: 00:00 Neues Setup und KI-Co-Host 02:42 Alphabet und AI-Infrastruktur 05:02 Nvidia DGX Spark und lokale LLMs 07:30 KI im Betriebssystem 10:30 DGX Station und Blackwell Power 14:23 Nvidia Nemotron 3 Ultra 17:19 Minimax M3 für Coding 21:41 Neues Video-Modell von xAI 24:04 Coding-Benchmarks und Modellpreise 28:11 Meta Support Assistant Hack 31:37 KI-Co-Host im Live-Test 33:19 Eigenes SEO LLM per LoRA 41:37 Anthropic IPO und Preisdruck 50:20 Fazit und Ausblick 02.06.2026 · AI Talk 3 Shownotes Grok Imagine Video 1.5 Preview | xAI Docs: Pricing $0.08 per second Pricing Output $0.08 per second You are charged for each second of video generated when using the API. https://docs.x.ai/developers/models/grok-imagine-video-1.5-preview Meta's AI chatbot helped attackers take over Instagram accounts | heise online: The attack vector was made public by US tech magazine 404 Media , which refers to Telegram groups of security researchers and hacking group… https://www.heise.de/en/news/Meta-s-AI-chatbot-helped-attackers-take-over-Instagram-accounts-11314517.html Persönlicher KI-Supercomputer | NVIDIA DGX Station: Tensor-Recheneinheiten der NVIDIA Blackwell-Generation NVIDIA DGX Station verfügt über Tensor-Recheneinheiten der NVIDIA Blackwell Generation, die 4-Bit-Gleitkomma-KI… https://www.nvidia.com/de-de/products/workstations/dgx-station/ NASDAQ-Aktie Alphabet schwächer: Riesen-Kapitalerhöhung geplant - Blick auf den Berkshire-Anteil | finanzen.net: Google befindet sich damit in guter Gesellschaft: Amazon etwa plant, rund 200 Milliarden Dollar zu investi… https://www.finanzen.net/nachricht/aktien/ausbau-alphabet-aktie-sinkt-mega-kapitalerhoehung-fuer-ki-offensive-berkshire-anteil-im-blick-15723078 Warren Buffett steigt mit 10 Milliarden Dollar bei Alphabets KI-Offensive ein: Juni 2026 Alphabet plant eine Kapitalerhöhung von 80 Milliarden Dollar, um seine KI-Infrastruktur auszubauen. https://the-decoder.de/warren-buffett-steigt-mit-10-milliarden-dollar-bei-alphabets-ki-offensive-ein/ OpenAI models and Codex on Amazon Bedrock are now generally available | Artificial Intelligence: More than 5 million people use Codex every week to write, refactor, debug, test, and validate code across large codebases. https://aws.amazon.com/blogs/machine-learning/openai-models-and-codex-on-amazon-bedrock-are-now-generally-available/ Regional availability - Amazon Bedrock: Virginia) Legacy (EOL: 2026-09-30) Rerank Region In-Region Geo Global us-west-2 (Oregon) ca-central-1 (Canada) eu-central-1 (Frankfurt) ap-northeast-1 (Tokyo) Nova Sonic Region In… https://docs.aws.amazon.com/bedrock/latest/userguide/models-region-compatibility.html Nemotron 3 Ultra: Nvidias neues Open-Source-Modell ist laut Benchmark das stärkste der USA: Bild: AAII Beim Anbieter DeepInfra liefert Nemotron 3 Ultra laut Artificial Analysis zudem mehr als 300 Token pro Sekunde. https://the-decoder.de/nemotron-3-ultra-nvidias-neues-open-source-modell-ist-laut-benchmark-das-staerkste-der-usa/ Anthropic confidentially submits draft S-1 to the SEC \ Anthropic: Skip to main content Skip to footer Try Claude Announcements Anthropic confidentially submits draft S-1 to the SEC Jun 1, 2026 Today, Anthropic, PBC con… https://www.anthropic.com/news/confidential-draft-s1-sec MiniMax M3: Frontier Coding, 1M Context, Native Multimodality — All in One Model - MiniMax Research | MiniMax: Its clean, scalable, easy-to-implement, and hardware-friendly characteristics allow its theoretical gains to… https://www.minimax.io/blog/minimax-m3

  • May 29 · 52 min

    Deepseek v4, Cursor Composer 2.5 & Chrome DevTools MCP: AI Talk über neue KI Tools

    In dieser AI Talk Folge spreche ich über Deepseek v4, Cursor Composer 2.5, Codex, Claude Code und neue Agent Tools. Deepseek v4 Pro hat in meinen Benchmarks extrem stark performt und ist preislich deutlich günstiger als viele westliche Frontier Modelle. Gleichzeitig zeige ich, wo politische Biases und Antwortverweigerungen problematisch werden können. Außerdem teile ich meine Erfahrungen mit Cursor Composer 2.5 aus einem echten Coding-Projekt, spreche über Codex Updates, Claude Code, Microsoft Agent Skills, steigende Token-Kosten in Unternehmen und den neuen Chrome DevTools MCP Server für Performance Audits. Eine Folge über neue KI-Modelle, Coding Agents, Kosten, Benchmarks und die Frage, welche Tools im Alltag wirklich nützlich sind.

  • May 28 · 43 min

    Ai Agents - Zukunft oder Trash? Mein Talk auf der OMfinCon!

    In dieser Folge gibt es meinen Vortrag von der OMfinCon zum Thema AI Agents im Marketing. 43 Minuten über den aktuellen Stand von AI Agents, warum SEO ein besonders spannender Use Case dafür ist und wie ich mir mit Autonomo SEO ein eigenes SEO AI Team gebaut habe. Ich zeige, wie einzelne Agents, ein Brain Orchestrator, ein Heartbeat Agent, Memory, Skills, APIs, MCP, eigene Crawler, Benchmarks und Human in the Loop zusammenspielen. Außerdem geht es sehr ehrlich um die Grenzen aktueller Agent-Systeme: instabile APIs, Gateway Issues, Token-Kosten, Kontextverlust, Authentifizierung, DSGVO, Modellverhalten und die Frage, wann AI Agents wirklich Marketing-Teams unterstützen können. Kapitelübersicht: 00:00 Einstieg: Warum AI Agents jetzt relevant werden 01:18 Rückblick: Frühe KI-Prognosen und ChatGPT 02:26 Google, Disruption und Anpassungsfähigkeit 03:15 Spezialisierte Chatbots und erste Agent-Erfahrungen 05:24 OpenClaw, Hermes und aktuelle Agent-Frameworks 10:30 Warum SEO ein guter Use Case für Agents ist 11:26 Warum ich ein eigenes Agent-System gebaut habe 12:49 Autonomo SEO: Ein Team aus SEO Agents 13:19 Chat mit einzelnen Agents und Brain Orchestrator 15:19 Teamchat: Wie Agents untereinander kommunizieren 16:03 Heartbeat Agent: Das Herzstück des Systems 16:50 Individuelle Agent-Einstellungen, Modelle und Memory 18:38 Task-Übersicht, Priorisierung und Freigaben 20:43 Outreach, Linkbuilding und Onpage-First-Ansatz 21:38 Workflows statt einzelner Tasks 23:18 Skills, APIs und MCP als Agent-Werkzeuge 25:10 Lokale Tools, Browser-Plugins und Server-Zugriffe 26:14 Eigener SEO Crawler für Agent-Projekte 28:13 Monitoring, Kostenkontrolle und Token-Verbrauch 29:19 Settings, Fokussteuerung und Kommunikationskanäle 30:12 LLM Benchmarking für eigene Use Cases 33:14 Technical SEO Benchmark: Überraschende Modell-Ergebnisse 34:16 Onpage Benchmark: Warum Mistral stark performt 35:45 Der Agent-Kindergarten: Die größten Praxisprobleme 36:06 Gateway Issues, Provider-Ausfälle und instabile APIs 37:10 Guardrails, Skills und MCP-Probleme 38:01 Memory-Systeme, Authentifizierung und Kontextverlust 39:10 Modellverhalten, DSGVO und Zuverlässigkeit 40:55 Warum aktuelle Modelle noch nicht stark genug sind 41:59 Ausblick: Wann Agents echte Marketing-Teams unterstützen können 42:53 Fazit: Human in the Loop bleibt entscheidend