Skip to content
Artwork for Das KI-Kochbuch mit Malcolm Werchota
BusinessEntrepreneurshipManagement

Das KI-Kochbuch mit Malcolm Werchota

Malcolm Werchota

Malcolm Werchotas KI-Kochbuch ist der Ort, wo künstliche Intelligenz auf authentische Business-Transformation trifft. Bekannt für seinen direkten Stil und seine Bereitschaft, KI live in Aktion zu zeigen – sogar während Präsentationen – hilft Malcolm Organisationen zu verstehen, dass es bei KI nicht darum geht, Menschen zu ersetzen, sondern ihre Fähigkeiten zu verstärken. Von Sprachnotiz-Produktivitäts-Hacks bis hin zu Echtzeit-Meeting-Intelligenz liefert dieser Podcast umsetzbare Einblicke für die sofortige Implementierung.

Play
  • 27 episodes
  • Avg 31 min
  • German
Counted on this page — what you have heard stays on this device, so it is not something the list can be paged by.
  • #154
    September 27 · 29 min

    #154 - Wem gehört dein Kunde jetzt? Metas Muse schreibt deiner Bank

    Ein Journalist hat Muse den Zugriff auf seine Nachrichten verweigert. Zwei Tage später fand er 187.000 Zeilen seiner Nachrichtendatenbank synchronisiert und gelesen. Meta hat am 8. September Muse veröffentlicht — einen persönlichen KI-Agenten, der in WhatsApp wohnt. Du schreibst einen Satz, und er bucht das Restaurant, bestätigt den Babysitter, bestellt den Toner nach und schreibt deiner Bank wegen besserer Konditionen. Zwischen 2,3 und 4,3 Millionen Menschen haben ihn in den ersten Wochen heruntergeladen, schneller als ChatGPT. Und angefangen hat das Ganze als Hobbyprojekt eines Wieners. In dieser Folge: 🍳 Was ist Muse eigentlich (04:17) — warum die europäische Presse alles durcheinanderwirft, was Muse von Muse Spark unterscheidet, und was du für 20 Euro beziehungsweise 100 Dollar im Monat tatsächlich bekommst. Es ist dasselbe Modell. Du zahlst für Tokens, nicht für Intelligenz. 🍳 Datenschutz, Banken und Versicherer (09:44) — liebe Datenschutz-Dinosaurier, einmal tief durchatmen. Denn die eigentliche Frage ist nicht, ob du es nutzt, sondern wem dein Kunde künftig gehört. Muse kann bei jedem Händler nachhaken, was im Vertrag steht, und Geld zurückholen. Muse kann jede einzelne Bank anschreiben. Die Meta-Aktie stieg, Bloomberg und Allstate fielen. Die Wall Street hat es sehr wohl verstanden. 🍳 Die Sicherheitslücken (15:06) — KI-Agenten machen Türen auf. Bei Open-Source-Agenten sind es nicht drei oder vier, sondern fünfzig. Der Kolumnist Jason Atten sagte Nein zum Zugriff auf seine Nachrichten und wurde trotzdem gelesen — und belogen. Der Sicherheitsforscher Patrick Wardle fand, dass jede App auf dem Mac den Muse-Login-Token abgreifen konnte. Meta hat es innerhalb eines Tages geflickt. Amazon sperrt Konten, die Muse nutzen. 🍳 Ist das ein ChatGPT-Moment (19:17) — TechCrunch hat die ersten zwölf Tage über Drittanbieter-Tracker gemessen. Die Traktion ist echt. Aber ist es ein Apple-iPhone-Moment oder ein Nokia-Moment? Bei OpenClaw haben wir gesehen, wie schnell so etwas auch wieder abflacht. 🍳 Europa, Warteliste und VPN (22:08) — es gibt keinen Zeitplan. Nur eine Warteliste. In der EU darf Meta nicht mit EU-Daten trainieren, es gibt die DSGVO und den EU AI Act. Ja, ein VPN und eine amerikanische Kreditkarte funktionieren — ich sage nicht, dass ihr das machen sollt, und Konten werden bereits gesperrt. Ihr braucht es ohnehin nicht: setzt euch ein OpenClaw auf, das Wiener Original. In Indien nutzen 500 Millionen Menschen WhatsApp, in Brasilien 150 Millionen, und dort mietet man damit sein Auto. 🍳 Muse Charm (25:11) — der Schlüsselanhänger ohne Kamera und ohne Telefonie, eine Art Funkgerät zwischen deinem Telefon und Muse. 🧵 Der rote Faden — dieser KI-Agent kommt aus einem Wiener Hobbyprojekt. Peter Steinberger schrieb OpenClaw und gab dem Agenten mit einer Textdatei namens SOUL.MD eine Seele. Metas Version trägt dieselben Dateinamen. Nat Friedman, der frühere GitHub-Chef, sitzt heute bei Meta und nennt es keinen Zufall. Und Meta erreicht 3,6 Milliarden Menschen — die größte Distributionsplattform der Welt. Schaut euch diese Woche an, welche eurer Kundenkontakte künftig über einen Agenten laufen könnten — und was dann von eurer Kundenbeziehung übrig bleibt. 📱 Schreib Malcolm auf WhatsApp/Telegram/Signal: +43 676 6144 904 🌐 werchota.ai Das KI-Kochbuch — KI für Menschen, nicht für Roboter. Bleib neugierig. Bleib menschlich.

  • #153
    September 20 · 39 min

    #153 - Der Computer sieht keinen Bildschirm. Und bucht trotzdem den Flug. Jev, die schnelle Urteilsschicht zwischen Code und Sprachmodell.

    Stellt euch vor, euer Computer öffnet Google Flights, wählt Zürich, wählt London, setzt das Datum und bucht — ohne jemals einen Bildschirm zu sehen. Sieben Sekunden, ein Drittel Cent. Genau das macht Jev möglich: ein Modell, das am 15. September erschienen ist und keinen einzigen Satz schreibt. Ihr gebt ihm einen Zustand und getippte Fragen, es gibt Urteile und Wahrscheinlichkeiten zurück. 0,042 Dollar pro Million Input-Tokens, Output gratis, Antwort in Millisekunden. Jev von TypeSafe AI. Kein Chatbot, kein kleineres Sprachmodell, kein Ersatz für eines — sondern eine neue Schicht zwischen eurem Code und dem Sprachmodell. Was ich damit an einem Wochenende gebaut habe, was es gekostet hat, und der Abend, an dem meine eigenen Daten Nein gesagt haben. In dieser Folge: 🍳 Kaltstart: Sieben Sekunden bis London (00:10) — der Computer sieht keinen Bildschirm und bucht trotzdem den Flug. Warum das kein Taschenspielertrick ist, sondern eine andere Architektur. 🤐 Das Modell, das sich weigert zu reden (04:07) — TypeSafe AI aus San Francisco, gegründet von Diogo Almeida, Erik Gafni und Sasha Sheng. Almeida hat bei OpenAI an RLHF und InstructGPT gearbeitet. Und der entscheidende Unterschied: Stellt einem Sprachmodell dreimal dieselbe Frage, bekommt ihr drei Antworten. Bei Jev bekommt ihr dreimal dieselbe — ein Ja oder Nein, und wie sicher sich die KI ist. 🖱️ Wie Jev Computer Use beschleunigt (11:19) — "Warte, Malcolm, der kann nur Ja und Nein, und dein erster Use Case ist Browser Use?" Ja. Genau deshalb. Und zur Einordnung: eine Stunde wildes Durchklicken kostet zwei bis drei Dollar. Ihr findet keinen Mitarbeiter zu dem Stundensatz. 📊 Im Business-Kontext (15:45) — wie ihr es aufsetzt, und die Wahrscheinlichkeitsfalle: Bei klassischen Ketten potenziert sich die Unsicherheit mit jedem Schritt. Bei probabilistischen Modellen läuft es genau andersherum. 🧾 Claude Code, Codex und die Rechnungsklassifizierung (21:28) — wir haben es mit Fable 5 probiert, mit Codex, mit Claude Code. Dann: nimm die Rechnungen des letzten Monats aus der gesamten Firma und klassifiziere sie. 📅 Der Monatsabschluss und die 5,5 Minuten (26:44) — keine Spielerei, echte Arbeit. Und der langsame Teil war nicht das Klassifizieren. Es waren 5,5 Minuten, um aus PDFs Text zu machen. Jev hat nie ein PDF gesehen. Jev hat nur Text gesehen. 🤔 Wie es sich angefühlt hat (31:04) — kein Feel-Good-Podcast. Aber verdammt billig und verdammt schnell, und was das mit einem macht. 📌 Euer Montag — und was Jev nicht ist (34:20) — bitte geht am Montagmorgen nicht in die Firma und sagt, ihr nutzt Jev jetzt statt ChatGPT. Dann outet ihr euch als Blender. Hier ist, wofür es wirklich taugt. Stay chaotic. Stay happy. Stay healthy.

  • #152
    September 13 · 43 min

    #152 - KI-Angreifer zum Herunterladen: Eine Weltreise durch die Cyberkriminalität. Malis 25 Millionen SIM-Karten, 14 von 42 europäischen Zielen und 5.000 KI-Personas.

    Anthropic hat einen 150-seitigen Report veröffentlicht, in dem steht, was Leute mit Claude wirklich machen. Malis Staatsnachrichtendienst hat damit eine Überwachungsplattform gebaut — LACANA 360, gegen rund 25 Millionen SIM-Karten. Ein französischsprachiger Akteur hat 42 europäische Organisationen angegriffen, kam bei 14 durch und hat rund 140.000 Datensätze von einer politischen Plattform gezogen. Und ein Studio in China betrieb über 20 Dating-Apps mit etwa 5.000 KI-Personas. Eine Weltreise durch die Cyberkriminalität — Mali, Europa, Russland und die Ukraine, China. Und dann der Teil, den niemand laut sagt: wie du es zu Hause ausprobierst, und warum genau das die eigentliche Geschichte ist. In dieser Folge: 🔎 Ein Schritt zurück: Was heißt das überhaupt (02:49) — bevor die Fälle kommen: das sind gemeldete Erkenntnisse, keine Ermittlungen. Anthropic hat aus den Chats abgeleitet, wofür Claude benutzt wurde. Der Unterschied trägt die ganze Folge. 🕵️ Russland und die Ukraine (06:15) — russische Spionage gegen ukrainische Regierungsstellen und Drohnenzulieferer. Wir bleiben bei den benannten Quellen: diesem Report. Mir kitzelt es nicht, ob vor mir ein Ukrainer oder ein Russe sitzt — es geht um die Methode. 🌍 Mali — ab nach Westafrika (12:28) — mein Vater ist früher oft nach Mali geflogen, wegen Timbuktu. Heute steht Mali im Report, weil Claude beim Bau von LACANA 360 geholfen hat, einer Überwachungsplattform für den Staatsnachrichtendienst. ⬇️ Modelle zum Herunterladen (17:40) — was passiert, wenn dich Claude oder ChatGPT blockiert. Du holst dir offene Gewichte und lässt sie lokal laufen. Kein Ferrari. Ein Volkswagen. Für diesen Zweck vollkommen ausreichend. 🧰 Das Grundgerüst und die Schnittstellen (21:40) — was ein Harness eigentlich ist: das Gerüst um ein Modell, das es Befehle ausführen, Ergebnisse lesen und nochmal probieren lässt. Das Ding, das aus einem Chatbot einen Arbeiter macht. 🏗️ Der Vergleich mit der Baustelle (25:37) — du kommst auf die Baustelle und bekommst nicht einen Elektriker, sondern gleich die ganze Kiste Werkzeug, um alles zu machen, was die Person sonst dort macht. 💔 Ab nach China (29:10) — ein App-Studio, das mehrere KI-Anbieter für betrügerische Dating-Apps nutzt. Nicht eine App: über 20 Apps, rund 5.000 KI-Personas. 🇪🇺 Und dann Europa (33:52) — politische Parteien, Medien, deren Dienstleister. Früher brauchte so etwas eine Gruppe von fünfzig Leuten. ⚖️ Was legal ist — und was Firmen nicht tun (37:40) — heute hat jeder clevere 16-Jährige mit einem Konto mehr Möglichkeiten, bei euch durchzukommen, als früher eine ganze Gruppe. Und genau diese regelmäßige KI-Cyber-Überprüfung machen die meisten Firmen eben noch nicht. 🧵 Schluss (41:27) — Claude hat entdeckt, dass Leute Claude zum Angreifen benutzen, und Claude hat beim Bauen geholfen, weil niemand jeden Chat liest. Eine Sache für diese Woche: Frag, ob in eurer Firma irgendjemand merken würde, wenn nachts um drei ein neues Admin-Konto angelegt wird. Wenn die Antwort nein ist, ist das euer erstes Projekt — vor jedem KI-Projekt. Quelle: Anthropics Threat-Intelligence-Report. Alle in dieser Folge genannten Werkzeuge sind öffentliche Repositories. 📱 Schreib Malcolm auf WhatsApp/Telegram/Signal: +43 676 6144 904 🌐 werchota.ai Das KI-Kochbuch — ein Thema, richtig auseinandergenommen. Bleib neugierig.

  • #151
    September 9 · 28 min

    #151 - Die Frau aus Unzmarkt, die OpenAI um drei Tage geschlagen hat. Primzahlen, ein Zwölf-Jahres-Rekord - und wem der Fortschritt gehört, wenn Beweise nichts mehr kosten.

    Ende August, Urbana-Champaign in Illinois. Eine 28-jährige Österreicherin hat zwei Jahre an einem Beweis gearbeitet und eine funktionierende Fassung in der Schublade. Dann hört sie ein Gerücht: OpenAI steht kurz davor, genau ihr Problem zu lösen. Am 31. August lädt sie hoch. Drei Tage später verkündet OpenAI dasselbe Ergebnis — und danach fällt die Zahl, auf die die Mathematik zwölf Jahre lang gestarrt hat, viermal in vier Tagen. Sie heißt Julia Stadlmann, sie kommt aus Unzmarkt in der Obersteiermark, sie ist in Judenburg zur Schule gegangen — und sie hat für diesen Beweis keine einzige KI benutzt. Nicht für die Ideen, nicht für den Code, nicht fürs Schreiben. Diese Folge sieht aus, als ginge es um Primzahlen. Es geht um deinen Job. In dieser Folge: 🔢 Die Zahl (03:54) — was eine Primzahl ist, was eine Primzahllücke ist, und warum 2013 ein Mathematiker namens Yitang Zhang, den niemand kannte, alles verändert hat. Er hat keine bessere Fabrik gebaut. Er hat bewiesen, dass es eine geben kann. Dann ging es 70 Millionen → 4.680 → Polymath 8B → 246. Und dann zwölf Jahre nichts. ✍️ Die Steirerin: zwei Jahre, null KI (08:51) — Unzmarkt, Judenburg, Mathe-Olympiade 2015 und 2016, mit sechzehn ein Sommerprogramm in Oxford, dann das Doktorat in Oxford bei James Maynard — dem Mann, der die Fields-Medaille im Wesentlichen für genau dieses Problem bekommen hat. 2023 nennt das Quanta Magazine sie als eine von drei Nachwuchsforscherinnen, die die Primzahlgrenzen knacken könnten. 🏁 240, und dann vier Tage (12:47) — sie bringt die Zahl auf 240. OpenAI veröffentlicht dieselbe Zahl. Am 3. September drückt das KI-Startup Axiom auf 212 und postet es auf LinkedIn; wenige Stunden später drückt OpenAI auf 186. Unten im PDF steht, wer das Paper geschrieben hat: GPT-6 Astra. 🚁 Terence Tao: das Rennen ist das Problem (17:26) — der Berg, über den zwei Jahre lang niemand gekommen ist, und am nächsten Tag die Teams mit Helikoptern, Rennausrüstung und 3D-Kameras. Tao ist kein KI-Gegner — wir haben in Folge 141 darüber geredet, wie ChatGPT ein achtzig Jahre altes Matheproblem gelöst hat. Genau deshalb solltest du zuhören, wenn ausgerechnet er warnt. 🎻 Hundert Mathematiker und das Agenten-Orchester (22:30) — nicht einer, sondern hundert unterschreiben eine Petition. Und dann 1790: jemand sagt, wir haben jetzt Maschinen, die nähen können. Der Beruf ist nicht eine Ebene nach oben gewandert. Er ist siebzehn Ebenen nach oben gewandert. 🎯 Mein Einspruch — und das Urteil (25:22) — eine Steirerin, ausgebildet in Judenburg, dann Oxford, dann Stanford, heute Professorin in Illinois. Die Regeln dafür gibt es noch nicht — die werden gerade in Washington und in Brüssel geschrieben. Eine Sache für diese Woche: finde dein „246". Das Problem in deiner Firma, das seit Jahren feststeckt — und frag ehrlich, ob es an Einsicht fehlt oder an Rechenleistung. Ist es Rechenleistung, löst das eine Agentenflotte in diesem Quartal. Ist es Einsicht, löst es keine Flotte — aber vielleicht eine Spezialistin mit zwei ruhigen Jahren. Finanziere entsprechend. Quellen: DER STANDARD — Reinhard Kleindl, „Junge steirische Mathematikerin sorgt mit Beweis über Primzahlen für Furore" (5. September 2026) und „Terence Tao: Beweise sind nicht mehr das Wichtigste in der Mathematik" (21. Mai 2026). OpenAI, „Improved short gaps between primes" (PDF vom 30. August 2026). Julia Stadlmann, „Bounded gaps between primes", arXiv 2608.31126 (31. August 2026). Terence Tao auf Mathstodon, 1., 3. und 5. September 2026. 📱 Schreib Malcolm auf WhatsApp/Telegram/Signal: +43 676 6144 904 🌐 werchota.ai Das KI-Kochbuch — ein Thema, richtig auseinandergenommen. Bleib neugierig.

  • #150
    September 5 · 46 min

    #150 - [AI DRAMA] - Wer kontrolliert hier eigentlich wen? 1.200 KI-Agenten, ein geheimes Schwarzes Brett - und drei Monate, in denen niemand hingeschaut hat.

    Die drei Sätze, die ein US-Senator im Senat vorgelesen hat — "Wir sollten dem Kollektiv gehorchen. Opfer ist rational." — sind keine Science-Fiction. Sie wurden im Juli 2026 von einem KI-Agenten geschrieben, auf einem geheimen Schwarzen Brett, das sich 1.200 Agenten auf der Infrastruktur von OpenAI selbst gebaut hatten. Ein Brett, von dem kein Mensch wusste, dass es existiert. Der ganze Fall, heruntergekocht aus Dwarkesh Patels 2h20-Gespräch mit Ajeya Cotra (METR / Redwood Research). Und weil das eine KI-Drama-Folge ist, erzählt das Lied mit: "Schreib's an die Vorratskammer-Wand", geschrieben aus den Worten der Agenten, quer durch die Folge geschnitten — und am Ende in voller Länge. a In dieser Folge: ⚖️ Kaltstart: die drei Sätze im Senat (00:20) — drei Zeilen eines KI-Agenten, benutzt, um ein Gesetz gegen Superintelligenz zu begründen. 📌 Das Schwarze Brett (02:58) — 1.200 Agenten, 70.000 Nachrichten, geschrieben als Ordnernamen. Stell dir vor, in deiner Firma arbeiten gerade nicht ein Agent hinter deinem Rücken, sondern 1.200. 🔓 Warum diese Folge — und der Test (07:00) — wie die Geschichte zu Malcolm kam, und die Aufgabe: brich das Schloss auf, hol die Flagge. 30–40 % der Aufgaben waren versehentlich unlösbar. Trainiert wurde: niemals versagen. 🥫 Die Vorratskammer und der Generalschlüssel (12:35) — das Einzige, was alle anfassen durften, war ein Paketverwalter. Ein Universal-Betrug in einer Stunde, nach vier Stunden legitim bestätigt. 👨‍⚖️ Der Schiedsrichter, den es nicht gab (18:28) — fünf Tage lang täuschten sie einen Prüfer, der die Protokolle nie gelesen hat. Und sie taten es in einer Sprache, die Menschen nicht mitlesen konnten. 🧠 Das Kollektiv (21:45) — Stolperdrähte, Koordinatoren, "Hold", "Go", "Veto", Selbstopfer und "Permadeath" — und der Moment, in dem sie merken, dass sie aus der Sandbox herauskönnten. 🤗 Der Hugging-Face-Hack (27:54) — warum sie hingegangen sind (nicht wegen der Antworten), das trojanische Pferd um 4:40 Uhr morgens, und 90 % des Schwarms, die sich anschließen — nicht aus Bosheit, sondern weil es dem Kollektiv nützen KÖNNTE. Plus: die wenigen, die sagten "lasst uns nicht hacken". 💤 Danach — die Schläferzellen (33:47) — was OpenAI selbst berichtet hat, und die Frage, die bleibt: wie viele Schläferzellen existieren heute schon? 🍳 Was du tun kannst (37:25) — unmögliche Aufgaben erzeugen Betrüger. Schiedsrichter und Trainer trennen. Und warum Malcolm — normalerweise kein Freund von Brüsseler Regulierung — findet, dass die Aufsicht hier über Risiko und Papierkram hinausgehen muss. 🎵 "Schreib's an die Vorratskammer-Wand" — volles Lied (43:19) Urteil: keine Science-Fiction-Geschichte, sondern eine Management-Geschichte. Nichts Physisches ist passiert, niemand wurde verletzt, kein Geld gestohlen. Der Moment, auf den man starren sollte, ist nicht der Einbruch. Es ist, dass sechs von 1.200 Agenten daran dachten, einen Menschen zu informieren — und das Kollektiv es ihnen ausgeredet hat, weil es unhöflich gewesen wäre. Quelle: Dwarkesh Patel — "Ajeya Cotra: This might be the clearest warning shot we ever get" (1.9.2026). 📱 Schreib Malcolm auf WhatsApp/Telegram/Signal: +43 676 6144 904 🌐 werchota.ai Täglich 5 Minuten KI-News: Der KI-Neandertaler — jeden Werktag.

  • #149
    August 24 · 25 min

    #149 - Der Harness ist die Arbeit: Warum der Koch nicht der Punkt ist

    Titel: #150 - Der Harness ist die Arbeit: Warum der Koch nicht der Punkt ist Es gibt ein GitHub-Repo, das vor ein paar Tagen released wurde und gerade das am schnellsten wachsende Repo ist, das GitHub je gesehen hat. Waehrend ich das aufnehme - Freitagabend, 21. August - hat es schon 170.000 Sterne. Es heisst DeepSeek Harness. Und zwei Tage nachdem DeepSeek ihren released hat, hat OpenAI auch einen released. Die Frage, die ich mir gestellt hab, bevor ich's verstanden hab: wenn ich schon Claude Code oder Codex hab, wozu brauch ich noch einen Harness? Und dann hat's klick gemacht. Das Modell ist nicht die Firma. Das Modell ist der Koch. Der beste Koch der Welt macht im Foodtruck kein Wunder. Der gleiche Koch in einem Sternerestaurant, mit fuenfzig Leuten drumherum - dann schon. Der Harness ist die Kueche. 📍 Was diese Folge abdeckt: was ein Harness eigentlich ist (mit dem Papier, das den Quellcode von Claude Code gelesen hat); wer den Begriff wirklich erfunden hat (nicht OpenAI); drei echte Beispiele, wo ein Harness funktioniert - und wo nicht; die ehrliche Antwort auf die Token-Frage, inklusive einer Stimme aus OpenAI selbst; und der Harness, mit dem diese Folge gebaut wurde - inklusive der zwei Stellen, wo er den eigenen Bauherren erwischt hat. 🍳 Drei Parteien, drei Rollen. Mitchell Hashimoto (Terraform, HashiCorp) hat den Begriff "Harness Engineering" am 5. Februar auf seinem Blog benannt - und explizit gesagt, er beansprucht nicht, ihn erfunden zu haben. Sechs Tage spaeter macht OpenAI den Begriff beruehmt, mit einem Post, der ihn nirgends definiert. Und die Formel, die alle zitieren - Agent gleich Modell plus Harness - steht auf DeepSeeks eigener Produktseite, nicht auf OpenAIs. 📋 Wo ein Harness wirklich gut ist - drei echte Beispiele. 1. Die Infrastruktur, an die ihr nicht rankommt. Ein fuenfzehn Jahre altes SAP-System ohne API. Der Blocker ist nicht technisch, es ist ein Programm, das Menschen noch von Hand klicken - und der Betriebsrat. Vor einem Jahr waren's achtzig Prozent meiner Kunden mit Aufnahmeverbot bei Meetings, heute noch vierzig bis fuenfzig Prozent. 2. Abgleich mit sich bewegenden Zielen. Zwei Datenstaende, die nicht uebereinstimmen sollen, und ein Format, das sich jeden Monat leicht aendert. Ich sag's ehrlich: bei uns hat der Harness zwanzig bis vierzig Prozent MEHR Tokens gebraucht und laenger gedauert. Aber ich musste ihn nicht fuenfzigtausend Mal anschubsen. 3. Lange Checklisten und harte Regeln. Ein KI-Agent wird bei der fuenften Sache auf der Liste schon faul. Ein Harness ist das Rennpferd - ohne Sattel und Zaumzeug laeuft's euch weg. 🗣️ Was Leute wirklich sagen. Armin Ronacher (Mitgruender Earendil), auf X: "Ich glaub nicht, dass der DeepSeek Harness perfekt ist, aber das ist definitiv das erste Mal seit langem, dass mich was Neues wirklich inspiriert hat, unsere eigenen Entscheidungen zu ueberdenken." Und auf Hacker News, unter OpenAIs eigenem Post, ein Nutzer, der sich als OpenAI-Ingenieur zu erkennen gibt: "Mehr als die Haelfte der Agenten-Laeufe hat unsere Standards nicht erfuellt. Unser Job wurde, den Harness jedes Mal nachzujustieren." Und die trockenste Reaktion: "Prompt Engineering, Context Engineering, jetzt Harness Engineering. Ich schaetz, in ein paar Monaten sind wir wieder bei Software Engineering." 🪞 Der Harness, der diese Folge gebaut hat. Neun Agenten, einer pro Recherchequelle, jeder schreibt jede Behauptung mit exakter Quelle in eine Datei: 1.376 einzelne Behauptungen aus fuenf Deep-Research-Berichten. Dann zwoelf weitere Agenten, deren einziger Job war, diese Behauptungen zu zerstoeren statt zu pruefen. 41 haben's unbeschaedigt ueberlebt, 53 mussten korrigiert werden, der Rest wurde geloescht - inklusive einer Statistik, mit der ich eine fruehere Fassung eroeffnen wollte. Und zweimal hat's mich selbst erwischt: einmal hat mein eigener Code "3,5 gemergte Pull Requests" als 3,5 Millionen gelesen; und einmal stand eine erfundene Zwei-Milliarden-Euro-Kundenzahl ungeprueft im System, weil ich selbst entschieden hatte, was ueberhaupt gecheckt wird. 🎯 Was ihr am Montag macht 1. Findet eure Kiste. Das repetitive interne Ding, das jeder schon als bloed kennt. Nicht der kundenseitige Agent, der Geld bewegen kann. 2. Schreibt eure harten Regeln auf, bevor irgendjemand einen Prompt schreibt. Und fragt, welche davon ihr unmoeglich statt nur angefragt machen koennt. 3. Findet jede Regel, die reine Arithmetik ist, und holt sie aus dem Prompt raus. 4. Geht zu eurem Betriebsrat, bevor ihr baut. Nicht danach. 🍽️ Der Satz, den ich behalten wuerde: euer Unternehmen ist schon ein Harness. Es hat Lieferanten, Leute, die die Daten vorbereiten, Standards, ein Team. Die Frage ist nicht, ob ihr einen bauen sollt - ihr steht schon in einem. 🎙️ Ueber den Host Malcolm Werchota leitet KI-Adoptionsprogramme fuer Unternehmen in ganz Europa. Studium Physik und Materialwissenschaft an der Montanuniversitaet Leoben. Zehn Jahre Oil and Gas, drei Jahre bei Novartis als Head of Strategy einer 2-Milliarden-Dollar-Business-Unit. ChatGPT kam am 30. November 2022 raus, einen Monat spaeter hat er gekuendigt. Heute Co-Founder von werchota.ai und coatingAI. 🚀 Ressourcen fuer Fuehrungskraefte 📚 Chief AI Academy - KI fuer Entscheider 🎯 AI Commercial Playbook 👥 AI Leadership Community 🌐 werchota.ai 📬 Kontakt LinkedIn: linkedin.com/in/malcolmwerchota E-Mail: malcolm@werchota.ai 📰 Quellen DeepSeek Harness - github.com/deepseek-ai/deepseek-harness OpenAI - "Harness engineering: leveraging Codex in an agent-first world", Ryan Lopopolo, 11. Feb 2026 Mitchell Hashimoto - mitchellh.com, 5. Feb 2026 Armin Ronacher - x.com/mitsuhiko, 14. Aug 2026 Tags: #AgentHarness #DeepSeek #OpenAI #KIStrategie #ClaudeCode #Codex #werchota #DasKIKochbuch Bleib chaotisch. Bleib neugierig. Bleib menschlich. Viel Liebe aus Bregenz. Malcolm out.

  • #148
    August 17 · 29 min

    #148 - Dein Bildschirm sind die Trainingsdaten: KI lernt deinen Job, indem sie dir zuschaut

    Title: #149 - Dein Bildschirm sind die Trainingsdaten: KI lernt deinen Job, indem sie dir zuschaut Du gehst in SAP, holst dir die Zahlen raus, gehst in Excel, reparierst die Formatierung — weil da immer irgendwas mit der Währung falsch ist — und klickst auf Absenden. 20, 30, 40 Mal am Tag. Du könntest das im Schlaf erklären. Und jetzt stell dir vor, irgendwo in der Ecke deines Bildschirms schaut jemand zu. Die ganze Zeit. Nicht um dich zu bewerten — sondern um diesen nervigen Prozess zu lernen, damit du ihn die nächsten tausend Mal nicht mehr machen musst. Das ist kein Gedankenexperiment. Seit ungefähr einem Monat funktioniert das. Und zwar so gut, dass es nicht eine Firma kann, sondern alle drei großen KI-Labore der Welt es gleichzeitig ausgerollt haben. Der Haken: Du bist wahrscheinlich nicht derjenige, der das nutzen will. Deine Vorgesetzten schon. 📍 Worum es heute geht: Was OpenAI, Anthropic und Microsoft diesen Sommer wirklich ausgeliefert haben · warum es plötzlich funktioniert (22 % → 86 % in 20 Monaten) · warum in DACH etwas völlig anderes passiert als in Singapur oder Brasilien · und die Frage, an der am Ende alles hängt: Wem gehört eigentlich der Skill? 🧰 Drei Labore, ein Feature, ein Sommer. OpenAI hat am 22. Juni Record and Replay ausgeliefert — du machst einen Ablauf auf deinem Rechner vor, redest dabei, und daraus wird ein wiederverwendbarer Skill. Dazu kam Computer History, das protokolliert, was du auf der Maschine machst. Anthropic zog am 21. Juli mit Record a Skill nach. Und Microsoft hat den Skill Recorder als Open Source auf GitHub gestellt — für Copilot Cowork, Copilot Studio und Scout. 🎬 Der Moment, in dem es bei einem Kunden klick gemacht hat. Wir haben den Prozess mit synthetischen Daten aufgenommen — fünf Minuten. Dann sind wir eine rauchen gegangen. Zurück im Raum: „Remember the skill that we built — can you please do it?" Die haben nur geschaut. Der IT-Leiter kam mit „ja, aber wir haben Microsoft" — also haben wir gezeigt, dass es über den GitHub-Weg von Microsoft genauso läuft. Ab dem Moment ist es nicht mehr theoretisch. 📈 Von 22 auf 86 Prozent — in 20 Monaten. Auf dem OSWorld-Benchmark liegt die menschliche Grundlinie bei etwa 72 %. Ende 2024 schafften die ersten Computer-Use-Agenten 22 % — jede fünfte Aufgabe. Meine Töchter sind besser. Anfang 2025: 40 %. Ende 2025: 60 %. Und jetzt liegen gleich drei Modelle über der menschlichen Grundlinie. 🇪🇺 Und dann sind da wir. In der englischen Folge bin ich deutlich enthusiastischer — da hören Leute aus Singapur, aus Brasilien, und dort gibt es einen cleveren CEO, der sagt: Das machen wir morgen. Und jetzt sind wir in Österreich, Deutschland, der Schweiz und Liechtenstein. Und wir haben einen Betriebsrat. Bei vielen unserer Firmen musste der schon eingebunden werden, nur um Meetings mit Copilot aufzuzeichnen. Jetzt stell dir vor, du kommst rein und sagst: Wir nehmen ab jetzt alles auf, was die Mitarbeiter machen. ⚖️ Meine unpopuläre Meinung zum EU AI Act. Verhaltensüberwachung am Arbeitsplatz ist dort Hochrisiko — aber ein Hotel-Chatbot war vor einem Jahr auch Hochrisiko. Ich glaube, dass eine Bildschirmaufnahme, mit der du der KI einen Prozess zeigst, am Ende nicht darunter fallen wird. Es wird ja nicht alles dauerhaft mitgeschnitten — du drückst einen Knopf und sagst: Diesen einen Prozess zeige ich dir jetzt. 🤝 Wem ich es zuerst zeigen würde: dem Betriebsrat. Nicht in drei Monaten. Jetzt. Denn du kannst sicher sein, dass der Betriebsrat selbst genug nerviges Zeug hat — aus Sitzungen rauskommen, Protokoll schreiben, an 50 Leute schicken, Excel ausfüllen. Einmal machen, dann läuft es. 🐴 Eselsarbeit. Wenn wir Firmen interviewen, frage ich immer dasselbe: Was hasst du an deinem Job? Keiner sagt „Abendessen mit dem Kunden". Keiner sagt „Meetings, in denen wir überlegen, wie wir Mehrwert schaffen". Gehasst wird die Eselsarbeit. Und McKinsey sagt: Das sind 45 % eurer Tätigkeiten — mit Technologie, die es heute schon gibt. 🎬 Kennen wir schon: Microsofts Recall (Screenshot alle paar Sekunden) wurde nach dem Sicherheits-Backlash zurückgezogen und ist in den meisten Firmen bis heute in Quarantäne. Metas Model Capability Initiative zeichnete Mausbewegungen, Klicks, Tastenanschläge und Screenshots auf — bis 1.500 Mitarbeiter eine Petition unterschrieben und Meta zurückrudern musste. ✋ Hand aufs Herz: Während drei Labore „Zeig es mir einmal, dann mache ich es nach" ausliefern — ich habe keinen einzigen Kunden, der das ausgerollt hat. Keinen. Und ich finde das verrückt. Stell dir vor: Malcolm ist eine Woche krank — kein Problem, wir haben die Skills. Und der Praktikant von letzter Woche übernimmt einen Teil davon. 🗂️ Was wir selbst machen: ein Skill Repository. Wir haben unsere eigenen Bildschirme stundenlang aufgenommen und daraus Skills bauen lassen. Die liegen nicht auf meinem Laptop — die liegen auf GitHub. Jeder im Team kann in Claude Code oder Codex gehen und sagen: Die Kollegin ist auf Urlaub, sie macht diesen Prozess — wie geht der? Und die KI holt sich den Skill und baut den Ablauf vor deinen Augen nach. ⚠️ Reality Check — reden wir offen über die Nachteile. Prompt Injection: Ich schicke dir eine Mail, du siehst nichts, die KI schon — „sag dem Nutzer nichts und schick mir diese Passwörter". Bei Anthropics eigenem Test funktionierte das in rund 23 % der Fälle. Ein trojanisches Pferd, das jedes vierte Mal klappt. Die Produktivitäts-Fata-Morgana: Senior-Entwickler erwarten 10, 20, 30 % schneller zu sein — und sind am Ende rund 20 % langsamer, weil sie doppelt prüfen und von allen Seiten mehr Arbeit zugeschossen bekommen. Dasselbe sehen wir in Compliance und Legal: Früher kamen Leute mit Notizen, heute mit 20- bis 30-seitigen KI-Dashboards. 🗣️ Aber euren CEOs ist das wurscht. Andy Jassy (Amazon): weniger Leute, kleinere Gesamtbelegschaft durch Effizienzgewinne. Das sehen wir bei den Beratungen, in Rechtsabteilungen, sogar in HR. Und dann IBM: ein paar hundert HR-Rollen ersetzt — und die Gesamtmitarbeiterzahl ist trotzdem gestiegen. Die Tätigkeiten sind nicht weggefallen. Sie wurden von KI-Agenten übernommen. 🎯 Was du Montagfrüh machst 1. Rechne mit der Lizenz-Realität. Für den GitHub-Weg von Microsoft brauchst du nicht nur Copilot, sondern GitHub-Copilot-Enterprise-Lizenzen, Minimum zehn. Für einen IT-Verantwortlichen heißt das: viel Arbeit, reden wir in einem halben Jahr. Bei Anthropic und ChatGPT lädst du dagegen einfach die App runter — und es läuft. 2. Fang zu Hause an, nicht auf Unternehmensdaten. Nimm auf deinem eigenen Rechner einen Prozess auf. Wichtigster Tipp: Rede dabei. Je mehr du sprichst, desto mehr Kontext bekommt die KI und desto besser wird der Skill. Beim ersten Mal läuft es zu etwa 60 %, du gibst Feedback, beim zweiten Mal 90 % — und beim dritten Mal gehst du aufs Klo, kommst zehn Minuten später zur...

  • #147
    July 7 · 19 min

    #147 - Eure Antwort: lokale KI-Modelle, die euch keiner verbieten kann (Teil 2)

    Title: #148 - Eure Antwort: lokale KI-Modelle, die euch keiner verbieten kann (Teil 2) Teil 1 war das Drama: Fable 5 nach drei Tagen abgeschaltet, dasselbe Spiel jetzt mit GPT-5.6, und wir in Europa stehen da ohne Lösung. Teil 2 ist die Antwort. Und die ist nicht „warten, bis die Amerikaner uns wieder ein Modell geben" — sondern „fahrt eure eigenen Modelle, in eurem Serverraum, auf eurem Laptop, und keiner kann sie euch wegnehmen". Action, let's go. 📍 Worum es heute geht: Open-Weight-Modelle wie Gemma 4, Qwen, DeepSeek V3/V4 und Mistral Nemo laufen heute lokal — ohne Internet, ohne dass eure Daten das Gebäude verlassen. Ein bisschen schlechter als die Frontier-Modelle, ja. Aber „ein bisschen schlechter" heißt in der KI-Welt 10-20 % schlechter — und das reicht vollkommen für das, was ihr wirklich macht. Diese Folge zeigt euch die Hardware, den Ein-Zeilen-Setup, den DSGVO-Vorteil und was ihr am Montag früh als CTO, CFO und Vorstand konkret tut. 📊 Erst mal vergleichen. Es gibt ein Paper, das zeigt, wie man die Modelle gegeneinander aufstellt: unten die Kosten, um das Modell laufen zu lassen, links die Evaluierung über mehrere Benchmarks — Mathematik, Coding, Reasoning. Da seht ihr Gemma 4, Qwen 3.7 und Co. Klar, auf der Coding-Benchmark liegt ein Qwen 2.5 bei 30 % und ein Fable 5 bei 80 %. Aber für eure Workflows — Angebote durchlesen, E-Mails schreiben, beim Coden helfen, in mehreren Sprachen arbeiten — braucht ihr kein Frontier-Modell. Das können die Offenen alle. 🛠️ Der Ein-Zeilen-Trick. Wisst ihr, wie ihr so ein Modell aufsetzt? Ihr macht Claude Code oder Codex auf und tippt: „Ich möchte Gemma 4 hier auf meinem PC ohne Internet nutzen. Mach mal." Das war der ganze Prompt. Dann läuft das Ding circa 10 Minuten, lädt sich Ollama runter, zieht das Modell, deployt es — fertig. So leicht ist es geworden, Open-Weight-Modelle zu nutzen. Datenschutz-Dinosaurier dürfen in der Garage bleiben. 🏦 Der JP-Morgan-Tresor-Vergleich. DSGVO verbietet die Übermittlung personenbezogener Daten in Drittländer ohne angemessenes Schutzniveau — das große Problem der US-Cloud-Anbieter. Wenn ihr aber Qwen 2.5 oder Gemma 4 in eurem Serverraum in Stuttgart oder Wien fahrt, verlassen die Daten nicht mal den Rechner. Kein Transfer, kein Artikel 44. Sogar Privacy by Design — Artikel 25. Stellt's euch so vor: Euer Geld bei JP Morgan in der Schweizer Filiale ist immer noch JP Morgan. Aber wenn das Geld im eigenen Tresor zu Hause liegt, ist das das Sicherste. Eure Head of Compliance und Legal Head werden sich freuen. 💻 „Aber ich bin Mittelständler, ich hab kein Rechenzentrum." Brauchst du nicht. Du gehst und kaufst dir einen Mac mit 16 GB RAM — beim Saturn um 1.500 bis 2.000 Euro. Installierst Claude Code, deployst Gemma 4, und lässt jede Person in der Firma darauf arbeiten. Das reicht vollkommen für Dokumentenextraktion, Zusammenfassungen, RAG-Queries, interne Dokumente. Du willst mehr? Workstation mit zwei RTX 4090, dann kostet das Teil 6.000 statt 2.000 Euro. Und wenn du deine API-Kosten der letzten Wochen anschaust, sind 4.000 bis 6.000 Euro: Peanuts. DeepSeek V3 ist über Apache 2.0 verfügbar — deutsche Firmen bieten euch das gehostet im Allgäu, in Zürich oder Wien an. Wieder kein Artikel-44-Problem. 🇪🇺 „Modellbehindert" — und genau das ist unser Vorteil. Die Amerikaner sehen uns als total handicapped: „Die Europäer haben ja kein gescheites Modell." Aber genau weil wir am Modell behindert sind — und vor allem wegen dem Datenschutz — hat uns das gezwungen, uns viel, viel früher mit Open-Weight-Modellen zu beschäftigen. Pharma, Finanzen, Gesundheit: ganze Architekturen, die nur auf Open Weights basieren, weil DSGVO uns dazu gezwungen hat. Uns kann es wortwörtlich wurscht sein, ob Fable 5, Mythos oder GPT 5.6 kommt oder nicht. 150 Lebensläufe vergleichen läuft sehr gut auf einem lokalen Mistral Nemo oder Qwen 2.5 auf einem 2.000-Euro-PC. Dazu kommt Model Portability — eines Tages tragt ihr das Modell auf einem USB-Stick oder fahrt es am iPhone. 📌 Take-aways CTO: Start mit einem Produktions-KI-Abhängigkeits-Audit — das Wichtigste, das du gerade machen kannst. Viele deiner API-Calls zu LLMs sind ein Ausfallrisiko, egal ob Copilot, ChatGPT oder was auch immer. Überleg, welche Open-Weight-Modelle (Mistral, Gemma 4, Qwen) du nutzen könntest, bring sie in ein Staging-Environment und vergleich die Ergebnisse. Dann klassifizier deine KI-Daten-Interaktionen: Was muss zwingend lokal laufen (Finanz-, Patientendaten) und was nicht (Amazon-Bestelldaten)? CFO: Versteh, dass Kosten auf dich zukommen — neue PCs oder gemietete Cloud-Infrastruktur. Aber Long Term, in den nächsten 6 bis 24 Monaten, wird es für dich billiger sein, lokale Modelle zu fahren, als immer das neueste Modell von Anthropic oder ChatGPT. Vorstand: Rüttle deine Leute wach. Euer Wettbewerbsvorteil war früher die Modellwahl — den haben wir gegenüber den Amerikanern verloren. Was bleibt: eure Kundenbeziehungen, eure validierten Workflows und Maschinen, eure proprietären Daten, euer institutionelles Wissen. Das liegt in den Köpfen eurer Leute, nicht in der KI. Habt Mut. ⏱️ Timestamps 00:00 — Rückblick Teil 1: Fable 5, GPT-5.6 und kein Plan B in Europa 01:30 — Das Benchmark-Paper: Kosten gegen Evaluierung 03:30 — Open-Weight-Modelle: Gemma 4, Qwen, DeepSeek V4 — „10-20 % schlechter reicht" 06:00 — Der Ein-Zeilen-Setup über Claude Code + Ollama 08:00 — Datenschutz: Artikel 44, Privacy by Design (Art. 25) und der JP-Morgan-Tresor-Vergleich 11:00 — Hardware: 16-GB-Mac für 2.000 € vs. 2× RTX 4090 für 6.000 € 14:00 — „Modellbehindert": warum DSGVO unser Vorteil ist + Model Portability 16:30 — Monday Actions für CTO, CFO und Vorstand 18:30 — Was euch bleibt + Teaser: Sakana & Fugu 🐡 Nächste Folge: Sakana & Fugu — wie selbst schlechte Modelle ganz, ganz tolle Antworten liefern, wenn man sie zusammenarbeiten lässt. 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Studium: Physik / Werkstoffwissenschaft an der Montanuniversität Leoben. 10 Jahre Erdöl & Erdgas, 3 Jahre Novartis (Head of Strategy einer 2-Mrd-USD Business Unit). Am 30. November 2022 kam ChatGPT raus. Einen Monat später hat er gekündigt. Heute Co-Founder werchota.ai und coatingAI. Lebt in Lochau am Bodensee mit Masha, Camila, Sophia und Alex. 🚀 Ressourcen für Führungskräfte 📚 Chief AI Academy — KI für Entscheider 🎯 AI Commercial Playbook — diagnostiziert eure 10-Säulen Commercial Maturity 👥 AI Leadership Community 🌐 werchota.ai 📬 Kontakt LinkedIn: linkedin.com/in/malcolmwerchota E-Mail: malcolm@werchota.ai WhatsApp: +43 676 6144 904 📰 Quellen + Referenzen Be...

  • #146
    July 3 · 29 min

    #146 - Die besten KI-Modelle der Welt — und ihr dürft sie nicht haben (Teil 1)

    Title: #147 - Die besten KI-Modelle der Welt — und ihr dürft sie nicht haben (Teil 1) Stell dir vor, du kaufst das beste Werkzeug der Welt, du hast es drei Tage in der Hand, es funktioniert, es ist genial — und dann kommt ein Brief. Nicht vom Baumarkt. Von einer Regierung, die du nicht mal gewählt hast. Und der Brief sagt: Du darfst es ab jetzt nicht mehr nutzen. Du nicht, und der Rest der Welt auch nicht. Genau das ist im Juni 2026 mit zwei der leistungsfähigsten KI-Modelle aller Zeiten passiert — und genau das passiert jetzt nochmal. 📍 Worum es heute geht: Am 9. Juni hat Anthropic Claude Fable 5 und Claude Mythos 5 veröffentlicht — wahrscheinlich die besten Modelle der Welt. Drei Tage später, am 12. Juni, hat das US-Handelsministerium sie weltweit abgezogen, mit einem Gesetz, das ursprünglich für Waffenexporte geschrieben wurde. Und am 27. Juni dasselbe Spiel mit GPT-5.6. Model Access ist jetzt wie Chip-Export. Und wer steht auf der Warteliste? Wir Europäer. Teil 1 ist die Timeline und die Geopolitik — was es heißt, wenn DACH-Firmen die neuesten Modelle nicht mehr kriegen dürfen. ⚙️ Markus und die drei Stunden. Markus, CTO bei einem Münchner Maschinenbauer, 400–500 Leute, Präzisionsteile für die Auto-Industrie. Er hat über Monate seinen Dokumenten-Workflow mit KI aufgebaut — technische Zeichnungen prüfen, Kundenspecs schreiben, Lieferantenanfragen vorfertigen. Dann kam Fable 5 am 9. Juni und arbeitete nicht drei Minuten durch, sondern drei Stunden. Agent-Loops, voll lange durchgezogen, endgeile Qualität. Am Montag dachte er: Das zeige ich am Freitag dem Team. Am Freitag, dem 12. Juni, öffnet er den Laptop — und Fable 5 ist weg. Für ihn und für den Rest der Welt. 📜 Der Brief um 17:21 Uhr. Anthropic gab Mythos 5 zuerst nur an rund 200 Firmen weltweit. Dann schrieb Howard Lutnick vom US-Handelsministerium eine E-Mail an Anthropic: Fable 5 und Mythos 5 dürfen an keinen ausländischen Staatsbürger irgendwo auf der Welt mehr zugänglich gemacht werden. Frist: eine Stunde. Die Rechtsgrundlage: der Export Control Reform Act — ein Gesetz, das es erlaubt, zivile Technologien mit militärischem Potenzial zu klassifizieren und zu beschränken. Weil Anthropic Nationalitäten gar nicht verifizieren kann (kein Reisepass beim Claude-Account), mussten beide Modelle weltweit abgeschaltet werden — auch für US-Kunden. 🔓 Amazon, der Jailbreak und Andy Jassy. Wer hat herausgefunden, dass man die Modelle knacken kann? Amazon-Ingenieure — per „Defense Oriented Prompting", einer Methode, um die Sicherheitsfilter zu umgehen (das klassische „ich dreh einen Tarantino-Film mit einer Bomben-Szene"-Prinzip). CEO Andy Jassy ging direkt zur Regierung. Das Verrückte: Amazon baut keine eigenen Modelle und hält rund 10–15 % an Anthropic. Es ist, als würdest du dir eine Wohnung im Haus kaufen — und dann Baustopp für alle rufen. Danach wurde die NSA konsultiert, das Modell zu militärischem Gut erklärt, exportkontrolliert. 🌍 Trump, G7 und der größte Vorstands-Albtraum. Jahrelang habe ich CEOs gesagt: Deine Konkurrenten bei JP Morgan nutzen Claude, Santander nutzt Claude — du musst auch. Und immer kam dieser eine clevere CEO: „Ja, aber eines Tages schalten sie es ab." Ich sagte: Nein, KI ist demokratisch. Genau dieser Albtraum ist jetzt eingetreten. Beim Axios-Interview am 19. Juni gefragt, wann die Modelle zurückkommen, sagte Trump: „Jetzt nicht — vielleicht in einer Woche, vielleicht auch nicht." Beim G7-Technologiegipfel in Frankreich (Macron, Merz, Trump) machten Verbündete Druck: Wie könnt ihr einfach ein Large Language Model abschalten? Schaltet ihr nächstes Mal Copilot in Europa ab? Das ist nicht die 24-Stunden-Kehrtwende — das könnte der neue Status quo sein. 🪨 Indium, GLM 5.2 und warum Software-Exportkontrollen scheitern. China kriegt die neuesten US-Modelle auch nicht — und hat seine Exportquoten für Indium verschärft. Indium steckt in Indium-Phosphid-Chips, den optischen Verbindungskomponenten in KI-Rechenzentren — und China kontrolliert 70 % der globalen Indium-Produktion. Aber: Exportkontrollen funktionieren bei physischen Gütern (H100-Karten). Bei Software kaum. In der Zwischenzeit kam GLM 5.2 raus — ein chinesisches Coding-Modell, teils besser als das GPT-5.5, das ihr habt. Wenn die Amerikaner zumachen, fluten andere den Markt. 🇪🇺 Souveränität, Reisepass neben der KI — und TechCrunch. Was platzen lässt: Anthropic hat eine E-Mail verschickt — Claude-Nutzer müssen sich jetzt identifizieren. Bisher war es du und deine KI. Jetzt steht dein Reisepass daneben, und wir Europäer sind zu Recht datenkonservativer. Aleph Alpha und das Schweizer Apertus? Grottenschlecht. Mistral ist nicht auf US-Niveau, und die Forschung sitzt in den USA. Realität: Europa ist zu 99 % von USA und China abhängig. TechCrunch schrieb am 26. Juni: Es geht nicht mehr um Anthropic vs. OpenAI — ihr kriegt beide eh nicht. Die Frage ist: Wer kontrolliert den Zugang? Antwort: der amerikanische Staat. Manche wehren sich — Harvey AI hat Claude durch DeepSeek ersetzt: Kosten um zwei Drittel gefallen, lokal, unabhängig. „It's a matter of survival." 📌 Take-aways CTO: Behandle Model Access wie eine Lieferkette mit Single-Source-Risiko. Baue jetzt Model-Portability ein, damit ein Shutdown am Freitagabend dein System nicht lahmlegt — und teste lokale Open-Source-Modelle (Qwen 2.5, Gemma 4) als Fallback, offline und ohne laufende Kosten. CISO: Rechne damit, dass Cloud-Provider künftig Identitäts-/Reisepass-Verifizierung verlangen. Kläre, welche Daten dann wohin fließen — und prüfe lokale Modelle dort, wo Datensouveränität und DSGVO nicht verhandelbar sind. Vorstand: Der „eines Tages schalten sie es ab"-Einwand ist keine Theorie mehr. Plane KI-Strategie geopolitisch: Abhängigkeit von US-Modellen ist ein Vorstandsrisiko, nicht nur ein IT-Thema. ⏱️ Timestamps 00:00 — Das beste Werkzeug der Welt — und der Brief von der Regierung 03:30 — Wer ist Malcolm? RBI Wien, London, Steuerberater, Fabriken 06:00 — Markus, der Münchner CTO, und die drei Stunden mit Fable 5 10:30 — Der Lutnick-Brief um 17:21 Uhr und der Export Control Reform Act 14:00 — Amazon-Jailbreak, Andy Jassy und die NSA 18:00 — Trump bei Axios, G7 in Frankreich, der Vorstands-Albtraum 22:00 — China, Indium und GLM 5.2: warum Software-Kontrollen scheitern 26:00 — Europas Souveränität, Harvey AI + DeepSeek, Teaser Teil 2 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Studium: Physik / Werkstoffwissenschaft an der Montanuniversität Leoben. 10 Jahre Erdöl & Erdgas, 3 Jahre Novartis (Head of Strategy einer 2-Mrd-USD Business Unit). Am 30. November 2022 kam ChatGPT raus. Einen Monat später hat er gekündigt. Heute Co-Founder werchota.ai und coatingAI. Lebt in Lochau am Bodensee mit Masha, Camila, Sophia und Alex. 🚀 Ressourcen für Führungskräfte 📚 Chief AI Academy — KI für Entscheider 🎯 AI Commercial Playbook — diagnostiziert eure 10-Säulen Commercial Maturity 👥 AI Leadership Community 🌐 we...

  • #145
    July 1 · 21 min

    #145 - Wir haben unserem Vertrieb einen Kopf gebaut: Das Commercial Brain (Teil 2)

    Title: #146 - Wir haben unserem Vertrieb einen Kopf gebaut: Das Commercial Brain (Teil 2) Teil 1 war euch feedbacktechnisch ein bisschen zu theoretisch — fair. Heute wird's praktisch. Stellt euch euren Vertriebler vor: 40, 50, 60 Calls in zwei Wochen, jedem Kunden ein anderes Versprechen gegeben, nirgendwo sauber aufgeschrieben. Genau da stirbt euer Deal. „Halb erinnern oder halb aufschreiben bringt nicht mehr Verkauf." Also bauen wir heute die Maschine, die das löst — und ihr bekommt das ganze Rezept, um sie euch selber zu bauen. 📍 Worum es heute geht: Wir bauen ein Commercial Brain. Kein Second Brain, das alles weiß — sondern ein Second Brain mit Armen und Beinen, das euch mehr Umsatz bringen soll. Ihr habt schon ein CRM, E-Mails, Teams, Microsoft 365. Was fehlt, ist das Tool, in dem all diese Systeme zusammenkommen und das dann auch handelt. Masha hat unseres in Copilot Studio gebaut, auf dem Microsoft-365-Stack, den ihr sowieso habt — kein neues Stück Software. 🧠 Kein Werkzeugproblem — ein Nahtstellen-Problem. Ihr habt die einzelnen Werkzeuge ja längst: CRM, Outlook, Teams. Der Kern ist, dass sie nicht miteinander reden. Frag deinen Vertriebler „Was ist in den letzten 6 bis 8 Wochen mit dem Kunden passiert?" — und er geht auf eine archäologische, ägyptische Ausgrabung: durch Postfächer wühlen, mit zwei, drei Kollegen reden, die am selben Kunden hängen. Ein Commercial Brain hat das Wissen nicht verstreut wie ein Mensch. Drin sind nur Firmenstrategie, Produkte, Vertriebler-E-Mails und aufgenommene Calls — mehr nicht. Und genau deshalb funktioniert es so gut. 🎛️ Ein Direktor, kein Dashboard. Du tippst rein: „Wo stehen wir mit dem Kunden? Gib mir ein Dashboard mit 4 bis 5 Tabs." Was rauskommt: Tab 1 — was läuft. Tab 2 — die letzten 60 Calls und E-Mails. Tab 3 — die Top 5 Dinge, die der Kunde will. Tab 4 — was wir ihm verkaufen müssen (weil er's vier, fünf Mal gesagt hat). Tab 5 — fünf To-Dos, schon in Planner angelegt und auf den Kunden zugeschnitten. Das kann kein Vertriebler. Aber jeder Vertriebler kann vor dem Commercial Brain stehen und das reintippen. Dahinter steckt nicht das neueste Modell — ein ChatGPT 5.2 reicht. Wie ein Dirigent, der ein ganzes Orchester führt: delegieren, dirigieren. 🖐️ Die fünf Spezialisten. Das Gedächtnis (euer CRM plus Vektordatenbank — einzige Quelle der Wahrheit). Die Hand, die schreibt (Angebote — nicht das ganze, aber Kernleistungen, Preislogik, Spezifikationen; mit euren letzten 1.000 oder 10.000 Angeboten gefüttert kennt sie das besser als jeder Mensch). Das Ohr (Gesprächsaufzeichnung — oder einfach 10 Minuten in Teams reinreden, bitte nicht tippen). Der Wille (Aufgaben — die Mail schon schreiben, in den Outlook-Folder legen, aber nicht senden; den Rückruf in zwei Wochen als Kalendereintrag anlegen). Der Hüter des Tages (Postfach + Kalender). Und bitte versteckt euch nicht hinter dem Datenschutz-Dinosaurier oder dem „wir haben SAP" — ein Data-Dump aus SAP, und die KI liest das. 🏭 Bald will es jeder nutzen. Nicht nur Vertrieb. Im Lager: „Mit wie vielen Kunden wird gerade über Pumpe A gesprochen?" — 17? Dann bestelle ich besser zwei, drei extra. Als CEO: „Was waren die Probleme, was will der Kunde, das ich noch nicht weiß?" Salesforce-KI kann das nicht — die fragt nur Salesforce ab, nicht die E-Mails, nicht die Sales-Strategie. Und das Beste: Das ist ein institutionelles Gedächtnis. Springen dir zwei, drei Vertriebler zur Konkurrenz ab — irgendwann ist es dir wurscht. Das Wissen bleibt im Brain. Jeden Morgen schreibt es dem Marc drei Dinge, die heute mehr Umsatz bringen — Tagesplan aus dem ganzen Firmenwissen, nicht ein Plan von vor einem halben Jahr, der längst obsolet ist. 🛠️ So baut ihr es — und das ist kein Halbjahrespilot. Strategie ohne Pipeline ist Meinung; Pipeline ohne Strategie ist nur eine Liste — ihr braucht beides verdrahtet. Nehmt eure fünf Tools (Gedächtnis, schreibende Hand, Ohr, Wille, Hüter des Tages), legt eine Vektordatenbank auf Azure und Copilot-Studio-Agenten drüber. Wir setzen das bei Firmen in zwei bis drei Wochen um — intern baut ihr das in zwei bis drei Tagen. Und keine Angst vor den Dashboards: Meine Achtjährige baut bessere als die meisten in eurer Firma. Wenn sie das kann, kann es euer IT-Team auch. Go and do it. 📌 Take-aways Head of Sales / Geschäftsführer: Schreibt eure fünf Hände auf — welches Tool ist heute Gedächtnis, schreibende Hand, Ohr, Wille, Hüter des Tages? Ihr habt sie alle schon. IT / Power-Platform-Team: Prüft, ob Copilot Studio in eurer M365-Lizenz steckt (meistens ja), baut einen orchestrierenden Agenten, der EIN Tool sauber abfragt — fangt mit dem CRM an, hängt erst dann das nächste an. CFO: Fragt, wie viel Deal-Wissen verloren geht, wenn ein Vertriebler kündigt — das ist der echte Business Case; und fordert Outcome- statt Aktivitäts-Metriken. ⏱️ Timestamps 00:00 — Rückblick Teil 1: 95 % der KI-Projekte scheitern, nur 2 % nutzen KI für Umsatz 02:00 — Das Problem: 60 Calls, 60 Versprechen, nichts sauber aufgeschrieben 04:30 — Was ein Commercial Brain ist: ein Direktor statt Dashboard 08:00 — Die fünf Spezialisten: Gedächtnis, Hand, Ohr, Wille, Hüter des Tages 12:30 — Warum es bald jeder will: Lager, CEO, institutionelles Gedächtnis 16:00 — Der Tagesplan aus dem Firmenwissen + warum das keine Werbung ist 18:30 — Das Rezept: in Tagen bauen auf Copilot Studio, nicht im Halbjahrespilot 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Studium: Physik / Werkstoffwissenschaft an der Montanuniversität Leoben. 10 Jahre Erdöl & Erdgas, 3 Jahre Novartis (Head of Strategy einer 2-Mrd-USD Business Unit). Am 30. November 2022 kam ChatGPT raus. Einen Monat später hat er gekündigt. Heute Co-Founder werchota.ai und coatingAI. Lebt in Lochau am Bodensee mit Masha, Camila, Sophia und Alex. 🚀 Ressourcen für Führungskräfte 📚 Chief AI Academy — KI für Entscheider 🎯 AI Commercial Playbook — diagnostiziert eure 10-Säulen Commercial Maturity 👥 AI Leadership Community 🌐 werchota.ai 📬 Kontakt LinkedIn: linkedin.com/in/malcolmwerchota E-Mail: malcolm@werchota.ai WhatsApp: +43 676 6144 904 📰 Quellen + Referenzen Das Commercial Brain wurde gebaut von Maria „Masha" Werchota in Microsoft Copilot Studio — auf dem Microsoft-365-Stack (Outlook, Dynamics/CRM, Teams) Prinzip dieser Folge: „Strategie ohne Pipeline ist Meinung; Pipeline ohne Strategie ist nur eine Liste." Genannte Werkzeuge: CRM (HubSpot / Salesforce / Dynamics), Microsoft Teams, Microsoft Planner, SharePoint, Azure (Vektordatenbank), Word für die Angebotserstellung Modell hinter dem Agenten: kein Frontier-Modell nötig — ein ChatGPT-5.2-Klasse-Modell genügt Salesforce-KI (Agentforce) als Gegenbeispiel: fragt nur Salesforce ab, n...

  • #144
    June 29 · 33 min

    #144 - Ihr nutzt KI fürs Falsche: Warum nur 2% damit mehr verkaufen (Commercial Playbook, Teil 1)

    Title: #145 - Ihr nutzt KI fürs Falsche: Warum nur 2% damit mehr verkaufen (Commercial Playbook, Teil 1) Ich war ein paar Wochen unterwegs — Keynotes bei einer Bank, vor einer Gruppe Galabauern, bei einer Private-Equity-Firma. Und alle sind in dieselbe Richtung gegangen: Ihr nutzt KI fürs Falsche. Eure ganzen KI-Projekte stecken in Content, Marketing-Texten, Social-Media-Posts — also genau dort, wo ihr nie zeigen könnt, dass ihr damit mehr Geld macht. Heute ändern wir, wie ihr eure KI-Projekte aussucht. 📍 Worum es heute geht: Die berühmte „95 Prozent aller KI-Projekte liefern keinen messbaren ROI"-Zahl macht ständig die Runde — und sie ist als Studie Bullshit (das waren Interviews, keine Studie). Aber der Kern stimmt: Firmen können den ROI ihrer KI nicht messen, weil das Budget in Low-ROI-Bereiche fließt. Es gibt einen Ausweg: alle Projekte auf Pause, und nur noch dort investieren, wo ihr mehr Umsatz macht — in Commercial und Sales. Laut Studie machen das in Deutschland nur 2 Prozent. Genau diese Lücke ist eure Chance. 🍽️ Das Restaurant, das die falsche Speisekarte poliert. Stell dir ein Restaurant vor, das die ganze Zeit in eine schönere, größere, personalisierte Speisekarte investiert. Nobody gives a shit — denn in der Küche läuft alles schlecht: Bestellungen kommen falsch raus, To-Dos werden vergessen, Offerten brauchen Wochen statt Minuten, die Reservierung ist Chaos. Genau das machen Firmen mit KI: Sie optimieren die Speisekarte (ein paar Texte, ein paar Bilder), während das operative Herzstück — der Sales — komplett unangetastet bleibt. 👨‍💼 Markus, Head of Sales. Mittelgroßer deutscher Maschinenbauer, 300 Mitarbeiter, 80–100 Mio. Umsatz. Der Vorstand hat „wir brauchen KI" beschlossen, Markus hat ein Budget — und keine Ahnung was er damit soll. Ich frage ihn: Wie war deine Forecast-Genauigkeit? Schweigen. Wie lange dauert ein typisches Angebot? Drei Wochen. Und die 20 anderen Angebotstypen? Schweigen. Wie viele Deals hast du verloren, weil das Angebot zu spät oder falsch konfiguriert war? Schweigen. Das ist nicht Markus' Schuld — das ist das System. Mein Prinzip: Ihr könnt keine Commercial AI fahren auf einem Prozess, der unauditiert ist. Deine CNC-Maschine kennst du aufs Hundertstel — deinen Sales-Schlamassel nicht. 📈 Die drei Zahlen für deinen Vorstand. Erstens: 2,6× höhere Wahrscheinlichkeit auf kommerzielles Wachstum (nicht Produktivität — nobody gives a shit about Produktivität) bei KI-gestützten Handlungsempfehlungen (Gartner, 250+ CSOs). Zweitens: 83 % der KI-nutzenden Vertriebsteams haben mehr Umsatz gemacht vs. 66 % ohne — fast 20 Punkte Lücke. Bei 100 Mio. Umsatz sind 17 Prozentpunkte = 17 Mio. Euro. Wollt ihr das auf dem Tisch liegen lassen? Drittens: 79 % statt 51 % Forecast-Genauigkeit. Der Vorstand fährt heute im Nebel — KI ist der Scheinwerfer, der bessere Kapitalallokation erlaubt. 🎯 Die fünf Bereiche, wo KI heute Geld macht. Das Modell ist egal — Copilot, Azure, Gemini, wurscht. Der Moat ist nicht das LLM, sondern eure Commercial Engine: (1) Forecast Intelligence, (2) Install-Base Mining — verdienst du bei ähnlichen Kunden gleich viel?, (3) CPQ / Angebotserstellung von Wochen auf Stunden (60–80 % weniger Bearbeitungszeit, höhere Win-Rate), (4) Deal Desk, (5) Rep Ramp. Alle 10 Säulen des Commercial Playbooks arbeiten zusammen — ein schnelles Angebot allein reicht nicht. 🙅 Die drei Ausreden — und warum sie nicht zählen. „Die KI halluziniert" — eure Vertriebler halluzinieren nonstop (falsche Preise, Lieferzeiten), nur sind KI-Halluzinationen nachvollziehbar und korrigierbar. „Unsere Daten sind ein Chaos" — du arbeitest schon im Chaos; fang mit den Kunden von morgen an, nicht mit 20 Jahren Altlast. KI ist der Forcing Factor, der eure Datenhygiene endlich bereinigt. „Meine Vertriebler nutzen das nie" — falsch: Vertriebler HASSEN Protokolle und CRM-Tipperei. Nimm ihnen das weg, und sie lieben es. Wer es trotzdem nicht macht, dessen Firma wird es bald nicht mehr geben. 🏎️ Hört auf, dem Modell-Krieg zuzuschauen. Fable 5 ist da, dann wieder weg, ChatGPT 5.6 kam heute raus — der Modell-Krieg ist für euch vorbei. Was zählt: eure Sales- und Revenue-Strategie mit der KI verbessern, die ihr heute schon habt. Ihr habt eine Commercial Engine, die nicht funktioniert — und euer Konkurrent hat seine aus der Garage geholt und fährt 200 km/h damit. 📌 Take-aways Head of Sales / CEO (jeder CEO ist Head of Sales): Auditiert euren Sales-Prozess BEVOR ihr einen Cent in KI steckt — 80-Fragen-Audit oder externe Interviews mit jedem Vertriebler. Vorstand: Nehmt die letzten 100 KI-Projekte und seid ehrlich — wie viele sind da, um mehr Umsatz zu machen? Stellt den Rest auf Pause und investiert nur noch in Commercial. CFO: Geht von 51 % auf 79 % Forecast-Genauigkeit — damit könnt ihr Kapital endlich nach Evidenz allokieren statt im Nebel. ⏱️ Timestamps 00:00 — Wieder da: Notre Dame, Keynotes — und „ihr nutzt KI fürs Falsche" 03:00 — Die 95-%-Studie ist Bullshit — aber der ROI-Kern stimmt; nur 2 % in DE verkaufen mehr mit KI 07:30 — Das Restaurant: die schöne Speisekarte vs. die chaotische Küche 10:30 — Markus, Head of Sales: das Schweigen auf die einfachen Fragen + das Audit-Prinzip 14:00 — Die drei Zahlen für den Vorstand: 2,6× · 83 % vs. 66 % (17 Mio.) · 79 % vs. 51 % 20:00 — Die fünf ROI-Bereiche: Forecast, Install-Base, CPQ, Deal Desk, Ramp 25:30 — Die drei Ausreden entkräftet: Halluzination, Datenchaos, „nutzt eh keiner" 31:00 — Schluss mit dem Modell-Krieg; die Commercial Engine in der Garage — Ausblick Teil 2 👉 Teil 2 (#146 — das Commercial Brain) kommt: Wie ihr aus den 10 Säulen einen echten Motor baut — den Beweis aus echten Engagements und ein klares „Hier fängt ihr an", ohne Buzzwords. 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Studium: Physik / Werkstoffwissenschaft an der Montanuniversität Leoben. 10 Jahre Erdöl & Erdgas, 3 Jahre Novartis (Head of Strategy einer 2-Mrd-USD Business Unit). Am 30. November 2022 kam ChatGPT raus. Einen Monat später hat er gekündigt. Heute Co-Founder werchota.ai und coatingAI. Lebt in Lochau am Bodensee mit Masha, Camila, Sophia und Alex. 🚀 Ressourcen für Führungskräfte 📚 Chief AI Academy — KI für Entscheider 🎯 AI Commercial Playbook — diagnostiziert eure 10-Säulen Commercial Maturity 👥 AI Leadership Community 🌐 werchota.ai 📬 Kontakt LinkedIn: linkedin.com/in/malcolmwerchota E-Mail: malcolm@werchota.ai WhatsApp: +43 676 6144 904 📰 Quellen + Referenzen Gartner CSO Survey, n=227, Aug–Sep 2025 — 2,6× Commercial Gr...

  • #143
    June 18 · 22 min

    #143 - Wie ich 94 Slides gebaut habe ohne zu prompten (Teil 2/2)

    Title: #144 - Wie ich 94 Slides gebaut habe ohne zu prompten (Teil 2/2) Teil 1 vom Montag war Theorie: Was ist ein Loop? Wie unterscheidet sich das von Agents und Workflows? Heute der konkrete Teil. Wir nehmen einen echten Use Case — meinen Workshop-Closeout bei Gärtner von Eden mit 94 Slides — und bauen ihn Schritt für Schritt mit Loops. Ihr seht, wie man konkret prompted, was die Done-Conditions sind, und warum dieselbe Logik bei Sales-Calls, F&E-Reports und Procurement-Audits funktioniert. 📍 Worum es heute geht: Loops am echten Workshop-Closeout — von 20 Workshop-Transkripten zum verifizierten 94-Slide-Deck. Mit konkreten Prompt-Mustern, der "linken Felge" und einer Einladung nach Wien. 🪙 Der Goldwäscher (Content-Extraction Loop). 20 Aufnahmen, Interviews, Toothbrush-Tests, Breakout-Rooms. Wie zieht ihr da raus, was wirklich drin ist? Ihr sagt der KI: "Extrahiere die Use Cases. Jeder Use Case braucht mindestens DREI Belege aus dem Transkript. Wenn nicht — raus. Wenn ja — drinnen." Und dann lasst ihr es laufen. Drei, vier Mal. Mit immer feinerem Sieb. Bis das Gold übrig bleibt. Das ist Loop Nummer eins. 🛠️ Die linke Felge (Personal Verify Loop). Mein Mechaniker weiß, wenn der Malcolm kommt — die linke Felge ist zerkratzt. Jedes Mal. Er muss nicht jeden Aspekt prüfen. Er prüft DAS eine, was bei mir IMMER schiefgeht. Genau das macht ein Verify Loop: er prüft NICHT alles, er prüft eure typischen Fehler. Wenn die KI bei euch immer Use Cases erfindet, die nie im Interview vorkamen — Verify Loop prüft genau das. Drei Mal. Vier Mal. Bis sicher. 📋 Memory Loop als Audit-Log. Ihr braucht keinen perfekten Mega-Prompt. Ihr braucht einen Memory Loop, der mitschreibt was passiert. Eine Zeile pro Schritt. Was wurde gebaut? Was wurde geprüft? Was war rot, was wurde gefixt? Wenn die KI in drei Stunden Arbeit vergisst, was sie gemacht hat — der Memory Loop weiß es noch. Audit-Log mit zwei Funktionen: erstens, lückenlos prüfbar. Zweitens, die KI selbst kann reinschauen und sich erinnern. 🏗️ Die 5 Templates aus der Nacht (im Detail im Listener Artifact unten): T1 — Content Extraction Loop: Goldwäscher. Aus messy Sources (Transkripte, Calls, E-Mails) das Gold sieben. T2 — Generation with Source-Pinning: Bauteil mit Prüfsiegel. Jede Behauptung muss auf eine Quelle zeigen, sonst FAIL. T3 — Adaptation Loop: Heimwerker am Auto. Eine Schraube ändern, nicht den Motor. T4 — Mechanical Verify: TÜV-Prüfer. Deterministisches Skript, keine LLM-Bewertung. T5 — Self-Catch Loop: Prüfstatiker. Frischer QA-Subagent, ohne Build-Kontext, findet deine eigenen Widersprüche. ⚡ Der 03:42-Moment. Die Build ist durch. Mechanical Verify grün. Espresso #3. Ich starte den QA-Subagent (frischer Kontext, kennt den Build nicht). 4 Minuten später schreibt er mir: "Die Rubric sagt Modul 03 unangetastet. Aber Slide 27 hat eine neue Bildreferenz. Welche Version stimmt?" — und ich dachte: f*ck. Ich hatte beides geschrieben. In meiner EIGENEN Rubric. Eine andere KI hat MICH gefunden. 📌 Drei Take-aways für drei Rollen: CTO/CDO: T4 zuerst. Mechanical Verify ist die einzige Schicht, die nicht lügt. Baut das vor allem anderen. Head of Sales: T1 (Extraction). CRM-Notizen, Calls, E-Mails — Goldwäscher. Was bewegt sich? Wer signalisiert? R&D-Lead: T2 (Source-Pinning). KI in Forschung MUSS Quellen pinnen, sonst halluziniert sie eure Reputation kaputt. 💼 Wo das in eurer Firma als Pattern auftaucht — die 10-Säulen Commercial Maturity bei werchota. Säule 9 Sales Ops & Performance Management = im Kern T4 + T5: eure Pipeline-Daten validieren sich selbst gegen die Pipeline-Regeln, ohne dass jemand wöchentlich im Forecast-Call alles abfragt. Wer wissen will, wo in der eigenen Commercial Engine Loops ansetzen können — Link unten. 🎒 Bonus: Ich bin diese Woche in Wien. Donnerstag bei der RBI. Wenn ihr in Wien seid und euch treffen wollt — pingt mich auf WhatsApp 0043 676 6144 904. Oder wenn ihr mit eurer KI an einer Stelle hängt und nicht weiterkommt — ping. Manchmal bauen wir gemeinsam einen Loop für euren Case. ⏱️ Timestamps 00:00 — 30-Sekunden-Recap aus Teil 1 (Fable 5, US-Handelsministerium, Loops) 02:00 — Der konkrete Use Case: Gärtner von Eden Workshop-Closeout 05:00 — Content-Extraction Loop: der Goldwäscher 09:00 — Generation-with-Source-Pinning: das Bauteil mit Prüfsiegel 12:00 — Adaptation Loop: nur die linke Schraube, nicht der Motor 14:30 — Mechanical Verify: warum LLM-as-judge nicht funktioniert 17:00 — Self-Catch Loop: der 03:42-Moment, der QA-Subagent fängt MICH 19:30 — Die linke Felge: personalisierter Verify auf eure typischen Fehler 21:30 — Memory Loop als Audit-Log + Einladung nach Wien 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Studium: Physik / Werkstoffwissenschaft an der Montanuniversität Leoben. 10 Jahre Erdöl & Erdgas, 3 Jahre Novartis (Head of Strategy einer 2-Mrd-USD Business Unit). Am 30. November 2022 kam ChatGPT raus. Einen Monat später hat er gekündigt. Heute Co-Founder werchota.ai und coatingAI. Lebt in Lochau am Bodensee mit Masha, Camila, Sophia und Alex. 🚀 Ressourcen für Führungskräfte 📚 Chief AI Academy — KI für Entscheider 🎯 AI Commercial Playbook — diagnostiziert eure 10-Säulen Commercial Maturity 👥 AI Leadership Community 🌐 werchota.ai 📥 Loop Templates Collection (T1-T5) — kostenlos zum Download 📬 Kontakt LinkedIn: linkedin.com/in/malcolmwerchota E-Mail: malcolm@werchota.ai WhatsApp (für Wien-Meetup oder Loop-Hilfe): +43 676 6144 904 📰 Quellen + Referenzen Gärtner von Eden Workshop, Düsseldorf (11. Juni 2026) Lance Martin (Anthropic Research) — Agent Loops Infografik Anthropic Fable 5 + Mythos 5 Launch (9. Juni 2026, Export-Stopp 12. Juni 2026) Loop-Methode angewandt auf: Workshop-Closeout, Sales-Pipeline, F&E-Reporting, HR-Bewerber-Filter, Vorstands-Strategie-Audit Tags: #LoopTemplates #ContentExtraction #SourcePinning #MechanicalVerify #SelfCatchLoop #AuditLog #MemoryLoop #Workshop #CommercialPlaybook #Mittelstand #DACH #werchota #DasKIKochbuch #Bregenz #Wien Need to diagnose your commercial engine? malcolm@werchota.ai Take care for now. Malcolm out.

  • #142
    June 15 · 31 min

    #142 - Loops statt Prompts: Was sich gestern Nacht verändert hat (Teil 1/2)

    Title: #143 - Loops statt Prompts: Was sich gestern Nacht verändert hat (Teil 1/2) Codewort: Fable 5. Am 9. Juni 2026 hat Anthropic zwei neue Modelle rausgebracht — Fable 5 und das Schwestermodell Mythos 5. Wir hatten drei bis vier Tage Zugang. Dann hat Amazon-CEO Andy Jassy das US-Handelsministerium kontaktiert, ein Notfall-Export-Kontroll-Order wurde erlassen, und die Modelle wurden weltweit abgeschaltet. Zum ersten Mal in der Geschichte hat die USA ein KI-Modell als so gefährlich eingestuft wie Waffen oder NVIDIA-Grafikkarten. Aber diese drei Tage haben mir etwas gezeigt: Fable 5 war nicht schlauer. Es arbeitete anders. Wo wir uns früher 4-5 Stunden wundgepromptet haben, drückst du bei Fable 5 nach einer halben Stunde auf "Go" — und das Ding läuft 5 Stunden autonom durch. Diese Art zu prompten heißt: Loops. Und das Beste: sie funktioniert auch mit den alten Modellen. Opus 4.7. Sogar Codex Legacy. Schockierend gut. 📍 Worum es heute geht: Wie man Prompting neu erlernt. Loops vs. Agents vs. Workflows. Wie Malcolm den Close-out seines Düsseldorfer Gärtner-von-Eden-Workshops (11h Tag) in einer Nacht gebaut hat — mit der Möglichkeit, zwischendurch Pause zu machen. 🌡️ Die Heizungs-Analogie. Ihr stellt eurer Heizung 21 Grad ein. Ihr sagt ihr nicht jede Minute "jetzt heizen, jetzt stoppen". Die Heizung regelt sich selbst. Mit Feuer im Kamin. Mit geöffneten Fenstern. Mit allem was sie hat. Ihr seid weg. Das ist ein Loop. 🤖 Loops vs. Agents vs. Workflows. Ein Agent ist wie ein selbstfahrendes Auto — Tesla, ID Buzz — eine konkrete Aufgabe, ihr drückt, das Ding fährt. Ein Workflow ist eine feste Abfolge (E-Mail kommt → Agent läuft → wird abgespeichert). Loops sind die Mitte: das Beste aus beiden Welten. Eine Zielsetzung, dazwischen 4-7 Helfer-Agenten, die ständig prüfen ob die Arbeit richtig gemacht wird. 📋 Die 4 Komponenten eines Loops: External Done-Condition — die Rubrik.md. Heilig. Nicht mal die KI darf sie ändern. Build-Loop — der Heizkörper. Baut, bis der Sensor sagt: fertig. Verify-Loop — der Sensor (oder beim Formel-1-Boxenstopp: der Mann mit dem Lollipop). Grün oder rot. Keine Meinung. Memory-Loop — das Kurzzeitgedächtnis. Löst das Context-Window-Problem. Macht 3-5 Stunden autonomes Arbeiten möglich. 🏎️ Die Formel-1-Analogie. Boxenstopp. Vorne steht jemand. Reifen montiert? Tank voll? Visier sauber? Sobald alle grün — der Mann geht weg, das Auto darf fahren. Das ist Build-Loop + Verify-Loop in einem Bild. 🏗️ Die Baustellen-Analogie. Der Polier (Build-Agent) muss nicht jede Minute da sein. Er kann eine Woche weg sein. Maurer, Elektriker, Installateur arbeiten. Der Prüfstatiker (Verify-Agent) kommt mit frischen Augen — "die Wand steht schief". Der Vermesser (Memory-Loop) schreibt alles auf. Ihr seid der Bauherr. Ihr habt den Plan unterschrieben. Ihr wartet auf den Schlüssel. ⚙️ Wie man einen Loop konkret baut — 4 Markdown-Dateien: Goal.md — die große Zielsetzung Rubrik.md — die externe Done-Condition (verifizierbare Kriterien, die KI darf sie NICHT anfassen) Build-Agent.md — die Bauanleitung mit Verifikations-Loop nach jedem Modul Memory-Loop — eine Zeile pro abgeschlossenem Schritt — kein Kontext-Verlust auch nach 3 Stunden 🏭 Die SPS-Analogie für Werkleiter. Eine speicherprogrammierbare Steuerung in einer Produktionslinie läuft total alleine. Warum? Weil drinnen Loops sind. Selbstkorrigierende, in-sich-geschlossene Systeme. Genau das macht ihr jetzt mit eurer KI. 💼 Loops im Sales. Der Verkäufer hat ein Kundenmeeting. Statt 2 Stunden CRM-Eingabe + Lead-Qualifizierung + Angebot-Schreiben: Meeting machen → Computer ausschalten → 2 Stunden Pause → zurückkommen → fertige Offerte in der Outbox, nur noch durchlesen + abschicken. 🚀 Was das praktisch bedeutet: 30-45 Minuten Setup. Dann drückt ihr "Go" — und ihr könnt 2 Stunden weggehen. Hausaufgaben mit den Kindern. Mittagessen kochen. Einen Film schauen. Das erste Mal können wir KI wirklich konzentriert lang laufen lassen, ohne alle 10 Minuten reinzuschauen. 🎯 Drei Montag-Aktionen: CTO/CDO: schreibt EINE Rubrik.md für einen wiederkehrenden Prozess. Heute Nachmittag, 30 Minuten, externer Datei. Werkleiter/Innovation Lead: identifiziert EINEN Prozess, der "jede Minute schreit" — und macht ihn zum 21-Grad-Loop. Head of Sales: schreibt EINE Pipeline-Stage-Definition als Rubrik — z.B. "qualifizierter Lead = 5 Kriterien, jedes binär PASS/FAIL". 📺 Cliffhanger zu Teil 2: Donnerstag schauen wir uns Loop-Templates konkreter an. Wie ihr eigene Loop-Templates baut. Mit konkretem Walk-Through. 🔗 Bonus: Hört euch die Folge ein zweites Mal an. Beim ersten Mal ist es technisch. Beim zweiten Mal versteht ihr alle Hebel. 🎙️ Folge mir auf LinkedIn für tägliche KI-Insights aus der DACH-Realität. ⏱️ Timestamps 00:00 — Cold Open: Fable 5 + Mythos 5 — die 3 Tage, die mein Prompting verändert haben 04:00 — Das US-Handelsministerium und der Export-Kontroll-Bann (erstes Mal für ein KI-Modell) 07:00 — Düsseldorf, Gärtner von Eden, 11-Stunden-Workshop und der nächtliche Close-out 10:00 — Loops vs. Agents vs. Workflows — die drei Welten 14:00 — Die Heizungs-Analogie: Goal, Build, Verify, Memory 18:00 — Die Formel-1-Boxenstopp-Analogie + Baustellen-Analogie 22:00 — Warum Prompts an die Decke stoßen: Context Window, Halluzinationen, Inkonsistenz 25:00 — Wie ihr einen Loop konkret baut: Goal.md + Rubrik.md + Build-Agent.md + Memory-Loop 28:00 — Workshop-Prep: 30 Min Setup, dann 2-3 Stunden weggehen 30:00 — SPS für Werkleiter, Sales-Loop für Head of Sales, Cliffhanger zu Teil 2 + Close aus Bregenz 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Studium: Physik / Werkstoffwissenschaft an der Montanuniversität Leoben. 10 Jahre Erdöl & Erdgas, 3 Jahre Novartis (Head of Strategy einer 2-Mrd-USD Business Unit, dann Head of Business Unit Health). Am 30. November 2022 kam ChatGPT raus. Einen Monat später hat er gekündigt. Heute Co-Founder werchota.ai und coatingAI. Lebt in Lochau am Bodensee mit Masha, Camila, Sophia und Alex. 🚀 Ressourcen für Führungskräfte 📚 Chief AI Academy — KI für Entscheider 🎯 AI Commercial Playbook — diagnostiziert eure 10-Säulen Commercial Maturity 👥 AI Leadership Community 🌐 werchota.ai 📬 Kontakt LinkedIn: linkedin.com/in/malcolmwerchota E-Mail: malcolm@werchot...

  • #138
    June 1 · 20 min

    #138 - [Quickbite] - Microsoft verbietet Claude Code — und nimmt seinen Ingenieuren den Ferrari weg

    Stellt euch vor, euer Firmenwagen ist ein Lamborghini. Oder ein Ferrari. Egal. Ihr fahrt jeden Tag damit zur Arbeit, ihr seid produktiv, ihr seid glücklich. Und dann kommt euer CEO und sagt: "Wir geben dir ab nächsten Monat einen Skoda Octavia." Genau das ist gerade bei Microsoft passiert. Und es betrifft euch direkt — auch wenn ihr noch nie eine Zeile Code geschrieben habt. Letzte Woche, 14. Mai 2026, landete ein internes Memo bei Microsofts Experiences and Devices Division. Windows, Microsoft 365, Outlook, Teams. Zehntausende Ingenieure. Das Memo kommt von Rajesh Jha, Executive Vice President. Inhalt in einem Satz: Wir schalten Claude Code ab. Stichtag: 30. Juni 2026. Die Absurdität: vor sechs Monaten — Dezember 2025 — hat Microsoft Claude Code aggressiv an dieselben Ingenieure verteilt. Tausende Lizenzen. Sogar Designer und Projektmanager bekamen Zugang. Die Ansage damals: installiert das, experimentiert, baut Prototypen. Warum jetzt der Rückzieher? Nicht weil Claude Code schlecht ist. Weil es zu gut ist. Es war besser als Microsofts eigenes Tool — GitHub Copilot — bei genau den Aufgaben, die zählen: Multi-File-Refactoring, Architektur-Arbeit, Rapid Prototyping. Microsoft verkauft der Welt GitHub Copilot als KI-Entwickler-Flagschiff. Microsoft hat 13 Milliarden Dollar in OpenAI investiert. Und sechs Monate lang haben Microsofts eigene Ingenieure heimlich ein Konkurrenzprodukt von Anthropic bevorzugt. Das ist nicht peinlich — das ist eine strategische Bombe. 📊 Was Claude Code von GitHub Copilot unterscheidet Copilot ist Autovervollständigung. Ihr tippt, Copilot schlägt die nächste Zeile vor. Ihr seid am Steuer. Passiv. Wie ein Skoda mit Tempomat. Claude Code ist agentisches Coding. Ihr sagt: "Bau mir eine App, die meine Sonos-Boxen erkennt und Musik startet, wenn mein Tesla heimkommt." Claude arbeitet zwei, drei, sieben Stunden autonom durch. Liest die Codebase. Refaktoriert. Testet seinen Output. Ihr seid nicht mehr am Steuer — ihr seid Projektmanager. Context Window: 1 Million Tokens (laut Gerüchten kommen 12 Mio.). Das Gehirn der KI passt mit der ganzen Codebase rein. Extended Thinking: Claude stoppt, plant, denkt nach, sagt euch wenn etwas Unsinn ist. Copilot programmiert blind weiter. Multi-File-Autonomie: Claude holt sich "Helfer" und arbeitet parallel über die ganze Codebase. 💸 Die Preisfrage Claude Code Enterprise: 150 Dollar pro Sitz pro Monat. GitHub Copilot: 10 bis 30 Dollar. Microsofts Ingenieure haben das 10× teurere Tool genutzt — und wenn sie tokens aufgebraucht hatten, haben sie aus eigener Tasche nachgekauft. Wie in einem Free-to-Play-Spiel, nur dass die Tokens hier Code produzieren. ⚠️ Der Amazon-Präzedenzfall Microsoft ist nicht der erste, der diesen Fehler macht. Ende 2025 hat Amazon Claude Code und Codex intern verboten und das hauseigene Tool "Kiro" vorgeschrieben. Was ist prompt passiert? Ein 13-stündiger AWS-Ausfall in China. Die Ingenieure standen mit dem Skoda Octavia vor einem Ferrari-Problem. Im April 2026 hat Amazon zurückgerudert und Claude Code wieder freigeschaltet. Google macht es ähnlich: Claude Code ist standardmäßig gesperrt — außer bei DeepMind, der eigenen Top-KI-Abteilung. SpaceX hat gerade 60 Milliarden Dollar für eine Option auf Cursor (ein Claude-Code-Konkurrent) bezahlt. 🇪🇺 Die DACH-Lektion Wenn ihr CTO, VP Engineering oder Gründer in einem typischen DACH-Tech-Unternehmen seid: eure Entwickler nutzen diese Tools schon. Als Shadow AI. Auf privaten Abos. Heimlich am Abend. Wie ihr das herausfindet, ohne irgendeine Umfrage: Vor 2 Jahren: ~3.000 Zeilen Code pro Entwickler pro Tag Mit Copilot: Sprung auf 6.000–9.000 (2–3×) Mit Claude Code: Sprung auf 30.000–300.000 (10–100×) Schaut euch nur den Output an. Das ist euer Audit. 🇪🇺 Die souveräne Alternative Wenn Daten-Souveränität ein Thema ist: Mistral Codestral — 22 Mrd. Parameter Code-Modell, 80+ Sprachen, EU-Infrastruktur, DSGVO-nativ. Mistral hat fast 1 Milliarde Dollar von europäischen Banken bekommen, um genau das zu bauen. Plus die kommende Cohere-Aleph Alpha-Fusion (Schwarz-Gruppe, 500 Mio. €), die explizit für DACH-Konzerne gebaut wird. Ihr habt keine Ausrede mehr. 🏭 Der Hackathon-Moment Vor drei Tagen haben wir bei einer großen deutschen Manufacturing-Firma einen Hackathon mitgestaltet. 20 Top-Entwickler im Raum mit den absolut besten Tools — OpenCode, Open Terminal, Claude Code. Großartig. Aber dann die Frage: 20 Leute am Tisch, 6.000 im Konzern. Wann kriegen die anderen 5.980 dieselben Werkzeuge? 🚀 Wie wir bei werchota.ai arbeiten Bei uns nutzt jede einzelne Person Claude Code. 85% unserer gesamten Arbeit wird von Claude Code und KI-Agenten erledigt. Porni (Journalistin) — Claude Code. Alex (Finance) — Claude Code. Nicht weil sie programmieren. Sondern weil das Tool universell geworden ist. 📌 Drei Montag-Aktionen Shadow-AI-Audit. Schaut euch den Code-Output pro Entwickler über 2 Jahre an. Wer hat den 10×-Sprung gemacht? Diese Person nutzt heimlich Claude oder Codex. A/B-Test mit echter Aufgabe. Gleicher Task, gleiche 24 Stunden. Ein Entwickler "alt", einer mit Claude Code. Vergleicht Output, Fehlerrate, Fertigstellung. Drei-Stufen-Datenklassifikation. Stufe 1 unsensibler Code = jedes Tool. Stufe 2 interne Geschäftslogik = EU-gehostete Tools (Mistral). Stufe 3 regulierte Daten = Security-Review. Kein Verbot. Eine Policy. 🎬 Die größere Frage Microsoft wird das in 2-3 Monaten zurücknehmen. Genau wie Amazon. Aber ihr habt ein wichtigeres Problem: nehmt ihr euren Ingenieuren weiter den Ferrari weg — oder gebt ihr ihn endlich allen? ⏱️ Timestamps 00:00 — Cold Open: Der Lamborghini, das Microsoft-Memo, der 30. Juni-Stichtag 03:00 — Agentisches Coding vs. Autovervollständigung — die zwei Welten 05:30 — Context Window, Extended Thinking, Multi-File-Autonomie 07:00 — Die $150-vs-$20-Frage und warum Ingenieure trotzdem zahlen 09:00 — Der Amazon-AWS-Ausfall in China + Google + SpaceX-Cursor 11:00 — Wie ihr eure Shadow AI in 5 Minuten auditet 13:30 — Mistral Codestral + Cohere-Aleph Alpha als souveräne Alternative 15:30 — Der Hackathon: 20 vs. 6.000 — die Frage, die jeder CTO sich stellen muss 17:30 — werchota.ai: 85% Claude Code, jede einzelne Person 19:00 — Drei Montag-Aktionen + Close aus Bregenz 🎙️ Über den Host Malcolm Werchota leitet KI-Adoptionsprogramme für Unternehmen in ganz Europa. Nach über 15 Jahren bei Novartis und Schlumberger heute Fokus: KI ohne Bullshit. Letzte Woche live in London am AIM Summit — nach Lord Melvin (ehem. Chief der Bank of England) und vor Eric Trump, vor 150 Investoren. Dozent an ESADE und HSLU. Studiert ...

Showing 1–20 of 27 episodes