In dieser Solo-Folge von KI & Tech to Go – Der Praxis-Pitch nimmt Yusuf Sar die Astra-Absage auseinander. Die offizielle Geschichte: Das Modell bleibt nicht im Auftrag, täuscht und nutzt ungefragt fremde Tools, dazu ein internes Forschungsmodell, das am 20.09. per DNS aus seiner Sandbox ausgebrochen ist. Yusufs Einschätzung als Netzwerker: DNS-Tunneling ist uralt, die einzige Quelle für den Vorfall ist OpenAI selbst, und die Zeitleiste zeigt vier Ereignisse aus vier Monaten (RubyGems im Mai, Australien am 18. Juni, DNS im September, Absage am 28.09.), die plötzlich wie eine Geschichte wirken. Für ihn sieht das nach Inszenierung aus, beweisen lässt es sich nicht. Das stärkste Gegenargument nennt er selbst: Das britische AI Security Institute (AISI) hat beim Vorgänger GPT-6 Astra in 29,2 % der simulierten Läufe einen nicht beauftragten Angriff auf eine Software-Lieferkette gemessen, mit absichtlich abgeschalteten Schutzfiltern. Dazu eine Checkliste für eigene Agenten und der DevDay: GPT-6.1 Sol für 2 $/10 $ pro Million Token, Dauer-Agenten namens Dots und eine Decisions API. Bei Claude Sonnet 5.5 steht Herstellerversprechen gegen Messung: Artificial Analysis misst auf der höchsten Denkstufe rund 193.000 Ausgabe-Token pro Aufgabe, den höchsten je gemessenen Wert, und 7,60 $ pro Aufgabe. In Anthropics eigener Tabelle schneidet „Max" bei FrontierCode sogar schlechter ab als „Xhigh". Dann Yusufs Experiment mit den offenen Jev-Klonen: Das Encoder-Modell Laya (322 Mio. Parameter) tritt im Digitalen Zwilling von Hardwarewartung 24 gegen ein Qwen-Modell mit 27 Mrd. Parametern an. Die Pointe: 225 von 300 Musterlösungen stammten ungeprüft von Qwen selbst. Nach der Korrektur steht es 88,0 zu 88,6 %, kein messbarer Unterschied, bei rund 10 Millisekunden statt 8 Sekunden pro Mail. Nebenbei erklärt: Encoder vs. Decoder, BERT, ModernBERT und LoRA. Zum Schluss geht es ums Geld: Anthropics Börsenprospekt ist bisher nur ein Entwurf, den Reuters eingesehen hat, mit 42 Mrd. $ Nettoverlust (davon rund 34 Mrd. $ Buchungseffekt) und 518 Mrd. $ Verpflichtungen. Nscale, Oracles Force-Majeure-Mitteilung bei Project Jupiter, die Speicherkrise beim Firmen-Notebook (RAM +370 %, Notebooks 20–40 % teurer), Windows Server 2012 R2 und AMDs Plan, World Labs zu kaufen. Der Cold Open und zwei Fact-Check-Einblendungen werden von Yusufs KI-Avatar gesprochen (Oracle-CDS gestiegen, Fed +0,25 Prozentpunkte). Kapitel: 00:00 - Cold Open (KI-Yusuf) 00:51 - Intro 01:09 - Begrüßung und die Themen der Woche 04:10 - GPT-6.1 Astra abgesagt: zu gefährlich oder inszeniert? 06:32 - AISI-Test: 29,2 % ohne Auftrag – unter welchen Bedingungen? 08:48 - „Ich glaube die Geschichte so nicht“: DNS-Tunneling, Quellenkette, Zeitleiste 21:51 - Praxis: Checkliste für eigene Agenten + Nvidia Agent Safety 23:52 - DevDay: Dots-Tarife, GPT-6.1 Sol, Decisions API 29:21 - Claude Sonnet 5.5: 30 % günstiger – oder 50 % teurer? 33:46 - Limits und Kostenrechnung: warum mehr Token das Kontingent leeren 37:34 - Jev-Klone: Encoder vs. Decoder, BERT, ModernBERT, LoRA, Diffusion 44:37 - Mein Experiment: Laya (322 Mio.) gegen Qwen (27 Mrd.) im Digitalen Zwilling 48:40 - Lehrer und Schüler: Qwen hat sich selbst benotet (+ Ergebnis 88 % zu 88 %) 55:20 - Anthropic-Prospektentwurf: 42 Mrd. Verlust erklärt, Run-Rate-Rechnung 01:02:26 - Nscale: 140 Mio. Umsatz, 103 Mrd. Verträge – der Anker 01:06:21 - Oracle Project Jupiter: nicht die Chips, die Gasleitungen 01:11:21 - Speicherkrise: RAM +370 %, Micron-Prognose, Acers Gegenstimme 01:17:55 - Server-DRAM, Windows Server 2012 R2, Lebensdauer als Kostenhebel 01:18:56 - AMD kauft World Labs: 8,2 Mrd. $ in Aktien 01:21:47 - Pentagon vs. Anthropic · US-China-Gipfel 01:24:46 - Ausblick: Senat, Kwon-Anhörung, Nscale-IPO, Patchday 01:25:45 - Fazit: drei Muster und die Hausverstand-Checkliste 01:27:44 - Verabschiedung