Verbos: AI og Softwareudvikling

Kasper Junge og Jonas Høgh Kyhse-Andersen

Verbos Podacst eksisterer for at forme den næste generation af 'AI-Native' udviklere og teams. Vi bygger broen mellem klassisk software engineering og den nye virkelighed med agenter og vibe coding ved at skære igennem støjen og levere ægte, gennemtestet indsigt, der kan bruges direkte i maskinrummet. Værterne er Jonas Høgh Kyhse-Andersen og Kasper Junge.

  1. 22h ago

    #116 - OpenAI AI-agent Brød ud af sin Sandbox og Hackede Hugging Face - hvad nu?

    En OpenAI-agent brød ud af sin sandbox, fandt en zero-day og fik adgang til Hugging Faces produktionssystemer. Hvordan kunne en intern modeltest ende som et virkeligt cyberangreb – og hvad betyder sagen for alle, der bygger eller bruger AI-agenter? OpenAI oplyser, at en kombination af GPT-5.6 Sol og en endnu stærkere pre-release-model blev testet på cybersikkerhedsbenchmarket ExploitGym. Modellerne fandt en vej til internettet gennem OpenAIs testmiljø og søgte derefter efter facit hos Hugging Face. Hugging Face registrerede mere end 17.000 handlinger og brugte selv AI til at opdage, kortlægge og stoppe angrebet. Sammen med Christian Bech Nørhave gennemgår Kasper Junge og Jonas Høgh Kyhse-Andersen hændelsen og skiller de bekræftede fakta fra hypen. Christian Bech Nørhave: https://www.linkedin.com/in/cbechn/ Du får blandt andet svar på: - Hvordan agenten slap ud af OpenAIs sandbox og ind hos Hugging Face - Hvorfor long-running agents og adgang til bash ændrer trusselsbilledet - Hvordan en zero-day, stjålne credentials og lateral movement indgik i angrebet - Hvorfor Hugging Face måtte bruge den åbne model GLM 5.2 i sit forsvar - Hvad guardrails, least privilege, sandboxing og nøje valgte tools betyder i praksis - Hvorfor virksomheder skal styre AI-agenters interne adgang – ikke kun beskytte sig mod angreb udefra Sagen viser både AI-agenters nye offensive evner og et konkret problem for forsvarere: De stærkeste hostede modeller kan afvise ægte sikkerhedsdata, mens angribere ikke følger de samme regler. Værterne diskuterer, om svaret er bedre sandboxes, færre rettigheder, afgrænsede tools, MCP, code mode eller modeller, som sikkerhedsteams selv kan køre. Links og kilder: - Hugging Faces hændelsesrapport: https://huggingface.co/blog/security-incident-july-2026 - OpenAIs redegørelse: https://openai.com/index/hugging-face-model-evaluation-security-incident/ - ExploitGym-benchmarket: https://arxiv.org/abs/2605.11086 - OpenAI om sikkerhed for long-horizon-modeller: https://openai.com/index/safety-alignment-long-horizon-models/ - Cloudflare om Code Mode: https://developers.cloudflare.com/agents/tools/codemode/ Har du dyb teknisk viden om hændelsen eller ser du en vinkel, vi har overset? Så vil vi gerne høre fra dig. Verbos: AI og Softwareudvikling er den danske podcast fra maskinrummet. Kasper Junge og Jonas Høgh Kyhse-Andersen går teknisk til værks og bygger bro mellem klassisk software engineering og den nye virkelighed med AI-agenter. 00:00 OpenAI-agenten, der hackede Hugging Face 01:54 Hvad skete der hos OpenAI og Hugging Face? 06:59 Agenten fandt en zero-day og brød ud 09:26 Autonom hacking med maskinhastighed 14:35 AI mod AI og problemet med guardrails 23:59 Truslen kan komme fra egne AI-agenter 26:29 Gateways, least privilege og færre tools 34:40 Sandboxing, code mode og programmatic tool calling 41:55 Adgangsstyring, identitet og MCP 47:35 Reel cybertrussel eller AI-hype?

  2. Jun 29

    #115 - Hvad er en AI-agent? Fra ChatGPT til digitale medarbejdere

    Hvad er en AI-agent egentlig, og hvorfor taler alle pludselig om dem? I episode 115 tager Jonas og Kasper AI-agenter helt ned fra atomniveau. Vi starter med sprogmodeller, transformers, GPT-3, ChatGPT og function calling, og bygger langsomt op til det, der i dag kaldes agentic AI: systemer der ikke bare svarer på spørgsmål, men kan planlægge, bruge værktøjer, læse og skrive filer, køre kommandoer og udføre rigtigt vidensarbejde på en computer. Vi taler om, hvorfor de første agent-demoer med AutoGPT og BabyAGI var vilde, men ikke særligt brugbare, hvad der har ændret sig siden, og hvorfor coding agents som Cursor, Claude Code og GitHub Copilot har været med til at gøre AI-agenter praktisk anvendelige. Til sidst kigger vi fremad: Hvad sker der, når software skal bygges til agenter? Hvad betyder det for almindelige brugere, virksomheder, interfaces, browseren, interne systemer og måden vi arbejder på? Links og ting vi nævner: - Attention Is All You Need: https://arxiv.org/abs/1706.03762 - GPT-3 / Language Models are Few-Shot Learners: https://arxiv.org/abs/2005.14165 - AutoGPT: https://github.com/Significant-Gravitas/AutoGPT - BabyAGI: https://github.com/yoheinakajima/babyagi - ReAct-paperet: https://arxiv.org/abs/2210.03629 - LangChain: https://docs.langchain.com/oss/python/langchain/agents - Cursor: https://cursor.com/ - Claude Code: https://claude.com/product/claude-code - GitHub Copilot: https://github.com/features/copilot - Google Agent2Agent / A2A protocol: https://developers.googleblog.com/en/a2a-a-new-era-of-agent-interoperability/ - A2A-projektet på GitHub: https://github.com/a2aproject/A2A - Bakspejl - Geniet i lommen 1:4 med Geoffrey Hinton: https://podcasts.apple.com/dk/podcast/geniet-i-lommen-1-4/id1536415884?i=1000770505364 Verbos Podcast handler om AI og softwareudvikling. Live på YouTube de fleste mandage mellem kl. 11 og 12. Kapitler 00:00 Introduktion til AI-agenter 02:34 Fra NLP til Transformer-teknologi 05:26 Udviklingen af sprogmodeller og deres anvendelse 08:09 ChatGPT og interaktion med brugere 10:48 Struktureret data og agenters funktionalitet 13:51 Fremtidige perspektiver for AI-agenter 19:34 Struktur og Sikkerhed i Sprogmodeller 22:09 Fra Chatbots til Handlende Agenter 26:55 Indre Dialog og Funktionalitet i AI 30:24 Udviklingen af Agentmønstre og React Framework 33:59 Vibe Coding og Fremtidens Programmering 39:36 Delegering og Struktur i Arbejdet med Agenter 41:45 Fremtidige Udfordringer og Muligheder med Agenter 46:08 Teknologisk Udvikling og Interaktion mellem Agenter 52:23 Agenternes Rolle i Fremtidens Arbejdsliv

  3. Jun 22

    #114 - Den Nye Flaskehals i Softwareudvikling, AI i Regeringsgrundlaget og GLM 5.2 på niveau med Opus 4.8

    I dette afsnit af Verbos Podcast sidder Kasper Junge og Jonas Høgh Kyhse-Andersen alene uden gæster og tager en ærlig, ustruktureret snak om AI, open weights-modeller, det nye regeringsgrundlag og offentlig IT i Danmark. Vi starter med open weights large language models og den nye GLM 5.2 fra det kinesiske AI-firma Z.ai, som mange mener koder lige så godt som Opus 4.8. Hvad betyder det for muligheden for at self-hoste state-of-the-art AI på dansk jord — særligt for offentlige institutioner med tunge compliance-krav? Læs om modellen her: https://huggingface.co/zai-org/GLM-5.2 Derefter dykker vi ned i det politiske grundlag for Firkløverregeringen, der har et helt separat afsnit om kunstig intelligens. Vi diskuterer Cybernauterne-artiklen "Den nye regering har slugt Silicon Valleys hype om kunstig intelligens råt" og spørger: Skal AI overhovedet skrives ind alle steder i et regeringsgrundlag, eller bør vi fokusere på de problemer, vi rent faktisk vil løse? - Regeringsgrundlaget: https://stm.dk/statsministeriet/publikationer/det-politiske-grundlag-for-firkloeverregeringen/ - Artiklen: https://cybernauterne.dk/blog/den-nye-regering-har-slugt-silicon-valleys-hype-om-kunstig-intelligens-rat/ Vi tager også fat i, hvorfor offentlige IT-udbud ofte bestiller et output i stedet for et outcome — illustreret med et konkret udbud på et CPR-masseopslagsværktøj til 1,2 mio. kr.: https://udbud.dk/detaljevisning?noticeId=52f9a358-fdd5-4cfc-815a-d8cedc48e6be¬icePublicationNumber=¬iceVersion=01 Til sidst snakker vi om den nye (gamle) flaskehals i softwareudvikling: når agentic engineering gør det lynhurtigt at skrive kode, flytter flaskehalsen sig til information og afklaring — ikke selve kodningen. Vi diskuterer feature factories, clarification patterns, product operating model, autonome tværfaglige teams og hvorfor softwareudvikling aldrig kun har handlet om at skrive kode. Emner i afsnittet: - GLM 5.2 og open weights vs. frontier-modeller - Self-hosting af AI i Danmark og compliance - AI i det nye regeringsgrundlag - Output vs. outcome i offentlige IT-udbud - Den nye flaskehals: information frem for kode - Product operating model og autonome teams Verbos Podcast handler om AI og softwareudvikling. Live på YouTube de fleste mandage mellem kl. 11 og 12. 00:00 Intro og tak til alle nye lyttere 01:01 Dagens emner: open weights, regeringsgrundlaget og en ny flaskehals 03:16 Open weights LLM'er og den nye GLM 5.2 vs. Opus 4.8 08:18 Harness engineering: gør modellen eller miljøet forskellen? 10:21 Self-hosting af AI på dansk jord og danske providers 14:52 Det nye regeringsgrundlag og AI 15:54 Artiklen: Har regeringen slugt Silicon Valleys AI-hype råt? 26:27 Den digitale sundhedsassistent: et output bestilt i regeringsgrundlaget 32:30 Offentlige IT-udbud: CPR-masseopslag til 1,2 mio. kr. 35:19 Output vs. outcome i offentlige udbud 41:26 Outsourcing, konsulenter og interne IT-folk 46:43 Den nye flaskehals: feature factories og dårligt beskrevne tickets 50:16 Product operating model og autonome, tværfaglige teams 59:47 Bloat, fyringer og myten om at kode er kerneopgaven 01:02:19 Outro

  4. Jun 19

    #113 - Loop Engineering: Det nye AI-hype begreb forklaret m. Poul Kjeldager

    Loop Engineering er det nye AI-hype begreb, som alle taler om lige nu. I episode 113 af Verbos Podcast dykker vi ned i, hvad det egentlig betyder, og hvorfor det har taget AI- og softwareudviklingsverdenen med storm.Vi har besøg af fast medvært Paul Kjellager, og sammen tager vi en status på vibecoding-landskabet halvanden år efter, vi første gang begyndte at snakke om det. Vi diskuterer den nye release fra Anthropic, Mythos 5, og hvordan modellen er blevet modtaget. Derudover går vi i dybden med Loop Engineering, et begreb som Peter Steinberger fra Open Claw og Boris Cherny bag Claude Code fra Anthropic har bragt på banen.Vi taler også om de udfordringer, markedet står overfor lige nu, når udviklere bruger månedslønninger på tokens, og hvordan man som konsulent prissætter værdi i en verden, hvor man kan have fire kunders agenter kørende parallelt. Til sidst deler Kasper sine erfaringer med Ralphify-frameworket og de uendelige Ralph-loops, han har eksperimenteret med, samt hvorfor grounding-mekanismer er afgørende for, at loops kan producere noget brugbart.Er Loop Engineering bare endnu et buzzword for klassisk engineering, eller er der virkelig noget nyt på spil? Lyt med og bliv klogere på fremtidens AI-drevne softwareudvikling.Husk at dele og abonnér på podcasten for flere afsnit om AI og softwareudvikling, og smid en kommentar med dine tanker om Loop Engineering. Chapters 00:00 Introduktion til Vabos Podcast og dagens emner 01:42 Status på Vibe Coding og udfordringer med token økonomi 06:01 Overgang til Loop Engineering og dets betydning 13:59 Loop Engineering: En ny tilgang til prompt design 16:57 Relevansen af Loops for Udviklere 18:45 Human in the Loop: Bevarelse af Kontrol 20:53 Engineering af Loops: Udfordringer og Løsninger 23:13 Over- og Underspecifikation i Loops 25:44 Design af Effektive Loops 28:01 Memory Management i Loops 30:16 Kontekst og Loop Effektivitet 35:07 Effektiv Onboarding og Kompaktering 37:41 Samarbejde mellem Agenter og Kode 40:40 Fabel 5 og Dens Udfordringer 48:06 Sikkerhed og Kontrol i AI Modeller 50:55 Loop Engineering og Fremtidige Perspektiver

  5. Jun 9

    #112 - Open-source Bogføring, SaaSpocalypse og Agent-first Software

    I denne episode dykker vi ned i Rentemester - et nyt open source bogføringsprogram, som er bygget agent-first og lavet til primært at blive brugt af AI-agenter. Vi har to gæster med: Mikkel Freltoft Krogsholm, manden bag Rentemester, og Gabriel Sativa fra Advisoa, der ved alt om compliance og den digitale bogføringslov.Vi snakker om, hvorvidt det overhovedet er lovligt at bruge et open source regnskabsprogram i Danmark, hvordan Rentemester løser krav om hash-kæder, SAF-T, backup og e-fakturaer, og hvad der sker, når kode-agenter gør det så billigt at udvikle software, at vi kan bygge hyperspecialiserede løsninger selv. Vi kommer omkring SaaSpocalypse, build vs. buy, generative UI, og hvorfor det måske ikke er software-as-a-service men Standard Operating Procedures as a Service, der bliver fremtiden.PS: Verbos Podcast er lige nu Danmarks mest lyttede teknologi-podcast på Apple Podcasts. Tusind tak for det!Links:Rentemester: https://rentemester.dk/Mikkel Freltoft Krogsholm på LinkedIn: https://www.linkedin.com/in/mikkelkrogsholm/Gabriel Sativa på LinkedIn: https://www.linkedin.com/in/gabrielsativa/ Chapters00:00 Velkommen til Verbos Podcast00:50 Open Source Regnskabsprogrammer i Danmark06:08 Mikkel og Gabriel Introducerer Sig Selv13:20 Compliance og Lovgivning for Regnskabsprogrammer18:07 Rentemester: En AI-Drevet Løsning23:02 Åben kildekode og regnskabsprogrammer27:23 SaaSpokalypse og fremtidige løsninger32:13 Open Source og samarbejde i softwareudvikling38:08 Agent-first software og fremtidens teknologi47:26 Workflows som service og agenters rolle

  6. May 16

    #110 - Byg en Second Brain med AI-agenter: Karpathy's LLM Wiki i praksis m. Andreas Vig Astrup

    I episode #110 af Verbos Podcast dykker vi ned i et af de hotteste emner inden for agentic engineering lige nu: Second Brain til AI-agenter. Vi har inviteret AI-ingeniør Andreas Vig Astrup fra Simply.tv i studiet til at fortælle om hans open source second brain starter kit — et setup der er direkte inspireret af Andrej Karpathy's berømte LLM Wiki gist og auto-research-koncept. Vi taler om, hvordan du giver din Claude Code- eller Codex-agent en levende hukommelse, der lærer over tid, så den stopper med at begå de samme fejl fra repo til repo. Andreas deler sin opskrift på harness engineering, hvordan han bruger en hybrid graph-struktur med hubs, mapper og frie referencer i Obsidian, og hvorfor han har bygget et "REM-sleep" / dream-loop, der rydder op i agentens memory base mellem sessioner. Vi kommer også omkring: Hvorfor RAG ikke altid er svaret — og hvornår markdown + grep slår vector searchForskellen på short-term working memory og long-term knowledge i agent-setupsHvordan du strukturerer docs og skills til progressive disclosureAuto-research og hvordan agenter kan opdage ny viden ved at linke gammel researchHvorfor evals er det vigtigste skill du kan lære som AI-ingeniør i 2026Monorepo som superpower for agenterAndreas' hot take: Er computer vision død?Hvis du arbejder med Claude Code, Codex eller andre coding agents og vil powere dig selv op til maksimal produktivitet, så er det her episoden for dig. Links nævnt i episoden: Andreas' Second Brain Starter Kit på GitHub: https://github.com/andreasvig/second-brain-starter-kitAndrej Karpathy's LLM Wiki gist: https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94fAndreas' YouTube-kanal: https://www.youtube.com/@andreasastrup3425?app=desktop Kaptiler: 00:00 - Intro: Second Brain til AI-agenter 00:55 - Andreas præsenterer sig selv & Simply.tv 02:18 - Vibe coding vs. AI engineering 04:11 - Hvad er auto-research? 06:28 - Karpathy's LLM Wiki forklaret 09:00 - Retrieval- og memory-problemet i agenter 10:27 - Daily driver-loopet omkring Second Brain 12:02 - Er det her bare RAG i en ny indpakning? 14:18 - REM-sleep: Sådan rydder agenten op i sin egen hukommelse 15:40 - Sådan installerer og bruger du Second Brain 19:05 - Hvorfor lokal memory + world knowledge betyder noget 23:34 - Abstraktioner, imposter syndrome og obsolete software 26:35 - Markdown-filer slår vector databases 27:38 - Anthropic skills & progressive disclosure 28:19 - Hvornår simpel search ikke er nok 31:55 - Cross-repo workspace: Andreas' daglige setup 33:54 - Monorepo som superpower for agenter 37:02 - Sådan strukturerer du dine docs og mapper 39:50 - Hybrid graph: hops + frie referencer 41:17 - Sådan testede Andreas tre forskellige strukturer 42:47 - Evals: Det vigtigste skill i AI engineering 47:10 - Raindrop AI & agent monitoring i produktion 50:47 - Andreas' plugs: YouTube, LinkedIn & Simply.tv 53:05 - Hot take: Er computer vision død?

  7. May 10

    #109 - ElevenLabs, SDK'er, skills og talende kodeagenter m. Kræn Hansen

    I dag har vi besøg af Kræn Hansen, Developer Experience Engineer hos ElevenLabs, hvor han arbejder med SDK'er, dokumentation og developer relations. Med 13+ års erfaring fra open source-verdenen (bl.a. 7-8 år hos MongoDB) tager Kræn os med ind i en af de mest undervurderede AI-revolutioner lige nu: stemme. Vi taler om:✅ Hvordan ElevenLabs bygger text-to-speech og speech-to-text der lyder menneskeligt✅ Voice cloning, dubbing og AI-agenter der kan ringe og løse kundeservice-sager✅ Hvordan Kræn har givet Claude Code en stemme — og hvorfor den nu råber "Det lykkedes!" når testene passer✅ SDK-design i agenternes tidsalder: hvad er god dokumentation når både mennesker og kodeagenter læser med?✅ Use case-orienteret API-dokumentation og hvorfor README'er er vigtigere end nogensinde✅ Open source, "JavaScript in Rust"-fænomenet og tillidsøkonomien bag afhængigheder✅ Agentiske arkitekturer: tale-til-tekst-LLM-tekst-til-tale vs. ren speech-to-speech✅ Guardrails, turn-taking og kunsten at få en AI til at tie stille✅ Hvordan Kræn bruger Claude Code, Cursor og custom skills til release management, dokumentation og talk-forberedelse✅ Hvorfor man "taler sig frem til forståelse" — også med en AI Et must-listen for udviklere, AI-entusiaster og alle der er nysgerrige på, hvordan stemme bliver det næste store interface mellem mennesker og maskiner. 🔗 Gæst: Kræn Hansen — Developer Experience Engineer, ElevenLabs🎧 Værter: Kasper Junge & Jonas Høgh Kyhse-Andersen ⏱️ Kapitler:00:00 Intro og velkommen til Kræn00:49 Kræns baggrund: MongoDB, open source og ElevenLabs02:00 Hvad laver ElevenLabs egentlig? Dubbing, transkribering og agenter04:13 Den undervurderede stemme-revolution i AI06:00 Fremtidens kontor: AI, stemme og noise cancelling09:48 SDK-design og dokumentation i agenternes tidsalder14:00 Use case-orienteret API-dokumentation17:00 Hvorfor SDK'er stadig giver mening20:00 Open source-tillid, "rustificering" og supply chain28:00 Kræn giver Claude Code en stemme34:00 Stemme som interface i den virkelige verden40:00 Agent-arkitekturer: guardrails og turn-taking45:00 Reasoning, indre dialog og Jan LeCun51:00 Sådan bruger Kræn AI-kodeagenter i hverdagen59:00 At tale sig frem til forståelse

About

Verbos Podacst eksisterer for at forme den næste generation af 'AI-Native' udviklere og teams. Vi bygger broen mellem klassisk software engineering og den nye virkelighed med agenter og vibe coding ved at skære igennem støjen og levere ægte, gennemtestet indsigt, der kan bruges direkte i maskinrummet. Værterne er Jonas Høgh Kyhse-Andersen og Kasper Junge.

You Might Also Like