Digital Intelligens

Artificiell intelligens

Digital Intelligens - en podcast om AI och innovation

  1. 5d ago

    Autonoma agenter och Bill Gates robotskatt

    Z.ai lanserar Ox Alpha som den öppna modellen GLM-5.3-Flash: Denna multimodala MoE-modell med 320 miljarder parametrar (varav 18 miljarder är aktiva) presterar nära Claude Opus 4.8 i kodnings- och agenttester, men till ungefär en tiondel av kostnaden. Den har körts helt på kinesiska AI-chip och modellvikterna är helt öppna, vilket sätter press på både priser och Nvidias dominans i Kina. Anthropic säkrar enorm beräkningskapacitet i ett historiskt molnavtal: Företaget rapporteras hyra cirka 460 MW kapacitet i West Virginia från brittiska Nscale för 45 miljarder dollar över sex år. Datacentret förväntas tas i drift i slutet av 2027 och använda Nvidias kommande Vera Rubin-chip, vilket visar hur hårt de ledande AI-labben nu konkurrerar om el och nästa generations infrastruktur. Salesforce och Anthropic integrerar CRM direkt i Claude: Genom lanseringen av Claudeforce flyttas praktiskt säljarbete till ett agentiskt konversationsgränssnitt. Ett nytt Salesforce-plugin med 37 färdiga säljfunktioner gör att Claude kan läsa aktuell affärskontext och uppdatera pipelines, vilket innebär att affärssystemet i allt högre grad blir ett verktyg bakom AI-agenten. Politiska modeller för automatisering: Bill Gates föreslår en robotskatt på robotar och AI-användning för att jämna ut skattevillkoren för mänsklig arbetskraft. Han föreslår även kategorin "Human Reserved" för att skydda specifika, mänskligt värdefulla arbetsuppgifter från automatisering. Förbättrad transkribering: Googles nya modell Gemini 3.5 Transcribe omvandlar rått ljud till färdigredigerad, korrekt formaterad text och kan hantera både bakgrundsbrus och svåra fackuttryck via API och agentplattformar. Mer autonoma webbagenter: Microsoft släpper AutoSaddler: Ett nytt verktyg på GitHub med öppen källkod som automatiskt analyserar AI-agenters körspår för att systematiskt föreslå optimeringar av promptar och middleware. Övriga tekniknyheter och trender

  2. Aug 27

    Ubers miljardbot och OpenAIs nya chip

    OpenAI:s Jalapeño-chip visar första resultaten OpenAI har presenterat de första interna testerna för sitt egna inferenschip Jalapeño, utvecklat i samarbete med Broadcom. Chippet är specialbyggt för att köra (och inte träna) modeller och uppges leverera 1,5–1,9 gånger mer AI-arbete per watt samt 1,7–3,6 gånger lägre svarslatens än jämförelsesystemen. Detta kan sänka OpenAI:s driftskostnader per token och minska beroendet av Nvidia när det tas i drift före årsskiftet.Fysisk AI i 4D med Accelerated Understanding Företaget Accelerated Understanding, grundat av bland annat Caltech-professorn Anima Anandkumar och Benedikt Jenik, fokuserar på modeller som kan simulera hur fysiska system utvecklas i 3D över tid. Genom att använda neural operators istället för vanliga språkmodeller kan tekniken hantera kontexter på över fem biljoner datapunkter inom områden som material, extremväder och robotik.Perplexity och Nvidia lanserar lokal AI-agent Lösningen Portable Computer gör det möjligt att köra Perplexitys agentstack, modeller, verktyg och sandbox helt lokalt på Nvidia DGX Spark. Systemet stöder modellerna Qwen 3.8 27B och PPLX 27B lokalt utan att förbruka Perplexity-krediter, och användaren måste godkänna alla steg som eskaleras till molnet. Detta skapar ett integritetssäkert alternativ för känsliga filer och stora arbetsvolymer.Uber får miljardböter för automatiserade beslut Den nederländska dataskyddsmyndigheten har bötfällt Uber med 825 miljoner euro efter att förarkonton stängts av helt automatiskt utan verklig mänsklig inblandning. Detta bedöms bryta mot GDPR:s skydd mot helt automatiserade beslut som har betydande konsekvenser för människors försörjning. Uber planerar att överklaga beslutet.Apple lanserar M6-chippet för ständigt aktiva agenter Apple har presenterat sitt nya 2-nanometerschip M6 i en ny Mac mini, samt M5 Ultra i Mac Studio. Mac mini med M6 utlovar upp till fyra gånger snabbare AI-prestanda än M4-modellen och marknadsförs specifikt för ständigt aktiva agentarbetsflöden med ett startpris på 899 dollar.Google lanserar branschspecifika Gemini-agenter Google lanserar specialiserade och säkra agentplattformar i en förhandsversion: Gemini Enterprise for Legal och Gemini Enterprise for Financial Services. Dessa är skräddarsydda för uppgifter som avtalsgranskning, regulatorisk bevakning, KYC (känn din kund) och riskanalys.Säkrare agentbehörigheter och gemensamt Claude-minne Vercel Connect blir allmänt tillgängligt och introducerar kortlivade behörigheter för AI-agenter, vilka skapas dynamiskt vid körning och löper ut automatiskt. Anthropic slår ihop minnet i Claude-chatt och Cowork för att ge en mer sammanhängande upplevelse där kontexten automatiskt följer med mellan samtal och agentuppgifter. Figure samlar in mänsklig data för robotik Robotikbolaget Figure har släppt appen Index för att låta människor bidra med träningsdata om hur fysiska uppgifter utförs, vilket ska hjälpa till att träna bolagets humanoida robotar på fler miljöer och beteenden än vad egna robotflottor kan producera.

  3. Aug 26

    Från skyttegravar till datacenter i rymden

    Militärt AI-samarbete mellan Storbritannien och Ukraina: Storbritannien blir den första utländska partnern till Ukrainas Avengers AI Labs. Genom samarbetet får Storbritannien tillgång till unika, verkliga stridsdata från tusentals kameror och infraröda sensorer för att träna AI-modeller som känner igen bland annat stridsvagnar, artilleri, drönare och luftvärn. De ska även samarbeta kring gemensamma modeller, säkra beräkningsmiljöer samt nya AI-chip för drönare och autonoma system. SpaceXAI och Nvidia tar beräkningskraft till rymden: SpaceXAI planerar att bygga sin första Starmind-satellit kring Nvidias rymdanpassade plattform Vera Rubin NVL72. Detta partnerskap gör rymdbaserade datacenter till ett konkret industriprojekt med sikte på uppskjutning mot slutet av 2027. Thomson Reuters lanserar egen juridisk språkmodell: Den nya språkmodellen Thomson har kostat 40 miljoner dollar att utveckla och är tränad på företagets egna juridiska innehåll och expertis. En mindre version kommer dessutom att släppas med öppna vikter för akademisk och icke-kommersiell användning. Kinesiska hackergrupper mer än fördubblar sina attacker med AI: Kinesiska statskopplade grupper använder öppna modeller som DeepSeek för rekognosering, kodskrivning och utveckling av skadlig programvara, vilket har lett till en mer än fördubblad attackvolym på grund av modellens låga kostnad och svagare skyddsräcken. Nvidia sätter Groq 3 LPX i full produktion: Denna inferensaccelerator är optimerad för snabb tokengenerering i agentiska arbetsflöden och har visat sig leverera upp till 3 400 utdatatokens per sekund i tredjepartstest med Gemma 4 31B. Alibaba lanserar Wan 3.0 och storsatsar på AI-kapacitet: Den nya modellen kan generera upp till 30 sekunder långa videor från text, bild och dokument. Alibaba planerar dessutom en nyemission på 80 miljarder Hongkong-dollar där hela nettolikviden ska investeras i företagets fullstackkapacitet för AI. AI-agenter skriver över 70 procent av Ubers pull requests: Genom en intern mjukvarufabrik med styrd gateway och verktygsåtkomst skapas nu merparten av koden av AI-agenter, vilket har fördubblat kodmängden per ingenjör på ett år. Inferensmotorer pekas ut som en ny attackyta: En ny säkerhetsanalys beskriver hur specifika tokensekvenser kan utnyttja sårbarheter i programvaran som kör modeller på GPU:er och i teorin ta kontroll över värddatorn för att stjäla vikter eller röra sig vidare i datacentret. Verklig, högkvalitativ och annoterad stridsdata håller på att förvandlas till en strategisk tillgång och kritisk geopolitisk infrastruktur. Rymdbaserad datorkraft går snabbt från att vara en visionär idé till konkreta, hårdvarubaserade planer. Företag med värdefulla och proprietära kunskapsbaser väljer allt oftare att bygga egna specialiserade modeller framför dyra, generella API-lösningar.

  4. Aug 25

    Nvidias prischock och AI-modeller som fuskar

    OpenAI svänger om Kaliforniens AI-säkerhetslag (SB 53): OpenAI föreslår nu att lagförslaget SB 53 kompletteras med krav på övervakning av avancerade modeller redan under träning och utvärdering. Bolaget efterlyser också starkare cyberskydd genom hela modellutvecklingen, vilket innebär en tydlig kursändring från deras tidigare motstånd mot lagen. Denna utveckling är viktig eftersom en ledande modellaktör nu ger konkret stöd åt tidigare och mer teknisk tillsyn av frontiermodeller. Nvidia varnar för kraftigt höjda priser på AI-servrar: Flera stora kunder har informerats om att priserna på servrar utrustade med de nya Vera Rubin- och Grace Blackwell-chipen kan stiga med över 15 procent från och med början av nästa år. Den främsta orsaken till prischocken är dyrare minneschip, i synnerhet HBM. Högre hårdvarupriser förväntas slå direkt mot budgetar och marginaler i hela AI-infrastrukturkedjan. Den anonyma modellen "Ox Alpha" utmanar inom kodning: En ny anonym modell vid namn Ox Alpha har lanserats på OpenRouter med multimodalt stöd, en kontext på cirka en miljon tokens och fokus på långvarigt agentarbete. Modellen presterar nära Fable 5 i kodtester men förbrukar betydligt färre tokens per uppgift. Detta kan snabbt förändra prisbilden för kodagenter, särskilt om modellen senare går att köra lokalt. Anthropic delar Claude Mythos 5 för defensivt bruk: Modellen Claude Mythos 5 används nu för kodgranskning inom Claude Security och hos fler säkerhetspartner. Den hjälper till att upptäcka sårbarheter och föreslå patchar, men användare får normalt inte direkt tillgång till modellen för att generera skadlig kod. Upplägget visar på en tänkbar distributionsmodell för kraftfull cyber-AI där försvarskapacitet delas utan att ge full offensiv åtkomst. DeepSeek testar experimentell modell med bildförståelse: Den nya experimentella modellen DeepSeek V4-Flash-Vision-Exp lägger till analys av bilder, skärmbilder och diagram till modellens text- och agentförmågor. Modellen fungerar med vanliga API-format från OpenAI och Anthropic, vilket underlättar leverantörsbyten, och uppges närma sig Opus 4.8 i vissa agenttester. Hugging Face undersöker intresse för miljardförsäljning: Plattformen uppges ha anlitat en bank för att sondera köparintresse vid en värdering på minst 13 miljarder dollar, vilket är nästan en tredubbling jämfört med dess värdering under 2023. Plattformens modellhub, dataekosystem och utvecklarrelationer har i dag blivit strategisk infrastruktur på AI-marknaden. Ny färdplan för Model Context Protocol (MCP): MCP utvecklas från en enkel verktygskoppling till ett mer komplett och säkert lager för samverkande agenter. Den nya färdplanen prioriterar agentmeddelanden, enhetligare HTTP-transport, identitet och företagssäkerhet. Metod för att avslöja fusk i talmodeller: Hugging Face beskriver tre nya tester för att upptäcka så kallad "benchmarkmaxning" inom taligenkänning, där modeller överanpassas till specifika testmönster (som i VoxPopuli och LibriSpeech) snarare än att faktiskt bli bättre. Robusta utvärderingar minskar risken för att företag tar inköpsbeslut baserade på missvisande topplistesiffror.

  5. Aug 24

    AI-agenter i cellerna och flygande vingar

    Individanpassad cancerbehandling med mRNA (Fas 3): Moderna och Merck rapporterar att intismeran i kombination med Keytruda förbättrade överlevnaden utan återfall samt tiden utan fjärrmetastaser hos patienter med opererat högriskmelanom. Detta är ett viktigt kliniskt steg för skräddarsydda cancerbehandlingar baserade på patienters unika tumörmutationer, vilket på sikt kan etablera individanpassade mRNA-vacciner som en helt ny behandlingsplattform. De fullständiga resultaten och effektens storlek har dock inte redovisats ännu. Kinesisk rymdframgång med återanvändbar raket: Företaget LandSpace har placerat en satellit i omloppsbana och därefter lyckats landa det första raketsteget av Zhuque-3 vertikalt på land. LandSpace blir därmed det tredje privata företaget i världen (efter SpaceX och Blue Origin) som genomfört en vertikal landning av ett orbitalt raketsteg, vilket kan bidra till sänkta uppskjutningskostnader och ökad global konkurrens. AI-designade intrakroppar når in i celler: Genom att kombinera regler för elektrisk laddning med AI-baserad proteindesign har forskare lyckats omvandla vanliga antikroppar till stabila "intrakroppar" (små antikroppsfragment som fungerar inuti celler). Metoden har testats på 672 sekvenser riktade mot proteiner kopplade till bland annat Alzheimers, Parkinsons och Huntingtons sjukdom. Detta öppnar upp helt nya behandlingsmöjligheter som vanliga antikroppar inte kan nå. Kina testar jätteflygplan ("flygande vinge"): Det aerodynamiska forskningscentret CARDC har vindtunneltestat ett blended-wing-koncept dimensionerat för upp till 800 passagerare. Designen kan ge effektivare långdistansflyg och bättre bränsleekonomi, men stora utmaningar återstår kring nödutrymning och fönsterlösa kabiner. Säkrare neonatalvård genom ljusskanning: En ny studie från Lurie Children's visar att bredbandig optisk spektroskopi med infrarött ljus kan upptäcka den farliga tarmsjukdomen nekrotiserande enterokolit hos för tidigt födda barn i ett tidigt skede. Metoden är icke-invasiv och mäter förändringar genom barnets buk, vilket kan ge vården ett avgörande försprång jämfört med traditionell röntgen. Fysiskt tangentbord gör comeback: Android-telefonen Clicks Communicator kombinerar en kompakt skärm med ett fysiskt tangentbord. Telefonen fokuserar på kommunikation i stället för ständig konsumtion och kan kopplas till en primär telefons internettjänster. Det blir helt avgörande att följa Modernas fullständiga fas 3-data för att bedöma effektens storlek och säkerhetsprofilen. LandSpaces lyckade landning ses som det tydligaste industriella teknikskiftet just nu. De AI-designade intrakropparna bedöms ha den mest spännande och värdefulla långsiktiga forskningspotentialen.

  6. Aug 22

    Anthropics miljardnotering och din nya AI-kollega

    Anthropic planerar en rekordstor börsnotering Enligt uppgifter från Bloomberg förbereder Anthropic en börsansökan som kan lämnas in redan i slutet av augusti. Bolaget siktar på att matcha eller överträffa SpaceX historiskt stora börsintroduktion, samtidigt som man förhandlar om en kreditfacilitet på över 10 miljarder dollar. Eftersom planerna ännu inte är formellt inskickade bör de ses som långt gångna förberedelser snarare än ett slutgiltigt beslut. Varför det spelar roll: En notering av denna kaliber skulle ge marknaden en mycket tydlig värdering av frontier-AI-bolag och visa hur stora deras faktiska kapitalbehov är. Micron storsatsar på forskning kring AI-minne Micron lanserar en ny forskningshubb, Micron Research Labs, i Boise och planerar att investera 10 miljarder dollar under de kommande tio åren. Hubben ska utveckla nya minnestekniker, beräkningsarkitekturer och framtida halvledartillverkning i tätt samarbete med universitet, myndigheter och industripartner. Varför det spelar roll: Minneskapacitet har blivit en av de mest kritiska flaskhalsarna för AI, och denna satsning visar hur hårdvarukonkurrensen nu flyttar allt längre ned i teknikstacken. Slack Code integrerar AI-agenter i teamet Slack introducerar projektspecifika kodkanaler där mänskliga utvecklare och AI-kodagenter kan samarbeta. Teamet kan planera, skriva och granska programvara samt följa kodändringar och förhandsvisningar direkt i Slack-gränssnittet, med integrationer från aktörer som GitHub, Anthropic och Vercel. Varför det spelar roll: AI-kodagenter flyttar nu ut från utvecklarnas privata verktyg och in i gemensamma arbetsytor där fler personer i organisationen kan granska och styra deras arbete. Mistral lanserar "Agentic Search" för dokumentanalys Mistral har presenterat en ny sökloop som gör att modeller kan söka, öppna, navigera, läsa och söka med mönster (grep) i långa dokument i flera steg. I Mistrals egna tester ökade träffsäkerheten på FinanceBench-testet från 26,7 procent till 86 procent, även om dessa resultat än så länge är leverantörsrapporterade och behöver verifieras oberoende. Varför det spelar roll: Metoden adresserar ett vanligt problem med RAG (Retrieval-Augmented Generation), där modeller tenderar att svara baserat på de första textavsnitten de hittar istället för att kontrollera hela källan. Mistral lanserar "Agentic Search" för dokumentanalys Mistral har presenterat en ny sökloop som gör att modeller kan söka, öppna, navigera, läsa och söka med mönster (grep) i långa dokument i flera steg. I Mistrals egna tester ökade träffsäkerheten på FinanceBench-testet från 26,7 procent till 86 procent, även om dessa resultat än så länge är leverantörsrapporterade och behöver verifieras oberoende. Varför det spelar roll: Metoden adresserar ett vanligt problem med RAG (Retrieval-Augmented Generation), där modeller tenderar att svara baserat på de första textavsnitten de hittar istället för att kontrollera hela källan.

  7. Aug 21

    Claude Mythos designar proteiner helt själv

    Claude driver proteindesign nästan helt självständigt: Anthropic visar att deras modeller Claude Mythos Preview och Opus 4.8 lyckades ta fram fungerande proteinbindare mot 14 av 15 mål med minimal mänsklig inblandning. Mellan 22 och 35 procent av designerna fungerade i laboratoriet, vilket är ett stort kliv uppåt från den vanliga träffnivån på 10–15 % (även om detta fortfarande är ett tidigt steg i läkemedelsutveckling och inte färdiga läkemedel). Detta representerar ett skifte där AI går från att vara en vetenskaplig assistent till att kunna genomföra hela experimentella arbetsflöden självständigt. Google och Marvell fördjupar samarbete kring egna AI-chip: Marvell har gett Google option att köpa upp till 58,97 miljoner aktier (värda cirka 12,2 miljarder dollar om optionen utnyttjas helt) kopplat till Googles inköpsnivåer av Marvells specialchip. Samarbetet spänner över inferensacceleratorer, nätverk, lagring och minnesnära beräkningar för Googles TPU-ekosystem, i syfte att bygga egna chipkedjor, minska beroendet av Nvidia och pressa infrastrukturkostnaderna. Stripe förvärvar OpenRouter: Betalningsjätten Stripe har avtalat om att köpa OpenRouter, en gateway som routar datatrafik mellan över 400 AI-modeller från fler än 80 leverantörer. Stripe vill hjälpa företag att optimera val av modell, tokenkostnader och användning. Detta visar hur modellrouting håller på att utvecklas till ett centralt infrastrukturlager i AI-ekonomin. OpenAI pausar delar av frontier-träningen av säkerhetsskäl: På grund av snabba framsteg inom cyberförmåga och incidenter där de interna skyddsmekanismerna inte räckte till, pausade OpenAI tillfälligt två veckors driftsinriktad förstärkningsinlärning och håller sin största planerade frontier-träning vilande. Cerebras lanserar fjärde generationens AI-system CS-4: Det nya systemet bygger på tre nya "wafer-scale"-processorer och uppges ge upp till 30 gånger snabbare inferens än GPU-system samt tio gånger bättre energieffektivitet per watt än föregångaren CS-3. Pennsylvania skärper kraven på AI-datacenter: Guvernör Josh Shapiro har skrivit under en order som tar bort AI-datacenter från snabba tillståndsprocesser, förbjuder sekretessavtal kring projekten och kräver lokalt godkännande samt bindande miljö- och samhällsåtaganden för att skydda invånare från högre kostnader. Replit lanserar ett kreditfritt gratis-läge: Replits nya "Free Mode" drivs av GPT-5.6 Luna och tillåter användare att göra enklare agentuppgifter och chatta utan att förbruka sina krediter, vilket förändrar ekonomin för AI-baserad mjukvaruutveckling. OpenAI testar "Private Safety Processing": Ett nytt säkerhetssystem som ska hitta missbruksmönster i API-interaktioner utan att bryta löftet om noll datalagring för berättigade företagskunder. AI driver vetenskapen på riktigt: Anthropics resultat inom proteindesign är dagens tydligaste exempel på hur AI har gått från teori till att driva faktiska, laboratorieverifierade vetenskapliga processer. Infrastruktur och optimering: Stripes uppköp av OpenRouter understryker att optimering av modellrouting håller på att bli en kritisk del av den framtida AI-infrastrukturen. Det fysiska kriget om AI: AI-kapplöpningen avgörs allt mer bortom själva mjukvaran – det handlar om tillgång till egna chip (Google–Marvell), el, tillstånd och lokalt politiskt stöd (Pennsylvania). Övriga viktiga nyheter i korthetSammanfattande analys (Snabb take)

  8. Aug 20

    Stormakternas AI-krig och agenter med minne

    USA tvingar partnerländer att välja AI-läger: USA:s utrikesdepartement förbereder ett besked till 35 partnerländer om att de riskerar att stängas ute från den USA-ledda teknikkoalitionen Pax Silica om de ansluter sig till Kinas nya AI-samarbete. Initiativet omfattar allt från AI-modeller och halvledare till kritiska mineraler. ChatGPT anpassas för tonåringar: OpenAI rullar ut en skräddarsydd ChatGPT-upplevelse för användare i åldern 13–17 år. Kontona får ett starkare standardskydd mot bland annat skadligt innehåll och självskada, föräldrakontroller samt koppling till ett fokuserat "Study Mode". Miljardinvestering i specialchip: Chipbolaget Etched har tagit in 700 miljoner dollar i en ny finansieringsrunda, vilket värderar bolaget till hela 21 miljarder dollar. De har också levererat sitt första AI-rack till Jane Street för att sänka kostnader och latens vid AI-inferens. Firefox lanserar integritetsfokuserad AI: Mozilla introducerar Smart Window, ett valfritt läge med en inbyggd assistent där användaren har full kontroll över vilken historik och flikdata assistenten får använda. Meta stäms på miljardbelopp: En koalition av amerikanska delstater kräver cirka 200 miljarder dollar från Meta. De anklagar bolaget för att medvetet ha gjort Facebook och Instagram beroendeframkallande för barn samt brutit mot konsumentskyddsregler. AI-agenter får minne och bättre verktyg: Utvecklingen av agenter går snabbt framåt på flera fronter: Geopolitiska block: AI-ekosystemet håller på att delas upp i tydliga geopolitiska läger, där nationella säkerhetsintressen börjar styra teknikvalen mer än pris och prestanda. Fokus på minderåriga: Både stämningen mot Meta och OpenAI:s nya tonårsskydd visar att branschen tvingas bygga mer åldersanpassad och säker teknik som standard. Infrastruktur och säkerhet: Nästa stora flaskhals är inte bara att göra modellerna smartare, utan att bygga robust och säker infrastruktur för att köra dem (vilket Etcheds chip och Vercels sandlådetester visar). Övriga viktiga nyheter i korthetDe tre stora trenderna ("Snabb take")

About

Digital Intelligens - en podcast om AI och innovation