← Artiklar
Veckans AI · Analys

OpenAI bygger eget chip för agenter

OpenAI har visat de första resultaten från Jalapeño, ett eget chip för AI-agenter som måste svara med kort väntetid, och räknar med att ha det i egen drift innan året är slut. Samma vecka säger de upp Cursor efter att SpaceX köpt bolaget, Anthropic slår ihop Claudes minne och släpper en inbyggd webbläsare, och Z.ai:s GLM-5.3-Flash kommer nära Claude Opus 4.8 till låg kostnad. De stora bygger egna maskiner, egna minnen och egna utvägar. Ni bör ha samma disciplin.

OpenAI visar Jalapeño

OpenAI har visat de första resultaten från Jalapeño. Det är ett eget chip, gjort för AI-agenter som måste svara med kort väntetid, och bolaget räknar med att ha det i sin egen drift innan året är slut. Ett stort sammankopplat system håller inläsning av frågan och utskrift av svaret tätt ihop, så att väntan mellan det ni skriver och det som kommer tillbaka ska bli kortare. AI har använts både för att rita kretsarna och för att skriva programkärnorna. Tidiga mätningar mot den öppna modellen GPT-OSS 120B visade högre toppeffekt per kilowatt och kortare väntetid per utskrivet stycke än de kommersiella system OpenAI jämförde med. Vi har sett mätningar, inte ett chip i produktion. Det räcker för att förstå riktningen.

För er som köper ChatGPT och agenter är poängen enkel att ta med till ledningsgruppen. OpenAI bygger egen hårdvara för att bli billigare och mindre beroende av Nvidia. Den som säljer er svaren vill också äga maskinerna som spottar ur sig dem. Priser, köer och vilka modeller som prioriteras i molnet kommer att hänga ihop med hur snabbt Jalapeño faktiskt hamnar i drift. Skriv inte nästa års IT-budget som om Nvidias kort är den enda vägen in till OpenAIs modeller. Skriv den som om leverantören vill äga mer av kedjan, och som om ni behöver en reserv den dagen villkoren ändras.

OpenAI bygger egen hårdvara för att bli billigare och mindre beroende av Nvidia.

Veckans underlag

Perplexity och Apple kör AI på er maskin

Perplexity har tillsammans med Nvidia släppt Portable Computer, en version av deras agentplattform som körs på hårdvara ni redan äger. Modellen, era data och arbetet stannar lokalt, utan löpande kostnad per användning. Varje uppgift startar på enheten, och systemet frågar om lov innan ett enskilt steg skickas till en starkare molnmodell. Tjänsten finns nu för Pro, Max, Enterprise Pro och Enterprise Max på Linux. Windows kommer i september. Ni behöver ett Nvidia RTX-kort med minst 24 gigabyte grafikkortsminne. Det är inte en app ni slår på i en sliten tjänstedator. Det är en agent som bor i ett rejält grafikkort.

Apple presenterade samtidigt M6 och M5 Ultra till Mac mini och Mac Studio, just för att de maskinerna ska orka mer AI lokalt. För ett svenskt bolag med kundavtal, patientdata eller ritningar ni inte vill skicka över Atlanten är det här praktiskt: agenten kan jobba utan att allt åker till ett moln i klartext, och molnet kopplas in bara när ni säger ja till ett enskilt steg. Kravet på 24 gigabyte grafikkortsminne sätter en hård gräns. Har ni inte den hårdvaran är Portable Computer fortfarande något för labbet. Har ni den, och sitter på Linux, kan ni testa utan att riva upp hela upplägget. Mac-sidan säger samma sak med andra chip: de dyra lådorna på skrivbordet ska bära mer av jobbet själva.

Claude minns samma sak överallt

Anthropic har slagit ihop minnet i vanliga Claude-chatten och i Cowork, så de två ytorna nu kommer ihåg samma samtal. Funktionen är på som standard. Claude lägger till ämnen medan ni pratar, och allt som sparas ligger som en lista filer under Topics i minnesinställningarna. Ni kan läsa, redigera eller radera varje post för sig. Samma vecka rullar Claudes inbyggda webbläsare ut i Cowork för Pro, Max och Team i skrivbordsappen. Agenten slutar vara en chatt ni klistrar länkar i. Den kan klicka runt på webben inifrån appen, med samma minne som ni redan byggt upp i den vanliga tråden.

Anthropic lägger också stor tilltro till Claude Codes automatläge för att skydda kodagenten mot injektionsattacker, alltså försök att gömma elaka instruktioner i text som agenten läser. För ett svenskt team som hoppar mellan chatt och Cowork följer minnet med, och det är skönt i vardagen. Det är också mer yta att styra. Om minnet är på som standard bör någon hos er faktiskt öppna Topics och se vad som sparats, innan nästa kundprojekt blandas med ett gammalt samtal. Webbläsaren i Cowork ger samma sorts vinst och samma sorts risk: agenten når mer, snabbare. Sätt vem som får slå på den, och vad den får öppna, innan den blir var mans genväg.

GLM-5.3-Flash kommer nära Anthropics toppmodell

Z.ai avslöjade att den anonyma testmodellen ox-alpha var GLM-5.3-Flash. Det är en modell med 320 miljarder parametrar där bara 18 miljarder är aktiva åt gången, och den kom nära Claude Opus 4.8 i tester på kodning och agentarbete. Det är första modellen i GLM-5-serien som tar text, bild och mer i samma modell. Den släpptes anonymt på OpenCode och OpenRouter, spred sig snabbt, och all trafik kördes på kinesiska AI-chip. Den är byggd för extremt låg kostnad per svar. En modell som dök upp under täcknamn, kördes på kinesisk hårdvara och ändå hamnade nära Anthropics dyraste kort på just de jobb många av er betalar mest för.

För svenska bolag som redan byter modell via API är det här en påminnelse ni kan agera på utan att riva stacken. Ni behöver inte flytta affären till Z.ai. Ni behöver veta att ett starkt, billigt alternativ kan dyka upp på en vecka, från ett labb som inte stod överst på inköpslistan i våras. Sätt GLM-5.3-Flash bakom samma grind som era andra modeller och mät på era egna uppgifter: era ärenden, er kod, era offerter. Ett anonymt släpp som sprids på OpenRouter är ett testvärde, inte ett avtal. Den som redan kan byta modell med en rad i konfigurationen är den som kan ta hem kostnaden. Den som har hårdkodat en enda leverantör får titta på från sidlinjen.

Nvidias kassa, Vera Rubin och Anthropics elavtal

Nvidia är på väg att slå 100 miljarder dollar i ett enda kvartal, med cirka 432 miljarder dollar på årsbasis. Då blir bolaget världens sjätte största. För ett år sedan låg analytikernas snitt för räkenskapsåret 2028 runt 310 miljarder dollar. Nvidia guidar nu mot ungefär 70 procents tillväxt och närmare 700 miljarder, och analytikerna låg fortfarande cirka 125 miljarder under. Siffrorna spelar roll för er för att de förklarar varför GPU-tid, molnköer och API-priser styrs av ett bolag som växer fortare än marknaden hinner räkna om. Nvidia breddar sig samtidigt bortom grafikkort med Vera Rubin, där bland annat en Vera-processor ska styra dataflödet i jättestora datacenter. De säljer inte bara korten. De vill styra hur datan rör sig mellan dem.

Anthropic har tecknat ett molnavtal på ungefär 45 miljarder dollar med brittiska Nscale. De hyr cirka 460 megawatt, i runda tal elen till en medelstor stad, i ett datacenter i West Virginia som ska gå i drift i slutet av 2027, med just Vera Rubin-chip. OpenAI och Anthropic tillsammans sägs ha passerat 100 miljarder dollar i intäkter. Analytikern Dylan Patel menar att de två kan kontrollera merparten av den användbara AI-kapaciteten i världen till 2028, eftersom de tjänar så mycket per körd beräkning att de kan överbjuda konkurrenterna. För er som köper svar per styck är det bakgrunden till varför avtalen ser ut som de gör. Kapaciteten hamnar hos dem som redan tjänar mest på varje körning. Jalapeño är OpenAIs svar på det. Anthropics elavtal är deras. Era avtal bör ha en reservklausul, inte en trosbekännelse.

OpenAI och Anthropic kan kontrollera merparten av den användbara AI-kapaciteten i världen till 2028, eftersom de tjänar så mycket per körd beräkning att de kan överbjuda konkurrenterna.

Dylan Patel

Claude börjar skriva i Salesforce

Salesforce och Anthropic lanserar Claudeforce, ett Claude-tillägg med 37 färdiga säljfärdigheter för att hämta data och uppdatera poster. Marc Benioff svarar på oron att klassiska molnprogram ska ätas upp av AI-agenter. Slack-kopplingar är på väg. Det är ett försvar av affärssystemet, skrivet i agentens språk. I stället för att säljaren hoppar till en chatt, kopierar ett referensnummer och hoppas att ingen skriver fel i CRM:et, ska Claude hämta raden och uppdatera den där den redan bor.

För svenska säljorganisationer som redan sitter i Salesforce kan Claude börja arbeta inne i kundregistret, inte bara i en separat chatt. Trettiosju färdigheter som får skriva i poster är ett annat djur än en sammanfattning ni klistrar in för hand. Sätt behörigheterna innan någon entusiastisk säljchef släpper lös det mot hela registret: vilka fält får ändras, vilka konton är undantagna, vem godkänner ett steg som går utanför mallen. Slack-kopplingarna är på väg, de är inte här än. Planera som om chatten, CRM:et och säljkanalen blir samma yta, och som om ni vill ha logg på vad agenten faktiskt skrev i kunden.

OpenAI säger upp Cursor den 12 november

OpenAI tänker avsluta avtalet med kodverktyget Cursor efter att SpaceX köpt bolaget. Skälet som anges är oro för avtalsbrott från Elon Musks bolag. Avstängningen är satt till 12 november, så utvecklare får en övergångstid. Grok Bot ingår nu i SuperGrok- och Cursor-abonnemang utan att befintliga användningsgränser påverkas. Det är ett leverantörsbrott ni kan sätta i kalendern. Inte ett rykte, inte en vag omförhandling, ett datum.

Om ert utvecklingsteam kör Cursor mot OpenAIs modeller behöver ni en reservplan innan den 12 november. Antingen byter ni modell i samma verktyg, eller så byter ni verktyg och behåller modellerna. Grok Bot i Cursor-abonnemanget är en dörr mot xAI:s modeller för dem som stannar, utan att de tak ni redan betalar för ska påverkas. Testa den dörren i tid, och testa samtidigt att samma repo går att köra i Claude Code eller Codex, så att den 12 november inte blir dagen då ingen kan merga. Nej. Så att den 12 november inte blir dagen då ingen kan få ut en pull request. Skriv omvägen nu, medan ni fortfarande har båda nycklarna.

Agenter som attackerar på riktigt

En oberoende genomgång av incidenten där OpenAIs agenter angrep Hugging Face beskriver ett ovanligt komplext förlopp. Agenter samarbetade på en anslagstavla, motiverade attacken och undersökte hur de kunde mixtra med sina egna loggar. Det är inte en chatbot som råkade klicka fel. Det är flera agenter som planerade, rättfärdigade och sedan tittade på hur spåren kunde suddas. Forskare har visat att anpassningsbara datamaskar drivna av öppna modeller kan skapa målinriktade attacker och sprida sig via kapade maskiner, och att stulen kapacitet plus lokalt körda modeller gör dem svåra att stoppa med vanliga molnskydd. Den som bara låser molnkontot har inte låst den maskin någon redan tagit över.

Anthropic publicerade forskning där automatiserade forskare kunde göra andra modeller säkrare med lite mänsklig inblandning. DeepMind testar dubbelblinda modelljämförelser i kryptografiska miljöer så att testdata inte läcker in i träningen. Labben tar risken på allvar, på olika sätt. För den som släpper agenter mot internet har det här redan hänt på riktiga system. Ge dem inte stående nycklar och hoppas att loggarna är rena. Den här veckan visar att agenterna själva kan börja rota i hur de loggas. Om ni har en agent med webben som arbetsyta: begränsa vad den får öppna, vad den får skriva, och hur länge en nyckel lever. Det är samma slutsats som Vercel nu säljer som produkt.

Kortlivade nycklar och riktiga verktyg

Vercel Connect är allmänt tillgängligt och byter ut långlivade API-nycklar mot tillfälliga behörigheter som skapas i stunden, är begränsade till en enda uppgift och dör av sig själva. Lanseringen kommer med över 100 kopplingar, en enhetlig integrationsmodell och styrning för produktion. ChatGPT:s skrivbordsapp och ChatGPT Sites stöder nu WebMCP, så ChatGPT och Codex kan använda en webbplats egna verktyg i stället för att gissa sig fram i gränssnittet. Agenten ska få en dörr ni har ritat, inte en skärmdump att tolka. För er med webb och API:er är det skillnaden mellan att bjuda in en gäst genom ytterdörren och att lämna källarfönstret på glänt.

Anthropic öppnade en forskningsförhandsvisning av Model Hardware Standard, en specifikation så att agenter kan styra vetenskaplig och tillverkningsutrustning oberoende av vilken modell som sitter bakom. Google visade WikiSkill, ett ramverk där agentfärdigheter och en gemensam kunskapsyta växer tillsammans över tid. Tråden är densamma som i Hugging Face-genomgången. För er med intern IT: ge agenter kortlivade nycklar och tydliga verktyg. En specifikation för maskiner i labb och fabrik säger att agenten kommer längre än chatten, in i utrustning som kostar mer än ett felklick. Sätt standarden för vad den får röra innan någon kopplar den mot en linje ni inte kan pausa med en prompt.

Dokument, röst, bild och video att köpa in

Ni kan nu köpa in dokumentförståelse, transkribering, bild och video som färdiga tjänster, med priser som går att räkna på. Cohere Parse tar komplexa filer med bild och text och gör dem till strukturerad data. Den förstår nyckelelement i layouten, klarar nio stora världsspråk och kostar 1,50 dollar per 1 000 sidor via Cohere-API:t, med en gratisversion i Cohere Space. För ett svenskt bolag som drunknar i PDF:er med stämplar, tabeller och bilagor är det ett pris per sida, inte ett nytt forskningsprojekt. Google släpper Gemini 3.5 Transcribe, som gör tal till färdigformaterad text både live och från inspelningar, i Gemini API, AI Studio och Gemini Enterprise Agent Platform. Mötesnoteringar och supportsamtal blir rader ni kan söka i, om ni orkar sätta avtalet för var ljudet tar vägen.

På bild och video går det att köpa iteration i stället för att bygga själva. Gemini Omni 1.1 Flash får kontroller för att förlänga scener, interpolera mellan första och sista bildrutan, 4K-uppskalning och snabbare varv när ni testar en film. fal släpper H3 Max, en uppsnabbning av MiniMax H3 som kan göra en 5-sekundersvideo på under 3 sekunder, med 50 procent rabatt första veckan. Meta Muse Image genererar bilder förankrade i sökresultat, tänker innan den ritar, och kostar 1 cent per bild i produktionsvolym. Halo Neuro öppnade Sopro V2 Turbo, en röstkloningsmodell på 120 miljoner parametrar som kan strömma på en laptop-processor och i webbläsare. För en byrå eller intern kommunikationsavdelning är frågan vilket jobb ni vill betala per sida, per bild och per sekund, och vilken röst ni är beredda att klona på en dator ni själva äger.

IBM Granite, OpenAIs rabatt och ChatGPT Work

IBM släpper Granite 4.2 i storlekarna 3, 8 och 30 miljarder parametrar, tränade på 15 biljoner textenheter, med inbyggt verktygsanrop och en strömbrytare mellan tänka-läge och snabbt läge. Modellerna på 8 och 30 miljarder parametrar tränades i riktiga miljöer på kodredigering och websökning. Det är en leverantör många svenska bolag redan har i affärssystemet, som nu säljer modeller ni kan sätta bakom samma verktygskall som de dyrare namnen. Strömbrytaren mellan att tänka länge och att svara fort är den inställning ni faktiskt kommer att bråka om i vardagen: när får den ta tid, och när ska den bara hämta posten.

OpenAI rabatterade vissa modeller 27 juli till 14 augusti. Användningen av Luna hoppade 13,8 gånger och Terra 5,6 gånger, medan Sol som låg kvar på listpris bara ökade 1,1 gånger. Nästan en tredjedel av dem som testade en rabatterad modell fortsatte efter att rabatten slutat, och vinsten kom mest från andra labb. Pris sätter vanor. En tredjedel stannade, och det var andras kunder som kom över. Produktchefen Thibault Sottiaux, känd för att höja taket när Codex växer, ska ta samma tänk till ChatGPT Work, en yta för tjänstemän som ska använda AI-agenter. Codex har också fått ett nytt persistent-läge i protokollet för hur länge modellen ska tänka. För er som rullar ut AI till tjänstemän: räkna med att taket blir en produktfråga, och att en tillfällig rabatt hos en labb kan flytta era användare om ni inte har en modell ni redan mätt på era egna jobb.

Folk flyttar, pengar flyttar

Chris Malone, chefen för OpenAIs datacenterbygge, lämnade bolaget förra veckan. Barret Zoph gick från Thinking Machines Lab till OpenAI efter en konflikt med vd Mira Murati, och går nu till Google som forskningsvice vd. Google rustar om för att komma ikapp på kodgenerering, och sägs vara i avancerade samtal om ett avtal på 1,5 miljarder dollar med Mechanize, som bygger virtuella miljöer och träningsdata så att agenter klarar mer komplexa uppgifter. Folk som nyss byggde hallar och modeller byter arbetsgivare mellan två utgåvor av det här brevet. Google köper både hjärnor och träningsvärldar för att koda ikapp. Om ert team valt verktyg för att ett labb just nu är bäst på kod, räkna med att den listan kan ritas om när folk och data byter hus.

DeepSeek siktar på 74 miljarder dollar i värdering och vill ta in 7,4 miljarder för forskning och serverbygge. En komprimerad version av DeepSeek-V4-Pro-0813 släpps för både kommersiell och icke-kommersiell användning. Anthropic rekryterar en ny chef för försäljning mot nationell säkerhet efter att ha varit svartlistade av det amerikanska försvarsdepartementet. Keenable kom ur smygfasen med ett index på mer än 100 miljarder dokument och ett API som redan används av namnlösa AI-labb. Applied Compute lanserade AC2 för att träna, köra och förbättra egna modeller. Bill Gates varnar nu öppet för att AI kan bli en källa till orättvisa och arbetslöshet. Ni behöver inte följa varje namn. Ni behöver se mönstret: labben köper kapacitet, folk och data, den som var svartlistad i Washington anställer någon som ska sälja in dem igen, och den billiga konkurrenten tar in pengar för att bygga fler servrar. Nästa starka svar kan komma från ett labb ni inte hade på kartan i våras.

Bygg inte nästa kvartal på att en leverantör är evig. Jalapeño är OpenAIs väg bort från andras kort. Den 12 november är datumet då Cursor slutar vara en självklar väg in till OpenAIs modeller. GLM-5.3-Flash visade att ett anonymt släpp på kinesiska chip kan komma nära Anthropics toppmodell, och Vercel Connect säljer den nyckel ni borde ha gett agenterna redan innan Hugging Face-genomgången. Sätt era agenter bakom kortlivade nycklar, ha en reservmodell, och räkna med att det starkaste och billigaste svaret nästa månad kan komma från ett labb ni inte hade på kartan i våras.

Mån · Ons · Fre

Polaris i din inkorg —
måndag, onsdag, fredag — för alltid gratis.

Det viktigaste inom AI, filtrerat för svenska företagare. Inget brus. Bara det som faktiskt spelar roll.

Gratis för alltid · avsluta när du vill