← Artiklar
Veckans AI · Analys

Stripe köper OpenRouter

Stripe har köpt OpenRouter, röret som slussar över tio biljoner token per dygn mellan företag och modeller. Samma vecka får ni GLM-5.3 till samma pris som 5.2, OpenAI sänker takten efter cyberrisker, och agenterna sätter sig i mötesljudet, Slack och editorn. För den som betalar fakturan i Sverige är frågan densamma överallt: vem äger flödet, vad kostar det, och vad får modellen se.

Z.ai ger GLM-5.3 till 5.2-pris

Z.ai har släppt GLM-5.3 i sitt API. Det är live, och priset ligger kvar på 1,4 dollar per miljon token in och 4,4 dollar per miljon token ut, samma taxa som GLM-5.2. Ni betalar alltså inte mer för en modell som bolaget beskriver som tydligt starkare på kod och på jobb som tar många steg. Vikterna ska släppas öppet så att ni kan köra den själva, men de har inte satt datum.

För ett svenskt team som redan anropar kinesiska modeller är steget litet: byt version och mät kodkvalitet och agentjobb innan ni låser er. Fakturan står still, men skillnaden syns bara mot era egna uppgifter. Vänta inte på öppna vikter om API:t redan räcker, och räkna inte med att vikterna dyker upp bara för att de har utlovats.

Cerebras CS-4 och Nvidias kassa

Cerebras nya maskin CS-4 sägs vara flera gånger snabbare än föregångaren, som bolaget redan hävdar svarar snabbare än system byggda på Nvidias processorer. Den testas nu av en liten kundgrupp och ska bli mer allmänt tillgänglig under tredje kvartalet. Nvidia svarar med pengar: 105 miljarder dollar i ett datacenter i Ohio som ska stötta OpenAI, plus samarbeten med Wall Street kring investeringar i grafikkort, medan AMD och Google tar mark.

Poolside AI har tecknat ett icke-exklusivt licensavtal med Nvidia värt 6 miljarder dollar, och 109 anställda på Poolside får erbjudanden att gå över till Nvidia. Micron lägger 10 miljarder dollar över tio år på ett labb i Boise för minne och beräkningssystem. Etched har skickat sitt första hårdvarurack till Jane Street och tagit in 700 miljoner dollar till en värdering på 21 miljarder. För den som köper moln i Sverige styrs kapacitet och pris just nu av vem som har kapitalet att bygga hallar. Ni kan inte påverka Ohio, men ni kan sluta teckna långa avtal som utgår från att priset bara går åt ett håll.

OpenAI bromsar efter cyberrisker

OpenAI bromsade tillfälligt uppskalningen av sina största modeller och pausade en del träning där modellen lär sig av vad som lyckas och misslyckas. Skälet var nya tecken på att modellerna blivit duktigare på cyberangrepp, plus en säkerhetsincident. De säger inte hur länge pausen varar, och de sätter inte datum för nästa hopp.

Samtidigt förhandsvisar de Private Safety Processing: automatiska skydd ska kunna se mönster över flera samtal och ändå hålla löftet om att inte spara kunddata. De har också startat teamet Strategic Futures, som ska titta på hur individer behåller handlingsutrymme när AI flyttar ekonomisk och politisk makt. Om ni sitter på GPT i produktion: räkna med att nästa kapacitetshopp kan komma senare än produktkalendern, och att nollagring och skydd nu förhandlas i samma mening. Det är en dålig vecka att lova styrelsen ett visst datum för en större modell.

Metas Muse Video och DeepSeeks bildmodell

Metas Muse Video är i sluten beta och gör 10 sekunder långa klipp med inbyggt ljud, fin detalj, förståelse för scener och bilder som hänger ihop över tid. Tidiga exempel finns publicerade, men det är inte öppet för vanliga användare än. Reklambyrån och produktteamet kan titta. De kan inte boka leverans.

DeepSeek V4-Flash-Vision-Exp är en experimentell modell som lägger bildförståelse ovanpå text: den kan beskriva bilder, läsa text i skärmdumpar, tolka diagram och hantera flera bildformat. Den kommer nästan upp i samma nivå som Anthropics Opus 4.8 på agentuppgifter, är byggd för att passa olika agentramar, och pratar OpenAI:s Chat Completions och Responses samt Anthropics Messages. För ett svenskt team är Muse intressant för reklam och produktfilm den dagen den öppnas, medan DeepSeek kan bytas in i befintliga API-flöden. Kolla dataskyddet först. Det är en kinesisk leverantör, och skärmdumpar från era system är sällan något ni vill skicka iväg utan avtal.

Ramp Router, Replit och vem som får pengarna

Ramps Router skickar varje anrop till den billigaste modell som klarar kravet, tittar på svarstid och felfrekvens i realtid, och ska kapa AI-kostnaden med i snitt 40 procent. En separat analys säger samma sak med andra ord: mät intelligens per lyckat resultat, och flytta rutinjobb till billigare, lokala eller regelstyrda system när de små modellerna väl klarar just den uppgiften.

Replit har släppt Free Mode där ni kan skapa ungefär 30 gånger mer med OpenAI:s GPT-5.6 Luna utan att bränna krediter på vardagsjobb, med en yta som går från chatt till hela byggen. Core får mer volym, Pro ännu mer. Anthropics billigare Opus 5 gick om Fable 5 i företagens modellspend inom en månad efter lansering, och Opus 5 kostar ungefär hälften av Fable. Billiga öppna modeller tar användare från de dyraste abonnemangen. För ekonomi och IT i Sverige är den stora spaken den här veckan routing och rätt modell till rätt jobb. Ännu ett toppabonnemang löser inte fakturan.

Ramps Router ska kapa AI-kostnaden med i snitt 40 procent.

Ramp

Stripe köper OpenRouter

Stripe har köpt OpenRouter. Motivet som lyfts är säkerhet och kontroll av hur modeller beter sig i praktiken. OpenRouter hanterar över 10 biljoner token per dygn, alltså beteendedata från hur modeller faktiskt används som ingen enskild labb har ensam. Stripe vill sitta som neutral part med både transaktionsdata och den flödesbilden.

Via OpenRouter dyker också Ox Alpha upp, en modell för resonemang, kod, långa agentjobb och produktion, från en leverantör som valt att vara anonym. OpenRouter routar bara. Om ni redan skickar anrop där: ägaren är nu ett betalbolag, och den anonyma kodmodellen är värd ett eget test mot era riktiga uppgifter innan ni släpper in den. Jag gillar att någon samlar hur modellerna faktiskt används. Jag gillar mindre att bytet av ägare kan komma utan att ni omförhandlar avtalet.

OpenRouter hanterar över 10 biljoner token per dygn, alltså beteendedata från hur modeller faktiskt används som ingen enskild labb har ensam.

OpenRouter

Hugging Face känner av 13 miljarder

Hugging Face ska ha jobbat med en bank för att känna av köparintresse på 13 miljarder dollar eller mer, nästan tre gånger värderingen 2023. Prislappen speglar modellhubben, utvecklarna runt den och infrastrukturen. Inget avtal var klart.

Har ni vikter, dataset eller interna ytor där, behandla det som en plattform som kan byta ägare. Ingenting har bytt händer än. Ni bör ändå veta vad som ligger på kontot, under vilket avtal, och vad ni tar hem om villkoren ändras.

Anthropics mötesagent och kodförsvar

Project Parka är en Mac-funktion som fångar systemljud och mikrofon, streamar transkript med vem som sa vad, och gör om mötet till körbart arbete för Claudes agenter. I praktiken ett möte som blir en implementationsprompt. Oklart om Claude sätter igång själv eller väntar på ert ja. Samma varv paketerar de datoranvändning, webbläsare, versionerade skills och återanvändbara filer: ladda upp en rutin en gång, lås version, återanvänd fil-id, färre webläsarrundor. De kallar det allmänt tillgängligt, men äldre dokument märker fortfarande delar som beta, så kolla ert konto.

Claude Mythos 5 finns för kodskanning i Claude Security: ni får patchförslag eller varning i partnerverktyg, men inte själva modellen och ingen chans att be den skriva ett exploit. Anthropic planerade också att låta företagskunder hålla den lagstadgade 30-dagars datalagringen på egen molninfrastruktur. För svenska bolag med möten, kodgranskning och GDPR är det här både en produktivitetsyta och en fråga om vad som spelas in, var loggarna bor, och vad försvarssidan får utan att offensiven får samma modell. Sätt inte på systemljudet i styrelserummet förrän ni vet var transkriptet hamnar.

ChatGPT i Meddelanden, Google i editorn

ChatGPT på Mac kan nu arbeta med trådar från Apples Meddelanden — iMessage, SMS och RCS — på alla planer i desktop-appen för macOS. Ni ger alltså chatten tillgång till privat korrespondens. Var sparsamma med bestående godkännande, särskilt mot kunder och anställda. En tråd med ett offertdatum är sällan något ni vill ha liggande i en chattlogg ni inte styr.

Google har lagt Antigravity i behöriga Gemini Enterprise-abonnemang och släppt tillägg till vanliga kodeditorer, bland annat VS Code och JetBrains, så samma agentarbetsyta följer med. Admin kan sätta sandlåda, verktygsbehörighet, budget, identitet och revisionsspår. För en svensk IT-chef: den ena nyheten är en integritetsfråga i chatten ni redan har, den andra är agenter inne i den editor era utvecklare redan öppnar, med rattar ni kan låsa. Lås rattarna innan någon kopplar in Meddelanden för att spara tid.

Agenterna flyttar in i Slack och editorn

Cursor kan bevaka förslag på kodändringar, titta på en Slack-tråd och köra schemalagda jobb. Agenten prenumererar på en händelse och vaknar när något händer, just nu bara för molnagenter. Underagenter kan köra på egna virtuella maskiner, och ni kan styra dem med meddelanden medan de jobbar utan att avbryta. Slack Code inför kodkanaler där team och agenter bygger tillsammans. Vercel har släppt en Slack-yta för att anropa sin agent från teamchatten, och Warp Factories säljs som en färdig mjukvarufabrik för AI-utveckling.

Grok Bot ingår nu i SuperGrok Plus och i Cursor-planerna Pro+ och Teams. Ni kan ha flera bottar för roller som att leta säljledningar, bygga sajt och hantera inkorgen, och en längre genomgång beskriver hur de blir ett dygnet-runt-system om ni ger dem ägarskap, återanvändbara skills, händelsestyrda rutiner, typade överlämningar, verifieringsregler och godkännandegränser. För team som redan sitter i Slack och editorn slutar agenten att vara ett fönster ni öppnar för hand. Då måste ni veta vem som får säga ja, och vad som får gå ut utan er.

Mistral slutar lita på första träffen

Mistrals Agentic Search ger modellen fem operationer — sök, öppna, navigera, läs och grep — så den kan gå igenom långa dokument, följa referenser och kolla svaret i stället för att nöja sig med första bitarna. I Mistrals egna tester steg andelen rätt på FinanceBench, ett test med finansfrågor, från 26,7 procent till 86 procent, och en annan körning höjde samma modell ytterligare 10,5 procentenheter. Siffrorna är detaljerade men körda av leverantören.

Harvey II låter juridiska agenter starta med kontext, minne och preferenser från tidigare uppdrag. Harvey har också eftertränat en Kimi K3-bas med asynkron belöningsträning i långa, realistiska juridikmiljöer och tränat separata förmågor för företagsgranskning, granskningstabeller och byråkunskap som huvudsystemet kan anropa som verktyg. Alla Harvey-siffror är skrivna av dem själva och uppgiftsspecifika. För den som söker i avtal eller bygger byråstöd i Sverige sitter vinsten i loopen och i arbetsflödet, och ni bör återskapa mätningen på era egna dokument. En leverantörs finanstest är inte ert kundavtal.

Öppna vikters skydd går att plocka bort

En genomgång visar att vägran att svara på farliga frågor i modeller med öppna vikter går att rensa bort på minuter genom att projicera bort den riktning i vikterna som styr nej-svaret. Ingen spärr vid släppet håller över tid. Ett motdrag räknar med att vägran rensas bort och förgiftar utdelningen: de flesta svar på farliga operativa frågor blir då självsäkra och flytande, men med de kritiska detaljerna medvetet fel. Skyddet tar inte inbrott via prompten och gäller bara förstautgåvan.

Vercel kör en tvåveckorsutmaning med upp till 1 miljon dollar till den som tar sig ur deras Firecracker-sandlåda. En forskningsartikel föreslår ett regelsystem som följer en agents behörighet genom hela uppgiften, inte bara vid start — till exempel en återbetalningsagent som får läsa rätt kund, räkna belopp, använda betalverktyget bara under utgiftsgränsen, be en människa om ja och lämna spår. Deras körtid stoppade eller rättade 94,8 procent av regelbrotten och klarade ändå 86,9 procent av de legitima uppgifterna. För svenska bolag som kör öppna vikter eller agenter mot ekonomi och kunddata: räkna inte med modellens inbyggda nej, mät sandlådan, och sätt regler som följer med genom hela jobbet.

Efterträning av agenter och öppna vikter

Miles v0.1 är ett öppet system för att förbättra agenter efter första träningen: många kopior försöker uppgifter i isolerade miljöer, det som funkade poängsätts, resultatet går tillbaka in i träningen, och den uppdaterade modellen skickas ut utan att hela kedjan stoppas. Paketet täcker utkörning, sandlåda, asynkron träning, uppspelning av körningar, modelluppdatering och flera hårdvaror. Agent Lightning v1.0 gör liknande i 3 500 rader kod och höjde Qwen3.5-9B med 14,6 poäng på SWE-bench Verified, ett test mot riktiga Github-buggar, med bara 6 000 träningsexempel.

Liquid AI lät autonoma kodagenter bygga toktoktok, en produktionsklar tränare för hur text ska delas upp, och pekar på tydliga specar, uppgifter över flera områden och extern verifiering som det som får långa agentjobb att hålla. TaoLive eftertränade en 35-miljardersmodell att tolka körsystemet den får just nu, genom att variera namn på färdigheter, verktygsscheman, promptstruktur och krokar, i stället för att memorera ett fast gränssnitt. Thinking Machines släppte i juli Inkling, deras första modell tränad från noll, med vikter på Hugging Face under Apache 2.0. Den tar in bild och ljud utan en separat förtränad kodare. För ett svenskt team som vill förbättra en agent utan att hyra ett labb: de här paketen finns. Mät på era buggar, inte på deras.

Stripe sitter nu på röret som slussar över tio biljoner token per dygn. Cerebras och Nvidia slåss med hallar och kassa. GLM-5.3 kostar samma som 5.2. OpenAI bromsar. Agenterna är i Slack, i editorn och i mötesljudet. Er uppgift den här veckan är tråkigare än modellnamnen: byt version där priset står still, routa rutinjobben, och släpp inte in Meddelanden eller systemljudet förrän ni vet vem som äger loggen.

Mån · Ons · Fre

Polaris i din inkorg —
måndag, onsdag, fredag — för alltid gratis.

Det viktigaste inom AI, filtrerat för svenska företagare. Inget brus. Bara det som faktiskt spelar roll.

Gratis för alltid · avsluta när du vill