Ramp bygger AI-router som skickar varje anrop till billigaste modellen
- En router är en switch mellan modeller, inte en modell
- Modellerna byts ut snabbare än de kan testas
- Fintech bygger AI-infrastruktur för att det liknar det de redan gör
- OpenRouter är redan här och har fler modeller
- FAQ
- Kan jag använda Router från Sverige?
- Behöver jag skriva om min kod för att använda en modellrouter?
- Varför skulle en billigare modell ge samma resultat?
- Vad är risken med att lägga en tredje part mellan appen och modellen?
Utgiftsplattformen Ramp släppte den 20 augusti 2026 en tjänst kallad Router, som tar emot ett API-anrop och själv väljer vilken språkmodell som ska svara. Kunder som testat den under uppbyggnaden har enligt Ramp sänkt sina inferenskostnader med i genomsnitt 40 procent. Tjänsten är gratis att routa genom till slutet av 2026, du betalar bara listpris för de tokens du använder och den är än så länge bara tillgänglig i USA.
Intressantare än produkten är vem som byggde den. Ramp är ett fintechbolag som hanterar över 200 miljarder dollar i årliga företagsinköp. Att ett sådant bolag lägger tre år på att bygga routningsinfrastruktur för språkmodeller säger något om var värdet i AI-kedjan hamnar just nu.
En router är en switch mellan modeller, inte en modell
Grundprincipen är enkel att förstå. I stället för att din kod pekar direkt på OpenAI eller Anthropic pekar den på en mellanliggande tjänst. Den tjänsten tar emot anropet, tittar på vad du bett om och skickar det vidare till den modell som gör jobbet billigast eller snabbast. Svaret kommer tillbaka i samma format som du är van vid, eftersom API:et är kompatibelt med både OpenAI och Anthropic. Du behöver inte skriva om något.
Ramp har byggt in fyra sätt att välja mottagare. Flex tier skickar till samma modell men i en billigare kö, alltså samma kvalitet till lägre pris om du kan vänta något. Shadow models låter dig köra en kandidatmodell parallellt med produktionstrafiken utan att användarna påverkas, vilket ger dig riktiga jämförelsedata i stället för magkänsla. Benchmarks låter dig definiera upp till tre egna mätpunkter och dirigera efter dem. Och via Nvidias Switchyard går den dyra modellen bara in när uppgiften faktiskt kräver den.
I dashboarden kan du se varför ett enskilt anrop kostade det det kostade.
Modellerna byts ut snabbare än de kan testas
Varje gång en ny modellversion släpps måste ett utvecklingsteam i praktiken göra om samma arbete: spela upp sina prompter, jämföra svarskvalitet, mäta latens, räkna på kostnaden per token och sedan bestämma om det är värt att byta. Med den takt modellerna släpps i nu hinner ingen med. Många team kör därför vidare på en modell de valde för nio månader sedan, ofta en dyrare än de behöver.
En router flyttar det beslutet från kodbasen till en konfiguration. Det är samma idé som ligger bakom abstraktionslager i övrigt, du bygger mot ett gränssnitt i stället för mot en leverantör och byter innehållet bakom gränssnittet när något bättre kommer.
Ramp hävdar att de själva sänkte sina inferenskostnader med runt 30 procent på det här sättet, med bibehållen tillförlitlighet över 99,9 procent i produktion.
Router hanterar över 2,75 biljoner tokens per månad i produktion.
Den siffran är det egentliga argumentet. Det är inte en pilot, det är en volym som redan sliter på infrastrukturen.
Fintech bygger AI-infrastruktur för att det liknar det de redan gör
Det verkar krokigt att ett utgiftskort-bolag bygger modellrouting. Sedan tittar man på vad routing egentligen är, ta emot en transaktion, avgöra vart den ska, prissätta den, logga den och visa kunden efteråt varför den kostade vad den kostade. Det är betalningsinfrastruktur, bara med tokens i stället för kronor.
Ramp har enligt sitt eget AI-index sett kundernas AI-utgifter växa 20,7 gånger sedan juni 2025. Om du sitter på den datan ser du en ny utgiftspost växa fram i realtid och du ser att ingen har byggt kostnadskontrollen för den. Det är precis samma lucka som fintechbolag fyllde för resekostnader och prenumerationer.
Positioneringen är öppet uttalad. Ramp siktar på att bli tullhus för AI-inferens, en roll där Stripe rör sig i samma riktning. Vem som tar den positionen avgör vem som får se hela flödet av vad företag betalar för AI och den insynen är i sig värd mer än marginalen på routningen.
OpenRouter är redan här och har fler modeller
Router är inte först. OpenRouter gör i huvudsak samma sak och har i dag ett bredare utbud av modeller. Ramp startar med åtta leverantörer, bland dem OpenAI, Anthropic, DeepSeek, Moonshot, Minimax, Nvidia, xAI och Z.ai och uppger att antalet modeller ligger runt 27 och växer.
Så varför skulle någon byta? Antagligen inte för modellutbudet, utan för att kostnadsrapporteringen sitter i samma system som resten av företagets utgifter. Ett svenskt bolag som redan har sin kortadministration någonstans kommer sannolikt att välja routern som talar med den plattformen, inte den med längst modellista.
Lockelsen i prissättningen är tydlig och kortsiktig: gratis routning till slutet av 2026, plus 26 dollar i startkrediter. Vad som händer 2027 har Ramp inte sagt. Det är värt att väga in innan du bygger in ett beroende, för det är exakt det mönstret som gör att system hamnar på lånad tid.
FAQ
Kan jag använda Router från Sverige?
Nej. Tjänsten är i skrivande stund bara tillgänglig i USA. Vill du testa samma princip finns OpenRouter och liknande alternativ som inte har den geografiska begränsningen.
Behöver jag skriva om min kod för att använda en modellrouter?
Oftast inte. Routers av den här typen exponerar ett API som är kompatibelt med OpenAI eller Anthropic, vilket innebär att du byter basadress och API-nyckel men behåller anropen som de är. Det är hela poängen med ett abstraktionslager: bytet ska kosta en konfigurationsrad, inte en refaktorisering.
Varför skulle en billigare modell ge samma resultat?
Många anrop i en produktionsapp är enkla. Klassificera en text, extrahera ett fält, formatera om ett svar. Sådant klarar mindre modeller lika bra som de största, till en bråkdel av priset. Vinsten kommer av att inte skicka triviala uppgifter till den dyraste modellen bara för att den råkar vara standard i koden.
Vad är risken med att lägga en tredje part mellan appen och modellen?
Du får ett extra hopp som kan gå ner och du lämnar dina prompter till ytterligare en aktör. Dessutom binder du dig till någons prissättning som du inte kontrollerar, vilket i Ramps fall är oklar efter 2026. Bygg gärna så att du kan peka om till en leverantör direkt om routern försvinner.
Källor
- Router router.com
