Stripe neemt OpenRouter over, een AI-modelrouteringsplatform dat ontwikkelaars via één interface toegang geeft tot honderden modellen. Deze deal voegt slimme modelselectie en routing toe aan Stripe's bestaande AI-ecosysteem.
Het is officieel: Stripe heeft de overname van OpenRouter aangekondigd. Dit is niet zomaar een bedrijfsovername, het is een strategische stap die de manier waarop we met AI-modellen werken op z'n kop kan zetten. Voor jou als ontwikkelaar betekent dit dat toegang tot honderden modellen straks nog eenvoudiger wordt, allemaal via één enkele interface. Stripe breidt hiermee haar bestaande werk op het gebied van AI-gebruik en token-based billing uit met slimme modelselectie en routing.
OpenRouter ondersteunt volgens Stripe meer dan 400 modellen van meer dan 80 verschillende aanbieders. Je kunt je voorstellen wat dat betekent: in plaats van tientallen losse integraties te moeten bouwen en onderhouden, stuur je al je verzoeken via één API. Dat scheelt niet alleen een hoop tijd, maar ook veel kopzorgen.
### Routing gaat verder dan alleen modelkeuze
Het platform doet meer dan alleen maar een model kiezen. Het evalueert elk verzoek op basis van factoren zoals complexiteit, prijs, snelheid en betrouwbaarheid. Op basis daarvan stuurt het je vraag naar het model dat het beste bij jouw specifieke eisen past. Dat is alsof je een persoonlijke butler hebt die precies weet welk gereedschap je nodig hebt voor welke klus.
Maar het gaat nog een stap verder. OpenRouter regelt ook een tweede routinglaag tussen verschillende aanbieders die hetzelfde model leveren. In de documentatie staat dat je endpoints kunt prioriteren op basis van prijs, doorvoer of latentie, terwijl je ook eisen kunt stellen zoals maximumprijzen of minimale prestatieniveaus.
- Het platform meet latentie en doorvoer voor individuele model-provider combinaties met behulp van actuele prestatiegegevens.
- Hierdoor kan een verzoek worden doorgestuurd naar een endpoint dat voldoet aan specifieke kosten- of prestatiecriteria.
- Dit scheidt twee belangrijke beslissingen: welk model het verzoek afhandelt en welke provider het uiteindelijk levert.
De keuze voor een provider kan de kosten voor inference behoorlijk beïnvloeden, zelfs als het onderliggende model hetzelfde blijft. In een voorbeeld uit juni 2026 noteerde OpenRouter de prijzen voor Llama 3.3 70B input tokens op €0,09 per miljoen via DeepInfra en €0,95 via Together. De outputprijzen varieerden van €0,29 tot €0,95 per miljoen tokens tussen de getoonde providers. Dat zijn verschillen waar je niet zomaar aan voorbij kunt gaan.
### Waarom deze routing zo belangrijk is
Routing biedt ook een cruciale failover-functie. Als een endpoint onbereikbaar wordt, kan het systeem van OpenRouter verzoeken verplaatsen naar alternatieve providers of modellen. Het handelt problemen af zoals providerstoringen, rate limits, context-length errors of moderatieweigeringen. Dat geeft je een stuk meer gemoedsrust.
Ook gegevensverwerkingseisen spelen een rol. OpenRouter stelt gebruikers in staat om verzoeken te beperken tot Zero Data Retention endpoints en te voorkomen dat er wordt doorgestuurd naar providers die data verzamelen of trainen op prompts. Enterprise klanten kunnen zelfs verzoeken om verwerking binnen de regio, bijvoorbeeld in de VS of de EU. De routingcriteria kunnen dus modelcapaciteit, providerbeschikbaarheid, verwerkingslocatie, latentie, doorvoer en kosten omvatten.
### De opkomst van multi-model infrastructuur
Omgevingen met meerdere modellen zijn al heel gewoon. Het State of Application Strategy rapport van F5 uit 2026, gebaseerd op antwoorden van meer dan 1.100 IT-beslissers, toonde aan dat 52% van de organisaties meerdere AI-modellen aan elkaar koppelde of orkestreerde. Respondenten gebruikten gemiddeld zeven modellen.
Menlo Ventures, een investeerder in OpenRouter, rapporteerde een ander perspectief in haar mid-year onderzoek van 2025. Daaruit bleek dat 66% van de bouwers modellen upgradete terwijl ze bij hun bestaande provider bleven, terwijl 11% van leverancier wisselde.
OpenRouter is niet de enige speler die model routing toevoegt. Snowflake kondigde op 18 augustus dynamische model routing aan voor Cortex AI Gateway, een functie die naar verwachting in private preview gaat. Cloudflare biedt Dynamic Routing in bèta via AI Gateway, met regels voor modelselectie, quota en fallbacks. AWS levert Intelligent Prompt Routing via Bedrock en Microsoft Foundry biedt routingprofielen die modelkwaliteit en prijs in balans brengen.
> Deze ontwikkeling laat zien dat de markt volwassener wordt. Het gaat niet meer alleen om toegang tot de nieuwste modellen, maar om slimme, efficiënte en kosteneffectieve inzet ervan.
Zowel AWS als Snowflake beschrijven systemen die minder veeleisende workloads kunnen doorsturen naar kleinere of goedkopere modellen, terwijl ze andere modellen reserveren voor taken die hogere responskwaliteit of complexere redenering vereisen. Dat is een efficiënte manier van werken.
### De operationele kant van routing
Met al deze nieuwe mogelijkheden komen ook nieuwe operationele vereisten. Het Azure Architecture Center van Microsoft merkt op dat dynamische modelselectie de kostenprognoses, debugging en prestatiebewaking kan compliceren. Het is belangrijk om hier goed over na te denken voordat je een dergelijk systeem implementeert.
Kortom, de overname van OpenRouter door Stripe is een belangrijke ontwikkeling in de wereld van AI-infrastructuur. Het maakt het voor ontwikkelaars eenvoudiger en slimmer om de kracht van verschillende AI-modellen te benutten, zonder verstrikt te raken in een web van complexe integraties en wisselende kosten. Het is een stap naar een meer geïntegreerde en intelligente toekomst voor AI-ontwikkeling.