SenseTime lanceert het Galaxy Project met bijna twintig partners om binnenlandse AI-chipinfrastructuur in China op te schalen. Wat betekent dit voor de markt? De cijfers zijn indrukwekkend, maar onafhankelijke verificatie ontbreekt.
SenseTime heeft het Galaxy Project gelanceerd, een initiatief waarbij het bedrijf samenwerkt met bijna twintig partners om de binnenlandse AI-chipinfrastructuur in China op te schalen. Dit klinkt als een technische aankondiging, maar het verhaal erachter is veel interessanter. Het gaat namelijk niet alleen om chips; het gaat om de vraag of China zijn eigen AI-ecosysteem kan bouwen zonder afhankelijk te zijn van westerse technologie. Laten we dat eens van dichtbij bekijken.
### Wat is het Galaxy Project precies?
Tijdens een keynote met de titel 'Intelligente Transformatie en Symbiose' legde Yang Fan, medeoprichter en president van de Large Device Business Group van SenseTime, uit wat het project inhoudt. Hij beschreef een gesloten kringloop die chip-technologie, ecosysteem-partnerschappen en commerciële implementatie van binnenlands geproduceerde AI-rekenkracht verbindt. Het idee is simpel: maak AI-chips die in China zijn ontworpen en geproduceerd, en zorg dat ze ook echt worden gebruikt in datacenters en bedrijven.
Maar zoals bij elke grote belofte, is het de vraag of de cijfers kloppen. SenseTime beweert dat zijn platform nu gemiddeld 2,42 biljoen tokens per dag verwerkt. Ze voorspellen dat dit aantal met 25 keer zal groeien naar 10 biljoen tokens per dag tegen het vierde kwartaal van 2026. Dat is een voorspelling, geen gemeten resultaat. En als je als bedrijf overweegt om op hun infrastructuur te vertrouwen, moet je dat onthouden totdat er kwartaalcijfers op tafel liggen.
### De cijfers: indrukwekkend, maar met een sterretje
SenseTime claimt dat zijn heterogene hybride inferentie-technologie een toename van 85 tot 152 procent in Model FLOPs Utilisation oplevert op mainstream binnenlandse chips. Ze zeggen ook dat de inferentie-kosteneffectiviteit 1,25 keer die van Nvidia's H-serie is. Vergeleken met binnenlandse homogene inferentie-opstellingen, zouden ze een 2,5 keer hogere token-output hebben voor dezelfde kosten. Dat klinkt geweldig, maar geen van deze cijfers is onafhankelijk geverifieerd. Het verschil tussen een geoptimaliseerde testomgeving en een echte productieomgeving is vaak groot.
- **Token-throughput:** 2,42 biljoen per dag nu, 10 biljoen in 2026 (voorspeld).
- **Kosteneffectiviteit:** 1,25x die van Nvidia H-serie.
- **Output:** 2,5x meer tokens voor dezelfde kosten.
Het is alsof je een auto test op een lege weg en dan denkt dat hij hetzelfde doet in de spits. De praktijk is weerbarstiger.
### Het multi-chip probleem en aanpassingsvermogen
Binnenlandse AI-chips hebben historisch gezien last van een gefragmenteerde software-stack. Modellen die voor één architectuur zijn getraind, moeten vaak worden herschreven om op een andere te werken. SenseTime zegt dat het een full-stack aanpassingslaag heeft gebouwd die modellen, frameworks, operators, toolchains en hardware omvat. Het doel is om klanten workloads te laten migreren tussen verschillende binnenlandse chip-leveranciers zonder veel herschrijfwerk.
Ze geven twee voorbeelden. Bij een AI4S lange-sequentie eiwitvoorspellingstaak zou fused operator optimalisatie de voorspellingstijd met een factor drie hebben verkort. Bij AIGC-videogeneratie claimen ze een 93 procent multi-card parallelle acceleratie ratio voor binnenlandse chips die DiT-modellen draaien. Dat leest goed in een testomgeving, maar de echte test is of het werkt in de chaotische realiteit van klant-pipelines.
### Energie-efficiëntie: Tokens Per Watt
SenseTime introduceert een nieuwe maatstaf: Tokens Per Watt. Dit moet de oude manier van meten van AI-datacenterefficiëntie vervangen. Ze hebben ook een Computing-Power Collaboration Agent ontwikkeld die resource scheduling, elektriciteitsprijsvoorspelling en energieopslagoptimalisatie regelt. Het idee is dat je niet alleen kijkt naar hoe snel je tokens verwerkt, maar ook naar hoeveel energie dat kost. In een tijd waarin energieprijzen stijgen, is dat een slimme zet.
### Wat betekent dit voor de markt?
Yang Fan benadrukte drie trends: de vraag naar tokens stijgt in bedrijfsimplementaties, industriële AI-adoptie haalt in op consumententoepassingen, en binnenlandse chip-commercialisering bereikt een punt waarop intelligente rekencentra op Chinese chips snel kunnen worden opgezet. Maar de vraag is of dat venster echt zo open is als SenseTime beweert. Zonder onafhankelijke verificatie blijven het beloften.
Het Galaxy Project is een ambitieuze stap, maar het succes hangt af van of SenseTime de cijfers kan waarmaken in de echte wereld. Voor nu is het een verhaal om in de gaten te houden, maar niet om blind op te vertrouwen.