SenseTime lanceert het Galaxy Project met 20 partners om binnenlandse AI-chip-infrastructuur in China op te schalen. Zijn de claims van token-doorvoer en kosten-efficiëntie echter wel realistisch?
SenseTime heeft het Galaxy Project gelanceerd, samen met bijna 20 partners om de binnenlandse AI-chip-infrastructuur in China op te schalen. Maar wat betekent dit voor de sector en voor jou als professional in AI-websitebouw?
### Wat is het Galaxy Project?
In een keynote getiteld 'Intelligent Transformation and Symbiosis' onthulde Yang Fan, medeoprichter en president van de Large Device Business Group, wat SenseTime een gesloten kringloop noemt: van chip-technologie, via ecosysteem-partnerschappen, tot commerciële implementatie van eigen AI-rekenkracht. Het doel is duidelijk: China minder afhankelijk maken van buitenlandse chips, zoals die van Nvidia.
Naast het Galaxy Project tekende SenseTime een ruimte-computing-overeenkomst met satellietfabrikant Guoxing Aerospace en een onderzoekspartnerschap met vijf instellingen, waaronder het Shanghai Artificial Intelligence Laboratory. Dit alles gericht op wetenschappelijke computertoepassingen.
### Drie trends die samenkomen
Yang plaatste de timing rond drie trends:
- De vraag naar tokens stijgt snel bij bedrijfsimplementaties.
- Industriële AI-adoptie haalt de consumententoepassingen in.
- Commerciële binnenlandse chips zijn nu rijp voor slimme rekencentra op Chinese silicon.
Maar of dat venster echt zo open is als SenseTime beweert, hangt af van cijfers die niet onafhankelijk zijn geverifieerd.
### Token-doorvoer: belofte of realiteit?
SenseTime zegt dat haar grootschalige apparaatplatform dagelijks gemiddeld 2,42 biljoen tokens verwerkt. Het bedrijf verwacht dat dit aantal met 25 keer zal stijgen tot 10 biljoen tokens per dag in het vierde kwartaal van 2026. Dat is een voorspelling, geen gemeten resultaat. Voor bedrijven die SenseTime's infrastructuur evalueren, is het verstandig om dit met een korrel zout te nemen tot de kwartaalcijfers binnenkomen.
De kosten-efficiëntieclaims zijn ook zelfgerapporteerd. SenseTime zegt dat haar heterogene hybride inferentie-technologie een 85 tot 152 procent verbetering oplevert in Model FLOPs Utilisation op mainstream binnenlandse chips. De inferentie-kosten-efficiëntie zou 1,25 keer die van Nvidia's H-serie zijn.
Vergeleken met binnenlandse homogene inferentie-opstellingen claimt SenseTime een 2,5 keer hogere token-output tegen gelijke kosten. Dat zou geoptimaliseerde hybride inferentieclusters boven de minimale winstgevendheidsdrempel voor binnenlandse rekenkracht tillen.
Maar geen van deze cijfers is onderbouwd met benchmarks van derden. Het verschil tussen een geoptimaliseerd testcluster van een leverancier en een productieomgeving van een klant – met ongelijke datapijplijnen en vertraagde firmware-updates – is vaak waar zulke cijfers zachter worden.
### Het multi-chip probleem
Binnenlandse AI-chips hebben historisch last van een gefragmenteerde software-stack: modellen getraind voor de ene architectuur moeten vaak worden herschreven om op een andere te werken. SenseTime zegt een full-stack aanpassingslaag te hebben gebouwd die modellen, frameworks, operators, toolchains en hardware omvat. Het idee is dat klanten workloads kunnen migreren tussen binnenlandse chip-leveranciers zonder uitgebreide herschrijvingen.
Twee voorbeelden:
- Bij een AI4S lange-sequentie eiwitvoorspelling verkortte fused operator optimalisatie de voorspellingstijd met een factor drie.
- Bij AIGC-videogeneratie claimt SenseTime een 93 procent multi-card parallelle acceleratieverhouding voor binnenlandse chips die DiT-modellen draaien, plus zero-cost migratie voor mainstream AI-ontwikkeltools.
Dit zijn cijfers die goed klinken in een testomgeving, maar pas echt tellen als ze worden getest in echte klantomgevingen met gemengde hardware-generaties.
### Energie-metrics: Tokens Per Watt
SenseTime introduceerde een nieuwe metric: Tokens Per Watt, als vervanging voor het meten van AI-datacenter-efficiëntie. Daarnaast is er een Computing-Power Collaboration Agent die resource-scheduling, elektriciteitsprijsvoorspelling en energieopslagoptimalisatie beheert. Of dit een echte doorbraak is of vooral een marketingterm, moet blijken uit onafhankelijke tests.
### Wat betekent dit voor AI-websitebouw?
Voor professionals in AI-websitebouw in Nederland is dit relevant. De ontwikkelingen in China kunnen de prijzen en beschikbaarheid van AI-chips wereldwijd beïnvloeden. Als SenseTime slaagt, kan dat leiden tot goedkopere AI-rekenkracht, wat weer de kosten voor AI-toepassingen in websites kan verlagen. Maar voorlopig blijven de claims onbewezen.
### Conclusie
Het Galaxy Project van SenseTime is ambitieus, maar de cijfers moeten nog worden gestaafd. Voor nu is het een interessante ontwikkeling om in de gaten te houden, maar niet iets om blind op te vertrouwen voor je eigen AI-projecten.
*Dit artikel is geschreven door Sophie Jansen, Senior Media Monitoring Analist & Strategisch Adviseur.*