Terug naar Nieuws
ProductAI Understanding-briefing

SCMP meldt dat Zhipu AI GLM-5.3-Flash lanceerde nadat Ox Alpha op 100.000 Chinese chips draaide

De South China Morning Post meldt dat Zhipu AI zijn open-weight GLM-5.3-Flash-model formeel heeft uitgebracht na een stealth-proef op 100.000 in eigen land geproduceerde chips, met een ongewoon hoog gebruik op OpenRouter en OpenCode.

5 min readRead the original reporting
Source-provided image accompanying SCMP reports Zhipu AI launched GLM-5.3-Flash after Ox Alpha ran on 100,000 Chinese chips
Toegeschreven rapportageBron opgenomen
Uitgever
scmp.com
Bronlink
scmp.comhttps://www.scmp.com/tech/big-tech/article/3365433/zhipu-ai-shares-jump-viral-ox-alpha-model-revealed-glm-53-flash-chinese-chips
Brontype
Rapportage door een nieuwskanaal – geen document van eigen hand.
Ook aangehaald

Wat we niet onafhankelijk konden bevestigen: Deze claim wordt toegeschreven aan het genoemde verkooppunt. We hebben het niet geverifieerd aan de hand van een document van de eerste partij. (scmp.com)

Verhaal laatst herzien

ContextBegrijp dit in 60 seconden

Begin hier

Sleuteltermen

Modelkaart
Documentatie die het beoogde gebruik, de meetgegevens, de beperkingen en de risico's van een model beschrijft.
Benchmark
Een gestandaardiseerde test of dataset die wordt gebruikt om de prestaties van modellen te meten en te vergelijken.
Gevolgtrekking
De runtimefase waarin een getraind model voorspellingen of uitvoer genereert.
Test jezelfQuiz over AI-modellen uitgelegd

Wat is er veranderd sinds de publicatie

  1. Voor het eerst gepubliceerd
  2. De South China Morning Post brengt het bestaande Ox Alpha/GLM-5.3-Flash-releaseverhaal aanzienlijk vooruit door een formele lancering te melden, de bewering van Zhipu dat het model op 100.000 in eigen land geproduceerde chips draaide, een gerapporteerd gebruik van 62 biljoen tokens vóór de release, OpenRouter-ranglijst en volumecijfers, en een stijging van meer dan 12 procent in Zhipu AI-aandelen. Deze beweringen worden niet onafhankelijk bevestigd in de aangeleverde bron.

Wat is er gebeurd

De South China Morning Post meldt dat Zhipu AI formeel GLM-5.3-Flash heeft gelanceerd, het model dat voorheen bekend stond onder de codenaam Ox Alpha. Zhipu zei dat het model tijdens een stealth-proef volledig op een cluster van 100.000 in eigen land geproduceerde chips draaide. Volgens het rapport heeft het model 62 biljoen tokens verwerkt voordat het officieel werd vrijgegeven.

De South China Morning Post meldt dat Zhipu AI woensdag de GLM-5.3-Flash als open-weight-model heeft uitgebracht, nadat het systeem onder de naam Ox Alpha in omloop was gebracht. Het artikel presenteert de release als een formele identificatie van een model dat aanzienlijke aandacht had getrokken op externe AI-platforms. Het rapport bevat geen link naar een modelkaart, repository, technisch rapport of ander primair document, dus de precieze releasevoorwaarden en modelconfiguratie worden hier niet onafhankelijk bevestigd.

Volgens de South China Morning Post zei Zhipu dat het systeem volledig draaide op een cluster van 100.000 in eigen land geproduceerde chips tijdens een spraakmakende stealth-proef. Het rapport identificeert niet de chipmaker, het chipmodel, de interconnectietechnologie, de locaties van datacenters, de stroomvereisten, en ook niet of alle 100.000 chips tegelijkertijd actief waren. Er wordt ook niet uitgelegd hoe de werklast werd verdeeld en of de proef training, gevolgtrekking of beide omvatte; de omringende context van het artikel geeft aan dat de relevante test grootschalige gevolgtrekking en gebruik betrof.

De South China Morning Post zegt dat het model vóór de formele release 62 biljoen tokens via OpenRouter en OpenCode heeft verwerkt. Op OpenRouter rapporteert het artikel meer dan 11 biljoen tokens in de eerste drie dagen, wat het beschrijft als de grootste lancering van het platform tot nu toe. Het rapport citeert verder gegevens van OpenRouter waaruit blijkt dat het model donderdag op de eerste plaats stond onder de codeersystemen, waarbij 10,3 biljoen tokens bijna 31 procent van het wekelijkse volume van het platform voor hun rekening namen. De bron geeft geen uitleg over de telmethode van OpenRouter, maakt geen onderscheid tussen gebruikersverkeer en geautomatiseerde workloads en geeft geen vergelijkingsperiode.

Het artikel meldt ook dat de Zhipu AI-aandelen donderdag in Hong Kong ruim 12 procent hoger sloten op HK$1.160. Die marktbeweging is een gerapporteerde reactie en geen bewijs op zichzelf van de kwaliteit van het model of de commerciële duurzaamheid. De bron stelt niet vast of de koerswijziging uitsluitend werd veroorzaakt door de modelrelease of werd beïnvloed door andere marktfactoren. Er is geen onafhankelijke verklaring van Zhipu, OpenRouter, OpenCode, chipleveranciers of financiële toezichthouders opgenomen naast de beweringen die door de krant worden aangehaald.

Brongegevens: scmp.com ↗

Waarom het ertoe doet

De gerapporteerde implementatie is significant omdat het een grootschalige AI-inferentiewerklast koppelt aan in China gemaakte chips in plaats van te vertrouwen op Nvidia-hardware. Als het onafhankelijk wordt bevestigd, zou het een concreet voorbeeld zijn van een Chinees AI-bedrijf dat een veelgebruikt model hanteert te midden van Amerikaanse exportcontroles en de inspanningen van Peking om de afhankelijkheid van geavanceerde Amerikaanse processors te verminderen.

De gerapporteerde inzet van de chip is van belang omdat geavanceerde AI-inferentie over het algemeen afhankelijk is geweest van de toegang tot krachtige versnellers en grootschalige datacentersystemen. De South China Morning Post beschouwt de proef van Zhipu als een test of China het gebruik van modellen op mondiale schaal op binnenlandse hardware aankan. Als het verslag klopt, suggereert dit dat exportcontroles Chinese bedrijven er wellicht niet van zullen weerhouden betekenisvolle gevolgtrekkingscapaciteiten op te bouwen, ook al blijven beperkingen de toegang tot de meest geavanceerde buitenlandse verwerkers beperken.

Het verhaal verbindt ook de adoptie van modellen met hardwarebeleid. Beijing heeft geprobeerd de afhankelijkheid van Nvidia te verminderen, en de South China Morning Post presenteert de GLM-5.3-Flash-proef als een voorbeeld van software en infrastructuur die samen worden ontwikkeld. Dat onderscheid is belangrijk: uit het rapport blijkt niet dat Chinese chips overeenkomen met de prestaties, efficiëntie of beschikbaarheid van Nvidia in het algemeen. Het beschrijft de gerapporteerde implementatie van één bedrijf en biedt niet de technische metingen die nodig zijn om systemen eerlijk te vergelijken.

De gebruikscijfers kunnen van belang zijn voor ontwikkelaars en bedrijven, omdat open-weight-modellen kunnen worden gedownload, aangepast of gehost door andere partijen dan de oorspronkelijke ontwikkelaar, afhankelijk van de licentie- en releasevoorwaarden. De bron vermeldt echter niet de licentie, identificeert het aantal parameters van het model, beschrijft de hardwarevereisten niet, of bevestigt niet dat het gerapporteerde verkeer betaalde klanten of productief werk vertegenwoordigde. Een hoog tokenvolume kan duiden op interesse en experimenten, maar is geen vervanging voor onafhankelijke evaluaties van nauwkeurigheid, betrouwbaarheid, veiligheid of kosten.

De marktimpact van het rapport is ook opmerkelijk, maar beperkt. Een stijging van ruim 12 procent in de aandelen van Zhipu AI geeft aan dat beleggers de aankondiging als gevolgvol hebben beschouwd, aldus de South China Morning Post. Er wordt niet aangetoond dat het model vergelijkbare inkomsten zal genereren, concurrerende systemen zal verdringen of winstgevend zal functioneren. Deze uitkomsten blijven onbekend uit de beschikbare bron.

Interactive Mechanism

Interactief mechanisme: hoe het eigenlijk werkt

Ontdek interactief de onderliggende technologie achter deze ontwikkeling.

Model Parameter Size:8B Parameters
VRAM Required5.5 GBGPU memory footprint
Target HardwareMacBook / Single GPUDeployment tier
Privacy100% Air-GappedLocal device capability
Core takeaway: Small, quantized models (3B–8B) now run directly inside smartphones and laptops with complete data privacy, while mammoth 400B+ models remain the domain of datacenter clusters.
Interactieve conceptcheck+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Wat je nu moet bekijken

De belangrijkste vragen zijn of de gerapporteerde chipinzet- en gebruikscijfers van Zhipu onafhankelijk kunnen worden geverifieerd, hoe GLM-5.3-Flash presteert ten opzichte van concurrerende codeermodellen, en of het model na de formele release op vergelijkbare schaal beschikbaar blijft. De bron biedt geen technische benchmarks, chipspecificaties, prijzen of bewijs van duurzame productie.

Ten eerste is onafhankelijke technische bevestiging nodig. De bron levert geen bewijs van chipfabrikanten, cloudoperators, OpenRouter, OpenCode of een externe auditor die de bewering bevestigt dat GLM-5.3-Flash op 100.000 Chinese chips draaide. Nuttige vervolgrapportage zou de chips identificeren, de clusterarchitectuur beschrijven en de piekdemonstratiecapaciteit scheiden van de duurzame productiecapaciteit.

Ten tweede moeten waarnemers op zoek gaan naar transparant vrijgavemateriaal. Een modelkaart of technisch rapport zou de mogelijkheden van het model, de trainings- en gevolgtrekkingsmethoden, de licentie, veiligheidsbeperkingen, contextlimieten en beoogde gebruikers kunnen verduidelijken. De South China Morning Post rapporteert geen benchmarkresultaten of gecontroleerde vergelijkingen met andere coderingssystemen, dus de positie van het model in de gebruiksrangschikking van OpenRouter mag niet worden behandeld als een prestatierangschikking.

Ten derde vereisen de gerapporteerde tokentotalen een zorgvuldige interpretatie. De cijfers van OpenRouter meten mogelijk platformverkeer in plaats van unieke gebruikers, betaald gebruik of succesvolle taken, en de bron legt niet uit hoe OpenCode-verkeer zich verhoudt tot de totalen van OpenRouter. Uit vervolgverslaggeving moet blijken of de cijfers betrekking hebben op dezelfde modelversie, of ze na de release nog steeds voortduren, en of de aandacht voor ongebruikelijke lanceringen de vraag op de korte termijn heeft doen toenemen.

Ten slotte blijft de bredere hardwarevraag open. Het verhaal biedt een gerapporteerd voorbeeld van de inzet van binnenlandse chips, maar het bewijst niet dat China buitenlandse accelerators voor alle AI-workloads kan vervangen. Toekomstig bewijsmateriaal zou zich moeten richten op het energieverbruik, de doorvoer, softwarecompatibiliteit, aanbodbeperkingen en de totale bedrijfskosten. Deze factoren zullen bepalen of de gerapporteerde proef een herhaalbaar commercieel patroon wordt in plaats van een spraakmakende demonstratie.

Gerelateerde gidsen en quizzen

AI-modellen uitgelegdChatGPT & LLM'sAI-trainingToekomst van AITest wat je weet: probeer een gratis AI-quizZoek een AI-term op in onze woordenlijstVolg de AI-modelreleasetracker

Updates en correcties

Dit canonieke verhaal wordt op zijn plaats bijgewerkt wanneer de zich ontwikkelende gebeurtenis wezenlijk verandert. De URL en de oorspronkelijke publicatiedatum veranderen nooit.

  • De South China Morning Post brengt het bestaande Ox Alpha/GLM-5.3-Flash-releaseverhaal aanzienlijk vooruit door een formele lancering te melden, de bewering van Zhipu dat het model op 100.000 in eigen land geproduceerde chips draaide, een gerapporteerd gebruik van 62 biljoen tokens vóór de release, OpenRouter-ranglijst en volumecijfers, en een stijging van meer dan 12 procent in Zhipu AI-aandelen. Deze beweringen worden niet onafhankelijk bevestigd in de aangeleverde bron.
Zie het openbare correctielogboek
Vond je dit nuttig?