Tillbaka till Nyheter
ProduktAI Understanding genomgång

SCMP rapporterar att Zhipu AI lanserade GLM-5.3-Flash efter att Ox Alpha körde på 100 000 kinesiska marker

South China Morning Post rapporterar att Zhipu AI formellt släppte sin GLM-5.3-Flash-modell med öppen vikt efter en smygtest på 100 000 inhemskt producerade chips, med ovanligt hög användning på OpenRouter och OpenCode.

5 min readRead the original reporting
Source-provided image accompanying SCMP reports Zhipu AI launched GLM-5.3-Flash after Ox Alpha ran on 100,000 Chinese chips
Tillskriven rapporteringKälla inspelad
Förläggare
scmp.com
Källlänk
scmp.comhttps://www.scmp.com/tech/big-tech/article/3365433/zhipu-ai-shares-jump-viral-ox-alpha-model-revealed-glm-53-flash-chinese-chips
Källtyp
Rapportering från ett nyhetsställe – inte ett förstapartsdokument.
Också citerad

Vad vi inte kunde bekräfta oberoende: Detta påstående hänförs till det namngivna försäljningsstället. Vi har inte verifierat det mot ett förstapartsdokument. (scmp.com)

Berättelsen senast reviderad

SammanhangFörstå detta på 60 sekunder

Börja här

Nyckeltermer

Modellkort
Dokumentation som beskriver en modells avsedda användning, mått, begränsningar och risker.
Referenspunkt
Ett standardiserat test eller datauppsättning som används för att mäta och jämföra modellprestanda.
Slutledning
Körtidsfasen där en tränad modell genererar förutsägelser eller utdata.
Testa dig självAI Models Explained Quiz

Vad har förändrats sedan publiceringen

  1. Först publicerad
  2. South China Morning Post utvecklar väsentligt den befintliga Ox Alpha/GLM-5.3-Flash-releasehistorien genom att rapportera en formell lansering, Zhipu:s påstående att modellen körde på 100 000 inhemskt producerade chips, rapporterade användningen av 62 biljoner tokens före lanseringen, OpenRouter-ranking och 12 volym-percent-och fler volym-percent. Zhipu AI-aktier. Dessa påståenden är inte oberoende bekräftade i den medföljande källan.

Vad hände

South China Morning Post rapporterar att Zhipu AI formellt lanserade GLM-5.3-Flash, modellen som tidigare känd under kodnamnet Ox Alpha. Zhipu sa att modellen körde helt och hållet på ett kluster av 100 000 inhemskt producerade marker under en stealth-test. Rapporten säger att modellen bearbetade 62 biljoner tokens innan den formella släpptes.

South China Morning Post rapporterar att Zhipu AI släppte GLM-5.3-Flash som en modell med öppen vikt på onsdagen, efter att systemet hade cirkulerat under namnet Ox Alpha. Artikeln presenterar releasen som en formell identifiering av en modell som hade väckt stor uppmärksamhet på externa AI-plattformar. Rapporten innehåller inte en länk till ett modellkort, arkiv, teknisk rapport eller annat primärt dokument, så de exakta utgivningsvillkoren och modellkonfigurationen bekräftas inte oberoende här.

Enligt South China Morning Post sa Zhipu att systemet körde helt på ett kluster av 100 000 inhemskt producerade marker under en högprofilerad stealth-test. Rapporten identifierar inte chiptillverkaren, chipmodellen, sammankopplingstekniken, datacenterplatserna, strömkraven eller om alla 100 000 chips var aktiva samtidigt. Det förklarar inte heller hur arbetsbelastningen fördelades eller om försöket innebar träning, slutledning eller båda; Artikelns omgivande sammanhang indikerar att det relevanta testet gällde storskalig slutledning och användning.

South China Morning Post säger att modellen bearbetade 62 biljoner tokens över OpenRouter och OpenCode innan den formella släpptes. På OpenRouter rapporterar artikeln mer än 11 ​​biljoner tokens under de första tre dagarna, vilket den beskriver som plattformens största lansering hittills. Rapporten citerar vidare OpenRouter-data som visar att modellen rankades först bland kodsystem på torsdagen, med 10,3 biljoner tokens som står för nästan 31 procent av plattformens veckovolym. Källan förklarar inte OpenRouters räknemetod, särskiljer inte användartrafik från automatiserade arbetsbelastningar eller tillhandahåller en jämförelseperiod.

Artikeln rapporterar också att Zhipu AI-aktier stängde mer än 12 procent högre på HK$1 160 i Hong Kong på torsdagen. Denna marknadsrörelse är en rapporterad reaktion, inte ett bevis i sig på modellkvalitet eller kommersiell hållbarhet. Källan fastställer inte om aktiekursförändringen enbart orsakades av modellsläppet eller påverkades av andra marknadsfaktorer. Inget oberoende uttalande från Zhipu, OpenRouter, OpenCode, chipleverantörer eller finansiella tillsynsmyndigheter ingår förutom de påståenden som tidningen citerar.

Källinformation: scmp.com ↗

Varför det spelar roll

Den rapporterade implementeringen är betydande eftersom den kopplar en storskalig AI-inferensarbetsbelastning till kinesisktillverkade chips snarare än att förlita sig på Nvidia-hårdvara. Om det bekräftas oberoende av varandra, skulle det ge ett konkret exempel på ett kinesiskt AI-företag som driver en flitigt använd modell bland USA:s exportkontroller och Pekings ansträngningar att minska beroendet av avancerade amerikanska processorer.

Den rapporterade chipplaceringen spelar roll eftersom avancerad AI-inferens i allmänhet har varit beroende av tillgång till högpresterande acceleratorer och storskaliga datacentersystem. South China Morning Post ramar in Zhipu:s rättegång som ett test av om Kina kan hantera global modellanvändning på inhemsk hårdvara. Om kontot är korrekt, tyder det på att exportkontroller kanske inte hindrar kinesiska företag från att bygga upp meningsfull slutledningskapacitet, även om restriktioner fortsätter att begränsa tillgången till de mest avancerade utländska processorerna.

Berättelsen kopplar också modellantagande med hårdvarupolicy. Peking har försökt minska beroendet av Nvidia, och South China Morning Post presenterar testversionen av GLM-5.3-Flash som ett exempel på mjukvara och infrastruktur som utvecklas tillsammans. Den skillnaden är viktig: rapporten visar inte att kinesiska marker matchar Nvidia:s prestanda, effektivitet eller tillgänglighet i allmänhet. Den beskriver ett företags rapporterade driftsättning och ger inte de tekniska mått som behövs för att jämföra system rättvist.

Användningssiffrorna kan ha betydelse för utvecklare och företag eftersom modeller med öppen vikt kan laddas ner, anpassas eller vara värd för andra parter än den ursprungliga utvecklaren, beroende på licens- och releasevillkor. Källan anger dock inte licensen, identifierar inte modellens parameterantal, beskriver dess hårdvarukrav eller bekräftar att den rapporterade trafiken representerade betalda kunder eller produktivt arbete. Hög tokenvolym kan indikera intresse och experiment, men det är inte en ersättning för oberoende utvärderingar av noggrannhet, tillförlitlighet, säkerhet eller kostnad.

Rapportens marknadspåverkan är också anmärkningsvärd men begränsad. En uppgång på mer än 12 procent i Zhipu AI:s aktier indikerar att investerare behandlade tillkännagivandet som följdriktigt, enligt South China Morning Post. Den slår inte fast att modellen kommer att generera jämförbara intäkter, tränga undan konkurrerande system eller fungera lönsamt. Dessa resultat förblir okända från den tillgängliga källan.

Interactive Mechanism

Interaktiv mekanism: hur det faktiskt fungerar

Utforska den underliggande tekniken bakom denna utveckling interaktivt.

Model Parameter Size:8B Parameters
VRAM Required5.5 GBGPU memory footprint
Target HardwareMacBook / Single GPUDeployment tier
Privacy100% Air-GappedLocal device capability
Core takeaway: Small, quantized models (3B–8B) now run directly inside smartphones and laptops with complete data privacy, while mammoth 400B+ models remain the domain of datacenter clusters.
Interaktiv konceptkontroll+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Vad du ska titta på härnäst

Nyckelfrågorna är om Zhipu:s rapporterade chipdistribuering och användningssiffror kan verifieras oberoende, hur GLM-5.3-Flash presterar mot konkurrerande kodningsmodeller och om modellen förblir tillgänglig i jämförbar skala efter den formella lanseringen. Källan tillhandahåller inte tekniska riktmärken, chipspecifikationer, prissättning eller bevis på ihållande produktionsdrift.

Först behövs en oberoende teknisk bekräftelse. Källan tillhandahåller inga bevis från chiptillverkare, molnoperatörer, OpenRouter, OpenCode eller en extern revisor som bekräftar påståendet att GLM-5.3-Flash körde på 100 000 kinesiska marker. Användbar uppföljningsrapportering skulle identifiera chipsen, beskriva klusterarkitekturen och separera toppdemonstrationskapacitet från ihållande produktionskapacitet.

För det andra bör observatörer leta efter transparenta släppmaterial. Ett modellkort eller teknisk rapport kan klargöra modellens kapacitet, utbildning och slutledningsmetoder, licens, säkerhetsbegränsningar, sammanhangsbegränsningar och avsedda användare. South China Morning Post rapporterar inte benchmarkresultat eller kontrollerade jämförelser med andra kodningssystem, så modellens position i OpenRouters användningsrankning bör inte behandlas som en prestandarankning.

För det tredje kräver de rapporterade tokensummorna noggrann tolkning. OpenRouters siffror kan mäta plattformstrafik snarare än unika användare, betald användning eller framgångsrika uppgifter, och källan förklarar inte hur OpenCode-trafik förhåller sig till OpenRouters totalsummor. Uppföljning bör fastställa om siffrorna hänvisar till samma modellversion, om de fortsatte efter lanseringen och om ovanlig lanseringsuppmärksamhet ökade efterfrågan på kort sikt.

Slutligen förblir den bredare hårdvarufrågan öppen. Berättelsen erbjuder ett rapporterat exempel på inhemskt chip-distribution, men det fastställer inte att Kina kan ersätta utländska acceleratorer över alla AI-arbetsbelastningar. Framtida bevis bör ta upp energianvändning, genomströmning, programvarukompatibilitet, leveransbegränsningar och totala driftskostnader. Dessa faktorer kommer att avgöra om den rapporterade prövningen blir ett repeterbart kommersiellt mönster snarare än en högprofilerad demonstration.

Relaterade guider och frågesporter

AI-modeller förklarasChatGPT och LLM:erAI utbildningAI:s framtidTesta vad du vet – prova ett gratis AI-quizSlå upp en AI-term i vår ordlistaFölj AI-modellens release tracker

Uppdateringar och korrigeringar

Denna kanoniska berättelse uppdateras på plats när händelsen som utvecklas väsentligt förändras. Dess URL och ursprungliga publiceringsdatum ändras aldrig.

  • South China Morning Post utvecklar väsentligt den befintliga Ox Alpha/GLM-5.3-Flash-releasehistorien genom att rapportera en formell lansering, Zhipu:s påstående att modellen körde på 100 000 inhemskt producerade chips, rapporterade användningen av 62 biljoner tokens före lanseringen, OpenRouter-ranking och 12 volym-percent-och fler volym-percent. Zhipu AI-aktier. Dessa påståenden är inte oberoende bekräftade i den medföljande källan.
Se den offentliga korrigeringsloggen
Hittade du detta användbart?