Mi történt
A Notebookcheck jelentése szerint a Xiaomi az augusztus 24-i Xring chiptechnológiai konferencián bemutatta az AI Cube mérnöki prototípust. A kompakt rendszer három, cég által tervezett chipet egyesít: az Xring O3, O100 és D100. A Notebookcheck szerint a Xiaomi azt állítja, hogy a rendszert helyi mesterséges intelligencia modellek telepítésére szánják, és 120B és 3B modelleket is futtathat.
A Notebookcheck jelentése szerint a Xiaomi az AI Cube-ot mérnöki prototípusként mutatta be, nem pedig kész kiskereskedelmi termékként. A jelentés szerint az eszközt a Xiaomi Xring chiptechnológiai konferenciáján mutatták be augusztus 24-én, és az AI modellek helyi futtatására készült. A cikk Xring O3, O100 és D100 néven azonosítja a három chipet, és azt állítja, hogy a rendszer akár 150 watt folyamatos teljesítményt is képes leadni. Ez az ábra teljesítmény-burkológörbét ír le, nem pedig önállóan mért sebesség- vagy minőségi eredményt.
A Notebookcheck Lei Jun Weibo-fiókját és az IT Home-ot idézi beszerzésében. A mellékelt forrás nem tartalmaz nyilvános Xiaomi termékoldalt, független jelentést vagy a rendszer független ellenőrzött tesztjét. A Notebookcheck leírja, hogy a chipeknek külön szerepük van. A jelentés szerint az Xring O3 a fő processzor, 10 magos CPU-val, 16 magos G2-Ultra NX GPU-val és 200 TOPS NPU-val. Azt állítja, hogy az O100-at nagy sávszélességű mesterséges intelligencia munkaterhelésre szánják, és 6 nm-es 3D szelet-szintű halmozott csomagolást használ, a Xiaomi pedig 28 672 effektív adatvonalat és akár 1,22 TB/s-ig közeli memória számítási sávszélességet állít fel. A leírások szerint a D100 nagy teljesítményű mesterséges intelligencia és intelligens vezetési munkaterhelést céloz meg, 3 nm-es folyamattal, 20 magos CPU-val, 16 magos NPU-val, akár 160 GB egységes memória támogatásával és akár 200 milliárd paraméterrel rendelkező modellek helyi telepítésével. Ezek a Notebookcheck által közölt specifikációk és állítások, nem pedig a forrásban önállóan megerősített megállapítások.
A jelentés szerint a Xiaomi prototípusa 120B és 3B modelleket is telepíthet, és válthat a „gyors és lassú rendszerek” között a helyi mesterséges intelligencia használatához. A Notebookcheck a tervezést olyan rendszerekkel állítja szembe, mint a Nvidia DGX Spark és az Asus Ascent GX10, amelyek a cikk szerint 128 GB egységes memóriát kínálnak, és akár 200 milliárd paraméterrel támogatják a helyi modelleket. A Xiaomi bejelentett kialakítása abban különbözik, hogy három saját Xring chipjét egy rendszerben kombinálja. A Notebookcheck egy 33 874 CNC precíziós perforációval ellátott, egytestű repülőgép-alumínium héjat is ismertet. A cikk szerint a Xiaomi eseményanyagai azt mutatják, hogy az O100 és a D100 kereskedelmi forgalomba hozatalát 2027-re tervezik, de azt nem állapítják meg, hogy maga az AI Cube mikor fog megjelenni.
Forrás részletei: notebookcheck.net ↗
Miért számít
A prototípus egy speciálisabb megközelítésre utal a nagy mesterséges intelligencia modellek felhőadatközpontokon kívüli futtatására. A Notebookcheck szerint a Xiaomi három chipre választja szét az általános számítástechnikát, a nagy sávszélességű feldolgozást és az AI-munkaterhelést, ami potenciálisan lehetővé teszi, hogy egy kompakt rendszer kezelje azokat a modelleket, amelyek általában jelentős szerverhardvert igényelnek. Az állításokat független tesztelés nem igazolta.
A központi jelentőségű az a kísérlet, hogy viszonylag nagy AI modelleket tegyenek használhatóvá egy helyi gépen. Ha a Xiaomi által közölt specifikációk megbízható szoftvert és valós átviteli sebességet jelentenek, egy ilyen rendszer csökkentheti a távoli következtetésektől való függést bizonyos munkaterheléseknél. A helyi végrehajtás számíthat ott, ahol a szervezeteknek alacsonyabb hálózati késleltetésre, nagyobb adatkezelésre vagy felhőkapcsolat nélküli folyamatos működésre van szükségük. Ezek az előnyök gyakorlati lehetőségek, nem pedig a mellékelt jelentésben bemutatott eredmények. A Notebookcheck nem közöl olyan független tesztet, amely azt mutatná, hogy az AI Cube adott válaszsebességet, pontossági szintet vagy költségelőnyt biztosít.
A háromchipes kialakítás azt is szemlélteti, hogy az AI hardver hogyan válik egyre specializálódottabbá. Ahelyett, hogy minden feladathoz egy processzorra támaszkodna, a jelentett architektúra általános feldolgozást rendel az O3-hoz, és hangsúlyozza a memória mozgását és az AI-számítást az O100 és D100 segítségével. Ez a megközelítés segíthet a helyi mesterséges intelligencia egyik fő korlátjának megoldásában: a nagy modellsúlyok és a köztes adatok hatékony mozgatása korlátozott memórián és összeköttetéseken keresztül. A tervezés hasznossága azonban attól függ, hogyan kommunikálnak a chipek, hogyan foglalják le a memóriát, és hogy a szoftver képes-e felosztani a modell munkaterhelését közöttük. A Notebookcheck jelentése nem tartalmazza ezeket a megvalósítási részleteket.
A jelentett modellkapacitás figyelemre méltó, de nem szabad összetéveszteni a széleskörű használhatósággal. Az az állítás, hogy a hardver akár 200 milliárd paraméterrel is képes telepíteni egy modellt, önmagában nem bizonyítja, hogy a modell gyorsan reagál, belefér a gyakorlati teljesítményhatárokba, vagy támogatja a felhasználók számára szükséges eszközöket. A nagy modellek tömörítést, kvantálást vagy gondos particionálást igényelhetnek, és a cikk nem határozza meg, hogy mely modelleket használták, milyen beállítások mellett vagy milyen kimeneti minőséggel. A jelentés továbbá nem tartalmaz árat, rendelkezésre állási tervet vagy bizonyítékot arra vonatkozóan, hogy a prototípus készen áll a fogyasztók vagy a vállalkozások számára. Jelenkori legvilágosabb jelentősége a Xiaomi helyi mesterséges intelligencia hardveres irányának konkrét jelzése.
Interaktív mechanizmus: Hogyan működik valójában
Fedezze fel interaktívan a fejlesztés mögött meghúzódó technológiát.
A route planner searches possible journeys using explicit rules. What does this illustrate about AI?
Mit nézzünk ezután
A fő ismeretlenek a kereskedelmi elérhetőség, az ár, a szoftvertámogatás és a mért teljesítmény. A Notebookcheck jelentése szerint a Xiaomi nem közölte az AI Cube megjelenési dátumát vagy árát, míg az esemény anyagai szerint az O100 és a D100 kereskedelmi forgalomba hozatalát 2027-re tervezik. A jövőbeni jelentéseknek meg kell határozniuk, hogy a prototípus használható termék lesz-e, és hogyan teljesít a valódi modellekkel.
Az első kérdés, amelyet meg kell nézni, az, hogy az AI Cube valódi termék lesz-e. A Notebookcheck nem közöl kiadási dátumot vagy árat a rendszerről, és a cikk mérnöki prototípusként jellemzi. A Xiaomi rendezvényanyagai állítólag 2027-re teszik az O100 és a D100 kereskedelmi forgalomba hozatalát, de ez nem jelenti azt, hogy a teljes mini PC-t ugyanabban az ütemezésben értékesítik. Egy későbbi bejelentésnek tisztáznia kell a regionális elérhetőséget, a memóriakonfigurációkat, az operációs rendszer támogatását, a modellkiszolgáló szoftvereket és azt, hogy a háromchipes konfiguráció változatlan marad-e.
A független tesztelés elengedhetetlen lesz. A hasznos kiértékelések a másodpercenkénti tokeneket, az indítási időt, a tartós teljesítményt, az energiafogyasztást, a hőkezelést és a zajt mérnék több modellméretben. Azt is tisztázni kell, hogy a jelentett 120B és 200B kapacitások teljes pontosságú modellekre, kvantált modellekre vagy más telepítési formátumokra vonatkoznak-e. Mivel a forrás független mérések helyett a Notebookcheck által közvetített vállalati specifikációkat tartalmazza, ezeknek a gyakorlati jellemzőknek még nem lehet következtetnie a jelentett TOPS-, sávszélesség- vagy wattszámadatokból.
A tágabb kérdés az, hogy a Xiaomi képes-e ökoszisztémát építeni az Xring hardvere köré. A helyi mesterséges intelligencia rendszereknek kompatibilis modellekre, fejlesztői eszközökre, memóriakezelő szoftverre, frissítésekre és egyértelmű dokumentációra van szükségük, nem csak megfelelő szilíciumra. A jövőbeni lefedettségnek a nyilvános szoftverkiadásokat, a megnevezett modelleket használó bemutatókat, a reprodukálható benchmarkokat és az ügyfelek telepítésének bizonyítékait kell keresnie. Addig is az AI Cube egy jelentős prototípus bejelentésként értelmezhető, potenciálisan hasznos helyi következtetésekkel, nem pedig annak bizonyítékaként, hogy megérkezett egy széles körben elérhető, 200 milliárd paraméteres asztali mesterséges intelligencia termék.