Vissza a Hírekhez
TermékAI Understanding eligazítás

A Votee AI kantoni modelleket épít Hongkong közszolgáltatásai és vállalkozásai számára

A Fortune jelentése szerint a Votee AI hongkongi startup új kantoni adatokra vonatkozó nyílt súlyú modelleket képez át bankok, egyetemek és kormányzati szervek számára, hogy orvosolja a főbb AI-rendszerek helyi és kulturális ismereteinek hiányosságait.

6 min readRead the original reporting
Source-provided image accompanying Votee AI is building Cantonese models for Hong Kong’s public services and businesses
Hozzárendelt jelentésForrás rögzített
Kiadó
fortune.com
Forrás link
fortune.comhttps://fortune.com/2026/08/27/votee-ai-hong-kong-cantonese-llm-pak-sun-ting-ceo/
Forrás típusa
Egy hírügynökség jelentése – nem belső dokumentum.

Amit önállóan nem tudtunk megerősíteni: Ez az állítás a megnevezett üzletnek tulajdonítható. Nem ellenőriztük belső dokumentum alapján. (fortune.com)

KontextusÉrtsd meg ezt 60 másodperc alatt

Kezdje itt

Kulcsfogalmak

Szintetikus adatok
Mesterségesen előállított adatok az érzékeny edzési adatok kiegészítésére, szimulálására vagy védelmére.
Benchmark
A modell teljesítményének mérésére és összehasonlítására használt szabványos teszt vagy adatkészlet.
Paraméter
Tanult súly a modellben, amely befolyásolja annak kimeneteit.
Teszteld magadMi az AI? Kvíz

Mi történt

A Fortune jelentése szerint a hongkongi székhelyű Votee AI kantoni fókuszú nyelvi modelleket épít azáltal, hogy áttanítja a nyílt súlyú modelleket olyan fejlesztőktől, mint a Meta és az Alibaba. A vállalat azt állítja, hogy a kantoni képzési korpuszát körülbelül 100 millióról több mint 500 millióra bővítette online adatgyűjtés, közösségi és egyetemi hozzájárulások, korábbi adat-üzleti tartalmak és szintetikus adatok révén. Modellei állítólag körülbelül 70 milliárd paraméterrel rendelkeznek, és a vállalat a képzési költségeket nagyjából 250 000 dollárra becsüli.

A Fortune jelentése szerint a Votee AI egy hongkongi startup, amely kantoni és más nyelvekre összpontosít, amelyeket a vezető mesterséges intelligenciarendszerek által alul kiszolgáltként ír le. A jelentés szerint a vállalat nyitott súlyú modelleket vesz át olyan fejlesztőktől, mint a Meta és az Alibaba, és további képzéseket végez kantoni adatokkal. A Votee eladja az így létrejött rendszereket bankoknak, egyetemeknek és kormányzati szerveknek. A jelentés a vállalat munkáját az angol és a mandarin nyelv dominanciájára adott válaszként mutatja be a jelenlegi mesterségesintelligencia-piacon, nem pedig egy általános határmodell felépítésére tett kísérletként, amely közvetlenül versenyez a teljes skálán.

A Fortune jelentése szerint a kantoni nyelv nyelvtanában és szókincsében különbözik a mandarin nyelvtől, különösen Hongkongban, ahol a beszélők ugyanazon a mondaton belül válthatnak a kantoni és az angol között. A cikk szerint több mint 80 millió ember beszél kantoni nyelvet, ez a népesség összemérhető a koreaiul beszélők számával, és nagyobb, mint az olasz vagy thai nyelvűek száma. A jelentés azonban azt állítja, hogy a szabványosított írásos adatok, különösen a köznyelvi kantoni nyelv kínálata viszonylag korlátozott. A Fortune a HKCanto-Eval-ra hivatkozik, amely a Kyushu Egyetem, a Hongkongi Oktatási Egyetem és a hon9kon9ize helyi mesterségesintelligencia-közösség kutatói által kifejlesztett referenciaérték. A , amelyet a Fortune szerint a Votee szponzorált, megállapította, hogy a mainstream modellek ésszerűen képesek kezelni a mindennapi kantoni nyelvet, de a kulturális és helyi ismeretek terén rutinszerűen kudarcot vallottak.

A közölt képzési folyamat több forrást is magában foglal. A Fortune szerint a Votee online anyagokat kapar, köztük a Radio Television Hong Kong tartalmát, és adatokat kap közösségektől és egyetemektől. A vállalat korábbi big data üzletének anyagaira támaszkodik, és szintetikus kantoni adatkészleteket hoz létre a képzéshez. A Fortune szerint ezeknek az erőfeszítéseknek köszönhetően a korpusz 100 millióról több mint 500 millióra nőtt. A startup modelljei körülbelül 70 milliárd paraméterrel rendelkeznek. Pak-Sun Ting vezérigazgató a Fortune-nak elmondta, hogy a Votee 500 millió és egymilliárd közötti tokent használ modelljei betanításához, szemben az angol nyelvű modelleknél használt trilliókkal, és a költségeket nagyjából 250 000 dollárra becsüli. A Fortune nem ellenőrzi önállóan ezeket az adatokat, és nem írja le a modell architektúráját, kiadási feltételeit, értékelési módszertanát vagy a nyilvánosság számára elérhetőségét.

Forrás részletei: fortune.com ↗

Miért számít

A kantoni nyelvet több mint 80 millióan beszélik, de a Fortune jelentése szerint a köznyelvi és lokalizált írásos adatok viszonylag szűkösek. A Votee által szponzorált HKCanto-Eval szerint a mainstream modellek képesek kezelni a mindennapi kantoni nyelvet, de gyengén teljesítenek a kulturális és helyi ismeretek terén. A jobb helyi nyelvű rendszerek hatással lehetnek az oktatásban, az egészségügyben, a rendészetben és a kormányzati szolgáltatásokban a nyilvánosság előtti felhasználásra, ugyanakkor támogathatják az angol és mandarin nyelvtől kevésbé függő mesterséges intelligencia kiépítésére irányuló szélesebb körű erőfeszítéseket.

A Fortune beszámolója azt szemlélteti, hogy a nyelvi lefedettség miért praktikus mesterséges intelligencia probléma, nem csak a kultúra megőrzésének kérdése. Ting elmondta a kiadványnak, hogy a kantoni nyelvet az oktatásban, az egészségügyben és a rendőrségi kommunikációban használják, és azzal érvelt, hogy az ilyen kontextusokat nem kezelő rendszerek csak korlátozottan használhatók. Ha pontos, a vállalat fókusza a széles körű többnyelvű állítások és a helyi terminológia, intézmények, társadalmi konvenciók és vegyes nyelvű beszéd vagy írás megértésének képessége közötti szakadékra mutat. A következmények jelentősek lehetnek mindenhol, ahol egy mesterséges intelligencia rendszer információkat foglal össze, segíti a személyzetet vagy kommunikál a lakosokkal kantoni nyelven.

A jelentés Votee munkáját az úgynevezett szuverén mesterséges intelligencia felé irányuló szélesebb körű mozgalomba helyezi. A Fortune ismerteti az indonéz Sahabat AI, az AI szingapúri AI SEA-LION projekt és a dél-koreai állam által támogatott hazai alapítvány-modellszolgáltatók kiválasztására irányuló erőfeszítéseket. A közös cél a helyi adatok, modellek és alkalmazások nagyobb ellenőrzése, nem pedig a tengerentúli szolgáltatóktól való teljes függés. Ting elmondta a Fortune-nak, hogy a mesterséges intelligencia ellátási láncának minden részének birtoklása nehéz, de a kormányok előnyben részesíthetik az alapmodellek és alkalmazások ellenőrzését. Azzal is érvelt, hogy sok közszférabeli feladat nem igényel határterületi rendszereket, és kisebb helyi modellekkel is megoldható, esetleg erősebb angol vagy kínai nyelvű modellekkel, amelyeket a színfalak mögött használnak.

Ennek a modellnek vannak gyakorlati kompromisszumai. A helyi rendszerek javíthatják a nyelvi illeszkedést, és nagyobb ellenőrzést adhatnak az intézményeknek az érzékeny telepítések felett, de egy kisebb vagy speciális modell szűkebb képességekkel rendelkezhet, és továbbra is függhet a külföldi modellszolgáltatóktól, chipektől vagy infrastruktúrától. A Fortune jelentése szerint a Votee a MiniMax és a SenseTime modellekkel dolgozik, és használhatja a Nvidia chipeket, hangsúlyozva, hogy a helyi nyelv tulajdonlása nem feltétlenül jelenti a technológiai függetlenséget a teljes kötegben. A cikk a Votee-t is profitorientált vállalatként írja le, amelynek bevétele jelenleg meghaladja a költségeit, Ting szerint, és az ügyfélszerződések biztosítják a finanszírozás nagy részét. A Fortune jelentése szerint Allan Zeman tanácsadó, és hogy a Votee aktív megbeszéléseket folytat az AI Singapore-val, de nem erősíti meg önállóan a vállalat pénzügyeit, szerződéseit, ügyfélkihelyezéseit vagy a megbeszélések állapotát.

Interactive Mechanism

Interaktív mechanizmus: Hogyan működik valójában

Fedezze fel interaktívan a fejlesztés mögött meghúzódó technológiát.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Interaktív koncepció ellenőrzése+10 Points
What is AI? Quiz

A route planner searches possible journeys using explicit rules. What does this illustrate about AI?

Mit nézzünk ezután

A legfontosabb megválaszolatlan kérdés az, hogy a Votee modelljei megbízhatóan teljesítenek-e a vállalat saját állításain és az általa szponzorált referenciaértéken kívül. A Fortune nem biztosít független értékeléseket, hibaarányokat, nyilvános modellkibocsátást, árakat, ügyfélszámokat vagy részleteket az adatlicencekről és az adatvédelmi biztosítékokról. A további jelentéseknek meg kell vizsgálniuk a valódi kantoni feladatok teljesítését, a lekapart anyag származási és beleegyezési státuszát, a telepítési léptéket, valamint azt, hogy a vállalatnak az AI Singapore-val folytatott megbeszélései konkrét partnerséghez vezetnek-e.

Az első prioritás a független teljesítményteszt. A Fortune beszámol a HKCanto-Eval megállapításairól és a Votee állításairól a kantoni megértéssel és érveléssel kapcsolatban, de a cikk nem ad pontszámokat, összehasonlításokat konkrét modellek között, mintafeladatokat, meghibásodási arányokat vagy független auditor által végzett értékelést. Hasznos vizsgálat tesztelné a köznyelvi kantoni nyelvet, az angol kódváltást, a regionális szókincset, a közszolgálati terminológiát és a kulturálisan specifikus kérdéseket. Azt is értékelnie kell, hogy a fejlesztések továbbra is fennállnak-e, ha a rendszer nem a képzési adatokra emlékeztető anyagokkal, hanem ismeretlen témákkal találkozik.

Az adatkezelés egy másik megoldatlan probléma. A Fortune szerint a Votee online kaparást, RTHK-tartalmat, közösségi és egyetemi hozzájárulásokat, korábbi üzleti adatokat és szintetikus adatokat használ. A forrás nem állapítja meg, hogy mely anyagokat engedélyezték, a közreműködők hogyan adtak engedélyt, eltávolították-e a személyes adatokat, illetve hogyan kezelik a szerzői jogokat és a műsorszolgáltatói jogokat. Ezek a kérdések különösen az egészségügyi, oktatási, rendészeti és kormányzati használatra szánt rendszerekre vonatkoznak. A jövőbeni közzétételeknek tisztázni kell a korpusz eredetét, beleegyezését és megőrzési irányelveit, valamint a magánjellegű vagy szerzői joggal védett anyagok reprodukálásával szembeni biztosítékokat.

A cég kereskedelmi és regionális terjeszkedése határozza meg, hogy a projekt tartós állami képességgé válik, vagy szakosodott szolgáltatási üzletág marad. A Fortune jelentése szerint a Votee intézményi ügyfeleknek értékesít, bevételei meghaladják költségeit, és azt reméli, hogy Hongkongból Délkelet-Ázsiába terjeszkedik, és végül Kelet-Ázsiában, Észak-Amerikában és Afrikában veszélyeztetett nyelveken dolgozhat. A forrás nem szolgáltat ügyfélszámot, üzembe helyezési mennyiséget, nyilvános hozzáférést, árképzést, szolgáltatási szintű kötelezettségvállalásokat vagy az elfogadás bizonyítékát. Figyelje a modell nyilvános kiadását, a független ellenőrzött szerződéseket, a valós telepítések eredményeit, a megerősített mesterséges intelligencia szingapúri partnerséget és a bizonyítékokat arra vonatkozóan, hogy a rendszer megbízható előnyökkel járhat anélkül, hogy túlbecsülné, mire képes egy 70 milliárdos kantoni modell.

Kapcsolódó útmutatók és vetélkedők

Mi az az AI?ChatGPT és LLM-ekAz AI modellek magyarázataMI-etikaTesztelje, amit tud – próbáljon ki egy ingyenes AI-kvíztKeressen egy AI kifejezést a szószedetünkbenKövesse az AI modell kiadáskövetőjét
Ezt hasznosnak találta?