خبروں پر واپس جائیں۔
پروڈکٹAI Understanding بریفنگ

Votee AI ہانگ کانگ کی عوامی خدمات اور کاروبار کے لیے کینٹونیز ماڈل بنا رہا ہے۔

Fortune رپورٹ کرتا ہے کہ ہانگ کانگ کا اسٹارٹ اپ Votee AI بینکوں، یونیورسٹیوں اور سرکاری محکموں کے لیے کینٹونیز ڈیٹا پر کھلے وزن کے ماڈلز کو دوبارہ تربیت دے رہا ہے، جس کا مقصد مین اسٹریم AI سسٹمز کے مقامی اور ثقافتی علم میں موجود خلاء کو دور کرنا ہے۔

6 min readRead the original reporting
Source-provided image accompanying Votee AI is building Cantonese models for Hong Kong’s public services and businesses
منسوب رپورٹنگماخذ ریکارڈ شدہ
پبلشر
fortune.com
ماخذ لنک
fortune.comhttps://fortune.com/2026/08/27/votee-ai-hong-kong-cantonese-llm-pak-sun-ting-ceo/
ماخذ کی قسم
نیوز آؤٹ لیٹ کے ذریعہ رپورٹنگ - فریق اول کی دستاویز نہیں۔

جس کی ہم آزادانہ طور پر تصدیق نہیں کر سکے۔: یہ دعویٰ نامزد آؤٹ لیٹ سے منسوب ہے۔ ہم نے فریق اول کے دستاویز سے اس کی تصدیق نہیں کی۔ (fortune.com)

سیاق و سباقاسے 60 سیکنڈ میں سمجھیں۔

یہاں سے شروع کریں۔

کلیدی شرائط

مصنوعی ڈیٹا
مصنوعی طور پر تیار کردہ ڈیٹا جو کہ حساس تربیتی ڈیٹا کو بڑھانے، انکی شکل دینے یا اس کی حفاظت کے لیے استعمال کیا جاتا ہے۔
بینچ مارک
ایک معیاری ٹیسٹ یا ڈیٹا سیٹ جو ماڈل کی کارکردگی کی پیمائش اور موازنہ کرنے کے لیے استعمال ہوتا ہے۔
پیرامیٹر
ایک ماڈل کے اندر سیکھا ہوا وزن جو اس کے آؤٹ پٹس کو متاثر کرتا ہے۔
اپنے آپ کو جانچیں۔AI کیا ہے؟ کوئز

کیا ہوا؟

فارچیون نے رپورٹ کیا ہے کہ ہانگ کانگ میں مقیم Votee AI Meta اور Alibaba سمیت ڈویلپرز سے اوپن ویٹ ماڈلز کو دوبارہ تربیت دے کر کینٹونیز پر مرکوز زبان کے ماڈل بنا رہا ہے۔ کمپنی کا کہنا ہے کہ اس نے آن لائن سکریپنگ، کمیونٹی اور یونیورسٹی کے تعاون، سابقہ ​​ڈیٹا-بزنس مواد اور مصنوعی ڈیٹا کے ذریعے اپنے کینٹونیز ٹریننگ کارپس کو تقریباً 100 ملین ٹوکنز سے بڑھا کر 500 ملین سے زیادہ کر دیا ہے۔ اس کے ماڈلز میں تقریباً 70 بلین پیرامیٹرز ہونے کی اطلاع ہے، اور کمپنی کا تخمینہ تقریباً $250,000 کی تربیتی لاگت کا ہے۔

Fortune کی رپورٹ ہے کہ Votee AI ہانگ کانگ کا ایک سٹارٹ اپ ہے جس کی توجہ کینٹونیز اور دیگر زبانوں پر ہے جسے یہ معروف AI سسٹمز کے ذریعے کم خدمت کے طور پر بیان کرتا ہے۔ رپورٹ کے مطابق، کمپنی Meta اور Alibaba جیسے ڈویلپرز سے اوپن ویٹ ماڈل لیتی ہے اور کینٹونیز ڈیٹا کے ساتھ اضافی تربیت کرتی ہے۔ ووٹ حاصل کرنے والے نظام کو بینکوں، یونیورسٹیوں اور سرکاری محکموں کو فروخت کرتا ہے۔ رپورٹ میں کمپنی کے کام کو موجودہ AI مارکیٹ میں انگریزی اور مینڈارن کے غلبے کے جواب کے طور پر پیش کیا گیا ہے، بجائے اس کے کہ ایک عمومی فرنٹیئر ماڈل بنانے کی کوشش کے طور پر جو مجموعی پیمانے پر براہ راست مقابلہ کرے۔

فارچون نے رپورٹ کیا ہے کہ کینٹونیز گرائمر اور الفاظ میں مینڈارن سے مختلف ہے، خاص طور پر ہانگ کانگ میں، جہاں بولنے والے ایک ہی جملے میں کینٹونیز اور انگریزی کے درمیان تبدیل ہو سکتے ہیں۔ مضمون میں کہا گیا ہے کہ 80 ملین سے زیادہ لوگ کینٹونیز بولتے ہیں، یہ آبادی کوریائی بولنے والوں کی تعداد کے مقابلے اور اطالوی یا تھائی بولنے والوں کی تعداد سے زیادہ ہے۔ پھر بھی رپورٹ میں کہا گیا ہے کہ معیاری تحریری ڈیٹا کی فراہمی، خاص طور پر بول چال کینٹونیز، نسبتاً محدود ہے۔ فارچیون نے HKCanto-Eval کا حوالہ دیا، جو کیوشو یونیورسٹی، ہانگ کانگ کی ایجوکیشن یونیورسٹی اور مقامی AI کمیونٹی hon9kon9ize کے محققین کے ذریعہ تیار کردہ ایک معیار ہے۔ بینچ مارک، جسے Fortune کا کہنا ہے کہ Votee کے ذریعے سپانسر کیا گیا تھا، نے پایا کہ مرکزی دھارے کے ماڈلز روزمرہ کینٹونیز کو معقول طریقے سے سنبھال سکتے ہیں لیکن ثقافتی اور مقامی علم میں معمول کے مطابق ناکام ہو گئے۔

رپورٹ شدہ تربیتی عمل کئی ذرائع کو یکجا کرتا ہے۔ فارچیون کا کہنا ہے کہ ووٹ آن لائن مواد کو کھرچتا ہے، بشمول ریڈیو ٹیلی ویژن ہانگ کانگ کا مواد، اور کمیونٹیز اور یونیورسٹیوں سے ڈیٹا بھی حاصل کرتا ہے۔ کمپنی اپنے پہلے کے بڑے ڈیٹا کے کاروبار سے مواد حاصل کرتی ہے اور تربیت کے لیے مصنوعی کینٹونیز ڈیٹاسیٹس بناتی ہے۔ فارچیون کے مطابق، ان کوششوں نے کارپس کو 100 ملین ٹوکن سے بڑھا کر 500 ملین سے زیادہ کر دیا۔ اسٹارٹ اپ کے ماڈلز کو تقریباً 70 بلین پیرامیٹرز کے طور پر بیان کیا گیا ہے۔ چیف ایگزیکٹیو پاک سن ٹنگ نے فارچیون کو بتایا کہ ووٹ اپنے ماڈلز کو تربیت دینے کے لیے 500 ملین سے 1 بلین ٹوکن استعمال کرتا ہے، اس کے مقابلے میں انگریزی زبان کے ماڈلز کے لیے استعمال کیے جانے والے کھربوں کے مقابلے، اور اس کی لاگت کا تخمینہ تقریباً $250,000 ہے۔ Fortune آزادانہ طور پر ان اعداد و شمار کی تصدیق نہیں کرتا ہے یا ماڈل کے فن تعمیر، ریلیز کی شرائط، تشخیصی طریقہ کار یا عوام کے لیے دستیابی کی وضاحت نہیں کرتا ہے۔

ماخذ کی تفصیلات: fortune.com ↗

یہ کیوں اہمیت رکھتا ہے۔

کینٹونیز کو 80 ملین سے زیادہ لوگ بولتے ہیں، لیکن فارچیون نے رپورٹ کیا ہے کہ بول چال اور مقامی تحریری ڈیٹا نسبتاً کم ہے۔ ووٹی کے زیر اہتمام HKCanto-Eval بینچ مارک کے مطابق، مین اسٹریم ماڈلز روزمرہ کینٹونیز کو سنبھال سکتے ہیں لیکن ثقافتی اور مقامی علم کے حوالے سے خراب کارکردگی کا مظاہرہ کرتے ہیں۔ مقامی زبان کے بہتر نظام تعلیم، صحت کی دیکھ بھال، پولیسنگ اور سرکاری خدمات میں عوام کے سامنے آنے والے استعمال کو متاثر کر سکتے ہیں، جبکہ AI بنانے کی وسیع تر کوششوں کی حمایت بھی کرتے ہیں جو انگریزی اور مینڈارن پر کم انحصار کرتی ہے۔

فارچیون کی رپورٹنگ اس بات کی وضاحت کرتی ہے کہ کیوں زبان کی کوریج ایک عملی AI مسئلہ ہے، نہ صرف ثقافتی تحفظ کا معاملہ۔ ٹنگ نے اشاعت کو بتایا کہ کینٹونیز کا استعمال تعلیم، صحت کی دیکھ بھال اور پولیس مواصلات میں کیا جاتا ہے، یہ دلیل دیتے ہوئے کہ وہ نظام جو ان سیاق و سباق کو نہیں سنبھالتے ہیں وہ محدود استعمال کے ہیں۔ اگر درست ہے تو، کمپنی کی توجہ وسیع کثیر لسانی دعووں اور مقامی اصطلاحات، اداروں، سماجی کنونشنز اور مخلوط زبان کی تقریر یا تحریر کو سمجھنے کی صلاحیت کے درمیان فرق کی طرف اشارہ کرتی ہے۔ جہاں بھی کوئی AI نظام معلومات کا خلاصہ کرتا ہے، عملے کی مدد کرتا ہے یا کینٹونیز میں رہائشیوں کے ساتھ بات چیت کرتا ہے وہاں اس کے نتائج اہم ہو سکتے ہیں۔

رپورٹ میں ووٹ کے کام کو نام نہاد خودمختار AI کی طرف وسیع تر تحریک میں بھی رکھا گیا ہے۔ Fortune انڈونیشیا کے Sahabat AI، AI سنگاپور کے SEA-LION پروجیکٹ اور گھریلو فاؤنڈیشن ماڈل فراہم کرنے والوں کو منتخب کرنے کے لیے جنوبی کوریا کی ریاستی حمایت یافتہ کوششوں سے متعلق متعلقہ کوششوں کی وضاحت کرتا ہے۔ مشترکہ مقصد بیرون ملک فراہم کنندگان پر مکمل انحصار کے بجائے مقامی ڈیٹا، ماڈلز اور ایپلیکیشنز پر زیادہ کنٹرول ہے۔ ٹنگ نے فارچیون کو بتایا کہ AI سپلائی چین کے ہر حصے کا مالک ہونا مشکل ہے، لیکن حکومتیں فاؤنڈیشن ماڈلز اور ایپلی کیشنز کے کنٹرول کو ترجیح دے سکتی ہیں۔ انہوں نے یہ بھی دلیل دی کہ پبلک سیکٹر کے بہت سے کاموں کو فرنٹیئر سکیل سسٹم کی ضرورت نہیں ہو سکتی ہے اور ان کو چھوٹے مقامی ماڈلز کے ذریعے سنبھالا جا سکتا ہے، ممکنہ طور پر پردے کے پیچھے استعمال ہونے والے انگریزی یا چینی زبان کے زیادہ طاقتور ماڈلز کے ساتھ۔

اس ماڈل میں عملی تجارت ہے۔ مقامی نظام لسانی فٹ کو بہتر بنا سکتے ہیں اور اداروں کو حساس تعیناتیوں پر زیادہ کنٹرول دے سکتے ہیں، لیکن ایک چھوٹے یا خصوصی ماڈل کی صلاحیتیں کم ہو سکتی ہیں اور وہ پھر بھی غیر ملکی ماڈل فراہم کنندگان، چپس یا انفراسٹرکچر پر منحصر ہے۔ Fortune رپورٹ کرتا ہے کہ Votee MiniMax اور SenseTime کے ماڈلز کے ساتھ کام کرتا ہے اور Nvidia چپس استعمال کر سکتا ہے، اس بات پر زور دیتے ہوئے کہ مقامی زبان کی ملکیت کا مطلب یہ نہیں ہے کہ پورے اسٹیک میں تکنیکی آزادی ہو۔ مضمون میں ووٹی کو ایک غیر منافع بخش کمپنی کے طور پر بھی بیان کیا گیا ہے جس کی آمدنی فی الحال اس کی لاگت سے زیادہ ہے، ٹنگ کے مطابق، کلائنٹ کے معاہدوں کے ساتھ اس کی زیادہ تر فنڈنگ ​​فراہم کی جاتی ہے۔ Fortune رپورٹ کرتا ہے کہ ایلن زیمن ایک مشیر ہیں اور ووٹی AI سنگاپور کے ساتھ فعال بات چیت میں ہے، لیکن یہ کمپنی کے مالیات، معاہدوں، کسٹمر کی تعیناتیوں یا ان مباحثوں کی حیثیت کی آزادانہ طور پر تصدیق نہیں کرتا ہے۔

Interactive Mechanism

انٹرایکٹو میکانزم: یہ اصل میں کیسے کام کرتا ہے۔

اس ترقی کے پیچھے بنیادی ٹیکنالوجی کو انٹرایکٹو طریقے سے دریافت کریں۔

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
انٹرایکٹو تصور چیک+10 Points
What is AI? Quiz

A route planner searches possible journeys using explicit rules. What does this illustrate about AI?

آگے کیا دیکھنا ہے۔

اہم جواب نہ ملنے والا سوال یہ ہے کہ آیا ووٹ کے ماڈل کمپنی کے اپنے دعووں اور اس کے اسپانسر کردہ بینچ مارک سے باہر قابل اعتماد کارکردگی کا مظاہرہ کرتے ہیں۔ Fortune آزاد تشخیص، غلطی کی شرح، عوامی ماڈل کی ریلیز، قیمتوں کا تعین، کسٹمر نمبر یا ڈیٹا لائسنسنگ اور رازداری کے تحفظات کے بارے میں تفصیلات فراہم نہیں کرتا ہے۔ مزید رپورٹنگ میں حقیقی کینٹونیز کاموں کی کارکردگی، کھرچنے والے مواد کی موجودگی اور رضامندی کی حیثیت، تعیناتی کے پیمانے، اور آیا AI سنگاپور کے ساتھ کمپنی کی بات چیت ایک ٹھوس شراکت داری کا باعث بنتی ہے۔

پہلی ترجیح آزادانہ کارکردگی کی جانچ ہے۔ Fortune HKCanto-Eval کے نتائج اور کینٹونیز کی تفہیم اور استدلال کے بارے میں ووٹ کے دعووں کی رپورٹ کرتا ہے، لیکن مضمون اسکور، مخصوص ماڈلز میں موازنہ، نمونے کے کام، ناکامی کی شرح یا غیر منسلک آڈیٹر کے ذریعہ تشخیص فراہم نہیں کرتا ہے۔ مفید جانچ پڑتال بولی کینٹونیز، انگریزی کے ساتھ کوڈ سوئچنگ، علاقائی الفاظ، عوامی خدمت کی اصطلاحات اور ثقافتی طور پر مخصوص سوالات کی جانچ کرے گی۔ اسے اس بات کا بھی جائزہ لینا چاہیے کہ آیا اس وقت بہتری برقرار رہتی ہے جب سسٹم کو اس کے تربیتی ڈیٹا سے مشابہ مواد کی بجائے غیر مانوس موضوعات کا سامنا کرنا پڑتا ہے۔

ڈیٹا گورننس ایک اور حل طلب مسئلہ ہے۔ فارچیون کا کہنا ہے کہ ووٹ آن لائن سکریپنگ، آر ٹی ایچ کے مواد، کمیونٹی اور یونیورسٹی کے تعاون، پہلے سے کاروباری ڈیٹا اور مصنوعی ڈیٹا استعمال کرتا ہے۔ ماخذ اس بات کا تعین نہیں کرتا ہے کہ کون سا مواد لائسنس یافتہ تھا، شراکت داروں نے اجازت کیسے دی، آیا ذاتی معلومات کو ہٹایا گیا، یا کاپی رائٹ اور براڈکاسٹر کے حقوق کو کیسے سنبھالا جاتا ہے۔ یہ سوالات خاص طور پر صحت کی دیکھ بھال، تعلیم، پولیسنگ اور حکومتی استعمال کے لیے بنائے گئے نظاموں کے لیے اہم ہیں۔ مستقبل کے انکشافات کو کارپس کی اصل، رضامندی اور برقرار رکھنے کی پالیسیوں کے ساتھ ساتھ نجی یا کاپی رائٹ شدہ مواد کو دوبارہ پیش کرنے کے خلاف حفاظتی اقدامات کو واضح کرنا چاہیے۔

کمپنی کی تجارتی اور علاقائی توسیع اس بات کا تعین کرے گی کہ آیا یہ پراجیکٹ ایک پائیدار عوامی صلاحیت بن جائے گا یا ایک خصوصی سروس کا کاروبار بنے گا۔ فارچیون رپورٹ کرتا ہے کہ ووٹی ادارہ جاتی صارفین کو فروخت کرتا ہے، اس کا کہنا ہے کہ اس کی آمدنی اس کی لاگت سے زیادہ ہے، اور امید ہے کہ ہانگ کانگ سے جنوب مشرقی ایشیا تک پھیلے گا اور آخر کار مشرقی ایشیا، شمالی امریکہ اور افریقہ میں خطرے سے دوچار زبانوں پر کام کرے گا۔ ذریعہ صارفین کی تعداد، تعیناتی والیوم، عوامی رسائی، قیمتوں کا تعین، خدمت کی سطح کے وعدے یا اپنانے کے ثبوت فراہم نہیں کرتا ہے۔ عوامی ماڈل کی ریلیز، آزادانہ طور پر تصدیق شدہ معاہدوں، حقیقی تعیناتیوں کے نتائج، ایک تصدیق شدہ AI سنگاپور کی شراکت داری اور اس بات کا ثبوت دیکھیں کہ یہ نظام 70-بلین پیرامیٹر کینٹونیز ماڈل کیا کر سکتا ہے اس کو بڑھا چڑھا کر پیش کیے بغیر قابل اعتماد فوائد فراہم کر سکتا ہے۔

متعلقہ گائیڈز اور کوئزز

AI کیا ہے؟ChatGPT اور ایل ایل ایمAI ماڈلز کی وضاحتاے آئی اخلاقیاتآپ جو جانتے ہیں اس کی جانچ کریں - ایک مفت AI کوئز آزمائیں۔ہماری لغت میں AI کی اصطلاح دیکھیںاے آئی ماڈل ریلیز ٹریکر پر عمل کریں۔
یہ مفید پایا؟