Apa yang terjadi
Notebookcheck melaporkan bahwa Xiaomi meluncurkan prototipe rekayasa AI Cube pada konferensi teknologi chip Xring pada 24 Agustus. Sistem ringkas ini menggabungkan tiga chip rancangan perusahaan: Xring O3, O100, dan D100. Menurut Notebookcheck, Xiaomi mengatakan sistem tersebut ditujukan untuk penerapan model AI lokal dan dapat menjalankan model 120B dan 3B.
Notebookcheck melaporkan bahwa Xiaomi menunjukkan AI Cube sebagai prototipe rekayasa, bukan produk ritel jadi. Laporan tersebut mengatakan perangkat tersebut diluncurkan pada konferensi teknologi chip Xring Xiaomi pada 24 Agustus dan dirancang untuk menjalankan model AI secara lokal. Artikel tersebut mengidentifikasi tiga chip tersebut sebagai Xring O3, O100 dan D100, dan mengatakan bahwa sistem tersebut dapat menghasilkan daya berkelanjutan hingga 150 watt. Angka tersebut menggambarkan kekuatan yang dimiliki, bukan hasil kecepatan atau kualitas yang diukur secara independen.
Notebookcheck mengutip akun Weibo Lei Jun dan IT Home dalam sumbernya. Sumber yang disediakan tidak mencakup halaman produk Xiaomi publik, laporan independen, atau pengujian sistem yang diverifikasi secara independen. Notebookcheck menggambarkan chip memiliki peran terpisah. Laporan tersebut menyebutkan Xring O3 adalah prosesor utama, dengan CPU 10-core, GPU G2-Ultra NX 16-core dan NPU 200 TOPS yang diklaim. Dikatakan bahwa O100 ditujukan untuk beban kerja AI dengan bandwidth tinggi dan menggunakan kemasan bertumpuk tingkat wafer 3D 6nm, dengan Xiaomi mengklaim 28.672 jalur data efektif dan bandwidth komputasi dekat memori hingga 1,22 TB/s. D100 digambarkan menargetkan AI berkinerja tinggi dan beban kerja mengemudi cerdas, dengan proses 3nm, CPU 20-inti, NPU 16-inti, dukungan memori terpadu hingga 160 GB, dan penerapan model lokal dengan hingga 200 miliar parameter. Ini adalah spesifikasi dan klaim yang dilaporkan oleh Notebookcheck, bukan temuan yang dikonfirmasi secara independen dalam sumbernya.
Laporan tersebut mengatakan prototipe Xiaomi dapat menerapkan model 120B dan 3B dan beralih antara “sistem cepat dan lambat” untuk penggunaan AI lokal. Notebookcheck membandingkan desainnya dengan sistem seperti DGX Spark Nvidia dan Ascent GX10 dari Asus, yang menurut artikel tersebut menawarkan memori terpadu 128 GB dan mendukung model lokal dengan parameter hingga 200 miliar. Desain yang dilaporkan Xiaomi berbeda dengan menggabungkan tiga chip Xring miliknya dalam satu sistem. Notebookcheck juga menjelaskan cangkang unibody aluminium-dirgantara dengan 33.874 perforasi presisi CNC. Artikel tersebut mengatakan materi acara Xiaomi menunjukkan bahwa O100 dan D100 direncanakan untuk diluncurkan secara komersial pada tahun 2027, tetapi tidak diketahui kapan AI Cube itu sendiri akan dikirimkan.
Detail sumber: notebookcheck.net ↗
Mengapa itu penting
Prototipe ini menunjukkan pendekatan yang lebih terspesialisasi untuk menjalankan model AI besar di luar pusat data cloud. Notebookcheck mengatakan Xiaomi memisahkan komputasi umum, pemrosesan bandwidth tinggi, dan beban kerja AI dalam tiga chip, yang berpotensi memungkinkan sistem kompak untuk menangani model yang biasanya memerlukan perangkat keras server besar. Klaim tersebut masih belum terverifikasi melalui pengujian independen.
Signifikansi utamanya adalah upaya untuk membuat model AI yang relatif besar dapat digunakan pada mesin lokal. Jika spesifikasi yang dilaporkan Xiaomi diterjemahkan ke dalam perangkat lunak yang andal dan hasil nyata, sistem semacam ini dapat mengurangi ketergantungan pada inferensi jarak jauh untuk beberapa beban kerja. Eksekusi lokal dapat menjadi penting ketika organisasi memerlukan latensi jaringan yang lebih rendah, kontrol yang lebih besar atas data, atau operasi yang berkelanjutan tanpa koneksi cloud. Manfaat-manfaat tersebut merupakan kemungkinan-kemungkinan praktis, bukan hasil-hasil yang ditunjukkan oleh laporan yang diberikan. Notebookcheck tidak melaporkan pengujian independen yang menunjukkan bahwa AI Cube memberikan kecepatan respons, tingkat akurasi, atau keunggulan biaya tertentu.
Desain tiga chip juga menggambarkan bagaimana perangkat keras AI menjadi lebih terspesialisasi. Daripada mengandalkan satu prosesor untuk setiap tugas, arsitektur yang dilaporkan menugaskan pemrosesan umum ke O3 dan menekankan pergerakan memori dan komputasi AI melalui O100 dan D100. Pendekatan tersebut dapat membantu mengatasi kendala utama dalam AI lokal: memindahkan bobot model yang besar dan data perantara secara efisien melalui memori dan interkoneksi yang terbatas. Namun, kegunaan desain akan bergantung pada cara chip berkomunikasi, bagaimana memori dialokasikan, dan apakah perangkat lunak dapat membagi beban kerja model ke seluruh chip. Laporan Notebookcheck tidak memberikan rincian implementasi tersebut.
Kapasitas model yang dilaporkan penting namun tidak sama dengan kegunaan luas. Klaim bahwa perangkat keras dapat menerapkan model dengan hingga 200 miliar parameter tidak dengan sendirinya menunjukkan bahwa model tersebut akan merespons dengan cepat, sesuai dengan batas daya praktis, atau mendukung alat yang dibutuhkan pengguna. Model besar mungkin memerlukan kompresi, kuantisasi, atau partisi yang cermat, dan artikel tersebut tidak menentukan model mana yang digunakan, dalam pengaturan apa, atau dengan kualitas keluaran apa. Laporan tersebut juga tidak memberikan harga, rencana ketersediaan atau bukti bahwa prototipe tersebut siap untuk konsumen atau bisnis. Pentingnya hal ini saat ini adalah sebagai sinyal nyata arah perangkat keras AI lokal Xiaomi.
Mekanisme Interaktif: Cara Kerja Sebenarnya
Jelajahi teknologi yang mendasari di balik perkembangan ini secara interaktif.
A route planner searches possible journeys using explicit rules. What does this illustrate about AI?
Apa yang harus ditonton selanjutnya
Hal utama yang belum diketahui adalah ketersediaan komersial, harga, dukungan perangkat lunak, dan kinerja terukur. Notebookcheck melaporkan bahwa Xiaomi belum mengumumkan tanggal rilis atau harga untuk AI Cube, sementara materi acaranya menunjukkan peluncuran komersial untuk O100 dan D100 direncanakan pada tahun 2027. Pelaporan di masa depan harus menentukan apakah prototipe tersebut menjadi produk yang dapat digunakan dan bagaimana kinerjanya dengan model sebenarnya.
Masalah pertama yang harus diperhatikan adalah apakah AI Cube menjadi produk nyata. Notebookcheck melaporkan tidak ada tanggal rilis atau harga untuk sistem tersebut, dan artikel tersebut mencirikannya sebagai prototipe teknik. Materi acara Xiaomi dilaporkan menyebutkan peluncuran komersial O100 dan D100 pada tahun 2027, tetapi hal itu tidak memastikan bahwa mini PC lengkap akan dijual pada jadwal yang sama. Pengumuman selanjutnya akan memperjelas ketersediaan regional, konfigurasi memori, dukungan sistem operasi, perangkat lunak penyajian model dan apakah konfigurasi tiga chip tetap tidak berubah.
Pengujian independen akan sangat penting. Evaluasi yang berguna akan mengukur token per detik, waktu startup, kinerja berkelanjutan, konsumsi daya, perilaku termal, dan kebisingan di beberapa ukuran model. Mereka juga harus mengklarifikasi apakah kapasitas 120 miliar dan 200 miliar yang dilaporkan mengacu pada model presisi penuh, model terkuantisasi, atau format penerapan lainnya. Karena sumbernya berisi spesifikasi perusahaan yang disampaikan oleh Notebookcheck dan bukan pengukuran independen, belum ada karakteristik praktis yang dapat disimpulkan dari TOPS, bandwidth, atau angka watt yang dilaporkan.
Pertanyaan yang lebih luas adalah apakah Xiaomi dapat membangun ekosistem di sekitar perangkat keras Xring-nya. Sistem AI lokal memerlukan model yang kompatibel, alat pengembang, perangkat lunak manajemen memori, pembaruan dan dokumentasi yang jelas, bukan hanya silikon yang mumpuni. Cakupan di masa depan harus mencakup rilis perangkat lunak publik, demonstrasi menggunakan model yang disebutkan, tolok ukur yang dapat direproduksi, dan bukti penerapan pelanggan. Sampai saat itu, AI Cube paling baik dipahami sebagai pengumuman prototipe yang signifikan dengan ambisi inferensi lokal yang berpotensi berguna, bukan sebagai bukti bahwa produk AI desktop dengan 200 miliar parameter yang tersedia secara luas telah hadir.