Kembali ke Berita
produkAI Understanding taklimat

PrismML mengeluarkan Bonsai 2, model 27B termampat untuk peranti tempatan

PrismML telah mengeluarkan Bonsai 2, versi mampat 5.9GB model Qwen3.8 27B Alibaba yang dijalankan secara tempatan pada telefon pintar dan PC sambil mengekalkan 98% prestasi penanda aras asal.

4 min readRead the linked source
Source-provided image accompanying PrismML releases Bonsai 2, a compressed 27B model for local devices
Rujukan sumberSumber direkodkan
Penerbit
techjuice.pk
Pautan sumber
techjuice.pkhttps://www.techjuice.pk/prismml-bonsai-2-27b-llm-compression-smartphone-pc-ai-device/
Jenis sumber
Sumber terpaut — status sumber primer belum ditetapkan.
KonteksFahami perkara ini dalam masa 60 saat

Mulakan di sini

Istilah utama

Model Bahasa Besar (LLM)
Model bahasa yang dilatih mengenai korpora teks besar-besaran untuk menjana dan menganalisis teks.
AI Pada Peranti
Inferens AI dilakukan secara setempat pada perkakasan pengguna dan bukannya dalam perkhidmatan awan jauh.
Penanda aras
Ujian piawai atau set data yang digunakan untuk mengukur dan membandingkan prestasi model.
Uji diri andaKuiz Penjelasan Model AI

Apa yang berlaku

PrismML mengeluarkan Bonsai 2 27B, model bahasa besar termampat yang direka untuk dijalankan pada komputer peribadi dan telefon pintar mewah tanpa infrastruktur awan. Model ini mengurangkan Qwen3.8 27B Alibaba kepada 5.9 gigabait menggunakan pemampatan berat ternary, mengekalkan 98% daripada prestasi penanda aras asal. Pemberat tersedia di bawah Lesen Apache 2.0 dan menyokong GPU NVIDIA melalui peranti CUDA dan Apple melalui MLX.

PrismML, sebuah syarikat permulaan yang diasaskan oleh penyelidik Caltech dan diketuai oleh Babak Hassibi, mengeluarkan Bonsai 2 27B pada hari Khamis. Model ini ialah versi mampat bagi Qwen3.8 27B Alibaba, dikurangkan kepada 5.9 gigabait melalui pemampatan berat terner, yang menukar parameter 16-bit kepada tiga nilai: satu positif, satu negatif atau sifar. Teknik ini menghapuskan parameter berlebihan, membolehkan model mengekalkan 98% daripada prestasi penanda aras asal sambil dipasang pada perkakasan tempatan.

Keluaran itu menandakan peningkatan ketara berbanding model Bonsai asal dari Mac, yang mengekalkan 95% prestasi penanda aras. Menurut PrismML, model asal telah dimuat turun lebih 11 juta kali, dengan model lebih kecil tambahan mengumpul 2.6 juta muat turun, menunjukkan penggunaan pembangun yang kukuh untuk AI berasaskan peranti. Model baharu ini dijalankan pada GPU NVIDIA melalui CUDA dan pada peranti Apple (Mac, iPhone, iPad) melalui MLX, menggunakan kernel bit rendah tersuai untuk memastikan pelaksanaan tempatan yang cekap.

Berat model tersedia serta-merta di bawah Lesen Apache 2.0, membenarkan penyepaduan dan pengubahsuaian yang meluas. PrismML memperoleh pusingan benih $22.25 juta yang disokong oleh Khosla Ventures, Cerberus Capital, dan Caltech, dengan Ion Stoica, pengasas bersama Databricks, berkhidmat sebagai penasihat. Pendekatan syarikat memberi tumpuan kepada memanfaatkan lebihan dalam model yang lebih besar untuk mencapai pariti prestasi tinggi dengan saiz fail yang minimum, strategi yang dicadangkan Hassibi akan menjadi lebih berkesan apabila saiz model meningkat.

Butiran sumber: techjuice.pk ↗

Mengapa ia penting

Keluaran ini menunjukkan bahawa AI berkemampuan penaakulan boleh beroperasi secara tempatan pada perkakasan pengguna, menangani kebimbangan privasi dan menghapuskan kependaman awan dan kos langganan. Dengan mencapai pariti prestasi tinggi dengan saiz fail yang jauh lebih kecil, PrismML memajukan peralihan daripada AI yang bergantung kepada awan kepada penaakulan berasaskan peranti yang diedarkan, menjadikan keupayaan AI lanjutan boleh diakses tanpa infrastruktur pusat data yang besar.

Keupayaan untuk menjalankan AI berkemampuan penaakulan secara tempatan pada peranti pengguna menangani kebimbangan privasi yang kritikal dengan memastikan data pengguna tidak pernah meninggalkan peranti. Ini menghapuskan keperluan untuk penghantaran awan, mengurangkan kependaman dan mengalih keluar kos langganan berterusan yang dikaitkan dengan perkhidmatan AI berasaskan awan. Bagi pembangun dan pengguna akhir, ini mewakili anjakan asas ke arah pengedaran, penaakulan berasaskan peranti yang menjimatkan kos dan peribadi.

Kadar pengekalan tinggi 98% prestasi penanda aras dalam fail 5.9GB menunjukkan bahawa teknik pemampatan boleh mengekalkan kecerdasan model besar dengan berkesan. Ini mempunyai implikasi praktikal untuk industri yang memerlukan AI pada peranti, seperti penjagaan kesihatan, kewangan dan pembantu peribadi, di mana kedaulatan data dan tindak balas masa nyata adalah yang terpenting. Sifat sumber terbuka keluaran ini mempercepatkan lagi penerimaan dengan membenarkan komuniti membina dan mengoptimumkan model untuk kekangan perkakasan tertentu.

Interactive Mechanism

Mekanisme Interaktif: Bagaimana Ia Berfungsi Sebenarnya

Terokai teknologi asas di sebalik pembangunan ini secara interaktif.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Semakan Konsep Interaktif+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Apa yang perlu ditonton seterusnya

Pembangun harus memantau ketersediaan kernel bit rendah tersuai untuk seni bina perkakasan yang berbeza dan matlamat yang dinyatakan syarikat untuk memampatkan ratusan-bilion-model parameter dalam beberapa bulan akan datang. Selain itu, potensi penyepaduan dengan peranti Apple, yang dibayangkan oleh masa keluaran, memerlukan perhatian untuk keupayaan AI sisi peranti pada masa hadapan.

PrismML telah menyatakan matlamat seterusnya adalah untuk memampatkan model dengan ratusan bilion parameter dalam beberapa bulan akan datang. Kejayaan dalam bidang ini akan mengesahkan lagi kebolehskalaan pemampatan ternary untuk model kelas sempadan, yang berpotensi menjadikan keupayaan AI yang lebih maju tersedia pada perkakasan tempatan.

Masa keluaran telah membawa kepada spekulasi tentang potensi integrasi dengan peranti Apple. Walaupun Ketua Pegawai Eksekutif Babak Hassibi enggan mengulas mengenai laporan rundingan dengan Apple, sokongan untuk rangka kerja MLX Apple mencadangkan penjajaran strategik dengan ekosistem Apple. Pengumuman masa depan mengenai perkongsian rasmi atau pengoptimuman khusus peranti boleh memberi kesan ketara kepada penggunaan AI tempatan pada platform iOS dan macOS.

Panduan & kuiz berkaitan

Model AI DiterangkanLatihan AIEjen AIUji apa yang anda tahu — cuba kuiz AI percumaCari istilah AI dalam glosari kamiIkuti penjejak keluaran model AI
Adakah ini berguna?