Kembali ke Berita
produkAI Understanding taklimat

SMBtech melaporkan Perplexity melancarkan Komputer Mudah Alih untuk ejen AI tempatan di DGX Spark

SMBtech melaporkan bahawa Perplexity telah melancarkan Komputer Mudah Alih, aplikasi ejen AI tempatan pertama yang dioptimumkan untuk perkakasan DGX Spark Nvidia, dengan sokongan untuk model tempatan, fail peribadi dan perkhidmatan produktiviti yang disambungkan.

5 min readRead the linked source
Source-provided image accompanying SMBtech reports Perplexity launches Portable Computer for local AI agents on DGX Spark
Rujukan sumberSumber direkodkan
Penerbit
smbtech.au
Pautan sumber
smbtech.auhttps://smbtech.au/news/nvidia-and-perplexity-launch-portable-computer/
Jenis sumber
Sumber terpaut — status sumber primer belum ditetapkan.
KonteksFahami perkara ini dalam masa 60 saat

Mulakan di sini

Istilah utama

Perplexity
Metrik model bahasa yang mengukur betapa terkejutnya model dengan token seterusnya yang benar.
Suntikan Pantas
Corak serangan yang mana arahan berniat jahat dimasukkan ke dalam input model atau kandungan yang diambil semula.
Penanda aras
Ujian piawai atau set data yang digunakan untuk mengukur dan membandingkan prestasi model.
Uji diri andaKuiz Agen AI

Apa yang berlaku

SMBtech melaporkan bahawa melancarkan Komputer Mudah Alih, aplikasi ejen AI tempatan pertama yang direka untuk DGX Spark Nvidia. Aplikasi ini digambarkan sebagai menyokong aliran kerja penaakulan, penyelidikan dan ejen tempatan, sambil membenarkan pengguna bertukar antara model tempatan dan dihoskan awan. SMBtech berkata persediaan tempatan termasuk model Qwen 3.8 27B yang telah terlatih dan Perplexity sedang membangunkan varian Nemotron 3.5 Lightning yang diperhalusi.

SMBtech melaporkan bahawa melancarkan Komputer Mudah Alih sebagai aplikasi ejen AI pertama tempatan yang dioptimumkan untuk perkakasan DGX Spark Nvidia. Laporan itu mengatakan aplikasi itu bertujuan untuk menjalankan penaakulan, penyelidikan dan aliran kerja ejen pada sistem pengguna sendiri, dengan fail, model dan data disimpan secara setempat untuk aliran kerja tersebut. Sumber itu tidak mengenal pasti pengumuman Nvidia berasingan yang mengesahkan pelancaran, dan ia tidak mengesahkan status keluaran produk secara bebas di luar pelaporannya.

Menurut SMBtech, Komputer Mudah Alih boleh menyambung ke Google Drive, Gmail, Slack dan GitHub. Pengguna dilaporkan boleh memilih antara model tempatan dan dihoskan awan: inferens setempat dibentangkan sebagai sesuai untuk kerja rutin, manakala inferens awan boleh digunakan untuk tugas yang memerlukan maklumat semasa atau penaakulan yang lebih kompleks. SMBtech berkata aliran kerja yang dijalankan secara tempatan tidak dikira terhadap had token awan. Laporan itu tidak menerangkan maklumat yang dihantar kepada perkhidmatan awan atau aplikasi yang disambungkan, dan juga tidak menerangkan tetapan kebenaran, pengekalan atau audit.

SMBtech berkata menyediakan persediaan inferens tempatan satu klik menggunakan model Qwen 3.8 27B yang terlatih selepas itu. Syarikat itu juga dilaporkan sedang membangunkan varian Nemotron 3.5 Lightning yang diperhalusi bertujuan untuk memberikan respons tempatan yang lebih pantas. Artikel itu tidak memberikan penanda aras bebas untuk Komputer Mudah Alih itu sendiri, dan ia tidak menentukan sama ada model tersedia untuk setiap pemilik DGX Spark atau sama ada konfigurasi tambahan diperlukan.

Laporan itu meletakkan pelancaran dalam Nvidia yang lebih luas menolak model terbuka tempatan, alat pembangun dan perisian tertumpu kepada ejen. Ia mengatakan sokongan untuk GPU GeForce RTX dan RTX PRO, Windows dan Stesen DGX dirancang. Kenyataan sokongan masa depan tersebut dikaitkan dengan akaun SMBtech dan tidak boleh dianggap sebagai ketersediaan yang disahkan atau komitmen penghantaran. Sumber itu juga membincangkan keluaran model dan perisian lain, tetapi itu adalah item yang berasingan dan bukannya bukti bahawa Komputer Mudah Alih sudah disokong merentas semua sistem tersebut.

Butiran sumber: smbtech.au ↗

Mengapa ia penting

Pelancaran yang dilaporkan boleh menjadikan ejen AI tempatan lebih praktikal untuk pengguna yang mengendalikan fail peribadi, kod dan perkhidmatan kerja yang disambungkan. Menjalankan beberapa beban kerja secara setempat boleh mengurangkan pergantungan pada had token awan dan menyimpan data pada sistem yang dikawal pengguna, tetapi artikel itu tidak mengesahkan ketersediaan produk, prestasi, harga, kawalan keselamatan atau konfigurasi yang disokong secara bebas.

Komputer Mudah Alih menangani had praktikal ejen AI berasaskan awan: fail sensitif dan konteks kerja mungkin perlu meninggalkan sistem pengguna sebelum ejen boleh bertindak ke atasnya. Jika penerangan SMBtech adalah tepat, sesetengah tugas sebaliknya boleh dijalankan pada perkakasan tempatan, yang mungkin menarik minat pembangun, perniagaan dan individu yang mempunyai keperluan privasi atau pemastautin data. Pelaksanaan tempatan juga boleh mengurangkan pergantungan pada had penggunaan awan berulang untuk beban kerja yang sesuai.

Sambungan yang dilaporkan ke Google Drive, Gmail, Slack dan GitHub menjadikan produk lebih penting daripada chatbot luar talian. Ejen yang boleh mengakses fail, mesej, repositori atau sistem kerja lain mungkin berguna untuk penyelidikan dan tugasan rutin, tetapi ia juga mewujudkan sempadan keselamatan dan kebenaran yang lebih besar. Sumber itu tidak menyatakan sama ada aplikasi boleh mengambil tindakan dalam perkhidmatan tersebut, apakah kelulusan yang diperlukan, cara bukti kelayakan disimpan atau cara akses boleh dibatalkan.

Pilihan tempatan-berbanding-awan boleh menjadi corak reka bentuk penting untuk aplikasi AI. Model tempatan mungkin menawarkan kawalan yang lebih besar ke atas data dan akses yang boleh diramal kepada konteks peribadi, manakala model awan boleh menyediakan keupayaan yang bergantung pada maklumat baharu atau lebih banyak kapasiti pengkomputeran. Fleksibiliti itu berpotensi berguna, tetapi artikel itu tidak memberikan ukuran perbandingan ketepatan, kependaman, kos, penggunaan tenaga atau privasi antara kedua-dua mod.

Kesan praktikal kekal tidak pasti kerana sumbernya adalah laporan sekunder dan tidak menyediakan dokumentasi produk, ujian pengguna atau demonstrasi yang disahkan secara bebas. Ia juga tidak menyatakan harga, ketersediaan geografi, keperluan operasi, syarat pelesenan model atau sama ada aplikasi itu sedia untuk pengguna umum. Oleh itu, pelancaran itu harus difahami sebagai langkah produk yang dilaporkan, bukan sebagai bukti bahawa ejen autonomi tempatan boleh dipercayai atau selamat untuk kerja yang mempunyai kepentingan tinggi.

Interactive Mechanism

Mekanisme Interaktif: Bagaimana Ia Berfungsi Sebenarnya

Terokai teknologi asas di sebalik pembangunan ini secara interaktif.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Semakan Konsep Interaktif+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Apa yang perlu ditonton seterusnya

Soalan utama ialah sama ada Komputer Mudah Alih tersedia secara meluas, konfigurasi DGX Spark yang disokongnya, cara pemprosesan tempatan dan awan dipisahkan dan data yang dihantar ke perkhidmatan yang disambungkan. SMBtech juga mengatakan sokongan untuk GPU GeForce RTX dan RTX PRO, Windows dan Stesen DGX dirancang, tetapi tidak menyediakan jadual keluaran atau ujian bebas bagi versi tersebut.

Ketersediaan dan skop adalah tidak diketahui segera. SMBtech melaporkan pelancaran untuk DGX Spark tetapi menerangkan sokongan untuk GPU GeForce RTX dan RTX PRO, Windows dan Stesen DGX seperti yang dirancang. Dokumentasi susulan harus menjelaskan sama ada Komputer Mudah Alih tersedia sekarang, perkakasan mana yang disokong, sama ada ia berjalan pada satu peranti atau memerlukan perkhidmatan tambahan dan sama ada versi yang dirancang akan mempunyai keupayaan yang sama.

Aliran data patut diteliti dengan teliti. Pengguna akan memerlukan maklumat yang jelas tentang tugas yang kekal setempat, apabila inferens awan digunakan, telemetri yang dikumpul dan sama ada gesaan, fail atau output dikekalkan. Sambungan ke Gmail, Google Drive, Slack dan GitHub juga menjadikan reka bentuk kebenaran penting: perlindungan praktikal termasuk akses berskop sempit, pengesahan eksplisit sebelum tindakan luaran, pengasingan kelayakan dan log yang menunjukkan perkara yang diakses atau diubah oleh ejen. Tiada satu pun daripada perlindungan tersebut disahkan dalam sumber.

Penyepaduan Qwen 3.8 27B dan Nemotron 3.5 Lightning yang dirancang harus dinilai secara berasingan daripada penerangan pemasaran aplikasi. Bukti berguna akan termasuk ujian bebas pengekodan, penyelidikan, penggunaan alat, tugasan jangka panjang dan pemulihan kegagalan pada DGX Spark. Tuntutan prestasi tentang model yang disokong Nvidia berkaitan di tempat lain dalam artikel tidak menentukan prestasi Komputer Mudah Alih dalam aliran kerja sebenar.

Persoalan yang lebih luas ialah sama ada perkakasan tempatan boleh menyokong ejen yang berguna tanpa mengalihkan beban penyelenggaraan dan keselamatan yang tidak boleh diterima kepada pengguna. Memantau kemas kini model, kebergantungan perisian, kebenaran perkhidmatan bersambung dan tindakan yang tidak dijangka akan sama pentingnya dengan kelajuan inferens mentah. Laporan SMBtech tidak menetapkan cara Komputer Mudah Alih mengendalikan ralat, suntikan segera dalam kandungan yang diambil, fail berniat jahat atau permintaan ejen yang tidak selamat, jadi perlindungan tersebut kekal tidak diketahui bermakna.

Panduan & kuiz berkaitan

Ejen AIModel AI DiterangkanEtika AIPrompt EngineeringUji apa yang anda tahu — cuba kuiz AI percumaCari istilah AI dalam glosari kamiIkuti penjejak keluaran model AI
Adakah ini berguna?