Yang Anda Butuhkan hanyalah Penyelarasan: Pelatihan Tanpa Instruksi untuk Model Bahasa Audio Umum
Pendekatan baru untuk melatih model bahasa besar multimodal (MLLM) menghilangkan kebutuhan akan pengawasan khusus tugas yang ekstensif.
Diperbarui setiap hari1797 cerita terverifikasi
Liputan AI yang diperiksa sumber tentang peluncuran produk, perubahan kebijakan, riset keselamatan, dan langkah industri, dijelaskan dengan bahasa sederhana oleh tim edukasi nirlaba.
Setiap cerita terhubung ke bukti terkuat yang tersedia: sumber asli jika tersedia, dan laporan yang jelas dikaitkan dengan jelas.
Apa yang terjadi, mengapa hal itu penting, dan apa yang harus diperhatikan — tanpa jargon.
Ketika sinyalnya tipis, kami tidak mempublikasikan apa pun selain mengisi feed.
Cerita AI yang diperiksa sumbernya, yang terbaru terlebih dahulu, untuk orang-orang yang perlu memahami AI tanpa mengejar hype.
Pendekatan baru untuk melatih model bahasa besar multimodal (MLLM) menghilangkan kebutuhan akan pengawasan khusus tugas yang ekstensif.
Karya ini mengkaji perintah yang dilengkapi emoji sebagai kasus uji kesenjangan dalam evaluasi keselamatan model bahasa besar (LLM).
Platform e-niaga modern sering kali mengoperasikan sistem pencarian, rekomendasi, personalisasi, dan CRM secara independen, sehingga membatasi peluang untuk keterlibatan kembali pelanggan secara proaktif.
Sebuah makalah memperkenalkan THPT-Ladder, tolok ukur 632 item yang menerapkan skema penilaian ujian nasional Vietnam tahun 2025 pada model bahasa dan melaporkan nilai yang sangat berbeda dari ukuran akurasi proporsional standar.
Makalah arXiv menjelaskan cara Netflix membangun, menerapkan, dan terus memantau juri LLM untuk mendapatkan penjelasan rekomendasi, melaporkan peningkatan penayangan dan interaksi dalam pengujian A/B selama lima minggu yang melibatkan puluhan juta anggota.
Survei arXiv baru mengusulkan untuk melihat ingatan, alat, keterampilan, alur kerja, dan hubungan agen AI sebagai grafik yang berubah seiring waktu, dan memerlukan evaluasi dan tata kelola yang sadar grafik.
Pracetak arXiv baru menghadirkan FACET, kerangka kerja untuk menghasilkan tugas terminal yang dapat dieksekusi yang instruksi, lingkungan, solusi, dan verifikasinya dirancang untuk tetap konsisten.
Pracetak arXiv memperkenalkan SESSE, kerangka kerja bebas pelatihan yang membagi preferensi juri LLM menjadi sub-pertanyaan. Para penulis melaporkan kesetaraan yang hampir sama dengan dasar rantai pemikiran pada 1.000 contoh RewardBench dan catatan suara tingkat kriteria; generalisasi, biaya, dan validasi independen masih menjadi pertanyaan terbuka.
Tim IBM Spyre mengatakan agen pengkodean membantu menciptakan 13 adaptor runtime yang mencakup 7.960 dari 10.000 model penyematan Hugging Face yang paling banyak diunduh dalam target yang ditetapkan, dengan 6.804 lulus pengujian end-to-end pada Spyre. Tim mengatakan proses debug manusia tetap penting.
Makalah penelitian Apple menjelaskan metode pelabelan semu berulang tiga fase untuk pengenalan ucapan otomatis peralihan kode Mandarin-Inggris dan melaporkan pengurangan Tingkat Kesalahan Campuran pada dua subset pengembangan SEAME.
Google mengatakan pengguna akan segera dapat memberi tahu Discover topik dan tautan apa yang ingin mereka lihat lebih banyak atau lebih sedikit, sementara kontrol baru juga mempersonalisasi ringkasan audio Penelusuran dan Google News.
Amazon Bedrock kini menawarkan model OpenAI GPT-5.6 Sol, Terra, dan Luna di lebih dari 25 Wilayah AWS, dengan opsi perutean geografis dan global yang memperluas kumpulan komputasi yang tersedia.
Satu pengarahan berguna setiap minggu
Dapatkan berita AI terverifikasi minggu ini, data asli, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.
Menyewa profesional AI atau meluncurkan produk AI yang berguna? Tunjukkan kepada orang-orang yang datang ke sini untuk belajar dan bertindak.
Posting pekerjaan AI Kirim alat AI