Adaptasi Domain
Metode yang mentransfer model yang dilatih di satu domain agar berperforma lebih baik di domain lain.
Terminologi teknis penting dijelaskan dengan tingkat kejelasan tertinggi. Dirancang untuk peneliti, pelajar, dan pendidikan yang berpusat pada manusia.
Metode yang mentransfer model yang dilatih di satu domain agar berperforma lebih baik di domain lain.
Sebuah sistem perangkat lunak yang dapat mengamati, menalar, dan mengambil tindakan untuk mencapai suatu tujuan, sering kali menggunakan alat dan memori.
Sistem AI hipotetis yang dapat melakukan sebagian besar tugas intelektual pada tingkat manusia di banyak domain.
Inferensi AI dilakukan secara lokal pada perangkat keras pengguna, bukan pada layanan cloud jarak jauh.
Sistem AI yang menghasilkan konten baru seperti teks, gambar, audio, video, atau kode.
Pendekatan pelatihan dan pembentukan perilaku di mana keluaran model dipandu oleh serangkaian prinsip tertulis yang tetap.
Seperangkat aturan atau langkah yang diikuti komputer untuk memecahkan masalah atau menyelesaikan tugas.
Metode bias posisional yang memberikan penalti pada skor perhatian berdasarkan jarak tertentu, membantu model melakukan ekstrapolasi ke konteks yang lebih panjang.
Proses multi-langkah di mana sistem AI merencanakan, mengeksekusi, memeriksa hasil, dan melakukan iterasi menuju suatu tujuan.
Tugas NLP yang mengklasifikasikan nada emosional atau opini dalam teks.
Algoritma yang menemukan vektor yang mendekati kueri tanpa perbandingan menyeluruh, memperdagangkan ketepatan demi kecepatan.
Label atau metadata yang ditambahkan manusia digunakan untuk melatih atau mengevaluasi model pembelajaran mesin.
Menggabungkan prediksi dari beberapa model untuk meningkatkan ketahanan atau akurasi.
Cara terstruktur bagi satu sistem perangkat lunak untuk mengirim permintaan dan menerima tanggapan dari sistem lain.
Asal, kepemilikan, dan riwayat kumpulan data atau artefak model yang terdokumentasi.
Teknik yang membuat contoh pelatihan yang dimodifikasi untuk meningkatkan generalisasi model.
Basis data yang dioptimalkan untuk menyimpan dan menanyakan vektor penyematan berdimensi tinggi.
Kumpulan dokumen atau catatan terkurasi yang digunakan untuk pengambilan, otomatisasi dukungan, atau respons dasar.
Permukaan dalam ruang fitur yang memisahkan kelas-kelas yang diprediksi oleh pengklasifikasi.
Nilai numerik yang dipelajari yang menskalakan sinyal yang melewati jaringan saraf.
Pola dorongan yang menyisipkan langkah-langkah penalaran dengan tindakan penggunaan alat untuk menyelesaikan tugas dengan lebih andal.
Penyiapan pelatihan tempat model ditingkatkan dengan menghasilkan data melalui interaksi atau kompetisi dengan salinan dirinya sendiri.
Model yang mengkodekan kueri dan dokumen ke dalam vektor terpisah sehingga dapat dibandingkan dengan cepat dalam skala besar.
Pola kesalahan atau ketidakadilan yang konsisten dalam data atau perilaku model.
Ketidakadilan sistematis dalam keluaran model yang disebabkan oleh ketidakseimbangan data, asumsi, atau pilihan pemodelan.
Algoritme tokenisasi subkata yang menggabungkan pasangan karakter paling sering menjadi token yang dapat digunakan kembali.
Arsitektur dengan subjaringan khusus yang hanya menjalankan pakar terpilih untuk setiap masukan.
Instruksi masukan dan konteks diberikan ke model generatif.
Kumpulan data yang sangat besar dan kompleks yang memerlukan penyimpanan dan teknik pemrosesan yang dapat diskalakan.
Data yang dihasilkan secara artifisial digunakan untuk menambah, menyimulasikan, atau melindungi data pelatihan sensitif.
Strategi pembangkitan yang membatasi token keluaran pada struktur yang valid atau pilihan yang sesuai dengan kebijakan.
Mengompresi pengetahuan dari model guru yang besar menjadi model siswa yang lebih kecil.
Metode pelatihan yang menyempurnakan model secara langsung pada pasangan preferensi tanpa memerlukan model imbalan terpisah.
Mengubah data mentah menjadi fitur informatif yang dapat digunakan model.
Kerangka kerja evaluasi berulang yang menjalankan perintah, kumpulan data, dan logika penilaian di seluruh versi model.
Tolok ukur masalah pemrograman Python yang digunakan untuk mengukur kebenaran pembuatan kode melalui pengujian unit.
Seberapa akurat klaim model sesuai dengan informasi dunia nyata yang dapat diverifikasi.
Lapisan moderasi yang memblokir atau menulis ulang input atau output model yang tidak aman.
Variabel masukan yang digunakan oleh model untuk membuat prediksi.
Tujuan matematika yang mengukur kesalahan prediksi selama pelatihan.
Pengaturan generatif di mana generator dan diskriminator berlatih satu sama lain.
Seberapa baik performa model pada data baru yang tidak terlihat di luar set pelatihan.
Vektor yang menunjukkan seberapa banyak setiap parameter harus diubah untuk mengurangi kerugian.
Struktur grafik entitas dan hubungan yang digunakan untuk penalaran atau pengambilan.
Tolok ukur soal cerita matematika sekolah dasar yang digunakan untuk mengevaluasi penalaran langkah demi langkah dalam model bahasa.
Ketika suatu model menghasilkan informasi yang lancar tetapi salah atau tidak didukung.
Nilai konfigurasi yang ditetapkan sebelum pelatihan, seperti kecepatan pembelajaran, ukuran batch, atau kedalaman.
Sumber daya pemrosesan yang diperlukan untuk melatih dan menjalankan model, sering kali diukur dalam jam FLOPS atau GPU.
Struktur indeks berbasis grafik untuk perkiraan pencarian tetangga terdekat dengan cepat melalui vektor berdimensi tinggi.
Hubungan empiris yang menunjukkan bagaimana performa meningkat seiring dengan ukuran model, data, atau komputasi.
Metode untuk memperkirakan hubungan sebab-akibat daripada korelasi sederhana.
Proporsi hal positif aktual yang diidentifikasi dengan benar oleh model.
Pola serangan di mana instruksi berbahaya dimasukkan ke dalam input model atau konten yang diambil.
Rentang statistik yang kemungkinan berisi nilai sebenarnya dari metrik model yang diukur.
Arsitektur saraf yang dioptimalkan untuk memproses data seperti grid seperti gambar.
Model komputasi berlapis yang terinspirasi oleh neuron dan sinapsis biologis.
Jumlah maksimum token masukan yang dapat diproses model bahasa sekaligus.
Seberapa cocok skor keyakinan model dengan probabilitas kebenaran sebenarnya.
Menyelaraskan kepercayaan pengguna terhadap keluaran AI dengan keandalan sistem yang sebenarnya dalam setiap tugas.
Dokumentasi yang menjelaskan tujuan penggunaan model, metrik, batasan, dan risiko.
Argumen terstruktur, didukung oleh bukti, bahwa sistem AI aman untuk konteks penggunaan tertentu.
Bidang yang berfokus pada pengurangan perilaku berbahaya, kegagalan, dan risiko penyalahgunaan dalam sistem AI.
Label referensi tepercaya yang digunakan untuk melatih atau mengevaluasi keluaran model.
Jika contoh pengujian benchmark atau varian yang mirip terdapat dalam data pelatihan, hal ini akan meningkatkan performa yang dilaporkan.
Sejauh mana respons AI didukung oleh sumber data atau bukti yang diambil.
Hyperparameter pelatihan yang mengontrol seberapa banyak parameter berubah setiap langkah pembaruan.
Bidang luas dalam membangun sistem yang melakukan tugas yang memerlukan pengenalan pola, penalaran, bahasa, atau pengambilan keputusan.
Kemampuan model untuk mempertahankan performa di bawah gangguan, pergeseran, atau masukan yang berlawanan.
Output model dibatasi pada skema yang ditentukan seperti JSON, argumen alat, atau bidang yang diketik.
Fungsi tujuan umum yang digunakan untuk melatih model klasifikasi dengan memberikan penalti pada probabilitas yang salah.
Nilai kesalahan model dihitung selama pelatihan dan dioptimalkan ke bawah seiring waktu.
Fase runtime saat model terlatih menghasilkan prediksi atau keluaran.
Saat model mengingat data pelatihan dan berperforma buruk pada masukan yang tidak terlihat.
Tugas di mana model memberikan masukan ke satu atau lebih kategori yang telah ditentukan sebelumnya.
Memprediksi tujuan pengguna dari kueri teks untuk merutekannya dengan benar.
Arsitektur model multimodal yang mempelajari representasi bersama antara teks dan gambar.
Mengonversi bobot model ke format presisi lebih rendah seperti 8-bit atau 4-bit.
Mengurangi presisi numerik bobot model untuk mengurangi biaya memori dan inferensi.
Kumpulan contoh terstruktur atau tidak terstruktur yang digunakan untuk pelatihan, validasi, atau pengujian.
Kumpulan data yang digunakan untuk mengukur kualitas model setelah pelatihan.
Referensi ke bagian sumber atau dokumen yang disertakan dalam respons model untuk mendukung klaimnya.
Waktu antara mengirim permintaan dan menerima keluaran model.
Siklus berulang di mana agen AI mengamati, merencanakan, bertindak, dan melakukan refleksi hingga mencapai tujuan atau mencapai kondisi berhenti.
Model yang menilai kueri dan dokumen secara bersamaan untuk penilaian relevansi dengan akurasi tinggi.
Menggunakan model bahasa untuk menilai atau membandingkan keluaran dari model lain selama evaluasi.
Metode penyesuaian parameter yang efisien yang menambahkan matriks adaptor peringkat rendah.
Metrik evaluasi kode yang mengukur kemungkinan setidaknya satu dari k sampel yang dihasilkan lulus pengujian.
Alur kerja tempat manusia meninjau, memandu, atau mengesampingkan keluaran AI.
Protokol terbuka yang memungkinkan aplikasi AI terhubung ke alat eksternal, sumber data, dan penyedia konteks dengan cara standar.
Komponen model yang secara dinamis berfokus pada bagian masukan yang relevan saat menghasilkan keluaran.
Konteks tersimpan yang digunakan agen AI di seluruh langkah atau sesi untuk meningkatkan kontinuitas.
Sebuah tolok ukur yang menguji model bahasa di 57 mata pelajaran akademik dan profesional menggunakan pertanyaan pilihan ganda.
Model bahasa yang dilatih pada corpora teks besar untuk menghasilkan dan menganalisis teks.
Model bahasa ringkas yang dioptimalkan untuk latensi, biaya, atau penggunaan pada perangkat yang lebih rendah.
Model multimodal yang secara bersama-sama memproses informasi visual dan tekstual.
Model referensi sederhana yang digunakan untuk membandingkan apakah pendekatan yang lebih kompleks benar-benar meningkatkan hasil.
Arsitektur generatif yang belajar membalikkan noise untuk mensintesis gambar, audio, atau konten lainnya.
Model besar yang telah dilatih sebelumnya dan dapat disesuaikan dengan banyak tugas hilir.
Model yang menilai keluaran berdasarkan sinyal preferensi, sering digunakan dalam saluran RLHF.
Model yang banyak parameternya nol atau tidak aktif untuk mengurangi komputasi.
Model yang penalaran internalnya sulit diinterpretasikan langsung oleh manusia.
Penurunan kinerja seiring berjalannya waktu karena kondisi dunia nyata berbeda dari asumsi pelatihan.
Model yang dapat memproses atau menghasilkan beberapa tipe data seperti teks, gambar, dan audio.
Model yang dikhususkan untuk mengubah data menjadi vektor yang digunakan untuk pencarian semantik, pengelompokan, dan pengambilan.
Sebuah model yang dilatih berdasarkan peringkat manusia untuk memprediksi respons mana yang mungkin disukai pengguna.
Model yang lebih kecil dilatih untuk meniru perilaku model yang lebih besar sambil menggunakan lebih sedikit komputasi pada inferensi.
Model yang dirilis dengan bobot atau kode publik untuk inspeksi, adaptasi, dan penggunaan kembali.
Prediksi yang salah ketika model melewatkan kasus positif yang sebenarnya.
Kebijakan di mana muatan permintaan/respons tidak disimpan setelah pemrosesan di luar jangka waktu operasional yang berumur pendek.
Mengubah nilai ke skala yang konsisten untuk meningkatkan stabilitas pengoptimalan.
Teknologi yang mengubah teks dalam gambar atau pindaian menjadi teks yang dapat dibaca mesin.
Aturan, pemeriksaan, dan kontrol yang membatasi perilaku model yang tidak aman atau tidak diinginkan.
Biaya tambahan dalam waktu, komputasi, atau kecepatan produk yang diperlukan untuk membuat sistem lebih aman dan terkendali.
Bobot yang dipelajari di dalam model yang memengaruhi keluarannya.
Langkah-langkah pelatihan diterapkan setelah pra-pelatihan, seperti penyetelan instruksi, optimalisasi preferensi, dan penyetelan keselamatan.
Proses menetapkan tag atau keluaran target ke data mentah untuk pembelajaran yang diawasi.
Kemampuan model untuk menghasilkan panggilan terstruktur yang memicu alat atau API eksternal.
Menghapus bobot model atau neuron yang kurang penting untuk mengurangi ukuran dan komputasi.
Pendekatan pelatihan yang memungkinkan model terus belajar dari data baru tanpa melupakan pengetahuan sebelumnya.
Kemampuan model untuk mengikuti pola dari contoh yang diberikan langsung di prompt.
Mempelajari representasi dari data yang tidak berlabel dengan memprediksi bagian yang disamarkan atau ditransformasikan.
Bagian dari pembelajaran mesin yang menggunakan jaringan saraf banyak lapisan untuk pembelajaran representasi.
Metode yang memungkinkan sistem mempelajari pola dari data dan meningkat seiring waktu.
Pelatihan dengan imbalan memberi sinyal saat agen mempelajari tindakan yang memaksimalkan keuntungan jangka panjang.
Sebuah metode pelatihan yang menggunakan sinyal preferensi manusia untuk membentuk perilaku model.
Mempelajari atau mengadaptasi perilaku hanya dari sejumlah kecil contoh.
Pola pembelajaran dari data tidak berlabel tanpa target keluaran yang jelas.
Menerapkan pengetahuan yang dipelajari dalam satu tugas atau domain untuk meningkatkan tugas lainnya.
Melatih model dengan contoh berlabel yang memetakan masukan ke keluaran yang diketahui.
Menyelesaikan tugas tanpa contoh tugas spesifik dengan mengandalkan pengetahuan umum sebelumnya.
Teknik cepat yang dimaksudkan untuk melewati batasan keamanan model.
Komponen model yang mengubah masukan menjadi representasi laten.
Model yang menyusun ulang kumpulan awal hasil yang diambil untuk menempatkan item yang paling relevan di urutan teratas.
Cabang AI berfokus pada pemahaman dan menghasilkan bahasa manusia.
Titik waktu terakhir yang tercermin dalam data pelatihan model.
Penetapan harga yang skala biayanya disesuaikan dengan panggilan API, token, waktu inferensi, atau komputasi yang digunakan.
Pengaturan decoding yang mengurangi kemungkinan token secara proporsional dengan seberapa sering token tersebut muncul sejauh ini.
Pengaturan decoding yang mengurangi kemungkinan munculnya token, mendorong topik baru.
Pengaturan decoding yang menurunkan kemungkinan token yang telah dihasilkan model untuk mengurangi loop.
Pendekatan pengambilan yang menggabungkan pencarian kata kunci (leksikal) dengan pencarian vektor (semantik) untuk perolehan dan presisi yang lebih baik.
Pencarian yang cocok dengan arti dan bukan kata kunci yang sama persis, sering kali menggunakan penyematan.
Algoritme penguraian kode yang menyimpan beberapa urutan kandidat teratas di setiap langkah untuk menemukan keluaran dengan probabilitas lebih tinggi.
Menjalankan model secara paralel dengan lalu lintas produksi tanpa memengaruhi keputusan yang diambil pengguna.
Tugas NLP yang mengidentifikasi entitas seperti orang, tempat, tanggal, atau organisasi.
Menemukan dokumen atau catatan yang relevan dari sumber pengetahuan untuk kueri.
Pola pengambilan yang mencari bagian kecil namun mengembalikan dokumen induk yang lebih besar untuk konteks yang lebih kaya.
Teknik pengambilan yang menulis ulang kueri pengguna menjadi beberapa varian untuk meningkatkan ingatan.
Strategi decoding yang mengambil sampel hanya dari k kemungkinan besar token berikutnya.
Strategi decoding yang mengambil sampel dari kumpulan token terkecil yang probabilitasnya berjumlah p.
Menggunakan label yang berisik, heuristik, atau parsial untuk melatih model ketika label yang bersih sulit didapat.
Kemampuan model untuk memanggil alat eksternal seperti penelusuran, kalkulator, atau API.
Metode regularisasi yang memperhalus label keras untuk meningkatkan generalisasi.
Model yang dirancang khusus untuk tugas klasifikasi.
Informasi ditambahkan ke penyematan token sehingga transformator dapat membedakan urutan urutan.
Logika yang memvalidasi dan mengubah keluaran model menjadi struktur yang diketik dengan kuat dan dapat digunakan mesin.
Metode percepatan inferensi di mana rancangan model kecil mengusulkan token yang diverifikasi secara paralel oleh model yang lebih besar.
Sejauh mana perilaku model dapat diinterpretasikan dan dijelaskan kepada manusia.
Metode optimasi yang memperbarui parameter ke arah yang mengurangi kesalahan.
Pekerjaan membuat sistem AI berperilaku sesuai dengan niat manusia, nilai-nilai, dan batasan keselamatan.
Representasi vektor numerik yang menangkap makna semantik teks, gambar, atau data lainnya.
Representasi vektor padat dari kata-kata yang menangkap hubungan semantik.
Melanjutkan pelatihan pada data spesifik domain untuk mengadaptasi model yang telah dilatih sebelumnya ke tugas tertentu.
Metode yang mengadaptasi model dengan melatih sebagian kecil parameter tambahan.
Menyempurnakan model pasangan instruksi-respons untuk meningkatkan kemampuan mengikuti tugas.
Pergeseran data masukan dunia nyata dari waktu ke waktu yang dapat menurunkan performa model.
Melatih model yang lebih kecil untuk meniru keluaran model yang lebih besar.
Pola perhatian di mana setiap token hanya memperhatikan jendela berukuran tetap dari token terdekat untuk mengurangi komputasi.
Algoritme perhatian yang dioptimalkan yang mengurangi penggunaan memori dan mempercepat pelatihan transformator dan inferensi.
Mekanisme transformator yang menjalankan beberapa operasi perhatian secara paralel untuk menangkap berbagai jenis hubungan.
Jumlah daya pemrosesan yang dikonsumsi saat menghasilkan setiap respons.
Perhitungan inferensi tambahan yang digunakan selama pembuatan respons untuk meningkatkan kualitas atau penalaran.
Instruksi berprioritas tinggi yang menetapkan perilaku, kebijakan, dan gaya respons untuk suatu model.
Metrik model bahasa yang mengukur seberapa terkejut model tersebut dengan token berikutnya yang sebenarnya.
Fase pelatihan perantara antara pra-pelatihan dan pasca-pelatihan, sering kali digunakan untuk penyesuaian kemampuan atau domain.
Model yang membuat prediksi melalui rangkaian pemisahan fitur jika-maka.
Pendekatan penalaran dimana suatu model mengeksplorasi beberapa jalur solusi yang bercabang dan memilih yang paling menjanjikan.
Prediksi yang salah ketika model salah menandai kasus negatif sebagai kasus positif.
Tokenizer tanpa bahasa yang mempelajari unit subkata langsung dari teks mentah tanpa terlebih dahulu membagi spasi.
Pelatihan model skala besar awal mengenai data luas sebelum adaptasi hilir.
Proporsi prediksi positif yang sebenarnya benar.
Proporsi item yang diambil dan relevan dengan kueri pengguna.
Teknik privasi yang menambahkan gangguan statistik sehingga catatan individual tidak dapat disimpulkan secara andal dari keluaran.
Merancang petunjuk untuk meningkatkan kualitas keluaran, keandalan, dan kemampuan pengendalian.
Algoritme pelatihan inti yang memperbarui bobot model dengan menyebarkan kesalahan prediksi ke belakang melalui jaringan.
Teknik penyempurnaan yang menggabungkan kuantisasi bobot 4-bit dengan adaptor LoRA untuk mengurangi kebutuhan memori.
Sebuah metode yang mengambil pengetahuan eksternal dan memasukkannya ke dalam generasi pada waktu inferensi.
Metode pengambilan yang menghasilkan beberapa varian kueri, mengambil hasil untuk masing-masing varian, dan menggabungkan peringkat.
Gaya penalaran di mana model AI menguraikan masalah menjadi langkah-langkah perantara.
Katalog pusat untuk pembuatan versi, persetujuan, dan pelacakan model di seluruh lingkungan.
Merancang atau mentransformasikan variabel masukan agar pembelajaran lebih mudah dan efektif.
Ruang representasi terkompresi di mana konsep-konsep serupa diposisikan berdekatan satu sama lain sebagai vektor.
Alur kerja yang teratur dari prapemrosesan, langkah model, dan tahapan pascapemrosesan.
Kumpulan data yang digunakan selama pengembangan untuk menyesuaikan model dan mencegah overfitting.
Catatan dari mana data berasal, bagaimana data tersebut diubah, dan di mana data tersebut digunakan.
Sebuah sistem yang dapat mengambil keputusan dan bertindak dengan kendali manusia secara langsung atau terbatas secara real time.
Saluran model yang memprediksi preferensi pengguna untuk menentukan peringkat konten atau produk.
Pengaturan pengambilan sampel yang mengontrol keacakan dalam keluaran yang dihasilkan.
Metode pengkodean posisi yang memutar kueri dan vektor kunci untuk mengkodekan posisi token relatif.
Sepotong teks yang diproses oleh model bahasa, seperti potongan kata atau simbol.
Menanamkan sinyal yang dapat dideteksi dalam teks atau media yang dihasilkan AI sehingga nantinya dapat diidentifikasi sebagai sinyal yang diproduksi oleh mesin.
Kebijakan, standar, dan mekanisme pengawasan yang memandu bagaimana AI dikembangkan dan digunakan di masyarakat.
Tensor kunci dan nilai tersimpan dari token sebelumnya yang memungkinkan transformator menghasilkan token baru tanpa menghitung ulang perhatian sebelumnya.
Pola cepat yang dapat digunakan kembali dengan variabel, aturan pemformatan, dan instruksi khusus tugas.
Menguji stres sistem AI dengan petunjuk yang berlawanan untuk mengungkap kegagalan dan risiko.
Antarmuka API yang diterapkan yang menerima permintaan model dan mengembalikan prediksi dalam produksi.
Proses pemisahan teks menjadi token untuk masukan model.
Sistem terkelola untuk menyimpan dan menyajikan fitur ML yang divalidasi secara konsisten untuk pelatihan dan inferensi.
Tes atau kumpulan data standar yang digunakan untuk mengukur dan membandingkan kinerja model.
Arsitektur saraf yang menggunakan perhatian untuk memodelkan hubungan lintas urutan secara paralel.
Seberapa jelas logika, sumber data, dan batasan sistem AI didokumentasikan dan dapat dipahami.
Kerangka peraturan Uni Eropa yang berbasis risiko untuk sistem dan penyedia AI.
Cabang AI yang mengekstrak makna dari gambar dan video.
Teknik dan praktik untuk membuat prediksi AI lebih transparan dan mudah dipahami.