Lewati ke konten
Belajar
Berita
Alat
Lowongan
Misi
Cari
⌘K
English
Donasi
Tidak bisa
×
Mulai di sini
Mulailah belajar
Belajar
Pergi ke Belajar
Kursus
Panduan
Tutor AI
Prompt library
Kuis
Sertifikat
Glosarium
Berita
Pergi ke Berita
Berita AI terbaru
Pelacak topik
Research & datasets
Blog
Standar editorial
Koreksi
Alat
Pergi ke Alat
Direktori alat
Daftar terbaik
Bandingkan alat
Cost calculator
Pemurni Cepat
Kirim alat
Lowongan
Pergi ke Lowongan
Telusuri pekerjaan AI
Posting pekerjaan
Mensponsori AIU
Misi
Pergi ke Misi
Misi
Dampak & statistik
Penulis
Help centre
What's new
Bantuan
Donasi
Rumah
/
Glosarium
/
Perhitungan Waktu Inferensi
Istilah Glosarium AI
Apa itu
Perhitungan Waktu Inferensi
?
Definisi
Jumlah daya pemrosesan yang dikonsumsi saat menghasilkan setiap respons.
Istilah terkait
Perhitungan Waktu Tes
Perhitungan inferensi tambahan yang digunakan selama pembuatan respons untuk meningkatkan kualitas atau penalaran.
Penagihan Berbasis Penggunaan
Penetapan harga yang skala biayanya disesuaikan dengan panggilan API, token, waktu inferensi, atau komputasi yang digunakan.
Model Suling
Model yang lebih kecil dilatih untuk meniru perilaku model yang lebih besar sambil menggunakan lebih sedikit komputasi pada inferensi.
Hitung
Sumber daya pemrosesan yang diperlukan untuk melatih dan menjalankan model, sering kali diukur dalam jam FLOPS atau GPU.
RAG (Generasi Augmented Pengambilan)
Sebuah metode yang mengambil pengetahuan eksternal dan memasukkannya ke dalam generasi pada waktu inferensi.
Pajak Penyelarasan
Biaya tambahan dalam waktu, komputasi, atau kecepatan produk yang diperlukan untuk membuat sistem lebih aman dan terkendali.
Pelajari lebih lanjut di panduan gratis kami
AI Inference
Computer Vision
Sentiment Analysis
Real-Time Voice Agents
See also
Inference
Instruction Tuning
In-Context Learning
Intent Classification
Hyperparameter
Jailbreak
Human-in-the-Loop
Knowledge Cutoff
Previous
Inference
Next
Instruction Tuning
Jelajahi Glosarium AI selengkapnya
Jelajahi semua panduan AI gratis