Dem ci ëmbiit li
Jàng
Xibaar
Jumtukaay yi
Liggéey yi
Sunu yitte
Seetal
⌘K
English
Maye
Menu
Tambalil fii
Tambalil jàng
Jàng
Demal ci Jàng
Kuur yi
Gindikaay yi
Jàngalekat AI
Bibliothèque prompt
Nattu yi
Sertifikaa
Baatukaay
Xibaar
Demal ci Xibaar
Xibaar yi mujjee ci IA
toppkatu topic
Gëstu ak done
Blog
Sart yu tëralin
Njubbanti
Jumtukaay yi
Demal ci Jumtukaay yi
Répertoire jumtukaay
Limu yi gëna baax
Teg jumtukaay yi
kalkulatëru njëg
Raffineur bu gaaw
Joxe jumtukaayu AI
Liggéey yi
Demal ci Liggéey yi
Saytu ay liggéey IA
Poste ab liggey
parrain AIU
Sunu yitte
Demal ci Sunu yitte
Sunu yitte
njeexte ak lim
Auteur yi
Centre d'aide
Lu bees
Ndimbal
Maye
Daara
/
Baatukaay
/
Jàng mu am doole ci feedback nit (RLHF)
Baatu Glossaire IA
Luy
Jàng mu am doole ci feedback nit (RLHF)
?
Maanaam
Xeetu tàggat yaram buy jëfandikoo siñaal yi nit ñi taamu ngir jëmmal xeetu doxalin.
Term yu ci méngoo
Jàng buy dooleel
Tàggat ci siñaal neexal, di barab bi ab ndawu liggéey di jàngee jëf yuy yokk ndàmpaay ci diir bu yàgg.
Modèlu neexal
Benn xeetu poñ buy joxe poñ ci siñaal yiñ taamu, ñu koy faral di jëfandikoo ci pipeline RLHF yi.
DPO (Optimisation préférence directe)
Xeetu tàggat yaram buy gëna suqali xeetu model yi ci ñaari tànneef te soxlawul xeetu neexal bu wuute.
Wéyal jàng
Xeetu tàggat yaram buy may model bi mu wéy di jàng ci done yu bees te du fàtte xam-xam bimu amoon bu njëkk.
Jàng ci ay yoon yu néew
Jàng wala méngale doxalin ci misaal yu néew.
Modèle drift
Degradasioŋ performance ci diir bu gàtt ndax anam yi àdduna bi di doxee dañu wuute ak xalaati tàggat yaram yi.
Nekk leen ci sunuy tegtal yu amul fayda
Deep Learning
Reinforcement Learning
Machine Learning Basics
Supervised Learning
Xoolal itam
Retrieval
Red Teaming
Recommendation System
Robustness
Recall
Safety Filter
RAG (Retrieval-Augmented Generation)
Scaling Law
Previous
Reinforcement Learning
Next
Retrieval
Xoolal Glossaire IA bi yépp
Saytu bépp tegtal IA bu amul fayda