Rekọja si akoonu
Kọ́ ẹ̀kọ́
Ìròyìn
Irinṣẹ́
Iṣẹ́
Iṣẹ́ wa
Wa
⌘K
English
Ṣètọrẹ
Akojọ aṣyn
Bẹrẹ nibi
Bẹrẹ ẹkọ
Kọ́ ẹ̀kọ́
Lọ si Kọ́ ẹ̀kọ́
Awọn iṣẹ ikẹkọ
Ìtọ́nisọ́nà
Olùkọ́ AI
Prompt ìkàwé
Ìdánwò
Ìjẹ́risi
Ìwé ọ̀rọ̀
Ìròyìn
Lọ si Ìròyìn
Titun AI iroyin
Awọn olutọpa koko
Iwadi ati awọn data
Blog
Ìlànà ìtẹ̀jáde
Àtúnṣe
Irinṣẹ́
Lọ si Irinṣẹ́
Ilana irinṣẹ
Ti o dara ju-ti awọn akojọ
Ṣe afiwe awọn irinṣẹ
Iye owo isiro
Refiner kiakia
Fi irinṣẹ́ AI ranṣẹ́
Iṣẹ́
Lọ si Iṣẹ́
Ṣawakiri awọn iṣẹ AI
Firanṣẹ iṣẹ kan
Onigbowo AIU
Iṣẹ́ wa
Lọ si Iṣẹ́ wa
Iṣẹ́ wa
Ipa & awọn iṣiro
Awọn onkọwe
Ile-iṣẹ iranlọwọ
Ohun ti o jẹ titun
Àtìlẹ́yìn
Ṣètọrẹ
Ile
/
Ìwé ìtumọ̀ ọ̀rọ̀
/
Ẹ̀kọ́ Ìmúpadàbọ̀sípò látinú Ìdánilójú Ènìyàn (RLHF)
AI Gilosari Igba
Kini
Ẹ̀kọ́ Ìmúpadàbọ̀sípò látinú Ìdánilójú Ènìyàn (RLHF)
?
Itumọ
Ọna ikẹkọ ti o lo awọn ifihan agbara ayanfẹ eniyan lati ṣe apẹrẹ ihuwasi awoṣe.
Awọn ofin ti o jọmọ
Ẹkọ imudara
Ikẹkọ nipasẹ awọn ami ẹsan nibiti aṣoju kan kọ awọn iṣe ti o mu ipadabọ igba pipẹ pọ si.
Awoṣe Ere
Awoṣe ti o ṣe iṣiro awọn abajade ti o da lori awọn ifihan agbara ayanfẹ, nigbagbogbo lo ninu awọn paipu RLHF.
DPO (Imudara Iyanfẹ Taara)
Ọna ikẹkọ ti o ṣe atunṣe awọn awoṣe taara taara lori awọn orisii ayanfẹ laisi nilo awoṣe ere lọtọ.
Ẹkọ Ilọsiwaju
Awọn isunmọ ikẹkọ ti o jẹ ki awoṣe jẹ ki ẹkọ lati inu data tuntun laisi gbagbe imọ iṣaaju.
Diẹ-Shot eko
Kọ ẹkọ tabi ṣatunṣe ihuwasi lati nọmba kekere ti awọn apẹẹrẹ.
Awoṣe fiseete
Ibajẹ iṣẹ ṣiṣe ni akoko pupọ bi awọn ipo gidi-aye ṣe iyatọ si awọn arosinu ikẹkọ.
Kọ ẹkọ diẹ sii ninu awọn itọsọna ọfẹ wa
Deep Learning
Reinforcement Learning
Machine Learning Basics
Supervised Learning
Wo tun
Retrieval
Red Teaming
Recommendation System
Robustness
Recall
Safety Filter
RAG (Retrieval-Augmented Generation)
Scaling Law
Previous
Reinforcement Learning
Next
Retrieval
Ṣawakiri ni kikun AI Gilosari
Ṣawari gbogbo awọn itọsọna AI ọfẹ