Rekọja si akoonu
Kọ́ ẹ̀kọ́
Ìròyìn
Irinṣẹ́
Iṣẹ́
Iṣẹ́ wa
Wa
⌘K
English
Ṣètọrẹ
Akojọ aṣyn
Bẹrẹ nibi
Bẹrẹ ẹkọ
Kọ́ ẹ̀kọ́
Lọ si Kọ́ ẹ̀kọ́
Awọn iṣẹ ikẹkọ
Ìtọ́nisọ́nà
Olùkọ́ AI
Prompt ìkàwé
Ìdánwò
Ìjẹ́risi
Ìwé ọ̀rọ̀
Ìròyìn
Lọ si Ìròyìn
Titun AI iroyin
Awọn olutọpa koko
Iwadi ati awọn data
Blog
Ìlànà ìtẹ̀jáde
Àtúnṣe
Irinṣẹ́
Lọ si Irinṣẹ́
Ilana irinṣẹ
Ti o dara ju-ti awọn akojọ
Ṣe afiwe awọn irinṣẹ
Iye owo isiro
Refiner kiakia
Fi irinṣẹ́ AI ranṣẹ́
Iṣẹ́
Lọ si Iṣẹ́
Ṣawakiri awọn iṣẹ AI
Firanṣẹ iṣẹ kan
Onigbowo AIU
Iṣẹ́ wa
Lọ si Iṣẹ́ wa
Iṣẹ́ wa
Ipa & awọn iṣiro
Awọn onkọwe
Help center
Ohun ti o jẹ titun
Àtìlẹ́yìn
Ṣètọrẹ
Ile
/
Ìwé ìtumọ̀ ọ̀rọ̀
/
Ẹkọ imudara
AI Gilosari Igba
Kini
Ẹkọ imudara
?
Itumọ
Ikẹkọ nipasẹ awọn ami ẹsan nibiti aṣoju kan kọ awọn iṣe ti o mu ipadabọ igba pipẹ pọ si.
Awọn ofin ti o jọmọ
Ẹ̀kọ́ Ìmúpadàbọ̀sípò látinú Ìdánilójú Ènìyàn (RLHF)
Ọna ikẹkọ ti o lo awọn ifihan agbara ayanfẹ eniyan lati ṣe apẹrẹ ihuwasi awoṣe.
Awoṣe Ere
Awoṣe ti o ṣe iṣiro awọn abajade ti o da lori awọn ifihan agbara ayanfẹ, nigbagbogbo lo ninu awọn paipu RLHF.
AI Aṣoju
Eto sọfitiwia ti o le ṣe akiyesi, ronu, ati ṣe awọn iṣe lati ṣaṣeyọri ibi-afẹde kan, nigbagbogbo lilo awọn irinṣẹ ati iranti.
t'olofin AI
Idanileko ati ọna apẹrẹ ihuwasi nibiti awọn abajade awoṣe jẹ itọsọna nipasẹ eto ti o wa titi ti awọn ipilẹ kikọ.
Yipo aṣoju
Iwọn aṣetunṣe nibiti aṣoju AI ṣe akiyesi, gbero, ṣe iṣe, ati tan imọlẹ titi yoo fi pari ibi-afẹde kan tabi de ipo iduro kan.
DPO (Imudara Iyanfẹ Taara)
Ọna ikẹkọ ti o ṣe atunṣe awọn awoṣe taara taara lori awọn orisii ayanfẹ laisi nilo awoṣe ere lọtọ.
Kọ ẹkọ diẹ sii ninu awọn itọsọna ọfẹ wa
Deep Learning
Reinforcement Learning
Machine Learning Basics
Supervised Learning
Wo tun
Red Teaming
Recommendation System
Retrieval
Recall
RAG (Retrieval-Augmented Generation)
Robustness
Quantization
Safety Filter
Previous
Red Teaming
Next
Reinforcement Learning from Human Feedback (RLHF)
Ṣawakiri ni kikun AI Gilosari
Ṣawari gbogbo awọn itọsọna AI ọfẹ