Kwiga gushimangira abakozi benshi
Multi-Agent Reinforcement Learning (MARL) itoza abakozi benshi biga basangiye ibidukikije, buriwese ahuza imyitwarire mugihe abandi nabo bahuza.
Incamake
It matters because most real-world problems — traffic, markets, teams of robots — involve many decision-makers, not one.
Kwibira cyane
Mu myigire-imwe yo gushimangira imyigire, umukozi umwe yiga politiki mugukoresha ibihembo byinshi mubidukikije. MARL yongeyeho abakozi benshi, kandi ibyo bihindura byose: duhereye kuri buri mukozi, ibidukikije ntabwo bihagaze kuko abandi bakomeza guhindura politiki yabo. Abakozi barashobora gufatanya (kugabana ibihembo byikipe, nka robo ikina umupira wamaguru), guhatana (zero-sum, nka poker cyangwa gukurikirana-guhunga), cyangwa kuvangwa. Abashakashatsi bakoresha uburyo bwimikino nkimikino ya Markov (imikino idakuka) ihuza ibikorwa byumushinga umwe wa Markov. Ibisubizo bizwi birimo AlphaStar ya DeepMind igera kuri Grandmaster muri StarCraft II na OpenAI Amakipe atanu yatsinze Dota 2 yabigize umwuga, byombi bishingiye kubaturage babakozi batojwe hagati yabo binyuze mukwikinisha.
Ubushishozi
Ikibazo cyibanze ni ukudahagarara: nkuko buri agent avugurura politiki yayo, abandi bahura nintego igenda, kubwibyo kwiga byigenga birashobora kunanirwa guhuza. Gukosora bizwi cyane ni amahugurwa yibanze hamwe no kwegereza ubuyobozi abaturage (CTDE), akoreshwa na algorithms nka MADDPG na QMIX. Mugihe cyamahugurwa, uwinegura abona ibyo abakozi bose bareba hamwe nibikorwa kugirango babare gradients zihamye, ariko mugihe cyoherejwe buri mukozi akora akoresheje ibyo yiboneye gusa - guhuza imyigire ihuriweho nibikorwa bifatika, byigenga.
Ingaruka z'Ingamba
Ibyemezo bisobanutse
Iragufasha gutandukanya ibyifuzo bya tekiniki bisobanutse nururimi rwo kwamamaza.
Igiciro na bije
Urashobora kubaza ibibazo byiza byo gushyira mubikorwa mbere yo gukoresha amafaranga cyangwa igihe.
Itsinda hamwe nakazi
Amakipe asangiye ibitekerezo akora ibicuruzwa byiza, politiki, nibyemezo byo kwiga.
Kazoza ka Multi-Agent gushimangira Kwiga
MARL igenda yerekeza kuri sisitemu nini, ifunguye cyane aho abakozi binjira bakagenda, no kugana mumakipe ya LLM ashingiye kubakozi baganira, bahagarariye, kandi bakoresha ibikoresho hamwe. Tegereza iterambere kumurimo munini w'inguzanyo (ukwiye ibihembo mumatsinda manini), protocole y'itumanaho igaragara, hamwe n'ingwate z'umutekano kubakozi bahanganye. Nkuko ibinyabiziga byigenga, imiyoboro yingufu, hamwe na sisitemu yubucuruzi bigenda bikorana, guhuza ibikorwa byinshi - no kwirinda gufatanya cyangwa guhungabanya ibitekerezo - bihinduka ikibazo cyibanze kandi kigenzura.
Gushyira mu bikorwa Isi
Guhuza amato ya robo yububiko kugirango bayobore paki batagonganye cyangwa ngo bafungire mumihanda
Kugenzura ibinyabiziga-ibimenyetso aho buri masangano ari umukozi wiga kugabanya ubwinshi bwumujyi
Umukino wamahugurwa AI nka OpenAI Batanu (Dota 2) na AlphaStar (StarCraft II) ukoresheje kwikinisha mubakozi benshi
Gucunga amasoko no gusaba igisubizo muri bateri zagabanijwe hamwe ningo mumashanyarazi meza
Ingaruka & Kurinda
Amakipe atandukanye arashobora gukoresha ijambo rimwe muburyo butandukanye, sobanura intera hakiri kare.
Ibipimo birashobora kugaragara bikomeye mugihe imikorere-yisi-itaringaniye.
Kwirengagiza ubuziranenge bwamakuru na gahunda yo gusuzuma akenshi bitanga ibisubizo byoroshye.
Igishushanyo mbonera
Tangira nururimi rusobanutse rwibisubizo ukeneye.
Toranya intsinzi imwe hamwe nuburyo bumwe bwo gutsindwa mbere yo kwipimisha.
Koresha umuderevu muto hamwe namakuru ahagarariye, ntabwo ari demo yashizweho.
Inyandiko aho Multi-Agent Reinforcement Kwiga ifasha kandi nuburyo bworoshye bworoshye.
Komeza Ubushakashatsi
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Multi-Agent Reinforcement Learning quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Ubuyobozi bukurikira
Kwiga gushimangira
Ibibazo bikunze kubazwa
What is Multi-Agent Reinforcement Learning?
Multi-Agent Reinforcement Learning (MARL) itoza abakozi benshi biga basangiye ibidukikije, buriwese ahuza imyitwarire mugihe abandi nabo bahuza. Nibyingenzi kuko ibibazo byinshi byukuri-isi - traffic, amasoko, amakipe ya robo - arimo abafata ibyemezo benshi, ntabwo arimwe.
Niki gituma ibidukikije 'bidahagarara' uhereye kumukozi umwe muri MARL?
Kuberako buri mukozi avugurura politiki yayo mugihe cyamahugurwa, buri mukozi ahura neza nintego yimuka - ibidukikije bigenda bihinduka nkuko abandi biga.
Bisobanura iki 'amahugurwa yibanze hamwe no kwegereza ubuyobozi abaturage' (CTDE) bisobanura iki?
Uburyo bwa CTDE nka MADDPG na QMIX bakoresha amakuru yisi yose kugirango bige neza, mugihe buri agent akora akoresheje ibyo yitegereje gusa.
Ni ubuhe buryo bw'imibare bushyira hamwe umukozi umwe MDP kubakozi benshi?
Imikino ya Markov (nanone yitwa imikino idakuka) yagura MDPs mugukora ibikorwa hamwe nibihembo kuri buri agent mubafata ibyemezo byinshi.
Mubufatanye bwa MARL gusa, ni gute ibihembo bisanzwe byubatswe?
Igenamigambi rya koperative riha abakozi intego imwe, bityo ikibazo gihinduka guhuza ibikorwa no gutanga inguzanyo mumatsinda.
Nubuhe buryo bwo kureka sisitemu nka OpenAI Batanu na AlphaStar gutera imbere nta makuru yimikino yabantu?
Kwikinisha-kwibumbira mubikorwa birwanya verisiyo yabo ubwabo, gukora integanyanyigisho yikora yabarwanya bakomeye.