AMABWIRIZA Yibanze

Kwiga gushimangira abakozi benshi

Multi-Agent Reinforcement Learning (MARL) itoza abakozi benshi biga basangiye ibidukikije, buriwese ahuza imyitwarire mugihe abandi nabo bahuza.

2 min somaIbiherutse kuvugururwa

Incamake

It matters because most real-world problems — traffic, markets, teams of robots — involve many decision-makers, not one.

Kwibira cyane

Mu myigire-imwe yo gushimangira imyigire, umukozi umwe yiga politiki mugukoresha ibihembo byinshi mubidukikije. MARL yongeyeho abakozi benshi, kandi ibyo bihindura byose: duhereye kuri buri mukozi, ibidukikije ntabwo bihagaze kuko abandi bakomeza guhindura politiki yabo. Abakozi barashobora gufatanya (kugabana ibihembo byikipe, nka robo ikina umupira wamaguru), guhatana (zero-sum, nka poker cyangwa gukurikirana-guhunga), cyangwa kuvangwa. Abashakashatsi bakoresha uburyo bwimikino nkimikino ya Markov (imikino idakuka) ihuza ibikorwa byumushinga umwe wa Markov. Ibisubizo bizwi birimo AlphaStar ya DeepMind igera kuri Grandmaster muri StarCraft II na OpenAI Amakipe atanu yatsinze Dota 2 yabigize umwuga, byombi bishingiye kubaturage babakozi batojwe hagati yabo binyuze mukwikinisha.

Ubushishozi

Ikibazo cyibanze ni ukudahagarara: nkuko buri agent avugurura politiki yayo, abandi bahura nintego igenda, kubwibyo kwiga byigenga birashobora kunanirwa guhuza. Gukosora bizwi cyane ni amahugurwa yibanze hamwe no kwegereza ubuyobozi abaturage (CTDE), akoreshwa na algorithms nka MADDPG na QMIX. Mugihe cyamahugurwa, uwinegura abona ibyo abakozi bose bareba hamwe nibikorwa kugirango babare gradients zihamye, ariko mugihe cyoherejwe buri mukozi akora akoresheje ibyo yiboneye gusa - guhuza imyigire ihuriweho nibikorwa bifatika, byigenga.

Ingaruka z'Ingamba

Ibyemezo bisobanutse

Iragufasha gutandukanya ibyifuzo bya tekiniki bisobanutse nururimi rwo kwamamaza.

Igiciro na bije

Urashobora kubaza ibibazo byiza byo gushyira mubikorwa mbere yo gukoresha amafaranga cyangwa igihe.

Itsinda hamwe nakazi

Amakipe asangiye ibitekerezo akora ibicuruzwa byiza, politiki, nibyemezo byo kwiga.

Kazoza ka Multi-Agent gushimangira Kwiga

MARL igenda yerekeza kuri sisitemu nini, ifunguye cyane aho abakozi binjira bakagenda, no kugana mumakipe ya LLM ashingiye kubakozi baganira, bahagarariye, kandi bakoresha ibikoresho hamwe. Tegereza iterambere kumurimo munini w'inguzanyo (ukwiye ibihembo mumatsinda manini), protocole y'itumanaho igaragara, hamwe n'ingwate z'umutekano kubakozi bahanganye. Nkuko ibinyabiziga byigenga, imiyoboro yingufu, hamwe na sisitemu yubucuruzi bigenda bikorana, guhuza ibikorwa byinshi - no kwirinda gufatanya cyangwa guhungabanya ibitekerezo - bihinduka ikibazo cyibanze kandi kigenzura.

Gushyira mu bikorwa Isi

Guhuza amato ya robo yububiko kugirango bayobore paki batagonganye cyangwa ngo bafungire mumihanda

Kugenzura ibinyabiziga-ibimenyetso aho buri masangano ari umukozi wiga kugabanya ubwinshi bwumujyi

Umukino wamahugurwa AI nka OpenAI Batanu (Dota 2) na AlphaStar (StarCraft II) ukoresheje kwikinisha mubakozi benshi

Gucunga amasoko no gusaba igisubizo muri bateri zagabanijwe hamwe ningo mumashanyarazi meza

Ingaruka & Kurinda

Amakipe atandukanye arashobora gukoresha ijambo rimwe muburyo butandukanye, sobanura intera hakiri kare.

Ibipimo birashobora kugaragara bikomeye mugihe imikorere-yisi-itaringaniye.

Kwirengagiza ubuziranenge bwamakuru na gahunda yo gusuzuma akenshi bitanga ibisubizo byoroshye.

Igishushanyo mbonera

1

Tangira nururimi rusobanutse rwibisubizo ukeneye.

2

Toranya intsinzi imwe hamwe nuburyo bumwe bwo gutsindwa mbere yo kwipimisha.

3

Koresha umuderevu muto hamwe namakuru ahagarariye, ntabwo ari demo yashizweho.

4

Inyandiko aho Multi-Agent Reinforcement Kwiga ifasha kandi nuburyo bworoshye bworoshye.

Komeza Ubushakashatsi

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Multi-Agent Reinforcement Learning quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Tangira ikibazo

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Ubuyobozi bukurikira

Kwiga gushimangira

Ibibazo bikunze kubazwa

What is Multi-Agent Reinforcement Learning?

Multi-Agent Reinforcement Learning (MARL) itoza abakozi benshi biga basangiye ibidukikije, buriwese ahuza imyitwarire mugihe abandi nabo bahuza. Nibyingenzi kuko ibibazo byinshi byukuri-isi - traffic, amasoko, amakipe ya robo - arimo abafata ibyemezo benshi, ntabwo arimwe.

Niki gituma ibidukikije 'bidahagarara' uhereye kumukozi umwe muri MARL?

Kuberako buri mukozi avugurura politiki yayo mugihe cyamahugurwa, buri mukozi ahura neza nintego yimuka - ibidukikije bigenda bihinduka nkuko abandi biga.

Bisobanura iki 'amahugurwa yibanze hamwe no kwegereza ubuyobozi abaturage' (CTDE) bisobanura iki?

Uburyo bwa CTDE nka MADDPG na QMIX bakoresha amakuru yisi yose kugirango bige neza, mugihe buri agent akora akoresheje ibyo yitegereje gusa.

Ni ubuhe buryo bw'imibare bushyira hamwe umukozi umwe MDP kubakozi benshi?

Imikino ya Markov (nanone yitwa imikino idakuka) yagura MDPs mugukora ibikorwa hamwe nibihembo kuri buri agent mubafata ibyemezo byinshi.

Mubufatanye bwa MARL gusa, ni gute ibihembo bisanzwe byubatswe?

Igenamigambi rya koperative riha abakozi intego imwe, bityo ikibazo gihinduka guhuza ibikorwa no gutanga inguzanyo mumatsinda.

Nubuhe buryo bwo kureka sisitemu nka OpenAI Batanu na AlphaStar gutera imbere nta makuru yimikino yabantu?

Kwikinisha-kwibumbira mubikorwa birwanya verisiyo yabo ubwabo, gukora integanyanyigisho yikora yabarwanya bakomeye.