MWONGOZO wa Makampuni

AlphaGo na AlphaZero

AlphaGo ilikuwa programu ya DeepMind iliyoshinda wachezaji bora zaidi wa Go duniani, hatua muhimu iliyofikiriwa kwa miongo kadhaa iliyopita.

dk 2 kusomaIlisasishwa mwisho

Muhtasari

AlphaZero then mastered Go, chess, and shogi entirely through self-play, learning superhuman skill from scratch.

Dive ya kina

Go ina nafasi nyingi zaidi za ubao kuliko atomi katika ulimwengu unaoonekana, na kufanya utafutaji wa nguvu usio na matumaini na uvumbuzi kuwa muhimu. Mnamo 2016, AlphaGo ilimshinda bingwa mashuhuri Lee Sedol 4-1, na wataalam wake mashuhuri wa 'Move 37' kama wabunifu wasio watu. AlphaGo ilijifunza kutoka kwa michezo ya wataalamu wa binadamu pamoja na kujicheza. Mnamo mwaka wa 2017, AlphaZero ilienda mbali zaidi: kwa kuanzia na sheria tu na hakuna data ya kibinadamu, ilijifundisha yenyewe kwa kucheza mamilioni ya michezo dhidi yake, kupita programu bora za Go, chess, na shogi ndani ya masaa kadhaa hadi siku. Mfumo wa baadaye, MuZero, hata ulijifunza sheria za michezo peke yake. Hatua hizi muhimu zilionyesha jinsi ujifunzaji wa kuimarisha pamoja na utafutaji unavyoweza kugundua mikakati zaidi ya maarifa ya binadamu.

Ufahamu wa Kiufundi

AlphaZero inachanganya mtandao wa kina wa neva na Monte Carlo Tree Search (MCTS). Mtandao hutoa sera (ambayo hatua huonekana kuwa ya kutegemewa) na thamani (ambaye ana uwezekano wa kushinda), ikiongoza utafutaji ili kuchunguza tu mistari inayofaa zaidi badala ya kila tawi. Kupitia mafunzo ya kuimarisha uchezaji wa kibinafsi, ubashiri wa mtandao na matokeo ya utafutaji huimarisha kila mmoja, na kuboreka kwa kasi. Hakuna michezo ya binadamu au kazi za tathmini zilizoundwa kwa mikono zinazohitajika, sheria tu na zawadi ya kushinda.

Athari za kimkakati

Vendor strategy

Ramani za barabara za wachuuzi huathiri vipengele ambavyo timu yako inaweza kuunda baadaye.

Cost and budget

Masharti ya kibiashara na chaguzi za kupeleka huathiri gharama na hatari ya muda mrefu.

Risk and safety

Vivutio vya kampuni hutengeneza chaguo-msingi za bidhaa, mkao wa usalama na uwazi.

Mustakabali wa AlphaGo na AlphaZero

Kichocheo cha AlphaZero, kinachojifunza kwa kujichezea kwa kuongozwa na utafutaji, sasa huathiri robotiki, ugunduzi wa kisayansi, na hoja za lugha kubwa, ambapo miundo 'hutafuta' hatua za utatuzi. Vizazi kama vile MuZero na AlphaProof hutumia mawazo haya katika kupanga bila kanuni zinazojulikana na kwa hisabati. Tarajia uchezaji wa kibinafsi na utafutaji wa miti ili kuweka mifumo dhabiti ambayo lazima ipange, kuweka mikakati, na kugundua masuluhisho mapya, yanayochanganyika zaidi na mbinu za kufikiri zinazoonekana sasa katika miundo ya AI ya mipakani.

Utekelezaji wa Ulimwengu Halisi

Washinda mabingwa wa dunia wa Go Lee Sedol (2016) na Ke Jie (2017) katika mechi muhimu

AlphaZero inajifundisha chess ya ubinadamu kwa saa nyingi, ikionyesha mawazo mapya ya kufungua na kujitolea yaliyosomwa na wakuu

MuZero ujuzi wa Go, chess, shogi na Atari bila kuambiwa sheria

Mbinu za kujichezea na kutafuta zinazovutia zinazotumika sasa katika robotiki, hesabu (AlphaProof), na hoja za LLM.

Hatari & Walinzi

Matangazo ya uzinduzi yanaweza kushinda uthabiti katika utendakazi halisi wa uzalishaji.

Bei za API au mabadiliko ya sera yanaweza kuvunja mawazo mara moja.

Utegemezi wa muuzaji mmoja huongeza gharama za kufunga na kuhama.

Ramani ya Utekelezaji

1

Tathmini watoa huduma kwa kutumia kazi na seti zako za data.

2

Kagua faragha, usalama na masharti ya kisheria kabla ya kuunganishwa.

3

Dumisha mpango mbadala kwa miundo au wachuuzi.

4

Fuatilia maelezo ya toleo ili mabadiliko ya ramani ya barabara yasiwashangaze timu.

Endelea Kuchunguza

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the AlphaGo and AlphaZero quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Anza chemsha bongo

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Mwongozo unaofuata

Mifano ya Zhipu GLM

Maswali yanayoulizwa mara kwa mara

What is AlphaGo and AlphaZero?

AlphaGo ilikuwa programu ya DeepMind iliyoshinda wachezaji bora zaidi wa Go duniani, hatua muhimu iliyofikiriwa kwa miongo kadhaa iliyopita. AlphaZero kisha akabobea Go, chess, na shogi kabisa kupitia uchezaji wa kibinafsi, kujifunza ustadi wa ubinadamu kutoka mwanzo.

Kwa nini mchezo wa Go ulizingatiwa kuwa mgumu sana kwa kompyuta?

Sababu kubwa ya Go's branching hufanya utafutaji wa nguvu usiwezekane, kwa hivyo mafanikio yalihitaji angavu iliyojifunza.

Ni nani aliyeshinda AlphaGo maarufu 4-1 mnamo 2016?

AlphaGo ilishinda bingwa wa Go Lee Sedol 4-1 katika mechi iliyotazamwa na watu wengi 2016.

AlphaZero ilijifunza vipi kucheza, tofauti na AlphaGo?

AlphaZero ilianza kutoka kwa sheria tu na ikajifunza kwa kujichezea pekee, bila data ya mchezo wa binadamu.

AlphaZero inaoanisha njia gani ya utafutaji na mtandao wake wa neva?

AlphaZero hutumia Utafutaji wa Miti wa Monte Carlo unaoongozwa na sera ya mtandao wa neva na utabiri wa thamani.

Ni mambo gani mawili ambayo mtandao wa neural wa AlphaZero unatabiri kuongoza utafutaji wake?

Matokeo ya mtandao yanayosonga yanaonekana kuahidi (sera) na makadirio ya nani atashinda (thamani), ikilenga utafutaji.