AlphaGo na AlphaZero
AlphaGo ilikuwa programu ya DeepMind iliyoshinda wachezaji bora zaidi wa Go duniani, hatua muhimu iliyofikiriwa kwa miongo kadhaa iliyopita.
Muhtasari
AlphaZero then mastered Go, chess, and shogi entirely through self-play, learning superhuman skill from scratch.
Dive ya kina
Go ina nafasi nyingi zaidi za ubao kuliko atomi katika ulimwengu unaoonekana, na kufanya utafutaji wa nguvu usio na matumaini na uvumbuzi kuwa muhimu. Mnamo 2016, AlphaGo ilimshinda bingwa mashuhuri Lee Sedol 4-1, na wataalam wake mashuhuri wa 'Move 37' kama wabunifu wasio watu. AlphaGo ilijifunza kutoka kwa michezo ya wataalamu wa binadamu pamoja na kujicheza. Mnamo mwaka wa 2017, AlphaZero ilienda mbali zaidi: kwa kuanzia na sheria tu na hakuna data ya kibinadamu, ilijifundisha yenyewe kwa kucheza mamilioni ya michezo dhidi yake, kupita programu bora za Go, chess, na shogi ndani ya masaa kadhaa hadi siku. Mfumo wa baadaye, MuZero, hata ulijifunza sheria za michezo peke yake. Hatua hizi muhimu zilionyesha jinsi ujifunzaji wa kuimarisha pamoja na utafutaji unavyoweza kugundua mikakati zaidi ya maarifa ya binadamu.
Ufahamu wa Kiufundi
AlphaZero inachanganya mtandao wa kina wa neva na Monte Carlo Tree Search (MCTS). Mtandao hutoa sera (ambayo hatua huonekana kuwa ya kutegemewa) na thamani (ambaye ana uwezekano wa kushinda), ikiongoza utafutaji ili kuchunguza tu mistari inayofaa zaidi badala ya kila tawi. Kupitia mafunzo ya kuimarisha uchezaji wa kibinafsi, ubashiri wa mtandao na matokeo ya utafutaji huimarisha kila mmoja, na kuboreka kwa kasi. Hakuna michezo ya binadamu au kazi za tathmini zilizoundwa kwa mikono zinazohitajika, sheria tu na zawadi ya kushinda.
Athari za kimkakati
Vendor strategy
Ramani za barabara za wachuuzi huathiri vipengele ambavyo timu yako inaweza kuunda baadaye.
Cost and budget
Masharti ya kibiashara na chaguzi za kupeleka huathiri gharama na hatari ya muda mrefu.
Risk and safety
Vivutio vya kampuni hutengeneza chaguo-msingi za bidhaa, mkao wa usalama na uwazi.
Mustakabali wa AlphaGo na AlphaZero
Kichocheo cha AlphaZero, kinachojifunza kwa kujichezea kwa kuongozwa na utafutaji, sasa huathiri robotiki, ugunduzi wa kisayansi, na hoja za lugha kubwa, ambapo miundo 'hutafuta' hatua za utatuzi. Vizazi kama vile MuZero na AlphaProof hutumia mawazo haya katika kupanga bila kanuni zinazojulikana na kwa hisabati. Tarajia uchezaji wa kibinafsi na utafutaji wa miti ili kuweka mifumo dhabiti ambayo lazima ipange, kuweka mikakati, na kugundua masuluhisho mapya, yanayochanganyika zaidi na mbinu za kufikiri zinazoonekana sasa katika miundo ya AI ya mipakani.
Utekelezaji wa Ulimwengu Halisi
Washinda mabingwa wa dunia wa Go Lee Sedol (2016) na Ke Jie (2017) katika mechi muhimu
AlphaZero inajifundisha chess ya ubinadamu kwa saa nyingi, ikionyesha mawazo mapya ya kufungua na kujitolea yaliyosomwa na wakuu
MuZero ujuzi wa Go, chess, shogi na Atari bila kuambiwa sheria
Mbinu za kujichezea na kutafuta zinazovutia zinazotumika sasa katika robotiki, hesabu (AlphaProof), na hoja za LLM.
Hatari & Walinzi
Matangazo ya uzinduzi yanaweza kushinda uthabiti katika utendakazi halisi wa uzalishaji.
Bei za API au mabadiliko ya sera yanaweza kuvunja mawazo mara moja.
Utegemezi wa muuzaji mmoja huongeza gharama za kufunga na kuhama.
Ramani ya Utekelezaji
Tathmini watoa huduma kwa kutumia kazi na seti zako za data.
Kagua faragha, usalama na masharti ya kisheria kabla ya kuunganishwa.
Dumisha mpango mbadala kwa miundo au wachuuzi.
Fuatilia maelezo ya toleo ili mabadiliko ya ramani ya barabara yasiwashangaze timu.
Endelea Kuchunguza
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the AlphaGo and AlphaZero quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Mwongozo unaofuata
Mifano ya Zhipu GLM
Maswali yanayoulizwa mara kwa mara
What is AlphaGo and AlphaZero?
AlphaGo ilikuwa programu ya DeepMind iliyoshinda wachezaji bora zaidi wa Go duniani, hatua muhimu iliyofikiriwa kwa miongo kadhaa iliyopita. AlphaZero kisha akabobea Go, chess, na shogi kabisa kupitia uchezaji wa kibinafsi, kujifunza ustadi wa ubinadamu kutoka mwanzo.
Kwa nini mchezo wa Go ulizingatiwa kuwa mgumu sana kwa kompyuta?
Sababu kubwa ya Go's branching hufanya utafutaji wa nguvu usiwezekane, kwa hivyo mafanikio yalihitaji angavu iliyojifunza.
Ni nani aliyeshinda AlphaGo maarufu 4-1 mnamo 2016?
AlphaGo ilishinda bingwa wa Go Lee Sedol 4-1 katika mechi iliyotazamwa na watu wengi 2016.
AlphaZero ilijifunza vipi kucheza, tofauti na AlphaGo?
AlphaZero ilianza kutoka kwa sheria tu na ikajifunza kwa kujichezea pekee, bila data ya mchezo wa binadamu.
AlphaZero inaoanisha njia gani ya utafutaji na mtandao wake wa neva?
AlphaZero hutumia Utafutaji wa Miti wa Monte Carlo unaoongozwa na sera ya mtandao wa neva na utabiri wa thamani.
Ni mambo gani mawili ambayo mtandao wa neural wa AlphaZero unatabiri kuongoza utafutaji wake?
Matokeo ya mtandao yanayosonga yanaonekana kuahidi (sera) na makadirio ya nani atashinda (thamani), ikilenga utafutaji.