Xaajale GPU yu bari
Multi-Instance GPU (MIG) xarala NVIDIA la buy dagg benn GPU physique ci xaaj hardware yu bari yuñ tàqale.
Résumé
It matters because it lets one expensive accelerator serve many small workloads at once without them interfering with each other.
Plongeur bu xóot
Ñu ngi ko dugal ci NVIDIA A100 (Ampere) ba noppi wéyal ko ci H100 ak GPU yu bees yi, MIG dafay xaaj GPU ci juróom ñaari instance yu moom seen bopp. MIG wuute na ak losisel biy dagg waxtu, ndax dafay joxe isolation hardware bu dëggu: instance bu nekk amna multiprocesseur (SMs) boppam, daggitu cache L2, daggitu mémoire, ak daggitu mémoire bu am bandwidth bu kawe. A100 bu am 40GB mën nañu ko xaaj juróom ñaari instance yu 5GB, wala yu gëna néew yu gëna mag. Partition bu nekk dafay doxalee ni GPU bu gëna ndaw, kon liggéey bu bari bruit wala bu tass ci benn instance mënul xiifloo wala yàq beneen. Kalite-serwiis buñ garanti bi moo tax MIG nekk lu baax ci serwiis inference, cluster yu bari-luwekat, ak environmaa developpement yu jëfandikukat yu bari bokk benn kàrt.
Gis-gis xarala
MIG dafay liggéey ci gating physiquement crossbar bi ci biir GPU bi suko defee instance bu nekk am yoon wi koy yóbbu ci memory slice ak SMs. NVIDIA dafay màndargaal profil yi ni ay fraksioŋ yu melni 1g.5gb (benn xaaj ordinatër, 5GB) ba 7g.40gb. GPU instance dafay denc mémoire ak SMs; ci biir benn Instance Compute dafay xaaj SM yi gëna. Ndax xaaj yi dañuy tënku ci hardware, njuumte yi, njuumti ECC yi, ak yaatuwaayu bandwidth memory bi dañuy des ci benn instance.
njeextalu pexe
Njëgg ak budget
Dogal yi architecture di jël dañuy indi njariñ ak njëgu liggéey bi ay at ci ginaaw.
dogal yu gëna leer
Njàngalem xarala yi dafay jàppale ekip yi ñu tànn li gën, te baña yam ci li gëna bees daal.
Xool kalite
Tanneef yu gëna baax ci wàllu ingeñër dina wàññi jafe-jafe yi ci wàllu wóor ci liggéey bi.
Ëlëgu xaaj GPU yu bari
Lu GPU yi di màgg ba yegg ci 80GB, 141GB, ak ginaaw, xaaj bi dafay gëna yéeme ndax model yi benn-benn soxlawul kàrt bu mat ngir mëna def ay doggal. Xaarandil Kubernetes bu gëna dëgër ak mboolem cloud, xaaj bu bees te du yàq node bi, ak profil yu gëna dëgër. Jaaykat yiy joŋante ñu ngi topp virtualisation GPU bu nuru SR-IOV, ak platform inference yu amul serwër ñu ngi gëna yéem ci xaaj ngir pack model yu bari yu dëgër te dagg mbalit mi.
Doxal ci àdduna dëgg
Benn fournisseur cloud dafay xaaj benn A100 ci juróom ñaari instance suko defee juróom ñaari kiliyaan yi ku nekk am benn GPU buñ garanti, buñ tàqale ngir inference.
Ab kuréel gëstukat bu daara ju kawe dafay jox ndongo bu nekk ci PhD yi 10GB MIG ngir prototyping ludul monopolise kàrt lëmm.
Benn sarwiisu inference dafay boole làkk yu ndaw yu bari ak modeli gis-gis ci benn H100, bu nekk ci xaaj boppam ak latency buñu mëna seetlu.
Benn cluster Kubernetes dafay siiwal misaali MIG ni ay jumtukaay yuñ mëna waajal, moo tax pod yi dañuy laaj 'nvidia.com/mig-1g.5gb' ni yeneen jumtukaay yi.
Risk yi ak balustrade yi
Optimize benn benchmark mën na nëbb ñakk kattan yu gëna yaatu ci sistem bi.
Njëg li ñuy fay ci infrastructure yi ak ci toppatoo dañuy faral di suufeel.
Bu sistem yi di gëna xawa jafee xam, jafe-jafe yi am ci wàllu kaaraange ak seetlu mën nañu gëna bari.
Roadmap ngir samp gi
Mandargal latency, kalite, ak njëg yi laata ngay jëfandikoo.
Benchmark ci biir sargal ak done yu dëggu.
Jumtukaay bi di saytu njuumte yi, derive bi ak njeextalu jëfandikukat bi.
Waajal rollback ak yooni tontu ci jafe-jafe yi laata ngay eskale.
Weyal di banneexu
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Multi-Instance GPU Partitioning quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Gis bi ci topp
Jàng liggéey yu bari
Laaj yi ñuy faral di laaj
What is Multi-Instance GPU Partitioning?
Multi-Instance GPU (MIG) xarala NVIDIA la buy xaaj benn GPU physique ci xaaj hardware yu bari yuñ tàqale. Dafa am solo ndax dafay tax benn accelerator bu seer mëna def ay liggéey yu ndaw yu bari ci benn yoon te duñu jaxasoo seen biir.
Ban xeetu tàqale la MIG di joxe ci diggante instans yi?
MIG dafay fexe ñu baña bokk ci hardware bi, di jox SMs, L2 cache slices, ak mémoire ci instance bu nekk suko defee liggéey bi baña mëna jàpp.
Ci ban architecture NVIDIA lañu njëkka dugal MIG?
MIG mingi njëkka am A100 bu sukkandiko ci Ampere ba noppi wéyal ci H100 ginaaw ga GPU yu santaru done yi.
Lan mooy limu instance yi gëna bari yuñ mëna xaaj GPU bu mëna MIG?
GPU bu mëna MIG lu melni A100 mën nañu ko xaaj juróom ñaari instance yu moom seen bopp.
Ci profil MIG bu melni '1g.5gb', lan la '5gb' di tekki?
Profil bi dafay kode ay daggitu ordinatër (1g) ak mémoire buñ jagleel (5GB) biñ jox instance bi.
Ban liggéey la MIG gëna méngoo?
MIG dafay leer sudee ay liggéey yu ndaw yu bari (lu melni inference) bokk benn kàrt bu am kalite serwiis buñ garanti.