FP8 iyo Qaababka Saxan-hoose
FP8 waa qaab nambar 8-bit ah oo sabeynaya-dhibcaha kaas oo u ogolaanaya moodooyinka AI inay kaydiyaan miisaanka oo ay ku shaqeeyaan xisaabta iyaga oo isticmaalaya rubuc ka mid ah xusuusta tirooyinka 32-bit ee caadiga ah.
Dulmar
It is a key trick for making giant models cheaper and faster to train and serve.
quusid qoto dheer
Shabakadaha neerfaha ayaa ka samaysan balaayiin tirooyin ah. Dhaqan ahaan tirooyinkaasi waxay isticmaali jireen 32 bits (FP32) ama 16 bits (FP16/BF16) midkiiba. FP8 waxa ay ku soo koobtaa 8-bit oo kaliya, iyada oo jaraysa xusuusta iyo xadhkaha xadhkaha goos gooska qiyaas ahaan kala badh iyo 16-bit. Waxa jira laba qaab oo FP8 ah oo caadi ah: E4M3 (4 jibbaaran, 3 mantissa bits) waxa ay ku siinayaa sax badan laakiin kala duwanaansho yar Ganacsigu waa daacadnimo: xoogaa yar macnaheedu waa khaladaad soo koobid. Si loo saxo, qaab-dhismeedyadu waxay khuseeyaan qodobbada is-miidaaminta-bax-bararka ama xannibaadda kasta kuwaas oo dib u cabbiraya qiyamka FP8 ee baaxadda la isticmaali karo. NVIDIA's Hopper iyo Blackwell GPUs ayaa ku daray qalabka FP8 matrix matrixka, taas oo ka dhigaysa mid wax ku ool ah labadaba tababarka iyo ka-fiirsashada. Qaababka cusub sida MXFP8, MXFP4, iyo NVFP4 ayaa xitaa hoos u riixaya baloogyada cabbira-yar ee la wadaago.
Aragtida Farsamada
Caqabada FP8 waa kala duwanaansho firfircoon. Iyada oo kaliya in yar oo jibbaaran, hawlqabadyo waaweyn ama yaryar ayaa buux dhaafiyey ama hoos ugu qulqulaya eber. Hagaajintu waa miisaan: ku dhufo tensor qodob si ay qiyamkeedu ugu soo degaan daaqada FP8 ee la matali karo, samee FP8-ku-dhufashada, ka dibna dib u kala qaybi, badi ururinta qayb qayb ahaan si sax ah (FP16/FP32). E4M3 waxaa sida caadiga ah loo isticmaalaa miisaanka iyo firfircoonida, E5M2 ee gradients halkaas oo kala duwanaansho arrimo ka badan sax ah.
Saamaynta Istiraatijiyadeed
Qiimaha iyo miisaaniyada
Go'aamada qaab-dhismeedku waxay horseedaan waxqabadka iyo kharashka hawlgalka sannadaha.
Go'aamo cad
Waxbarashada farsamada waxay ka caawisaa kooxaha inay doortaan xidhmo sax ah, ma aha oo kaliya kan ugu cusub.
Xakamaynta tayada
Doorashooyinka injineernimada ee wanaagsan waxay yareeyaan shilalka la isku halleyn karo ee wax soo saarka.
Mustaqbalka FP8 iyo qaababka saxda ah ee hooseeya
Saxnimadu hoos ayay u socotaa. Ka dib markii FP8 ay timid 4-bit qaabab-cabbir-yar-yar ah (MXFP4, NVFP4) kuwaas oo xirxiran cabbir yar oo la wadaago halkii baloog yar, iyo qalabka Blackwell hadda wuxuu si toos ah u dardargeliyaa FP4. Filo cuntooyin isku-dhafan oo sax ah halka lakabyo kala duwan ay isticmaalaan qaybo-ballaadhyo kala duwan, oo ay weheliso tababbarka qiyaas-oggolaanshaha ka wanaagsan si 4-bit ay u noqoto mid ku habboon fikradda. Ciyaarta dhamaadka ah waxa ay ku tuujinaysaa moodooyinka cabirka xuduudka oo ku dulsaaraya jajabyo ka yar, jaban oo aan lahayn lumin tayada la qiyaasi karo.
Dhaqangelinta Adduunka-dhabta ah
Tababarka moodooyinka luqadaha waaweyn ee NVIDIA Hopper/Blackwell GPUs iyadoo la adeegsanayo FP8 si qiyaas ahaan labanlaab wax-soo-saarka loo barbardhigo BF16
U adeegida fikradda chatbot ee FP8 sidaa darteed moodalku wuxuu ku habboon yahay GPU-yo yar wuxuuna ka jawaabayaa codsiyo badan ilbiriqsikii
Isticmaalka E5M2 ee isgaadhsiinta tartiib tartiib ah inta lagu jiro tababarka la qaybiyay si loo gooyo xawaaraha shabakada inta u dhaxaysa noodhadhka
Gelinaya moodooyinka MXFP4/NVFP4 si ay ugu habboonaadaan moodal-xadeedka hal GPU-xusuus sare oo raqiis ah
Khatarta & Dariiqyada Ilaalada
Hagaajinta hal bartilmaameed waxay qarin kartaa daciifnimada nidaamka ballaaran.
Kaabayaasha dhaqaalaha iyo dayactirka inta badan waa la dhayalsadaa.
Nabadgelyada iyo daldaloolada u fiirsashada ayaa kori kara marka nidaamyadu noqdaan kuwo aad u adag.
Qorshe Hawleedka Dhaqangelinta
Qeex daahida, tayada, iyo bartilmaameedyada qiimaha ka hor inta aan la hirgelin.
Benchmark marka la eego culeyska dhabta ah iyo xaaladaha xogta.
La socodka qalabka khaladaadka, leexashada, iyo saamaynta isticmaalaha.
U diyaari dib-u-noqoshada iyo dariiqyada jawaab-celinta dhacdada ka hor inta aanad miisaan.
Sii wad Sahaminta
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the FP8 and Low-Precision Formats quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Hagaha xiga
Qaababka Taxanaha Model
Su'aalaha soo noqnoqda
What is FP8 and Low-Precision Formats?
FP8 waa qaab nambar 8-bit ah oo sabeynaya-dhibcaha kaas oo u ogolaanaya moodooyinka AI inay kaydiyaan miisaanka oo ay ku shaqeeyaan xisaabta iyaga oo isticmaalaya rubuc ka mid ah xusuusta tirooyinka 32-bit ee caadiga ah. Waa khiyaamo fure u ah samaynta moodooyinka waaweyn ee ka raqiisan oo degdeg ah si loo tababaro loona adeego.
Immisa xabbo ayuu nambarka FP8 adeegsadaa marka la barbar dhigo lambarka caadiga ah ee FP32?
FP8 waxa ay isticmaashaa 8 bits halka FP32 ay isticmaasho 32 bits, marka FP8 waxa ay qaadataa hal rubuc kaydinta iyo baaxada baaxada leh.
Maxay yihiin calaamadaha 'E4M3' iyo 'E5M2' waxay qeexayaan qaabka FP8?
E4M3 macnaheedu waa 4 jibbaaran iyo 3 xabbo oo mantissa ah; E5M2 macnaheedu waa 5 jibbaaran iyo 2 mantissa bits. Qaybo jibbaaro badan ayaa balaadhiya kala duwanaanshaha; qaybo badan oo mantissa ah waxay ku daraan sax.
Waa maxay sababta dhuumaha FP8 u adeegsadaan qodobbada is-qarinta tenorsada?
Iyada oo tiro yar oo jibbaaran ah, qiyamka waaweyn ayaa buuxdhaafay iyo kuwa yaryar oo ku qulqulaya eber. Isku-dheellitirku waxay dib-u-eegis ku samaynaysaa teendhada FP8 daaqadda la isticmaali karo ka hor xisaabta.
Waa kuwee ganacsi dhimisteeda ugu weyn ee isticmaalka FP8?
Qaybo ka yar macneheedu waa matalaad adag iyo qalad wareeg ah oo badan. Faa'idadu aad ayay uga yar tahay xusuusta iyo baaxadda baaxadda, iyo xisaabta degdegga ah ee qalabka la taageeray.
Jiilkee NVIDIA GPU markii ugu horreysay ku daray taageerada qalabeed ee u go'ay xisaabta matrix FP8?
GPU-yada ku salaysan Hopper sida H100 waxay soo bandhigtay taageerada FP8 Tensor Core, Blackwell ayaana markii dambe tan ku kordhisay FP4.