UMHLAHLANDLELA Wobuchwepheshe

FP8 kanye namafomethi anembe eliphansi

I-FP8 iyifomethi yenombolo yephoyinti elintantayo engu-8-bit evumela amamodeli e-AI ukuthi agcine izisindo futhi asebenzise izibalo esebenzisa ingxenye yesine yenkumbulo yezinombolo ezijwayelekile ezingamabhithi angu-32.

2 amaminithi ukufundaIgcine ukubuyekezwa

Uhlolojikelele

It is a key trick for making giant models cheaper and faster to train and serve.

I-Deep Dive

Amanethiwekhi e-Neural enziwe ngezigidigidi zezinombolo. Ngokwesiko lezo zinombolo zazisebenzisa amabhithi angu-32 (FP32) noma amabhithi angu-16 (FP16/BF16) ngayinye. I-FP8 iwashwabanisa abe amabhithi angu-8 kuphela, inqamula inkumbulo kanye nomkhawulokudonsa cishe uhhafu uma uqhathaniswa no-16-bit. Kunezakhiwo ezimbili ezivamile ze-FP8: I-E4M3 (ama-exponent bits, 3 mantissa bits) inikeza ukunemba okwengeziwe kodwa ububanzi obuncane, futhi i-E5M2 (i-exponent 5, 2 mantissa) inikeza ububanzi obubanzi kodwa izinyathelo ezimaholoholo. Ukuhwebelana kungukuthembeka: izingcezu ezimbalwa zisho amaphutha okusondeza. Ukuze kuhlale kunembile, izinhlaka zisebenzisa i-tensor ngayinye noma ibhlokhi ngayinye ezikala amanani zibe ibanga elisebenzisekayo le-FP8. I-NVIDIA's Hopper kanye ne-Blackwell GPUs yengeze izinjini ze-matrix ze-hardware ze-FP8, ziyenza isebenze kukho kokubili ukuqeqeshwa nokuchazwa. Amafomethi amasha afana ne-MXFP8, MXFP4, ne-NVFP4 aphusha ngisho naphansi ngamabhulokhi okukala amancane okwabelwana ngawo.

I-Technical Insight

Inselele ye-FP8 ububanzi obuguqukayo. Ngamabhithi ama-eksponenti ambalwa kuphela, ukwenza kusebenze okukhulu noma okuncane kuyachichima noma kudlulele kuqanda. Ukulungiswa kuwukukala: phindaphinda i-tensor nge-factor ukuze amanani ayo ahlale efasiteleni elimelelekayo le-FP8, yenza i-FP8 iphindaphindeke, bese ihlukanisa iphinde ikhiphe, ngokuvamile iqongelela isamba semali esiyingxenye ngokunemba okuphezulu (FP16/FP32). I-E4M3 ivamise ukusetshenziselwa izisindo nokwenza kusebenze, i-E5M2 yamagradient lapho ububanzi bubaluleke kakhulu kunokunemba.

I-Strategic Impact

Izindleko kanye nesabelomali

Izinqumo zezakhiwo ziqhuba ukusebenza kanye nezindleko zokusebenza iminyaka.

Izinqumo ezicacile

Imfundo yobuchwepheshe isiza amaqembu ukuthi akhethe isitaki esifanele, hhayi nje esisha.

Ukulawulwa kwekhwalithi

Izinketho ezingcono zobunjiniyela zinciphisa izehlakalo ezinokwethenjelwa ekukhiqizeni.

Ikusasa le-FP8 kanye namafomethi anembe eliphansi

Ukunemba kugijimela phansi. Ngemuva kwe-FP8 kufike amafomethi we-4-bit micro-scaling (MXFP4, NVFP4) apakisha isikali esabiwe esincane ngebhulokhi ngayinye encane, kanye ne-Blackwell hardware manje isheshisa i-FP4 ngokuqondile. Lindela amaresiphi anembe okuxubile lapho izendlalelo ezihlukene zisebenzisa ububanzi bebhithi obuhlukile, kanye nokuqeqeshwa okungcono kokwazi ukulinganisa ukuze i-4-bit ibe yiyona ndlela ezenzakalelayo yokucabanga. Isiphetho segeyimu sicindezela amamodeli esikali somngcele kuma-chips ambalwa, ashibhile ngaphandle kokulahlekelwa kwekhwalithi elinganisekayo.

Ukuqaliswa Komhlaba Wangempela

Ukuqeqesha amamodeli olimi amakhulu kuma-NVIDIA Hopper/Blackwell GPUs usebenzisa i-FP8 ukuze acishe aphindwe kabili uma kuqhathaniswa ne-BF16.

Inikeza i-chatbot inference ku-FP8 ukuze imodeli ilingane kuma-GPU ambalwa futhi iphendule izicelo eziningi ngomzuzwana.

Ukusebenzisa i-E5M2 ekuxhumaneni kwe-gradient ngesikhathi sokuqeqeshwa okusabalalisiwe ukusika umkhawulokudonsa wenethiwekhi phakathi kwamanodi

Kusetshenziswa amamodeli we-MXFP4/NVFP4-quantized ukuze alingane imodeli yesikali somngcele ku-GPU eyodwa yememori ephezulu ukuze uthole ukucatshangelwa okushibhile

Izingozi & Guardrails

Ukuthuthukisa ibhentshimakhi eyodwa kungafihla ubuthakathaka obubanzi besistimu.

Izindleko zengqalasizinda nezokulungisa zivame ukubukelwa phansi.

Izikhala zokuphepha nokubonakala zingakhula njengoba izinhlelo ziba nzima kakhulu.

Ukuqalisa Umhlahlandlela

1

Chaza ukubambezeleka, ikhwalithi, nezindleko ezihlosiwe ngaphambi kokuqaliswa.

2

Ibhentshimakhi ngaphansi komthwalo wangempela nezimo zedatha.

3

Ukuqapha amathuluzi amaphutha, ukukhukhuleka, nomthelela wabasebenzisi.

4

Lungiselela izindlela zokuhlehlisa nezigameko ngaphambi kokukala.

Qhubeka Uhlole

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the FP8 and Low-Precision Formats quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Qala imibuzo

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Umhlahlandlela olandelayo

Amafomethi Okulinganisa Amamodeli

Imibuzo evame ukubuzwa

What is FP8 and Low-Precision Formats?

I-FP8 iyifomethi yenombolo yephoyinti elintantayo engu-8-bit evumela amamodeli e-AI ukuthi agcine izisindo futhi asebenzise izibalo esebenzisa ingxenye yesine yenkumbulo yezinombolo ezijwayelekile ezingamabhithi angu-32. Kuyiqhinga elibalulekile lokwenza amamodeli amakhulu ashibhe futhi asheshe ukuwaqeqesha nokuwaphakela.

Mangaki amabhithi inombolo ye-FP8 ewasebenzisayo uma kuqhathaniswa nenombolo ye-FP32 ejwayelekile?

I-FP8 isebenzisa amabhithi angu-8 kuyilapho i-FP32 isebenzisa amabhithi angu-32, ngakho i-FP8 ithatha ikota eyodwa yokugcina nomkhawulokudonsa.

Achazani amalebula okuthi 'E4M3' kanye ne-'E5M2' mayelana nefomethi ye-FP8?

I-E4M3 isho izingcezu ezi-4 ze-exponent kanye nezingcezu ezi-3 ze-mantissa; I-E5M2 isho i-exponent engu-5 kanye namabhithi e-mantissa angu-2. Amabhithi ama-eksponenti amaningi anweba ububanzi; izingcezu ze-mantissa ezengeziwe zengeza ukunemba.

Kungani amapayipi e-FP8 esebenzisa izici zokukala kuma-tensor?

Ngamabhithi ama-eksponenti ambalwa, amanani amakhulu ayachichima futhi amancane adlulela ngaphansi aze afike kuqanda. Ukukala kunciphisa ama-tensor efasiteleni elisebenzisekayo le-FP8 ngaphambi kwezibalo.

Ikuphi ukuhwebelana okuyicala elibi lokusebenzisa i-FP8?

Amabhithi ambalwa asho ukumelela okuqinile kanye nephutha lokusondeza. Inzuzo inkumbulo encane kanye nomkhawulokudonsa, kanye nezibalo ezisheshayo kuhadiwe esekelwe.

Isiphi isizukulwane se-NVIDIA GPU esiqale ukwengeza ukusekelwa kwehadiwe okuzinikele kwe-FP8 matrix math?

Ama-GPU asuselwa ku-Hopper afana ne-H100 wethule ukwesekwa kwe-FP8 Tensor Core, futhi uBlackwell kamuva wanweba lokhu ku-FP4.