Maktaba ya bure ya AI

Sauti AI viongoziBure milele.

117 miongozo ya Kiingereza rahisi, njia zilizoundwa za kujifunza na maktaba huria - iliyojengwa na shirika lisilo la faida la 501(c)(3) ili mtu yeyote aweze kuelewa AI ya kisasa.

117Miongozo ya bure
1Nyimbo za mada
~2 minKwa mwongozo
~4hReading time

Anzia hapa

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Nyimbo za mada

Vinjari kwa wimbo

Nenda kwenye eneo unalojali. Kila wimbo una miongozo mingi ya Kiingereza-wazi.

Maktaba kamili

Viongozi wote

117 ya 1019 miongozo iliyoonyeshwa. Chuja kwa wimbo au tafuta hapo juu.

Sauti AI

Mimi Streaming Audio Codec

Mimi ni kodeki ya sauti ya neural ambayo inabana usemi kuwa mtiririko mdogo wa tokeni tofauti kwa wakati halisi, ili miundo ya AI iweze kusikiliza na kuzungumza kwa sauti ya chini sana...

2 dk kusomaSoma
Sauti AI

Sikiliza Hudhuria na Tahajia

Sikiliza, Hudhuria na Tahajia (LAS) ni mtandao wa kihistoria wa 2015 ambao unanukuu hotuba moja kwa moja hadi kwa herufi, bila matamshi yaliyojengwa kwa mkono...

2 dk kusomaSoma
Sauti AI

SpecAugment kwa Utambuzi wa Usemi

SpecAugment ni mbinu rahisi lakini yenye nguvu ya uongezaji data ambayo hufunika na kupotosha sura ya usemi ili kufanya miundo ya utambuzi kuwa thabiti zaidi.

2 dk kusomaSoma
Sauti AI

Kuweka lebo Kiotomatiki kwa Muziki

Kuweka lebo kiotomatiki kwa muziki hutumia ujifunzaji wa mashine ili kusikiliza wimbo na kuambatisha kiotomatiki lebo za maelezo kama vile aina, hali, ala na tempo.

2 dk kusomaSoma
Sauti AI

Uhamisho wa Timbre ya Muziki

Uhamisho wa Timbre huunda upya 'rangi ya toni' ya sauti ili chombo kimoja kisisikike kama kingine, na kugeuza wimbo wa sauti kuwa violin au mstari wa tarumbeta...

2 dk kusomaSoma
Sauti AI

Uainishaji wa Scene ya Akustisk

Uainishaji wa eneo la sauti (ASC) hufunza mashine kutambua mazingira ambayo rekodi ilitengenezwa, barabara yenye shughuli nyingi, bustani tulivu, gari moshi, mkahawa...

2 dk kusomaSoma
Sauti AI

NVIDIA Riva na Nemo Hotuba

NVIDIA Riva ni SDK iliyoharakishwa na GPU kwa hotuba ya uzalishaji AI (ASR, TTS, na tafsiri), huku NeMo ikiwa zana huria ya mafunzo na urekebishaji...

2 dk kusomaSoma
Sauti AI

Usanifu wa DeepSpeech

DeepSpeech ni muundo wa utambuzi wa usemi wa mwisho hadi mwisho ulioanzishwa na Baidu mnamo 2014 ambao hupanga vipengele vya sauti ghafi moja kwa moja kwenye maandishi kwa kutumia neural inayojirudia...

2 dk kusomaSoma
Sauti AI

Upachikaji wa Spika wa X-Vector

X-vekta ni alama za vidole za nambari za urefu usiobadilika za sauti ya mzungumzaji zinazotolewa na mtandao wa neva, zinazotumiwa kueleza ni nani anayezungumza bila kujali anachosema.

2 dk kusomaSoma
Sauti AI

Mwangaza-TTS Monotonic Alignment

Glow-TTS ni muundo wa maandishi-hadi-hotuba ambao hujifunza kusawazisha maandishi kwa usemi peke yake kwa kutumia ujanja wa utaftaji, na hivyo kuondoa hitaji la upangaji tofauti.

2 dk kusomaSoma
Sauti AI

Sambamba ya Vokoda ya WaveGAN

Parallel WaveGAN ni vokoda ya haraka ya neural ambayo hubadilisha mel-spectrogram kuwa muundo mbichi wa sauti kwa kutumia GAN ndogo, na kutoa sampuli zote mara moja.

2 dk kusomaSoma
Sauti AI

Sauti ya Sauti ya Mtiririko wa WaveGlow

WaveGlow ni vokoda ya neva inayotegemea mtiririko kutoka NVIDIA ambayo husanikisha miundo ya mawimbi ya matamshi kutoka kwa spectrogramu za mel kwa kupitisha moja bila kurudi nyuma.

2 dk kusomaSoma

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.