Fundações de IA
Entenda o que é IA, como os sistemas aprendem, onde falham e como julgar as reivindicações sem exageros.
Biblioteca de IA gratuita
117 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.
Comece aqui
Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.
Entenda o que é IA, como os sistemas aprendem, onde falham e como julgar as reivindicações sem exageros.
Use a IA de forma produtiva enquanto protege a privacidade, verifica os resultados e preserva a responsabilidade humana.
Avalie casos de uso no local de trabalho, execute pilotos seguros, meça o valor e comunique as mudanças com responsabilidade.
Analise os sistemas de IA por meio de direitos, equidade, governança, segurança e resultados de interesse público.
Entenda modelos de linguagem, recuperação, agentes, avaliação, custo e proteções de implantação por meio de design prático de sistema.
Faixas de tópico
Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.
Biblioteca completa
117 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.
Mimi é um codec de áudio neural que comprime a fala em um pequeno fluxo de tokens discretos em tempo real, para que os modelos de IA possam ouvir e falar com voz muito baixa.
IA de áudioOuvir, Atender e Soletrar (LAS) é uma rede neural marcante de 2015 que transcreve a fala diretamente em caracteres, sem pronúncia construída à mão…
IA de áudioSpecAugment é um método simples, mas poderoso de aumento de dados que mascara e distorce o espectrograma da fala para tornar os modelos de reconhecimento mais robustos.
IA de áudioA etiquetagem automática de música usa aprendizado de máquina para ouvir uma música e anexar automaticamente rótulos descritivos como gênero, humor, instrumentos e andamento.
IA de áudioA transferência de timbre remodela a 'cor do tom' do áudio para que um instrumento soe como outro, transformando uma melodia cantarolada em um violino ou uma linha de trompete...
IA de áudioA classificação de cena acústica (ASC) treina máquinas para reconhecer o ambiente em que a gravação foi feita, uma rua movimentada, um parque tranquilo, um trem, um café…
IA de áudioNVIDIA Riva é um SDK acelerado por GPU para IA de produção de fala (ASR, TTS e tradução), enquanto NeMo é o kit de ferramentas de código aberto para treinamento e ajuste fino…
IA de áudioDeepSpeech é um modelo de reconhecimento de fala ponta a ponta introduzido pelo Baidu em 2014 que mapeia recursos de áudio brutos diretamente para texto usando um neural recorrente…
IA de áudioOs vetores X são impressões digitais numéricas de comprimento fixo da voz de um locutor, produzidas por uma rede neural, usadas para dizer quem está falando, independentemente do que digam.
IA de áudioGlow-TTS é um modelo de conversão de texto em fala que aprende a alinhar texto com fala por conta própria usando um truque de pesquisa inteligente, eliminando a necessidade de um alinhador separado.
IA de áudioParallel WaveGAN é um vocoder neural rápido que transforma um espectrograma mel em uma forma de onda de áudio bruta usando um pequeno GAN, gerando todas as amostras de uma vez.
IA de áudioWaveGlow é um vocoder neural baseado em fluxo da NVIDIA que sintetiza formas de onda de fala a partir de espectrogramas mel em uma única passagem sem autorregressão.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.