Fundações de IA
Entenda o que é IA, como os sistemas aprendem, onde falham e como julgar as reivindicações sem exageros.
Biblioteca de IA gratuita
117 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.
Comece aqui
Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.
Entenda o que é IA, como os sistemas aprendem, onde falham e como julgar as reivindicações sem exageros.
Use a IA de forma produtiva enquanto protege a privacidade, verifica os resultados e preserva a responsabilidade humana.
Avalie casos de uso no local de trabalho, execute pilotos seguros, meça o valor e comunique as mudanças com responsabilidade.
Analise os sistemas de IA por meio de direitos, equidade, governança, segurança e resultados de interesse público.
Entenda modelos de linguagem, recuperação, agentes, avaliação, custo e proteções de implantação por meio de design prático de sistema.
Faixas de tópico
Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.
Biblioteca completa
117 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.
A identificação da música cover detecta quando duas gravações com sons muito diferentes são, na verdade, a mesma música subjacente – uma versão acústica ao vivo, um remix…
IA de áudioO DDSP (Processamento de Sinais Digitais Diferenciados) funde blocos de construção de sintetizadores clássicos com redes neurais, para que o aprendizado profundo possa controlar os osciladores…
IA de áudioVITS é um modelo de conversão de texto em fala que transforma texto diretamente em formas de onda de áudio brutas em um único sistema treinado, ignorando o pipeline usual de dois estágios.
IA de áudioO FastSpeech gera um espectrograma de fala inteiro em paralelo, em vez de um quadro por vez, tornando a síntese dramaticamente mais rápida e estável.
IA de áudioNaturalSpeech é uma linha de pesquisa TTS Microsoft que visa qualidade de fala em nível humano, com versões posteriores usando difusão latente para gerar riqueza, natural…
IA de áudioO Speech Emotion Recognition (SER) é uma IA que detecta o estado emocional de um locutor – raiva, alegria, tristeza, frustração – a partir do som de sua voz, não apenas…
IA de áudioMoshi é uma IA de voz em tempo real e de código aberto da Kyutai que fala e ouve ao mesmo tempo – full-duplex – em vez de fazer turnos rígidos.
IA de áudioA Tradução de Fala para Fala (S2ST) pega palavras faladas em um idioma e produz palavras faladas em outro - de preferência preservando a voz e o tom do locutor…
IA de áudioHiFi-GAN é um vocoder generativo-adversário que transforma um espectrograma mel em uma forma de onda de áudio bruta quase instantaneamente, produzindo fala com qualidade de estúdio…
IA de áudioA conversão de grafema para fonema (G2P) traduz letras escritas nos sons que um sistema de fala deveria realmente pronunciar.
IA de áudioA normalização de texto é a etapa inicial que reescreve o texto escrito bruto em palavras totalmente faladas antes que um sistema de fala o diga.
IA de áudioSoundStream é o codec de áudio neural ponta a ponta do Google que compacta fala e música em taxas de bits extremamente baixas, preservando a qualidade.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.