Atualizado diariamente2000 histórias verificadas
Notícias de IA. Sem o barulho.
Cobertura de IA verificada na fonte sobre lançamentos de produtos, mudanças políticas, pesquisas de segurança e movimentos do setor, explicada em inglês simples por uma equipe de educação sem fins lucrativos.
Fonte verificada
Cada história está vinculada às evidências mais fortes disponíveis: fontes originais, quando disponíveis, reportagens claramente atribuídas.
Inglês simples
O que aconteceu, por que é importante e o que assistir – sem jargão.
Sem preenchimento
Quando o sinal é fraco, não publicamos nada além de preencher o feed.
Mais histórias
9 históriasInovação
Estudo mapeia 46 modelos linguísticos construídos para o português
Um estudo sistemático de mapeamento cataloga 46 modelos de língua portuguesa e compara arquiteturas, recursos de treinamento, licenciamento, código, dados e pesos. Os autores dizem que o campo está crescendo, mas é difícil de avaliar porque as informações estão espalhadas por documentos, relatórios técnicos, repositórios e documentação de projetos.arxiv.orgInovação
O estudo de interpretabilidade liga as respostas excessivamente confiantes de Qwen3-4B a um mecanismo tendencioso para a certeza
Um estudo arXiv relata que Qwen3-4B favorece a certeza em detrimento da incerteza em tarefas de raciocínio controlado e identifica características do modelo que podem causar o desequilíbrio. Os autores dizem que as intervenções direcionadas reduziram os erros de excesso de confiança, mas o resumo não divulga o tamanho dos efeitos ou os detalhes dos testes.arxiv.orgInovação
A lacuna deôntica: grandes modelos de linguagem e a linguagem modal da obrigação
Auxiliares modais como devem, deveriam e têm que marcar necessidade e obrigação nos contextos de autoridade do falante e postura interpessoal.arxiv.orgSegurança
Artigo propõe obscurecer sinais de recusa para resistir a ataques de abolição
Uma pré-impressão do arXiv introduz um método de edição de peso destinado a dificultar a extração e remoção de recusas de segurança. O artigo relata pontuações de recusa pós-abliteração mais fortes em dois modelos abertos, com diferentes compensações no desempenho de uso geral.arxiv.orgInovação
Artigo relata um método temporal para detectar alucinações no nível simbólico
Uma pré-impressão do arXiv descreve um detector de alucinações que combina estatísticas de texto, sinais de implicação e surpresa de modelo de linguagem em sequências, em vez de julgar tokens de forma independente. Seu modelo BiGRU atingiu uma AUC de 0,840 no RAGTruth, segundo o jornal.arxiv.orgInovação
O rastreamento de entidades surge em 410 milhões de parâmetros, excede os humanos em narrativas naturalistas
Compreender a linguagem requer rastrear entidades através do discurso – isto é, saber onde as coisas estão e como elas mudam, mesmo quando não declaradas explicitamente.arxiv.orgInovação
A pesquisa guiada pelo compilador de relatórios em papel melhora a eficiência da prova do teorema Lean
Uma pré-impressão do arXiv propõe um método adaptativo de pesquisa de provas para projetos Lean 4 dependentes do contexto. Seus autores relatam uma melhoria média de 12,8 pontos percentuais na taxa de aprovação dentro de um orçamento pass@32, usando 21,9% menos chamadas de LLM do que as linhas de base do pass@k.arxiv.orgInovação
Benchmark separa resolução de geometria da construção de diagrama
Um novo benchmark de código aberto testa se os modelos de base podem construir diagramas geométricos fiéis, e não apenas resolver os problemas subjacentes. Seus autores relatam que os modelos avaliados alcançaram uma taxa média de sucesso de compilação de 36,14%, expondo uma lacuna entre as respostas matemáticas e as construções visuais utilizáveis.arxiv.orgInovação
Alinhamento é tudo que você precisa: treinamento sem instruções para modelos gerais de audiolinguagem
Uma nova abordagem para treinar modelos multimodais de grandes linguagens (MLLMs) elimina a necessidade de ampla supervisão específica de tarefas.arxiv.org
Um briefing útil por semana
Acompanhe a IA sem ficar no feed.
Receba as notícias verificadas sobre IA da semana, dados originais, ferramentas úteis, opções de aprendizado e novos trabalhos de IA.
Alcance pessoas que estão aprendendo IA
Contratar um profissional de IA ou lançar um produto útil de IA? Coloque isso na frente das pessoas que vieram aqui para aprender e agir.
Publique um trabalho de IAEnvie uma ferramenta de IA