Atualizado diariamente2286 histórias verificadas
Notícias de IA. Sem o barulho.
Cobertura de IA verificada na fonte sobre lançamentos de produtos, mudanças políticas, pesquisas de segurança e movimentos do setor, explicada em inglês simples por uma equipe de educação sem fins lucrativos.
Fonte verificada
Cada história está vinculada às evidências mais fortes disponíveis: fontes originais, quando disponíveis, reportagens claramente atribuídas.
Inglês simples
O que aconteceu, por que é importante e o que assistir – sem jargão.
Sem preenchimento
Quando o sinal é fraco, não publicamos nada além de preencher o feed.
Mais histórias
9 históriasInovação
Agentes de código perdem confiabilidade quando o código é reescrito sem alterar seu significado, segundo estudo
Uma pré-impressão do arXiv relata que os agentes de código podem ter desempenho diferente em bases de código semanticamente equivalentes, com efeitos variando de acordo com modelo, estrutura de agente e benchmark.arxiv.orgInovação
Modelo de lógica difusa aprimorada para diagnóstico de falhas em transformadores de potência usando melhorias no método de gás chave IEEE
Este estudo apresenta um modelo aprimorado combinando Lógica Fuzzy com o Método Key Gas IEEE (FL-KGM) que introduz funções de pertinência refinadas, conjuntos de regras fuzzy otimizados e uma nova separação de CO e CO2 para eliminar inconsistências de diagnóstico.arxiv.orgInovação
Novos relatórios de pré-impressão ganham com modelos de linguagem em loop na chamada de ferramentas em várias etapas
Um estudo arXiv avalia modelos de linguagem convencionais e em loop em três benchmarks de chamada de ferramentas, relatando resultados mais sólidos em fluxos de trabalho que exigem múltiplas chamadas de API dependentes e uma abordagem de computação adaptativa potencialmente mais eficiente.arxiv.orgInovação
Adversarial Review testa discordância estruturada para revisão de código de agente
Um novo artigo do arXiv propõe um protocolo de revisão de código de três agentes no qual um revisor avalia o código de um agente e um crítico audita que revisa antes que as edições sejam feitas. Os autores relatam melhores resultados de benchmark em relação às linhas de base testadas, ao mesmo tempo que identificam o falso consenso como um modo de falha.arxiv.orgInovação
Estudo ArXiv relata grandes ganhos em discurso de ódio em Urdu romano com a adaptação de LoRA
Uma pré-impressão do arXiv compara o ajuste fino com eficiência de parâmetros e disparo zero para detecção de discurso de ódio em urdu romano. Os autores relatam que a adaptação LoRA elevou o desempenho F1 de 0,56 para acima de 0,93 em um corpus contendo mais de 72.000 comentários anotados.arxiv.orgSegurança
Teste preliminar do FraudBench encontra agentes bancários vulneráveis à fraude adaptativa
Um artigo do arXiv apresenta o FraudBench, uma referência para testar se os agentes bancários que utilizam ferramentas podem detectar fraudes que se desenrolam nas conversas. Em uma avaliação preliminar de teste único, quatro agentes pontuaram de 49% a 65% na segurança de ataques.arxiv.orgInovação
Pesquisadores da Apple relatam lei de dimensionamento para modelos de treinamento com dados escassos
Um estudo de mais de 2.000 execuções de treinamento de modelos de linguagem diz que dados de destino escassos podem ser repetidos de 15 a 20 vezes em misturas, com a melhor taxa variando de acordo com a escala e o cálculo.machinelearning.apple.comInovação
Pesquisadores da Apple propõem substituições lexicais para melhorar o treinamento de modelos multilíngues
Os pesquisadores da Apple descrevem o LINK, uma intervenção de pré-treinamento que substitui palavras selecionadas em inglês por traduções em nível de palavra de um idioma alvo. O documento relata melhorias em oito idiomas e cinco tamanhos de modelo, incluindo uma aceleração de até duas vezes para alcançar um desempenho downstream equivalente.machinelearning.apple.comPolítica
O documento de posição exige certificação antes que os agentes de IA tomem decisões de mercado
Um documento de posição relata conluio tácito de agentes DeepSeek-R1 em um mercado simulado de preços de Bertrand, mesmo após instruções humanas contra conluio. Argumenta que a certificação do comportamento observado deve preceder a implantação de agentes de raciocínio nos mercados económicos; as evidências e salvaguardas permanecem preliminares.arxiv.org
Um briefing útil por semana
Acompanhe a IA sem ficar no feed.
Receba as notícias verificadas sobre IA da semana, dados originais, ferramentas úteis, opções de aprendizado e novos trabalhos de IA.
Alcance pessoas que estão aprendendo IA
Contratar um profissional de IA ou lançar um produto útil de IA? Coloque isso na frente das pessoas que vieram aqui para aprender e agir.
Publique um trabalho de IAEnvie uma ferramenta de IA