Alinhamento é tudo que você precisa: treinamento sem instruções para modelos gerais de audiolinguagem
Uma nova abordagem para treinar modelos multimodais de grandes linguagens (MLLMs) elimina a necessidade de ampla supervisão específica de tarefas.
Atualizado diariamente1797 histórias verificadas
Cobertura de IA verificada na fonte sobre lançamentos de produtos, mudanças políticas, pesquisas de segurança e movimentos do setor, explicada em inglês simples por uma equipe de educação sem fins lucrativos.
Cada história está vinculada às evidências mais fortes disponíveis: fontes originais, quando disponíveis, reportagens claramente atribuídas.
O que aconteceu, por que é importante e o que assistir – sem jargão.
Quando o sinal é fraco, não publicamos nada além de preencher o feed.
Histórias de IA verificadas na fonte, as mais recentes primeiro, para pessoas que precisam entender a IA sem perseguir exageros.
Uma nova abordagem para treinar modelos multimodais de grandes linguagens (MLLMs) elimina a necessidade de ampla supervisão específica de tarefas.
Este trabalho examina prompts aumentados por emojis como um caso de teste para lacunas na avaliação de segurança de grandes modelos de linguagem (LLMs).
As plataformas modernas de comércio eletrônico geralmente operam sistemas de pesquisa, recomendação, personalização e CRM de forma independente, limitando as oportunidades de reengajamento proativo do cliente.
Um artigo apresenta o THPT-Ladder, um benchmark de 632 itens que aplica o esquema de classificação do exame nacional do Vietnã de 2025 a modelos linguísticos e relata pontuações materialmente diferentes das medidas padrão de precisão proporcional.
Um artigo arXiv descreve como a Netflix construiu, implantou e monitorou continuamente um juiz LLM para explicações de recomendações, relatando ganhos de visualização e engajamento em um teste A/B de cinco semanas envolvendo dezenas de milhões de membros.
Uma nova pesquisa arXiv propõe visualizar as memórias, ferramentas, habilidades, fluxos de trabalho e relacionamentos de um agente de IA como um gráfico que muda ao longo do tempo e exige avaliação e governança com reconhecimento de gráfico.
Uma nova pré-impressão do arXiv apresenta o FACET, uma estrutura para gerar tarefas de terminal executáveis cujas instruções, ambientes, soluções e verificadores são projetados para permanecerem consistentes.
Uma pré-impressão do arXiv apresenta o SESSE, uma estrutura sem treinamento que divide a preferência de um juiz LLM em subquestões. Os autores relatam quase paridade com uma linha de base de cadeia de pensamento em 1.000 exemplos do RewardBench e registros de votação em nível de critério; generalização, custo e validação independente permanecem questões em aberto.
Uma equipe do IBM Spyre afirma que os agentes de codificação ajudaram a criar 13 adaptadores de tempo de execução que cobriram 7.960 dos 10.000 modelos de incorporação Hugging Face mais baixados em seu conjunto de destino, com 6.804 passando em testes ponta a ponta no Spyre. A equipe diz que a depuração humana permaneceu essencial.
Um artigo de pesquisa da Apple descreve um método de pseudo-rotulagem iterativo trifásico para reconhecimento automático de fala com troca de código mandarim-inglês e relata reduções na taxa de erros de mistura em dois subconjuntos de desenvolvimento SEAME.
Google diz que os usuários em breve poderão dizer ao Discover quais tópicos e links desejam ver mais ou menos, enquanto os novos controles também personalizam os briefings de áudio da Pesquisa e do Google News.
O Amazon Bedrock agora oferece modelos GPT-5.6 Sol, Terra e Luna do OpenAI em mais de 25 regiões da AWS, com opções de roteamento geográfico e global que expandem o pool de computação disponível.
Um briefing útil por semana
Receba as notícias verificadas sobre IA da semana, dados originais, ferramentas úteis, opções de aprendizado e novos trabalhos de IA.
Contratar um profissional de IA ou lançar um produto útil de IA? Coloque isso na frente das pessoas que vieram aqui para aprender e agir.
Publique um trabalho de IA Envie uma ferramenta de IA