Actualizado diariamente2286 historias verificadas
Noticias de IA. Sin el ruido.
Cobertura verificada por IA sobre lanzamientos de productos, cambios en políticas, investigaciones de seguridad y movimientos del sector, explicada en un lenguaje sencillo por un equipo educativo sin ánimo de lucro.
Fuentes verificadas
Cada historia enlaza con la evidencia más sólida disponible: fuentes originales cuando están disponibles, y por lo demás reportajes claramente atribuidos.
Inglés sencillo
Qué pasó, por qué es importante y qué mirar, sin la jerga.
sin relleno
Cuando la señal es escasa, no publicamos nada en lugar de rellenar el feed.
Más historias
9 historiasInnovación
Los agentes de código pierden confiabilidad cuando el código se reescribe sin cambiar su significado, según un estudio
Una preimpresión de arXiv informa que los agentes de código pueden funcionar de manera diferente en bases de código semánticamente equivalentes, con efectos que varían según el modelo, el marco del agente y el punto de referencia.arxiv.orgInnovación
Modelo de lógica difusa mejorado para el diagnóstico de fallas de transformadores de potencia utilizando mejoras clave en el método de gas IEEE
Este estudio presenta un modelo mejorado que combina la lógica difusa con el método de gas clave IEEE (FL-KGM) que introduce funciones de membresía refinadas, conjuntos de reglas difusas optimizadas y una nueva separación de CO y CO2 para eliminar inconsistencias de diagnóstico.arxiv.orgInnovación
Los nuevos informes preimpresos se benefician de los modelos de lenguaje en bucle en la llamada de herramientas de varios pasos
Un estudio de arXiv evalúa modelos de lenguaje convencional y en bucle en tres puntos de referencia de llamadas de herramientas, reportando resultados más sólidos en flujos de trabajo que requieren múltiples llamadas API dependientes y un enfoque de computación adaptativa potencialmente más eficiente.arxiv.orgInnovación
La revisión adversaria prueba el desacuerdo estructurado para la revisión del código agente
Un nuevo artículo de arXiv propone un protocolo de revisión de código de tres agentes en el que un revisor evalúa el código de un agente y un crítico audita esa revisión antes de realizar las ediciones. Los autores informan resultados de referencia mejorados con respecto a las líneas de base probadas, al tiempo que identifican el falso consenso como un modo de falla.arxiv.orgInnovación
Un estudio de ArXiv informa grandes avances en el discurso de odio en urdu romano gracias a la adaptación de LoRA
Una preimpresión de arXiv compara el ajuste preciso de disparo cero y eficiente de parámetros para la detección de discursos de odio en urdu romano. Los autores informan que la adaptación de LoRA aumentó el rendimiento de F1 de 0,56 a más de 0,93 en un corpus que contiene más de 72.000 comentarios anotados.arxiv.orgSeguridad
La prueba preliminar de FraudBench encuentra que los agentes bancarios son vulnerables al fraude adaptativo
Un artículo de arXiv presenta FraudBench, un punto de referencia para probar si los agentes bancarios que utilizan herramientas pueden detectar el fraude que se desarrolla a lo largo de las conversaciones. En una evaluación preliminar de un solo ensayo, cuatro agentes obtuvieron puntuaciones del 49% al 65% en seguridad contra ataques.arxiv.orgInnovación
Investigadores de Apple informan una ley de escala para modelos de entrenamiento con datos escasos
Un estudio de más de 2000 ejecuciones de entrenamiento de modelos de lenguaje dice que los escasos datos objetivo se pueden repetir entre 15 y 20 veces en mezclas, y la mejor tasa varía según la escala y la computación.machinelearning.apple.comInnovación
Investigadores de Apple proponen sustituciones léxicas para mejorar la formación de modelos multilingües
Los investigadores de Apple describen LINK, una intervención previa al entrenamiento que reemplaza palabras seleccionadas en inglés con traducciones a nivel de palabras de un idioma de destino. El documento informa mejoras en ocho idiomas y cinco tamaños de modelos, incluida una aceleración de hasta el doble para alcanzar un rendimiento posterior equivalente.machinelearning.apple.comPolítica
El documento de posición exige una certificación antes de que los agentes de IA tomen decisiones de mercado
Un documento de posición informa sobre una colusión tácita por parte de agentes de DeepSeek-R1 en un mercado de precios simulado de Bertrand, incluso después de indicaciones humanas contra la colusión. Sostiene que la certificación del comportamiento observado debería preceder al despliegue de agentes de razonamiento en los mercados económicos; las pruebas y las salvaguardias siguen siendo preliminares.arxiv.org
Un informe útil cada semana
Mantente al día con la IA sin vivir en el feed.
Recibe las noticias verificadas de IA de la semana, datos originales, herramientas útiles, recomendaciones de aprendizaje y nuevos empleos en IA.
Llegue a las personas que están aprendiendo sobre IA
¿Contratar a un profesional de IA o lanzar un producto útil de IA? Ponlo delante de personas que han venido aquí a aprender y actuar.
Publicar un trabajo de IAEnviar una herramienta de IA