Actualizado diariamente2272 historias verificadas
Noticias de IA. Sin el ruido.
Cobertura verificada por IA sobre lanzamientos de productos, cambios en políticas, investigaciones de seguridad y movimientos del sector, explicada en un lenguaje sencillo por un equipo educativo sin ánimo de lucro.
Fuentes verificadas
Cada historia enlaza con la evidencia más sólida disponible: fuentes originales cuando están disponibles, y por lo demás reportajes claramente atribuidos.
Inglés sencillo
Qué pasó, por qué es importante y qué mirar, sin la jerga.
sin relleno
Cuando la señal es escasa, no publicamos nada en lugar de rellenar el feed.
Más historias
9 historiasInnovación
El periódico afirma que la gestión de caché basada en agentes reduce el retraso del primer token hasta en un 45 % en el servicio de múltiples agentes
Una nueva preimpresión de arXiv describe CacheScout, una capa construida en el servidor vLLM de código abierto que decide qué guardar en la caché de valores clave de un modelo en función del agente que probablemente se ejecutará a continuación. Los autores informan ganancias de latencia y rendimiento de dos dígitos; las cargas de trabajo, los modelos y el hardware no se indican en resumen.arxiv.orgInnovación
La auditoría de una prueba generada por IA OpenAI encuentra una condición invertida y publica una reparación
Dos investigadores dicen que una prueba de lema en el Capítulo 6 del documento matemático de OpenAI tiene un error de polaridad: una prueba en términos de éxito promedio donde el siguiente paso necesita un gran fracaso condicional. Dan un contraejemplo y una prueba corregida, y advierten que esto no es una verificación del teorema principal del capítulo.arxiv.orgInnovación
Un estudio de replicación dice que los FLOP aún predicen erróneamente el tiempo de ejecución de la IA y la solución propuesta falla en el hardware más nuevo
Una preimpresión de dos investigadores reproduce un estudio anterior sobre por qué recuentos iguales de FLOP no significan igual tiempo de ejecución. Confirma la afirmación subyacente, pero informa que la fórmula de corrección de α-FLOP generalmente subestima el tiempo de ejecución en hardware más nuevo, lo que muestra saltos y oscilaciones que la fórmula no captura.arxiv.orgEmpresa
Un documento de referencia encuentra cuatro formas de consultar datos empresariales con todos los LLM con una puntuación inferior al 26 %
Una nueva preimpresión de arXiv compara cuatro arquitecturas para consultas en lenguaje natural de bases de datos empresariales entre sí en un punto de referencia bilingüe sintético. Ninguno respondió correctamente a más de una cuarta parte de los casos, y el diseño que obtuvo la puntuación más alta no fue el más seguro ni el más barato.arxiv.orgInnovación
Un documento propone calificar a los agentes de seguridad de IA sin etiquetas midiendo la convergencia hacia un modelo más sólido
Una nueva preimpresión de arXiv sostiene que los equipos de seguridad pueden juzgar si un agente de IA equipado con memoria o recuperación está aprendiendo midiendo hasta qué punto cierra la brecha con un modelo "maestro" más fuerte, en lugar de basarse en puntos de referencia etiquetados que a menudo son escasos o obsoletos. A juzgar por un modelo con potencia similar, no dio ninguna señal utilizable.arxiv.orgInnovación
Un nuevo punto de referencia prueba si los asistentes de IA pueden recordar un año de uso del teléfono
Un informe técnico de 17 autores publicado en arXiv presenta MobileMem, un punto de referencia y un marco para la memoria a largo plazo en el dispositivo creado a partir de una colección de experiencias móviles a escala anual. El resumen describe el diseño pero no informa puntuaciones y los detalles clave sobre los datos subyacentes permanecen sin revelar.arxiv.orgInnovación
Un artículo informa que una organización modular similar a un cerebro emerge dentro de grandes modelos lingüísticos
Una nueva preimpresión de arXiv dice que los grandes modelos de lenguaje desarrollan una estructura interna funcionalmente especializada que se alinea con distintas redes del cerebro humano, basándose en análisis de circuitos en 46 tareas en cuatro dominios cognitivos. La página de resúmenes deja sin mencionar los detalles metodológicos clave.arxiv.orgInnovación
Un artículo encuentra que las últimas capas de un modelo de mezcla de expertos toleran un enmascaramiento intenso de expertos
Una preimpresión informa que al desactivar expertos de baja magnitud en las últimas cinco capas de un modelo de Mezcla de Expertos de 35 mil millones de parámetros se conservaron resultados de traducción de códigos mucho más utilizables que distribuir los mismos cortes en todas las capas. Cubre un modelo y un punto de referencia, y el resumen no informa ninguna línea de base desenmascarada.arxiv.orgSeguridad
Los defectos de CoreBreak permiten que las herramientas del agente se ejecuten sin que se llame al modelo
Una nota de investigación de Cloud Security Alliance describe CoreBreak, un patrón de fallas en Amazon Bedrock AgentCore, el kit de desarrollo de agentes de Google y los paquetes de arnés AI SDK de Vercel que permitieron que las herramientas se ejecutaran sin un giro de modelo, dejando las barreras de seguridad a nivel de modelo sin nada que inspeccionar.labs.cloudsecurityalliance.org
Un informe útil cada semana
Mantente al día con la IA sin vivir en el feed.
Recibe las noticias verificadas de IA de la semana, datos originales, herramientas útiles, recomendaciones de aprendizaje y nuevos empleos en IA.
Llegue a las personas que están aprendiendo sobre IA
¿Contratar a un profesional de IA o lanzar un producto útil de IA? Ponlo delante de personas que han venido aquí a aprender y actuar.
Publicar un trabajo de IAEnviar una herramienta de IA