Actualizado diariamente2396 historias verificadas

Noticias de IA. Sin el ruido.

Cobertura verificada por IA sobre lanzamientos de productos, cambios en políticas, investigaciones de seguridad y movimientos del sector, explicada en un lenguaje sencillo por un equipo educativo sin ánimo de lucro.

Fuentes verificadas

Cada historia enlaza con la evidencia más sólida disponible: fuentes originales cuando están disponibles, y por lo demás reportajes claramente atribuidos.

Inglés sencillo

Qué pasó, por qué es importante y qué mirar, sin la jerga.

sin relleno

Cuando la señal es escasa, no publicamos nada en lugar de rellenar el feed.

9 historias
  1. InnovaciónInnovación6 min leer

    El artículo presenta las "evaluaciones en la sombra": los agentes de IA hicieron la ingeniería pero fallaron en dos preguntas de investigación

    En una preimpresión de 24 autores, agentes de inteligencia artificial fronteriza intentaron las preguntas de investigación centrales de dos presentaciones inéditas de NeurIPS 2026 y luego los propios autores de los artículos calificaron los resultados. Los agentes se encargaron solos de la ingeniería durante seis días, pero fueron rechazados rotundamente en la investigación.arxiv.org
  2. ProductoProducto7 min leer

    Warp abre acceso temprano a "Factories", un sistema de configuración como código para ejecutar flotas de agentes de codificación

    Warp está aceptando solicitudes de acceso temprano para Warp Factories, que define flotas de agentes de codificación como código: repositorios, modelos, permisos y puntos de control humanos en un archivo YAML, impulsado por CLI, API, SDK y MCP. Sus cifras de automatización y costos son afirmaciones de los proveedores: sin precios, fecha de disponibilidad general o pruebas independientes.warp.dev
  3. InnovaciónInnovación7 min leer

    Benchmark dice que los mejores modelos multimodales obtienen una puntuación inferior al 10% en la lectura de palabras a partir de sonidos de bolígrafo y movimientos de la mano

    Un nuevo artículo de arXiv presenta una prueba en la que los modelos deben inferir una palabra escrita a partir del audio de un lápiz y un video de movimiento de la mano, sin tinta visible. Los autores informan que los humanos tienen una precisión de letras ordenadas superior al 80% y modelos líderes por debajo del 10%, y que dar a los modelos ambas modalidades a menudo empeoraba los resultados.arxiv.org
  4. InnovaciónInnovación7 min leer

    El periódico afirma que la gestión de caché basada en agentes reduce el retraso del primer token hasta en un 45 % en el servicio de múltiples agentes

    Una nueva preimpresión de arXiv describe CacheScout, una capa construida en el servidor vLLM de código abierto que decide qué guardar en la caché de valores clave de un modelo en función del agente que probablemente se ejecutará a continuación. Los autores informan ganancias de latencia y rendimiento de dos dígitos; las cargas de trabajo, los modelos y el hardware no se indican en resumen.arxiv.org
  5. InnovaciónInnovación7 min leer

    La auditoría de una prueba generada por IA OpenAI encuentra una condición invertida y publica una reparación

    Dos investigadores dicen que una prueba de lema en el Capítulo 6 del documento matemático de OpenAI tiene un error de polaridad: una prueba en términos de éxito promedio donde el siguiente paso necesita un gran fracaso condicional. Dan un contraejemplo y una prueba corregida, y advierten que esto no es una verificación del teorema principal del capítulo.arxiv.org
  6. InnovaciónInnovación7 min leer

    Un estudio de replicación dice que los FLOP aún predicen erróneamente el tiempo de ejecución de la IA y la solución propuesta falla en el hardware más nuevo

    Una preimpresión de dos investigadores reproduce un estudio anterior sobre por qué recuentos iguales de FLOP no significan igual tiempo de ejecución. Confirma la afirmación subyacente, pero informa que la fórmula de corrección de α-FLOP generalmente subestima el tiempo de ejecución en hardware más nuevo, lo que muestra saltos y oscilaciones que la fórmula no captura.arxiv.org
  7. EmpresaEmpresa6 min leer

    Un documento de referencia encuentra cuatro formas de consultar datos empresariales con todos los LLM con una puntuación inferior al 26 %

    Una nueva preimpresión de arXiv compara cuatro arquitecturas para consultas en lenguaje natural de bases de datos empresariales entre sí en un punto de referencia bilingüe sintético. Ninguno respondió correctamente a más de una cuarta parte de los casos, y el diseño que obtuvo la puntuación más alta no fue el más seguro ni el más barato.arxiv.org
  8. InnovaciónInnovación7 min leer

    Un documento propone calificar a los agentes de seguridad de IA sin etiquetas midiendo la convergencia hacia un modelo más sólido

    Una nueva preimpresión de arXiv sostiene que los equipos de seguridad pueden juzgar si un agente de IA equipado con memoria o recuperación está aprendiendo midiendo hasta qué punto cierra la brecha con un modelo "maestro" más fuerte, en lugar de basarse en puntos de referencia etiquetados que a menudo son escasos o obsoletos. A juzgar por un modelo con potencia similar, no dio ninguna señal utilizable.arxiv.org

Un informe útil cada semana

Mantente al día con la IA sin vivir en el feed.

Recibe las noticias verificadas de IA de la semana, datos originales, herramientas útiles, recomendaciones de aprendizaje y nuevos empleos en IA.

Send me
One email a week. Switch any time.

Llegue a las personas que están aprendiendo sobre IA

¿Contratar a un profesional de IA o lanzar un producto útil de IA? Ponlo delante de personas que han venido aquí a aprender y actuar.

Publicar un trabajo de IAEnviar una herramienta de IA