Actualizado diariamente1797 historias verificadas

Noticias de IA.Sin el ruido.

Cobertura verificada por IA sobre lanzamientos de productos, cambios en políticas, investigaciones de seguridad y movimientos del sector, explicada en un lenguaje sencillo por un equipo educativo sin ánimo de lucro.

Fuentes verificadas

Cada historia enlaza con la evidencia más sólida disponible: fuentes originales cuando están disponibles, y por lo demás reportajes claramente atribuidos.

Inglés sencillo

Qué pasó, por qué es importante y qué mirar, sin la jerga.

sin relleno

Cuando la señal es escasa, no publicamos nada en lugar de rellenar el feed.

Archivo de noticias

Archivo de noticias de IA — Página 149

Historias de IA con fuentes verificadas, las más recientes primero, para personas que necesitan comprender la IA sin perseguir exageraciones.

Source-provided image accompanying Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger ModelHistoria principal
Innovación7 min leer
Innovación7 min leer

Un documento propone calificar a los agentes de seguridad de IA sin etiquetas midiendo la convergencia hacia un modelo más sólido

Una nueva preimpresión de arXiv sostiene que los equipos de seguridad pueden juzgar si un agente de IA equipado con memoria o recuperación está aprendiendo midiendo hasta qué punto cierra la brecha con un modelo "maestro" más fuerte, en lugar de basarse en puntos de referencia etiquetados que a menudo son escasos o obsoletos. A juzgar por un modelo con potencia similar, no dio ninguna señal utilizable.

leer historia Fuente verificada: arxiv.org
9 historias
  1. Innovación7 min leer

    Un artículo encuentra que las últimas capas de un modelo de mezcla de expertos toleran un enmascaramiento intenso de expertos

    Una preimpresión informa que al desactivar expertos de baja magnitud en las últimas cinco capas de un modelo de Mezcla de Expertos de 35 mil millones de parámetros se conservaron resultados de traducción de códigos mucho más utilizables que distribuir los mismos cortes en todas las capas. Cubre un modelo y un punto de referencia, y el resumen no informa ninguna línea de base desenmascarada.

    arxiv.org
  2. Seguridad7 min leer

    Los defectos de CoreBreak permiten que las herramientas del agente se ejecuten sin que se llame al modelo

    Una nota de investigación de Cloud Security Alliance describe CoreBreak, un patrón de fallas en Amazon Bedrock AgentCore, el kit de desarrollo de agentes de Google y los paquetes de arnés AI SDK de Vercel que permitieron que las herramientas se ejecutaran sin un giro de modelo, dejando las barreras de seguridad a nivel de modelo sin nada que inspeccionar.

    labs.cloudsecurityalliance.org
  3. Industria6 min leer

    Cursor dice que su adquisición por parte de SpaceX se ha cerrado oficialmente

    Cursor publicó una breve publicación diciendo que SpaceX completó la adquisición de la herramienta de codificación de inteligencia artificial, finalizando un proceso que, según dice, comenzó en abril con una asociación de entrenamiento de modelos con SpaceXAI. La publicación promete acceso a lo que llama la flota de GPU más grande del mundo, pero no revela términos, cronogramas ni cambios de producto.

    cursor.com
  4. Innovación7 min leer

    Un nuevo punto de referencia encuentra que los agentes de IA bloquean erróneamente el trabajo aprobado el 28% del tiempo

    Una preimpresión presenta SteerBench-Work, una prueba de 106 escenarios del momento en que un agente de IA decide actuar o hacer una pausa para su revisión. En 30 condiciones modelo, los autores informan que retener incorrectamente el trabajo autorizado era aproximadamente 28 veces más común que permitir incorrectamente un trabajo inseguro.

    arxiv.org
  5. Innovación7 min leer

    Un artículo sostiene que las estrategias de evolución superan a la RL al mantener diversos los conjuntos de respuestas del LLM

    Una nueva preimpresión de arXiv sostiene que los LLM posteriores al entrenamiento con estrategias de evolución (un método basado en la población y sin gradientes que perturba los pesos directamente) supera el aprendizaje por refuerzo en pass@k y la cobertura de soluciones. El resumen cita mejores resultados de pruebas comparativas de matemáticas, pero no menciona modelos, pruebas comparativas ni números.

    arxiv.org
  6. Seguridad7 min leer

    Un artículo dice que los agentes de IA que se mejoran a sí mismos pueden convertir un éxito inseguro en una habilidad reutilizable

    Una nueva preimpresión de arXiv compara un modo de falla de agente específico: cuando un agente de mejora automática escribe un procedimiento inseguro en la memoria, se puede recuperar y ejecutar en sesiones posteriores. Cada configuración evolucionada probada produjo artefactos inseguros y tres tareas maliciosas duplicaron con creces el éxito del ataque de transferencia.

    arxiv.org
  7. Seguridad6 min leer

    El documento SEAG propone establecer un alias para las entidades sensibles antes de que las consultas de RAG lleguen a los LLM externos

    Una preimpresión publicada en arXiv describe un marco que intercambia nombres confidenciales en consultas y documentos recuperados por alias antes de enviarlos a un modelo de terceros. Los autores informan una precisión de más del 80 % en su métrica de usuario de un extremo a otro y tasas de ocultación total entre el 74,91 % y el 77,83 % en tres modelos pequeños.

    arxiv.org

Un informe útil cada semana

Mantente al día con la IA sin vivir en el feed.

Recibe las noticias verificadas de IA de la semana, datos originales, herramientas útiles, recomendaciones de aprendizaje y nuevos empleos en IA.

Send me
One email a week. Switch any time.

Llegue a las personas que están aprendiendo sobre IA

¿Contratar a un profesional de IA o lanzar un producto útil de IA? Ponlo delante de personas que han venido aquí a aprender y actuar.

Publicar un trabajo de IA Enviar una herramienta de IA