Actualizado diariamente1873 historias verificadas
Noticias de IA. Sin el ruido.
Cobertura verificada por IA sobre lanzamientos de productos, cambios en políticas, investigaciones de seguridad y movimientos del sector, explicada en un lenguaje sencillo por un equipo educativo sin ánimo de lucro.
Fuentes verificadas
Cada historia enlaza con la evidencia más sólida disponible: fuentes originales cuando están disponibles, y por lo demás reportajes claramente atribuidos.
Inglés sencillo
Qué pasó, por qué es importante y qué mirar, sin la jerga.
sin relleno
Cuando la señal es escasa, no publicamos nada en lugar de rellenar el feed.
Más historias
9 historiasSeguridad
El documento SEAG propone establecer un alias para las entidades sensibles antes de que las consultas de RAG lleguen a los LLM externos
Una preimpresión publicada en arXiv describe un marco que intercambia nombres confidenciales en consultas y documentos recuperados por alias antes de enviarlos a un modelo de terceros. Los autores informan una precisión de más del 80 % en su métrica de usuario de un extremo a otro y tasas de ocultación total entre el 74,91 % y el 77,83 % en tres modelos pequeños.arxiv.orgInnovación
CABS+ Paper informa modelos más baratos y rápidos fusionados en 27 conjuntos de datos
Una preimpresión publicada en arXiv describe CABS+, un método de fusión de modelos que reemplaza la búsqueda de cuadrícula con una búsqueda de coeficientes sin gradiente. Los autores informan ganancias de rendimiento de dos dígitos en dos líneas de base, menos de una cuarta parte de la memoria de GPU de una línea de base y aproximadamente una aceleración de 4 veces respecto a otra.arxiv.orgInnovación
Un artículo propone "lecciones" recuperadas para mejorar el razonamiento espacial en modelos de visión y lenguaje congelados
Una preimpresión de arXiv describe Spatial Memory Agent, que almacena experiencia verificada como lecciones de texto recuperadas en el momento de la inferencia, afirmando ganancias en cinco puntos de referencia espaciales y cuatro modelos de visión y lenguaje sin cambiar los pesos del modelo. Está bajo revisión; su resumen no menciona puntos de referencia, modelos base o márgenes.arxiv.orgInnovación
El papel PROVE-RT informa un 44,7% de éxito en la generación de pruebas en tiempo real verificadas por máquina
Una preimpresión de arXiv presenta PROVE-RT, que utiliza recuperación e indicaciones por etapas para hacer que modelos de lenguaje grandes escriban scripts de prueba PROSA/ROCQ para análisis de programabilidad en tiempo real. Los autores informan una tasa de éxito del 44,7% en un conjunto de evaluación seleccionado, donde la indicación directa no logra producir mecanizaciones válidas de manera confiable.arxiv.orgPolítica
Un documento de trabajo pregunta si la ley del consumidor de la India puede cubrir los daños causados por la IA
Un nuevo documento de trabajo de arXiv sostiene que la Ley de Protección al Consumidor de la India de 2019 es lo suficientemente amplia como para abarcar en principio los daños relacionados con la IA, pero que aún no se ha resuelto la prueba de la causalidad y la asignación de culpas en toda la cadena de suministro de la IA. Aquí sólo se resume públicamente el resumen; el artículo no está revisado por pares.arxiv.orgInnovación
Apple Paper propone un desaprendizaje automático más económico al omitir datos de baja influencia
Un artículo de Apple Machine Learning Research sostiene que no todos los puntos de datos en una solicitud de eliminación necesitan una eliminación activa. Utilizando funciones de influencia en tareas de lenguaje y visión, los autores dicen que los ejemplos de baja influencia se pueden eliminar del conjunto de olvido, reduciendo el cómputo de desaprendizaje hasta aproximadamente un 50 por ciento.machinelearning.apple.comInnovación
AutoWorldModel-Bench prueba si los agentes codificadores pueden mejorar los modelos mundiales
Una nueva preimpresión de arXiv presenta un punto de referencia para evaluar agentes de codificación como investigadores de modelos mundiales abiertos en ocho entornos de juego, informando mejoras en 63 de 64 sesiones.arxiv.orgInnovación
El artículo de Distribird describe agentes de IA basados en la literatura para modelos anteriores bayesianos
Una preimpresión de arXiv presenta Distribird, una aplicación de múltiples agentes que busca literatura científica, extrae valores de parámetros informados y construye distribuciones previas rastreables para la calibración del modelo bayesiano.arxiv.orgInnovación
Los investigadores presentan OmniLens para la interpretabilidad de modelos de lenguaje a gran escala
Un nuevo artículo de arXiv describe OmniLens, un método de menor costo para examinar señales internas en modelos de lenguaje grandes y completos e identificar dónde aparecen los comportamientos y dónde funcionan las intervenciones.arxiv.org
Un informe útil cada semana
Mantente al día con la IA sin vivir en el feed.
Recibe las noticias verificadas de IA de la semana, datos originales, herramientas útiles, recomendaciones de aprendizaje y nuevos empleos en IA.
Llegue a las personas que están aprendiendo sobre IA
¿Contratar a un profesional de IA o lanzar un producto útil de IA? Ponlo delante de personas que han venido aquí a aprender y actuar.
Publicar un trabajo de IAEnviar una herramienta de IA