Saltar al contenido
Aprender
Noticias
Herramientas
Empleos
Misión
Buscar
⌘K
English
Donar
Menú
×
Empieza aquí
Empezar a aprender
Aprender
Ir a Aprender
Cursos
Guías
Tutor de IA
Prompt library
Cuestionarios
Certificado
Glosario
Noticias
Ir a Noticias
Últimas noticias sobre IA
Seguidores de temas
Research & datasets
Blog
Normas editoriales
Correcciones
Herramientas
Ir a Herramientas
Directorio de herramientas
Listas de lo mejor
Comparar herramientas
Cost calculator
Refinador rápido
Enviar herramienta
Empleos
Ir a Empleos
Explorar trabajos de IA
Publicar un trabajo
Patrocinador AIU
Misión
Ir a Misión
Misión
Impacto y estadísticas
Autores
Help centre
What's new
Ayuda
Donar
Inicio
/
Glosario
/
Barandillas
Término del glosario de IA
que es
Barandillas
?
Definición
Reglas, comprobaciones y controles que limitan el comportamiento inseguro o no deseado del modelo.
Términos relacionados
Seguridad de la IA
Un campo enfocado en reducir comportamientos dañinos, fallas y riesgos de uso indebido en los sistemas de IA.
Algoritmo
Un conjunto definido de reglas o pasos que sigue una computadora para resolver un problema o completar una tarea.
Sesgo
Un patrón constante de error o injusticia en los datos o el comportamiento del modelo.
Explicabilidad
El grado en que el comportamiento de un modelo puede interpretarse y explicarse a los humanos.
Aprendizaje en pocas oportunidades
Aprender o adaptar el comportamiento a partir de sólo un pequeño número de ejemplos.
Aprendizaje reforzado a partir de la retroalimentación humana (RLHF)
Un método de entrenamiento que utiliza señales de preferencia humana para dar forma al comportamiento del modelo.
Obtenga más información en nuestras guías gratuitas.
Guardrails and Output Moderation
Agent Guardrails
See also
Ground Truth
Hallucination
Gradient Descent
Human-in-the-Loop
Gradient
Hyperparameter
Generative AI
In-Context Learning
Previous
Ground Truth
Next
Hallucination
Explore el glosario completo de IA
Explora todas las guías gratuitas de IA