Ga naar de inhoud
Leren
Nieuws
Tools
Vacatures
Missie
Zoeken
⌘K
English
Doneren
Menukaart
×
Begin hier
Begin met leren
Leren
Ga naar Leren
Cursussen
Gidsen
AI-tutor
Prompt library
Quizzen
Certificaat
Woordenlijst
Nieuws
Ga naar Nieuws
Laatste AI-nieuws
Onderwerptrackers
Research & datasets
Blog
Redactionele standaarden
Correcties
Tools
Ga naar Tools
Gereedschapsmap
Best-of-lijsten
Vergelijk hulpmiddelen
Cost calculator
Snelle raffinaderij
Tool indienen
Vacatures
Ga naar Vacatures
Blader door AI-taken
Plaats een vacature
SponsorAIU
Missie
Ga naar Missie
Missie
Impact en statistieken
Auteurs
Help centre
What's new
Support
Doneren
Thuis
/
Woordenlijst
/
Vangrails
AI-verklarende term
Wat is
Vangrails
?
Definitie
Regels, controles en controles die onveilig of ongewenst modelgedrag beperken.
Gerelateerde termen
AI-veiligheid
Een vakgebied dat zich richt op het verminderen van schadelijk gedrag, mislukkingen en misbruikrisico's in AI-systemen.
algoritme
Een gedefinieerde reeks regels of stappen die een computer volgt om een probleem op te lossen of een taak te voltooien.
Vooroordeel
Een consistent patroon van fouten of oneerlijkheid in gegevens of modelgedrag.
Uitlegbaarheid
De mate waarin het gedrag van een model kan worden geïnterpreteerd en verklaard aan mensen.
Leren met weinig schoten
Gedrag leren of aanpassen vanuit slechts een klein aantal voorbeelden.
Versterkend leren van menselijke feedback (RLHF)
Een trainingsmethode die menselijke voorkeurssignalen gebruikt om modelgedrag vorm te geven.
Lees meer in onze gratis handleidingen
Guardrails and Output Moderation
Agent Guardrails
See also
Ground Truth
Hallucination
Gradient Descent
Human-in-the-Loop
Gradient
Hyperparameter
Generative AI
In-Context Learning
Previous
Ground Truth
Next
Hallucination
Blader door de volledige AI-woordenlijst
Ontdek alle gratis AI-gidsen