Bài kiểm tra có liên kết hướng dẫn · Trung bình Cấp độ
Building an LLM Eval Dataset Quiz
Tests sourcing real cases, golden answers versus rubrics, edge-case coverage, and sizing an eval set so score differences are meaningful.
Câu hỏi 1 của 8
Bài kiểm tra có liên kết hướng dẫn · Trung bình Cấp độ
Tests sourcing real cases, golden answers versus rubrics, edge-case coverage, and sizing an eval set so score differences are meaningful.