AI QA Trainer – LLM Evaluation
Contract · Mid-level · Anywhere
Thông tin công việc
- Hình thức: Làm việc từ xa (remote)
- Mức lương: $960 - $10,400 / tháng
- Ngành: Product
- Chuyên môn: Machine Learning Evaluation
- Cấp bậc: Mid-level
- Khu vực tuyển: Anywhere
- Ngày đăng: 09/10/2026
Mô tả công việc
Vị trí này chịu trách nhiệm đánh giá chất lượng các mô hình ngôn ngữ lớn: kiểm tra độ chính xác thực tế, phát hiện ảo giác (hallucination), thử nghiệm khả năng chống prompt-injection/jailbreak, kiểm toán thiên kiến và xác minh tính nhất quán của chuỗi lập luận, từ đó ghi nhận mọi lỗi và đề xuất cải thiện prompt, guardrails cùng các chỉ số đánh giá. Bạn sẽ thiết kế rubric, xây dựng bộ test hồi quy, chạy red-teaming và tự động hóa bằng Python/SQL để theo dõi chất lượng theo thời gian. Phù hợp với người có nền tảng khoa học máy tính, khoa học dữ liệu, ngôn ngữ học tính toán hoặc thống kê, đã từng làm QA cho hệ thống ML/AI và có kỹ năng giao tiếp rõ ràng, có khả năng "trình bày cách mình suy luận".