Mmaiqai.com
🎯 CT-AI · Chương 2 · Mục 2.2.1

Tiêu chí chấp nhận cho hệ AI: đo bằng ngưỡng, không phải đúng/sai

🎯 Mục tiêu học (LO AI-2.2.1 · mức K2 – Hiểu): nêu ví dụ về tiêu chí chấp nhận cho hệ AI.

💡 Ý cốt lõi: với hệ AI, tiêu chí chấp nhận thường phải mang tính thống kê / xác suất / theo ngưỡng — không phải "đúng hay sai" (binary) như phần mềm thường.

Xét cả chức năng lẫn phi chức năng, gắn với các đặc tính chất lượng ISO/IEC 25059 (mục 2.1.1) và an toàn (mục 2.1.2).

Ví dụ tiêu chí chấp nhận theo từng đặc tính

Điểm chung: đều đo được, có con số / ngưỡng / thời gian.

Đặc tínhVí dụ tiêu chí chấp nhận
AI functional correctnessAccuracy ≥ 95% cho hệ nhận diện ảnh; recall ≥ 90% cho hệ dự đoán lỗi.
Functional adaptabilityHệ quản lý động cơ thích ứng trong ≤ 20 giây khi vượt ngưỡng độ cao đã định.
User controllabilityGiám sát viên giành quyền điều khiển drone trong 0,5 giây khi nó phát tín hiệu mất GPS.
TransparencyCung cấp đủ thông tin về mô hình ML bên thứ ba và nguồn gốc dữ liệu huấn luyện; API trả về mã phiên bản mô hình đang chạy + link tài liệu.
AI robustnessThời gian phản hồi vẫn < 1 giây khi mất kết nối CSDL trung tâm trong 30 giây; thiết bị edge chuyển sang chế độ suy luận điện thấp (thay vì sập) khi nhiệt độ > 85°C liên tục 10 giây.
IntervenabilityDây chuyền dừng được trong 0,5 giây khi robot vượt vùng an toàn; lưới điện có cửa sổ xác nhận 30 giây để kỹ sư phủ quyết hành động 'nghiêm trọng' do AI đề xuất.
Societal & ethical risk mitigationHệ tuyên án không phân biệt theo nhóm sắc tộc (theo metric công bằng đã định); chatbot đạt ≥ 95% trong đánh giá red teaming về từ chối tạo nội dung bạo lực/tự hại/thù ghét.
Safety (an toàn)Thành phần không-AI tuân ISO 26262-6 mức ASIL C; tín hiệu điều khiển vượt giới hạn an toàn > 10% được xử lý trong 0,15 giây.

📝 Bẫy hay gặp

Đề hay cho một phát biểu nghe hợp lý nhưng sai — nhớ mấy chỗ gài sau:

  • "Tiêu chí chấp nhận hệ AI nên là đúng/sai (binary)" → SAI: thường phải thống kê / theo ngưỡng (accuracy ≥ 95%, phản hồi < 1s...).
  • "Chỉ cần xét đặc tính chức năng" → SAI: xét cả phi chức năng (robustness, transparency, an toàn...).
  • Một tiêu chí chấp nhận tốt phải đo được — "hệ phải đủ chính xác" là chưa đạt (thiếu con số/ngưỡng).

📌 Ghi nhớ

Kiểu tiêu chí: thống kê · xác suất · theo ngưỡng (không binary)

Gắn với: đặc tính 25059 + an toàn; xét cả chức năng & phi chức năng

Với tester: đây là việc rất thực tế — tester phải biến yêu cầu mơ hồ thành tiêu chí đo được (accuracy ≥ 95%, phản hồi < 1s, dừng trong 0,5s...). Có con số rõ thì mới test và phán pass/fail được cho hệ AI vốn không có "một đáp án đúng duy nhất".

📖 Thuật ngữ Anh–Việt (mục này)

Đề thi dùng thuật ngữ tiếng Anh — nhớ đúng cụm bên trái. Bấm 🔊 để nghe từng từ, hoặc "Đọc tất cả" để nghe lần lượt Anh → (vài giây) → Việt.

Thuật ngữ (EN)Nghĩa & ghi nhớ nhanh
Acceptance criteriaTiêu chí chấp nhận — điều kiện để hệ được coi là đạt
Threshold-basedTheo ngưỡng — đạt/không dựa trên mốc số cụ thể
StatisticalThống kê — dựa trên số liệu tổng hợp
ProbabilisticXác suất
BinaryNhị phân — chỉ đúng hoặc sai
Functional (characteristic)Đặc tính chức năng
Non-functional (characteristic)Đặc tính phi chức năng
AccuracyĐộ chính xác (thước đo phân loại)
RecallĐộ bao phủ — bắt được bao nhiêu ca dương thật
Fairness metricThước đo công bằng
Red teamingĐánh giá tấn công thử để tìm điểm yếu/rủi ro
ASIL (automotive safety integrity level)Mức toàn vẹn an toàn ô tô (theo ISO 26262)

🎯 Câu hỏi minh họa (phong cách đề CT-AI · K2)

Which of the following is the most appropriate acceptance criterion for the AI functional correctness of an image recognition system?

  • a) The system should be accurate enough.
  • b) The system must never make a mistake.
  • c) The system shall achieve an accuracy of at least 95%.
  • d) The system should feel fast to users.
Xem bản dịch tiếng Việt

Đâu là tiêu chí chấp nhận phù hợp nhất cho tính đúng đắn chức năng AI của một hệ nhận diện ảnh?

a) Hệ nên đủ chính xác.

b) Hệ không bao giờ được sai.

c) Hệ phải đạt accuracy tối thiểu 95%.

d) Hệ nên tạo cảm giác nhanh với người dùng.

Xem đáp án & giải thích

Đáp án đúng: c — Có ngưỡng đo được (accuracy ≥ 95%) nên test được.

a d sai — mơ hồ, không đo được ("đủ chính xác", "cảm giác nhanh").

b sai — hệ AI xác suất không thể "không bao giờ sai".

Đề để tiếng Anh cho sát đề thi thật; phần giải thích để tiếng Việt cho dễ hiểu. Câu hỏi do maiqai.com tự soạn theo phong cách đề.

📎 Nguồn: Chương 2 – Đặc tính chất lượng, mục 2.2.1 "Acceptance Criteria for AI-Based Systems", trang 23–25 — ISTQB® Certified Tester AI Testing Syllabus v2.0 (© International Software Testing Qualifications Board). Nội dung biên soạn/dịch ý lại bằng tiếng Việt, không sao chép nguyên văn.