Nhận diện và thiết lập ngưỡng phòng vệ cho 4 rủi ro AI then chốt
Định danh 4 dạng rủi ro AI cốt lõi (Hallucination, Bias, Edge Cases, Misuse), định lượng ma trận Likelihood × Severity và thiết lập ngưỡng chấp nhận được kèm kịch bản Fallback.
Nhận diện và thiết lập ngưỡng phòng vệ cho 4 rủi ro AI then chốt
Ở bài 8, chúng ta đã xem xét mức độ chịu lỗi (Error Tolerance) như một khối tổng thể. Bài học này đi sâu vào việc bóc tách: Mô hình có thể sai theo những kiểu nào? Bạn không thể xây dựng rào chắn bảo vệ cho một rủi ro mà chính bạn chưa định danh chính xác.
Ví dụ xuyên suốt bài: Trợ lý AI nội bộ của FinTrack Portal - cho phép nhân viên tra cứu và hỏi đáp về chính sách nhân sự, bảo hiểm y tế, quyền lợi thai sản và quy trình công tác từ kho tài liệu nội bộ (RAG).
Liệt kê chung chung: 'AI có thể sai'
Ma trận Likelihood × Severity
Nhận diện và thiết lập ngưỡng phòng vệ cho 4 rủi ro AI then chốt
Nhân viên dùng Prompt Injection để ép chatbot in bảng lương toàn công ty.
Bộ lọc Deterministic trước khi vào LLM + Che giấu PII dữ liệu + Phân quyền RBAC nghiêm ngặt.