Module 2 • Bài 1545 phút

Nhận diện và thiết lập ngưỡng phòng vệ cho 4 rủi ro AI then chốt

Định danh 4 dạng rủi ro AI cốt lõi (Hallucination, Bias, Edge Cases, Misuse), định lượng ma trận Likelihood × Severity và thiết lập ngưỡng chấp nhận được kèm kịch bản Fallback.

Phân loại 4 rủi ro: Hallucination, Bias, Distribution Shift, Misuse
Định vị rủi ro trên ma trận Likelihood × Severity để tối ưu nguồn lực
Thiết lập ngưỡng rủi ro định lượng và hạ tầng cứu cánh Graceful Degradation

Nhận diện và thiết lập ngưỡng phòng vệ cho 4 rủi ro AI then chốt

Ở bài 8, chúng ta đã xem xét mức độ chịu lỗi (Error Tolerance) như một khối tổng thể. Bài học này đi sâu vào việc bóc tách: Mô hình có thể sai theo những kiểu nào? Bạn không thể xây dựng rào chắn bảo vệ cho một rủi ro mà chính bạn chưa định danh chính xác.

Ví dụ xuyên suốt bài: Trợ lý AI nội bộ của FinTrack Portal - cho phép nhân viên tra cứu và hỏi đáp về chính sách nhân sự, bảo hiểm y tế, quyền lợi thai sản và quy trình công tác từ kho tài liệu nội bộ (RAG).

TIẾP CẬN CŨ / LỖI THỜI
Liệt kê chung chung: 'AI có thể sai'
Rải đều nguồn lực phòng vệ cho mọi trường hợp, bỏ lọt rủi ro chết người
CHUẨN AI PM / HIỆN ĐẠI
Ma trận Likelihood × Severity
Dồn tài nguyên guardrail vào Vùng Đỏ và thiết lập Graceful Fallback liền mạch
QUẢN TRỊ RỦI RO AIMa Trận Likelihood × Severity & Cơ Chế Graceful Fallback

Nhận diện và thiết lập ngưỡng phòng vệ cho 4 rủi ro AI then chốt

1. Khai Thác & Tấn Công (Jailbreak / Leak)VÙNG ĐỎ: ĐẦU TƯ TỐI ĐA GUARDRAIL
TÌNH HUỐNG THỰC TẾ TRÊN FINTRACK PORTAL

Nhân viên dùng Prompt Injection để ép chatbot in bảng lương toàn công ty.

HÀNG RÀO PHÒNG VỆ PM CẦN THIẾT LẬP

Bộ lọc Deterministic trước khi vào LLM + Che giấu PII dữ liệu + Phân quyền RBAC nghiêm ngặt.

Nguyên tắc phòng vệ AI: Phân bổ tài nguyên theo ma trận Likelihood × Severity. Triệt tiêu ảo giác bằng ngưỡng Cutoff RAG cứng (85%) và luôn thiết kế hạ tầng Graceful Fallback chuyển tiếp con người liền mạch.