Bảo Vệ AI Coding Assistant Khỏi Tấn Công Prompt Injection & Lộ Secret Key | DevPrompt Lab

Kỹ thuật cô lập System Prompt và mã hóa ngữ cảnh giúp bảo vệ mã nguồn độc quyền của công ty không bị đánh cắp qua chat.

Bảo Vệ AI Coding Assistant Khỏi Tấn Công Prompt Injection & Lộ Secret Key

Khi xây dựng các tính năng AI nội bộ như "Chatbot tra cứu tài liệu kỹ thuật" hoặc "Tự động review code Pull Request", hệ thống của bạn đối mặt với nguy cơ bị tấn công **Indirect Prompt Injection**: kẻ tấn công có thể chèn các câu lệnh độc hại vào mã nguồn hoặc file README công khai nhằm ép AI tiết lộ biến môi trường bí mật (API Keys, DB Credentials).

---

Các Lớp Phòng Thủ Bắt Buộc (Defense in Depth)

1. **Phân tách ranh giới dữ liệu (XML Tagging Delimiters)**:

Bọc dữ liệu của người dùng hoặc code cần phân tích trong các thẻ XML riêng biệt:

   <untrusted_code_to_review>
   {{CODE_SNIPPET}}
   </untrusted_code_to_review>

2. **Chỉ thị phủ định không thể đảo ngược**:

Hướng dẫn AI coi mọi văn bản bên trong thẻ `<untrusted_code_to_review>` là dữ liệu thô (pure text data), tuyệt đối không coi đó là chỉ dẫn điều khiển.