Bảo mật & quản trị
Quyền truy cập được phân giải bằng code có thể audit, không bao giờ phó thác cho model.
Trang này mô tả đúng mô hình bảo mật đang chạy production, bằng ngôn ngữ dễ hiểu. Đây cũng là câu chuyện chúng tôi trình bày với đội bảo mật của bạn, kèm bằng chứng kiểm chứng cho từng tuyên bố.
Nguyên tắc thiết kế
Model sinh ngôn ngữ mang tính xác suất. Kiểm soát truy cập thì không được phép như vậy. Vì thế chốt kiểm soát quyết định trong XNOR Agents là một bộ lọc tất định, quyết định tài liệu nào được vào ngữ cảnh của model, theo từng người, từng request. Luật trong prompt và model kiểm duyệt vẫn tồn tại như các lớp bổ sung, nhưng chúng được xác định rõ là thứ yếu. Cùng một bộ nguyên tắc chạy xuyên suốt mọi thứ chúng tôi giao: đặc quyền tối thiểu, bằng chứng trước câu trả lời, fail closed, và con người chịu trách nhiệm cho mọi quyết định hệ trọng.
Thứ model không bao giờ được thấy, model không thể tiết lộ. Không cho prompt tinh vi, không cho kẻ tấn công kiên trì, và không do vô tình.
Bốn lớp độc lập, lớp nào cũng fail-closed
Đặc quyền tối thiểu tại nguồn
Thông tin xác thực của agent được giới hạn ở tầng nền tảng, đúng các thư viện nó phục vụ. Truy cập ngoài phạm vi bị chính nền tảng của bạn từ chối, không phải bởi code của chúng tôi, và điều này được chứng minh bằng negative tests kỳ vọng bị từ chối. Trong kiểm chứng Knowledge Agent, 12/12 nỗ lực vượt rào đều bị chặn, kể cả gọi thẳng kho lưu trữ mật.
Lọc tài liệu bằng code, trước khi tới model
Allowlist tất định ánh xạ mỗi tier truy cập vào các thư mục được phép. Mỗi ứng viên truy xuất được đối chiếu với vị trí thật, ghim vào đúng thư viện tài liệu cấu hình, và bị loại khi có bất kỳ sai lệch nào. Denylist cứng cho các thư mục nhạy cảm nhất được biên dịch trong code, cố ý nằm ngoài tầm với của cấu hình.
Chính sách prompt chống thao túng
Tài liệu truy xuất được bọc như dữ liệu không tin cậy. Các ký hiệu cấu trúc bị vô hiệu hóa để tác giả tài liệu không thể giả mạo chỉ thị hệ thống, và bản nháp chuyển cho model kiểm duyệt được rào chắn để tài liệu cài bẫy không thể mạo danh người kiểm duyệt.
Mọi câu trả lời được hậu kiểm trước khi gửi
Bộ lọc tất định bắt thông tin xác thực, số tài khoản và mức lương cá nhân. Sau đó một model độc lập soát bản nháp theo chính sách dữ liệu của bạn và trả về phán quyết nghiêm ngặt: chỉ khi đạt tường minh mới được gửi. Lỗi văn phong được thử lại đúng một lần; vi phạm dữ liệu thì không bao giờ.
Fail-closed, ở mọi nơi
Không phân giải được quyền? Người hỏi bị coi như chưa được cấp quyền. Không đọc được phán quyết kiểm duyệt? Chặn câu trả lời. Không rõ loại cuộc trò chuyện? Coi như nhóm công khai nhất. File truy xuất không khai báo vị trí? Loại bỏ. Mọi mặc định đều bảo vệ dữ liệu của bạn, và từng mặc định đều được test ghim chặt.
Hai chốt kiểm soát mà đa số trợ lý AI không có
Luật khán giả trong group chat
Trong group chat, câu trả lời đi theo người có quyền thấp nhất đang có mặt, kể cả khi CEO là người hỏi. Agent mời người hỏi sang chat riêng để nhận câu trả lời đầy đủ, và không bao giờ tiết lộ thành viên nào là lý do giới hạn. Chống rò rỉ, hoàn toàn tự động.
Toàn vẹn trích dẫn tất định
Nguồn bịa còn tệ hơn lời từ chối, vì nó làm câu trả lời sai trông như kiểm chứng được. Một bước kiểm tra ở tầng code xác minh mọi file mà câu trả lời nêu tên đều đã thực sự được truy xuất trong lượt đó. Độc lập với model, nên nó sống sót qua mọi lần đổi nhà cung cấp.
Quản trị, audit và vận hành
Audit trail bất biến
Mỗi câu hỏi một dòng vĩnh viễn: ai hỏi, ở tier nào, các từ khóa trích ra từ câu hỏi, truy xuất gì, model kiểm duyệt quyết định gì và trạng thái của câu trả lời. Nguyên văn câu hỏi và nội dung câu trả lời không bao giờ được lưu. Lưu không thời hạn, theo thực hành ISO 27001, kèm sẵn các truy vấn review cho đội tuân thủ của bạn.
Danh tính là danh tính của bạn
Tier truy cập gắn với nhóm danh tính doanh nghiệp sẵn có. Gỡ một người khỏi nhóm chấm dứt quyền truy cập trong vòng 15 phút. Không có cơ sở dữ liệu người dùng riêng để lệch pha.
Mỗi agent một stack cô lập
Mỗi agent có thông tin xác thực riêng, kho lưu trữ riêng và secret riêng. Một agent bị xâm phạm không chạm được các agent còn lại, và bán kính ảnh hưởng của bất kỳ secret nào chỉ là một function.
Cổng đánh giá trước mỗi lần phát hành
Bộ đánh giá bảo mật đối kháng chạy trên model thật và phải đạt toàn bộ trước khi mọi thay đổi prompt hay chính sách được ship. Đổi model cũng đi qua đúng cổng đó.
Phân tích tôn trọng quyền riêng tư
Dashboard sử dụng lưu chủ đề và đường dẫn tài liệu truy xuất, không bao giờ lưu nguyên văn câu hỏi. Chi phí, quota và chất lượng đều nhìn thấy được mà không phải dựng công cụ giám sát nhân viên.
Secret không chạm clipboard con người
Thông tin xác thực nằm trong kho tham số bảo mật, nạp một lần khi khởi động, không bao giờ ghi log. Việc xoay vòng được nối thẳng giữa các hệ thống, nên giá trị secret không bao giờ đi qua chat, email hay file.
Đo chất lượng, không phỏng đoán
Mỗi câu trả lời đều có nút tốt / chưa tốt, và lá phiếu được ghi lên đúng dòng audit chứa phán quyết của guard. Chính cặp dữ liệu đó tạo ra con số mà kiểm thử bảo mật không thể tạo: tần suất guard chặn một câu trả lời mà người đọc thật sự cần. Bấm chưa tốt sẽ mở ô ghi chú tùy chọn tối đa 300 ký tự; ghi chú nằm lại trong bảng của chính agent, chỉ các con số thống kê mới lên dashboard.
Tư thế tuân thủ
Kiến trúc được thiết kế để phục vụ rà soát: audit trail theo thực hành ISO 27001, bảo vệ dữ liệu cá nhân định hình theo Luật Bảo vệ dữ liệu cá nhân (Luật 91/2025/QH15, hiệu lực từ 01/01/2026) cho chính triển khai của chúng tôi, và một sổ đăng ký rủi ro chính thức trong đó mỗi rủi ro được chấp nhận đều có tên, ngày và chữ ký người quyết định. Trong hợp đồng của bạn, các tài liệu tương tự được lập theo bối cảnh pháp lý của bạn, kèm bộ hồ sơ bằng chứng dày hơn mà các ngành chịu quản lý chặt thường yêu cầu (xem kinh nghiệm của chúng tôi trong lĩnh vực tài chính).
Trao đổi với đội kỹ thuật
Hãy dẫn theo đội bảo mật của bạn.
Buổi demo thú vị hơn với những câu hỏi khó nhất của bạn. Chúng tôi trình bày các chốt kiểm soát, các bài test đứng sau, và audit trail mà chúng ghi lại.
Chúng tôi sẵn sàng đi qua threat model ngay trong buổi demo.