ai·radar
Bản tin sáng Tra cứu

Hiểu và tăng cường sự kiên trì của cửa sau trong việc huấn luyện sau agent LLM

Understanding and Enhancing Backdoor Persistency in LLM Agent Post-Training

Đoạn trích bài viết

Các nhà phát triển có thể xây dựng các agent LLM bằng cách điều chỉnh các mô hình của bên thứ ba thông qua huấn luyện hậu lành mạnh. Chúng tôi nghiên cứu mối đe dọa chuỗi cung ứng trong đó một kẻ tấn công cung cấp một mô hình với một cửa sau: hành vi ẩn tạo ra các kết quả độc hại khi một mô hình đầu vào cụ thể xuất hiện.

Toàn văn bài viết

Đọc bài viết đầy đủ trên huggingface

Mở bài gốc để xem trọn vẹn chi tiết và dẫn chứng.

Mở bài viết gốc