EngramEdit: Các cập nhật kiến thức không liên kết trong LLM thông qua bộ nhớ có điều kiện
EngramEdit: Decoupled Knowledge Updates in LLMs through Conditional Memory
Đoạn trích bài viết
Conditional memory architectures such as DeepSeek Engram use input n-grams to look up learned embeddings, expanding the capacity of large language models (LLMs) with limited additional computation.
Toàn văn bài viết
Mở bài viết gốc
Đọc bài viết đầy đủ trên huggingface
Mở bài gốc để xem trọn vẹn chi tiết và dẫn chứng.