Prefix-Tuning: Optimizing Continuous Prompts for Generation

Tóm tắt một câu

Prefix-Tuning giữ backbone language model đóng băng và chỉ học một chuỗi vector prefix liên tục để điều kiện hóa mô hình cho task mới.

Vì sao cần cho đề tài

Đây là nền trực tiếp cho các prompt vector trong Prompt Tree. Trước khi thiết kế root/internal/leaf prompts, cần hiểu prefix được chèn vào attention như “virtual tokens” và vì sao nó tiết kiệm tham số hơn full fine-tuning.

Nguồn đã kiểm

Cần đọc tiếp

  • Prefix được chèn vào layer nào.
  • Prefix key/value khác soft prompt input-level ở đâu.
  • Khi nào prefix tuning yếu hơn full fine-tuning.