2023 - ReAct - Synergizing Reasoning and Acting in Language Models - arXiv 2210.03629v3
Nguồn
- PDF gốc: 2023 - ReAct - Synergizing Reasoning and Acting in Language Models - arXiv 2210.03629v3.pdf
- Đọc cùng: CS224N 2026 - Lecture 10 - RAG and Language Agents
- Concept: LLM Agent, Prompt Engineering
Vấn đề paper giải quyết
Reasoning traces và acting/tool interaction thường được nghiên cứu tách rời. ReAct kết hợp chúng theo dạng xen kẽ: model vừa suy nghĩ vừa hành động trong môi trường.
Đóng góp chính
- Sinh reasoning traces và task-specific actions xen kẽ.
- Reasoning giúp theo dõi plan, cập nhật trạng thái và xử lý ngoại lệ.
- Actions giúp model lấy thông tin từ môi trường hoặc tool thay vì chỉ dựa vào parametric memory.
Cơ chế
Thought: phân tích trạng thái và kế hoạch
Action: gọi tool / tìm kiếm / tương tác môi trường
Observation: nhận kết quả
Thought: cập nhật suy luận
...
Answer: kết luậnVì sao quan trọng với CS224N
Lecture 10 dùng ReAct như pattern nền cho language agents. Nó cho thấy agent không chỉ là LM trả lời dài hơn, mà là loop reasoning-action-observation.
Hạn chế / câu hỏi
- Reasoning trace có thể sai nhưng vẫn tự tin.
- Tool result cần được parse và kiểm tra.
- Evaluation phải đo cả trajectory, không chỉ final answer.
Câu hỏi review
- ReAct xen kẽ hai loại output nào?
- Observation giúp model sửa plan ra sao?
- Vì sao agent evaluation khó hơn QA thường?