AIfor Educations
05

RAG — AI đọc tài liệu của bạn

Retrieval-Augmented Generation (RAG) bổ sung kiến thức qua truy xuất tài liệu thay vì fine-tune lại toàn bộ mô hình. Hệ thống tìm đoạn liên quan, đưa vào prompt, rồi để LLM sinh câu trả lời. Phương pháp phù hợp handbook, quy chế và FAQ nội bộ.

DOC

Tài liệu

PDF / Markdown / FAQ

CUT

Chunk

Cắt đoạn ngắn

VEC

Embed

Mỗi đoạn → vector

DB

Vector DB

Lưu text + embedding

TOP

Retrieve

Top-k gần câu hỏi

GEN

LLM

Sinh câu có căn cứ

Pipeline RAG từng bước

Bấm để đi tuần tự

Bước

Chia tài liệu dài thành đoạn ngắn (chunk) để embedding & truy xuất chính xác hơn.

Kho tài liệu (chunk)

  • • Quy chế thi.pdf → 12 chunk
  • • Handbook thư viện.md → 8 chunk
  • • Slide AI & RAG → 15 chunk

Chưa Generate

Bấm bước 5 · Generate để xem LLM trả lời có trích nguồn.