Phần 2: State, Memory & Context Management

Phần 2: State, Memory & Context Management

← Chương trước: Phần 1: Agent Topology & Orchestration | Mục lục Series | Chương tiếp theo: Phần 3: Secure Tool Calling & Guardrails → Answer-first: Quản trị bộ nhớ AI Agent phân tầng thành In-session Working Memory, Short-term Buffer lưu hội thoại gần, và Long-term Semantic Memory trên Vector DB. Chiến lược nén ngữ cảnh và phân mảnh bộ nhớ ngăn chặn tràn context window và hiện tượng suy giảm trí nhớ qua các phiên làm việc kéo dài. ...

17 tháng 5, 2026 · 7 phút · Lê Tuấn Anh
Phần 3: Tối Ưu Qdrant Hybrid Search: Giải Bài Toán Hard Filters

Phần 3: Tối Ưu Qdrant Hybrid Search: Giải Bài Toán Hard Filters

← Chương trước: Phần 2: Data Ingestion & Atomic Chunking | Mục lục Series | Chương tiếp theo: Phần 4: Active RAG & Strict Tool Calling → Answer-first: Qdrant Hybrid Search kết hợp Dense Vector và Sparse Vector BM25 qua thuật toán Reciprocal Rank Fusion (RRF). Kỹ thuật Payload Filtering áp dụng bộ lọc cứng trực tiếp trong quá trình duyệt đồ thị HNSW, ngăn ngừa lọc hậu kỳ gây suy giảm tập kết quả và bảo đảm hiệu năng truy vấn đa điều kiện. ...

22 tháng 5, 2026 · 10 phút · Lê Tuấn Anh
So Sánh Vector Database Cho RAG: Qdrant vs Milvus vs pgvector trong Production

So Sánh Vector Database Cho RAG: Qdrant vs Milvus vs pgvector trong Production

← Chương trước: Kiến Trúc Bảo Mật Zero-Trust Cho Microservices | Mục lục Series | Chương tiếp theo: Cloudflare Workers & Edge Computing → Answer-first: A Vector Database indexes high-dimensional embeddings using algorithms like Hierarchical Navigable Small World (HNSW) for ultra-fast semantic retrieval. In modern RAG architectures, combining dense semantic vectors with sparse BM25 keyword vectors via Reciprocal Rank Fusion (RRF) delivers optimal retrieval accuracy while Scalar and Binary Quantization reduce memory footprints up to 32x without degrading latency. ...

10 tháng 5, 2026 · 10 phút · Lê Tuấn Anh
Phần 7 — System Design: Lãnh địa sinh tồn vô giá của Developer

Phần 7 — System Design: Lãnh địa sinh tồn vô giá của Developer

← Chương trước: Phần 6 — Chuyển dịch vai trò: Từ Coder đến AI Orchestrator | Mục lục Series | Chương tiếp theo: Phần 8 — Nghịch lý Junior → Answer-first: Thiết kế hệ thống phân tán chịu tải cao, tính nhất quán dữ liệu, phân vùng mạng và tối ưu bộ nhớ là pháo đài sinh tồn mà AI không thể thay thế con người. Nắm vững System Design là chìa khóa bảo chứng vị thế không thể bị thay thế của kỹ sư. ...

10 tháng 5, 2026 · 15 phút · Lê Tuấn Anh
GraphRAG vs Naive RAG Kiến Trúc Doanh Nghiệp

GraphRAG và Naive RAG: Hướng Dẫn Kiến Trúc Doanh Nghiệp

🇬🇧 Read the English version of this article on tanhdev.com Answer-first: GraphRAG kết hợp Knowledge Graph với Vector Search, giải quyết bài toán suy luận đa bước (multi-hop) và tổng hợp bối cảnh toàn cục. Kiến trúc chuẩn doanh nghiệp sử dụng thuật toán Leiden, đồ thị Neo4j kèm Kafka CDC streaming real-time và kiểm soát ACL phân quyền tầng entity. Đại đa số các phương án triển khai RAG (Retrieval-Augmented Generation) thông thường (Naive RAG) đều có cơ chế tương tự: chia tài liệu thành từng mảng nhỏ (chunks), tạo vector embedding, lưu trữ trong cơ sở dữ liệu vector (vector database), trích xuất thông tin qua độ tương đồng cosine (cosine similarity), và chuyển top-K chunks vào ngữ cảnh (context) của LLM. Phương pháp này hoạt động hiệu quả cho các câu hỏi đáp (Q&A) trên tài liệu ngắn. Tuy nhiên, nó bộc lộ hạn chế lớn khi áp dụng vào kho tri thức doanh nghiệp phức tạp, nơi câu trả lời không nằm ở một chunk rời rạc mà nằm ở các mối quan hệ (relationships) kết nối giữa nhiều thực thể (entities) khác nhau. ...

1 tháng 6, 2026 · 19 phút · Lê Tuấn Anh
Thiết kế Hệ thống Tìm kiếm TMĐT dạng Agent với Golang

Thiết kế Hệ thống Tìm kiếm TMĐT dạng Agent với Golang

Answer-first: Hệ thống tìm kiếm TMĐT Agentic kết hợp Hybrid Search (Sparse BM25 + Dense HNSW) với Small Language Models (SLM) router trên Go microservices. Kiến trúc phân tích intent đa bước, trích xuất thuộc tính tức thời và re-rank ngữ nghĩa dưới 45ms, tăng tỷ lệ chuyển đổi tìm kiếm không dấu/phức tạp thêm 28% so với OpenSearch truyền thống. 🇬🇧 Read the English version of this article on tanhdev.com ...

22 tháng 5, 2026 · 11 phút · Lê Tuấn Anh