دليل تنفيذ قاعدة البيانات المتجهية / RAG — من RAG الساذج إلى الإنتاج
تعرف "ما هو RAG"، لكن عند البناء تخرج الإجابة مختلّة — لأنه ما يزال RAG الساذج: تقطيع باستهتار وبحث متجهي بسيط. وبوصفه متابعة التنفيذ للمقال 030، يشرح هذا المقال خط أنابيب RAG العملي في 2026 (تقطيع ذكي، embedding، قاعدة بيانات متجهية، بحث هجين، إعادة ترتيب) مرحلة مرحلة: استراتيجيات التقطيع (recursive 512 افتراضياً، semantic/structural/parent-child، وContextual Retrieval الذي يُبلَغ أنه يخفّض فشل الاسترجاع حتى 67%)، واختيار نموذج embedding (text-embedding-3-large وغيره)، ومقارنة ست قواعد بيانات متجهية (Chroma للنماذج الأولية، pgvector مع Postgres، Qdrant منخفض الزمن، Pinecone المُدارة بالكامل، Weaviate بطلة الهجين، Milvus للنطاق الضخم)، وبحث هجين يدمج BM25 + متجهات كثيفة عبر RRF، وretrieve-then-rerank بـ bi-encoder ثم cross-encoder (Cohere/Voyage/BGE/Jina)، وتقسيم LlamaIndex (الاسترجاع) مقابل LangChain/LangGraph (التحكّم)، ولماذا لا تستبدل نافذة 1M توكن الـ RAG (lost in the middle، التشتيت)، وملاحظات الإنتاج مثل بناء مجموعة تقييم أولاً.