---
title: "RAG patterns — آر اے جی پیٹرنز"
source: "https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2"
wiki: "systems-analysis.info/int"
article: "RAG_patterns_—_آر_اے_جی_پیٹرنز"
language: "ur"
categories:
  - "Category:Large language models"
  - "Category:Prompt engineering"
  - "Category:Urdu"
revision_id: 6121
wiki_created_at: 2026-09-06T23:58:38Z
wiki_modified_at: 2026-09-06T23:58:38Z
downloaded_at: 2026-09-07T23:12:10Z
---

# RAG patterns — آر اے جی پیٹرنز

**RAG پیٹرنز** (انگریزی: *RAG Patterns*) — یہ **Retrieval-Augmented Generation** (RAG) سسٹمز کی تعمیر کے لیے معماری اور طریقہ کارانہ نقطہ ہائے نظر کا مجموعہ ہیں۔ یہ پیٹرنز بڑے زبانی ماڈلز (LLM) کے بنیادی مسائل — جیسے کہ فریب کاری (hallucinations)، علم کا پرانا پڑ جانا، اور ڈومین کی مخصوص معلومات کی کمی — کو حل کرنے کے لیے LLM کو بیرونی، متحرک طور پر قابلِ رسائی ڈیٹا کے ذرائع کے ساتھ ضم کر کے ان مسائل سے نمٹتے ہیں<sup>[\[1\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-lewis2020-1)</sup>۔ RAG کا ارتقاء سادہ خطی پائپ لائنز سے لے کر پیچیدہ ماڈیولر اور ایجنٹ پر مبنی سسٹمز تک کا سفر طے کر چکا ہے<sup>[\[2\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-survey2024-2)</sup>۔

## RAG کے بنیادی پیٹرنز

ٹیکنالوجی کی ترقی کے ساتھ بے شمار RAG پیٹرنز سامنے آئے ہیں، جن میں سے ہر ایک مخصوص مسائل حل کرتا ہے اور معیار، رفتار، اور لاگت کے درمیان اپنے اپنے توازن رکھتا ہے۔

- **Classic RAG (کلاسک RAG)** — بنیادی طریقہ کار، جس میں صارف کی درخواست کو ویکٹرائز کر کے ویکٹر ڈیٹا بیس میں متعلقہ ٹکڑوں (chunks) کی تلاش کی جاتی ہے؛ ملنے والے chunks کو سوال کے ساتھ LLM کو فراہم کیا جاتا ہے تاکہ جواب تیار کیا جا سکے<sup>[\[1\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-lewis2020-1)</sup>۔

<!-- -->

- **Multi‑Query RAG (متعدد سوالات)** — LLM اصل درخواست کے کئی دوبارہ الفاظ میں ڈھالے گئے/واضح کیے گئے متبادل تیار کرتا ہے؛ تلاش تمام متبادلوں پر کی جاتی ہے، نتائج یکجا کیے جاتے ہیں، جس سے یادداشت (*recall*) بہتر ہوتی ہے<sup>[\[3\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-langchain-multiquery-3)</sup>۔

<!-- -->

- **HyDE (Hypothetical Document Expansion)** — مختصر درخواست اور طویل دستاویزات کے درمیان «معنوی خلاء» کو پاٹنے کے لیے استعمال ہوتا ہے۔ LLM پہلے ایک «فرضی» جوابی دستاویز تیار کرتا ہے، پھر اس کا embedding تلاش کے لیے استعمال ہوتا ہے، جو اکثر نکالنے کا معیار بہتر بناتا ہے<sup>[\[4\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-hyde-4)</sup>۔

<!-- -->

- **Hybrid Retrieval (ہائبرڈ تلاش)** — معنوی (ویکٹر) اور الفاظی (BM25) تلاش کا امتزاج۔ ہائبرڈ اسکیمز پروڈکشن سسٹمز کا معیار بن چکی ہیں: ویکٹر تلاش معنوی مطابقتیں ڈھونڈتی ہے، جبکہ BM25 عین اصطلاحات/IDs/مخففات تلاش کرتا ہے؛ نتائج fusion سے ملائے جاتے ہیں<sup>[\[5\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-weaviate-hybrid-5)[\[6\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-qdrant-hybrid-6)[\[7\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-milvus-fulltext-7)</sup>۔

<!-- -->

- **Re‑ranking (اضافی درجہ بندی)** — دو مرحلوں کا عمل: تیز retriever امیدواروں کا مجموعہ فراہم کرتا ہے (مثلاً top‑100)، پھر cross‑encoder (یا کوئی اور reranker) متعلقیت دوبارہ شمار کر کے LLM کے لیے بہترین (مثلاً top‑5) منتخب کرتا ہے<sup>[\[8\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-nogueira2019-8)[\[9\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-cohere-rerank-9)</sup>۔

<!-- -->

- **Query Routing (درخواست کی راہنمائی)** — متعدد متنوع ڈیٹا ذرائع (مختلف indexes/ڈیٹا بیسز/APIs) والے سسٹمز میں درخواست کو router (LLM سلیکٹر یا کلاسیفائر) کی مدد سے بہترین ذریعے کی طرف بھیجا جاتا ہے؛ اس میں fallback حکمت عملیاں بھی شامل ہیں<sup>[\[10\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-llama-router-10)</sup>۔

<!-- -->

- **Agentic/Web RAG (ایجنٹ RAG)** — LLM بطور ایجنٹ کام کرتا ہے: پیچیدہ سوالات کو چھوٹے حصوں میں توڑتا ہے، تکراری منصوبہ بندی کرتا ہے اور آراء کے ساتھ اوزار (ویکٹر تلاش، ویب تلاش) استعمال کرتا ہے۔ عام نفاذ ReAct پیراڈائم ہے<sup>[\[11\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-react-11)</sup>؛ ویب پر مبنی معلومات اکٹھی کرنے اور لازمی حوالہ جات کے لیے WebGPT دیکھیں<sup>[\[12\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-webgpt-12)</sup>۔

### ملتی جلتی اور ابھرتی ہوئی پیراڈائمز

- **GraphRAG (گراف RAG)** — علمی گراف کو سیاق و سباق کے ذریعے اور انتخاب کے طریقہ کار کے طور پر استعمال کرتا ہے؛ تلاش اداروں کے درمیان روابط کی ساخت اور متن پر مبنی ہوتی ہے، جو multi‑hop سوالات پر تشریح پذیری اور معیار بہتر بناتی ہے<sup>[\[13\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-graphrag-13)[\[14\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-graphrag-project-14)</sup>۔
- **MM‑RAG (ملٹی موڈل RAG)** — متن اور بصری ذرائع (اسکینز/خاکے/جداول) کے ساتھ کام۔ مثال کے طور پر: VisRAG ملٹی موڈل دستاویزات پر VLM پر مبنی retrieval اور generation کا مظاہرہ کرتا ہے<sup>[\[15\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-visrag-15)</sup>۔
- **Packaging & Context Handling (سیاق و سباق کی پیکجنگ)** — ملنے والے chunks کو prompt میں ضم کرنے کے طریقے: *Stuff*، *Map‑Reduce*، *Refine*، *Tree‑of‑Chunks (RAPTOR)*<sup>[\[16\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-raptor-16)</sup>۔

## پیٹرنز کا تقابلی جدول

| پیٹرن                | کب استعمال کریں                                        | معیار پر اثر                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                      | لاگت / تاخیر  | خطرات اور حدود                                           |
|----------------------|--------------------------------------------------------|-----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|---------------|----------------------------------------------------------|
| **Classic RAG**      | PoC اور یکساں ڈیٹا بیس پر سادہ Q&A                     | بنیادی سطح؛ embeddings پر بہت زیادہ انحصار<sup>[\[1\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-lewis2020-1)</sup>                                                                                                                                                                                                                                                                                                                                                          | کم            | الفاظ کے انتخاب کی حساسیت؛ غیر متعلق سیاق و سباق کا خطرہ |
| **Hybrid Retrieval** | زیادہ تر پروڈکشن منظرناموں میں؛ بہت سے کوڈز/مخففات/IDs | یادداشت بہتر کرتا ہے؛ عین اصطلاحات ڈھونڈتا ہے<sup>[\[5\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-weaviate-hybrid-5)[\[6\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-qdrant-hybrid-6)[\[7\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-milvus-fulltext-7)</sup> | کم/درمیانی    | fusion وزن کی ترتیب؛ دو indexes                          |
| **Re‑ranking**       | جب اعلیٰ درستگی اہم ہو                                  | top‑k پر precision میں قابلِ ذکر اضافہ<sup>[\[8\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-nogueira2019-8)[\[9\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-cohere-rerank-9)</sup>                                                                                                                                                                                     | درمیانی/زیادہ | اضافی تاخیر/لاگت                                         |
| **Multi‑Query**      | مختصر/کثیر پہلو درخواستیں                              | recall بہتر کرتا ہے<sup>[\[3\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-langchain-multiquery-3)</sup>                                                                                                                                                                                                                                                                                                                                                                      | درمیانی       | فالتو/شور والے دوبارہ الفاظ                              |
| **HyDE**             | بڑے «معنوی خلاء» کے ساتھ مختصر/مبہم درخواستیں          | *zero‑shot* retrieval کا معیار بہتر کرتا ہے<sup>[\[4\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-hyde-4)</sup>                                                                                                                                                                                                                                                                                                                                                              | درمیانی       | «فرضی» متن کے معیار پر انحصار                            |
| **Query Routing**    | متعدد ذرائع (دستاویز ڈیٹا بیس، SQL، API، ویب)          | درست ذریعے کی وجہ سے متعلقیت بہتر ہوتی ہے<sup>[\[10\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-llama-router-10)</sup>                                                                                                                                                                                                                                                                                                                                                      | درمیانی       | غلط راستہ = تلاش ناکام                                   |
| **Agentic/Web RAG**  | پیچیدہ، تحقیقی، کثیر مرحلہ درخواستیں                   | خطی پائپ لائن کی حدود سے باہر مسائل حل کرتا ہے<sup>[\[11\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-react-11)[\[12\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-webgpt-12)</sup>                                                                                                                                                                                      | زیادہ         | پیچیدگی، چکر میں پھنسنے کا خطرہ؛ guardrails ضروری ہیں    |

RAG کے اہم پیٹرنز کا موازنہ

## عملی نفاذ اور معماری

### نفاذ کے مراحل

1.  **Proof of Concept (PoC):** محدود لیکن نمائندہ ڈیٹاسیٹ پر **Classic RAG** سے آغاز کریں تاکہ embeddings کا معیار اور بنیادی retrieval جانچا جا سکے<sup>[\[1\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-lewis2020-1)</sup>۔
2.  **Minimum Viable Product (MVP):** بہترین «محنت/اثر» تناسب کے طور پر **Hybrid Retrieval** اور **Re‑ranking** نافذ کریں<sup>[\[5\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-weaviate-hybrid-5)[\[8\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-nogueira2019-8)</sup>۔
3.  **Production:** درخواست کی تبدیلیاں (**HyDE**، **Multi‑Query**) شامل کریں اور ضرورت پڑنے پر **Query Routing** لگائیں؛ observability (retrieval/rerank/جوابات کی لاگنگ) اور A/B تجربہ کاری ترتیب دیں<sup>[\[3\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-langchain-multiquery-3)[\[10\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-llama-router-10)</sup>۔

### اہم اجزاء

- **Chunking (چنکنگ):** معیار کے سب سے اہم عوامل میں سے ایک۔ سادہ مقررہ سائز اکثر معنوی اکائیوں کو توڑ دیتا ہے۔ ساختی (مارک اپ کی بنیاد پر) یا بازگشتی splitters (پیراگراف ← جملہ ← لفظ) تجویز کیے جاتے ہیں<sup>[\[17\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-rcsplit-17)[\[18\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-llama-hier-18)</sup>۔
- **Embeddings اور میٹا ڈیٹا:** ہر chunk کے ساتھ document_id، صفحہ/حصہ، عنوان، تاریخیں محفوظ کریں؛ یہ فلٹرنگ اور درست حوالہ جات کے لیے ضروری ہے۔
- **ہائبرڈ retrieval اور rerank:** BM25 اور ویکٹر کو fusion (یا RRF) کے ساتھ استعمال کریں، پھر امیدواروں کے چھوٹے مجموعے پر دوبارہ درجہ بندی کے لیے cross‑encoder لگائیں<sup>[\[5\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-weaviate-hybrid-5)[\[6\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-qdrant-hybrid-6)[\[8\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-nogueira2019-8)</sup>۔
- **سیاق و سباق کی پیکجنگ:** طویل مجموعوں کے لیے *Map‑Reduce*، *Refine* یا *Tree‑of‑Chunks* منتخب کریں<sup>[\[16\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-raptor-16)[\[18\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-llama-hier-18)</sup>۔

### عام غلطیاں (anti-patterns)

- **صرف ویکٹر تلاش** BM25 کے بغیر ← کوڈز/IDs/مخففات پر ناکامی<sup>[\[5\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-weaviate-hybrid-5)[\[7\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-milvus-fulltext-7)</sup>۔
- **بہت بڑا/چھوٹا chunk** ← سیاق و سباق کا ضیاع یا embedding کا «بکھراؤ»<sup>[\[17\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-rcsplit-17)</sup>۔
- **پروڈکشن میں rerank کی غیر موجودگی** ← LLM کو شور والا سیاق و سباق ملتا ہے<sup>[\[8\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-nogueira2019-8)</sup>۔
- **کوئی observability نہیں** اور ذرائع کی ٹریسنگ نہیں ← غلطیوں کی وجوہات سمجھنا ناممکن ہو جاتا ہے (RAG کا جائزہ دیکھیں)۔

## معیار کا جائزہ اور میٹرکس

جائزہ retriever کی سطح (آف لائن) اور end‑to‑end (generation) دونوں پر کیا جاتا ہے۔

### Retriever میٹرکس

- **Hit Rate, Recall@k, MRR** — متعلقہ دستاویزات کی کوریج اور مقام۔
- **Context Precision & Recall** — نکالا گیا سیاق و سباق کتنا «فضول» مواد سے پاک ہے اور ضروری تمام معلومات کا احاطہ کرتا ہے (RAGAS میں نافذ)<sup>[\[19\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-ragas-19)</sup>۔

### Generator میٹرکس (end‑to‑end)

- **Faithfulness / Groundedness** — فراہم کردہ سیاق و سباق کے ساتھ جواب کی مطابقت۔
- **Answer Relevancy (جواب کی متعلقیت)** — اصل سوال کے ساتھ مطابقت۔

میٹرکس کی خودکاری کے لیے open‑source فریم ورکس استعمال ہوتے ہیں: **RAGAS**، **TruLens** (*RAG triad*: context relevance, groundedness, answer relevance)، **DeepEval**<sup>[\[20\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-trulens-20)[\[21\]](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_note-deepeval-21)</sup>۔

## یہ بھی دیکھیں

- Retrieval-Augmented Generation (RAG)
- ویکٹر ڈیٹا بیسز
- Embedding
- AI-ایجنٹ
- GraphRAG
- MM-RAG
- LLM کا جائزہ اور benchmarks

## حوالہ جات

- Lewis, P., Perez, E., et al. (2020). *Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks*. NeurIPS. arXiv:2005.11401.
- Fan, W., Ding, Y., et al. (2024). *A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models*. KDD. DOI:10.1145/3637528.3671470; arXiv:2405.06211.
- Gao, L., Ma, X., Lin, J., Callan, J. (2023). *Precise Zero‑Shot Dense Retrieval without Relevance Labels (HyDE)*. ACL 2023. ACL Anthology; arXiv:2212.10496.
- Nogueira, R., Cho, K. (2019). *Passage Re‑ranking with BERT*. arXiv:1901.04085.
- Weaviate Docs. *Hybrid search (BM25+Vector)*. <a href="https://docs.weaviate.io/weaviate/concepts/search/hybrid-search" class="external autonumber" rel="nofollow">[1]</a>.
- Qdrant Docs. *Hybrid Queries*. <a href="https://qdrant.tech/documentation/concepts/hybrid-queries/" class="external autonumber" rel="nofollow">[2]</a>.
- Milvus Docs. *Full‑Text Search* / *Hybrid Search*. <a href="https://milvus.io/docs/full-text-search.md" class="external autonumber" rel="nofollow">[3]</a> / <a href="https://milvus.io/docs/hybrid_search_with_milvus.md" class="external autonumber" rel="nofollow">[4]</a>.
- LangChain Docs. *MultiQueryRetriever*. <a href="https://python.langchain.com/docs/how_to/MultiQueryRetriever/" class="external autonumber" rel="nofollow">[5]</a>.
- Cohere Docs. *Rerank — best practices*. <a href="https://docs.cohere.com/docs/reranking-best-practices" class="external autonumber" rel="nofollow">[6]</a>.
- LlamaIndex Docs. *Routing (query routers/selectors)*. <a href="https://docs.llamaindex.ai/en/stable/module_guides/querying/router/" class="external autonumber" rel="nofollow">[7]</a>.
- Yao, S., et al. (2023). *ReAct: Synergizing Reasoning and Acting in Language Models*. ICLR. arXiv:2210.03629.
- Nakano, R., et al. (2021). *WebGPT: Browser‑assisted question‑answering with human feedback*. arXiv:2112.09332.
- Microsoft Research Blog. *GraphRAG: Unlocking LLM discovery on narrative private data*. (2024). <a href="https://www.microsoft.com/en-us/research/blog/graphrag-unlocking-llm-discovery-on-narrative-private-data/" class="external autonumber" rel="nofollow">[8]</a>.
- Microsoft Research. *Project GraphRAG*. (2024). <a href="https://www.microsoft.com/en-us/research/project/graphrag/" class="external autonumber" rel="nofollow">[9]</a>.
- Yu, S., et al. (2024). *VisRAG: Vision‑based Retrieval‑augmented Generation on Multi‑modality Documents*. arXiv:2410.10594.
- Sarthi, P., et al. (2024). *RAPTOR: Recursive Abstractive Processing for Tree‑Organized Retrieval*. arXiv:2401.18059.
- Es, S., et al. (2024). *RAGAs: Automated Evaluation of Retrieval Augmented Generation*. EACL (Demo). <a href="https://aclanthology.org/2024.eacl-demo.16/" class="external autonumber" rel="nofollow">[10]</a>.
- TruLens Docs. *RAG Triad*. <a href="https://www.trulens.org/getting_started/core_concepts/rag_triad/" class="external autonumber" rel="nofollow">[11]</a>.
- DeepEval (GitHub). *The LLM Evaluation Framework*. <a href="https://github.com/confident-ai/deepeval" class="external autonumber" rel="nofollow">[12]</a>.
- LangChain Docs. *RecursiveCharacterTextSplitter*. <a href="https://python.langchain.com/docs/how_to/recursive_text_splitter/" class="external autonumber" rel="nofollow">[13]</a>.
- LlamaIndex Docs. *HierarchicalNodeParser*; *Response Synthesis (Tree/Refine)*. <a href="https://docs.llamaindex.ai/en/stable/api/llama_index.core.node_parser.HierarchicalNodeParser.html" class="external autonumber" rel="nofollow">[14]</a>; <a href="https://docs.llamaindex.ai/en/stable/examples/low_level/response_synthesis/" class="external autonumber" rel="nofollow">[15]</a>.

## حواشی

1.  <span id="cite_note-lewis2020-1">↑ <sup>[1.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-lewis2020_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-lewis2020_1-1)</sup> <sup>[1.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-lewis2020_1-2)</sup> <sup>[1.3](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-lewis2020_1-3)</sup> Lewis, P., Perez, E., et al. (2020). *Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks*. NeurIPS. arXiv:2005.11401.</span>
2.  <span id="cite_note-survey2024-2">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-survey2024_2-0) Fan, W., Ding, Y., et al. (2024). *A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models*. KDD. DOI:10.1145/3637528.3671470; arXiv:2405.06211.</span>
3.  <span id="cite_note-langchain-multiquery-3">↑ <sup>[3.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-langchain-multiquery_3-0)</sup> <sup>[3.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-langchain-multiquery_3-1)</sup> <sup>[3.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-langchain-multiquery_3-2)</sup> LangChain Docs. *MultiQueryRetriever*. <a href="https://python.langchain.com/docs/how_to/MultiQueryRetriever/" class="external free" rel="nofollow">https://python.langchain.com/docs/how_to/MultiQueryRetriever/</a></span>
4.  <span id="cite_note-hyde-4">↑ <sup>[4.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-hyde_4-0)</sup> <sup>[4.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-hyde_4-1)</sup> Gao, L., Ma, X., Lin, J., Callan, J. (2023). *Precise Zero‑Shot Dense Retrieval without Relevance Labels*. ACL 2023. arXiv:2212.10496; ACL Anthology: 2023.acl‑long.99.</span>
5.  <span id="cite_note-weaviate-hybrid-5">↑ <sup>[5.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-weaviate-hybrid_5-0)</sup> <sup>[5.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-weaviate-hybrid_5-1)</sup> <sup>[5.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-weaviate-hybrid_5-2)</sup> <sup>[5.3](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-weaviate-hybrid_5-3)</sup> <sup>[5.4](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-weaviate-hybrid_5-4)</sup> Weaviate Docs. *Hybrid search (BM25+Vector)*. <a href="https://docs.weaviate.io/weaviate/concepts/search/hybrid-search" class="external free" rel="nofollow">https://docs.weaviate.io/weaviate/concepts/search/hybrid-search</a></span>
6.  <span id="cite_note-qdrant-hybrid-6">↑ <sup>[6.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-qdrant-hybrid_6-0)</sup> <sup>[6.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-qdrant-hybrid_6-1)</sup> <sup>[6.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-qdrant-hybrid_6-2)</sup> Qdrant Docs. *Hybrid Queries*. <a href="https://qdrant.tech/documentation/concepts/hybrid-queries/" class="external free" rel="nofollow">https://qdrant.tech/documentation/concepts/hybrid-queries/</a></span>
7.  <span id="cite_note-milvus-fulltext-7">↑ <sup>[7.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-milvus-fulltext_7-0)</sup> <sup>[7.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-milvus-fulltext_7-1)</sup> <sup>[7.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-milvus-fulltext_7-2)</sup> Milvus Docs. *Full‑Text Search* и *Hybrid Search*. <a href="https://milvus.io/docs/full-text-search.md" class="external free" rel="nofollow">https://milvus.io/docs/full-text-search.md</a>; <a href="https://milvus.io/docs/hybrid_search_with_milvus.md" class="external free" rel="nofollow">https://milvus.io/docs/hybrid_search_with_milvus.md</a></span>
8.  <span id="cite_note-nogueira2019-8">↑ <sup>[8.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-nogueira2019_8-0)</sup> <sup>[8.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-nogueira2019_8-1)</sup> <sup>[8.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-nogueira2019_8-2)</sup> <sup>[8.3](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-nogueira2019_8-3)</sup> <sup>[8.4](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-nogueira2019_8-4)</sup> Nogueira, R., Cho, K. (2019). *Passage Re‑ranking with BERT*. arXiv:1901.04085.</span>
9.  <span id="cite_note-cohere-rerank-9">↑ <sup>[9.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-cohere-rerank_9-0)</sup> <sup>[9.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-cohere-rerank_9-1)</sup> Cohere Docs. *Rerank — best practices*. <a href="https://docs.cohere.com/docs/reranking-best-practices" class="external free" rel="nofollow">https://docs.cohere.com/docs/reranking-best-practices</a></span>
10. <span id="cite_note-llama-router-10">↑ <sup>[10.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-llama-router_10-0)</sup> <sup>[10.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-llama-router_10-1)</sup> <sup>[10.2](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-llama-router_10-2)</sup> LlamaIndex Docs. *Routing (query routers/selectors)*. <a href="https://docs.llamaindex.ai/en/stable/module_guides/querying/router/" class="external free" rel="nofollow">https://docs.llamaindex.ai/en/stable/module_guides/querying/router/</a></span>
11. <span id="cite_note-react-11">↑ <sup>[11.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-react_11-0)</sup> <sup>[11.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-react_11-1)</sup> Yao, S., et al. (2023). *ReAct: Synergizing Reasoning and Acting in Language Models*. ICLR 2023. arXiv:2210.03629.</span>
12. <span id="cite_note-webgpt-12">↑ <sup>[12.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-webgpt_12-0)</sup> <sup>[12.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-webgpt_12-1)</sup> Nakano, R., et al. (2021). *WebGPT: Browser‑assisted question‑answering with human feedback*. arXiv:2112.09332.</span>
13. <span id="cite_note-graphrag-13">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-graphrag_13-0) Microsoft Research Blog. *GraphRAG: Unlocking LLM discovery on narrative private data*. 2024. <a href="https://www.microsoft.com/en-us/research/blog/graphrag-unlocking-llm-discovery-on-narrative-private-data/" class="external free" rel="nofollow">https://www.microsoft.com/en-us/research/blog/graphrag-unlocking-llm-discovery-on-narrative-private-data/</a></span>
14. <span id="cite_note-graphrag-project-14">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-graphrag-project_14-0) Microsoft Research. *Project GraphRAG*. <a href="https://www.microsoft.com/en-us/research/project/graphrag/" class="external free" rel="nofollow">https://www.microsoft.com/en-us/research/project/graphrag/</a></span>
15. <span id="cite_note-visrag-15">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-visrag_15-0) Yu, S., et al. (2024). *VisRAG: Vision‑based Retrieval‑augmented Generation on Multi‑modality Documents*. arXiv:2410.10594; OpenReview: zG459X3Xge.</span>
16. <span id="cite_note-raptor-16">↑ <sup>[16.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-raptor_16-0)</sup> <sup>[16.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-raptor_16-1)</sup> Sarthi, P., et al. (2024). *RAPTOR: Recursive Abstractive Processing for Tree‑Organized Retrieval*. arXiv:2401.18059.</span>
17. <span id="cite_note-rcsplit-17">↑ <sup>[17.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-rcsplit_17-0)</sup> <sup>[17.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-rcsplit_17-1)</sup> LangChain Docs. *RecursiveCharacterTextSplitter*. <a href="https://python.langchain.com/docs/how_to/recursive_text_splitter/" class="external free" rel="nofollow">https://python.langchain.com/docs/how_to/recursive_text_splitter/</a></span>
18. <span id="cite_note-llama-hier-18">↑ <sup>[18.0](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-llama-hier_18-0)</sup> <sup>[18.1](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-llama-hier_18-1)</sup> LlamaIndex Docs. *HierarchicalNodeParser* и *Tree Summarization*. <a href="https://docs.llamaindex.ai/en/stable/api/llama_index.core.node_parser.HierarchicalNodeParser.html" class="external free" rel="nofollow">https://docs.llamaindex.ai/en/stable/api/llama_index.core.node_parser.HierarchicalNodeParser.html</a>; <a href="https://docs.llamaindex.ai/en/stable/examples/low_level/response_synthesis/" class="external free" rel="nofollow">https://docs.llamaindex.ai/en/stable/examples/low_level/response_synthesis/</a></span>
19. <span id="cite_note-ragas-19">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-ragas_19-0) Es, S., et al. (2024). *RAGAs: Automated Evaluation of Retrieval Augmented Generation*. EACL (Demo). <a href="https://aclanthology.org/2024.eacl-demo.16/" class="external free" rel="nofollow">https://aclanthology.org/2024.eacl-demo.16/</a></span>
20. <span id="cite_note-trulens-20">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-trulens_20-0) TruLens Docs. *RAG Triad*. <a href="https://www.trulens.org/getting_started/core_concepts/rag_triad/" class="external free" rel="nofollow">https://www.trulens.org/getting_started/core_concepts/rag_triad/</a></span>
21. <span id="cite_note-deepeval-21">[↑](https://systems-analysis.info/int/RAG_patterns_%E2%80%94_%D8%A2%D8%B1_%D8%A7%DB%92_%D8%AC%DB%8C_%D9%BE%DB%8C%D9%B9%D8%B1%D9%86%D8%B2#cite_ref-deepeval_21-0) DeepEval (GitHub). <a href="https://github.com/confident-ai/deepeval" class="external free" rel="nofollow">https://github.com/confident-ai/deepeval</a></span>
