---
title: "GraphRAG (RO)"
source: "https://systems-analysis.info/int/GraphRAG_(RO)"
wiki: "systems-analysis.info/int"
article: "GraphRAG_(RO)"
language: "ro"
categories:
  - "Category:Large language models"
  - "Category:Prompt engineering"
  - "Category:Romanian"
revision_id: 2740
wiki_created_at: 2026-09-06T23:10:19Z
wiki_modified_at: 2026-09-06T23:10:19Z
downloaded_at: 2026-09-07T22:53:03Z
---

# GraphRAG (RO)

**GraphRAG** — este o paradigmă avansată de **Retrieval-Augmented Generation (RAG)**, în care, în loc de căutarea tradițională prin fragmente de text izolate (chunk-uri), se utilizează un graf de cunoștințe (*Knowledge Graph, KG*)<sup>[\[1\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-zhang2025-1)</sup>. Structura grafică reprezintă explicit relațiile dintre entități și ierarhia conceptelor din domeniu, ceea ce permite LLM să efectueze extragerea de cunoștințe în mai mulți pași logici și să formuleze răspunsuri mai conștiente de context și mai explicabile<sup>[\[2\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-linkedin2024-2)</sup>.

Abordarea GraphRAG demonstrează un avantaj semnificativ față de RAG clasic atunci când se lucrează cu interogări complexe, cu mai mulți pași (*multi‑hop*), unde răspunsul depinde de combinarea mai multor fapte răspândite în documente diferite<sup>[\[3\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-hu2024-3)</sup>.

## Limitările RAG clasic și avantajele grafului

RAG clasic, bazat pe căutarea vectorială în text nestructurat, se confruntă cu o serie de limitări fundamentale care devin critice în scenarii enterprise complexe:

- **Absența relațiilor structurale:** RAG tradițional procesează chunk-urile de text ca unități izolate și nu percepe relațiile explicite dintre ele. Acest lucru îl face ineficient pentru interogările *multi‑hop*, unde pentru a răspunde este necesară parcurgerea unui lanț de fapte (A→B→C), iar căutarea găsește doar verigile de început și de sfârșit (A și C), omițând verigile intermediare<sup>[\[1\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-zhang2025-1)</sup>.
- **Ambiguitate semantică:** În domenii înalt specializate (medicină, drept, inginerie), termenii au semnificații specifice. Căutarea vectorială, captând tema generală, poate interpreta greșit rolul unui obiect concret, ceea ce duce la extragerea unui context nerelevant.
- **Explicabilitate limitată:** RAG clasic furnizează fragmente de documente, dar nu dovezi explicite privind modul în care aceste fragmente se leagă într-un lanț logic. GraphRAG, dimpotrivă, face acest proces transparent, furnizând ca dovadă calea din graf și impunând atribuirea afirmațiilor la surse (citare)<sup>[\[4\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-webgpt-4)</sup>.

**GraphRAG** rezolvă aceste probleme reprezentând cunoștințele sub forma unei rețele de entități și relații interconectate, ceea ce permite sistemului nu doar să găsească text similar, ci să efectueze inferențe logice pe baza unui model formalizat al domeniului.

## Arhitectura GraphRAG

Conveiorul general GraphRAG extinde RAG clasic, adăugând etape de construire și utilizare a grafului de cunoștințe. Acesta se împarte în două etape principale: pregătire offline și procesare online a interogării.

### Etapa 1: Ingestie și indexare (offline)

În această etapă, datele sursă (documente, baze de date) sunt transformate în două reprezentări complementare: grafică și vectorială.

1.  **Extragerea cunoștințelor:** Din texte sunt extrase fapte structurate cu ajutorul unui conveior NLP:
    - **Named Entity Recognition (NER):** Identificarea mențiunilor de entități (persoane, organizații, produse).
    - **Entity Linking (EL):** Conectarea mențiunilor la identificatori canonici din graf pentru eliminarea ambiguității (de exemplu, «Ionescu I.I.» și «I. Ionescu» devin un singur nod)<sup>[\[5\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-yang2025-5)</sup>.
    - **Relation Extraction (RE):** Identificarea relațiilor dintre entități (de exemplu, *Compania X* −*a achiziționat*→ *Startup Y*).
2.  **Modelarea și stocarea grafului:** Triplele extrase (subiect‑predicat‑obiect) sunt încărcate într-o bază de date grafică. Alegerea modelului (**Property Graph** sau **RDF**) depinde de sarcină. Este esențial să se stocheze **proveniența** (*provenance*) fiecărui fapt — referința la documentul sursă și fragmentul de text<sup>[\[3\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-hu2024-3)</sup>. În graf pot fi adăugate și metadate privind **timpul** (*valid_from/valid_to*) și **gradul de încredere** (*confidence*).
3.  **Indexare hibridă:** Paralel cu graful, se creează un index vectorial pentru fragmentele de text sursă. Aceasta permite combinarea căutării structurale prin graf cu căutarea semantică prin text.

### Etapa 2: Procesarea interogării și generarea răspunsului (online)

1.  **Parsarea interogării:** Interogarea utilizatorului este analizată pentru a extrage entitățile-cheie, care servesc drept „puncte de intrare" în graf.
2.  **Extragerea subgrafului:** În loc să caute chunk-uri individuale, GraphRAG găsește **subgraful relevant** — un fragment conex al grafului în jurul „punctelor de intrare", conținând informațiile necesare pentru răspuns. În acest scop sunt utilizați algoritmi precum **parcurgerea k‑hop** sau **Personalized PageRank (PPR)**<sup>[\[6\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-song2023-6)</sup>.
3.  **Căutarea hibridă și fuziunea rezultatelor:** Paralel cu extragerea subgrafului, se efectuează căutarea prin indexul vectorial și/sau lexical (BM25). Rezultatele din graf și din text sunt combinate și transmise la etapa următoare.
4.  **Re‑ranking:** Lista combinată de candidați (noduri ale grafului și chunk-uri de text) este re-ordonată cu ajutorul unui model mai precis (de exemplu, un cross-encoder) pentru selectarea informațiilor cele mai relevante. Aceasta permite filtrarea zgomotului și creșterea preciziei<sup>[\[7\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-nogueira2019-7)</sup>.
5.  **Împachetarea contextului și generarea:** Contextul selectat și ordonat (subgraful și textele) este transformat într-un format inteligibil pentru LLM (de exemplu, o listă de afirmații cu indicarea surselor). Acest context îmbogățit este furnizat în prompt pentru generarea răspunsului final.
6.  **Trasabilitate și citare:** Datorită legăturii «fapt ↔ sursă» din graf, răspunsul generat conține referințe precise la documentele care confirmă fiecare teză. Aceasta asigură o temeinicie și transparență ridicate.

## Tabel comparativ al componentelor

| Componentă/aspect                | Variante de implementare                                                                                                                                         | Avantaje                                                                                                                                                                     | Dezavantaje/riscuri                                                                                    | Când este preferabil                                                             |
|----------------------------------|------------------------------------------------------------------------------------------------------------------------------------------------------------------|------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|--------------------------------------------------------------------------------------------------------|----------------------------------------------------------------------------------|
| Modelul grafului de cunoștințe   | **RDF/OWL**                                                                                                                                                      | Ontologie riguroasă, inferențe logice (reasoning), compatibilitate cu Linked Open Data.                                                                                      | Dificultăți în stocarea atributelor relațiilor (timp, sursă) fără entități suplimentare (reification). | Domenii semantic bogate cu ontologii existente; este necesară deducția.          |
| **Property Graph** (Neo4j, etc.) | Flexibilitate, proprietăți arbitrare pe noduri/muchii, performanță ridicată.                                                                                     | Necesită o schemă clară definită manual sau riscul unui «haos»; nu există un standard unic.                                                                                  | Start rapid cu date nestructurate; integrare cu documente (multi‑model DB).                            |                                                                                  |
| Extragerea subgrafului           | **k‑hop BFS / DFS**                                                                                                                                              | Acoperă toate nodurile până la adâncimea k, simplu de implementat.                                                                                                           | «Explozie» a grafului: creștere exponențială a numărului de noduri; poate returna mult zgomot.         | Grafuri mici sau parcurgere la adâncimea 1–2; structuri ierarhice.               |
| **Personalized PageRank (PPR)**  | Se focalizează pe nodurile cu adevărat conectate, zgomotul este filtrat<sup>[\[6\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-song2023-6)</sup>. | Poate omite un nod îndepărtat, dar important (dacă există puține căi, dar acesta este critic).                                                                               | Rețele complexe cu multiple căi (graf social, graf de citări).                                         |                                                                                  |
| Căutare hibridă                  | **Listă combinată** (scalar fusion cu ponderea λ)                                                                                                                | Ajustarea ponderilor λ permite echilibrarea precision/recall în funcție de sarcină<sup>[\[8\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-hsu2025-8)</sup>.   | Un λ fix nu este optim pentru toate tipurile de interogări.                                            | În faza de prototipare; când se știe că o sursă este evident mai importantă.     |
| **Cross‑encoder rerank**         | Creștere semnificativă a preciziei; posibilitatea de a lua în considerare interrelații complexe.                                                                 | Crește latența; necesită date de antrenament sau utilizarea modelelor existente<sup>[\[7\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-nogueira2019-7)</sup>. | Scenarii de precizie înaltă (drept, medicină), unde contextul cât mai relevant este esențial.          |                                                                                  |
| Securitatea datelor              | **Filtrarea subgrafului** (RBAC/ABAC)                                                                                                                            | Control granular (până la nivel de nod) care exclude scurgerile de date.                                                                                                     | «Zone oarbe»: dacă un nod important este eliminat, răspunsul poate deveni incomplet.                   | În medii enterprise cu cerințe stricte de acces (PII, GDPR, secrete comerciale). |

Analiza comparativă a componentelor-cheie ale arhitecturii GraphRAG

## Trasabilitate, încredere și securitate

Unul dintre principalele avantaje ale GraphRAG este posibilitatea de a prezenta **lanțuri de dovezi transparente**. În loc de un răspuns «cutie neagră», sistemul poate arăta calea de raționament: «Faptul A este menționat în \[doc1\]. Este legat de faptul B \[doc2\], iar B conform \[doc3\] conduce la C», — ceea ce sporește încrederea utilizatorului și simplifică depanarea.

În plus, structura grafică permite implementarea unui **control al accesului** granular (RBAC/ABAC). Fiecare nod sau muchie din graf poate avea o etichetă de acces. La extragerea subgrafului, sistemul filtrează automat datele la care utilizatorul nu are drepturi de acces, asigurând securitatea în domenii sensibile (finanțe, HR, medicină).

## Evaluarea calității

Evaluarea unui sistem GraphRAG este multi-etapă și include metrici pentru fiecare componentă:

- **Metrici de extragere a cunoștințelor:** F1‑score pentru NER și RE, pentru a evalua calitatea construirii grafului.
- **Metrici de extragere a subgrafului:** *Subgraph Recall@K* (proporția cazurilor în care nodurile/muchiile necesare pentru răspuns au fost incluse în subgraful extras) și *Path Precision/Recall* pentru întrebări multi‑hop.
- **Metrici ale răspunsului LLM:**
  - **Faithfulness / Groundedness:** în ce măsură răspunsul se bazează strict pe contextul furnizat.
  - **Human evaluation:** evaluarea de către experți după criterii de corectitudine, completitudine și coerență.

Pentru automatizarea evaluării sunt utilizate benchmark-uri specializate (de exemplu, *WebQuestionsSP*, *GrailQA*) și framework-uri (de exemplu, *RAGAS*)<sup>[\[9\]](https://systems-analysis.info/int/GraphRAG_(RO)#cite_note-ragas2024-9)</sup>.

## Vezi și

- Retrieval‑Augmented Generation (RAG)
- Graf de cunoștințe
- Bază de date vectorială
- Embedding
- Agent AI
- Evaluarea și benchmark-urile LLM

## Bibliografie

- Zhang, Q. et al. (2025). *A Survey of Graph Retrieval‑Augmented Generation for Customized Large Language Models*. arXiv:2501.13958.
- Xu, Z. et al. (2024). *Retrieval‑Augmented Generation with Knowledge Graphs for Customer Service Question Answering*. arXiv:2404.17723.
- Hu, Y. et al. (2024). *GRAG: Graph Retrieval‑Augmented Generation*. arXiv:2405.16506.
- Nakano, R. et al. (2021). *WebGPT: Browser‑assisted Question‑Answering with Human Feedback*. arXiv:2112.09332.
- Yang, R. et al. (2025). *KG‑IRAG: A Knowledge Graph‑Based Iterative Retrieval‑Augmented Generation Framework for Temporal Reasoning*. arXiv:2503.14234.
- Song, Y. et al. (2023). *Advancements in Complex Knowledge Graph Question Answering: A Survey*. DOI:10.3390/electronics12214395.
- Nogueira, R.; Cho, K. (2019). *Passage Re‑ranking with BERT*. arXiv:1901.04085.
- Hsu, H.‑L.; Tzeng, J. (2025). *DAT: Dynamic Alpha Tuning for Hybrid Retrieval in Retrieval‑Augmented Generation*. arXiv:2503.23013.
- Lewis, P. et al. (2020). *Retrieval‑Augmented Generation for Knowledge‑Intensive NLP Tasks*. arXiv:2005.11401.
- Karpukhin, V. et al. (2020). *Dense Passage Retrieval for Open‑Domain Question Answering*. arXiv:2004.04906.
- Sun, H. et al. (2018). *Open‑Domain Question Answering Using Early Fusion of Knowledge Bases and Text (GRAFT‑Net)*. arXiv:1809.00782.
- Sun, H.; Bedrax‑Weiss, T.; Cohen, W. W. (2019). *PullNet: Open‑Domain Question Answering with Iterative Retrieval on Knowledge Bases and Text*. arXiv:1904.09537.
- He, X. et al. (2024). *G‑Retriever: Retrieval‑Augmented Generation for Textual Graph Understanding and Question Answering*. arXiv:2402.07630.
- Es, S.; James, J.; Espinosa‑Anke, L.; Schockaert, S. (2024). *RAGAs: Automated Evaluation of Retrieval Augmented Generation*. ACL:2024.eacl-demo.16.

## Note

1.  <span id="cite_note-zhang2025-1">↑ <sup>[1.0](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-zhang2025_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-zhang2025_1-1)</sup> Zhang, Q., et al. *A Survey of Graph Retrieval-Augmented Generation for Customized Large Language Models*. arXiv, 2025. <a href="https://arxiv.org/abs/2501.13958" class="external text" rel="nofollow">arXiv:2501.13958</a>.</span>
2.  <span id="cite_note-linkedin2024-2">[↑](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-linkedin2024_2-0) Xu, Z., et al. *Retrieval-Augmented Generation with Knowledge Graphs for Customer Service Question Answering*. SIGIR, 2024. <a href="https://arxiv.org/abs/2404.17723" class="external text" rel="nofollow">arXiv:2404.17723</a>; DOI: <a href="https://dl.acm.org/doi/10.1145/3626772.3661370" class="external text" rel="nofollow">10.1145/3626772.3661370</a>.</span>
3.  <span id="cite_note-hu2024-3">↑ <sup>[3.0](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-hu2024_3-0)</sup> <sup>[3.1](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-hu2024_3-1)</sup> Hu, Y., et al. *GRAG: Graph Retrieval‑Augmented Generation*. arXiv, 2024. <a href="https://arxiv.org/abs/2405.16506" class="external text" rel="nofollow">arXiv:2405.16506</a>; также в Findings of NAACL 2025: <a href="https://aclanthology.org/2025.findings-naacl.232/" class="external text" rel="nofollow">ACL Anthology</a>.</span>
4.  <span id="cite_note-webgpt-4">[↑](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-webgpt_4-0) Nakano, R., et al. *WebGPT: Browser‑assisted question‑answering with human feedback*. arXiv, 2021. <a href="https://arxiv.org/abs/2112.09332" class="external text" rel="nofollow">arXiv:2112.09332</a>.</span>
5.  <span id="cite_note-yang2025-5">[↑](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-yang2025_5-0) Yang, R., et al. *KG‑IRAG: A Knowledge Graph‑Based Iterative Retrieval‑Augmented Generation Framework for Temporal Reasoning*. arXiv, 2025. <a href="https://arxiv.org/abs/2503.14234" class="external text" rel="nofollow">arXiv:2503.14234</a>.</span>
6.  <span id="cite_note-song2023-6">↑ <sup>[6.0](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-song2023_6-0)</sup> <sup>[6.1](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-song2023_6-1)</sup> Song, Y., Li, W., Dai, G., Shang, X. *Advancements in Complex Knowledge Graph Question Answering: A Survey*. *Electronics*, 2023. DOI: <a href="https://doi.org/10.3390/electronics12214395" class="external text" rel="nofollow">10.3390/electronics12214395</a>.</span>
7.  <span id="cite_note-nogueira2019-7">↑ <sup>[7.0](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-nogueira2019_7-0)</sup> <sup>[7.1](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-nogueira2019_7-1)</sup> Nogueira, R., Cho, K. *Passage Re‑ranking with BERT*. arXiv, 2019. <a href="https://arxiv.org/abs/1901.04085" class="external text" rel="nofollow">arXiv:1901.04085</a>.</span>
8.  <span id="cite_note-hsu2025-8">[↑](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-hsu2025_8-0) Hsu, H.‑L.; Tzeng, J. *DAT: Dynamic Alpha Tuning for Hybrid Retrieval in Retrieval‑Augmented Generation*. arXiv, 2025. <a href="https://arxiv.org/abs/2503.23013" class="external text" rel="nofollow">arXiv:2503.23013</a>.</span>
9.  <span id="cite_note-ragas2024-9">[↑](https://systems-analysis.info/int/GraphRAG_(RO)#cite_ref-ragas2024_9-0) Es, S.; James, J.; Espinosa Anke, L.; Schockaert, S. *RAGAs: Automated Evaluation of Retrieval Augmented Generation*. EACL (System Demonstrations), 2024. <a href="https://aclanthology.org/2024.eacl-demo.16/" class="external text" rel="nofollow">ACL:2024.eacl-demo.16</a>; также preprint: <a href="https://arxiv.org/abs/2309.15217" class="external text" rel="nofollow">arXiv:2309.15217</a>.</span>
