---
title: "Bağlamsal Unutma"
source: "https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma"
wiki: "systems-analysis.info/int"
article: "Bağlamsal_Unutma"
language: "tr"
categories:
  - "Category:Large language models"
  - "Category:Machine learning"
  - "Category:Turkish"
revision_id: 742
wiki_created_at: 2026-09-06T22:38:14Z
wiki_modified_at: 2026-09-06T22:38:14Z
downloaded_at: 2026-09-07T22:42:06Z
---

# Bağlamsal Unutma

**Büyük dil modellerinde bağlamsal unutma** — büyük bir dil modelinin (LLM) tek bir etkileşim sürecinde kendisine önceden sağlanan bilgiyi kaybettiği, görmezden geldiği ya da etkisiz biçimde kullandığı çok boyutlu bir olgudur<sup>[\[1\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-howard-cds-1)</sup>. İnsan belleğinin aksine, LLM'lerin kalıcı bir durum deposu yoktur ve yalnızca **bağlam penceresine** dayanırlar — bu, modelin aynı anda işleyebildiği sınırlı miktarda metindir (token cinsinden). Bu pencere, modelin kısa süreli veya çalışma belleği işlevini görür<sup>[\[2\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-liu2023-lost-in-middle-2)</sup>.

Bu sınırlamanın en bilinen tezahürü, **«Ortada Kaybolma» (Lost in the Middle)** sorunudur — modellerin uzun bir bağlamın başında ve sonunda yer alan bilgileri daha iyi işleme, ortasındakileri ise daha kötü işleme eğilimidir<sup>[\[2\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-liu2023-lost-in-middle-2)</sup>. Bu olgu bir hata değil; transformer mimarisinden ve eğitim ilkelerinden kaynaklanan temel bir özelliktir.

## İki Tür Unutma: Bağlamsal ve Yıkıcı

LLM'lerdeki iki temel farklı «unutma» türünü birbirinden ayırt etmek önemlidir: bağlam içi unutma ve yıkıcı unutma.

### Bağlam İçi Unutma (Ortada Kaybolma)

Bu tür unutma, halihazırda eğitilmiş bir modelle **tek bir etkileşim oturumu** (çıkarım) sırasında gerçekleşir. Bağlam penceresinin sınırlılıklarıyla ilişkilidir. Diyaloğun veya belgenin hacmi pencere boyutunu aştığında, model yeni içeriğe yer açmak için en eski parçaları «unutur». Pencere sınırları içinde bile bağlamın ortasındaki bilgiler daha az etkin biçimde kullanılabilir. Bu, modelin çalışma belleğinin kısıtıdır<sup>[\[3\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-aclanthology-lost-in-middle-3)</sup>. Popüler yazında bu olgu aynı zamanda **«bağlam bozulması sendromu»** (Context Degradation Syndrome, CDS) olarak da adlandırılmaktadır<sup>[\[1\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-howard-cds-1)</sup>.

### Yıkıcı Unutma (Model Kayması)

«Model kayması» (*model drift*) olarak da bilinen bu tür unutma, modelin yeni veriler üzerinde **ince ayar (fine-tuning)** sürecinde gerçekleşir. Geniş bir genel bilgi külliyatı üzerinde önceden eğitilmiş bir model, dar kapsamlı bir veri kümesi üzerinde (örneğin tıbbi metinler) ince ayara tabi tutulduğunda ağırlıkları değişir. Bu durum, yeni görevle ilişkili olmayan, önceden edinilmiş bilgi ve becerilerin bozulmasına veya «silinmesine» yol açabilir<sup>[\[4\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-greyling-catastrophic-4)</sup>.

## Nedenler ve Mekanizmalar

Bağlamsal unutma, transformer mimarisinin ve vektör uzayı geometrisinin doğrudan bir sonucudur.

### «Ortada Kaybolma» (Lost in the Middle) Etkisi

Stanford Üniversitesi'nin 2023 tarihli «Lost in the Middle» adlı araştırması, LLM'lerin uzun bir bağlamdan bilgi çıkarımındaki performansının **U-şeklinde bir eğri** izlediğini açıkça ortaya koymuştur<sup>[\[2\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-liu2023-lost-in-middle-2)</sup>. Yanıt doğruluğu, ilgili bilgi bağlamın en başında (**öncelik etkisi**) veya en sonunda (**yenilik etkisi**) yer aldığında en yüksektir; bilgi bağlamın ortasına «gizlendiğinde» ise belirgin biçimde düşer. Bu olgunun nedenleri:

- **Dikkat mekanizması**: Transformer mimarisi, yapısı gereği başlangıç tokenlarına orantısız miktarda dikkat ayırır (bu tokenlara «dikkat çapaları» ya da *attention sinks* denir); bu durum küresel tutarlılığı korumak ve yerel bağlamı işlemek için gereklidir, ancak ortadaki içeriğe odaklanmanın zayıflamasına yol açar<sup>[\[5\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-neurips-poster-vectors-5)</sup>.
- **Ön eğitim verileri**: Modeller çoğunlukla görece kısa metinler üzerinde eğitilir; bu metinlerde önemli bilgiler baştan onlarca bin token uzakta nadiren bulunur; bu da modellerin çok uzun bağlamları etkin biçimde kullanmasını engeller<sup>[\[6\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-an2024-context-fall-short-6)</sup>.

## Tezahürler ve Sonuçlar

- **Bağlam bozulması sendromu**: Uzun diyaloglar sırasında model «konunun ipliğini kaybetmeye» başlar, yanıtları tekrar eder, önceden ortaya konulmuş olgularla çelişir ve giderek daha genel ve belirsiz yanıtlar verir<sup>[\[1\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-howard-cds-1)</sup>.
- **Çok aşamalı görevlerde başarısızlık**: Koşulların birden fazla konuşma satırı boyunca netleştirildiği görevlerde model, yanlış ilk varsayıma «takılıp kalabilir» ve sonraki düzeltmeleri görmezden gelebilir; bu da görevin tümüyle çözülememesine yol açar<sup>[\[7\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-arxiv-multi-turn-lost-7)</sup>.
- **Belge analizinde güvenilmezlik**: Uzun raporlar veya hukuki belgeler analiz edilirken LLM, merkezi bölümlerde yer alan kilit olgular gözden kaçırabilir; bu durum onu bu tür görevler için güvenilmez bir araç haline getirir.

## Azaltma ve Önleme Stratejileri

Araştırmacılar ve geliştiriciler, bağlamsal unutma sorununu çözmek için çeşitli yaklaşımlar uygulamaktadır.

### Bağlam Penceresinin Genişletilmesi

En doğrudan yaklaşım, bağlam penceresi boyutunun artırılmasıdır. **Claude 3** (200 bin token) ve **Gemini 1.5 Pro** (2 milyona kadar token) gibi çağdaş modeller bu sınırı önemli ölçüde genişletmiştir<sup>[\[8\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-anthropic-claude3-family-8)[\[9\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-google-gemini1-5-pro-9)</sup>. Ancak araştırmalar, pencereyi büyütmenin tek başına onun etkin kullanımını garanti etmediğini ve «ortada kaybolma» sorununun devam ettiğini göstermektedir<sup>[\[2\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-liu2023-lost-in-middle-2)</sup>.

### Gelişmiş Prompt Mühendisliği

Prompt'ların özenli biçimde yapılandırılması, performansı önemli ölçüde artırabilir. Anthropic şu uygulamaları önermektedir<sup>[\[10\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-anthropic-long-context-tips-10)</sup>:

- **Belgeleri başa yerleştirmek**: Uzun metinleri, talimatlar ve soru öncesinde prompt'un en başına koymak.
- **XML etiketleri kullanmak**: Belgeleri net bir ayrım sağlamak amacıyla \`\<document\>\` etiketleriyle sarmak.
- **Yanıtları alıntılarla gerekçelendirmek**: Modele önce ilgili alıntıları çıkarma, ardından bu alıntılara dayanarak yanıt oluşturma talimatı vermek.

### Belleğin Dışsallaştırılması: Retrieval-Augmented Generation (RAG)

Temelden farklı bir yaklaşım — tüm bilgiyi bağlam penceresine sığdırmaya çalışmak yerine, onu harici bir sisteme (vektör veritabanı) taşımak ve ihtiyaç duyulduğunda sağlamaktır.

1.  **Çıkarım (Retrieve)**: Bir sorgu geldiğinde sistem, harici veritabanında ilgili bilgileri arar.
2.  **Zenginleştirme (Augment)**: Bulunan parçalar orijinal sorguya eklenir.
3.  **Üretim (Generate)**: LLM, sağlanan bağlama dayanarak yanıt üretir.

**RAG**, pratikte sınırsız veri hacimleriyle çalışmayı mümkün kılar ve güncel ile doğrulanmış bilgiye erişim sağlar; bu da halüsinasyon riskini azaltır ve bugün itibarıyla en güvenilir çözüm olarak öne çıkar<sup>[\[11\]](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_note-google-cloud-rag-11)</sup>.

## Dış bağlantılar

- Lost in the Middle: How Language Models Use Long Contexts — Stanford Üniversitesi'nin özgün araştırması.
- Anthropic'in 100 bin token bağlam penceresine sahip Claude duyurusu.

## Kaynakça

- Liu, N. F. et al. (2023). *Lost in the Middle: How Language Models Use Long Contexts*. arXiv:2307.03172.
- An, C. et al. (2024). *Why Does the Effective Context Length of LLMs Fall Short?*. arXiv:2410.18745.
- Ding, J. et al. (2023). *LongNet: Scaling Transformers to 1,000,000,000 Tokens*. arXiv:2307.02486.
- Yang, A. et al. (2024). *Context Parallelism for Scalable Million-Token Inference*. arXiv:2411.01783.
- Chen, S. et al. (2023). *Extending Context Window of Large Language Models via Positional Interpolation*. arXiv:2306.15595.
- Ding, Y. et al. (2024). *LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens*. arXiv:2402.13753.
- Li, S. et al. (2023). *Functional Interpolation for Relative Positions Improves Long Context Transformers*. arXiv:2310.04418.
- Dong, Z. et al. (2024). *Exploring Context Window of Large Language Models via Decomposed Positional Vectors*. arXiv:2405.18009.
- Laban, P. et al. (2025). *LLMs Get Lost in Multi-Turn Conversation*. arXiv:2505.06120.
- Li, R. et al. (2024). *Extending Context Window in Large Language Models with Segmented Base Adjustment for Rotary Position Embeddings*. *Applied Sciences*, 14(7), 3076. DOI:10.3390/app14073076.
- Yang, A. & Reizenstein, J. (2024). *Exploring Context Window of LLMs via Decomposed Positional Vectors* (NeurIPS Poster). NeurIPS 2024.

## Notlar

1.  <span id="cite_note-howard-cds-1">↑ <sup>[1.0](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-howard-cds_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-howard-cds_1-1)</sup> <sup>[1.2](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-howard-cds_1-2)</sup> Howard, James. «Context Degradation Syndrome: When Large Language Models Lose the Plot». *jameshoward.us*. <a href="https://jameshoward.us/2024/11/26/context-degradation-syndrome-when-large-language-models-lose-the-plot/" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-liu2023-lost-in-middle-2">↑ <sup>[2.0](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-liu2023-lost-in-middle_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-liu2023-lost-in-middle_2-1)</sup> <sup>[2.2](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-liu2023-lost-in-middle_2-2)</sup> <sup>[2.3](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-liu2023-lost-in-middle_2-3)</sup> Liu, Nelson F.; et al. «Lost in the Middle: How Language Models Use Long Contexts». *arXiv*. <a href="https://cs.stanford.edu/~nfliu/papers/lost-in-the-middle.arxiv2023.pdf" class="external autonumber" rel="nofollow">[2]</a></span>
3.  <span id="cite_note-aclanthology-lost-in-middle-3">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-aclanthology-lost-in-middle_3-0) Liu, Nelson F.; et al. «Lost in the Middle: How Language Models Use Long Contexts». *ACL Anthology*. <a href="https://aclanthology.org/2024.tacl-1.9/" class="external autonumber" rel="nofollow">[3]</a></span>
4.  <span id="cite_note-greyling-catastrophic-4">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-greyling-catastrophic_4-0) Greyling, Cobus. «Catastrophic Forgetting In LLMs». *Medium*. <a href="https://cobusgreyling.medium.com/catastrophic-forgetting-in-llms-bf345760e6e2" class="external autonumber" rel="nofollow">[4]</a></span>
5.  <span id="cite_note-neurips-poster-vectors-5">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-neurips-poster-vectors_5-0) «Exploring Context Window of Large Language Models via Decomposed Positional Vectors». *NeurIPS Proceedings*. <a href="https://neurips.cc/virtual/2024/poster/92943" class="external autonumber" rel="nofollow">[5]</a></span>
6.  <span id="cite_note-an2024-context-fall-short-6">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-an2024-context-fall-short_6-0) An, Chenxin; et al. «Why Does the Effective Context Length of LLMs Fall Short?». *arXiv*. <a href="https://arxiv.org/html/2410.18745v1" class="external autonumber" rel="nofollow">[6]</a></span>
7.  <span id="cite_note-arxiv-multi-turn-lost-7">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-arxiv-multi-turn-lost_7-0) «LLMs Get Lost In Multi-Turn Conversation». *arXiv*. <a href="https://arxiv.org/html/2505.06120v1" class="external autonumber" rel="nofollow">[7]</a></span>
8.  <span id="cite_note-anthropic-claude3-family-8">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-anthropic-claude3-family_8-0) «Introducing the next generation of Claude». *Anthropic*. <a href="https://www.anthropic.com/news/claude-3-family" class="external autonumber" rel="nofollow">[8]</a></span>
9.  <span id="cite_note-google-gemini1-5-pro-9">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-google-gemini1-5-pro_9-0) «Google's Gemini 1.5 Pro - Revolutionizing AI with a 1M Token Context Window». *Medium*. <a href="https://medium.com/google-cloud/googles-gemini-1-5-pro-revolutionizing-ai-with-a-1m-token-context-window-bfea5adfd35f" class="external autonumber" rel="nofollow">[9]</a></span>
10. <span id="cite_note-anthropic-long-context-tips-10">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-anthropic-long-context-tips_10-0) «Long context prompting tips». *Anthropic Documentation*. <a href="https://docs.anthropic.com/en/docs/build-with-claude/prompt-engineering/long-context-tips" class="external autonumber" rel="nofollow">[10]</a></span>
11. <span id="cite_note-google-cloud-rag-11">[↑](https://systems-analysis.info/int/Ba%C4%9Flamsal_Unutma#cite_ref-google-cloud-rag_11-0) «What is Retrieval-Augmented Generation (RAG)?». *Google Cloud*. <a href="https://cloud.google.com/use-cases/retrieval-augmented-generation" class="external autonumber" rel="nofollow">[11]</a></span>
