---
title: "Prompt-Engineering"
source: "https://systems-analysis.info/int/Prompt-Engineering"
wiki: "systems-analysis.info/int"
article: "Prompt-Engineering"
language: "de"
categories:
  - "Category:German"
  - "Category:Large language models"
  - "Category:Machine learning"
  - "Category:Prompt engineering"
revision_id: 5928
wiki_created_at: 2026-09-06T23:55:58Z
wiki_modified_at: 2026-09-06T23:55:58Z
downloaded_at: 2026-09-07T23:11:04Z
---

# Prompt-Engineering

**Prompt-Engineering** ist eine Disziplin, die sich mit der Entwicklung und Optimierung von Prompts (Anweisungen) befasst, um effektiv mit großen Sprachmodellen (LLM) zu interagieren. Die Qualität eines Prompts bestimmt direkt die Genauigkeit, Relevanz und Sicherheit der Modellantwort. Dieses Feld entwickelt sich rasant und geht von der manuellen Erstellung von Anweisungen zur Entwicklung komplexer Agentensysteme und dem Einsatz von Modellen mit integrierten Denkmechanismen über.

## Grundprinzipien und Struktur eines Prompts

Obwohl es keinen einheitlichen Standard gibt, basieren effektive Prompts auf gemeinsamen Ansätzen, die von verschiedenen Forschern und Unternehmen vorgeschlagen werden (z. B. die 6 Strategien von OpenAI oder die praktischen Anleitungen von Anthropic).

- Ein effektiver Prompt enthält oft die folgenden Komponenten:
  - Rolle (*Persona*): Legt den Kontext und den Verhaltensstil des Modells fest (*„Du bist ein leitender wissenschaftlicher Mitarbeiter ...“*).
  - Anweisungen (*Instructions*): Klare, schrittweise Anweisungen, was zu tun ist.
  - Kontext (*Context*): Notwendige Informationen zur Erfüllung der Aufgabe.
  - Beispiele (*Examples*): Demonstration des gewünschten Formats oder Stils (Few-Shot-Prompting).
  - Ausgabeformat (*Output Format*): Vorgabe der Antwortstruktur (z. B. JSON, Markdown).

## Techniken zur Verbesserung des logischen Denkens (Reasoning)

Diese Techniken veranlassen das Modell, strukturierter zu „denken“.*Wichtiger Hinweis (Emergenz): Die Wirksamkeit der \`Chain‑of‑Thought\`-Technik zeigt sich nur bei großen Modellen (≈100 Milliarden Parameter und mehr). Kleinere Modelle zeigen einen vernachlässigbaren Effekt oder sogar eine Verschlechterung der Ergebnisse.*

- **Chain-of-Thought (CoT):** Die Anweisung an das Modell, vor der endgültigen Antwort eine schrittweise logische Herleitung zu generieren („Denke Schritt für Schritt“).
- Variationen und Alternativen zu CoT:
  - **Self-Consistency:** Generierung mehrerer Gedankengänge und Auswahl der häufigsten Antwort durch eine „Abstimmung“.
  - **Tree-of-Thoughts (ToT):** Untersuchung mehrerer Denkpfade in Form eines Baumes, mit Bewertung und Rückkehr zu vorherigen Schritten.
  - **Graph-of-Thought (GoT):** Eine fortgeschrittene Technik mit zwei Hauptimplementierungen: Eine modelliert die Denkprozesse als Graph für flexiblere logische Abläufe (Besta et al.), während die andere sich auf die Zusammenführung von Denkwegen konzentriert (Yao et al.).
- **Eingebaute Denkmechanismen (Reasoning Models):** Es wird über die Entwicklung einer neuen Generation von Modellen (wie *o1* und *o3* von OpenAI) berichtet, die von Grund auf mit internen Gedankengängen trainiert werden. Dies ermöglicht es ihnen, komplexere Aufgaben ohne explizites CoT-Prompting zu lösen.

## Kontextverwaltung und Gedächtnis

Mit der Zunahme der Kontextfenster entstehen neue Herausforderungen und Lösungen.

- **Kontextfenster (2024–2025):**

| Modell                      | Maximales Kontextfenster |
|-----------------------------|--------------------------|
| Google Gemini 2.0 Pro       | 2 Mio. Token             |
| Google Gemini 1.5 Pro       | 2 Mio. Token             |
| Anthropic Claude 3.5 Sonnet | ~200 Tsd. Token          |
| OpenAI GPT-4o               | ~128 Tsd. Token          |

Ab März 2025 wird Google Gemini 2.5 Pro mit einem Kontextfenster von 1 Million Token vorgestellt, und die Version Pro-Experimental verspricht 2 Millionen Token im Mai 2025.

- **Retrieval-Augmented Generation (RAG):** Klassisches RAG ergänzt den Prompt um Informationen aus externen Datenbanken. Moderne Implementierungen umfassen:
  - **GraphRAG:** Nutzt Wissensgraphen, um semantisch stärker verknüpfte Daten zu extrahieren.
  - **Multimodales RAG:** Arbeitet nicht nur mit Text, sondern auch mit Bildern, Audio und Video.
  - **Agentic RAG:** Integriert RAG in Agenten-Zyklen, in denen der Agent autonom entscheidet, wann und welche Informationen er abrufen muss.
- **Techniken für langen Kontext:** Um mit großen Kontextfenstern effizient zu arbeiten, werden fortschrittliche, aber oft proprietäre Techniken wie **Cascading KV Cache** und **Infinite Retrieval** eingesetzt.

## Fortgeschrittene Techniken: Agenten und Werkzeuge

- Werkzeugnutzung (Tool Usage):
  - **Function Calling:** Eine in Modellen (GPT-4, Claude 3.5) integrierte Fähigkeit, externe APIs aufzurufen.
  - **Model Context Protocol (MCP):** Laut einigen vorläufigen Berichten (Bestätigung erforderlich) wird ein neuer Standard zur Vereinheitlichung von Werkzeug-APIs entwickelt, der von Microsoft unterstützt wird.
- Agenten und Frameworks (2024–2025):
  - **LangChain (v0.3):** Mit der Veröffentlichung von LangChain v0.3 (September 2024) ist das Framework vollständig auf Pydantic 2 umgestiegen und hat die Unterstützung für Python 3.8 entsprechend dessen EOL-Datum im Oktober 2024 eingestellt.<sup>[\[1\]](https://systems-analysis.info/int/Prompt-Engineering#cite_note-1)</sup>
  - **AutoGen:** Ist vollständig auf eine asynchrone, ereignisorientierte Architektur (Actor-Modell) umgestiegen.
  - **CrewAI:** Ein schnell an Popularität gewinnendes, hochleistungsfähiges Framework für die Orchestrierung von Multi-Agenten-Systemen.
- No-Code-Plattformen: Werkzeuge wie AutoGen Studio ermöglichen die Erstellung und Konfiguration komplexer Agenten ohne Programmierung.

## Techniken zur Reduzierung von Halluzinationen

Halluzinationen (die Generierung faktisch falscher Informationen) bleiben ein zentrales Problem. Stand 2024 liegt ihre Rate bei führenden Modellen zwischen 3 % und 16 %, und der dadurch verursachte wirtschaftliche Schaden wird auf mehrere zehn Milliarden Dollar geschätzt.

- **Klassische Methoden:** RAG, Anforderung von Zitaten, Anpassung der Generierungsparameter (Temperatur, Top-p).
- **Moderne Ansätze zum Alignment:**
  - **Constitutional AI (CAI):** Eine von Anthropic vorgeschlagene Methode, bei der ein Modell darauf trainiert wird, einem Satz von Prinzipien (einer „Verfassung“) zu folgen, wobei KI-generiertes Feedback verwendet wird.
  - **Direct Preference Optimization (DPO):** Eine einfachere und effizientere Alternative zu RLHF. Studien zu DPO bei multimodalen VLMs (z. B. für radiologische Berichte) zeigen eine Reduzierung der Halluzinationen um das 3- bis 4,8-fache.

## Prompt-Muster: Aktueller Stand

Viele Muster (Persona, Output Customization) bleiben relevant.

- **Überdenkenswert:**
  - **Fact Check List Pattern:** Gilt als unzuverlässig. Modelle sind schlecht darin, Fakten durch Prompting selbst zu überprüfen und erfordern die Integration mit externen Verifizierungssystemen.
- **Neue Muster (2024–2025):**
  - **Meta-Prompting:** Die Verwendung eines LLM zur Generierung und Optimierung von Prompts für ein anderes LLM.
  - **Mixture-of-Experts (MoE) Prompts:** Erstellung von Prompts, die dynamisch verschiedene „Experten“-Teile des Modells ansprechen.
  - **Multimodale Muster:** Prompt-Strukturen, die Text, Bilder und andere Datentypen für komplexe Anfragen kombinieren.

## Weblinks

- <a href="https://docs.anthropic.com/en/docs/build-with-claude/prompt-engineering/overview" class="external text" rel="nofollow">Anthropic Prompt Engineering Guide</a>
- <a href="https://platform.openai.com/docs/guides/text" class="external text" rel="nofollow">OpenAI Prompt Engineering Guide</a>
- <a href="https://cloud.google.com/discover/what-is-prompt-engineering" class="external text" rel="nofollow">Google's Prompting Guide</a>
- <a href="https://www.promptingguide.ai/ru" class="external text" rel="nofollow">PromptingGuide.ai</a>
- <a href="https://docs.aws.amazon.com/bedrock/latest/userguide/prompt-engineering-guidelines.html" class="external text" rel="nofollow">Amazon Bedrock</a>

## Literatur

- Radford, A. et al. (2019). *Language Models are Unsupervised Multitask Learners*. <a href="https://cdn.openai.com/better-language-models/language_models_are_unsupervised_multitask_learners.pdf" class="external text" rel="nofollow">PDF</a>.
- Brown, T. B. et al. (2020). *Language Models are Few-Shot Learners*. <a href="https://arxiv.org/abs/2005.14165" class="external text" rel="nofollow">arXiv:2005.14165</a>.
- Li, X. L.; Liang, P. (2021). *Prefix-Tuning: Optimizing Continuous Prompts for Generation*. <a href="https://arxiv.org/abs/2101.00190" class="external text" rel="nofollow">arXiv:2101.00190</a>.
- Liu, Y. et al. (2021). *Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity*. <a href="https://arxiv.org/abs/2104.08786" class="external text" rel="nofollow">arXiv:2104.08786</a>.
- Bai, Y. et al. (2022). *Constitutional AI: Harmlessness from AI Feedback*. <a href="https://arxiv.org/abs/2212.08073" class="external text" rel="nofollow">arXiv:2212.08073</a>.
- Kojima, T. et al. (2022). *Large Language Models are Zero-Shot Reasoners*. <a href="https://arxiv.org/abs/2205.11916" class="external text" rel="nofollow">arXiv:2205.11916</a>.
- Wang, X. et al. (2022). *Self-Consistency Improves Chain of Thought Reasoning in Language Models*. <a href="https://arxiv.org/abs/2203.11171" class="external text" rel="nofollow">arXiv:2203.11171</a>.
- Wei, J. et al. (2022). *Chain-of-Thought Prompting Elicits Reasoning in Large Language Models*. <a href="https://arxiv.org/abs/2201.11903" class="external text" rel="nofollow">arXiv:2201.11903</a>.
- Zhang, Z. et al. (2022). *Automatic Chain of Thought Prompting in Large Language Models*. <a href="https://arxiv.org/abs/2210.03493" class="external text" rel="nofollow">arXiv:2210.03493</a>.
- Zhou, D. et al. (2022). *Least-to-Most Prompting Enables Complex Reasoning in Large Language Models*. <a href="https://arxiv.org/abs/2205.10625" class="external text" rel="nofollow">arXiv:2205.10625</a>.
- Besta, M. et al. (2023). *Graph of Thoughts: Solving Elaborate Problems with Large Language Models*. <a href="https://arxiv.org/abs/2308.09687" class="external text" rel="nofollow">arXiv:2308.09687</a>.
- Madaan, A. et al. (2023). *Self-Refine: Iterative Refinement with Self-Feedback*. <a href="https://arxiv.org/abs/2303.17651" class="external text" rel="nofollow">arXiv:2303.17651</a>.
- Rafailov, R. et al. (2023). *Direct Preference Optimization: Your Language Model is Secretly a Reward Model*. <a href="https://arxiv.org/abs/2305.18290" class="external text" rel="nofollow">arXiv:2305.18290</a>.
- Schick, T. et al. (2023). *Toolformer: Language Models Can Teach Themselves to Use Tools*. <a href="https://arxiv.org/abs/2302.04761" class="external text" rel="nofollow">arXiv:2302.04761</a>.
- Wang, Y. et al. (2023). *Self-Instruct: Aligning Language Models with Self-Generated Instructions*. <a href="https://arxiv.org/abs/2212.10560" class="external text" rel="nofollow">arXiv:2212.10560</a>.
- Yao, S. et al. (2023). *Tree of Thoughts: Deliberate Problem Solving with Large Language Models*. <a href="https://arxiv.org/abs/2305.10601" class="external text" rel="nofollow">arXiv:2305.10601</a>.
- Chang, K. et al. (2024). *Efficient Prompting Methods for Large Language Models: A Survey*. <a href="https://arxiv.org/abs/2404.01077" class="external text" rel="nofollow">arXiv:2404.01077</a>.
- Genkina, D. (2024). *AI Prompt Engineering Is Dead*. *IEEE Spectrum*. <a href="https://spectrum.ieee.org/prompt-engineering-is-dead" class="external autonumber" rel="nofollow">[2]</a>.
- Li, Z. et al. (2024). *Prompt Compression for Large Language Models: A Survey*. <a href="https://arxiv.org/abs/2410.12388" class="external text" rel="nofollow">arXiv:2410.12388</a>.
- Liang, X. et al. (2024). *Internal Consistency and Self-Feedback in Large Language Models: A Survey*. <a href="https://arxiv.org/abs/2407.14507" class="external text" rel="nofollow">arXiv:2407.14507</a>.
- Li, W. et al. (2025). *A Survey of Automatic Prompt Engineering: An Optimization Perspective*. <a href="https://arxiv.org/abs/2502.11560" class="external text" rel="nofollow">arXiv:2502.11560</a>.
- Wu, Z. et al. (2025). *The Dark Side of Function Calling: Pathways to Jailbreaking Large Language Models*. *EMNLP 2025*. <a href="https://aclanthology.org/2025.coling-main.39.pdf" class="external text" rel="nofollow">PDF</a>.
- Yang, B. et al. (2025). *Hallucination Detection in Large Language Models with Metamorphic Relations*. <a href="https://arxiv.org/abs/2502.15844" class="external text" rel="nofollow">arXiv:2502.15844</a>.

## Einzelnachweise

1.  <span id="cite_note-1">[↑](https://systems-analysis.info/int/Prompt-Engineering#cite_ref-1) „LangChain v0.3“. https://python.langchain.com/docs/versions/v0_3/.<a href="https://python.langchain.com/docs/versions/v0_3/" class="external autonumber" rel="nofollow">[1]</a></span>
