---
title: "Stop-Sequenzen"
source: "https://systems-analysis.info/int/Stop-Sequenzen"
wiki: "systems-analysis.info/int"
article: "Stop-Sequenzen"
language: "de"
categories:
  - "Category:German"
  - "Category:Large language models"
  - "Category:Machine learning"
revision_id: 6931
wiki_created_at: 2026-09-07T00:13:26Z
wiki_modified_at: 2026-09-07T00:13:26Z
downloaded_at: 2026-09-07T23:16:29Z
---

# Stop-Sequenzen

Eine **Stop Sequence** (*Stoppsequenz*) ist im Kontext von großen Sprachmodellen (LLMs) eine spezielle Abfolge von Zeichen oder Tokens, die dem Modell signalisiert, die Textgenerierung zu beenden<sup>[\[1\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-promptitude_def-1)</sup>. Dieser Mechanismus ist ein wichtiger Bestandteil autoregressiver Sprachmodelle und ermöglicht einen kontrollierten und vorhersagbaren Abschluss der Antwort.

Bei der Verwendung einer Stop-Sequenz prüft das Modell bei jedem Generierungsschritt, ob der bereits erzeugte Text mit einer der angegebenen Sequenzen endet. Wenn eine Übereinstimmung gefunden wird, wird der Prozess sofort beendet, wobei die Stop-Sequenz selbst **nicht** in die endgültige Ausgabe aufgenommen wird<sup>[\[2\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-openai_api-2)</sup>. Dies ermöglicht es Entwicklern, die Grenzen der Antwort präzise zu steuern, ohne den eigentlichen Prompt zu verändern.

## Grundprinzipien der Funktionsweise

In autoregressiven Sprachmodellen erfolgt die Textgenerierung sequenziell, Token für Token. Bei jedem Schritt sagt das Modell das nächste Token auf der Grundlage der gesamten vorhergehenden Sequenz (des Eingabe-Prompts und des bereits generierten Textes) voraus. Mathematisch wird dies als bedingte Wahrscheinlichkeit ausgedrückt:

$$
P(y_{t} \mid y_{< t},x)
$$

wobei $y_{t}$ das aktuell generierte Token ist, $y_{< t}$ die Sequenz der zuvor generierten Tokens und $x$ die Eingabesequenz<sup>[\[3\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-vellum_params-3)</sup>.

Der Mechanismus der **Stop-Sequenz** fungiert als externes Kriterium, um diesen iterativen Prozess zu unterbrechen.

## Arten von Stop-Sequenzen

Es gibt mehrere Haupttypen von Stop-Mechanismen, die einzeln oder in Kombination verwendet werden können.

### 1. End-of-Sequence-Token (EOS)

**End-of-Sequence (EOS)**-Token sind spezielle Tokens (z. B. \`\<\|endoftext\|\>\`), die in das Vokabular des Modells integriert sind und das Ende eines logischen Textabschnitts markieren. Das Modell lernt, ein EOS-Token zu generieren, wenn es die Antwort für abgeschlossen hält, da alle Texte im Trainingsdatensatz mit diesem Token enden<sup>[\[4\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-gpt3_survey-4)</sup>. Wenn ein EOS-Token erkannt wird, wird die Generierung automatisch beendet.

Studien zeigen, dass das Vorhandensein von EOS-Tokens die Aufmerksamkeitsarchitektur beeinflusst: Modelle entwickeln interne Mechanismen zur Positionszählung, was jedoch ihre Fähigkeit zur Extrapolation auf Sequenzen, die die Länge der Trainingsbeispiele deutlich überschreiten, einschränken kann<sup>[\[5\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-no_eos_extrapolation-5)</sup>.

### 2. Benutzerdefinierte Sequenzen

Dies sind beliebige Zeichenketten, die ein Entwickler für eine bestimmte Aufgabe festlegt. Sie sind nicht Teil des Modellvokabulars, werden aber auf Zeichenebene verfolgt. Beispiele hierfür sind:

- **Zeilenumbruchzeichen**: \`\n\` oder \`\n\n\`, um nach einem Absatz zu stoppen.
- **Kontext-Marker**: \`Human:\`, \`User:\` oder \`Q:\`, um Redebeiträge in einem Dialog zu trennen.
- **Spezielle Marker**: \`###\`, \`\</output\>\` oder \`END\`.

### 3. Strukturelle Sequenzen

Dies sind spezialisierte Marker, die zum Abschluss bestimmter Strukturelementen verwendet werden, was bei der Generierung von formatierten Inhalten von entscheidender Bedeutung ist<sup>[\[1\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-promptitude_def-1)</sup>:

- **Code**: Dreifache Backticks (\`\`\`), um einen Codeblock abzuschließen.
- **JSON/XML**: Schließende Klammern (\`}\`) oder Tags (\`\</element\>\`).

## Technische Implementierung und Probleme

Die effiziente Erkennung von Stop-Sequenzen ist eine nicht-triviale Aufgabe, die mit einer Reihe von Schwierigkeiten verbunden ist.

### Erkennungsalgorithmus und Optimierung

Der Erkennungsprozess in realen Systemen umfasst:

1.  **Prüfung bei jedem Schritt**: Nach der Generierung jedes neuen Tokens prüft das System, ob die aktuelle Ausgabe mit einer der definierten Stop-Sequenzen endet.
2.  **Verarbeitung von Teilübereinstimmungen**: Das System muss Situationen verfolgen, in denen ein Teil der Sequenz bereits generiert wurde, aber noch keine vollständige Übereinstimmung vorliegt.
3.  **Prüfung mehrerer Kriterien**: Die meisten Systeme (z. B. die OpenAI API) ermöglichen die gleichzeitige Überwachung mehrerer (bis zu vier) Stop-Sequenzen<sup>[\[2\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-openai_api-2)</sup>.

Im Framework Hugging Face Transformers ist dafür die abstrakte Klasse \`StoppingCriteria\` implementiert, die es ermöglicht, benutzerdefinierte Abbruchkriterien zu erstellen, wie z. B. \`MaxLengthCriteria\` (basierend auf der Länge) oder \`EosTokenCriteria\` (basierend auf dem EOS-Token)<sup>[\[4\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-gpt3_survey-4)</sup>.

### Probleme und Einschränkungen

- **Problem der Tokenisierung**: Dies ist die größte technische Schwierigkeit. Dieselbe Zeichenfolge (z. B. \`\nUser:\`) kann je nach Kontext unterschiedlich in Tokens aufgeteilt werden. Dies erschwert eine zuverlässige Erkennung, da eine Stop-Sequenz auf mehrere Tokens aufgeteilt sein kann<sup>[\[5\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-no_eos_extrapolation-5)</sup>.
- **Leistung**: Die Überprüfung zahlreicher langer Stop-Sequenzen bei jedem Schritt kann die Generierung verlangsamen, insbesondere bei der Arbeit mit langen Sequenzen in Echtzeit.
- **Fehlalarme**: Eine definierte Sequenz kann zufällig mitten in der gewünschten Antwort auftreten, was zu einem vorzeitigen Abbruch führt. Daher ist es wichtig, ausreichend einzigartige und spezifische Marker zu wählen (z. B. \`\n###\n\`)<sup>[\[6\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-finetune_gpt3-6)</sup>.

## Anwendung und Nutzungsszenarien

Stop-Sequenzen sind ein leistungsstarkes Werkzeug zur Steuerung des Verhaltens von LLMs.

- **Kontrolle von Länge und Kosten**: Sie ermöglichen es, die maximale Länge der Antwort zu begrenzen und somit den Token-Verbrauch zu reduzieren, was bei der Nutzung kostenpflichtiger APIs wichtig ist.
- **Dialogsysteme**: Sie werden verwendet, um die Redebeiträge der Gesprächspartner klar voneinander zu trennen, damit das Assistenzmodell keine Antwort für den Benutzer generiert.
- **Generierung strukturierter Inhalte**: Sie sind unerlässlich, um korrekte Ausgaben in Formaten wie JSON oder XML zu erhalten oder beim Schreiben von Code, um das Hinzufügen überflüssiger Informationen nach Abschluss der Struktur zu verhindern<sup>[\[7\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-cursor_backticks-7)</sup>.
- **Verhinderung unerwünschten Verhaltens**: Sie helfen, die Generierung zu unterbrechen, wenn sich wiederholender oder fehlerhafter Inhalt (Halluzinationen) auftritt.
- **Training und Feinabstimmung (Fine-Tuning)**: In Trainingsdatensätzen werden oft einzigartige Marker (z. B. \`###\`) als Stop-Sequenz verwendet, damit das Modell lernt, die Antwort an der richtigen Stelle zu beenden<sup>[\[6\]](https://systems-analysis.info/int/Stop-Sequenzen#cite_note-finetune_gpt3-6)</sup>.

## Aktuelle Forschungsrichtungen

- **Adaptive Abbruchkriterien**: Entwicklung von Methoden, die den Endpunkt dynamisch auf der Grundlage des Kontexts und der Qualität des generierten Textes bestimmen.
- **Entropiebasierte Ansätze**: Verwendung der Entropie der Token-Verteilung als Kriterium. Eine hohe Entropie kann auf Unsicherheit des Modells hindeuten und als Signal zum Abbruch der Generierung dienen.

## Weblinks

- <a href="https://help.openai.com/en/articles/5072263-how-do-i-use-stop-sequences-in-the-openai-api" class="external text" rel="nofollow">OpenAI-Dokumentation zur Verwendung von Stop-Sequenzen</a>
- <a href="https://huggingface.co/docs/transformers/main_classes/text_generation#transformers.StoppingCriteria" class="external text" rel="nofollow">Hugging Face-Dokumentation zu StoppingCriteria</a>

## Literatur

- Sutskever, I.; Vinyals, O.; Le, Q. V. (2014). *Sequence to Sequence Learning with Neural Networks*. <a href="https://arxiv.org/abs/1409.3215" class="external text" rel="nofollow">arXiv:1409.3215</a>.
- Vaswani, A. et al. (2017). *Attention Is All You Need*. <a href="https://arxiv.org/abs/1706.03762" class="external text" rel="nofollow">arXiv:1706.03762</a>.
- Keskar, N. S. et al. (2019). *CTRL: A Conditional Transformer Language Model for Controllable Generation*. <a href="https://arxiv.org/abs/1909.05858" class="external text" rel="nofollow">arXiv:1909.05858</a>.
- Holtzman, A. et al. (2020). *The Curious Case of Neural Text Degeneration*. <a href="https://arxiv.org/abs/1904.09751" class="external text" rel="nofollow">arXiv:1904.09751</a>.
- Brown, T. et al. (2020). *Language Models are Few-Shot Learners*. <a href="https://arxiv.org/abs/2005.14165" class="external text" rel="nofollow">arXiv:2005.14165</a>.
- Zong, M.; Krishnamachari, B. (2022). *A Survey on GPT-3*. <a href="https://arxiv.org/abs/2212.00857" class="external text" rel="nofollow">arXiv:2212.00857</a>.
- Zhao, Y. et al. (2022). *Calibrating Sequence Likelihood Improves Conditional Language Generation*. <a href="https://arxiv.org/abs/2210.00045" class="external text" rel="nofollow">arXiv:2210.00045</a>.
- Hu, J. C.; Cavicchioli, R.; Capotondi, A. (2023). *A Request for Clarity over the End-of-Sequence Token in the Self-Critical Sequence Training*. <a href="https://arxiv.org/abs/2305.12254" class="external text" rel="nofollow">arXiv:2305.12254</a>.
- Zhu, W. et al. (2024). *Improving Open-Ended Text Generation via Adaptive Decoding*. <a href="https://arxiv.org/abs/2402.18223" class="external text" rel="nofollow">arXiv:2402.18223</a>.
- Zhang, H. et al. (2024). *Adaptable Logical Control for Large Language Models*. <a href="https://arxiv.org/abs/2406.13892" class="external text" rel="nofollow">arXiv:2406.13892</a>.
- Suh, Y. J. et al. (2025). *The Curious Case of Sequentially Mis-calibrated Language Models*. <a href="https://arxiv.org/abs/2205.11916" class="external text" rel="nofollow">arXiv:2205.11916</a>.

## Einzelnachweise

1.  <span id="cite_note-promptitude_def-1">↑ <sup>[1.0](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-promptitude_def_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-promptitude_def_1-1)</sup> „Stop Sequence: Understanding & Setting It Correctly“. *Promptitude.io Help Center*. <a href="https://help.promptitude.io/en/articles/8897040-stop-sequence-understanding-setting-it-correctly" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-openai_api-2">↑ <sup>[2.0](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-openai_api_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-openai_api_2-1)</sup> „How do I use stop sequences in the OpenAI API?“. *OpenAI Help Center*. <a href="https://help.openai.com/en/articles/5072263-how-do-i-use-stop-sequences-in-the-openai-api" class="external autonumber" rel="nofollow">[2]</a></span>
3.  <span id="cite_note-vellum_params-3">[↑](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-vellum_params_3-0) „How to use stop sequences?“. *Vellum*. <a href="https://www.vellum.ai/llm-parameters/stop-sequence" class="external autonumber" rel="nofollow">[3]</a></span>
4.  <span id="cite_note-gpt3_survey-4">↑ <sup>[4.0](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-gpt3_survey_4-0)</sup> <sup>[4.1](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-gpt3_survey_4-1)</sup> Brown, Tom, et al. „A Survey on GPT-3“. *arXiv:2212.00857* \[cs.CL\], 1. Dez. 2022. <a href="https://arxiv.org/pdf/2212.00857" class="external autonumber" rel="nofollow">[4]</a></span>
5.  <span id="cite_note-no_eos_extrapolation-5">↑ <sup>[5.0](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-no_eos_extrapolation_5-0)</sup> <sup>[5.1](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-no_eos_extrapolation_5-1)</sup> Suh, Y. J., et al. „The Curious Case of Sequentially Mis-calibrated Language Models“. *arXiv:2205.11916* \[cs.CL\], 24. Mai 2022. <a href="https://arxiv.org/pdf/2205.11916" class="external autonumber" rel="nofollow">[5]</a></span>
6.  <span id="cite_note-finetune_gpt3-6">↑ <sup>[6.0](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-finetune_gpt3_6-0)</sup> <sup>[6.1](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-finetune_gpt3_6-1)</sup> Eric, Mihail. „How to Finetune GPT3“. *mihaileric.com*. <a href="https://www.mihaileric.com/posts/how-to-finetune-gpt3/" class="external autonumber" rel="nofollow">[6]</a></span>
7.  <span id="cite_note-cursor_backticks-7">[↑](https://systems-analysis.info/int/Stop-Sequenzen#cite_ref-cursor_backticks_7-0) Corin, Daniel. „Way Enough - Cursor Triple Backticks Stop Sequence“. *danielcorin.com*. <a href="https://www.danielcorin.com/til/cursor/triple-backticks-stop-sequence/" class="external autonumber" rel="nofollow">[7]</a></span>
