---
title: "Self-consistency prompting (ES)"
source: "https://systems-analysis.info/int/Self-consistency_prompting_(ES)"
wiki: "systems-analysis.info/int"
article: "Self-consistency_prompting_(ES)"
language: "es"
categories:
  - "Category:Large language models"
  - "Category:Machine learning"
  - "Category:Prompt engineering"
  - "Category:Spanish"
revision_id: 6637
wiki_created_at: 2026-09-07T00:08:11Z
wiki_modified_at: 2026-09-07T00:08:11Z
downloaded_at: 2026-09-07T23:14:57Z
---

# Self-consistency prompting (ES)

**Decodificación autoconsistente** (en inglés, *Self-Consistency Prompting, SC*) es un método o estrategia de decodificación en la ingeniería de prompts, diseñado para mejorar la precisión y fiabilidad de los [grandes modelos de lenguaje (LLM)](https://systems-analysis.info/int/Grandes_modelos_de_lenguaje "Grandes modelos de lenguaje") al resolver problemas que requieren razonamiento de múltiples pasos, como acertijos aritméticos y lógicos<sup>[\[1\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wang2022-1)</sup>. El método fue propuesto por investigadores de Google Research en 2022 como una mejora de la técnica de «cadena de pensamiento» (Chain-of-Thought, CoT).

La idea principal es no limitarse a una única salida «voraz», sino generar múltiples cadenas de razonamiento diversas para la misma pregunta y luego seleccionar la respuesta final que aparece con más frecuencia entre estas variantes. Este enfoque se basa en el principio intuitivo de que si un modelo, razonando por diferentes caminos, llega repetidamente al mismo resultado, es muy probable que ese resultado sea el correcto<sup>[\[1\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wang2022-1)</sup>.

## Contexto y antecedentes

El método Self-Consistency es un desarrollo directo de la técnica **Chain-of-Thought (CoT)**. La técnica CoT, propuesta por Wei et al. (2022), mejoró significativamente la capacidad de los LLM para resolver problemas complejos al incitar al modelo a detallar explícitamente los pasos de la solución<sup>[\[2\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wei2022-2)</sup>. Sin embargo, en su implementación básica, CoT utiliza la «decodificación voraz» (*greedy decoding*), donde en cada paso se elige el siguiente token más probable. Esto crea una limitación: si el modelo comete un error en una etapa temprana, no puede desviarse de esa trayectoria incorrecta y corregirla. Self-Consistency se propuso precisamente para resolver este problema<sup>[\[1\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wang2022-1)</sup>.

## Mecanismo de funcionamiento

El algoritmo de Self-Consistency reemplaza el enfoque determinista voraz con un procedimiento de «muestreo con posterior agregación» y consta de los siguientes pasos<sup>[\[1\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wang2022-1)</sup>:

1.  **Generación de múltiples rutas de razonamiento**: En lugar de una sola respuesta, el modelo genera la solución para la misma consulta varias veces (por ejemplo, hasta 40 veces) utilizando el método de cadena de pensamiento. Para obtener diversas rutas de razonamiento, se aplican métodos de decodificación estocásticos, como el muestreo por temperatura (con un parámetro de temperatura \> 0).
2.  **Agregación y selección de la respuesta**: De todas las cadenas de razonamiento generadas, se extraen solo las respuestas finales (por ejemplo, un valor numérico). Luego, entre estas respuestas, se elige la que aparece con más frecuencia. Esta respuesta se presenta como la final.

Este enfoque imita el principio de «auto-ensamblado», donde se utilizan múltiples salidas del mismo modelo para aumentar la fiabilidad y suavizar errores aleatorios<sup>[\[3\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-portkey_summary-3)</sup>.

## Eficacia y resultados

En la investigación original, Self-Consistency demostró un aumento significativo de la precisión en varios benchmarks populares, especialmente en tareas que requieren razonamiento aritmético y lógico.

- En el benchmark de problemas matemáticos **GSM8K**, la precisión del modelo PaLM-540B aumentó del 56,6% (con CoT) al **74,4%** (con Self-Consistency), lo que supuso un incremento del **17,8%**.
- En otras tareas aritméticas, como **SVAMP** y **AQuA**, el aumento fue del **+11,0%** y **+12,2%** respectivamente.
- En tareas que requieren lógica y sentido común, como **StrategyQA**, la mejora fue del **+6,4%**<sup>[\[1\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wang2022-1)</sup>.

La aplicación de Self-Consistency permitió establecer nuevos récords de rendimiento (*state-of-the-art*) en muchos benchmarks al utilizar modelos grandes como GPT-3 175B y PaLM 540B<sup>[\[1\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-wang2022-1)</sup>.

## Ventajas y limitaciones

### Ventajas

- **Aumento de la precisión**: Mejora significativamente los resultados en tareas que requieren un razonamiento complejo de múltiples pasos.
- **Fiabilidad**: El método es más resistente a los errores que pueden ocurrir en una única cadena de razonamiento.
- **Simplicidad de implementación**: No requiere entrenamiento adicional ni modificaciones en la arquitectura del modelo. El método se puede implementar como una simple «envoltura» alrededor de un modelo ya existente.

### Limitaciones

- **Altos costos computacionales**: La principal desventaja es la necesidad de generar la respuesta varias veces (por ejemplo, 10, 20 o 40 veces) para una sola consulta, lo que aumenta proporcionalmente el costo y el tiempo de inferencia.
- **Aplicabilidad limitada**: El método estándar es más eficaz para tareas con un formato de respuesta claramente definido (por ejemplo, un número, «sí/no», una opción de una lista), donde es fácil realizar una votación por mayoría. Es poco aplicable a tareas de generación abierta (escribir un ensayo, resumir), donde las respuestas son únicas en su forma.
- **Riesgo de error sistemático**: Si el modelo genera sistemáticamente razonamientos incorrectos que, por casualidad, convergen en la misma respuesta errónea, Self-Consistency no solo no corregirá el error, sino que reforzará la confianza en él.

## Desarrollo del método: Universal Self-Consistency

La limitación del método básico en tareas con formato de respuesta libre fue abordada en investigaciones posteriores. A finales de 2023, un grupo de investigadores de Google DeepMind propuso el enfoque **Universal Self-Consistency (USC)**<sup>[\[4\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-chen2023_usc-4)</sup>.

En USC, en lugar de una simple votación sobre las respuestas finales, se utiliza el propio LLM como «juez» para la agregación. El modelo genera varias soluciones completas y luego recibe un nuevo prompt pidiéndole que elija la «más consistente» o la «de mayor calidad» entre ellas. Este enfoque permite aplicar los principios de autoconsistencia a tareas con un formato de respuesta abierto y creativo<sup>[\[5\]](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_note-deepmind_usc-5)</sup>.

## Enlaces externos

- <a href="https://arxiv.org/abs/2203.11171" class="external text" rel="nofollow">Self-Consistency Improves Chain of Thought Reasoning in Language Models</a> — artículo de investigación original de Google Research.
- <a href="https://www.promptingguide.ai/techniques/consistency" class="external text" rel="nofollow">Self-Consistency</a> — guía en Prompt Engineering Guide.

## Bibliografía

- Wang, X. et al. (2022). *Self-Consistency Improves Chain of Thought Reasoning in Language Models*. <a href="https://arxiv.org/abs/2203.11171" class="external text" rel="nofollow">arXiv:2203.11171</a>.
- Wei, J. et al. (2022). *Chain-of-Thought Prompting Elicits Reasoning in Large Language Models*. <a href="https://arxiv.org/abs/2201.11903" class="external text" rel="nofollow">arXiv:2201.11903</a>.
- Aggarwal, P. et al. (2023). *Let’s Sample Step by Step: Adaptive-Consistency for Efficient Reasoning and Coding with LLMs*. <a href="https://arxiv.org/abs/2305.11860" class="external text" rel="nofollow">arXiv:2305.11860</a>.
- Chen, X. et al. (2023). *Universal Self-Consistency with Large Language Models*. <a href="https://arxiv.org/abs/2311.17311" class="external text" rel="nofollow">arXiv:2311.17311</a>.
- Knappe, T. et al. (2024). *Semantic Self-Consistency: Enhancing Language Model Reasoning via Semantic Weighting*. <a href="https://arxiv.org/abs/2410.07839" class="external text" rel="nofollow">arXiv:2410.07839</a>.
- Liang, X. et al. (2024). *Internal Consistency and Self-Feedback in Large Language Models: A Survey*. <a href="https://arxiv.org/abs/2407.14507" class="external text" rel="nofollow">arXiv:2407.14507</a>.
- Li, T. et al. (2024). *Improving Faithfulness of Large Language Models in Summarization via Sliding Generation and Self-Consistency*. <a href="https://arxiv.org/abs/2407.21443" class="external text" rel="nofollow">arXiv:2407.21443</a>.
- Byerly, A.; Khashabi, D. (2024). *How Effective Is Self-Consistency for Long-Context Problems?*. <a href="https://arxiv.org/abs/2411.01101" class="external text" rel="nofollow">arXiv:2411.01101</a>.
- Novikova, J. et al. (2025). *Consistency in Language Models: Current Landscape, Challenges, and Future Directions*. <a href="https://arxiv.org/abs/2505.00268" class="external text" rel="nofollow">arXiv:2505.00268</a>.
- Admoni, S. et al. (2025). *Towards Large Language Models with Self-Consistent Natural Language Explanations*. <a href="https://arxiv.org/abs/2506.07523" class="external text" rel="nofollow">arXiv:2506.07523</a>.

## Referencias

1.  <span id="cite_note-wang2022-1">↑ <sup>[1.0](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wang2022_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wang2022_1-1)</sup> <sup>[1.2](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wang2022_1-2)</sup> <sup>[1.3](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wang2022_1-3)</sup> <sup>[1.4](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wang2022_1-4)</sup> <sup>[1.5](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wang2022_1-5)</sup> Wang, X., Wei, J., Schuurmans, D., et al. (2022). «Self-Consistency Improves Chain of Thought Reasoning in Language Models». *arXiv*. <a href="https://arxiv.org/abs/2203.11171" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-wei2022-2">[↑](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-wei2022_2-0) Wei, J., Wang, X., Schuurmans, D., et al. (2022). «Chain-of-Thought Prompting Elicits Reasoning in Large Language Models». *NeurIPS 2022*.</span>
3.  <span id="cite_note-portkey_summary-3">[↑](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-portkey_summary_3-0) «Self-Consistency Improves Chain of Thought Reasoning in Language Models - Summary». *Portkey*. <a href="https://portkey.ai/blog/self-consistency-improves-chain-of-thought-reasoning-in-language-models-summary" class="external autonumber" rel="nofollow">[2]</a></span>
4.  <span id="cite_note-chen2023_usc-4">[↑](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-chen2023_usc_4-0) Chen, X., et al. (2023). «Universal Self-Consistency with Large Language Models». *arXiv*. <a href="https://arxiv.org/abs/2311.15180" class="external autonumber" rel="nofollow">[3]</a></span>
5.  <span id="cite_note-deepmind_usc-5">[↑](https://systems-analysis.info/int/Self-consistency_prompting_(ES)#cite_ref-deepmind_usc_5-0) «Universal Self-Consistency with Large Language Models». *Google DeepMind Publications*. <a href="https://deepmind.google/research/publications/50879/" class="external autonumber" rel="nofollow">[4]</a></span>
