---
title: "Alucinaciones de los LLM"
source: "https://systems-analysis.info/int/Alucinaciones_de_los_LLM"
wiki: "systems-analysis.info/int"
article: "Alucinaciones_de_los_LLM"
language: "es"
categories:
  - "Category:Large language models"
  - "Category:LLM core concepts"
  - "Category:Machine learning"
  - "Category:Spanish"
revision_id: 300
wiki_created_at: 2026-09-06T22:31:44Z
wiki_modified_at: 2026-09-06T22:31:44Z
downloaded_at: 2026-09-07T22:39:13Z
---

# Alucinaciones de los LLM

**Alucinación** (del inglés *hallucination*) en el contexto de los modelos de lenguaje grandes (LLM) es un fenómeno en el que el modelo genera con confianza una respuesta que parece plausible (*plausible*), pero que en realidad no se corresponde con la realidad, el contexto proporcionado o es internamente contradictoria<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>. El modelo «inventa» hechos, detalles o conclusiones lógicas que no están presentes en los datos de origen.

Es importante señalar que una alucinación no es un fallo o un error en el sentido tradicional. El modelo funciona según su diseño: predice la continuación más probable del texto basándose en los patrones extraídos de los datos de entrenamiento. No tiene un mecanismo incorporado de verificación de la veracidad<sup>[\[3\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-wikipedia-hallucination-3)</sup>. Las alucinaciones se diferencian de los errores simples en que presentan información con confianza pero falsa, que a menudo incluye hechos, citas o eventos inexistentes<sup>[\[4\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-openai-description-4)</sup>. Este fenómeno ha adquirido tal importancia que en 2023, el Diccionario de Cambridge agregó una nueva definición para el término «hallucination», relacionada con la inteligencia artificial<sup>[\[5\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-cambridge-dict-5)</sup>.

## Definiciones y clasificación de las alucinaciones

Aunque se utilizan diversos términos (por ejemplo, «confabulación», «invención»), las alucinaciones en los LLM se pueden dividir en dos grandes categorías: las relacionadas con la **veracidad fáctica** y las relacionadas con la **fidelidad a la fuente** (coherencia contextual)<sup>[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)</sup>.

### Alucinaciones fácticas

Este es el caso en que el modelo presenta información objetivamente incorrecta sobre el mundo real. El modelo afirma un «hecho» falso como si fuera verdadero<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)</sup>.

- **Ejemplo**: *«Charles Lindbergh fue la primera persona en pisar la superficie de la Luna»* — un hecho completamente inventado.
- **Citas y referencias falsas**: El modelo puede inventar una referencia a un trabajo científico o una ley inexistente, imitando el formato de una referencia real<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>. Esto socava la confianza en los modelos, especialmente en aplicaciones que requieren precisión (educación, noticias, consultoría)<sup>[\[7\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-quickcreator-tips-7)</sup>.

### Errores lógicos

El modelo comete una inconsistencia o un error en el razonamiento. Los hechos individuales en la respuesta pueden ser correctos, pero la conclusión es ilógica o contradice la lógica elemental<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>. Esto ocurre a menudo en razonamientos complejos o en tareas de matemáticas y causalidad, donde el modelo opera con conexiones probabilísticas de palabras en lugar de con lógica formal<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>.

- **Ejemplo**: *«Dado que los pájaros vuelan, los astronautas no experimentan la gravedad»* — el texto parece coherente, pero es lógicamente incorrecto.

### Alucinaciones contextuales

La respuesta del modelo no se corresponde con el contexto o la instrucción proporcionada. El modelo «se sale» del contexto, añadiendo información superflua o ignorando la necesaria<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)</sup>.

- **Incumplimiento de la instrucción**: Ante la petición «traduce el texto al español», el modelo responde en inglés<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)</sup>.
- **Información no proveniente de la fuente**: En una tarea de resumen, el modelo «añade» hechos que no estaban en el documento original, o los distorsiona<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)</sup>.
- **Mezcla de contextos**: A mitad de la respuesta, el modelo empieza a hablar de algo de otro ámbito. Por ejemplo, al responder una pregunta sobre el comisionado de la NBA **Adam Silver**, el modelo puede cambiar a su predecesor **David Stern**, mezclando dos contextos diferentes<sup>[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)</sup>.

### Inconsistencia

Una variedad de alucinación en la que el modelo se contradice a sí mismo dentro de una misma respuesta o serie de respuestas<sup>[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)</sup>. Un estudio encontró que en ChatGPT, el nivel de autocontradicción en las respuestas es de aproximadamente el 14%<sup>[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)</sup>.

- **Ejemplo**: *«La empresa X fue fundada en 1990... y unas frases más adelante ...La empresa X, creada en el año 2000...»*

### Alucinaciones en el código

Los LLM entrenados con código pueden generar fragmentos sintácticamente correctos pero no funcionales, utilizando funciones, bibliotecas o parámetros inexistentes<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>. Por ejemplo, un modelo podría generar \`import quantum\` en Python, aunque no existe un módulo estándar con ese nombre. En 2024, se propuso el término «code hallucination» y se creó el benchmark **CodeMirage** para sistematizar este problema<sup>[\[8\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-codemirage-paper-8)</sup>.

## Causas de la aparición

El fenómeno de las alucinaciones se debe a un conjunto de factores, desde la arquitectura del modelo hasta la calidad de los datos.

- **Arquitectura y principio de entrenamiento**: La mayoría de los LLM (por ejemplo, GPT) son transformadores autorregresivos, entrenados para predecir el siguiente token. Su objetivo es maximizar la verosimilitud del texto, no verificar la veracidad de las afirmaciones<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>. El modelo no distingue entre hechos y ficción en los datos de entrenamiento, percibiendo todo como patrones textuales<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>.
- **Calidad de los datos de entrenamiento**: Los LLM se entrenan con enormes corpus de texto de Internet, que contienen numerosas imprecisiones, mitos e información desactualizada<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)</sup>. El modelo memoriza y reproduce estos errores. También es importante el **knowledge cutoff** — el límite temporal hasta el cual el modelo dispone de información.
- **Método de generación de texto**: La naturaleza estocástica de la generación (muestreo con temperatura) permite al modelo crear respuestas más «creativas», pero menos precisas. La longitud limitada del contexto puede llevar a que el modelo «olvide» detalles tempranos del diálogo y comience a contradecirse<sup>[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)</sup>.

## Métodos de evaluación y medición

Para detectar y medir las alucinaciones se utilizan métricas automáticas, evaluación humana y benchmarks especializados.

- **Métricas automáticas**: Incluyen enfoques donde otro LLM actúa como «juez» (**LLM-as-a-judge**) para evaluar la corrección de una respuesta<sup>[\[9\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-evidently-blog-9)</sup>, o el análisis de la entropía (incertidumbre) del modelo durante la generación<sup>[\[10\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-kolena-blog-10)</sup>.
- **Anotación humana**: Se considera el «estándar de oro». Expertos o evaluadores de crowdsourcing evalúan manualmente las respuestas, marcando los errores. Este método se utiliza en el entrenamiento de modelos mediante RLHF<sup>[\[11\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-chatgpt-comparison-11)</sup>.
- **Benchmarks y pruebas de estrés**: Se han creado conjuntos de datos específicos, como **TruthfulQA**, que contiene preguntas diseñadas para provocar que el modelo reproduzca mitos comunes<sup>[\[12\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-mastering-llm-accuracy-12)</sup>. También existen tablas de clasificación, como el **Hugging Face Hallucination Leaderboard**, donde se comparan los modelos según su nivel de alucinaciones<sup>[\[13\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-llm-benchmarks-arize-13)</sup>.

## Métodos de mitigación y prevención

- **Retrieval-Augmented Generation (RAG)**: El enfoque más exitoso, que «vincula» el modelo a conocimientos externos. Antes de generar una respuesta, el modelo recibe información relevante de una base de datos, un motor de búsqueda o una API. Esto permite que el modelo base su respuesta en datos verificados en lugar de conjeturas<sup>[\[2\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-astera-guide-2)</sup>.
- **Cadenas de pensamiento (Chain-of-Thought) y autoverificación**: El modelo primero genera un razonamiento paso a paso antes de dar la respuesta final, lo que aumenta la precisión. En métodos más avanzados, como la **autoverificación (Self-Verification)**, el modelo genera una respuesta preliminar y luego se le encarga que la revise y la corrija<sup>[\[14\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-rag-cove-paper-14)</sup>.
- **Reglas y filtros integrados**: Los modelos se entrenan para negarse a responder si no están seguros. Por ejemplo, los modelos Claude de Anthropic siguen un principio de «veracidad» y a menudo responden «No lo sé con certeza...» en lugar de inventar hechos<sup>[\[11\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-chatgpt-comparison-11)</sup>.
- **Integración con herramientas externas**: Modelos como Gemini pueden reconocer automáticamente cuándo necesitan una herramienta externa (por ejemplo, una calculadora para cómputos o una búsqueda para noticias recientes) y utilizarla, lo que reduce significativamente el número de alucinaciones<sup>[\[11\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-chatgpt-comparison-11)</sup>.

## Riesgos y consecuencias

- **Riesgos legales y de reputación**: En el ámbito jurídico, las alucinaciones pueden tener graves consecuencias. El caso de **Mata v. Avianca (2023)** se hizo muy conocido, en el que un abogado utilizó ChatGPT para buscar precedentes judiciales, y este inventó varios casos inexistentes. Los abogados fueron multados, y el incidente sirvió de lección sobre la inadmisibilidad de confiar en la IA sin verificación<sup>[\[1\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-lakera-guide-1)</sup>.
- **Propagación de desinformación**: A escala social, los LLM pueden agravar el problema de las noticias falsas. Es conocido el caso del modelo **Galactica** de Meta, que fue creado para ayudar a los científicos pero comenzó a generar textos pseudocientíficos con experimentos y referencias inventadas. Tres días después, el acceso público al modelo fue cerrado<sup>[\[15\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-galactica-failure-15)</sup>.
- **Toma de decisiones erróneas**: Los usuarios, especialmente los menos experimentados, tienden a confiar en las respuestas formuladas con seguridad por la IA, lo que puede llevar a tomar decisiones incorrectas en finanzas, medicina y otras áreas críticas<sup>[\[7\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-quickcreator-tips-7)</sup>.

## Ejemplos prácticos

- **Caso de Air Canada (2023)**: El chatbot de la aerolínea inventó una política de reembolso de billetes inexistente. Cuando un cliente exigió que se aplicara, la compañía se negó. El Tribunal de Transportes de Canadá obligó a Air Canada a asumir la responsabilidad por la información proporcionada por su chatbot y a compensar las pérdidas del cliente<sup>[\[9\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-evidently-blog-9)</sup>.
- **Demanda por difamación contra OpenAI (2023)**: El locutor de radio Mark Walters demandó a OpenAI porque, en respuesta a la consulta de un periodista, ChatGPT lo acusó falsamente de fraude. Este caso subrayó la responsabilidad legal de las empresas por el contenido generado por sus modelos<sup>[\[6\]](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_note-nexla-guide-6)</sup>.

## Enlaces externos

- <a href="https://www.lakera.ai/blog/guide-to-hallucinations-in-large-language-models" class="external text" rel="nofollow">The Beginner's Guide to Hallucinations in Large Language Models</a> — una guía detallada de Lakera
- <a href="https://arxiv.org/abs/2202.03629" class="external text" rel="nofollow">Survey of Hallucination in Natural Language Generation</a> — una revisión científica del fenómeno en arXiv

## Literatura

- Holtzman, A. et al. (2020). *The Curious Case of Neural Text Degeneration*. <a href="https://arxiv.org/abs/1904.09751" class="external text" rel="nofollow">arXiv:1904.09751</a>.
- Caccia, M. et al. (2018). *Language GANs Falling Short*. <a href="https://arxiv.org/abs/1811.02549" class="external text" rel="nofollow">arXiv:1811.02549</a>.
- Fan, A. et al. (2018). *Hierarchical Neural Story Generation*. <a href="https://arxiv.org/abs/1805.04833" class="external text" rel="nofollow">arXiv:1805.04833</a>.
- Su, Y.; Collier, N. (2022). *Contrastive Search Is What You Need for Neural Text Generation*. <a href="https://arxiv.org/abs/2210.14140" class="external text" rel="nofollow">arXiv:2210.14140</a>.
- Meister, C. et al. (2023). *Locally Typical Sampling*. <a href="https://arxiv.org/abs/2202.00666" class="external text" rel="nofollow">arXiv:2202.00666</a>.
- O’Brien, S.; Lewis, M. (2023). *Contrastive Decoding Improves Reasoning in Large Language Models*. <a href="https://arxiv.org/abs/2309.09117" class="external text" rel="nofollow">arXiv:2309.09117</a>.
- Finlayson, M. et al. (2024). *Basis-Aware Truncation Sampling for Neural Text Generation*. <a href="https://arxiv.org/abs/2412.14352" class="external text" rel="nofollow">arXiv:2412.14352</a>.
- Tan, Q. et al. (2024). *A Thorough Examination of Decoding Methods in the Era of Large Language Models*. <a href="https://arxiv.org/abs/2402.06925" class="external text" rel="nofollow">arXiv:2402.06925</a>.
- Yu, S. et al. (2023). *Conformal Nucleus Sampling*. <a href="https://arxiv.org/abs/2305.02633" class="external text" rel="nofollow">arXiv:2305.02633</a>.
- Chen, S. J. et al. (2024). *Decoding Game: On Minimax Optimality of Heuristic Text Generation Methods*. <a href="https://arxiv.org/abs/2410.03968" class="external text" rel="nofollow">arXiv:2410.03968</a>.

## Referencias

1.  <span id="cite_note-lakera-guide-1">↑ <sup>[1.0](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-1)</sup> <sup>[1.2](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-2)</sup> <sup>[1.3](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-3)</sup> <sup>[1.4](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-4)</sup> <sup>[1.5](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-5)</sup> <sup>[1.6](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-lakera-guide_1-6)</sup> «The Beginner's Guide to Hallucinations in Large Language Models». *Lakera*. <a href="https://www.lakera.ai/blog/guide-to-hallucinations-in-large-language-models" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-astera-guide-2">↑ <sup>[2.0](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-1)</sup> <sup>[2.2](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-2)</sup> <sup>[2.3](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-3)</sup> <sup>[2.4](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-4)</sup> <sup>[2.5](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-5)</sup> <sup>[2.6](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-6)</sup> <sup>[2.7](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-7)</sup> <sup>[2.8](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-astera-guide_2-8)</sup> «What Is LLM Hallucination and How To Prevent It». *Astera*. <a href="https://www.astera.com/type/blog/llm-hallucination-how-to-reduce-it/" class="external autonumber" rel="nofollow">[2]</a></span>
3.  <span id="cite_note-wikipedia-hallucination-3">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-wikipedia-hallucination_3-0) «Hallucination (artificial intelligence)». En *Wikipedia*. <a href="https://en.wikipedia.org/wiki/Hallucination_(artificial_intelligence)" class="external autonumber" rel="nofollow">[3]</a></span>
4.  <span id="cite_note-openai-description-4">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-openai-description_4-0) «OpenAI describes LLM hallucinations as 'making up facts' in moments of uncertainty'». *\[fuente no especificada en el texto\]*.</span>
5.  <span id="cite_note-cambridge-dict-5">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-cambridge-dict_5-0) «Cambridge Dictionary adds new definition for 'hallucinate'». *\[fuente no especificada en el texto\]*.</span>
6.  <span id="cite_note-nexla-guide-6">↑ <sup>[6.0](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-0)</sup> <sup>[6.1](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-1)</sup> <sup>[6.2](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-2)</sup> <sup>[6.3](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-3)</sup> <sup>[6.4](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-4)</sup> <sup>[6.5](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-5)</sup> <sup>[6.6](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-nexla-guide_6-6)</sup> «LLM Hallucination—Types, Causes, and Solutions». *Nexla*. <a href="https://nexla.com/ai-infrastructure/llm-hallucination/" class="external autonumber" rel="nofollow">[4]</a></span>
7.  <span id="cite_note-quickcreator-tips-7">↑ <sup>[7.0](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-quickcreator-tips_7-0)</sup> <sup>[7.1](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-quickcreator-tips_7-1)</sup> «Effective Tips to Prevent AI Hallucinations in Generative AI». *QuickCreator*. <a href="https://quickcreator.io/quthor_blog/tricks-prevent-ai-hallucinations-generative-artificial-intelligence/" class="external autonumber" rel="nofollow">[5]</a></span>
8.  <span id="cite_note-codemirage-paper-8">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-codemirage-paper_8-0) \[2408.08333\] CodeMirage: Hallucinations in Code Generated by Large Language Models. *arXiv*. <a href="https://arxiv.org/abs/2408.08333" class="external autonumber" rel="nofollow">[6]</a></span>
9.  <span id="cite_note-evidently-blog-9">↑ <sup>[9.0](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-evidently-blog_9-0)</sup> <sup>[9.1](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-evidently-blog_9-1)</sup> «LLM hallucinations and failures: lessons from 4 examples». *Evidently AI Blog*. <a href="https://www.evidentlyai.com/blog/llm-hallucination-examples" class="external autonumber" rel="nofollow">[7]</a></span>
10. <span id="cite_note-kolena-blog-10">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-kolena-blog_10-0) «How to Perform Hallucination Detection for LLMs». *Kolena*. <a href="https://www.kolena.com/blog/how-to-perform-hallucination-detection-for-llms/" class="external autonumber" rel="nofollow">[8]</a></span>
11. <span id="cite_note-chatgpt-comparison-11">↑ <sup>[11.0](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-chatgpt-comparison_11-0)</sup> <sup>[11.1](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-chatgpt-comparison_11-1)</sup> <sup>[11.2](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-chatgpt-comparison_11-2)</sup> «ChatGPT vs Google Gemini vs Anthropic Claude: Comprehensive Comparison & Report». *DataStudios*. <a href="https://www.datastudios.org/post/chatgpt-vs-google-gemini-vs-anthropic-claude-comprehensive-comparison-report-capabilities-perfo" class="external autonumber" rel="nofollow">[9]</a></span>
12. <span id="cite_note-mastering-llm-accuracy-12">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-mastering-llm-accuracy_12-0) «Mastering LLM Accuracy: How to Test, Detect, and Fix Hallucinations in AI Models». *Stephen Weber on Medium*. <a href="https://weber-stephen.medium.com/mastering-llm-accuracy-how-to-test-detect-and-fix-hallucinations-in-ai-models-ae5f69111379" class="external autonumber" rel="nofollow">[10]</a></span>
13. <span id="cite_note-llm-benchmarks-arize-13">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-llm-benchmarks-arize_13-0) «LLM Benchmarks and Leaderboards: Avoiding Foundation Model Mistakes». *Arize Blog*. <a href="https://arize.com/blog-course/llm-leaderboards-benchmarks/" class="external autonumber" rel="nofollow">[11]</a></span>
14. <span id="cite_note-rag-cove-paper-14">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-rag-cove-paper_14-0) «Improving the Reliability of LLMs: Combining Chain-of-Thought Reasoning and Retrieval-Augmented Generation». *arXiv*. <a href="https://arxiv.org/html/2505.09031v1" class="external autonumber" rel="nofollow">[12]</a></span>
15. <span id="cite_note-galactica-failure-15">[↑](https://systems-analysis.info/int/Alucinaciones_de_los_LLM#cite_ref-galactica-failure_15-0) «Why Meta Took Down its 'Hallucinating' AI Model Galactica?». *Analytics India Magazine*. <a href="https://analyticsindiamag.com/ai-features/why-meta-took-down-its-hallucinating-ai-model-galactica/" class="external autonumber" rel="nofollow">[13]</a></span>
