Aprende La inteligencia artificial que usas, explicada

Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno

Lección 6 de 69 min de lecturarevisada el 5 de septiembre de 2026revisada el 5 sept 2026gratis, sin cuenta y sin anuncios

Una alucinación de la IA es una afirmación plausible y falsa generada por un modelo de lenguaje, y OpenAI cifra las de su modelo gpt-5-thinking-mini en el 26 % de las preguntas de su prueba SimpleQA (5 de septiembre de 2025). En cuanto a privacidad, el 5 de septiembre de 2026 tres de los cuatro asistentes usan tus chats para entrenar por defecto (ChatGPT, Gemini y Copilot con sesión iniciada) y Google declara que los chats que revisa una persona «se conservan hasta tres años» aunque borres tu actividad.
OpenAI (Why language models hallucinate), Google (centro de privacidad de Gemini), OpenAI, Microsoft y Anthropic (controles de datos) · leídos el 5 de septiembre de 2026

Lo que te llevas

  1. Saber por qué un asistente inventa con la misma seguridad con la que acierta, con la cifra y la causa que da su propio fabricante.
  2. Comprobar una respuesta en un minuto con el Contador de puntos a comprobar de m8d.io: cifras, fechas, citas, nombres y enlaces, y cómo se verifica cada uno.
  3. Saber qué no pegar en ningún asistente y dónde está el interruptor del entrenamiento en cada uno de los cuatro.

La causa

Qué son las alucinaciones de la IA y por qué el modelo inventa: el examen que premia adivinar

OpenAI define las alucinaciones, en su artículo del 5 de septiembre de 2025, como «afirmaciones plausibles pero falsas generadas por modelos de lenguaje», y pone su propio ejemplo: al pedir a un chatbot muy usado el título de la tesis doctoral de uno de los autores del artículo, dio «tres respuestas distintas, ninguna correcta», y con su fecha de nacimiento, otras tres. La causa que da no es un fallo de tamaño sino de incentivos: las pruebas con las que se puntúan los modelos miden solo el acierto, así que «se les anima a adivinar en vez de decir “no lo sé”». Es el examen tipo test en el que dejar en blanco vale cero y acertar por suerte vale un punto: sobre miles de preguntas, el modelo que adivina queda por delante del que reconoce que no sabe.

La tabla del mismo artículo lo cuantifica con dos modelos de la propia empresa en la prueba SimpleQA: gpt-5-thinking-mini se abstiene en el 52 % de las preguntas, acierta el 22 % y se equivoca el 26 %; el modelo anterior, o4-mini, se abstiene el 1 %, acierta el 24 % y se equivoca el 75 %. La lectura importante es la segunda columna: el modelo viejo «acierta» algo más precisamente porque adivina siempre, y a cambio se equivoca tres veces más. OpenAI concluye que la precisión «nunca llegará al 100 %» porque hay preguntas sin respuesta posible, y que las alucinaciones «se originan en la predicción de la siguiente palabra», el mecanismo de la primera lección. De las cinco páginas más leídas del top 10 de Google España sobre alucinaciones, una sola da un porcentaje (páginas leídas el 4 de septiembre de 2026).

El método

Cómo se comprueba una respuesta de IA: cifras, fechas, citas, nombres y enlaces

Una respuesta no se comprueba entera: se comprueban sus puntos concretos, y son de cinco clases. Las cifras (un porcentaje, un precio, una potencia) se verifican pidiendo la fuente exacta y abriéndola para ver que contiene esa cifra con esa unidad. Las fechas se contrastan con la fecha de corte del modelo (lo que pasó después no lo sabe salvo que busque) y con una fuente que la publique. Las citas entrecomilladas se buscan tal cual en un buscador: una cita que no aparece en ninguna fuente es inventada, y es una de las clases más frecuentes porque una frase con comillas «suena» a verdad. Los nombres propios (una persona, una empresa, una ley, un informe) se comprueban por su existencia y por lo que se les atribuye. Y los enlaces se abren: si no cargan o no dicen lo que la respuesta dice, el dato no existe.

El Contador de puntos a comprobar en una respuesta de IA, de m8d.io, subraya cada clase en el texto que pegues, los cuenta y dice cómo se verifica cada uno. No dice si son verdad, porque eso no lo puede saber un programa: dice dónde mirar. Una respuesta sin ninguna cifra, fecha, cita, nombre ni enlace tampoco es fiable: es que no tiene nada concreto que comprobar, y tampoco nada concreto que usar. Y el truco que más tiempo ahorra es preguntarle al asistente por adelantado: «di “no lo sé” cuando no tengas la fuente», que es exactamente la respuesta que, según OpenAI, sus pruebas no le enseñaron a dar.

Herramienta de m8d.io, gratis y sin cuenta

Contador de puntos a comprobar en una respuesta de IA

Pega la respuesta de cualquier asistente y se subrayan sus cifras, fechas, citas textuales, nombres propios y enlaces, con el recuento y la forma de verificar cada clase. No dice si son ciertos, que es lo que ningún programa puede saber: dice dónde mirar. Gratis, sin cuenta y sin anuncios.

Ejemplo: el texto de ejemplo (inventado a propósito para la lección) tiene 8 puntos que comprobar: 1 enlace, 1 cita textual, 2 fechas, 2 cifras y 2 nombres propios; ninguno de los ocho existe, y suenan igual de bien que si existieran.

La privacidad

Qué no contarle a un asistente de IA: lo que dice cada fabricante que hace con tus chats

La pregunta «¿qué datos no compartir con la IA?» aparece en Google junto a esta lección y su SERP lo dice todo: dos hilos de Reddit en el top 5 (SERP del 4 de septiembre de 2026). La respuesta con base está en las páginas de los cuatro fabricantes. OpenAI: los chats de las cuentas personales se usan para entrenar por defecto y el interruptor se llama «Mejorar el modelo para todos», en Controles de datos; los chats temporales no entrenan y «se borran de nuestros sistemas a los 30 días», aunque «pueden revisarse para vigilar abusos». Google: la «Actividad en las apps de Gemini» está activada por defecto, se borra sola a los 18 meses salvo que cambies el plazo, y los chats que revisa una persona «no se borran cuando borras tu actividad», sino que «se conservan hasta tres años»; su propia página pide: «no introduzcas información confidencial que no quieras que vea un revisor».

Microsoft: con sesión iniciada, «usamos tu actividad de conversación con Copilot para entrenar», guarda las conversaciones 18 meses por defecto y el interruptor está en Cuenta, Privacidad; sin sesión, «no entrenamos con tus conversaciones». Anthropic: desde el 28 de agosto de 2025 quien usa Claude Free, Pro o Max tiene que elegir; con permiso, los chats nuevos se conservan cinco años; sin él, 30 días. De ahí sale la lista de lo que no se pega en ninguno de los cuatro, con independencia del interruptor: contraseñas y códigos de verificación (OpenAI lo pone en sus buenas prácticas: «evita escribir contraseñas o información privada directamente en los mensajes»), el DNI y los datos bancarios, datos de salud, datos de otras personas que no te han dado permiso, y documentos de tu empresa que no publicarías. Para lo demás, el chat temporal o de incógnito y el interruptor apagado.

Lo que te protege

Contraseñas, phishing y el asistente: las tres reglas que no dependen de ningún interruptor

Primera: las contraseñas no entran en un chat, ni para «que me la recuerde» ni para que rellene un formulario; la lección de agentes explica que una web maliciosa puede ordenarle a un agente que las envíe fuera, y OpenAI cita ese caso exacto en su ayuda. Donde sí entran es en un gestor de contraseñas, que las genera y las rellena sin que las escribas: m8d tiene su guía de gestores de contraseñas con la elección de la casa. Segunda: un correo redactado sin una falta y con tu nombre ya no es señal de nada, porque redactarlo cuesta un prompt; el phishing se detecta por lo que pide (una clave, un pago, prisa) y por el dominio real del enlace, nunca por la calidad del texto.

Tercera: cifrar la conexión no es anonimato ni borra lo que el asistente guarda. Una VPN protege lo que viaja entre tu dispositivo y la red, y sirve en una wifi pública; lo que escribes en el chat llega igual al fabricante y se guarda según su política. Qué hace y qué no hace una VPN lo explica la pieza de m8d sobre qué es una VPN. Las tres reglas juntas son el resumen de la lección: lo que no quieres que lea nadie no se escribe en un chat; lo que sí escribes, lo comprobarás antes de usarlo; y el interruptor del entrenamiento se apaga el primer día.

Cuántos días declara cada fabricante que guarda un chatpáginas oficiales de controles de datos y privacidad de OpenAI, Google, Microsoft y Anthropic, leídas una a una · 5 de septiembre de 2026
Cuántos días declara cada fabricante que guarda un chat (páginas oficiales de controles de datos y privacidad de OpenAI, Google, Microsoft y Anthropic, leídas una a una, 5 de septiembre de 2026)
CategoríaProductos
ChatGPT, chat temporal (se borra a los 30 días)30
Claude sin permiso de entrenamiento (30 días)30
Copilot, por defecto (18 meses)540
Gemini, borrado automático por defecto (18 meses)540
Gemini, chats revisados por una persona (hasta 3 años)1095
Claude con permiso de entrenamiento (5 años)1825

6 productos contados. Es un censo de plazos declarados, en días, no de productos: cada fila es el periodo que publica el fabricante para ese caso. Los chats normales de ChatGPT quedan en el historial hasta que los borras; OpenAI no publica un plazo fijo para ellos.

Lo que se anuncia

«Puedes desactivar este ajuste o revisar y borrar tu actividad en cualquier momento en Actividad en las apps de Gemini» (Google, centro de privacidad de las apps de Gemini, leído el 5 de septiembre de 2026).

Lo que se puede comprobar

La misma página dice que «los chats revisados por revisores humanos (y datos relacionados como tu idioma, tipo de dispositivo, información de ubicación o comentarios) no se borran cuando borras tu actividad», sino que «se conservan hasta tres años», y pide «no introducir información confidencial que no quieras que vea un revisor». Con la actividad desactivada, los chats se guardan 72 horas.

Cómo lo sabemos: las tres frases están en support.google.com/gemini/answer/13594961, leída el 5 de septiembre de 2026; el patrón (revisión humana con conservación propia) aparece también en OpenAI («pueden revisarse para vigilar abusos») y es de la categoría, no de una marca. Fuente ›
La regla

Lo que escribes en un asistente con el historial activado puede leerlo una persona y quedarse años aunque tú lo borres: contraseñas, DNI, datos de salud, datos de otros y documentos de tu empresa no entran en el chat.

Qué significa para ti
26 % de error (gpt-5-thinking-mini, SimpleQA)De cada cuatro preguntas de datos concretos a un modelo de razonamiento pequeño, una sale mal dicha con seguridad. Un dato que vas a usar (un precio, una ley, una dosis) se abre en su fuente.
«Mejorar el modelo para todos» (ChatGPT)El interruptor del entrenamiento con tus chats. Está encendido de serie en cuentas personales; se apaga en Controles de datos y afecta a toda la cuenta.
Chat temporal / de incógnitoEl chat que no entrena ni queda en el historial: en ChatGPT se borra a los 30 días; Claude lo llama de incógnito. Es donde se pega lo que no quieres guardar.
18 meses (Gemini y Copilot)Lo que un chat normal se queda en tu cuenta por defecto. En Gemini puedes bajarlo a 3 meses; en los dos puedes borrarlo a mano.
Hasta 3 años (chats revisados en Gemini)Si una persona revisó tu chat, borrar tu actividad no lo borra. Es la razón de la regla: lo confidencial no se escribe.

Comprueba lo que has aprendido

1. Según OpenAI (5 de septiembre de 2025), ¿por qué los modelos inventan respuestas en vez de decir «no lo sé»?
2. Borras tu actividad en Gemini. ¿Qué pasa con un chat que revisó una persona?
3. ¿Cuál de los cuatro asistentes te obliga a elegir si tus chats entrenan, en vez de activarlo por defecto?

Dónde se aplica lo que acabas de aprender

Con las tres reglas, la decisión es dónde guardar lo que no entra en un chat: en un gestor de contraseñas, que las genera y las rellena sin que las escribas. La guía de m8d compara la categoría y dice cuál es la elección de la casa; y la pieza sobre VPN explica qué protege y qué no.

Las 6 fuentes de esta lección, con su fecha

  1. OpenAI: Why language models hallucinate (definición, causa y tabla de porcentajes) · 5-sep-2025, leído el 5-sep-2026
  2. OpenAI: Data Controls FAQ (entrenamiento con tus chats, chats temporales) · leído el 5-sep-2026
  3. Google: centro de privacidad de las apps de Gemini (actividad, revisores, conservación) · leído el 5-sep-2026
  4. Microsoft: preguntas frecuentes de privacidad de Copilot (entrenamiento, 18 meses) · leído el 5-sep-2026
  5. Anthropic: cambios en las condiciones de consumo (elección, 5 años o 30 días) · 28-ago-2025, leído el 5-sep-2026
  6. OpenAI: ChatGPT agent (buenas prácticas: sin contraseñas en los mensajes; ejemplo de inyección de prompts) · actualizado en agosto de 2026, leído el 5-sep-2026

Cómo citar esta lección

textom8d.io (2026). «Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno». Aprende, m8d.io. https://m8d.io/aprende/inteligencia-artificial/alucinaciones-y-privacidad/
html<a href="https://m8d.io/aprende/inteligencia-artificial/alucinaciones-y-privacidad/">Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno</a>, m8d.io (2026).
apam8d.io. (2026). Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno. Aprende. Recuperado el 5 de septiembre de 2026 de https://m8d.io/aprende/inteligencia-artificial/alucinaciones-y-privacidad/

Licencia CC BY 4.0: se puede reutilizar, también con fines comerciales, citando m8d.io con enlace.

Lo que se pregunta sobre esto

¿Qué son las alucinaciones?

En un asistente de IA, afirmaciones plausibles pero falsas que el modelo genera con la misma fluidez que las verdaderas: una cifra, una fecha, una cita o un nombre que no existen. OpenAI las define así y cifra las de su modelo gpt-5-thinking-mini en el 26 % de las preguntas de su prueba SimpleQA (5 de septiembre de 2025).

¿Qué datos no compartir con la IA?

Contraseñas y códigos de verificación, DNI y datos bancarios, datos de salud, datos de otras personas sin su permiso y documentos de tu empresa que no publicarías. Con independencia del interruptor de entrenamiento: Google guarda hasta tres años los chats revisados por una persona aunque borres tu actividad.

¿Qué cosas no se le debe preguntar a ChatGPT?

No es tanto qué preguntar como qué usar sin comprobar: datos concretos (precios, leyes, dosis, fechas) que vas a aplicar. OpenAI cifra el error de su propio modelo en el 26 % de las preguntas de hechos. Pide la fuente, ábrela, y activa el chat temporal para lo que no quieras en el historial.

Comentarios

Sé el primero

Sin registro: solo un nombre. Todos los comentarios se revisan antes de publicarse.