6/6Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno›
- 01Qué es la inteligencia artificial y qué es la IA generativa: la definición legal y cómo predice›
- 02Qué es un LLM, qué son los tokens y qué es la ventana de contexto: cuánto cabe de verdad en un chat›
- 03Qué es un prompt y cómo se escribe uno bueno: contexto, tarea, formato y ejemplo, con constructor para copiar›
- 04Qué es ChatGPT, Gemini, Copilot y Claude: qué cubre cada asistente de IA y cuál te conviene›
- 05Qué es un agente de IA y en qué se diferencia de un asistente: las cuatro piezas y cuándo pide permiso›
- 06Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno›
Aprende › La inteligencia artificial que usas, explicada
Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno
Lo que te llevas
- Saber por qué un asistente inventa con la misma seguridad con la que acierta, con la cifra y la causa que da su propio fabricante.
- Comprobar una respuesta en un minuto con el Contador de puntos a comprobar de m8d.io: cifras, fechas, citas, nombres y enlaces, y cómo se verifica cada uno.
- Saber qué no pegar en ningún asistente y dónde está el interruptor del entrenamiento en cada uno de los cuatro.
La causa
Qué son las alucinaciones de la IA y por qué el modelo inventa: el examen que premia adivinar
OpenAI define las alucinaciones, en su artículo del 5 de septiembre de 2025, como «afirmaciones plausibles pero falsas generadas por modelos de lenguaje», y pone su propio ejemplo: al pedir a un chatbot muy usado el título de la tesis doctoral de uno de los autores del artículo, dio «tres respuestas distintas, ninguna correcta», y con su fecha de nacimiento, otras tres. La causa que da no es un fallo de tamaño sino de incentivos: las pruebas con las que se puntúan los modelos miden solo el acierto, así que «se les anima a adivinar en vez de decir “no lo sé”». Es el examen tipo test en el que dejar en blanco vale cero y acertar por suerte vale un punto: sobre miles de preguntas, el modelo que adivina queda por delante del que reconoce que no sabe.
La tabla del mismo artículo lo cuantifica con dos modelos de la propia empresa en la prueba SimpleQA: gpt-5-thinking-mini se abstiene en el 52 % de las preguntas, acierta el 22 % y se equivoca el 26 %; el modelo anterior, o4-mini, se abstiene el 1 %, acierta el 24 % y se equivoca el 75 %. La lectura importante es la segunda columna: el modelo viejo «acierta» algo más precisamente porque adivina siempre, y a cambio se equivoca tres veces más. OpenAI concluye que la precisión «nunca llegará al 100 %» porque hay preguntas sin respuesta posible, y que las alucinaciones «se originan en la predicción de la siguiente palabra», el mecanismo de la primera lección. De las cinco páginas más leídas del top 10 de Google España sobre alucinaciones, una sola da un porcentaje (páginas leídas el 4 de septiembre de 2026).
El método
Cómo se comprueba una respuesta de IA: cifras, fechas, citas, nombres y enlaces
Una respuesta no se comprueba entera: se comprueban sus puntos concretos, y son de cinco clases. Las cifras (un porcentaje, un precio, una potencia) se verifican pidiendo la fuente exacta y abriéndola para ver que contiene esa cifra con esa unidad. Las fechas se contrastan con la fecha de corte del modelo (lo que pasó después no lo sabe salvo que busque) y con una fuente que la publique. Las citas entrecomilladas se buscan tal cual en un buscador: una cita que no aparece en ninguna fuente es inventada, y es una de las clases más frecuentes porque una frase con comillas «suena» a verdad. Los nombres propios (una persona, una empresa, una ley, un informe) se comprueban por su existencia y por lo que se les atribuye. Y los enlaces se abren: si no cargan o no dicen lo que la respuesta dice, el dato no existe.
El Contador de puntos a comprobar en una respuesta de IA, de m8d.io, subraya cada clase en el texto que pegues, los cuenta y dice cómo se verifica cada uno. No dice si son verdad, porque eso no lo puede saber un programa: dice dónde mirar. Una respuesta sin ninguna cifra, fecha, cita, nombre ni enlace tampoco es fiable: es que no tiene nada concreto que comprobar, y tampoco nada concreto que usar. Y el truco que más tiempo ahorra es preguntarle al asistente por adelantado: «di “no lo sé” cuando no tengas la fuente», que es exactamente la respuesta que, según OpenAI, sus pruebas no le enseñaron a dar.
Herramienta de m8d.io, gratis y sin cuenta
Contador de puntos a comprobar en una respuesta de IA
Pega la respuesta de cualquier asistente y se subrayan sus cifras, fechas, citas textuales, nombres propios y enlaces, con el recuento y la forma de verificar cada clase. No dice si son ciertos, que es lo que ningún programa puede saber: dice dónde mirar. Gratis, sin cuenta y sin anuncios.
Ejemplo: el texto de ejemplo (inventado a propósito para la lección) tiene 8 puntos que comprobar: 1 enlace, 1 cita textual, 2 fechas, 2 cifras y 2 nombres propios; ninguno de los ocho existe, y suenan igual de bien que si existieran.
La privacidad
Qué no contarle a un asistente de IA: lo que dice cada fabricante que hace con tus chats
La pregunta «¿qué datos no compartir con la IA?» aparece en Google junto a esta lección y su SERP lo dice todo: dos hilos de Reddit en el top 5 (SERP del 4 de septiembre de 2026). La respuesta con base está en las páginas de los cuatro fabricantes. OpenAI: los chats de las cuentas personales se usan para entrenar por defecto y el interruptor se llama «Mejorar el modelo para todos», en Controles de datos; los chats temporales no entrenan y «se borran de nuestros sistemas a los 30 días», aunque «pueden revisarse para vigilar abusos». Google: la «Actividad en las apps de Gemini» está activada por defecto, se borra sola a los 18 meses salvo que cambies el plazo, y los chats que revisa una persona «no se borran cuando borras tu actividad», sino que «se conservan hasta tres años»; su propia página pide: «no introduzcas información confidencial que no quieras que vea un revisor».
Microsoft: con sesión iniciada, «usamos tu actividad de conversación con Copilot para entrenar», guarda las conversaciones 18 meses por defecto y el interruptor está en Cuenta, Privacidad; sin sesión, «no entrenamos con tus conversaciones». Anthropic: desde el 28 de agosto de 2025 quien usa Claude Free, Pro o Max tiene que elegir; con permiso, los chats nuevos se conservan cinco años; sin él, 30 días. De ahí sale la lista de lo que no se pega en ninguno de los cuatro, con independencia del interruptor: contraseñas y códigos de verificación (OpenAI lo pone en sus buenas prácticas: «evita escribir contraseñas o información privada directamente en los mensajes»), el DNI y los datos bancarios, datos de salud, datos de otras personas que no te han dado permiso, y documentos de tu empresa que no publicarías. Para lo demás, el chat temporal o de incógnito y el interruptor apagado.
Lo que te protege
Contraseñas, phishing y el asistente: las tres reglas que no dependen de ningún interruptor
Primera: las contraseñas no entran en un chat, ni para «que me la recuerde» ni para que rellene un formulario; la lección de agentes explica que una web maliciosa puede ordenarle a un agente que las envíe fuera, y OpenAI cita ese caso exacto en su ayuda. Donde sí entran es en un gestor de contraseñas, que las genera y las rellena sin que las escribas: m8d tiene su guía de gestores de contraseñas con la elección de la casa. Segunda: un correo redactado sin una falta y con tu nombre ya no es señal de nada, porque redactarlo cuesta un prompt; el phishing se detecta por lo que pide (una clave, un pago, prisa) y por el dominio real del enlace, nunca por la calidad del texto.
Tercera: cifrar la conexión no es anonimato ni borra lo que el asistente guarda. Una VPN protege lo que viaja entre tu dispositivo y la red, y sirve en una wifi pública; lo que escribes en el chat llega igual al fabricante y se guarda según su política. Qué hace y qué no hace una VPN lo explica la pieza de m8d sobre qué es una VPN. Las tres reglas juntas son el resumen de la lección: lo que no quieres que lea nadie no se escribe en un chat; lo que sí escribes, lo comprobarás antes de usarlo; y el interruptor del entrenamiento se apaga el primer día.
| Categoría | Productos |
|---|---|
| ChatGPT, chat temporal (se borra a los 30 días) | 30 |
| Claude sin permiso de entrenamiento (30 días) | 30 |
| Copilot, por defecto (18 meses) | 540 |
| Gemini, borrado automático por defecto (18 meses) | 540 |
| Gemini, chats revisados por una persona (hasta 3 años) | 1095 |
| Claude con permiso de entrenamiento (5 años) | 1825 |
6 productos contados. Es un censo de plazos declarados, en días, no de productos: cada fila es el periodo que publica el fabricante para ese caso. Los chats normales de ChatGPT quedan en el historial hasta que los borras; OpenAI no publica un plazo fijo para ellos.
«Puedes desactivar este ajuste o revisar y borrar tu actividad en cualquier momento en Actividad en las apps de Gemini» (Google, centro de privacidad de las apps de Gemini, leído el 5 de septiembre de 2026).
La misma página dice que «los chats revisados por revisores humanos (y datos relacionados como tu idioma, tipo de dispositivo, información de ubicación o comentarios) no se borran cuando borras tu actividad», sino que «se conservan hasta tres años», y pide «no introducir información confidencial que no quieras que vea un revisor». Con la actividad desactivada, los chats se guardan 72 horas.
Lo que escribes en un asistente con el historial activado puede leerlo una persona y quedarse años aunque tú lo borres: contraseñas, DNI, datos de salud, datos de otros y documentos de tu empresa no entran en el chat.
Comprueba lo que has aprendido
Dónde se aplica lo que acabas de aprender
Con las tres reglas, la decisión es dónde guardar lo que no entra en un chat: en un gestor de contraseñas, que las genera y las rellena sin que las escribas. La guía de m8d compara la categoría y dice cuál es la elección de la casa; y la pieza sobre VPN explica qué protege y qué no.
Las 6 fuentes de esta lección, con su fecha
- OpenAI: Why language models hallucinate (definición, causa y tabla de porcentajes) · 5-sep-2025, leído el 5-sep-2026
- OpenAI: Data Controls FAQ (entrenamiento con tus chats, chats temporales) · leído el 5-sep-2026
- Google: centro de privacidad de las apps de Gemini (actividad, revisores, conservación) · leído el 5-sep-2026
- Microsoft: preguntas frecuentes de privacidad de Copilot (entrenamiento, 18 meses) · leído el 5-sep-2026
- Anthropic: cambios en las condiciones de consumo (elección, 5 años o 30 días) · 28-ago-2025, leído el 5-sep-2026
- OpenAI: ChatGPT agent (buenas prácticas: sin contraseñas en los mensajes; ejemplo de inyección de prompts) · actualizado en agosto de 2026, leído el 5-sep-2026
Cómo citar esta lección
m8d.io (2026). «Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno». Aprende, m8d.io. https://m8d.io/aprende/inteligencia-artificial/alucinaciones-y-privacidad/<a href="https://m8d.io/aprende/inteligencia-artificial/alucinaciones-y-privacidad/">Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno</a>, m8d.io (2026).m8d.io. (2026). Qué son las alucinaciones de la IA y qué no contarle a un asistente: por qué inventa y qué guarda cada uno. Aprende. Recuperado el 5 de septiembre de 2026 de https://m8d.io/aprende/inteligencia-artificial/alucinaciones-y-privacidad/Licencia CC BY 4.0: se puede reutilizar, también con fines comerciales, citando m8d.io con enlace.
Lo que se pregunta sobre esto
¿Qué son las alucinaciones?›
En un asistente de IA, afirmaciones plausibles pero falsas que el modelo genera con la misma fluidez que las verdaderas: una cifra, una fecha, una cita o un nombre que no existen. OpenAI las define así y cifra las de su modelo gpt-5-thinking-mini en el 26 % de las preguntas de su prueba SimpleQA (5 de septiembre de 2025).
¿Qué datos no compartir con la IA?›
Contraseñas y códigos de verificación, DNI y datos bancarios, datos de salud, datos de otras personas sin su permiso y documentos de tu empresa que no publicarías. Con independencia del interruptor de entrenamiento: Google guarda hasta tres años los chats revisados por una persona aunque borres tu actividad.
¿Qué cosas no se le debe preguntar a ChatGPT?›
No es tanto qué preguntar como qué usar sin comprobar: datos concretos (precios, leyes, dosis, fechas) que vas a aplicar. OpenAI cifra el error de su propio modelo en el 26 % de las preguntas de hechos. Pide la fuente, ábrela, y activa el chat temporal para lo que no quieras en el historial.
Comentarios
Sé el primeroSin registro: solo un nombre. Todos los comentarios se revisan antes de publicarse.