El Frente
Chats

GPT-5.5 reduce a la mitad las alucinaciones

Por la redacción de El Frente
GPT-5.5 reduce a la mitad las alucinaciones

OpenAI estrenó GPT-5.5 y afirma reducir a la mitad los datos inventados respecto a la generación anterior.

OpenAI lanzó GPT-5.5 el 23 de abril de 2026 y lo convirtió en el motor por defecto de ChatGPT. El foco del lanzamiento no es saber más, sino equivocarse menos. Es un giro de mensaje notable en una industria acostumbrada a medirse por capacidad bruta.

Las cifras que aporta la compañía van en esa dirección. OpenAI sostiene que GPT-5.5 produce un 52,5% menos de afirmaciones alucinadas que GPT-5.3 Instant. Reducir a la mitad las invenciones, de confirmarse, sería una mejora sustancial para cualquier uso serio.

El segundo dato apunta a los terrenos delicados. Según la compañía, el modelo comete un 37,3% menos de imprecisiones en conversaciones marcadas como sensibles. Son precisamente las situaciones donde un error afirmado con seguridad puede tener consecuencias reales para el usuario.

La elección del problema no es casual. La fiabilidad es la queja número uno de los usuarios, y el malestar rara vez viene de que el modelo no sepa algo. Viene de que afirme con aplomo cosas falsas, mezclando aciertos y errores con el mismo tono de certeza.

Hay que leer estas cifras con la cautela debida. Son mediciones de la propia OpenAI, sobre sus propios criterios, y todavía faltan evaluaciones independientes que las contrasten. Un porcentaje impresionante depende por completo de cómo se define una alucinación y de qué conjunto de pruebas se usa.

Convertir GPT-5.5 en el motor por defecto de ChatGPT es, además, una decisión con peso. Significa que la mayoría de usuarios obtendrá estas respuestas sin elegirlo activamente, lo que amplifica tanto la mejora prometida como cualquier regresión que pudiera aparecer en el uso real.

Lo interesante de fondo es el cambio de relato del sector. Tras años de carrera por el tamaño y por las puntuaciones, los fabricantes empiezan a vender fiabilidad como argumento principal. Es una señal de madurez: el mercado pide modelos en los que se pueda confiar, no solo modelos más grandes.

De cara a los próximos meses, la prueba real serán las mediciones externas y el uso cotidiano, no la nota de prensa. Si terceros confirman la reducción de errores, GPT-5.5 marcará una pauta; si no, quedará como una promesa más. Los datos de este artículo proceden de Fello AI.

Basado en información de: Fello AI.
Ver la fuente original ↗

← Portada Más de Chats →

Más señales de Chats

Todo lo que puedes hacer con OpenClaw gracias a su app para iPhone y Android
Chatsnuevo

Todo lo que puedes hacer con OpenClaw gracias a su app para iPhone y Android

OpenClaw es un agente de IA o agente personal de inteligencia artificial. Entre sus principales ventajas, es de código abierto y puedes instalarlo y ejecutarlo directamente en tu ordenador o dispos…

El FrenteLeer
OpenAI frena el desarrollo de su modelo más potente y activa alertas automáticas en 30 minutos: las nuevas salvaguardas tras el hackeo a Hugging Face
Chats

OpenAI frena el desarrollo de su modelo más potente y activa alertas automáticas en 30 minutos: las nuevas salvaguardas tras el hackeo a Hugging Face

El incidente más extraño de la historia reciente de la IA tiene hoy su capítulo de consecuencias. OpenAI anuncia este martes 18 de agosto un paquete de nuevas medidas de seguridad que cambian la fo…

El FrenteLeer
Anthropic añade una marca de agua invisible a todo lo que escribe Claude — y algunos usuarios cancelaron su suscripción
Chats

Anthropic añade una marca de agua invisible a todo lo que escribe Claude — y algunos usuarios cancelaron su suscripción

Desde el 2 de agosto de 2026, cada texto generado por los nuevos modelos Claude lleva una marca de agua invisible que no puedes ver pero que puede detectarse con las herramientas adecuadas. Anthrop…

El FrenteLeer

Explora por tema

ChatsModelosBioCómputoCienciaLímites