Sam Altman prometió "inteligencia a nivel de doctorado." Los usuarios obtuvieron un modelo que piensa que Oregón se llama "Onegon" y que Joe Biden todavía es presidente.
La última versión del chatbot de OpenAI ha decepcionado a los usuarios y ha cometido algunos errores humorísticos.

Nikolas Kokovlis/NurPhoto via Getty Images
Sam Altman prometió "inteligencia a nivel de doctorado." Los usuarios obtuvieron un modelo que piensa que Oregón se llama "Onegon" y que Joe Biden todavía es presidente.
GPT-5 de OpenAI, anunciado como la IA más avanzada de la compañía hasta la fecha, ha generado una decepción y burla generalizadas desde su lanzamiento el jueves, con usuarios reportando errores básicos que han reavivado debates sobre si el enfoque de escalado de la industria de la IA ha llegado a un límite.
La reacción fue rápida y brutal. Las redes sociales se iluminaron con capturas de pantalla de los errores extraños de GPT-5, como mapas etiquetando Oklahoma como "Gelahbrin", problemas matemáticos básicos como "5.9 = x + 5.11" resueltos incorrectamente, y líneas de tiempo con presidentes ficticios como "Willian H. Brusen."
"El consenso abrumador sobre GPT-5 tanto de X $TWTR como del AMA de Reddit $RDDT es abrumadoramente negativo," señaló la cuenta de AI Leaks and News, mientras una encuesta informal encontró que la mayoría de los usuarios calificaron el modelo como simplemente "Kinda mid."
Sin embargo, la recepción no fue uniformemente negativa. OpenAI informó que el tráfico de API se duplicó dentro de las 24 horas posteriores al lanzamiento, y algunos usuarios tempranos elogiaron las habilidades de codificación y la producción creativa de GPT-5. El CEO de Box, Aaron Levie destacó mejoras importantes en la extracción de datos de documentos legales complejos. El profesor de Wharton Ethan Mollick notó la capacidad del IA de anticipar las necesidades del usuario y ofrecer resultados completos más allá de las solicitudes básicas. El desarrollador Simon Willison escribió que GPT-5 es "mi nuevo modelo favorito."
Sin embargo, esas críticas positivas fueron eclipsadas por el duro veredicto del mercado. En Polymarket, una plataforma de predicción donde los comerciantes apuestan por eventos futuros, las probabilidades de OpenAI de tener la mejor IA modelo para fines de mes colapsaron del 75% al 14% en una sola hora el jueves por la noche.
Para el viernes, un contrito Sam Altman estaba haciendo control de daños en Reddit después de que los usuarios publicaron comentarios como "GPT-5 está vistiendo la piel de mi amigo muerto" y inició una petición en Change.org. He prometido restaurar el acceso a GPT-4o (lo cual OpenAI hizo para la tarde del viernes) y admitió que un "autoswitcher" roto entre los diferentes modos de GPT-5 había hecho que el modelo "pareciera mucho más tonto" de lo que se pretendía. La mea culpa marcó un sorprendente cambio para un CEO que apenas 24 horas antes había declarado que su última creación era "claramente un modelo que es generalmente inteligente."
El fiasco plantea preguntas fundamentales sobre si la estrategia central de la industria de la IA de construir modelos cada vez más grandes ha llegado a un callejón sin salida. Los críticos han argumentado durante mucho tiempo que simplemente escalar modelos no conducirá a una inteligencia general artificial, y los tropiezos de GPT-5 parecen validar esas preocupaciones.
"Mi trabajo aquí realmente está hecho," escribió Gary Marcus, un investigador de IA y crítico de larga data de los enfoques actuales de desarrollo de LLM. "Nadie con integridad intelectual aún puede creer que la mera escala nos llevará a la AGI." Los problemas que surgen de lo que se anunció como una herramienta a nivel de doctorado sugieren limitaciones fundamentales en cómo los modelos de lenguaje grandes procesan la información, no solo problemas iniciales que pueden solucionarse con parches.
El momento no podría ser peor para OpenAI. El grupo de IA de Alibaba anunció su modelo Qwen 3 con contexto de 1 millón de tokens, permitiendo conversaciones casi cuatro veces lo que ofrece GPT-5. Mientras tanto, Claude Opus 4.1 de Anthropic está manteniendo el ritmo en las pruebas de codificación, y Gemini, después de empezar tarde, está ganando terreno. Lo que se suponía que consolidaría el dominio de OpenAI, en cambio, entregó un regalo a los rivales.
Las apuestas son enormes para una empresa que acaba de recaudar 8.300 millones de dólares con una valoración de 300.000 millones de dólares y está quemando efectivo en costos de computación. Los ingresos anuales de OpenAI alcanzaron los 13.000 millones de dólares, pero la empresa sigue siendo no rentable, lo que hace que cada paso en falso sea costoso. El lanzamiento fallido también se produce mientras los competidores están al acecho, con Meta $META según se informa ofreciendo paquetes de mil millones de dólares para reclutar talento de OpenAI.
OpenAI planea lanzar nuevas características de productividad la próxima semana, incluyendo la integración con Gmail y Google $GOOGL Calendar, y ha suavizado históricamente los problemas de lanzamiento con el tiempo. Pero para un modelo en el que la empresa había trabajado desde finales de 2023, la recepción probablemente no es lo que OpenAI esperaba. En enero, Altman escribió que "ahora estamos confiados de que sabemos cómo construir AGI" — una confianza que parece prematura dado un modelo que no puede etiquetar correctamente Oregón en un mapa.
Únete a más de 500.000 lectores que comienzan su día con Quartz.
Al suscribirte, aceptas nuestros Términos de servicio y Política de privacidad.