Justo en la fecha de lanzamiento de GPT-5.5, Claude por fin lo admitió:

Sí, el modelo se ha vuelto “más tonto” y se han restablecido todas las cuotas de uso.
Tras más de un mes de desmentidos, la filtración sobre el error de inteligencia finalmente llegó directamente de Antrópico en sí misma:
- El nivel de razonamiento se ha rebajado discretamente de “alto” a “medio”
- Un error de caché borraba los rastros de pensamiento en cada turno
- El límite de 25 palabras en la solicitud mermó la calidad del resultado
Si sumamos esos tres fallos, la experiencia general de Claude se vio seriamente afectada.
Menos mal que la competencia ejerció presión justo en el momento adecuado. Está claro que intentar “educar a los usuarios” no iba a funcionar.
Aun así, corregir errores siempre es algo positivo. Es solo que… el momento resulta sospechoso. Se lanza el GPT-5.5 y, de repente, Claude “admite la derrota”.”
¿Te ha servido la versión 5.5 para depurar?
Dario… ¿No habrás empeorado a Claude a propósito solo para preparar un momento de remontada cuando se lanzara GPT-5.5, verdad?
Tres errores confirmados que explican la caída del rendimiento de Claude
Para empezar, no es la primera vez que ocurre.
En agosto del año pasado, Anthropic publicó un análisis posterior similar sobre las versiones 4.0 y 4.1 de Opus, en el que también afirmaba: “Nunca fue nuestra intención reducir la calidad del modelo”.”
En esta ocasión, el nuevo análisis a posteriori se titula “Un análisis retrospectivo de tres números recientes”.”
“La palabra ”reciente» es clave: no solo ahora, sino durante el último tiempo.
La comunidad ya se había dado cuenta de que
El empeoramiento del estado de Claude llevaba ya un tiempo siendo objeto de amplios debates.
Hace más de diez días, Stella Laurenzo, directora sénior de IA de AMD, publicó una auditoría exhaustiva en GitHub:

- 6.852 conversaciones
- 17 871 bloques de razonamiento
- Más de 230 000 llamadas a herramientas
Las conclusiones: desde febrero, la profundidad del razonamiento ha disminuido drásticamente.
Observaciones más detalladas:
- Claude empezó a caer en bucles de razonamiento
- Cada vez más, optaba por el la solución más sencilla, no es el correcto
Por su parte, la prueba de rendimiento BridgeBench de BridgeMind mostró que Opus 4.6 la precisión ha descendido de 83,31 TP3T a 68,31 TP3T, y la clasificación ha pasado de #2 a #10.

Aunque la metodología fue objeto de críticas posteriormente, la versión se impuso:
Claude se está volviendo más tonto.
La gente incluso acuñó un término: — «Shrinkflation» provocada por la IA. El mismo precio, pero un producto de menor calidad.
En otras palabras, los usuarios tenían la sensación de que les estaban dando un “menú infantil’.”
Explicación de los tres errores
Disminución silenciosa del nivel de razonamiento
El 4 de marzo, el incumplimiento de Claude Code nivel de razonamiento se rebajó de “alto” a “medio” debido a problemas de latencia.
Pero la interfaz de usuario seguía indicando “alto”.”
Los usuarios creían que estaban utilizando toda la potencia, pero en realidad disponían de una versión reducida.
Esto duró más de un mes antes de que se diera marcha atrás.
Cuanto más charlas, más tonto te vuelves
El 26 de marzo se introdujo una optimización del almacenamiento en caché:
- Objetivo: borrar los razonamientos antiguos tras 1 hora de inactividad
- Real: debido a un error, se borró en cada turno
Resultado:
- Claude siguió trabajando, pero se olvidó de sus propios objetivos
- Síntomas: olvidos, repeticiones, uso caótico de los utensilios
Peor aún:
Como el razonamiento se borraba constantemente, nunca se accedía a la caché → el uso de tokens se disparó.
Tardaron 15 días en arreglarlo.
Una sola línea de comando arruinó la calidad de la salida
El 16 de abril se añadió una instrucción del sistema:
- Máximo 25 palabras entre cada llamada a una herramienta
- La respuesta final debe limitarse a 100 palabras
Repercusión:
- Opus 4.6 y 4.7 ambos registraron una caída de rendimiento de ~31 TP3T
- Se revertió al cabo de 4 días
Abril: una serie de problemas autoinfligidos
Si echamos un vistazo a la cronología, abril no se redujo solo a errores técnicos, sino que fue una sucesión de decisiones cuestionables.
4 de abril — Bloqueo de herramientas de terceros
Anthropic ha bloqueado herramientas como OpenClaw al utilizar las suscripciones Pro/Max.
¿Quieres seguir utilizándolos? Cambia a la facturación por API.
21 de abril — Cambios discretos en los precios
Claude Code ha sido eliminado desde la página del plan Pro.
Los documentos de ayuda han cambiado de:
- “Pro o Max” → “Solo Max”
Tras las críticas recibidas, el responsable de Crecimiento, Amol Avasare, afirmó que solo se trataba de una prueba A/B 2%.
Problema: el cambio se aplicó a toda la web.
Se revocó en cuestión de horas.
La realidad de los precios
- Pro: $20/mes → $240/año
- Máximo 5 veces: $100/mes → $1200/año (aumento de 5 veces)
- Máximo 20 veces: 1 TP 4 T 2400/año (aumento de 10 veces)
No hay nivel intermedio.
23 de abril — Análisis posterior y “indemnización”
¿La compensación? Restablecer los límites de uso.
Algunos usuarios señalaron:
Eso ya había ocurrido durante el lanzamiento de Opus 4.7.
Así que esta “compensación” no era más que un reinicio normal del ciclo.
A los usuarios no les convence
Las opiniones están divididas.
Hay quien dice:
- A veces surgen errores
- El análisis posterior es transparente
- Boris Cherny respondió activamente en Hacker News
Otros se centran en otra cuestión:
Dos meses de silencio
- No hay ninguna comunicación oficial
- Solo hay algunas respuestas sueltas en X
- Falta de coherencia en los mensajes
Sospechas sobre la “optimización de la caché”
Hay quien cree que el momento en que se produce (coincidiendo con la caducidad de la caché) sugiere que:
No se trata de optimizar la latencia, sino de reducir los costes.
La reacción negativa ante las pruebas A/B
Los distintos usuarios recibieron diferentes configuraciones del producto sin que se les informara de ello.
La confianza ha sufrido otro revés.
La migración ya está en marcha
Una tendencia interesante en Hacker News:
Personas que comparten sus “historias de migración”.”
Algunos afirmaron que, de forma inconsciente, pasaron a Códice allá por febrero — y solo ahora se dan cuenta de que el deterioro de Claude pudo haberles empujado a ello.
Hay quien afirma que GPT-5.4 ya ha superado a Opus 4.6.
Algunos están tomando MiniMax como complemento:
- $40 → 4.500 mensajes por ciclo de 5 horas
- Visibilidad completa del razonamiento
El panorama ha cambiado
Hace seis meses, la idea de “utilizar Claude para programar” era prácticamente un consenso.
Ahora:
- Según se informa, Codex cuenta con 4 millones de usuarios activos
- GPT-5.5 se centra en la programación y el funcionamiento de los ordenadores
- El personal de OpenAI llega incluso a describirlo como un modelo de “jefe de gabinete”
No es que Claude estuviera necesariamente peor.
Otros mejoraron, y Claude tropezó en el peor momento posible.
La ventana se está reduciendo
Anthropic dispone ahora de menos tiempo que antes para:
- Corregir errores
- Recuperar la confianza
Mientras tanto:
- GPT-5.5 ya está disponible
- DeepSeek V4 está listo
Y la gente está esperando:
Géminis, te toca.


