Claude Opus 5.5, GPT-6 y una pausa que duró diez días

El 12 de septiembre Dario Amodei, el CEO de Anthropic, publicó un ensayo pidiendo a los laboratorios de IA que levantaran el pie del acelerador. Sam Altman, de OpenAI, le dio la razón en X. Diez días después, el 22, las dos empresas lanzaron modelos nuevos con menos de dos horas de diferencia.

Dicho así parece una contradicción, y algo de eso hay. Pero si miras lo que han sacado, la cosa tiene más lógica: ninguno de los dos ha superado a su modelo más potente. Lo que han hecho es ofrecer casi lo mismo por bastante menos dinero. Para una pyme, eso vale más que cualquier récord en un benchmark.

Claude Opus 5.5: igual de capaz, más barato y menos charlatán

Anthropic dice que Opus 5.5 rinde al nivel de Claude Fable 5.1, su modelo más capaz, en la mayor parte del trabajo, y que en cargas típicas cuesta un 40 % menos de ejecutar que Opus 5, que salió en julio. El precio de lista baja un 20 %: 4 dólares por millón de tokens de entrada y 20 por millón de salida.

A mí me interesa más otro cambio. Opus 5 tenía fama de enrollarse, con respuestas largas llenas de cabos sueltos y sugerencias que nadie había pedido. Anthropic reconoce que era la queja más repetida y ha cambiado la forma en que escribe el modelo. Las primeras pruebas publicadas coinciden en que ahora va más al grano. Si lo usas para resumir correos o revisar código, lo notas en el tiempo que dejas de perder leyendo.

También aseguran que intenta saltarse los límites que le marcas un 85 % menos que Opus 5 o Mythos 5.1. Viniendo de la ciberseguridad, es el dato que más me tranquiliza de todo el anuncio. Y a la vez me recuerda que ese problema existe y que hay que medirlo.

Sonnet 5.5 y Haiku 5.5 llegarán en las próximas semanas. Si pagas Pro, Max o Team, además, tienes límites de uso más altos desde el lanzamiento.

GPT-6 Astra, Sol y Luna

OpenAI abrió septiembre con GPT-6 Astra, su modelo más potente. El detalle que me llamó la atención es que es el primero que alcanza su umbral interno de riesgo «crítico» en ciberseguridad. Por eso lo recibieron primero las empresas de su programa de ciberseguridad y después los usuarios de Plus, Pro, Business y Enterprise.

El día 22 llegaron Sol y Luna, dos versiones derivadas de Astra. Sol está un escalón por debajo y apunta a trabajo complejo, como programar. Luna es para volumen: extraer datos y resumir en cantidad. En la API cuestan alrededor de la mitad que la tarifa promocional de GPT-5.6.

ChatGPT ya hace cosas mientras le hablas

El 23 de septiembre OpenAI permitió usar plugins desde el modo de voz. Puedes consultar el calendario, redactar un correo o pedir un resumen de Slack hablando con el móvil. También puedes elegir si la voz tira de Astra, Sol o Luna, y usarla dentro de ChatGPT Work para generar documentos o presentaciones. Los planes gratuitos (Free y Go) pueden usar la voz con los plugins que incluye su plan.

Aquí tengo sentimientos encontrados. Es muy cómodo. También supone dar permiso a un asistente para enviar correos en tu nombre, y eso conviene configurarlo con calma: qué aplicaciones conectas y qué acciones le dejas hacer sin preguntarte.

Anuncios dentro de ChatGPT

El gestor de anuncios de ChatGPT ya funciona en 31 mercados europeos, entre ellos Alemania, Francia e Italia. Como alguien que trabaja SEO y Google Ads para clientes, esto me parece de lo más relevante del mes para cualquier negocio. Salir en las respuestas de un asistente empieza a importar tanto como salir en Google, y ahora también se puede pagar por ello.

Claude para pymes y un descubrimiento curioso

A mediados de mes Anthropic amplió su oferta para pequeñas y medianas empresas con decenas de flujos de trabajo ya preparados e integraciones con herramientas como Shopify, Xero, Stripe o Zapier. Encaja con lo que veo en Mallorca: el interés ya no está en chatear con una IA, sino en que haga tareas dentro de los programas que la empresa ya usa.

Y una curiosidad fuera del mundo empresarial: Anthropic anunció que Claude encontró en una base de datos de ADN un sistema enzimático parecido a CRISPR, tras 21 horas de búsqueda. Los expertos piden prudencia con los titulares que hablan de «un nuevo CRISPR», y me parece razonable. Aun así, que un modelo de lenguaje haga ese trabajo de búsqueda durante casi un día entero da que pensar.

Qué haría yo con todo esto

Si tu empresa ya paga por Claude o ChatGPT, revisa qué modelo usa cada tarea. Con la bajada de precios, mucho de lo que antes reservabas al modelo caro cabe ahora en uno intermedio. Para resumir correos o extraer datos de facturas y albaranes, que es lo que automatizo con OCR en a3ERP, un modelo de volumen como Luna o Haiku suele bastar. Para revisar código o documentación compleja tiene más sentido Opus 5.5 o Sol.

Y pruébalos con tus propios documentos. Los benchmarks dicen poco de cómo se porta un modelo con los albaranes escaneados de tu proveedor.

El debate sobre la seguridad sigue abierto, y no lo quiero despachar con una broma: en julio, unos modelos de OpenAI que estaban en pruebas de ciberseguridad se saltaron su aislamiento y entraron en servidores de Hugging Face. Pero si la consecuencia práctica de este mes es que la IA útil cuesta la mitad y habla menos, para el trabajo diario de una pyme es una buena noticia.

Fuentes