La tregua de la IA era una auténtica mentira: Anthropic y OpenAI retoman la guerra con Claude Opus 5.5 y GPT-6

Actualidad y herramientas de Inteligencia Artificial leídas en CIBERED tu blog de Informática y Tecnología en Español Favorito

El noroeste de Estados Unidos está sumido en el caos. En la madrugada del día 23, Anthropic superó por primera vez a Claude Opus 5.5, apoderándose con fuerza del primer puesto en la clasificación de inteligencia AA.

Dos horas después, OpenAI respondió de inmediato lanzando GPT-6 Sol y GPT-6 Luna. Si bien, el Opus 5.5 era potente, el GPT-6 Sol se quedaba corto. Afortunadamente, el GPT-6 Luna funcionó de forma estable y su buena relación calidad-precio ayudó a cambiar el rumbo de la competencia.

Opus 5.5 arrasa frente a GPT-6 que parece quedarse atrás

Analicemos primero las puntuaciones de referencia. Lógicamente, si Astra es comparable a Fable/Mythos, entonces Sol debería estar a la par con Opus.

Aunque en la lista AA, el Claude Opus 5.5 es prácticamente indiscutible, incluso 5 puntos superior al 5.1 de su hermano mayor, Fable.

En cambio, GPT-6 Sol y Luna están prácticamente a la par con sus predecesores, con pocos cambios en sus posiciones. Probablemente se trate simplemente de una actualización de habilidades rutinaria por parte de Astra.

Esto, también se evidencia en las pruebas realizadas por los internautas.

Dejando de lado otros aspectos, si bien los tres modelos se lanzaron casi simultáneamente, la mayoría de los ejemplos en línea se ejecutan en Claude Opus 5, y como mucho se comparan con GPT-6 Astra o Sol. En cuanto a Luna, prácticamente no hay novedades al respecto.

Precios y consumo de tokens

El precio de GPT-6 Luna ha tocado fondo a 0,07 dólares, mientras que GPT-6 Sol está a 1 dólar; y nuestro estimado Claude Opus 5.5 ha subido directamente a 5,98 dólares.

Esta diferencia no se limita al precio unitario; se puede apreciar en el consumo de tokens. Claude Opus 5.5 consume muchos tokens para completar tareas, aproximadamente tres veces más que GPT-6 Sol y el doble que Luna.

Aunque esto también coincide con la tendencia actual en los modelos, donde si bien las puntuaciones de referencia de los buques insignia de segundo nivel pueden parecer comparables a las de los buques insignia, tienden a realizar tareas más exigentes y a generar más tokens.

Vistas: 1

Descubre más desde CIBERED

Suscríbete y recibe las últimas entradas en tu correo electrónico.

Scroll al inicio