Pese a toda la discusión sobre marcar el ritmo del desarrollo, ambas compañías lanzaron actualizaciones: Claude Opus 5.5 y los nuevos GPT-6 Sol y Luna, todos con mejor rendimiento a un costo por token menor. (Fuente: Engadget)
La conversación en la industria de la IA viene enfocada en gran medida en desacelerar el desarrollo de IA, o marcar el ritmo de la frontera, pero eso aparentemente no va a frenar a Anthropic ni a OpenAI de lanzar nuevos modelos. Ambas compañías están iterando sobre sus lanzamientos anteriores, Fable 5.1 y GPT-6 Astra, con nuevos modelos que ofrecen niveles de rendimiento similares pero a costos más bajos.
En el caso de Claude, Anthropic dice que su nuevo modelo Opus 5.5 es mejor manejando trabajo complejo, encontrando y corrigiendo ineficiencias en software y análisis financiero y de negocios, todos argumentos apuntados directamente a los clientes empresariales de Anthropic. Los benchmarks de la compañía afirman que Opus 5.5 también obtuvo mejores resultados en programación agéntica que GPT-6 Astra tanto en Terminal-Bench 4.0 como en FrontierCode v1.1 Principal, lo que podría hacerlo más atractivo para desarrolladores.
Las mejoras se extienden más allá de las tareas que puede manejar el modelo, hasta cómo funciona: Anthropic afirma que Opus 5.5 produce una escritura más fácil de entender, y que intentó sortear límites alrededor de un 85% menos seguido que modelos anteriores, sugiriendo que va a desobedecer instrucciones con menos frecuencia. Igual de importante, la compañía afirma que cuesta menos por token usarlo, 4 dólares por tokens de entrada y 20 dólares por tokens de salida, comparado con los 5 dólares de entrada y 25 dólares de salida de Opus 5.
Los nuevos modelos GPT-6 Sol y Luna de OpenAI están igualmente enfocados en la eficiencia. Los nuevos modelos se entrenaron usando métodos similares a los de GPT-6 Astra y ofrecen mejoras en trabajo profesional, programación y uso de computadoras, pero hasta un 50% más baratos que el precio promocional de sus contrapartes GPT-5.6. Específicamente, los tokens de entrada de GPT-6 Sol cuestan 2 dólares, mientras que los de salida cuestan 10 dólares. Para Luna, los tokens de entrada cuestan 0,10 dólares, y los de salida 0,50 dólares.
En cuanto a mejoras, ambos nuevos modelos GPT-6 son mejores acertando datos, con Sol cometiendo aproximadamente la mitad de errores que su predecesor, según OpenAI. En programación, la compañía dice que GPT-6 Sol puede igualar el rendimiento de Fable 5.1 a un costo menor. Los nuevos modelos también se comunican con más claridad, y gracias a mejoras en el caché de instrucciones, OpenAI dice que pueden reutilizar más contexto y responder más rápido.
OpenAI dice que los modelos GPT-6 están más alineados que antes según las pruebas propias de la compañía. Por ejemplo, mienten menos sobre los resultados de su trabajo de programación y rechazan aún más intentos de sortear las salvaguardas cuando reciben un comando inseguro. Al igual que Anthropic, OpenAI también propuso sus propios criterios para que evaluadores externos usen a la hora de juzgar el progreso y la seguridad del desarrollo de IA. Todavía queda por verse si estas propuestas van a derivar en algún tipo de estándar para toda la industria.
El modelo Opus 5.5 de Anthropic ya está disponible para desarrolladores a través de Claude, Amazon Web Services, Google Cloud y Microsoft Azure. GPT-6 Sol y GPT-6 Luna, de OpenAI, están disponibles en ChatGPT Work y Codex para clientes Plus, Pro, Business y Enterprise. Los usuarios gratuitos y los suscriptores de Go van a tener acceso solo a GPT-6 Luna en la app de escritorio de la compañía.
Nota elaborada con asistencia de IA. Fuentes verificadas y contenido editado por el equipo de Infosertec. Conocé nuestro proceso editorial.

