HomeWorld

OpenAI launches GPT-6 Sun and Moon, its new, more efficient models integrating Astra capabilities at a lower cost.

World 1 source 1 country 🔦 Under-reported 17m ago

Anthropic ha lanzado Opus 5.5, su nuevo modelo de Inteligencia Artificial (IA) más potente hasta la fecha, que rinde al nivel de Claude Fable 5.1 en la mayoría de las tareas y cuesta un 40 por ciento menos que Opus 5, su predecesor.Se trata del primer modelo del laboratorio de IA compartido tras la llamada a desacelerar el ritmo de desarrollo de esta tecnología que hizo recientemente el CEO de Anthropic, Dario Amodei. Por ello, incorpora salvaguardas de seguridad similares a las del modelo anterior Fable 5.1, sobre todo en biología y ciberseguridad, al ser comparable en estos apartados a Claude Mythos 5.1."Opus 5.5 es un gran paso hacia delante desde Opus 5. Es el nuevo modelo líder y los primeros probadores vieron grandes saltos en rendimiento en sus trabajos más complejos", afirma Anthropic desde su blog, para señalar a continuación que "es bueno encontrando y corrigiendo ineficiencias en software".En este marco, Anthropic ha añadido que Claude Opus 5.5 alcanza o supera en la mayoría de tareas complejas a modelos de mayor escala (como Fable 5.1), y es más rápido que su predecesor en más de un 30 por ciento.Así, se trata de un nuevo modelo de IA que destaca en programación agéntica (proyectos masivos y continuados), además de superar a sus predecesores en la obtención y verificación de fuentes, y consolidarse como el modelo con "mejor puntuación" en las auditorías de comportamiento automatizadas.

Anthropic ha señalado igualmente que genera una redacción más clara, natural y directa.Frente a la competencia, según los datos publicados por la compañía, Opus 5.5 encabeza la comparativa en programación agéntica y trabajo de conocimiento. En programación en terminal (Terminal-Bench 4.0) obtiene un 66,4 por ciento, por delante de GPT-6 Astra (57,9 por ciento) con 8,5 puntos de ventaja, y de GPT-5.6 Sol (37,3 por ciento).Sucede lo mismo en trabajo de conocimiento profesional (GDPval-AA v2.1) con 1.846 puntos Elo frente a los 1.588 y 1.542 de Sol y Astra, respectivamente; en razonamiento multidisciplinar (Humanity's Last Exam) con un 67,7 por ciento, alejándose más de 10 puntos de GPT-6 Astra (57,2 por ciento); y en programación en IDE / entornos reales (CursorBench 4.0 y FrontierCode v1.1) con 57,8 por ciento y 54,4 por ciento respectivamente, por delante de GPT-6 Astra en FrontierCode y de GPT-5.6 Sol en CursorBench.Al poner en perspectiva estos datos, sus puntos… OpenAI ha lanzado sus nuevos modelos de inteligencia artificial (IA) GPT-6 Sol y GPT-6 Luna, que llegan con algunas de las mejoras lanzadas con su modelo insignia Astra, pero añadiendo más eficiencia y costes más bajos.La compañía liderada por Sam Altman presentó GPT-6 Astra a principios de septiembre como su modelo de seguridad más capaz y con más restricciones hasta la fecha, además de avanzar a la inteligencia artificial general (AGI).Unas semanas después, la compañía de IA ha vuelto a lanzar nuevos modelos, GPT-6 Sol y GPT-6 Luna, pensados para impulsar el trabajo a diferentes escalas, ritmos y presupuestos.

Concretamente, aunque Astra ofrece capacidad para los proyectos más exigentes, los nuevos modelos Sol y Luna ayudan a distribuir los beneficios de dicha inteligencia al impulsar la eficiencia en costos.Como ha explicado OpenAI en un comunicado en su web, esto se debe a que los modelos Sol y Luna han sido entrenados con métodos similares a los de GPT-6 Astra, por lo que integran el rendimiento de este modelo insignia en cuanto al trabajo profesional, veracidad, codificación, uso de computadoras y alineación a modelos más rápidos y económicos.Al mismo tiempo, destacan por "liderar la relación costo-inteligencia", al combinar estas altas capacidades con una infraestructura que las implementa de manera eficiente a gran escala. Así, OpenAI ha hecho referencia a mejoras en el almacenamiento en caché y la inferencia, lo que les permite ofrecer estos modelos a menor coste.Como resultado, la compañía ha asegurado que ha conseguido reducir los precios de la API de Sol y Luna en un 50 por ciento, en comparación con sus precios promocionales de GPT-5.6.En cuanto a sus capacidades, Gpt-6 Sol es capaz de ejecutar tareas de trabajo difíciles con límites de uso más altos, ofreciendo mayor inteligencia y mejores resultados. Prueba de ello es que, según sus resultados en la prueba de flujos de trabajos empresariales AutomationBench, supera a otros modelos del sector como Claude Opus 5 de Anthropic, con un coste por tarea de tan solo el 9 por ciento en comparación.Asimismo, en el mismo 'benchmark' GPT-6 Luna mejora a su predecesor en 5,4 puntos porcentuales con un coste por tarea un 58 por ciento menor.Lo mismo ocurre en tareas relacionadas con la gestión de agentes de IA para flujos de trabajo profesionales.

En la prueba 'Agents Last Exam', OpenAI ha asegurado que GP…

Summary from source
Read the full story at the source Infobae (Buenos Aires, Argentina) · AR
Get the news on TelegramTop stories & under-reported picks, straight to your feed — free. Join →