Asana reduce los costos del modelo 76 veces en pruebas de navegador con GPT-6.1 Sol

OpenAI
Asana usó GPT-6 Astra en Codex para optimizar su agente de navegador en GPT-6.1 Sol, logrando flujos de trabajo 76 veces más baratos y 5 veces más rápidos.

Resumen

Asana utilizó GPT-6 Astra en Codex para optimizar el agente de navegador de StackAI mediante la prueba de políticas de caché, retención de historial y capturas de pantalla en varios modelos frontera. El flujo de trabajo optimizado en GPT-6.1 Sol promedió $0.47 y unos cuatro minutos por ejecución, 76 veces más barato y 5 veces más rápido que la configuración de producción original. Para Model B, la optimización redujo el costo estimado de al menos $36.21 a $1.24 por ejecución, una reducción de 29 veces. El almacenamiento en caché del 89% de la entrada al 5% del precio no almacenado en caché hizo que cada llamada fuera unas 3 veces más barata, y un mayor presupuesto de historial mejoró la finalización de respuestas de 3 de 18 ejecuciones a las 18. Asana ha publicado los cambios de navegación del navegador en StackAI y planea incorporar pruebas similares en las evaluaciones de la plataforma.

(Fuente:OpenAI)