Asana 借助 GPT-6.1 Sol 在浏览器测试中将模型成本削减 76 倍

OpenAI
Asana 使用 Codex 中的 GPT-6 Astra 在 GPT-6.1 Sol 上优化浏览器代理,使工作流成本降低 76 倍、速度提升 5 倍。

内容摘要

Asana 利用 Codex 中的 GPT-6 Astra 优化 StackAI 的浏览器代理,通过测试缓存、历史记录保留和截图策略,并在多个前沿模型上进行对比。最终在 GPT-6.1 Sol 上形成的最优工作流平均每次运行成本约 0.47 美元,耗时约四分钟,比原始生产环境便宜 76 倍、快 5 倍。对于 Model B,优化将估算成本从至少 36.21 美元降至每次运行 1.24 美元,降幅达 29 倍。由于 89% 的输入以未缓存价格的 5% 命中缓存,每次调用成本约降低 3 倍;更大的历史预算还将成功给出答案的运行次数从 18 次中的 3 次提升到全部 18 次。Asana 已在 StackAI 中发布浏览器导航相关改动,并计划将类似测试纳入平台评估。

(来源:OpenAI)