- OpenAI 认为,企业不应根据用户数量或代币成本来评估 AI,而应衡量 AI 在每美元支出中完成的有功工作量。
- 该公司提出了“每美元有用智能”(Useful Intelligence per Dollar)指标,包括四个标准:完成的工作量、每个成功任务的成本、结果的可靠性以及规模扩大时的价值增长。
- OpenAI 表示,重要的不是低廉的代币价格,而是完成高质量任务的总成本,包括员工时间、重试次数和检查结果的精力。
- 公司以财务预测流程为例,AI 可以自动收集数据、核对电子表格并准备报告,让员工专注于分析和决策。
- GPT-5.6 分为 Sol、Terra 和 Luna 三个版本,旨在平衡不同需求的性能、成本和速度。
- 在 Artificial Analysis 编码代理指数中,GPT-5.6 Sol 达到 72.7%,超过了 Claude Fable 5 的 69.9%,而估计 API 成本低约 36.2%。
- OpenAI 表示,在长代码任务中,GPT-5.6 Sol 使用的输出代币比另一款领先 AI 模型少约 54%。
- 公司建议企业跟踪三个运行指标:可直接使用的结果、需要修改的结果以及必须转交人工处理的情况,以评估 AI 的效率。
- OpenAI 强调,AI 的扩展能力取决于更好的模型结合、更高效的计算基础设施、专用硬件和智能调度机制。
- 文章总结道,AI 的成功将取决于其帮助人类完成更多高价值工作、做出更好决策并随时间推移降低成本的能力,而不仅仅是降低代币价格。
📌 OpenAI 为 AI 时代提出了一种新的衡量方式,将重点从代币成本转向创造的业务价值。据该公司称,企业应根据完成的工作量、每个合格结果的成本、可靠性以及扩大规模时的效率来评估 AI。GPT-5.6 Sol 在 Artificial Analysis 编码代理指数中获得 72.7% 的评分,超过 Claude Fable 5 且 API 成本低约 36.2%,这一数据表明,如果 AI 能在第一次就正确完成工作,更强大的 AI 反而能带来更低的实际成本。
