OpenAI提出企业AI新账本:别只看Token价格,要看每项成功任务成本
头像 三元桥David 2026-07-20 10:12:30    发布
46 浏览 0 点赞 0 收藏

企业团队评估AI投入产出

企业引入AI之后,最常见的问题已经从“模型能不能用”,转向“这笔投入到底值不值”。当地时间7月17日,OpenAI发布了一套面向企业的AI价值评估思路,核心概念是“每一美元能购买多少有用智能”。它试图把模型性能、运行成本、可靠性和业务结果放到同一张账本里。

这套框架首先提醒企业:不要把Token单价等同于AI成本。真正的成本还包括员工准备材料、检查答案、反复重试、修正错误和重新执行任务所花费的时间。一个看起来调用价格很低的模型,如果经常需要人工返工,最终可能比单价更高但一次完成任务的模型更贵。

衡量价值的第一步,是先定义“成功任务”。客服团队可以统计解决了多少真实问题,研发团队可以统计交付了多少可用代码,法务团队则可以统计审阅了多少合同。只有把目标从生成文字、回答问题,改为完成具体工作,企业才能比较不同模型、不同流程和不同供应商的真实投入产出。

第二个关键是可靠性。OpenAI建议把结果区分为可直接使用、需要修正和必须升级给人工处理等状态。对于大量、重复的业务任务,稳定完成往往比偶尔给出一个非常惊艳的答案更重要。可靠性数据也能帮助企业判断哪些环节适合自动化,哪些环节必须保留人工审核。

第三个维度是规模化后的价值。试点阶段几十次调用的表现,并不等于上万次任务下的经济性。企业需要同时观察成功率、单项任务的完整成本、处理速度和业务收益,才能决定某个AI应用是否值得从演示走向生产环境。

这套方法也把AI治理纳入了成本核算。哪些数据可以被模型访问,AI能够调用哪些系统,什么操作必须经过员工确认,都应该在上线前确定边界。边界不清会带来额外审计、纠错和安全成本,也会削弱员工和客户对AI系统的信任。

对企业管理者而言,这份“新账本”的意义不在于给所有AI项目一个统一分数,而是建立可重复的决策语言:先定义业务结果,再计算每项成功任务的完整成本,随后评估可靠性和规模化收益。模型选择也因此不再只是参数竞赛,而是根据任务难度、风险等级和经济性做组合配置。

随着AI预算进入精细化管理阶段,能否回答“完成了什么、花了多少、是否稳定”,将比简单展示模型能力更重要。企业AI的下一阶段,竞争焦点很可能从“谁先接入”转向“谁能持续把智能转化为可核算的业务成果”。

资料来源:OpenAI《A scorecard for the AI age》(2026年7月17日)
https://openai.com/index/a-scorecard-for-the-ai-age/

©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。
分类
AI资讯
地址:北京市朝阳区北三环东路三元桥曙光西里甲1号第三置业A座1508室 商务内容合作QQ:2291221 电话:13391790444或(010)62178877
版权所有:电脑商情信息服务集团 北京赢邦策略咨询有限责任公司
声明:本媒体部分图片、文章来源于网络,版权归原作者所有,我司致力于保护作者版权,如有侵权,请与我司联系删除

京ICP备:2022009079号-2

京公网安备:11010502051901号

ICP证:京B2-20230255