OpenAI 发布 Codex 经济研究:agentic AI 在公司内部几乎取代聊天式工作流,非工程岗位采用速度反超开发者
学术圈重大事件 · 发布 2026-06-26T04:35:00+08:00 · 更新 2026-06-26T04:49:25+08:00
OpenAI 6 月 25 日发布经济研究论文与配套解读,基于个人、组织和内部三类 Codex 使用数据,称 2026 年上半年周活跃使用者增长逾 5 倍;在 OpenAI 内部,Codex 已占 Codex+ChatGPT 输出 token 的 99.8%,法务、财务、招聘等非工程部门也在 4 月前后跨过“主要 AI 工具”门槛。这条信号的重要性不在宣传口径,而在于 agentic AI 第一次以大规模真实工作日志形式被量化为“长时任务委托”和跨岗位技术外溢。
OpenAI 6 月 25 日发布《How agents are transforming work》及配套 50 页 Economic Research 论文《The Shift to Agentic AI: Evidence from Codex》,试图用真实产品使用数据回答一个关键问题:当 AI 从“回答问题”转向“替人执行多步任务”后,工作流究竟发生了什么变化。样本覆盖个人账号、企业组织账号以及 OpenAI 内部员工三类人群。
OpenAI 页面配图:对应 2026 年 6 月 25 日发布的 Codex agentic AI 工作研究。
论文摘要称,2026 年上半年 Codex 周活跃用户增长超过 5 倍;超过 10% 的用户在一周内会同时管理 3 个及以上并发 agent,26.6% 的用户使用过可复用流程的 skills。OpenAI 正文还写到,到 2026 年 5 月,80.6% 的抽样个人用户至少发起过 1 次预计相当于人类 30 分钟以上工作的 Codex 请求,70.2% 超过 1 小时,25.6% 超过 8 小时。更强的内部信号是,截至 6 月 11 日,Codex 已占 OpenAI 员工在 Codex 与 ChatGPT 两类产品中生成输出 token 的 99.8%;法务、财务、招聘等非工程部门也在 2026 年 4 月前后完成向 Codex 为主的切换。
这条消息值得进“学术圈重大事件”,是因为 agentic AI 的扩散第一次有了较系统的真实工作场景证据。论文把 AI 使用单位从“单次对话”改写成“可委托的工作流”,并提示高强度用户越来越像在协调多个并发 agent。对科研和企业管理读者来说,这意味着下一轮竞争不只是谁的模型分数更高,而是谁能把多步执行、工具调用与验证流程嵌入真实组织。
但边界也要写清。第一,这是一篇公司主导的工作论文,而非独立同行评议的劳动经济学结论;第二,OpenAI 内部具备高模型熟悉度和低使用摩擦,不能直接外推到普通大学、实验室或企业;第三,部分“任务时长”依赖 LLM-as-judge 根据 transcript 估算,更适合作为方向性指标。更稳妥的结论是:agentic AI 的采用与工作重组正在加速发生,但净生产率和就业结构变化仍需独立研究。
信息来源
可信度说明
来源为 OpenAI 官方解读与配套 PDF 论文,作者名单包含 OpenAI 以及哥伦比亚商学院、沃顿和杜克合作者。可核验的是使用日志、token 占比、并发 agent 和 skills 使用等观测指标;证据边界在于研究环境高度依赖 OpenAI 自身组织条件,且任务时长大量来自模型估算,不等于独立审计后的真实生产率结论。