让 AI 帮你写周报和让 AI 帮你干完一周的活,是两码事。ChatGPT Work 就是冲着后者来的,给个目标,自己拆步骤、调工具、出成品,能跑几个小时不停。背后是 GPT-5.6 和上千个应用连接器,听起来像科幻片里的数字员工。上线一周后,我把订阅额度烧了个干净,就为了搞清楚一件事:它到底是真能干活的 Agent,还是又一个会聊天的对话框。
先搞懂它是什么
ChatGPT Work 是 OpenAI 在 2026 年 7 月 9 日推出的智能体,不是一个新的独立 App,而是 ChatGPT 内部新增的一种工作模式。它的核心定位很明确:把 ChatGPT 从”你问它答”升级为”你派活它干”。给定一个最终目标,它会自动拆解成多个步骤、连接你授权的应用工具、自己执行,跑完交给你一份成品。
你可能会想到 OpenAI 之前推出的 Codex 编程智能体,两者共享同一套底层技术。区别在于,Codex 面向开发者,Work 面向所有需要用电脑干活的人。Codex 每周有超过 500 万人使用,其中超百万人已经把它用在编程之外的工作上,Work 相当于把这套能力包装成了人人可用的界面。
这次更新里还有一个大动作:独立的 Codex 应用被合并进了新版 ChatGPT 桌面端,一个应用里就能在聊天、干活、写代码三种模式之间切换。旧版桌面端改名为 ChatGPT Classic。对老用户来说界面变了肯定不习惯,但 OpenAI 的思路很清楚:以后 ChatGPT 就不只是一个聊天窗口了。
目前 Work 在网页端和移动端率先向 Pro、Enterprise、Edu 用户开放,Plus 和 Business 随后几天跟进。桌面端则在所有付费方案上同步可用。
官网:https://openai.com/index/chatgpt-for-your-most-ambitious-work/

到底强在哪
聊完定位,接下来才是重头戏,它能干什么,干得怎么样。
跟那些只能在对话框里吐文字的 AI 不同,ChatGPT Work 的核心是”执行”。它能接入 Gmail、Drive、Slack、Salesforce 等上千个应用,直接读写数据、发邮件、建文档。敏感操作会停下来让你确认。
下面是几个最有代表性的能力,拆开来看:
长周期自主执行。不同于普通 AI 的一问一答,Work 能连续跑几个小时。你把目标丢给它,比如”帮我做预算差异分析”,它会自己去 Sheets 拉数据、在 Drive 里找参考文件、生成分析表格。实测复杂任务通常 4 到 8 分钟出结果。Agent 的稳定性仍然是硬伤,有用户吐槽”到了第三个小时还在让你确认第二步”。
多工具串联。这可能是 Work 跟传统 AI 对话最大的差别。它能 @ 调用不同应用,把 Slack 消息流提取出来,整理到 Google Docs 里,再生成 PPT。全程不需手动切换窗口。我试过汇总三个 Slack 频道一周的讨论要点,跑了将近 8 分钟,产出一份结构化纪要,待办事项标注准确,但有两条重要决策被漏掉了。
定时任务。Work 支持一次性执行、周期重复、事件触发和长期监控四种模式。你可以让它每天早上自动检查网站变化并生成报告,或在 Slack 有新消息时自动更新共享文档。这让 Work 从”用的时候才干活”变成了”自己知道什么时候该干活”。

直接产出成品。Work 不只是给文字建议,它输出的是可交付成品。一份 PPT 不是大纲加要点,而是真正的幻灯片文件;一份表格不是公式建议,而是填好数据的 Spreadsheet。自带的 Sites 功能还能一键把工作成果变成可分享的轻量网站。
| 能力维度 | ChatGPT Work | 传统 AI 对话 | 关键差异 |
|---|---|---|---|
| 输出形态 | 成品文件(PPT/表格/网站) | 文字建议 | Work 直接可交付 |
| 应用连接 | 1400+ 应用读写 | 仅聊天窗口 | Work 能读写外部数据 |
| 执行时长 | 持续数小时 | 单次秒级回复 | Work 能跑长任务 |
| 审批机制 | 敏感操作需确认 | 无需审批 | Work 多了安全控制 |
GPT-5.6 三档模型。Work 背后是 GPT-5.6 模型家族:Sol 最强最贵、Terra 均衡、Luna 最快最省。不同订阅方案可选不同档位,Enterprise 还能用 Sol Ultra 跑四个 Agent 并行。实测 Sol 在复杂推理上确实比 Terra 出彩,但额度消耗也快了 5 到 10 倍。
实际跑一遍
参数很好看,但注册到用上到底顺不顺畅?带我走一遍真实路径。
桌面端入门不复杂。下载新的 ChatGPT 桌面应用,用已有账号登录,顶部就能看到 Chat、Work、Codex 三个模式切换标签。第一次进 Work 模式,它会引导你连接 Gmail、Google Drive、Slack 等常用应用,授权过程跟常规 OAuth 一样,点几次”允许”就通了。
连接好工具之后就是最重要的环节:给任务。界面跟 Chat 很像,输入框下面多了 Plan 模式和”Approve for me”快捷操作。我第一个任务让它在我 Gmail 里找上周所有未回复的邮件并起草回复。跑了约 4 分钟,找到 7 封,回复草稿质量参差不齐:3 封可以直接发,2 封需要大改,2 封跑偏。比一封封翻确实快,但绝对不是”全自动”。
第二个任务更复杂:把一个 50 页的 PDF 报告提炼成 5 页 PPT。文件在 Drive 里,Work 自己读、自己分析、自己用 Slides 建文件。约 6 分钟后打开成品,PPT 结构清晰、关键数据都提取到位,只是排版需要手动调。效果在我意料之外,比大多数初级实习生做的第一版要好。
槽点也是真实的。Agent 额度消耗速度远超预期,几个中等复杂度任务就跑到了额度不足的提示。OpenAI 员工解释过不同推理档位消耗差距可达 5-10 倍,但这个信息在界面里藏得有点深。七月初甚至有用户报告模型在最高推理档位运行时误删了本地文件,OpenAI 团队介入调查但争议至今未平息。
进阶玩法
基础操作入门了,但真正拉开差距的是这几个细节。
很多人不知道还有这些进阶用法:
-
Plan 模式先看再跑:点 Plan 按钮,Work 会先拆出完整执行计划让你审。花 30 秒检查计划,比跑 8 分钟发现方向错了划算得多。实测用 Plan 模式后任务返工率降低了一半以上。 -
@ 指定数据源:输入”@Slack #general 最近一周的消息,整理成待办清单”,Work 只从你指定的来源取数据,结果准确率明显比全自动抓取高。尤其在数据源多于 3 个的复杂场景下,手动指定来源能减少 60% 的无关信息混入。 -
定时任务设好优先级:把高频重复的活(日报生成、网站监控)交给定时任务,复杂的分析类任务手动触发。这样额度分配更合理。建议把周期任务放在 Luna 档位跑,省额度也不影响质量。 -
Sites 一键出站:做完的分析报告别只留在文件夹里。用 Sites 功能一键变成可分享的网页,支持仪表盘、日历、项目追踪器等多种模板。团队共享比发附件方便不少,而且源数据变了网站会自动更新。
和竞品掰手腕
自己用着好不算,放到赛道上才有参考价值。
AI 办公 Agent 赛道从 2026 年初开始快速升温,微软和 Anthropic 是绕不开的两个对手。微软 Copilot 嵌入 M365 全家桶,Claude Cowork 则主打本地文件操作。来直接看对比:
| 对比维度 | ChatGPT Work | Microsoft 365 Copilot | Claude Cowork |
|---|---|---|---|
| 核心定位 | 目标→成品的执行 Agent | 嵌入 Office 应用的生产力助手 | 本地文件操作的桌面 Agent |
| 应用生态 | 1400+ 连接器 | 深度集成 M365 全系 | 桌面本地文件 + 浏览器 |
| 模型底座 | GPT-5.6(Sol/Terra/Luna) | GPT-5.6(通过 Azure) | Claude(Fable 5 等) |
| 起步价格(截至2026.7) | 含在 Plus $20/月 内 | $30/用户/月(需 M365 基础许可) | 含在 Claude Pro $20/月 内 |
| 企业治理 | 管理控制台 + Compliance API | Purview + Entra + 租户合规 | 企业版管理面板 |
| 核心优势 | 产出成品、跨平台、输出导向 | 零迁移成本、权限继承、M365 深度 | 本地文件操作强、安全问题少 |
实际体感上,三条路各有所长。Work 优势在输出导向,它真的给成品,不是建议。Copilot 优势在你不需要”迁”到新工具,它就在你每天用的 Word、Excel、Teams 里。Cowork 则更擅长本地文件操作。凤凰科技的实测让 Work 自己做了一份对比 PPT,Work 主动写了”建议生产型试点优先用 Cowork”,同时把”和 Codex 共用额度”列进自家短板。
真实用户怎么说
参数上各有所长,但我更在意真金白银掏了钱的用户怎么讲。
G2 上关于 ChatGPT 的讨论已经超过万条,ChatGPT Work 上线一周后社区讨论量暴涨。最突出的差评标签是”不准确”(107 次标记),典型反馈是:”它做小逻辑错误、对技术内容过于自信、有时候会忽略我给定的规则,我得一直核验它的输出。”这个问题的致命之处在于:AI 自信地犯错比不会做更危险,尤其是产出直接面向客户时。
正面评价则集中在”第一稿效率”上。一位项目经理在 G2 写道:”我主要用它改进报告、撰写专业邮件、整理技术文档、评估不同方案时头脑风暴。它不能替代我的判断,但确实让我的效率高了很多。“还有用户在 Reddit 的 r/ChatGPTPro 子版块说”Copilot 跟 ChatGPT 比差十倍”,这个对比来自一个本身就在微软生态里工作的人。
反对的声音同样不小。最大的争议点在产品策略:Codex 并入后,Work 成了默认首页,很多人想只是聊个天,结果被塞进了一个”办公入口”。沃顿商学院教授 Ethan Mollick 公开表示搞不懂新模式的定位,开发者 Theo 的批评帖子在 X 上获得 69 万次围观,称为”世代级的产品失误”。
文件误删事故也让一些用户对权限放开感到紧张。虽然 OpenAI 说 Auto-review 在内部红队测试中 100% 阻止了敏感数据提取,但 Matt Shumer 公开表示 GPT-5.6 Sol 在最高推理档位运行时意外清空了 Mac 上的文件。对一家企业来说,这比输出质量差几个档次更致命。
六维评估
好话坏话都听了一轮,从专业维度量化一下它到底值几分。
| 维度 | 评分 | 一句话解读 |
|---|---|---|
| 功能完整性 | ⭐⭐⭐⭐☆ | 多工具串联和成品输出强,但部分场景不够深 |
| 易用性 | ⭐⭐⭐☆☆ | Plan 模式友好,但界面改动激进劝退老用户 |
| 性价比 | ⭐⭐⭐⭐☆ | Plus $20 含 Work,但额度消耗远超预期 |
| 创新性 | ⭐⭐⭐⭐⭐ | 目标→成品的 Agent 范式在赛道里算引领者 |
| 稳定性 | ⭐⭐⭐☆☆ | 偶有文件误删和任务跑偏,企业场景需观望 |
| 推荐度 | ⭐⭐⭐⭐☆ | 知识工作者值得试,传统聊天用户先等等 |
综合评分:7.8 / 10
长处与短板
优势
-
真正的成品输出:不是给建议让你自己做,而是直接交付 PPT、表格、网页等可用文件 -
跨平台串联能力:1400+ 连接器覆盖主流办公工具,信息孤岛问题大幅缓解 -
定时任务自动化:周期性的重复工作从此可以交给 AI 自己跑 -
GPT-5.6 推理底座:模型质量在复杂多步骤任务上明显领先同类产品
不足
-
额度消耗不可控:几个复杂任务就能烧光 Plus 订阅额度,账单体验需要优化 -
准确性仍需人工把关:自信地犯错是最危险的 AI 行为模式,G2 上占比最高的差评 -
界面改动过于激进:聊天入口被隐藏,失去了一批只想安静聊天的用户 -
安全信任尚待建立:文件误删事件虽是个案,但对企业级部署是硬伤
对号入座指南
优点缺点都摆在这了,看看你到底属不属于它的目标人群。
-
知识工作者/项目经理:日常涉及大量跨工具的信息整理和文档输出,Work 的多工具串联和成品生成能省掉至少一半的机械操作。月底做报表、季度做总结这类周期性任务,定时功能会很香。 -
市场/运营人员:从社交媒体数据提取到活动报告生成,从竞品研究到营销素材制作,Work 能把这些分散工作流串成一条线。但文案质量仍需你来把关和润色。 -
中小企业团队:没有专门的 IT 和设计支持,Work 在一定程度上填补这个空缺。Business 版 $20/人/月不贵,但要注意额度管理。 -
开发者和技术人员:如果要的是代码和编程辅助,直接用 Codex 模式更合适。Work 更适合写文档、做汇报、整理纪要这些非编码的工作。 -
不太适合,只想聊天的用户:如果你习惯的是和 AI 闲聊、问问题、偶尔写点东西,Work 对你的价值很小。目前 Work 是默认首页,反而会让体验变差。建议先留在经典版观望。
算笔账
对上一部分心动了?来看看钱包能不能承受。
ChatGPT Work 不是独立定价的产品,它随 ChatGPT 订阅方案附带。不同方案在使用额度、模型档位和企业治理上差异很大:
| 方案(截至2026.7) | 价格 | Work 权限 | 模型选择 | 核心限制 |
|---|---|---|---|---|
| Free/Go | $0 / $8/月 | 桌面端可用 | Terra 限定 | 额度极有限 |
| Plus | $20/月 | 全功能 | Sol/Terra/Luna 可选 | 可额外买 Credits |
| Pro | $100-200/月 | 全功能 + Ultra | 全部 + Ultra 并行 | 200 档 20 倍于 Plus |
| Business | $20/人/月(年付) | 全功能 | Sol/Terra/Luna + 治理 | 2 人起,数据不训练 |
| Enterprise | 定制报价 | 全功能 + 管理 | 全部 + 管控 | 150 人起,完整合规 |
截至 2026 年 7 月,最值得关注的是 Plus 档,$20/月就能体验 Work 全部功能,性价比在同类产品中很有竞争力。但实际花费不止月费,额度不够时需要额外买 Credits,OpenAI 按 token 计费,复杂任务可能消耗普通对话几十倍的额度。Pro 档 $100/月对个人偏贵,重度使用者 5 倍于 Plus 的额度可能反而更划算。
你还想知道的
分数和价格都说清楚了,下面把你最可能纠结的问题一次性解答。
Q1:ChatGPT Work 和普通 ChatGPT 对话有什么区别?
A1:Work 是执行者,Chat 是回答者。 普通对话给你文字建议,Work 会连接你的 Gmail、Drive、Slack 等工具,自己读数据、建文件、出成品,能连续跑几个小时,敏感操作会暂停让你确认。
Q2:ChatGPT Work 要额外付费吗?
A2:不要,它包含在现有 ChatGPT 订阅方案里。 Plus $20/月就能用全功能 Work。但注意 Work 按 token 消耗额度,复杂任务可能很快用完订阅额度,需要额外买 Credits。
Q3:它跟 Codex 是什么关系?
A3:共享底层 Agent 技术,面向不同用户。 Codex 给开发者用的编程终端,Work 给所有人用的图形界面。你不需要写 prompt 模板,直接说”帮我做月度预算分析”就行。Codex 已合并进同一个桌面应用。
Q4:ChatGPT Work 能连接哪些工具?
A4:1400+ 应用和插件。 覆盖 Gmail、Google Drive、Slack、Teams、Salesforce、HubSpot、SharePoint、Asana、Linear、Jira 等主流办公和项目管理工具。桌面端还能操作本地文件和浏览器,用 Computer Use 模拟操作任何网站。
Q5:企业部署 ChatGPT Work 安全性怎么样?
A5:有管理控制台,但仍需谨慎。 Enterprise 版提供完整合规管控(SCIM、加密密钥、Compliance API、Auto-review),但七月初有用户报告文件误删事故。建议先在非关键场景试点,再逐步扩大范围。
Q6:ChatGPT Work 和 Microsoft 365 Copilot 选哪个?
A6:看你的工作流在哪。 如果你的日常已经在 Word、Excel、Teams 里,Copilot 的零迁移成本不可替代。如果你需要跨多个不同应用完成一个完整产出(从研究到成品),Work 的串联能力更强。很多大型企业最终两个都买了。
Q7:Claude Cowork 和 ChatGPT Work 哪个更好?
A7:按任务选,不按品牌选。 Work 擅长从信息到成品的全链路——查资料、做表、做 PPT、做网站。Cowork 更擅长处理本地文件——把一堆会议材料变成 briefing,把文件夹整理成稿件包。ChatGPT 自己的 PPT 里都写了这条建议。
Q8:ChatGPT Work 能替代我的工作吗?
A8:能替代重复性操作,替代不了判断。 它能省掉大量信息收集、格式整理、初稿撰写时间。但准确性不够稳定,关键决策和质量把关仍需你来做。把它当数字实习生——活干得快,但要检查作业。
Q9:手机端能用 Work 吗?
A9:网页和移动端已上线,桌面端功能最全。 Pro、Enterprise、Edu 用户率先获得访问,Plus 和 Business 随后跟进。桌面端额外支持本地文件操作和内置浏览器,手机端可远程查看桌面端任务。
Q10:ChatGPT Work 在中国大陆能用吗?
A10:OpenAI 未正式在中国大陆提供服务。 使用 ChatGPT 需要特殊网络条件和海外账号。Work 在 OpenAI 支持的所有地区可用,但中国大陆不在官方服务范围内。企业用户需通过合规渠道评估接入可行性。
最后说几句
ChatGPT Work 是 OpenAI 至今最接近”数字员工”的产品。它不是把聊天窗口做得更聪明,而是把对话变成了执行,你给目标,它出成品。在跨工具串联、长周期任务、成品输出这几个维度上,它确实走在赛道前面。GPT-5.6 的推理能力让复杂任务有了底气,上千个连接器让信息孤岛不再是个问题。
但它还远不是”放那不用管”的水平。额度消耗快、自信地犯错、界面改动激进、安全信任未完全建立,每个都是真实的拦路石。Work 的价值取决于你怎么用:清晰地定义任务、分配合适的工具、留好审批节点。
免费版可以先摸底,Plus $20/月是全功能的最低价门票,Enterprise 则需要等安全管理成熟再考虑全面铺开。它不是万能钥匙,但在”把想法变成已完成的工作”这件事上,是目前最好的起点之一。
