Codex 中的 ChatGPT Work 使用洞察
管理控制台中的洞察可帮助你了解团队使用 ChatGPT Work 和 Codex 开展哪些工作,以及额度用在了哪里。在工作区概览中打开一个类别,即可查看其任务和使用情况。比较结果前,请检查各视图显示的统计范围。
通过这些视图,找出需要与相关负责人共同评估的工作流。结合使用情况、额度消耗和团队记录,了解这些工作是否更省力、是否达到质量标准,以及是否取得了更好的结果。
分析视图
管理控制台提供 ChatGPT Work 和 Codex 的分析功能。使用情况显示活动与消耗,洞察将使用情况按类别和任务归组。对于工程工作,代码审查显示审查活动与发现的问题。

如果你关注 token,请使用“使用情况”中提供的 token 指标。消息占比、额度占比和 token 占比描述的是不同的内容;比较或分享结果时,请保留这些标签,不要混用。
打开洞察
在管理控制台中,选择你的工作区,然后打开分析 > 洞察。你需要拥有该工作区的分析访问权限;可见的视图和数据取决于你的权限和已启用的功能。
查看结果前,请检查工作区、日期范围和可用筛选条件。比较活动时,请保持这些设置一致。洞察的历史数据仅从开始分类时起提供。
使用场景与任务
在概览中,使用“使用场景 / 任务”切换控件,在大类和更具体的活动之间切换。在“使用场景”选项卡中,展开某个类别即可查看其任务。

在图表中选择一个使用场景或任务,即可打开其详情。使用“使用场景”表可以比较前 10 项之外的类别和任务。
一个类别可能包含多个工作流。在将其视为单一业务流程前,请先检查其中的任务。如果部分活动尚未分类,请在描述结果时注明这一局限。
消息、额度和活跃用户
结合表中的消息数、额度和活跃用户数,了解每个类别或任务。如果出现抽样提示,显示的数量反映的是抽样活动。请勿按比例放大这些数字来估算整个工作区的活动总量。

消息数 显示与某个类别或任务相关的消息数量。消息数并不能说明团队完成了多少工作。
额度占比 显示与某个类别或任务相关的额度消耗所占的比例。结合额度和消息数,可以了解消耗集中在哪里。
活跃用户数 显示在某个类别或任务中活跃的人数。结合消息数,可以比较使用某个类别的人数与其产生的活动量。
如果某个类别的额度占比较高,请检查其任务、模型和设置。工作更复杂或模型选择不同,都可能解释该类别的额度使用情况。在判断这些消耗是否值得之前,请先查看团队取得了哪些成果。
如果某个类别的活跃用户较少,请询问他们如何使用它,以及遇到了哪些困难。他们可能有值得分享的工作流,也可能需要更多支持。
类别详情
打开某个类别的详情,即可在右侧抽屉面板中查看其任务和使用情况明细。

查看该类别中的任务及各任务消耗的额度。模型、推理和速度明细显示各选项在所选类别或任务中的额度占比。如果消耗发生变化,请询问团队,工作内容或这些设置是否发生了变化。
如果提供了插件和技能调用数据,请查看该类别或任务的相关调用情况。这些计数包含所选日期和筛选条件范围内 ChatGPT Work 和 Codex 的活动。调用次数不等同于消息数或已完成的任务数。
分享发现时,请始终将估算值标注为估算。插件和技能的额度分配可能重叠,因此请勿将这些视图中的数值相加来计算总投入。有关如何解读额度及其对账单的影响,请参阅 ChatGPT Work 使用情况与费用。
代码审查
如果你正在评估工程工作,请打开代码审查,查看工作区可用的审查指标。
- 已审查的 PR 数 显示拉取请求的审查活动。经过审查的拉取请求不一定已合并或部署。
- 发现的问题数 显示这些审查发现的问题。请与审查人员确认,哪些发现有帮助,以及哪些已得到处理。
- 按优先级划分的问题、回应和回应情绪 提供有关发现的问题及人员回应情况的更多背景。

计数为零可能表示没有活动,也可能是报告数据缺失。解读该计数前,请检查日期范围,以及相关审查是否包含在内。
评估价值
选择团队在 ChatGPT Work 或 Codex 中使用的一个工作流。与业务负责人商定需要改善的结果以及衡量方式。结合客户简报、库存计划或拉取请求等团队记录查看洞察。让实际开展工作的人员参与评估。
使用一致的报告周期,并检查是否有抽样提示。类别可能包含多个工作流,活动计数并不衡量已完成的工作。以下示例展示如何结合使用数据和工作流中的证据来探究价值。
修复缺陷
Codex 是否帮助工程师减少排查和返工,更省力地解决缺陷?
选择某个服务中反复出现的一类缺陷,例如输入处理不正确。与熟悉相关代码的工程师一起查看问题、修复和回归测试。
如何探究
- 比较类似的修复。 对于复杂度相近的缺陷,记录排查、实现和审查所用的时间。将实际投入的时间与等待审查或发布的时间分开记录。
- 查看洞察。 打开软件工程,查找与排查相关的任务。查看对比周期内的额度和活跃用户数。
- 确认结果。 检查测试是否能复现缺陷,并在修复后通过。询问工程师纠正了哪些内容,并记录重新打开的问题或回归问题。
- 如果经确认的修复所需的总投入减少,就分享该工作流。 如果返工仍然很多,请完善复现步骤或仓库上下文,然后再次比较。
添加测试
Codex 是否帮助团队以更少的手动投入覆盖重要的失败场景?
选择一个已知存在覆盖缺口的模块。比较结果前,商定哪些行为和失败场景需要测试。
如何探究
- 明确缺口。 列出尚未覆盖的行为,并记录添加类似测试所需的投入。使用测试报告记录初始覆盖情况。
- 查看洞察。 在软件工程下查找相关任务。查看同一周期内的额度,以及可用的模型和推理明细。
- 检查测试。 请工程师检查断言是否能捕获预期的失败。记录不稳定的测试结果、增加的运行时间,以及重写或维护测试所花的时间。
- 如果将有效测试纳入代码库所需的投入减少,就复用该方法。 如果测试虽然通过却未能捕获失败,请明确预期行为,然后重试。
重构代码
Codex 是否帮助团队在保留预期行为的同时完成重构?
选择一项范围明确的改动,例如在整个包中替换已弃用的 API。商定哪些调用点属于范围之内,以及团队将如何验证结果。
如何探究
- 确定范围。 记录需要更新的调用点,以及手动完成类似改动所需的投入。标明估算值,尤其是此前被搁置的工作。
- 查看洞察。 查看同一周期内相关的软件工程任务及其额度。如果消耗较为突出,请检查可用的模型和推理明细。
- 验证改动。 审查差异,运行相关检查,并查找遗漏的调用点或行为变化。将审查、纠正和后续修复计入投入。
- 如果重构通过了商定的检查,就扩展到另一个包。 如果仍有太多收尾工作,请先缩小改动范围,或提供一个可用的示例。
客户研究
ChatGPT Work 是否帮助销售人员以更少的投入准备准确的客户简报?
选择一个定期准备简报的销售团队。商定每份简报应包含的内容,例如客户历史、当前重点事项和要向客户提出的问题。
如何探究
- 比较类似的简报。 记录试用前和试用期间的准备与审查时间。使用相同的质量标准,并选择研究深度需求相近的客户。
- 查看洞察。 在销售下查找客户研究与规划。使用可用的群组筛选条件聚焦该团队。查看同一周期内的额度、模型选择,以及任何可用的插件或技能活动。
- 与销售人员一起审阅简报。 对照源记录核查事实,并评估研究是否有助于为沟通做好准备。将纠正内容的时间计入投入,并跟踪节省的时间是否用于客户沟通或跟进。
- 如果准备准确简报所需的投入减少,就分享该方法。 如果缺少重要背景信息,请完善源材料或提供共享技能。使用 CRM 记录评估后续合格商机或销售业绩的变化;仅凭洞察无法确立这种联系。
库存规划
ChatGPT Work 是否帮助团队减少手动工作,制定可靠的库存计划?
选择一个定期开展的规划周期,例如为活动备货。商定涉及哪些产品和地点,以及团队将使用哪些销售和库存记录。
如何探究
- 记录当前流程。 衡量收集记录、准备计划和纠正计划所花的时间。记录类似周期中的缺货或库存过剩情况。
- 查看洞察。 查找与团队规划工作匹配的类别和任务。查看同一周期内的额度和活跃用户数。在将该类别的使用情况归因于这一工作流之前,请与团队确认两者确实匹配。
- 对照实际结果检查计划。 请库存负责人核实数量、假设和缺失的数据。将审查和纠正计入投入。周期结束后,将计划库存与销售量和剩余库存进行比较。
- 如果计划可靠且所需投入减少,就复用该工作流。 如果缺货或库存过剩增加,请重新检查输入和假设。使用库存和采购记录评估成本是否降低。
记录评估。 注明使用场景、负责人和报告周期。纳入基准、结果、额度和局限。记录与团队商定的任何调整,以及复查日期。根据团队记录统计已完成的工作,并标明估算值。
要评估投资回报率(ROI),请将改进带来的价值与 AI、设置、培训及持续支持的成本进行比较。将审查和纠正工作所花的时间计入成本。节省时间并不自动等于节省现金;请检查团队如何利用腾出的时间和人力。
提高使用限额前,请检查当前限额、消耗情况,以及哪些工作需要更多容量。消耗的额度不一定会产生额外的账单费用。请参阅 ChatGPT Work 使用情况与费用。
使用洞察是了解 ChatGPT Work 和 Codex 投资回报的一部分。它们显示所选范围内的使用情况和额度消耗。实际开展工作的团队可以解释发生了哪些变化、结果是否改善,以及这些改进带来了多少价值。结合两者,决定扩展哪些工作流,以及团队在哪些方面需要更多支持。