
OpenAI 推出企业级 AI Agent 部署产品 Presence

OpenAI 正式推出 Presence,一个面向企业的“部署即用”AI Agent 产品,而非简单的 API 或模型。核心思路是:现在的问题不再是 Agent 能不能工作,而是怎么让它在生产中足够可靠,并且能随着业务变化迭代。
Presence 的核心设计是“为具体任务定制”。每个部署开始时只聚焦一个明确的工作,比如处理账单纠纷、理赔或 IT 工单。Agent 只获得完成该任务所需的知识和系统权限。企业可以配置策略:Agent 能做什么、何时需要审批、何时必须转人工。上线后,生产中的对话记录和转人工事件会暴露出差距。Codex 会基于这些信号提出更新建议,团队测试和批准后再逐步上线。
这套机制背后是几个组件:策略与标准操作流程、护栏、批准操作、模拟测试、评估工具,以及由 Codex 驱动的改进循环。它们不是为了解决“通用问题”,而是让 Agent 在固定的边界内可靠执行,并且能持续适应政策、产品和用户行为的变化。
Presence 的实际效果来自 OpenAI 自己的客服通道(1-888-GPT-0090)的验证。上线几周内,在 OpenAI 内部用于评估一线人力的基准上达到或超过了标准。目前,该通道 75% 的进线问题无需人工协助即可解决。在与上线团队的协作中,其 Codex 驱动的改进循环在 10 天内将人工转接率降低了 15 个百分点。
典型客户案例包括 BBVA(墨西哥日常银行语音服务)、SoftBank(日语自然语言客服)、IAG(恶劣天气等高需求事件支持)。这些案例表明 Presence 侧重于特定垂直场景的高频、高风险任务。
值得注意的限制是:Presence 目前不是自助产品。通过有限通用可用性计划提供给合格的企业客户,部署由 OpenAI 的现场部署工程师(FDE)和盘古系统集成商主导。这意味着它是有较强的服务属性、较高的客单价形态,不适合中小企业自行尝试。
Presence 的另一个关键设计是“信任”贯穿全周期。上线前,团队可以通过模拟和评分器测试 Agent 是否在策略范围内做出正确决策。上线后,生产过程、转人工事件和质量信号可以持续暴露问题。Codex 会主动分析这些信号并提出更新,团队可以在与生产版本对比后再批准控制性灰度发布。
总结而言,OpenAI Presence 是一个把模型能力、策略引擎、评估系统和持续改进流程打包成“可信赖 Agent 部署方案”的产品。它不承诺通用能力,而是用明确的任务边界和严格的闭环迭代来换取生产环境下的可靠性。对于需要在高风险场景下部署 AI Agent 的大型企业,这是一个比自行拼接 API 和评估框架更完整的选项。


