aiself AI 情报站
2026-05-19·OpenAI Codex 升级为跨设备控制平面·AI

深度调研 — OpenAI Codex 升级为"超级控制平面",正在变成个人 AI 助手

事件全貌

继 4 月 Mac 版 Codex 加入 Computer Use、多智能体并行后,5 月这一轮升级的核心是把 Codex 从"开发者编码 agent"重新定位为"接管用户所有软件与设备的超级控制平面"。腾讯研究院速递点出三个核心新动作:

  1. Locked Use(锁屏后台运行):突破 macOS/Windows 通常对锁屏后台进程的限制,让 Codex 在电脑锁屏后仍能"常驻执行"——也就是说用户合上盖子离开后,agent 仍能干活。这从根本上改变了 "AI 助手只在用户主动唤起时工作"的交互假设。
  2. 多设备上下文共享:用户的电脑、手机、(未来还可能的眼镜/穿戴设备)组成一个"个人设备网络",Codex 跨设备同步用户偏好、修改习惯、未完成任务。
  3. 跨设备授权与权限传递:速递特别提示存在"跨设备授权漏洞"——这是从产品故事侧把"设备网络"作为一个产品形态在主动叙述。

放回 4 月版本的能力栈来看,整个 Codex 现在长这样:

能力含义
桌面操作Computer Use:查看/点击/输入 macOS 应用,多 agent 并行不抢光标agent 不再是网页里的对话框,是和你共用一台机器的"另一个我"
设备协同Locked Use 后台 + 多设备上下文共享 + Symphony 编排规范agent 跑在你不在的时候、跨在你换设备的时候
应用扩展90+ 插件(Slack/Gmail/Notion/JIRA/CircleCI 等)+ 内置浏览器 + 图像生成agent 接管的不只是命令行,是你日常用的 SaaS 全家桶
时间维度Heartbeats:晨间简报、晚间总结、跨周任务执行、自动调度未来任务agent 不只是"按需",是"持续在场",并能主动启动
记忆持久化用户偏好、修改习惯、历史背景越用越懂你
控制平面Symphony 开源编排规范,把 Linear 等项目板变成 Codex 控制台团队/家庭都能从一个中央面板调度多个 agent

另一组关键数据:Codex 用户当前约 50% 的使用已经不是写代码,而是日程管理、Slack/Gmail 工作流、文档审查、行政简报这类通用生产力任务。这意味着 OpenAI 在 Codex 这个"门面"产品上做的,就是个人助手 agent 产品,只不过叫了一个开发者向的名字以避免市场预期过度。

这件事的本质

把 Codex 升级理解成"OpenAI 推个人 AI 助手"——这是当前最该做的解码。

OpenAI 不是没做过 ChatGPT 桌面版,但 ChatGPT 桌面版本质还是"网页搬上来的聊天框"。Codex 是不一样的产品形态:它在你的电脑里、有系统级权限、能跨设备同步、有时间维度(heartbeats)能主动做事

把它和 5/16 曝光的 Gemini Spark(24/7 数字管家、可代下单消费)放一起看,模式就出来了:

AI 三巨头里至少两家(OpenAI / Google)正在把"24 小时跑在你身边的个人 AI agent"作为下一个旗舰产品形态。它不是 ChatGPT 的功能升级,是新的产品类别。

Anthropic 这边路径稍有不同(更早押了 Claude Code + Skills + 异步 routines 模式),但本质同样指向 "agent 长期在场 + 跨设备 + 主动行为"。

对 aiself 的具体含义

1. "独立 AI 个人助手 agent"这个赛道的天花板被巨头亲手抬起来了。

巨头亲自下场做这件事,对小团队是双刃剑:

  • 好处:用户教育的钱不需要 aiself 来出;产品形态、交互范式、用户预期都被巨头帮忙立住。
  • 坏处:留给独立产品的差异化窗口正在被快速挤压。"我做一个 24 小时主动管家"这句话已经不能作为差异化故事了,那是 Spark/Codex 也在做的。

2. aiself 的两个候选方向,需要重新拿这个事实压一压。

  • 如果做"生活全管家"方向:直接迎面撞上 Codex/Spark。除非 aiself 能在某个具体场景做到比巨头深 10 倍(例如"中国本土化生活服务深度集成 + 隐私本地化"),否则正面打不动。
  • 如果做"决策力训练教练"方向:与 Codex/Spark 在场景上几乎不重合。Codex 是"帮你做事",教练是"训练你自己做事"。这个方向反而因为巨头在做"代办型 agent"而显得更稀缺——当 AI 全部替你思考时,"训练自主决策"会成为人的反向需求。

3. 系统级权限/跨设备网络这条护城河 aiself 别想了。

OpenAI 和 Google 拿系统级权限(macOS Locked Use 这种)是被巨头给的,aiself 这种独立 app 拿不到,也没必要在这个维度上较劲。aiself 的差异化必须建立在"软件做不到、只有产品哲学和场景设计能做到"的维度上——例如"不是把你的注意力榨干,而是帮你长出更强的注意力"这种产品价值观差异。

4. 时间维度(heartbeats / routines)值得直接抄。

Codex 用 heartbeats、Anthropic 用 routines/Cowork 例程,本质都是 "agent 在时间轴上主动出现"。这是 aiself 必备能力(教练方向更需要——每天主动 check-in、每周复盘、每月看长期趋势),不需要从头发明,看现有规范学就行。

决策输入(给 5/24 方向决策会议)

  • 不可走的路:以"24 小时全管家"作为定位差异化。这条路已经被 OpenAI/Google 锁死。
  • 值得加码的方向:训练/教练向 agent。理由:当代办型 agent 越强,"人的自主决策能力"反而越成为稀缺资产;这个反向场景巨头大概率不做(与他们的"使用越多越好"商业模式冲突)。
  • 必抄的能力:跨设备上下文同步 + 时间维度(主动 check-in / 简报)+ 持久化用户记忆。这三个无论选哪个方向都要有。
  • 不必抄的能力:操作所有桌面应用、接管 SaaS 全家桶。这是巨头的护城河场景,模仿没意义。

还需要追踪

  1. Locked Use 是否会引发苹果/微软对 OS 级 agent 权限的政策反应(监管 + OS 平台规则),可能在 6–8 月有动作。
  2. Symphony 编排规范的开源生态采纳情况——如果它成为类似 LSP 的事实标准,aiself 早期可考虑兼容。
  3. Codex 50% 非编码使用占比的演化——如果到下个季度上升到 70%,OpenAI 大概率会正式把它重新品牌化为非开发者产品。