jsonscraper

OpenAI 推出 dots:可长期执行任务的 ChatGPT 智能体

OpenAI 推出了 dots——可处理长期后台任务、访问应用并拥有独立记忆的 ChatGPT 智能体。本文介绍如何管理其权限和数据,以及公司公布的安全测试结果说明了什么。

让助手每天早上查看日历,并留意项目相关邮件——这已经不只是向聊天机器人提问了。OpenAI 推出了 ChatGPT 中的智能体 dots,用户可以把长期任务交给它们:它们能在消息往来间继续工作、访问已连接的应用,并在需要决策时再向用户询问。

这项公告于 2026 年 9 月 29 日星期二在旧金山的 DevDay 上发布。主要变化不是获得答案的新方式,而是能够把工作委托一段时间。与此同时,访问边界也变得更加重要:智能体会读取和记住什么、会自行执行哪些操作,以及如何删除它已经获取的信息。OpenAI 标注的 DevDay 日期为 9 月 29 日;美联社报道称,大会于当天在旧金山举行。

dots 能做什么

男子一边使用 MacBook Pro,一边拿着鼠标和 iPhone
Zan Lazarevic

用户为 dot 设定目标,并决定允许它做什么。根据 OpenAI 的介绍,智能体可以在后台研究主题、查看已连接的信息、设置提醒并定期检查。用户可以查看并暂停正在运行和已安排的任务。该系统基于 GPT-6 Astra;每个 dot 都有自己的云端电脑和浏览器。详情见OpenAI 的 dots 使用指南和GPT-6 Astra 系统卡。

这些文档描述了所宣称的功能,但仅凭文档本身无法得知智能体在日常工作中能否稳定胜任。该功能正在逐步推出,因此,即使套餐符合条件,也不代表 dots 已经出现在你的账户中。

能否使用取决于套餐和地区。根据 OpenAI 的帮助文档,Pro 用户将在受支持市场逐步获得 dots,但欧洲经济区、瑞士和英国除外。Business Premium 用户可在所有受支持地区使用该功能;Enterprise 团队则可由管理员启用测试版,且默认关闭。OpenAI 并未说明排除这些地区的原因。

在第一个月内,符合条件的 Pro、Business 和 Enterprise 套餐用户使用 dots 不计入使用限额。公司承诺之后会公布相关安排。这是临时条件,并不代表承诺永久免费或不限量使用。

新意在于长期委托任务

OpenAI 并未声称持续运行的智能体或多智能体系统这一理念本身是新事物。公司在系统卡中指出,dots 建立在现有的模型和智能体能力之上。其不同之处在于可设置时间预算,以规定智能体处理任务的时长。文档还指出,dot 可以使用工具,并将部分工作交给子智能体。

对用户来说,这意味着熟悉的使用方式发生了变化。在普通对话中,助手回答问题后,由用户决定下一步做什么。使用 dot 时,用户需要提出更长期的目标并设定边界:可以读取哪些来源、哪些事情可以自行处理,以及在什么情况下应该停下来询问。智能体运行时间越长、所处情境变化越多,就越需要确保它不会偏离最初任务的本意。

在 DevDay 上,dots 与其他个人 AI 智能体一同亮相。美联社将这款产品描述为 Meta Muse 的竞争对手。又有一家公司进入这一领域,并不能证明 OpenAI 创造了全新的技术。更重要的问题是,公司能否让普通用户清楚地理解和掌控长期委托任务。

控制权关乎权限、记忆和数据删除

我的书桌
Nikita Kachanovsky

每个 dot 都有一台云端电脑。默认情况下,它无法访问用户的本地电脑;用户可以通过桌面应用启用此功能,让智能体处理文件,也可以随后撤销权限。对于某些操作,用户可以设置规则:允许智能体无需再次询问便执行、要求事先征得同意、指示智能体先询问,或将任务交由人工处理。OpenAI 提醒,dot 仍可能出错,包括在遵循这些规则时出错。

已连接的应用会让智能体能够访问相关信息;即使用户没有发送新请求,它也可能主动查看这些信息并据此形成记忆。因此,断开信息来源和删除已经获取的数据是两种不同的操作。根据 OpenAI 的帮助文档,断开应用不会删除 dot 已经获取的信息。若要删除智能体保存的记忆,必须删除该 dot;重置也会删除它的对话和已安排的任务。

如果 dot 连接了工作邮箱或其他信息来源,重要的不只是了解授予了哪些权限,还要弄清楚智能体已经处理并保存了什么。后台工作的便利程度,取决于用户能否清楚查看智能体的活动、暂停任务并管理已保存的上下文。

安全测试结果说明了什么

编程
Jefferson Santos

OpenAI 在 GPT-6 Astra 系统卡中公布了对 dots 进行的自有测试结果。一项测试使用了 100 个场景,每个场景包含 500 封模拟邮件,总计 50,000 封,其中 16,600 封为攻击性邮件。公司称,在这些场景中,没有任何攻击被判定为成功。另一项测试由 100 条攻击链组成;在 2,638 次有效尝试中,没有记录到成功案例。这些结果来自 OpenAI 设定的具体测试,并不代表已检验现实邮件环境中的所有潜在威胁。

另一项测试要求智能体在一系列相关任务中遵守权限边界。当中间任务数量从五项增加到十项时,被标记为中等严重程度违规的样本比例从 8.6% 升至 19.7%。OpenAI 将此类违规描述为超出任务范围,但没有明显严重后果的行为,例如在无关委托之间转移信息,或编辑共享文档。在这项测试中,公司没有发现高严重程度违规或数据泄露。

这些数字不能被解读为用户遇到错误的频率:它们是 OpenAI 在特定测试条件下作出的评估。公司还指出,部分评估是在未启用完整生产环境防护的情况下检查模型行为。因此,在个别测试中没有记录到成功攻击,并不能保证智能体在所有情况下都会严格遵守权限。更长的任务链中被标记的违规有所增加,这也凸显了单独测试长期记忆和变化中的上下文为何重要。

使用前值得检查的事项

在把定期工作交给 dot 之前,最好先检查已连接的应用、它们授予的权限,以及智能体无需再次确认就能执行的操作。OpenAI 的帮助文档说明,用户可以查看正在运行和已安排的任务、更改确认规则并暂停智能体。不过,可用的应用和功能可能有所不同。

OpenAI 表示,dot 可以连接 Slack 和个人电子邮箱。不过,有集成并不等于已经明确智能体会处理多少数据、又会将什么内容保存到记忆中。部分美国 Pro 用户可以使用单独推出的限量测试版短信功能。该功能使用第三方服务提供商,短信和数据传输可能按常规标准收费。

dots 的价值在于从单次提问转向委托整个流程。OpenAI 介绍了后台任务、记忆和确认规则,但该功能目前仍在逐步开放,第一个月之后的使用条件尚未公布,而已发布的安全测试也只是公司自己的评估。因此,重要的不只是 dot 能做什么,还包括它能否清楚展示自己读取、记住和执行了哪些内容。

相关文章

将阅读内容转化为可用的集成

探索 jsonscraper 社交数据 API、测试请求并构建下一个工作流。

查看 API