面对硅谷实习生时,这位CEO毫不讳言——距离「终极AI助手」的诞生,仅需一次模型升级或六个月时间。
未来半年内,一个新世界正在敲门:ChatGPT的继承者将具备窥看屏幕的能力,实时记下每一场会议、每一通电话,从而对你的生活有彻底的理解。距离这样的功能成为现实,只需跨越一次关键的模型演化。
值得注意的是,奥特曼说的远不止「记忆能力增强」或「处理更长上下文」这么简单,而是指AI能够不间断地观察你的屏幕、追踪每一次会议与通话、建立对你整个生活的深层认知。这代表着人与机器关系的蜕变:从单纯对话演变为真正的共生。那么,这一次奥特曼的预言是否可信呢?
奥特曼的愿景:AI成为你的终身记忆体
在过去二十四个月里,奥特曼多次描绘过一幅蓝图:存在一个轻量级的推理模型,却配备万亿级别的token容量,足以容纳你的完整人生轨迹,并源源不断地积累新信息。
在去年五月举办的Sequoia AI Ascent大会上,奥特曼提供了一个令人信服的洞察。他给出了一份简洁有力的分类方式:
在年长的用户眼里,ChatGPT是搜索引擎的替代品;
二十到三十岁的群体视其为人生的指路人;
而大学生群体已经把它当成了操作系统。
进一步观察还能发现,年轻一代正在形成「人生任何大决定之前先问AI」的习惯。
这些现象都在预示AI形态的未来演化方向。但这一次,奥特曼不仅仅是泛泛而谈「记忆功能」,而是具体指出屏幕感知能力与完整会议记录的重要性。他的预言更加具体:未来半年,新一代AI将真正理解你的全部。
这次飞跃是本质的:从「偶然使用」蜕变为「时时相伴」,从「单一任务处理」升华为「贯穿人生的数据积累」。投入在这个AI上的人生经历越丰富,对它的依赖越深,切割成本也就越昂贵。
记忆的进化:从被动存储走向主动生成
其实,这样的能力框架已初见端倪:ChatGPT的客户端在语音交互时已可捕捉屏幕信息,商业版本则早已配备会议记录和内容摘要的模块。
四月二十一日,OpenAI在编程工具Codex里推出了Chronicle这个研究预览功能。通过后台定期截图加光学字符识别技术,它能自动生成「你最近在忙什么」的记忆片段,以本地加密的Markdown格式存储,让Codex更好地理解当前工作内容、历史项目细节,无需用户重复说明。
实际体验后,OpenAI主席Greg Brockman给出了两个词的评价:「意外地奇妙」。内部为它取名「telepathy」——心灵感应。奥特曼本人的表态更直白:「这个名字恰如其分,就是你要的那种体验。」
不过Chronicle远非完整的「人生档案库」。它的主要使命是服务Codex的代码工作流,通过抓取近期屏幕片段来补充语境,并不能持续监听会议、录制通话或搭建全面的个人数据库。用户可以随时关闭。同时它也存在安全隐患,官方文档中明确提及了提示词注入风险、本地存储可能未加密、必须获取用户授权等问题。
与此同时,OpenAI的另一步棋是六月份ChatGPT发布的Dreaming V3版本。

Dreaming V3代表了ChatGPT记忆系统的全新设计:系统在后台自动从对话记录中萃取记忆信息,具有时间敏感性,能够滤除过期内容,显著改善事实准确度和用户偏好识别。用户也可在记忆摘要页面浏览或调整这些记忆。
尤其有趣的是,它拥有自动演变的机制。比如你曾表示「七月打算前往新加坡」,当七月过去后,系统会主动将记忆更新为「你七月已经去过新加坡」。记忆在这里不是固定的快照,而是随时间流动而自我调整的活物。
OpenAI的内部测评数据显示,这次升级带来了显著的性能跃升:事实回忆精准度由2025年的67.9%攀升至82.8%;用户偏好遵循度从55.3%提高到71.3%;时间敏感性判断准确率从52.2%增长到75.1%。

计算效率也提升了大约五倍,这正是为什么它能够向免费用户层推送的原因所在。
从产品线看,Dreaming V3和Chronicle是两条并行但独立的技术轨道——前者主打屏幕感知与代码编辑场景,后者则面向对话交互与通用场景。两者合并后的效果更加贴近奥特曼所描绘的「永久在线、高度个性化」图景,但目前还停留在研究试验和分批推送的阶段。
记忆成为新的壁垒:平台锁定的终极武器
奥特曼的这套构想并非孤立的野心。拉开更大的视角观察,过去几个月间,几乎整个AI产业都在同一时刻、投向同一个方向。
谷歌采取了企业级的打法。Memory Bank功能在Gemini企业版Agent平台上正式上线。开发者可以为自己的AI代理赋予跨会话记忆能力,让系统自动从交互中提取用户的倾好、重要时点、明确指令等信息。现阶段这条线主要服务开发者工具链,还未进入普通消费者的Gemini对话界面,但战略方向与OpenAI完全一致。
AnthropicA同样没有缺席。三月份,持久化记忆功能已全面铺开到Claude的全体用户——无论是免费层级还是付费级别,系统都会在后台根据你的对话内容自动总结并存储你的个人数据。
到了四月,开发者平台的Managed Agents也迎来了持久记忆的公开测试版。Netflix这样的业界巨头已经将其投入实际生产环境,某些企业客户的系统错误率因此下降了百分之九十七。
第三方玩家也闻风而动,只是策略截然不同。像Mem0这类记忆层产品的野心是,成为跨越各个平台的记忆中介层,同时兼容OpenAI、Anthropic、开源系列模型,从而解救开发者免被某个厂商完全束缚。
这个现象充分说明,业界已经看清了一个潜在问题——倘若各大科技巨头各自构建独立的记忆壁垒,最终的受害者是被困其中的用户和开发者群体。而如今,所有的行业巨头都在朝着这个方向狂奔。

但没有人愿意直言的事实是:你的AI记忆当前被禁锢在你使用最频繁的那个平台。一旦从ChatGPT切换到Claude,记忆池瞬间归零,你又要从零开始。同时使用三个平台,就相当于在培养三个完全割裂、成长路径迥异的虚拟自我。
这正是比算法性能本身更隐蔽有力的竞争壁垒。模型能力的强弱可能三个月一个排序更新,但记忆的积累则不同——时间越长沉淀越厚,切割成本随之攀升。谁能率先将用户记忆库填充到足够深度,谁就率先将用户紧紧钉在自己的生态中。
理解到这一点,就能揭开奥特曼言论的双重面貌:既是对产品未来的勾勒,也是对商业格局的深刻洞悉。