OpenAI行政總裁奧特曼,再次震驚科技圈。
在最近面對矽谷實習生的對話中,他直言「終極AI助理」只差「一次模型疊代/6個月」。
在接下來的6個月裏,我們即將迎來這樣一個世界:ChatGPT的後代可以觀看你的屏幕,記錄每一次會議和通話,並完美掌握你生活的全部背景。
我們距離這一功能變得極其實用,僅差一代模型的疊代。
注意,他說的不是「更強的記憶」或「更大的上下文」,而是持續觀看你的屏幕、記錄每一場會議與通話、掌握你整個人生的完美上下文。
這將是人機關係的質變:從對話走向共生。但這一次,奧特曼預言靠譜嗎?
奧特曼:讓AI記下你所有的生活
過去兩年,奧特曼反覆暢想過一個願景:希望有一個極小的推理模型,卻擁有萬億token的上下文,能記住你的所有生活,然後持續追加。
去年五月Sequoia AI Ascent大會,奧特曼給出了一個很有說服力的觀察。
他做了一個粗略卻清晰的劃分:
年長者把ChatGPT當Google的替代品;
20到30歲的人把它當人生顧問;
大學生則直接當作業系統。
更進一步的趨勢是,年輕人「人生大事,先問ChatGPT」。
這些都是未來AI新形態的信號。但這一次,他不再只是說「記憶」,而是直接點名屏幕感知與會議全量記錄。
奧特曼豪言:未來6個月內,下一代AI將徹底看懂你。
這將是真正的躍遷,從「偶爾使用」變成「持續在場」,從「單次任務」變成「整個人生級別的上下文積累」。你在這個AI身上投入的人生越多,離開它的代價就越大。
記憶從被動保存到主動合成
雛形其實已經開始浮現:ChatGPT桌面端在語音模式下已能獲取屏幕上下文,企業版也早有會議記錄與總結功能。
今年4月21日,OpenAI在編程產品Codex中上線了一個名為Chronicle的研究預覽版功能。
它通過後台間歇性屏幕截圖+OCR,生成關於「你最近在做什麼」的記憶,保存為本地加密Markdown文件,幫助Codex理解「這個「那個」或兩周前的項目,而無需用戶反覆重述。
上手體驗後,OpenAI主席Greg Brockman說了兩個詞:「surprisingly magical」(意外地奇妙)。
它的內部代號叫「telepathy」心靈感應。奧特曼本人直言:「字如其名,就是這種感覺。」
但Chronicle≠全面「人生上下」。它主要服務於Codex編程工作流,捕捉最近屏幕內容以補全上下文,而非持續錄製會議/通話或構建完整個人檔案。用戶可隨時暫停。
而且風險較大,官方文檔明確警告提示注入、本地未加密存儲、需用戶授權。
OpenAI的另一個動作是今年6月ChatGPT上線的Dreaming V3。
DreamingV3是ChatGPT記憶系統的最新架構:後台自動從對話歷史合成記憶狀態,具備時間感知,減少過時信息,提升事實回憶與偏好遵循。
用戶可通過記憶摘要頁查看/編輯。
最有意思的是,它具備自動演化能力。如果你說過「七月要去新加坡」,等時間過了,系統會自動把記憶改成「你七月去了新加坡」。記憶不再是靜態的,而是跟着時間走的。
在OpenAI內部評估中,這次更新性能提升明顯:
事實召回率從2025年的67.9%提升到82.8%;
偏好遵循從55.3%提升到71.3%;
時間敏感準確性從52.2%提升到75.1%。
而且計算效率提升了約5倍,這也是它能下放到免費用戶層的原因。
DreamingV3與Chronicle是並行但不同產品線的進展——一個側重屏幕上下文(Codex編程場景),一個側重對話合成(ChatGPT通用)。
合在一起更接近奧特曼描述的「始終在線、深度個性化」方向,但仍處於研究預覽/分階段推送階段。
記憶,正在成為新的護城河
奧特曼這套願景不是單打獨鬥。把鏡頭拉遠一點會發現,過去幾個月,幾乎整個AI行業在同一時間下注同一個方向。
谷歌那邊走的是企業路線。
Memory Bank在Gemini的企業級Agent平台上上線。開發者可給自己搭的AIagent接上一層能跨會話記憶的能力池,自動從對話里提煉用戶偏好、關鍵節點、顯式指令。
這條線目前更偏開發者基礎設施,還沒鋪到普通消費者的Gemini對話框裏,但方向和OpenAI是一致的。
Anthropic也沒閒着。
今年3月,持久記憶直接全量給了Claude的所有用戶,免費版付費版都有,後台悄悄根據對話總結出你的數據。
4月,又給開發者側的ManagedAgents加上了持久記憶公測版,Netflix等企業客戶已經拿去跑生產環境,有企業用戶的錯誤減少了97%。
第三方也在下場,但打法正好相反。
Mem0這類記憶層項目想做的,是變成一層跨平台的記憶中間件,同時對接OpenAI、Anthropic、開源模型,讓開發者不必被鎖死在某一家。
這恰恰說明行業已經意識到問題所在——如果每家巨頭都各自為政建自己的記憶孤島,最後受苦的會是被困在裏面的用戶和開發者。
現在幾乎所有巨頭都在往這個方向衝刺。
但真正沒人願意擺到枱面上說的是,你的AI記憶現在被鎖定在你最常用的那個平台里。從ChatGPT換到Claude,記憶是空的,一切從頭開始。三個工具一起用,你就同時養着三個互不相通、發展軌跡完全不同的「你」。
這才是比模型性能更隱蔽的護城河。
模型的強弱可能三個月就翻一輪排名,但記憶這東西是越攢越厚的,攢得越久,離開的成本就越高。誰先把用戶的記憶攢得足夠厚,誰就先把用戶焊在自己的平台上。
看懂這一層,就能明白奧特曼這句話不只是產品願景,還有商業預判。