聞樂 發自 凹非寺
量子位 | 公眾號 QbitAI
Claude開始做夢了。
人有時候白天想不通的事,睡一覺起來就突然明白了。
現在,Claude也學會了這招。Anthropic旗下Claude Managed Agents,上線了一項新功能,Dreaming——
讓AI在工作間隙“睡覺”反思,清理記憶、總結規律、甚至自我升級。
說白了,就是AI的睡眠整理術。
Claude Code泄露源碼里的Dreaming函數,現在終于知道是啥了(doge)。
Claude的「夢」,到底在做什么
咱和AI聊天的時候,每次對話它都會往記憶庫里塞內容,時間長了,記憶庫就變成了雜貨鋪。
重復的、過時的、沒用的全堆在一起,AI自己都分不清該用哪個。
結果就是AI越來越慢、越來越不準。
Claude這次推出的Dreaming,就是要解決這個問題。
它是一段在對話間隙悄悄運行的異步任務,而且是跨智能體集體反思。
Dreaming會自動讀取記憶庫和最多100條歷史會話,然后開始干三件事:
第一,合并重復,清理噪音。
把大同小異的記憶條目合并,刪掉記憶庫里無用的冗余信息。
第二,替換舊內容,更新知識。
第三,交叉分析,挖掘規律。
單個Agent看自己的經歷看不出啥,但把多個Agent的歷史放在一起對照,就能挖出單AI發現不了的隱藏模式。
比如反復出現的錯誤、多個Agent最終收斂的最優工作流、整個團隊統一的偏好習慣。
Dreaming的設計也比較安全可控,它不修改原始記憶數據,所有整理、優化后的結果,都會輸出到一個全新的記憶庫。
也就是說,你對“夢境”不滿意直接刪掉這個新庫就行,也不會影響原有數據。
Anthropic官方是這么說的:
Memory是工作時當場記住學到的東西;
Dreaming是工作間隙想明白這些經驗意味著什么。
一個是即時學習,一個是深度反思,這和人類睡覺時,大腦自動整理白天記憶、沉淀經驗、強化技能的邏輯幾乎一樣。
目前Dreaming還處于研究預覽階段,但也有公司已經嘗鮮了。
法律科技公司Harvey接入Dreaming后,表示其長文法律文書起草的完成率漲了大約6倍;寫作工具Spiral用Dreaming記住用戶的個人風格偏好,配合多Agent協作,內容越寫越對味。
三件套齊發
當然了,這次Claude Managed Agents更新,也不只是做夢。
在Dreaming之外,還有Outcomes、多智能體編排功能,這兩個已經進入了公開測試階段。
Outcomes可以看成是AI的自我質檢員。
思路很簡單:你先寫一份評分標準,AI干完活后,一個獨立的Grader Agent在隔離的上下文窗口里對著標準打分。
這個打分AI不受執行AI的干擾,不達標就指出問題,執行AI會自動修改,直到合格。
內部測試數據顯示,Outcomes能讓任務成功率最高提升10個百分點,docx文件生成質量提升8.4%,pptx提升10.1%,對細節要求高、主觀標準強的任務,效果尤其明顯。
多智能體編排則是讓AI組團干活,一個Lead Agent當隊長,把復雜任務拆成幾塊,分給不同的Specialist Agent并行處理。
每個Specialist可以是不同的模型、不同的prompt、不同的工具集,上下文互相隔離但共享文件系統。
Lead Agent可以隨時找之前調過的Agent繼續聊,對方還記得上次做了什么。
Netflix已經實踐過,平臺工程團隊用它并行分析幾百個build的日志,多個Agent各掃各的批次,最后只浮出反復出現的問題模式,一次性噪音全被過濾掉了。
這三個功能合在一起,其實解決的是同一件事——
讓AI不用人盯著,也能獨立完成復雜工作。
再加上和SpaceX合作拿到Colossus 1數據中心全部算力***、Pro和Max用戶的Claude Code調用限額翻倍……也能看出Anthropic正在搭建的是一整套AI自主工作的基礎設施。
創始人Dario Amodei還在Code with Claude大會上放了個預測:
首家由一人+AI運營、估值達到10億美金的公司,將在2026年誕生。
未來一個人做成10億美金公司不再是夢,或許這個10億美金公司,得先從Claude做個好夢開始…
參考鏈接:
[2]***s://claude***/blog/new-in-claude-managed-agents
一鍵三連「點贊」「轉發」「小心心」
歡迎在評論區留下你的想法!
— 完—
5月20日,我們將在北京金茂萬麗酒店舉辦一年一度的中國AIGC產業峰會。
首波嘉賓陣容已公布!昆侖萬維方漢、智譜吳瑋杰、EverMind鄧亞峰、風行在線易正朝、百度秒噠朱廣翔、Fusion Fund張璐、香港大學黃超、MarsW***e馮雷
請你和我們一起,不再只是討論AI的未來,而是現在就用起來。?? 返回搜狐,查看更多
