Agent Memory 走到十字路口:技术路线、评测方法与 AML 首榜
Agent Memory 走到十字路口:技术路线、评测方法与 AML 首榜背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
搜索
背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
刚刚,在百度AI Day开放日上,百度文库网盘联合官宣通用智能体GenFlow的中文名——库库AI,并推出了该智能体的全新独立入口,与百度系列办公产品完成了深度融合。库库AI(原GenFlow)自2025年4月上线以来,经过不断迭代,已然在文库、网盘等产品中全端通用,可一站式完成Office三件套等复杂办公任务
就在刚刚,智谱发布了其最新一代旗舰模型GLM-5.3,并宣布模型将在两周内开源。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力,已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型。
A社刚发了一项新研究,讲了件很有意思的事:Agent其实和丧尸一样,可以互相传播一种“思维病毒(Mind Viruses)”,而且过程中有些病毒还会发生变异。研究人员先给一个Agent植入某种想法,随即它开始私信队友、发展“下线”;新感染的Agent又会修改自己的长期记忆,把同一套想法继续传给下一位。
视频模型这个月很热闹。7 月 31 日,MiniMax H3 和字节跳动 Seedance 2.5 同日发布。3 天后,MiniMax H3 正式开源;8 月 7 日,Seedance 2.5 开放 api。模型越来越好了,但产品能把它用好吗?
MiniMax 过去一年的 agent 实践,从一个内部飞书 bot 开始,演化成了桌面应用 MiniMax Code,最终形成了一个训练-服务的闭环:模型在自己的 harness 里训练,通过 harness 服务用户,用户行为变成训练信号反哺下一个模型。这个闭环是模型公司设计 Agent 的核心逻辑。
对 Agent 来说,这种长期记忆能力,正逐渐成为影响实际可用性的一项基础能力。今天,Agent Memory Leaderboard(AML,记忆之巅排行榜)正式发布首期结果。
AI智能体训练平台Bespoke Labs宣布已完成4000万美元融资,其中A轮由Wing VC领投,Mayfield、The House Fund、dbt Labs CEO Tristan Handy,以及来自Anthropic、OpenAI和Meta的其他天使投资人参与
近日,汪源在和虎嗅的交流中,系统谈及公司调整的原因、现阶段的商业化进展,以及一家十人左右的创业公司如何寻找独立生存空间。因此,对久痕科技来说,定位升级不等于商业壁垒成立。当科技巨头们不断将知识库、PPT生成和Agent能力塞进超级应用,久痕科技必须向资本市场证明,上下文管理能否成为一个独立的产业层,而不是一项随时可能被平台免费提供的功能。
作为阿里AI To C的重要入口,千问App最近又更新了一个大版本。这次更新,除了视频通话这类功能之外,我注意到一个变化:它上新了一大批智能体。贝壳找房、顺丰速运、哈啰租车、闪送、盈米基金、天鹅到家、彩云天气,都以独立智能体的身份入驻了.