过程比结果重要:一个不给标准答案的调参框架,让Agent自己把数据库性能榨出来
过程比结果重要:一个不给标准答案的调参框架,让Agent自己把数据库性能榨出来数据库自动调参,一直是大模型Agent的“看似完美、实则翻车”名场面。
搜索
数据库自动调参,一直是大模型Agent的“看似完美、实则翻车”名场面。
来自博世中央研究院与清华大学的研究人员提出 FunctionEvolve 框架,在两大基准测试上大幅刷新了这项任务的结果。在 LLM-SRBench 的 129 个合成科学方程任务上,FunctionEvolve 最终给出的公式在 55.8% 的任务上与真实公式等价(SA@1 = 72/129),是此前最好结果的 3.6 倍;
刚刚,国内 AI 应用层最大的一笔融资落定了,但你很可能并没有听过这家公司的名字——演语。演语科技,英文名 Evoken。这是它第一次用集团品牌的身份对外发声。在此之前,外界更熟悉的,是它旗下的 LiblibAI。
最大生物学AI模型Evo2的幕后团队,要把所有生物信息整合到一套AI里!
近日,北京大学 EvoPhys 团队推出首个以 “人” 为中心的 “场景级万物可控” 5D 世界模型 EvoPhys-World,基于摩尔线程全国产算力底座,团队首次将 AI 生成世界从 “可观看、可漫游,浅交互” 的阶段,推进到 “可操纵、深交互、自进化” 的新阶段。
马卡龙又出来炒作自己新一轮融资了,但我感到十分难过😭
机器人看得见,但不一定看得准。
中科大团队首先推出动态多模态知识注入基准MMEVOKE,解构遗忘机制,并在此基础上提出全新双阶段框架KORE。通过「知识树」自动增强与「零空间」协方差约束微调,为大模型终身学习开辟了全新路径。
过去一年,Agent学会了两件事:会用工具、会调用Skill。
AI创造生命的一大步!斯坦福团队用AI造出从零写出16种噬菌体,内含地球前所未有的蛋白,Anthropic CEO预警:6到12个月,傻子也能造超级病毒。