AlphaGo核心作者:十年了,LLM还没学到那场棋局「神之一手」的精华
AlphaGo核心作者:十年了,LLM还没学到那场棋局「神之一手」的精华2016 年 3 月,首尔四季酒店。人机大战第二局进行到中途,AlphaGo 把一颗黑子落在了第五线上。现场解说一时语塞,有人怀疑程序出了 bug,因为在职业棋手的常识里,这手棋近乎于白送。
搜索
2016 年 3 月,首尔四季酒店。人机大战第二局进行到中途,AlphaGo 把一颗黑子落在了第五线上。现场解说一时语塞,有人怀疑程序出了 bug,因为在职业棋手的常识里,这手棋近乎于白送。
Geoffrey Hinton联合Yoshua Bengio、OpenAI首席科学家Jakub Pachocki、Anthropic联合创始人Jack Clark等20多位AI研究者发布剑桥CASP报告,指出AI已深度参与自身研发,Anthropic内部AI生成代码占比已超80%,警告递归自我改进可能引发技术进步突然加速的「智能爆炸」。
作者测试了豆包、元宝、千问、小红书点点、美团问小团、Claude及Meta的Muse等多款AI工具在制作福建七日国庆旅游攻略中的表现,发现当前通用AI助手和热门的Personal Agent虽能快速生成看似完整的行程,却普遍缺乏对用户个性化偏好的深度理解、长期记忆和多源信息整合能力,无法真正像人一样做出可执行的旅游攻略。
TypeSafe AI推出的Jev模型因直接输出决策与概率火爆出圈,其技术思路与NeurIPS 2025入选论文ConfTuner高度一致,后者通过Tokenized Brier Score直接训练候选置信度概率分布以实现概率校准。
东南大学魏秀参团队提出LeaP(Learnable source Prior)方法,由本体感知信息驱动并联合预测动作生成起点的均值与方差,在RoboTwin仿真15项任务上平均成功率81.6%、较标准高斯基线提升25.5个百分点,相关论文已被CoRL 2026接收。
Anthropic 投入 1 亿美元成立 Claude Frontier Academy(Claude 前沿学院),计划在 2027 年底前培养 1 万名 FDE(前沿部署工程师),首批学员来自埃森哲、贝恩、麦肯锡等企业,已在旧金山、纽约和伦敦开班。
继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效——OpenAI 的现役代码模型 GPT-6 Sol Codex惨遭「开盒」,老底被扒得一干二净!据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。
谁说 DeepSeek 假期不加班?就在昨天,DeepSeek Harness 又更新了。 这次发布的 v0.2.1-alpha.1,新增了一项很惹眼的功能:实验性 Claude Code Mods 兼容层。更有意思的是官方对它的解释:这次首先想验证,Claude Code Mods API 的能力,大致属于 DeepSeek Harness 插件能力的一个子集。
最近,AI 研究团队 Tavus 发布实时视频交互模型 Griffin,并公布了一项实验结果。在与其研究预览版 Griffin-Lite 进行一分钟视频通话后,54 名参与者中有 26 人认为,屏幕另一端坐着一个真人,占比约为 48%。
Meta正式开源Muse Gadgets项目,允许全球开发者使用ESP32开发板和树莓派5等设备为Muse个人AI Agent打造专属外围硬件,推动Muse从单一产品向可扩展平台转变。