AI资讯新闻榜单内容搜索-Gen

Claude比你更懂你的需求？Anthropic工程师公开内部用法：用HTML作为AI规范，反而比Markdown更省Token；让“验证”成为Agent的原生特性

“Claude 可能比你更擅长从你这里提取出你想要和需要的东西，而不是由你向 Claude 详细指定。”

来自主题: AI资讯

6511 点击 2026-05-25 09:50

80集短剧，3天拍完：当电影人下场做Agent，影视生产迎来了“最懂行”的解法

很多人以为，AI视频的终点是“生成一段让人惊艳的画面”。

来自主题: AI资讯

10377 点击 2026-05-25 09:48

RSS 2026｜机器人别等失败了才补救，AgentChord让恢复动作提前写进任务图

机器人操作正在从结构化工业场景走向更开放的真实环境。相比完成单个预设动作，真实任务往往包含更长的执行链条、更复杂的物体交互，以及更多不可控的外部扰动。一次抓取没有完全夹稳、目标物体被轻微碰偏、双臂交接时姿态出现偏差，都可能让后续步骤偏离原本计划。

来自主题: AI技术研报

7825 点击 2026-05-25 09:46

小红书灰度Skill上传入口，内容平台分发skill，B站、知乎会跟进吗？

近日，小红书开始灰度开放Skill上传入口，提出了一个值得认真对待的问题：在 Skill生态中，内容平台究竟扮演什么角色？和大厂推出的Agent平台之间，是竞争关系，还是正在形成某种协作分工？

来自主题: AI资讯

8980 点击 2026-05-24 14:11

Bengio新论文刷新递归推理上限，并行轨迹碾压串行推理

现在，图灵奖得主 Yoshua Bengio 给出了一份全新的并行方案。他们提出了 GRAM（Generative Recursive reAsoning Models，生成式递归推理模型），把确定性的递归潜在推理变成了概率性的多轨迹计算。模型在潜在空间中进行随机递归推理，每一步都可以采样不同的方向，最终形成对解空间的多路径探索。

来自主题: AI技术研报

9561 点击 2026-05-24 10:12

谷歌搜索智能体大升级，AI却直接「罢工」了？

本周的 I/O 大会上，谷歌推出了智能体（Agent）时代的全新搜索体验，号称 25 年来对自家搜索引擎的首次重大更新。就在大家满怀期待都开始大用特用的时候，却发现了一系列 bug。

来自主题: AI资讯

9423 点击 2026-05-23 17:09

OpenClaw案例：无需恶意攻击，日常聊天也能「黑化」Agent！

日常聊天可能在不经意间污染个性化Agent的长期记忆，使其在未来任务中偏离用户真实意图。研究人员通过ULSPB基准测试发现，即使无恶意提示，日常对话也可能改变Agent的安全边界。

来自主题: AI技术研报

7857 点击 2026-05-23 09:57

久不发声的美团AI，一开口就开源商用数字人——还把三个闭源大佬给超了

就在今天，美团龙猫大模型团队突然开源了商用级数字人视频生成模型 LongCat-Video-Avatar 1.5。在权威评测中，它的用户偏好胜率全面超越 Kling Avatar 2.0、OmniHuman-1.5 和 HeyGen 这三个头部玩家，并且直接以 MIT 协议开放，连商用限制都懒得设。

来自主题: AI资讯

9779 点击 2026-05-22 21:38

李飞飞最新发布ESI-Bench，空间智能的ImageNet来了

李飞飞团队最新发布ESI-Bench——一个专门用来评测具身空间智能的新基准。过去的空间智能评测默认给模型最优观测，而ESI-Bench第一个把观察者变成行动者，闭合了感知-行动回路。

来自主题: AI技术研报

9420 点击 2026-05-22 15:32

大模型狂飙的尽头，这家国产 GPU 厂商要把算力放在客厅

一个做国产 GPU 的公司，在前几天的发布会上，一口气更新了好几款端侧产品，有家庭智能中枢、AI PC、Agent，还有具身智能相关的工作。它叫 MTT AICUBE，按官方说法是「一台面向家庭的 AI 智算中枢」。

来自主题: AI资讯

9114 点击 2026-05-22 09:56