AI资讯新闻榜单内容搜索-Acti

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Acti
比李飞飞的T-Rex更进一步:戴盟发布全球首个触觉锚定世界模型 Daimon-TWM

比李飞飞的T-Rex更进一步:戴盟发布全球首个触觉锚定世界模型 Daimon-TWM

比李飞飞的T-Rex更进一步:戴盟发布全球首个触觉锚定世界模型 Daimon-TWM

8 月 10 日,戴盟机器人正式发布全球首个触觉锚定世界模型 Daimon-TWM(Tactile-grounded World Model),以原生触觉贯穿物理认知、推演决策和瞬时反应全阶段。这个 “物理交互脑” 不仅能理解正在发生的物理接触,还能预测下一步交互会发生什么,并根据瞬息万变的反馈及时修正动作。

来自主题: AI资讯
7362 点击    2026-08-11 10:26
VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,视觉 — 语言 — 动作模型(Vision-Language-Action Model,VLA)正逐渐成为通用机器人控制的重要技术路线,但当这些模型真正进入高频闭环执行时,一个矛盾越来越突出:模型越来越大、语义能力越来越强,动作更新却未必足够快。

来自主题: AI技术研报
10173 点击    2026-08-03 15:30
世界模型不再「盲搜」9000次:浙大、清华等团队提出INTACT,直接从意图生成动作

世界模型不再「盲搜」9000次:浙大、清华等团队提出INTACT,直接从意图生成动作

世界模型不再「盲搜」9000次:浙大、清华等团队提出INTACT,直接从意图生成动作

浙江大学、清华大学智能产业研究院、影溯 InSpatio、RoboParty Lab 等团队提出的 INTACT(INtent-To-ACTion),一种基于端到端 JEPA 的无搜索世界模型控制方法,试图改变这一范式:直接利用离线轨迹中已有的状态、动作与未来结果,将运动意图转化为动作模型可以读取的语义接口,使模型无需搜索候选动作序列,就能直接生成动作计划

来自主题: AI技术研报
8757 点击    2026-08-01 10:47
视频世界模型推理最高提速2.59×!浙大新作无需重训,不改参数

视频世界模型推理最高提速2.59×!浙大新作无需重训,不改参数

视频世界模型推理最高提速2.59×!浙大新作无需重训,不改参数

交互式视频世界模型正在从「一次性生成短片」走向「像游戏一样边操作边生成」。但长轨迹交互会迅速放大上下文、显存和多步去噪开销。Light Interaction不改模型参数、不重新训练,只在推理阶段把相机轨迹变成调度信号,动态选择历史上下文、在回访状态复用去噪输出,并用面向自回归生成的3D稀疏注意力降低计算。

来自主题: AI技术研报
9822 点击    2026-07-23 10:39
速递|AI旅行顾问Fora融资6000万美元,估值10亿美元,平台预订超30亿美元

速递|AI旅行顾问Fora融资6000万美元,估值10亿美元,平台预订超30亿美元

速递|AI旅行顾问Fora融资6000万美元,估值10亿美元,平台预订超30亿美元

AI旅行社 Fora 宣布完成一轮由 Forerunner 和 Tactile Ventures 领投的 6000 万美元 D 轮融资 ,公司估值达 10 亿美元。 Fora 成立于 2021 年,是一个双重平台:它通过提供支持客户沟通和旅行规划的基础设施,让人们可以轻松成为旅行顾问;

来自主题: AI资讯
9205 点击    2026-07-21 16:55
星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

WAIC 前夕,星尘智能(Astribot)新模型 Lumo-2,直接在官网甩出 20 + 真机视频 ——这背后,是星尘智能发布的第二代具身基座模型,也是业内首个面向家庭场景的隐式世界 - 动作模型(Latent World-Action Model),同步发的,还智能体 Agent Philia。

来自主题: AI资讯
9156 点击    2026-07-18 10:36
机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

近两年,视频生成模型在具身智能领域受到持续关注。从 UniPi、SuSIE 到各类 action-conditioned video generation 变体,其核心思路一致:先由模型生成一段未来视频,再从中提取动作信号供机器人执行。

来自主题: AI技术研报
9811 点击    2026-07-17 10:12