AI资讯新闻榜单内容搜索-视频模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 视频模型
让自然语言成为世界模型的表征,英伟达Physis-Lang这样增强视频物理真实性

让自然语言成为世界模型的表征,英伟达Physis-Lang这样增强视频物理真实性

让自然语言成为世界模型的表征,英伟达Physis-Lang这样增强视频物理真实性

英伟达联合MIT和牛津大学团队提出Physis-Lang,通过物理语言描述、自进化准则和能力导向的数据检索提升视频模型的物理理解与生成表现,其Cosmos3-Super和Cosmos3-Nano在Physics-IQ Verified分列第一、第二。

来自主题: AI技术研报
7295 点击    2026-10-10 12:36
李飞飞团队造了个世界动作模型:换个底座,机器人成功率直接飙升

李飞飞团队造了个世界动作模型:换个底座,机器人成功率直接飙升

李飞飞团队造了个世界动作模型:换个底座,机器人成功率直接飙升

9 月 22 日,以 FLUX 图像模型闻名的 Black Forest Labs 跨界发布了开源 7B 世界动作模型 FLUX 3 Action。据其官方博客,该模型在英伟达 RoboLab-120 榜单上超过了此前最强的开源模型 Cosmos 3 Nano,参数量却不到后者一半。一家做图像生成的公司跑来卷机器人控制,说明视频模型里积累的「物理直觉」正被越来越多的团队当作机器人大脑的底座。

来自主题: AI技术研报
6223 点击    2026-10-09 12:50
一家影视公司为什么能做出全球第二的视频模型?答案藏在「生产系统」里

一家影视公司为什么能做出全球第二的视频模型?答案藏在「生产系统」里

一家影视公司为什么能做出全球第二的视频模型?答案藏在「生产系统」里

Utopai Studios打造的Utopai X在Artificial Analysis Video Arena盲评中以1150 Elo位列全球第二,其核心竞争力是将模型深度集成PAI制作系统,并通过真实影视项目、专家反馈与系统迭代形成持续进化的数据飞轮。

来自主题: AI资讯
8070 点击    2026-10-06 14:39
复旦上线音视频模型新裁判:一万组数据对齐人类审美

复旦上线音视频模型新裁判:一万组数据对齐人类审美

复旦上线音视频模型新裁判:一万组数据对齐人类审美

现有的音视频奖励模型,能通过局部指标捕捉到画质或同步上的优势,却往往忽略声音失真、台词与提示不符,以及动作和语音配合不自然等问题。

来自主题: AI技术研报
9365 点击    2026-09-21 15:30
给视频模型建一座「全能训练场」:300项任务、可验证奖励,VBVR-Pro系统探索视觉推理

给视频模型建一座「全能训练场」:300项任务、可验证奖励,VBVR-Pro系统探索视觉推理

给视频模型建一座「全能训练场」:300项任务、可验证奖励,VBVR-Pro系统探索视觉推理

NTU、CMU、Berkeley等高校联合推出VBVR-Pro视觉推理系统,构建300项任务与100项可验证打分器的训练评测平台,测试30余个多模态模型,并验证其打分器可直接作为强化学习奖励。

来自主题: AI技术研报
7606 点击    2026-09-20 15:08
Minimax H3 之后,又来了一位狠角色:智象 HD-V1 发布,视频模型开始理解现实世界!

Minimax H3 之后,又来了一位狠角色:智象 HD-V1 发布,视频模型开始理解现实世界!

Minimax H3 之后,又来了一位狠角色:智象 HD-V1 发布,视频模型开始理解现实世界!

最近几个月,AI 视频赛道开始热起来了: Seedance2.0 发布后,AI 视频进入可用阶段,MiniMax H3 发布后,以 1/4 的价格,把 Seedance 2.0 的成本打了下去,AI 视频成本进入平价时代。

来自主题: AI技术研报
9916 点击    2026-09-16 15:10
Vidu S2:实时数字人,实时改视频

Vidu S2:实时数字人,实时改视频

Vidu S2:实时数字人,实时改视频

刚刚,生数上线了最新的 实时视频模型 S2,输出提高到 720p,保持 25—42 FPS,包含下面两款:

来自主题: AI技术研报
7944 点击    2026-09-15 14:32
深度|GPT-6遇上实时视频,AI游戏和互动内容迎来新赛季

深度|GPT-6遇上实时视频,AI游戏和互动内容迎来新赛季

深度|GPT-6遇上实时视频,AI游戏和互动内容迎来新赛季

一周之内大语言、图片、视频模型都迎来新赛季:OpenAI的GPT-6 Astra让编码 Agent更好地使用游戏引擎和Blender,自己改场景、自己跑、自己测;GPT-image-2.5上线,更快更强,图片编辑和关键帧动画显著提升;fal和Yoroll分别发布 H3 MaxTurbo和H3 Superfast后训练加速模型,5秒视频3秒内推理,实时生成和互动玩法纷纷涌现。

来自主题: AI资讯
6556 点击    2026-09-10 15:18
速递|前Sora负责人将投身AI视频创业,将联手DreamWorks联合创始人

速递|前Sora负责人将投身AI视频创业,将联手DreamWorks联合创始人

速递|前Sora负责人将投身AI视频创业,将联手DreamWorks联合创始人

前OpenAI Sora负责人比尔·皮布尔斯(Bill Peebles)与DreamWorks联合创始人杰弗里·卡岑伯格(Jeffrey Katzenberg)及Dropbox前CFO苏杰伊·贾斯瓦(Sujay Jaswa)共同创办AI视频创业公司,将自主训练视频模型,并与Andreessen Horowitz等投资人洽谈融资。

来自主题: AI资讯
9901 点击    2026-09-10 11:40