AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
看一遍就会,三星&上交提出RoboICL新方法,GPT-6 Astra多项机器人操控评测全面领先

看一遍就会,三星&上交提出RoboICL新方法,GPT-6 Astra多项机器人操控评测全面领先

看一遍就会,三星&上交提出RoboICL新方法,GPT-6 Astra多项机器人操控评测全面领先

三星与上海交通大学提出RoboICL具身上下文学习方法,通过冻结GPT-6 Astra模型并在推理时提供少量示范与机器人自身交互记忆,在RoboDojo 30项机器人操控评测中以50.64分全面领先PhysicalRSI等现有方法,并公开了929条可逐布局核查的执行记录及真实机械臂实验结果。

来自主题: AI技术研报
10606 点击    2026-10-01 13:15
国产世界模型首次出海上路!Momenta直接让百亿公里老司机开上欧洲街头

国产世界模型首次出海上路!Momenta直接让百亿公里老司机开上欧洲街头

国产世界模型首次出海上路!Momenta直接让百亿公里老司机开上欧洲街头

Momenta与神龙科技达成战略合作,将基于R7世界模型共同开发高阶智能辅助驾驶系统并搭载于标致、Jeep新量产车型,覆盖中国、欧洲及全球市场,实现国产世界模型首次出海上路进入国际品牌全球车型开发体系。

来自主题: AI资讯
8990 点击    2026-10-01 13:15
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!

硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!

硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!

浪潮信息在AICC 2026发布搭载128芯本土AI芯片的元脑SD200 Ultra超节点AI服务器,通过超级算子融合技术将2.8万亿参数Kimi K3的Token生成时延降至5.85毫秒,与海外Inferact以"巨内核"路线共同打响万亿参数模型推理效率战。

来自主题: AI资讯
9735 点击    2026-10-01 13:15
NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

港科大团队在NeurIPS 2026上提出AccelEval基准,覆盖6个领域42项任务和43类CUDA优化策略,评测大模型能否从可信CPU程序生成端到端更快的GPU实现,其中Gemini 3.1 Pro在中规模通过正确性验证的任务上取得71.2倍几何平均加速比。

来自主题: AI技术研报
8360 点击    2026-10-01 13:14
Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写

Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写

Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写

谷歌正式发布前沿AI模型Gemini 4 Argon,其在Text Arena排名第一、Vals RSI指数超越GPT-6 Astra达30%,单任务成本仅1.99美元,单次输出上限升至100万Token,并在谷歌内部以Rust安全语言重写了80万行系统内核代码。

来自主题: AI资讯
9941 点击    2026-10-01 10:16
Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

MiniMax于9月27日上线Flash级别模型M3.1-Flash-Preview,本文通过试衣间项目改造、机器人视频拆解、北京夜光可视化和A股市场观测台四个实测任务,将其与DeepSeek V4.1 Flash和GLM-5.3-Flash对比,结果显示M3.1速度仅次于DeepSeek但成本最低,成为Flash赛道上DeepSeek的新对手。

来自主题: AI资讯
8677 点击    2026-09-30 15:44
GPT-6 Astra也会「看错」流程图? Einsia AI发布PPTBench,视觉编程还有多远?

GPT-6 Astra也会「看错」流程图? Einsia AI发布PPTBench,视觉编程还有多远?

GPT-6 Astra也会「看错」流程图? Einsia AI发布PPTBench,视觉编程还有多远?

Einsia AI旗下Navers Lab发布视觉编程基准PPTBench,包含500个科学流程图任务并测试10个模型36种配置,GPT-6 Astra High以77.34分居首,但64.03%的结果因流程语义错误被拒,表明视觉理解仍是当前主要瓶颈。

来自主题: AI资讯
7568 点击    2026-09-30 15:42
刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

至知创新研究院开源320B大模型IQuest-Q1,该模型在代码生成、安全漏洞挖掘等评测中表现优异,并能自主排查训练Bug,在交通调度、仓库管理、电梯调度等真实场景中展现出强大的任务解决能力。

来自主题: AI资讯
9107 点击    2026-09-30 15:42
13 组横评综合性能第一!RunningHub 发布 RH Upscale,瞄准视频超分「不变样」难题

13 组横评综合性能第一!RunningHub 发布 RH Upscale,瞄准视频超分「不变样」难题

13 组横评综合性能第一!RunningHub 发布 RH Upscale,瞄准视频超分「不变样」难题

海马云旗下RunningHub发布自研生成式视频超分模型RH Upscale,在13组横向评测中以综合得分0.539位列第一,通过内容保真约束下的时空联合重建与五档模式设计,解决视频超分中"放大而不改内容"的难题。

来自主题: AI资讯
9341 点击    2026-09-30 15:41
Plan Mode才成标配,就有人宣布它「已死」

Plan Mode才成标配,就有人宣布它「已死」

Plan Mode才成标配,就有人宣布它「已死」

Nuanced创始人Ayman Nadeem发文宣布「Plan Mode已死」,指出随着AI模型能力提升,传统计划模式在AI编程中已不再必要,而规划与执行的边界正在逐渐融合。

来自主题: AI资讯
10179 点击    2026-09-30 15:39