AI资讯新闻榜单内容搜索-Ash

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Ash
Agent组队干活,最强模型只完成50%任务!基准评测协作能力

Agent组队干活,最强模型只完成50%任务!基准评测协作能力

Agent组队干活,最强模型只完成50%任务!基准评测协作能力

OpenAgents、哥伦比亚大学等研究者构建多智能体协作评测基准AgentWorld,评测显示主任务最高完整成功率为Gemini 3 Flash的52.0%,并提出CCE指标分析协作贡献。

来自主题: AI技术研报
7255 点击    2026-10-10 12:29
谷歌Gemini 4新模型大泄露!内测评价:这不Opus 5.5吗?!

谷歌Gemini 4新模型大泄露!内测评价:这不Opus 5.5吗?!

谷歌Gemini 4新模型大泄露!内测评价:这不Opus 5.5吗?!

谷歌正在内部测试Gemini 4新版本Carbon,员工称其编程体验接近Opus 5.5,同时Argon、Barium及疑似gemini-4-flash-preview的模型线索曝光。

来自主题: AI资讯
6244 点击    2026-10-10 12:29
MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做

MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做

MiniMax M3.1 Flash来了:Opus 5.5刷屏的绝活,它也能做

六天后的 9 月 28 日,MiniMax 上线了 M3.1-Flash-Preview。这是 M 系列的最新模型,百万 token 上下文、原生多模态,在 MiniMax Code 里首发上线,目前也可以通过 API 订阅套餐调用。

来自主题: AI资讯
8074 点击    2026-10-03 10:30
Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

MiniMax于9月27日上线Flash级别模型M3.1-Flash-Preview,本文通过试衣间项目改造、机器人视频拆解、北京夜光可视化和A股市场观测台四个实测任务,将其与DeepSeek V4.1 Flash和GLM-5.3-Flash对比,结果显示M3.1速度仅次于DeepSeek但成本最低,成为Flash赛道上DeepSeek的新对手。

来自主题: AI资讯
8663 点击    2026-09-30 15:44
DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源面向华为昇腾算力平台的基础设施组件,涵盖TileLang编译工具及DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect等计算与通信库,华为亦在CANN社区开源双方围绕昇腾950及超节点的联合创新实践。

来自主题: AI资讯
10511 点击    2026-09-30 15:43
用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

代季峰创立的Naive AI开源首个模型Naive-N0.5-Flash,总参数量309B、激活参数量15.5B,原生支持百万token上下文,面向编程与AI研发任务,由AI参与研发并在论文复现等评测中表现优异,权重与代码采用MIT许可开源。

来自主题: AI资讯
10061 点击    2026-09-29 11:53
可灵憋了8个月,放出一只“参数怪”:30秒一镜到底,10个关键帧,HDR和双声道也来了

可灵憋了8个月,放出一只“参数怪”:30秒一镜到底,10个关键帧,HDR和双声道也来了

可灵憋了8个月,放出一只“参数怪”:30秒一镜到底,10个关键帧,HDR和双声道也来了

可灵AI发布时隔8个月大版本更新的旗舰视频生成模型Kling 4.0及轻量版Kling 4.0 Flash,单次原生生成时长提升至30秒,最多支持10个关键帧输入,新增双通道立体声输出,并将很快推出4K 10-bit HDR格式。

来自主题: AI资讯
8907 点击    2026-09-29 11:52
Pi 爆火真相 :为什么只给模型一个 bash,反而赢了 Claude Code 和 Codex

Pi 爆火真相 :为什么只给模型一个 bash,反而赢了 Claude Code 和 Codex

Pi 爆火真相 :为什么只给模型一个 bash,反而赢了 Claude Code 和 Codex

欧洲开发者 Mario Zechner 开发的极简 Coding Agent Harness Pi 只给模型一个 bash,却在多项 Benchmark 中击败 Claude Code 和 Codex,凭借极简设计和高可扩展性在 2025 年底爆火,团队来自维也纳而非硅谷。

来自主题: AI资讯
9348 点击    2026-09-29 11:16
DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。

来自主题: AI技术研报
8866 点击    2026-09-28 16:22
我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

作者用 Qoder 搭配 Qwen3.8-Flash 模型调用开源工具 capcut-cli,在剪映 5.9 中自动完成口播视频的字幕识别、贴字和音效添加,生成可继续手动修改的分轨草稿。

来自主题: AI资讯
9301 点击    2026-09-27 23:11