AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
字节找到了DeepSeek时强时弱的原因

字节找到了DeepSeek时强时弱的原因

字节找到了DeepSeek时强时弱的原因

DeepSeek的神鬼二象性被字节Seed团队逮到了。

来自主题: AI资讯
9913 点击    2026-10-09 16:23
多会话语音记忆基准VoxMem,专治音频大模型记不住「谁说的、怎么说」

多会话语音记忆基准VoxMem,专治音频大模型记不住「谁说的、怎么说」

多会话语音记忆基准VoxMem,专治音频大模型记不住「谁说的、怎么说」

在语音助手、多用户共享的家庭助理等长期对话场景中,模型需要跨越多次会话记住用户的信息,但现有评测常遭遇两大难题:

来自主题: AI技术研报
8612 点击    2026-10-09 16:23
视频生成也能查资料、做模拟:8B智能体学会自主调用工具

视频生成也能查资料、做模拟:8B智能体学会自主调用工具

视频生成也能查资料、做模拟:8B智能体学会自主调用工具

从检索动作知识、寻找角色参考,到模拟运动和衔接镜头,一个经过强化学习的智能体,能给视频生成带来多大提升?

来自主题: AI技术研报
8053 点击    2026-10-09 11:34
蚂蚁×浙大新研究:让AI在流式对话中“读懂”情绪 | EMNLP'26

蚂蚁×浙大新研究:让AI在流式对话中“读懂”情绪 | EMNLP'26

蚂蚁×浙大新研究:让AI在流式对话中“读懂”情绪 | EMNLP'26

在与用户的实时对话中,AI能否及时感知情绪?模型给出的“高置信度”结论,又是否经得起推敲?

来自主题: AI技术研报
7762 点击    2026-10-09 11:32
NeurIPS 2026 Spotlight|拒绝模型「自作主张」,VisInteract用交互搜索找回意图

NeurIPS 2026 Spotlight|拒绝模型「自作主张」,VisInteract用交互搜索找回意图

NeurIPS 2026 Spotlight|拒绝模型「自作主张」,VisInteract用交互搜索找回意图

数据要让人看懂,通常得先从数据库里查出来,再画成图。文本到可视化(Text-to-Vis)做的就是这件事:用户说出想看什么,系统去库里查询,再用图表把需要的数据展示出来。

来自主题: AI技术研报
9165 点击    2026-10-08 11:26
USENIX Security 2026|上海创智学院×复旦大学给智能体装上轨迹「安全规则审计员」:让Agent的行动可审计、可解释

USENIX Security 2026|上海创智学院×复旦大学给智能体装上轨迹「安全规则审计员」:让Agent的行动可审计、可解释

USENIX Security 2026|上海创智学院×复旦大学给智能体装上轨迹「安全规则审计员」:让Agent的行动可审计、可解释

智能体时代,安全研究不仅要关心模型说了什么,现在还必须进一步回答:它做了什么、为什么这么做,以及这次的执行轨迹是否越过了当前场景明确规定的安全边界。

来自主题: AI技术研报
5629 点击    2026-10-08 11:26
NeurIPS 2026 | 长推理为何总在中途走偏?SAGE用结构信号纠偏,AC实例验证通过率接近8倍

NeurIPS 2026 | 长推理为何总在中途走偏?SAGE用结构信号纠偏,AC实例验证通过率接近8倍

NeurIPS 2026 | 长推理为何总在中途走偏?SAGE用结构信号纠偏,AC实例验证通过率接近8倍

大模型解短题常能给出流畅答案,推理链一长,却可能每一步都看似合理、终点仍然失效。来自弗吉尼亚理工大学、威斯康星大学麦迪逊分校和达特茅斯学院的研究团队在 NeurIPS2026 论文中提出 SAGE:用符号闭包分析(SCA)解释长推理中的探索偏差与累积偏差,再把这一诊断变成训练时的结构引导。

来自主题: AI技术研报
8840 点击    2026-10-08 11:26
4B模型下棋比肩大师、还会讲棋,陈丹琦团队怎么做到的?

4B模型下棋比肩大师、还会讲棋,陈丹琦团队怎么做到的?

4B模型下棋比肩大师、还会讲棋,陈丹琦团队怎么做到的?

普林斯顿大学陈丹琦团队在arXiv发布约4B参数模型QUEEN,通过门控交叉注意力连接Leela与SmolLM3-3B,并引入四阶段课程和迭代搜索蒸馏,使其棋力接近特级大师且能用自然语言解释着法。

来自主题: AI技术研报
8965 点击    2026-10-07 15:18
黎曼猜想临界线零点比例下界达67.35%:清华团队开源模型VeriLoop E2叩开可验证智能之门

黎曼猜想临界线零点比例下界达67.35%:清华团队开源模型VeriLoop E2叩开可验证智能之门

黎曼猜想临界线零点比例下界达67.35%:清华团队开源模型VeriLoop E2叩开可验证智能之门

清华团队开源以Qwen 3.8-27B为基础模型的VeriLoop E2,通过VGR外部证据门控实现可验证状态提交,并取得黎曼猜想临界线零点比例下界67.350003708785593%的严格有限维证书,但上游形式化桥接尚未完成。

来自主题: AI技术研报
8849 点击    2026-10-06 15:56
RSI火了,但自进化也会过拟合:Google等提出RRSI,给自进化施加正则化

RSI火了,但自进化也会过拟合:Google等提出RRSI,给自进化施加正则化

RSI火了,但自进化也会过拟合:Google等提出RRSI,给自进化施加正则化

Google等提出RRSI,通过正则化Agent Harness自我改进中的Proposal与Selection,减少过拟合与复杂度累积,并提升未见基准上的迁移表现、降低Token成本。

来自主题: AI技术研报
8285 点击    2026-10-06 13:54