AI资讯新闻榜单内容搜索-AR

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AR
ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

奖励模型(Reward Model, RM)是大语言模型对齐的核心组件,负责为模型输出提供符合人类偏好的评价信号。现有方法各有短板:标量判别式 RM 高效稳定但可解释性有限;生成式 judge 能给出判断理由,却需为每个样本生成长 reasoning,token 与延迟开销显著。

来自主题: AI技术研报
7503 点击    2026-07-13 14:44
ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题

ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题

ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题

人类可以在一生中持续学习新知识,而不会轻易遗忘已有技能。然而对 AI 模型而言,这恰恰是一道极具挑战性的难题:每当模型学习新任务时,参数更新往往会覆盖历史知识,产生经典的 “灾难性遗忘” 难题。持续学习(Continual Learning)正是为突破这一瓶颈而生的研究方向。

来自主题: AI技术研报
7581 点击    2026-07-13 14:43
独家 | Robopoet 完成亿元级 Pre-A 轮融资,芙崽开始走向全球化

独家 | Robopoet 完成亿元级 Pre-A 轮融资,芙崽开始走向全球化

独家 | Robopoet 完成亿元级 Pre-A 轮融资,芙崽开始走向全球化

FounderPark 独家获悉,AI 潮玩品牌珞博智能(Robopoet)宣布于 2026 年初完成亿元级 Pre-A 轮融资。本轮融资新增华映资本、广和通、涂鸦智能三大新股东,同时老股东红杉中国、

来自主题: AI资讯
9757 点击    2026-07-13 10:40
闭门会|张咋啦 Zara:AI 时代的底层工作方式

闭门会|张咋啦 Zara:AI 时代的底层工作方式

闭门会|张咋啦 Zara:AI 时代的底层工作方式

张咋啦 Zara 应该是中美 AI 圈子里几乎最出名的 Builder 了。

来自主题: AI资讯
7871 点击    2026-07-13 09:45
Claude Code砸的坑,蚂蚁安全在尝试填上

Claude Code砸的坑,蚂蚁安全在尝试填上

Claude Code砸的坑,蚂蚁安全在尝试填上

2026年,AI安全终于被推到了台前。

来自主题: AI资讯
9386 点击    2026-07-13 09:44
耗费了3亿 token,最好用的编辑器来了?

耗费了3亿 token,最好用的编辑器来了?

耗费了3亿 token,最好用的编辑器来了?

前几天在 github 上有个开源项目非常的火爆,就是 甲木 × 摸鱼小李 大佬联名首发的公众号排版 Skill ,不仅是设计有美感,而且又简约清新,不到几天,就斩获了 1.9k 的 stars

来自主题: AI资讯
7827 点击    2026-07-12 17:10
万字复盘:从模型到可用Agent,WorkBuddy的Harness工程是怎么做的?

万字复盘:从模型到可用Agent,WorkBuddy的Harness工程是怎么做的?

万字复盘:从模型到可用Agent,WorkBuddy的Harness工程是怎么做的?

WorkBuddy最近很火,实测下来的体感是,harness层似乎搭建得还不错,而且对国内模型的兼容度都做得很好,少有的国内应用厂商做出来的、基于国产模型的可用Agent产品。 这篇文章来自 Work

来自主题: AI资讯
9801 点击    2026-07-12 16:37
老黄RTX Spark真机现身Bilibili World!CPU和GPU直接焊在一起,笔记本跑120B大模型

老黄RTX Spark真机现身Bilibili World!CPU和GPU直接焊在一起,笔记本跑120B大模型

老黄RTX Spark真机现身Bilibili World!CPU和GPU直接焊在一起,笔记本跑120B大模型

就在这届Bilibili World上,英伟达首次面向大众玩家展示了搭载RTX Spark超级芯片的笔记本电脑。这款芯片专为个人智能体打造,不仅搭载了Blackwell RTX GPU,连CPU也是出自英伟达的Grace CPU。

来自主题: AI资讯
9522 点击    2026-07-12 10:52
北航、北大和美团联合提出:策略提升强化学习!

北航、北大和美团联合提出:策略提升强化学习!

北航、北大和美团联合提出:策略提升强化学习!

来自北航、北大、美团的研究团队提出了Policy Improvement Reinforcement Learning, PIRL,以及对应的落地算法 PIPO。这项工作关注的是大模型 RL 后训练中一个非常基础、但长期被默认跳过的问题:一次更新在当前数据上看起来优化了学习信号,是否就真的说明模型策略变强了?

来自主题: AI技术研报
8195 点击    2026-07-12 10:44
ACL 2026 | 用图异常检测抓出多智能体网络中的内鬼!XG-Guard:首个无监督、可解释、细粒度的MAS安全防线

ACL 2026 | 用图异常检测抓出多智能体网络中的内鬼!XG-Guard:首个无监督、可解释、细粒度的MAS安全防线

ACL 2026 | 用图异常检测抓出多智能体网络中的内鬼!XG-Guard:首个无监督、可解释、细粒度的MAS安全防线

研究团队提出了 XG-Guard (eXplainable and fine-Grained safeGuarding framework), 一个基于 GAD 且兼具可解释性和细粒度检测能力的无监督安全防护框架。目前工作已被 ACL 2026 Main Conference 接收。

来自主题: AI技术研报
8102 点击    2026-07-11 11:07