AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉

给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉

给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉

中国电信研究院与MemTensor等机构提出首个面向智能体记忆系统的操作级幻觉评测基准HaluMem,已被EMNLP 2026主会接收,该基准分别对记忆提取、更新和问答三个环节进行检查,并对Mem0、MemOS等六套系统实测,发现高召回率可能伴随虚假信息写入、低更新幻觉率背后存在大量遗漏、上游记忆问题最终会影响回答等核心现象。

来自主题: AI技术研报
10389 点击    2026-09-30 15:39
实录 OpenAI 年度发布会:25 项发布,逐一详解

实录 OpenAI 年度发布会:25 项发布,逐一详解

实录 OpenAI 年度发布会:25 项发布,逐一详解

OpenAI在第四届DevDay开发者大会上发布25项更新,包括Dots个人agent、ChatGPT Space协作空间、GPT-6.1 Sol模型、Ultrafast极速档及Codex全面上云等,涵盖模型、搭建工具与分发三大板块。

来自主题: AI资讯
9907 点击    2026-09-30 11:59
多个榜单登顶、1.2B参数,轻量化TeleOCR解锁文档智能化解析新能力

多个榜单登顶、1.2B参数,轻量化TeleOCR解锁文档智能化解析新能力

多个榜单登顶、1.2B参数,轻量化TeleOCR解锁文档智能化解析新能力

中国电信星辰通用人工智能实验室推出的轻量化文档解析模型TeleOCR(约1.2B参数)凭借形变感知学习、多边形版面分割、CGDP采样及内容—结构解耦等技术创新,在OmniDocBench v1.6、Wild-OmniDocBench、PureDocBench等多个公开榜单取得领先,并在ICDAR 2026 Sci-ImageMiner挑战赛中夺冠,目前已开源。

来自主题: AI资讯
9026 点击    2026-09-30 11:17
一出手就表现惊艳!国产开源大模型又杀出一匹黑马

一出手就表现惊艳!国产开源大模型又杀出一匹黑马

一出手就表现惊艳!国产开源大模型又杀出一匹黑马

至知创新研究院开源了采用稀疏 MoE 架构的代码与复杂任务导向大模型 IQuest-Q1,该模型总参数约 320B、激活参数仅约 15B,在代码生成、终端操作、智能体任务等多项评测中表现均衡,并展示了从前端交互、游戏开发到强化学习训练调试等场景的可交付能力。

来自主题: AI资讯
10479 点击    2026-09-30 11:16
刚刚,清北天团甩王炸!正面叫板Figure

刚刚,清北天团甩王炸!正面叫板Figure

刚刚,清北天团甩王炸!正面叫板Figure

国产初创公司德塔智能发布双足人形机器人基础模型Delta 0,其大小脑分层架构在铺床、洗碗等长程家务任务中正面叫板Figure Helix,德塔智能由清华与UCLA背景团队创立,半年内已完成近5亿元天使++轮融资。

来自主题: AI资讯
8633 点击    2026-09-30 11:14
AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站

AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站

AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站

匿名AI模型Space Bunny Alpha(太空兔)近期凭借草图转网页、长上下文与Agent编程能力在OpenRouter和OpenCode平台刷屏并冲上日调用量第一,其分词特征与MiniMax M3.1系列高度吻合但尚无厂商官方认领。

来自主题: AI资讯
10054 点击    2026-09-30 11:12
在线蒸馏灵活却太慢,离线缓存高效却不够灵活,LinkedIn 如何取舍?

在线蒸馏灵活却太慢,离线缓存高效却不够灵活,LinkedIn 如何取舍?

在线蒸馏灵活却太慢,离线缓存高效却不够灵活,LinkedIn 如何取舍?

LinkedIn 公开其 AI 职位搜索的多教师蒸馏训练基础设施,通过基于 SGLang 的定制框架结合在线与离线蒸馏方案,并叠加 LiGer、多节点训练、FSDP2 及 H200 集群等优化,实现约 8 倍训练加速,将 80 亿参数相关性模型和 17 亿参数互动模型的知识压缩至 6 亿参数排序模型,使职位搜索 NDCG@10 提升 24.48%。

来自主题: AI技术研报
7705 点击    2026-09-30 11:10
GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了

GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了

GPT-6 Astra的隐藏推理,丹麦团队用tool calling撬出来了

丹麦奥尔堡大学AI安全实验室与Seafill开源社区联合发表论文,通过tool calling方法从GPT-6 Astra等前沿闭源模型中提取出隐藏思维链,发现Astra采用类似"心算"的压缩推理方式,省略基础计算与代数变形等中间步骤而直接给出关键结论。

来自主题: AI技术研报
8847 点击    2026-09-30 11:09
提速10.7倍!这个端侧推理引擎一开源,机器人本体跑大模型终于不卡了

提速10.7倍!这个端侧推理引擎一开源,机器人本体跑大模型终于不卡了

提速10.7倍!这个端侧推理引擎一开源,机器人本体跑大模型终于不卡了

清华大学联合无问芯穹与上海交通大学开源了面向具身模型的端侧推理引擎APXInf,通过全栈优化在Thor芯片上将π0.5推理速度提高约10.7倍,并引入可由Agent执行的工程化流程以适配模型的持续迭代。

来自主题: AI资讯
9091 点击    2026-09-30 11:09
EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余

EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余

EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余

中国人民大学代文林、孟澄研究员团队提出的ME-Decoding方法被EMNLP 2026接收,该方法在解码时同时利用token概率与embedding相似度,从集合层面筛选低冗余候选token,在GSM8K和GPQA上取得所比较方法中最高的平均准确率,端到端GPU延迟仅增加约3%。

来自主题: AI技术研报
7894 点击    2026-09-30 11:07