大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练字节Seed最新研究,让大模型能“原地改参数”了。既不用改模型结构,也不用重新训练,还跑得很快。具体是这么个情况。智能体时代嘛,大家都知道模型们面对的任务开始变得越来越复杂、上下文越来越长。
搜索
字节Seed最新研究,让大模型能“原地改参数”了。既不用改模型结构,也不用重新训练,还跑得很快。具体是这么个情况。智能体时代嘛,大家都知道模型们面对的任务开始变得越来越复杂、上下文越来越长。
《终结者》导演詹姆斯·卡梅隆过去的一番论断,迎来了热议:AGI不会来自政府项目,而是由科技巨头打造。这比我在40年前《终结者》中描绘的情景更可怕,因为至少现在它已不再是科幻小说了。
多模态大推理模型的幻觉,很多时候并非「没看见」,而是在最不确定的推理阶段想偏了。最新研究发现,模型在生成because、however、wait等transition words时,往往处于高熵关键节点,更容易脱离图像证据、转向语言脑补。LEAD在高熵阶段不急于输出单一离散token,而是先在潜在语义空间保留多种候选推理方向,并通过视觉锚点持续拉回图像证据,显著缓解幻觉。
哦豁,马斯克一个“不小心”,把Claude参数抖出来了???长话短说:Sonnet 1T、Opus 5T。起因是老马发帖表示,xAI的Colossus 2超算正在训练7个模型,其中最大的一款,参数量直接冲到了10万亿。
《读佳》独家获悉,腾讯做了一款全新的AI创作产品“啵哔酱”,由深圳市网视界科技有限公司(下称“网视界”)开发,根据人民网此前发布的《内测“有记”,腾讯社交新品接二连三攻占细分市场》报道,以及澎湃新闻的相关报道可知,腾讯发布的“有记”、“朋友”等社交APP均为网视界开发,故这里不再对网视界和腾讯之间的关系做过多赘述。目前该产品还处于打磨测试阶段。
MBTI已经过时了!今天,全网被新型SBTI人格测试刷屏,服务器瞬间被挤崩。更狠的是,不到48小时,就有开发者用Claude Code完成了完整逆向复刻。它由B站UP主「蛆肉儿串儿」一人打造,没想到,却被网友们疯狂测试直接挤爆了服务器。
刚刚,这只爆火的「欢乐马」被认领了!是来自阿里巴巴 ATH 旗下郑波团队的模型,ATH 也就是不久前阿里刚成立的 AI 核心事业群 Alibaba Token Hub。阿里巴巴 ATH 表示:HappyHorse 是阿里 ATH 旗下创新事业部研发的模型,目前正处于内测中,也会于近期开放 API。
一觉醒来,微信公众号开始打击AI了!故事是这样的。 微信公众平台运营规范增加了一条规则:禁止自动化替代真人完成内容创作。 说真的,这个事来得一点都不意外。
2026 年第一季度,它和另外四种完全不同的 Agent 产品形态在同一个窗口期同时冒了出来。OpenClaw 走个人助理、Cowork 走办公协作、Codex App 走长程工程任务、Perplexity Computer 走统一工作站、腾讯云 ADP 走企业平台。
最近,来自Meta与University of Copenhagen的研究者提出了OneStory: Coherent Multi-Shot Video Generation with Adaptive Memory(收录于CVPR 2026)。这项工作聚焦于一个核心问题:如何在生成多镜头视频时,有效保留长程跨镜头上下文,从而实现更强的叙事一致性。