量化后画面闪烁?时序稳定的视频世界模型2-bit KV Cache压缩方案诞生
量化后画面闪烁?时序稳定的视频世界模型2-bit KV Cache压缩方案诞生哈尔滨工业大学(深圳)iLearn-Lab与新加坡国立大学LV-Lab提出免训练2-bit KV Cache量化框架QuantWM,改善视频世界模型量化后的时序闪烁与画质,并实现最高6.20倍缓存压缩。
搜索
哈尔滨工业大学(深圳)iLearn-Lab与新加坡国立大学LV-Lab提出免训练2-bit KV Cache量化框架QuantWM,改善视频世界模型量化后的时序闪烁与画质,并实现最高6.20倍缓存压缩。
Anthropic强化学习技术负责人Sholto Douglas预测,能力等于甚至超过所有人类的AGI可能在未来几年内出现,2028年AI年度资本开支或达4万亿美元,而研究员Nick Marwell对AI无需人类搭档后的后果表示紧张。
OpenAI在GitHub的openai/math仓库公开722份数学手稿,涉及372个问题家族及Lean形式化证明,并表示多数结果来自未发布的内部模型,部分未形式化结果可能存在问题。
Claude网页端和桌面端新增简体中文、繁体中文界面,但中国大陆及港澳仍不在Anthropic官方支持地区范围内。
Mistral 发布 Mistral Large 4,采用细粒度混合专家结构,总参数1.05T、每次激活49B,支持图文输入和100万上下文,API现已开放,权重计划于10月27日发布。
据彭博社报道,DeepSeek即将敲定至少800亿元人民币的新一轮融资,腾讯和宁德时代承诺出资金额居前,该轮融资拟为2027年初IPO铺路,但最终条款仍未确定。
开源项目mu(μ)在进化酒馆黑客松深圳收官战中夺冠,其将Jev深度融合进Harness,通过35个判定点优化上下文管理与多Agent通信。
英伟达投资的Reflection发布开源模型Beam,采用MoE架构,专注代码、推理和Agent任务,官方称其以GLM-5.2三分之一至四分之一的推理算力取得相当成绩,但原始能力仍落后部分前沿开源模型,计划月底以Apache 2.0放出权重。
A16Z第七版Top 100 消费级 AI 应用与9月底更新的市场状况 II显示,美国消费者虽已广泛尝试AI,但日常使用和付费渗透仍浅,智能降价正放大Agent的Token需求,重度用户与大众之间的AI使用鸿沟扩大,资本也重新流向芯片、能源和数据中心等实体基础设施。
Anthropic部分早期员工因担忧AI失控开始考虑在美国偏远地区买地避难,这群源自湾区AI安全圈的研究者也因风险判断不同而选择留下或离开。