OpenAI「疯狂28天」首日,这都发了些啥啊…
OpenAI「疯狂28天」首日,这都发了些啥啊…OpenAI开启Codex“疯狂28天”计划,首日宣称将GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%至50TPS,但用户实测低于预期,叠加ChatGPT测试广告、欧盟文本隐形水印及订阅调整引发质疑。
搜索
OpenAI开启Codex“疯狂28天”计划,首日宣称将GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%至50TPS,但用户实测低于预期,叠加ChatGPT测试广告、欧盟文本隐形水印及订阅调整引发质疑。
清华团队开源以Qwen 3.8-27B为基础模型的VeriLoop E2,通过VGR外部证据门控实现可验证状态提交,并取得黎曼猜想临界线零点比例下界67.350003708785593%的严格有限维证书,但上游形式化桥接尚未完成。
xAI联合创始人Christian Szegedy在《数学何去何从?》中称,AI正解决多个数学猜想和长期悬而未决问题,数学将由少数天才的手艺转向科技行业基础设施,但Wolfram等人认为纯数学不会被AI做完。
Hinton等22位作者在首篇RSI论文中指出,AI全面参与下一代AI研发可能形成递归自我改进并引发智能爆炸,但现阶段证据不足以证明智能爆炸已经发生。
Utopai Studios打造的Utopai X在Artificial Analysis Video Arena盲评中以1150 Elo位列全球第二,其核心竞争力是将模型深度集成PAI制作系统,并通过真实影视项目、专家反馈与系统迭代形成持续进化的数据飞轮。
StartLux发布完全开源的StartLux-Decision,其27B版本在Decision Index 0.2.1的38项基准中有31项超过Jev 1.13,并以63.88分升至公开榜首。
文章指出,AI时代的FDE已从软件部署延伸至梳理企业Ontology、验证方案、推动系统接入与员工采用,并通过沉淀可复用能力服务产品迭代,其核心难点正由技术转向沟通和组织变革。
开源项目agent-wow接入GPT-6 Astra,使其不读取游戏画面、仅依据服务器网络数据包自主感知和规划,40分钟内零死亡完成《魔兽世界》兽人新手村全部任务。
Rabbit创始人吕骋表示,人不该为Agent改变思考方式,OS3以持续对话、最多连接五台电脑并支持自带模型密钥和本地执行来降低门槛,但个人Agent的长期需求仍待验证。
在Anthropic冲刺IPO之际,Meta将Claude Code活跃用户从6万降至3万并转向Muse Code,微软也将内部Claude支出削减逾33%,单员工月度Token预算从10万美元降至1万美元。