点头、抢话、会脸红,一半人分辨不出这是位「AI 小姐姐」
点头、抢话、会脸红,一半人分辨不出这是位「AI 小姐姐」Tavus发布全双工视频到视频交互模型Griffin,可实时生成720p数字人并理解停顿、表情与动作,在一分钟测试中让54名参与者近48%误以为在与人交谈,但该结果未独立验证且模型尚未公开。
搜索
Tavus发布全双工视频到视频交互模型Griffin,可实时生成720p数字人并理解停顿、表情与动作,在一分钟测试中让54名参与者近48%误以为在与人交谈,但该结果未独立验证且模型尚未公开。
在Anthropic冲刺IPO之际,Meta将Claude Code活跃用户从6万降至3万并转向Muse Code,微软也将内部Claude支出削减逾33%,单员工月度Token预算从10万美元降至1万美元。
OpenAI员工David Robinson在离职信中称,持续冲刺和“迭代部署”文化已无法保持必要谨慎,并警告随着AI能力增强,失败的代价将扩大,人类可能失去决定自身生活方式的权利。
VA-Bench测试12个主要多模态模型发现,Qwen3.8-max、Opus-5和GPT-5.6-sol虽在目标识别与定位上达100%、操作语义理解达99.6%—100%,完整任务成功率却仅为53.93%、52.86%和51.55%,暴露大模型从空间理解到执行与修正的断层。
大模型竞技场Arena让Claude Opus 5.5与GPT-6 Astra各自练棋200局,前者估算评分从约1500升至1760,后者从第29盘的1810降至1400,显示AI仅靠记录与复盘提升能力的表现并不一致。
Harvey联合创始人Gabe Pereyra表示,AI应用公司不必与大模型公司比拼资金和算力,可借助真实任务评测、领域专家、开源模型和外部研究团队建立持续学习能力。
UC Berkeley教授宋晓冬带领的Virtue AI团队于今年6月加入Meta超级智能实验室,仅4个月后便因"工作风格不合"被曝遭裁减,合作疑似终止。
OpenAI在开发者日后因GPT-6.1 Sol实际体验不及预期、使用额度收紧等问题遭遇用户信任危机,Tibo承诺未来将进行连续28天发布或重置,并将简化产品、提高效率作为核心方向,以兑现此前过度宣传的承诺。
如果你妄图通过 Claude 执行 rm -rf node_modules 守护一方安宁的雨姐就会把你拦下:“整这死出呢?这命令不好使!想都别想” 然后面板里“拦下”那一栏记了 +1 Claude 要
OpenAI 开发者日才过去了 5 天,Tibo 又来预告下一代模型了。这一次,他们终于打算管管模型写出来的屎山代码了。不久前,OpenAI 产品负责人 Tibo Sottiaux 发帖称,未来的模型会更擅长删除和简化代码。