全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」
全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。
搜索
在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。
近日,由华为2012实验室、华为云、终端、计算等团队联合构建的openJiuwen开源AI Agent平台发布了企业级分布式蜂群架构,把JiuwenSwarm蜂群能力,扩展到企业级分布式集群。
6月12日,AI系列视频《被裁掉的女孩》在抖音及抖音精选上线,11集,73分钟,2亿播放,均集点赞超30万。第二季8月1日上线,仅一张预告海报,评论区就涌进上千条催更。主角方桃子成了全网第一个被记住的虚拟角色。有人说“我在桃子身上看到了自己”,这是今年暑期第一个真正意义上的爆款视频。
蚂蚁集团旗下具身智能企业上海蚂蚁灵波科技有限公司(简称“蚂蚁灵波”)正式对外确认,已启动首轮外部融资,拟募集资金15亿元,并计划于2026年底前完成第二轮融资。若该融资节奏顺利落地,这家落地张江AI创新小镇的硬科技企业,将创下国内具身智能赛道的最快融资纪录。
新智元报道 这个 8 月,AI 视频赛道的军备竞赛又升级了。 字节跳动发布 Seedance 2.5,把单次视频生成时长从 15 秒翻倍到 30 秒。同一天 MiniMax H3 开源,价格只要闭源旗
LightX2V团队面向Wan2.2-A14B推出LightWan2.2-A14B,以步数蒸馏、NVFP4量化感知训练和动态稀疏注意力压缩计算量,再用高效算子、细粒度卸载和多卡通信优化打通整条推理链路。
据Business Insider报道,当地时间8月5日,Anthropic称,公司正在组建内部芯片团队,为Claude设计定制AI芯片,并计划协同设计模型和硬件,以提升Claude大规模运行时的速度和效率。Anthropic发言人向Bussiness Insider证实了这一消息,这也是公司首次公开确认这一计划。
为什么说AI办公的终局远未到来?如果去看中国电脑办公人群的规模,大概在1到2亿之间。今天各类AI办公产品在这个群体里的实际渗透率,乐观估计也就10%到20%,真正愿意稳定付费的用户就更少了。
“当谷歌无法承载「疯狂假设」,这位 27 年的 Google 功臣,能否能用「不完美」的硬件终结 AI 的「暴力美学」?。 ”
根据公告,宇树科技网上、网下申购日均为8月10日,缴款截止日为8月12日。根据宇树科技公告,本次IPO采用战略配售、网下发行与网上发行相结合的方式进行,拟公开发行新股4044.64万股,拟发行数量占发行后总股本比例为10%。其中网上初始发行数量为647.10万股,网下初始发行数量为2588.62万股,初始战略配售数量为808.93万股。