PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍是石科技自研Meta-Infer高效推理引擎通过内核补齐、算子通信重构、并行调优与缓存复用等纯软件手段,在不改动模型前提下将DeepSeek-V4.1-Flash在PCIe显卡上的推理吞吐提升近7倍,该方法论同样适用于DeepSeek-V4-Flash、GLM5.3及国产GPU。
搜索
是石科技自研Meta-Infer高效推理引擎通过内核补齐、算子通信重构、并行调优与缓存复用等纯软件手段,在不改动模型前提下将DeepSeek-V4.1-Flash在PCIe显卡上的推理吞吐提升近7倍,该方法论同样适用于DeepSeek-V4-Flash、GLM5.3及国产GPU。
最近这几天,北京国家会议中心门口总是排起长队。 我刷码进场的时候,旁边两个穿格子衫的年轻人正在讨论今天先去哪边: 一个说先去E区看看机器人,另一个说C区有个安全路演,得早点过去占位置。 这是我第三次来
这个问题正随着推理模型和 RLVR 的发展变得更加重要。随着强化学习在大模型后训练中的作用不断增强,模型练什么、怎么练,也需要更仔细地安排。为了解决数据策略接入和效果比较中的麻烦问题,北大DCAI团队联合UCAS、上海算法创新研究院、中关村学院最新发布DataFlex-RL。
这些「老炮们」最不缺的就是把硬件造出来的能力,也不缺求变求新的劲儿。可AI硬件新课的内容,显然超纲了。
Agent的爆发不止于应用层,当应用不断涌现,底层的交易和支付方式也在被重写。今年的AI交易正沿着两条线同时展开:一条是Agent帮人完成任务,比如今年6月上线的AI版支付宝,一句话就能打车、点咖啡;另一条是Agent-to-Agent,比如两个月前,Mastercard发布了专为机器间支付设计的网络服务。
最近,闲鱼和GPT代充商家的战争,真的进化到我看不懂的程度了。
虎鲸文娱在云栖大会发布行业首个AI影视制作与管理平台"鲸锐AI",聚焦制作过程可控、结果可交付、成本可管理,旨在补足生成模型与专业影视生产之间缺失的工业化生产层基础设施。
AI手机哪家强?荣耀和阿里联手了。
AI 距离真正的递归自我改进(RSI)还有多远?当前,AI 已开始参与数据生成、训练优化、工具迭代与结果验证,但参与研发,并不意味着已经具备持续改进自身的能力。它能够自主完成哪些环节,又如何将局部优化连接成持续、可靠的改进闭环?回答这些问题,需要回到具体的研究与实践,审视已有进展与尚待突破的瓶颈。
“越来越多企业出海,从第一天开始就面向全球客户。但全球化不再只是进入更多的国家,它也意味着从第一天开始就要建立能让产品、收入和运营共同扩展的商业架构。”负责Stripe大中华区企业销售业务的刘斯成说。