提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026现在的 AI Agent 动辄需要处理超长上下文,既要看系统提示词、工具说明,又要翻阅历史对话和检索文档。为了省钱、省算力并降低延迟,很多开发者会给系统加上 “提示词压缩”(Prompt Compression)模块,把冗长的上下文浓缩后再喂给大模型。
搜索
现在的 AI Agent 动辄需要处理超长上下文,既要看系统提示词、工具说明,又要翻阅历史对话和检索文档。为了省钱、省算力并降低延迟,很多开发者会给系统加上 “提示词压缩”(Prompt Compression)模块,把冗长的上下文浓缩后再喂给大模型。
手术 AI 正在从 “单帧感知” 迈向 “全流程视频理解” 的全新时代!近日,由中国科学院香港创新研究院人工智能与机器人创新中心领衔,发布了全球首个十亿级参数、最大规模数据集练成的手术视频原生基础模型 ——SurgMotion!
MrFlow(Multi-Resolution Flow Matching)就用这样的三阶段,在Qwen-Image等模型上把端到端生成时间从49.32s压到4.77s,实际加速10.35x。文章发布当日即登上Hugging Face Daily Papers;发布三天内,GitHub已收获200+stars;目前也已登上Hugging Face Trending Papers。
刚刚, GPT-5.6 解禁了。据 Axios 报道,美国商务部已经给 OpenAI 放行,批准GPT-5.6 可对外公开发布。放行前,商务部下属的AI标准与创新中心(CAISI)对模型进行了额外测试,OpenAI派技术专家常驻华盛顿配合答疑,最终通过审查。
Broadcom 周一表示,将在一项扩展协议中为 Apple 提供定制芯片,该协议将持续至 2031 年。两家公司已签署一项新的多年期协议,博通将开发定制 ASIC 芯片,即专用集成电路(application-specific integrated circuit)。
VLA 大模型看似强大,却被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。招商局先进技术研究院下属实验室提出新的移动数据范式,首次在真实机器人系统上证明:让相机动起来采集数据,就能以极低成本破解 VLA 的空间泛化瓶颈,且效果普适于多种主流架构。被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。
GitHub上有个项目叫 Project N.O.M.A.D,33k Star,3k Fork。作者 Chris Sherwood 是个搞网络设备的 YouTuber,Crosstalk Solutions 频道有 38 万多订阅。这项目说白了就是把维基百科、本地 AI、离线地图、离线教育平台全塞进 Docker 里,断网也能用。
General Intuition 做的事听起来有点绕:用游戏数据训练现实世界里的 AI Agent。换成更直白的话说,General Intuition 做的是让 AI 先在游戏里学会“怎么行动”,再把这种能力迁移到机器人、无人机、自动驾驶、仿真环境里。
近日,深穹星核正式发布首款高仿真人脸机器人 Nova S1,搭载 VLIA 一体化端侧交互大脑,面向家庭、日常交互与协作场景。继上周天使 4 轮融资后,公司再次完成新一轮数千万元天使 5 轮战略融资,持续加码意图理解与情感交互技术的研发落地。
6月下旬,被业界称为“广告界奥斯卡”的戛纳国际创意节(Cannes Lions)在法国戛纳落幕。这个1954年创办、每年评定全球广告和营销传播行业最高荣誉的奖项,今年做了一个历史上从未有过的决定——为AI单独设立评判类别:AI Craft。