提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026现在的 AI Agent 动辄需要处理超长上下文,既要看系统提示词、工具说明,又要翻阅历史对话和检索文档。为了省钱、省算力并降低延迟,很多开发者会给系统加上 “提示词压缩”(Prompt Compression)模块,把冗长的上下文浓缩后再喂给大模型。
搜索
现在的 AI Agent 动辄需要处理超长上下文,既要看系统提示词、工具说明,又要翻阅历史对话和检索文档。为了省钱、省算力并降低延迟,很多开发者会给系统加上 “提示词压缩”(Prompt Compression)模块,把冗长的上下文浓缩后再喂给大模型。
MrFlow(Multi-Resolution Flow Matching)就用这样的三阶段,在Qwen-Image等模型上把端到端生成时间从49.32s压到4.77s,实际加速10.35x。文章发布当日即登上Hugging Face Daily Papers;发布三天内,GitHub已收获200+stars;目前也已登上Hugging Face Trending Papers。
今日,OpenAI元老之一、首席未来学家约书亚·阿希亚姆(Joshua Achiam)在社交平台X上发布告别长文,结束其在OpenAI近9年的任职,最后工作日为本月24日。阿希亚姆的履历几乎贯穿OpenAI从非营利研究实验室到商业巨头的全过程。他2017年以25岁实习生的身份加入OpenAI,当时“计算机还不会说话,也不会思考”。
据外媒TechCrunch 7月5日报道,截至今年6月底,美国已有83家获得风险投资支持的初创企业成功跻身独角兽阵营,其中与AI相关企业就有51家,半年累计融资金额超过520亿美元(约合人民币3532亿元)。
Exponential View 在 2026 年 6 月底发布《AI 经济现状报告》,通过一套去重复统计、自下而上覆盖千余家企业的财务测算模型,剥离行业虚高估值与宣传泡沫,还原海外生成式 AI 市场真实营收、资本开支、算力供需与产业链价值分配格局。
浪潮信息宣布,元脑SD200超节点AI服务器率先完成主流领先开源大模型Kimi K2.6、DeepSeek V4、GLM 5.2、MiniMax M3等的高性能优化,并在Kimi K2.6万亿参数大模型上实现Token生成时间快达4.77ms,为Agent场景应用的高效运行提供强大算力支撑。
2023 年大模型刚火的时候,浏览器被认为是 AI 时代最值得抢的入口,用AI颠覆Chrome是大家都能看到的百亿创业项目。实在是这个入口太大了。全球互联网用户已经是 60 亿量级,Chrome 一个产品就是三十亿级用户;Safari 靠 iPhone、iPad 和 Mac 占住十亿级设备入口,Edge 背后是 Windows 和微软账号体系。
Broadcom 周一表示,将在一项扩展协议中为 Apple 提供定制芯片,该协议将持续至 2031 年。两家公司已签署一项新的多年期协议,博通将开发定制 ASIC 芯片,即专用集成电路(application-specific integrated circuit)。
袁语2016年清明节后在九合创投拿到第一份投资工作,跟着王啸干,投的第一个项目就是VUE——一个帮普通人拍出好视频的创作工具。他说自己一直对"像钢琴一样的东西"着迷,那种能激发创造力的工具。
7月7日,Fable 5没下线!就在凌晨,Anthropic突然官宣, 最强Claude Fable 5限时免费,延长到了7月12日。比原计划,又多了足足五天的「白嫖」时间。具体用法,和之前一模一样,每周使用限额50%,超出之后想继续用,就得买credits了。