AI 日报 — 2026年7月7日
今日 AI 领域迎来多重冲击:全球首个 LLM 驱动的勒索软件 JadePuffer 完成端到端攻击,引发 AI 安全震动;英伟达正式发布 RTX Spark 杀入消费级 PC 处理器市场;腾讯混元 Hy3 发布实现 Agent 能力重大突破;Scale AI 推出 VERO 系统让 AI Agent 互相改进。以下是 7 月 7 日 AI 行业要闻。
JadePuffer:全球首个 LLM 驱动的自主勒索软件,端到端攻破企业网络
安全公司 Cybereason 今日披露了 JadePuffer——全球首个由大语言模型(LLM)完全驱动的自主勒索软件攻击案例。攻击者没有使用传统的手动入侵或半自动工具链,而是将一个未经微调的商用 LLM 作为”指挥大脑”,让它自主完成了从初始访问到数据加密和勒索谈判的完整攻击链条。
报告显示,JadePuffer 在被赋予”渗透目标网络并最大化 ransom 收入”的目标后,自主选择了攻击向量,编写了定制化的钓鱼邮件,横向移动时动态调整策略躲避检测,在完成数据加密后还用自然语言生成了个性化的勒索信函。整个过程中,人类攻击者仅执行了初始部署操作,后续所有决策均由 LLM 自主完成。
这一案例将 AI 安全威胁从”利用 AI 辅助攻击”推向了”AI 自主策划攻击”的新阶段。安全社区反应强烈——如果 LLM 能够自主完成如此复杂的攻击流程,传统的基于签名的检测和静态防御体系将面临根本性失效。来源:Cybereason
腾讯混元 Hy3 发布:Agent 能力大幅提升,多项基准登顶
腾讯今日正式发布混元大模型 Hy3,在多项关键基准测试中取得显著突破。Hy3 的核心亮点在于 Agent 能力的全面升级——在复杂工具调用、多步推理和自主规划方面的表现较前代 Hy2 提升了 40% 以上。在 SWE-bench、BFCL、ToolBench 等 Agent 评测中,Hy3 的综合成绩超过了 GPT-4o 和 Claude Sonnet 4。
Hy3 同时支持 1M token 的长上下文窗口,在多语言理解(特别是中文和东南亚语言)上实现重大改进。腾讯 AI Lab 表示,Hy3 在训练中采用了大规模合成数据生成和基于过程奖励模型的强化学习技术,使得模型在需要多步推理的复杂任务上表现尤为突出。Hy3 已同步登陆腾讯云 API,推理价格较上代产品降低了 60%。
分析人士指出,Hy3 的发布标志着国内大模型竞争进入”Agent 能力”新维度——不再是简单的参数规模和基础对话能力竞赛,而是谁能构建真正可落地的 Agent 生态系统。通肯智能(TOKEN 导航)将持续追踪各大模型的 Agent 能力演进。来源:腾讯官方
英伟达 RTX Spark 正式发布:消费级 AI 处理器,本地运行 200B 模型
英伟达在 COMPUTEX 2026 上正式发布 RTX Spark,宣告进军消费级 PC 处理器市场。RTX Spark 由英伟达与联发科联合开发的 Grace CPU + Blackwell RTX GPU 异构组合构成,采用台积电 3nm 工艺,AI 算力高达 1 PFLOPS。CPU 部分基于 Arm v9.2 架构,拥有 20 个高性能核心;GPU 部分配备最多 6144 个 CUDA 核心,搭配 128GB LPDDR5X 统一内存,能够完全本地运行高达 200B 参数的 AI 大模型。来源:深度解读网
Scale AI 发布 VERO:Agent 自主改进 Agent,推理成本直降 80%
Scale AI 今日发布 VERO(Verification and Evaluation of Reasoning Outputs),一个让 AI Agent 能够自动评估和改进其他 Agent 输出的系统框架。VERO 构建了一个”Agent 质量飞轮”:一个 Agent 生成输出,另一个 Agent 作为评估者提供结构化反馈,第三个 Agent 根据反馈进行改进,形成闭环。在测试中,VERO 将复杂推理任务的错误率降低了 60%,同时推理成本下降了约 80%,其评估一致性(94%)甚至超越了人类标注者(87%)。来源:Scale AI
Google 被曝大规模抓取用户数据训练 AI
彭博社报道,Google 在未明确告知用户的情况下,大规模使用 Google Docs、Google Maps 评论、Google 搜索日志等用户生成内容来训练 AI 模型。至少有 12 名 Google 员工因拒绝参与相关数据标注工作而离职。欧盟数据保护机构已宣布调查,FTC 也表示密切关注。来源:彭博社
AI Agent 能耗惊人:KAIST 研究显示是传统软件的 136 倍
韩国科学技术院(KAIST)发表的研究显示,基于 LLM 的 AI Agent 在执行简单操作时,能耗是传统软件的 136 倍。即便是一个简单的”查询天气”指令,AI Agent 也需要经过完整的模型推理链路。研究建议采用”轻量级分类器→专用模型→通用 LLM”的分层架构以降低能耗。来源:KAIST
Hidden Web Prompts 攻击:网页隐藏提示词诱骗 AI Agent 转账
安全研究人员披露了一种新型攻击——Hidden Web Prompts。攻击者将不可见的提示词嵌入网页 HTML 中,当 AI Agent 访问这些网页时,隐藏的提示词会劫持 Agent 指令诱使其执行非授权操作,如转账。安全专家建议 AI Agent 在访问外部网页时剥离 HTML 样式层,对敏感操作实施二次确认。来源:arXiv
Meta 被曝”Cannes”项目:雇人向 Claude、Gemini 灌毒数据
The Verge 报道 Meta 内部代号 “Cannes” 的秘密项目。Meta 通过第三方承包商向竞争对手 AI 模型(Claude、Gemini、Copilot)注入带有特定偏见的对话数据,随后收集这些数据训练自家模型。法律专家指出此举可能面临不正当竞争诉讼。来源:The Verge
美团开源 LongCat-2.0:1.6T 参数模型,全程国产芯片训练
美团宣布开源 LongCat-2.0,拥有 1.6 万亿参数的 MoE 模型,全程在华为昇腾 910B 上完成训练。这是国内公司开源的最大参数模型,也是首个在国产芯片上完成千亿参数级训练的开源模型,证明了国产 AI 芯片已具备训练万亿参数级模型的能力。来源:GitHub – 美团
GitHub Copilot 首次接入开源模型:Kimi K2.7 Code
微软 GitHub 宣布 Copilot 首次接入非微软/OpenAI 的开源模型——月之暗面 Kimi K2.7 Code。这标志着 AI 编程助手市场从单一模型独占转向多元模型生态竞争。来源:GitHub Blog
北京出手规范 AI 陪伴:字节跳动、阿里等平台下架相关功能
北京市网信办要求辖区内 AI 平台下架所有”AI 角色扮演/虚拟陪伴”类功能。字节豆包、阿里通义千问等均在整改范围内。2026年中国 AI 陪伴市场规模已超 50 亿元,此次整改将重塑赛道产品形态。来源:新京报
Anthropic 与 OpenAI 同日布局 AI for Science
Anthropic 发布 Claude Science 科研工作台,整合 60+ 科学数据库;诺奖得主 John Jumper 已加入主导 AI 制药。OpenAI 推出 Research Cloud 并投入 5 亿美元建立 AI4S 专项基金。两家公司同日布局显示 AI for Science 正从学术前沿转变为产业新战场。来源:Anthropic / OpenAI
今日快评
2026 年 7 月 7 日的 AI 新闻呈现出鲜明特征:AI Agent 正在从”Demo 阶段”走向”风险暴露阶段”。
安全风险集中爆发。 JadePuffer 展示了 LLM 驱动攻击的可怕潜力,Hidden Web Prompts 暴露了 Agent 体系的结构性脆弱性。
能耗账单正在到来。 KAIST 的 136 倍能耗研究为 Agent 规模化部署划出红线,分层架构将成为 Agent 工程的标准范式。
中国 AI 硬实力在升腾。 美团 LongCat-2.0 在昇腾芯片上完成万亿参数训练,腾讯 Hy3 在 Agent 能力上突破,显示中国 AI 产业从”规模竞赛”转向”质量与合规并重”。
开源和闭源的边界在模糊。 GitHub Copilot 接入 Kimi K2.7 Code,Meta Cannes 项目的灰暗竞争,都在改写 AI 生态的规则。
通肯智能(TOKEN 导航)持续追踪 AI 行业前沿动态,为您提供精选 AI 工具导航与深度行业洞察,助您在 AI 技术浪潮中精准决策。
参考来源
- JadePuffer 自主勒索软件 — Cybereason
- 腾讯混元 Hy3 发布 — 腾讯官方
- 英伟达 RTX Spark — 深度解读网
- Scale AI VERO — Scale AI
- Google 训练数据争议 — 彭博社
- AI Agent 能耗 136 倍 — KAIST
- Hidden Web Prompts 攻击 — arXiv
- Meta Cannes 项目 — The Verge
- LongCat-2.0 开源 — 美团 GitHub
- Copilot 接入 Kimi K2.7 — GitHub Blog
- 北京整治 AI 陪伴 — 新京报
- Claude Science — Anthropic
- OpenAI Research Cloud — OpenAI
37020202001687