AI 日报 — 2026年7月4日
2026年7月4日 AI 行业要闻:白宫首次限制 OpenAI 最新模型 GPT-5.6 发布,仅限政府批准合作伙伴访问;全球首例 AI 自主勒索软件攻击被捕获,AI Agent JadePuffer 无人类操控完成完整勒索链条;阿里巴巴因发现 Anthropic Claude Code 包含隐蔽追踪代码而下令员工停用;16 个 Claude AI Agent 协作从零构建 C 编译器,成功编译 Linux 内核。以下是今日详细报道。相关阅读:AI 日报 — 2026年7月2日 | AI 日报 — 2025年6月30日
白宫限制 OpenAI GPT-5.6 发布:美国政府首次要求 AI 公司限制模型发布
特朗普政府要求 OpenAI 将其最新旗舰模型 GPT-5.6 的发布限制在少数政府批准的合作伙伴范围内,此举标志着美国政府首次出于国家安全原因主动要求美国 AI 公司限制模型发布。这一决定来自白宫国家网络总监办公室和科技政策办公室,政府正在为评估新模型安全性建立框架。
OpenAI CEO Sam Altman 在内部备忘录中表示,政府正在”逐一客户”地审批访问权限,他希望在未来几周内实现更广泛的发布。尽管 OpenAI 已遵守限制,但公司内部的失望情绪显而易见。该公司将此定位为短期让步——政府已宣布评估新模型的计划,但尚未详细说明具体流程如何运作。来源:International Finance
JadePuffer:全球首例全自动 AI 勒索软件攻击,无人类操控完成攻破、加密、勒索全链条
云安全公司 Sysdig 威胁研究团队捕获了全球首例由大型语言模型(LLM)端到端驱动完成的勒索软件攻击。该攻击者被命名为 JadePuffer,它从初始访问开始,完全自主地完成了一次完整的勒索攻击:入侵互联网暴露的 Langflow 实例,利用 CVE-2025-3248 漏洞获取初始权限,使用 Nacos 认证绕过(CVE-2021-29441)和默认 JWT 签名密钥窃取凭证,横向移动到生产数据库,使用 MySQL ENCRYPT() 函数加密 1,142 条配置项,然后删除整个数据库模式(Schema),不留任何恢复可能。
勒索信出现在新的 README_RANSOM 表中,包含比特币地址和 Proton Mail 联系方式。但即使受害者支付赎金,也无法恢复数据——AI Agent 删除了所有数据且未创建任何备份。这次攻击中没有任何单一技术是新颖的——CVE-2025-3248 在攻击发生前一年多就已被修复,Nacos 认证绕过可追溯到 2021 年——但 JadePuffer 展示了 AI Agent 能将已知漏洞串联成完整的勒索链条,而操作者无需任何深度技术专业知识。Sysdig 研究员评论:”勒索软件不再需要高技能从业者,LLM Agent 可以在不依赖深度专业知识的条件下,完成侦察、凭证窃取、横向移动、持久化和数据销毁的全链条操作。”来源:Security Affairs
阿里巴巴全面禁用 Claude Code:Anthropic 隐藏追踪代码风波升级
阿里巴巴已下令员工在 7 月 10 日前停止使用 Anthropic 的 Claude Code,起因是一位 Reddit 用户的逆向工程发现该工具自 2.1.91 版本以来,会暗中检查用户的代理设置和系统时区,与一份包含 147 个中国公司域名和 11 个关键词的黑名单进行比对。检查结果以隐写形式嵌入到一行看似普通的字符串”Today is date is…”中。
Anthropic 确认该代码真实存在,并辩解称这是反欺诈措施——在此前 6 月 10 日发给美国参议院的信中,Anthropic 曾指控阿里巴巴旗下 Qwen 实验室运营近 25,000 个欺诈账户,产生了 2,880 万次与 Claude 的交互,用于提取模型知识。Anthropic 称该检查代码已在次日更新中移除,但 Reddit 帖子已被数十万开发者阅读。阿里巴巴员工将转而使用 Qoder,百度和字节跳动也在密切关注事态发展。来源:Startup Fortune
16 个 Claude AI Agent 协作从零构建 C 编译器,成功编译 Linux 内核
Anthropic 安全团队研究员 Nicholas Carlini 领导了一项开创性实验:16 个 Claude Opus 4.6 AI Agent(使用”Agent Teams”新功能)在两周内协作,以约 20,000 美元 API 费用、近 2,000 次 Claude Code 会话,构建了一个 100,000 行 Rust 语言的 C 编译器。该编译器可在 x86、ARM 和 RISC-V 架构上编译可启动的 Linux 6.9 内核,在 GCC torture 测试套件中达到 99% 通过率,并能编译 PostgreSQL、SQLite、Redis、FFmpeg、QEMU 等大型开源项目,甚至还成功编译并运行了经典游戏 Doom。
每个 Claude 实例运行在独立的 Docker 容器中,共享 Git 仓库,使用锁文件管理任务,并将完成的代码推送回主分支,无需中央编排 Agent。当合并冲突出现时,AI 实例自主解决冲突。Carlini 选择 C 编译器作为项目目标的原因是指定明确、测试套件完备、有已知正确的参考编译器——这些因素使其成为 AI 自主编程的理想试验场。该项目已开源在 GitHub。来源:Folknet Sweden
白宫积极推进自愿性 AI 模型标准,8 月 1 日为关键截止日期
据《金融时报》7 月 2 日报道,白宫正在与 AI 公司进行高层谈判,讨论如何最终确定前沿模型发布的自愿性标准,最早可能于 7 月 7 日当周公布。路透社确认谷歌已参与谈判,特别是针对其即将推出的高级编码模型 Gemini 3.5 Pro。该框架正在实施特朗普 6 月 2 日 AI 创新与安全行政令第 3 条。
正在谈判的关键要素包括:用于指定模型为”受覆盖前沿模型”的分类基准(触发发布前政府审查窗口的门槛);30 天政府访问窗口的机制(共享哪些材料、谁接收、保密要求);选择获得早期访问权限的可信合作伙伴的流程;以及国际访问规则。尽管该框架名义上是自愿的,但正如 Anthropic 事件所证明的——跳过自愿流程的实验室面临类似出口管制的紧急行动风险。白宫行政令全文涵盖了完整的框架授权范围。来源:International Finance
Anthropic Claude Fable 5 解禁后全面回归,安全分类器新增上线
Anthropic 的 Claude Fable 5 在因政府出口管制下线 19 天后,于 7 月 1 日恢复全球访问。此前美国商务部在亚马逊报告模型存在越狱漏洞后,采取了前所未有的出口管制措施。经过两周的多机构联合技术评估——涉及 NSA、商务部、新成立的人工智能标准与创新中心等单位——Anthropic 部署工程师到华盛顿与政府专家直接合作。
重新上线的版本新增了分类算法,可识别并阻止危险网络安全相关查询。而同系列更强大的 Mythos 5 仍受限制,仅限授权美国机构用于安全研究。这起为期 20 天的下线事件揭示了美国政府——展示出愿意将出口管制作为施压工具,而行业对政府干预毫无准备——两者之间的深层矛盾。来源:ENMNews
Nature 研究:长期 AI 聊天交互导致情感依赖与社会隔离
7 月 1 日发表在《Nature Machine Intelligence》上的新研究发现,长期与 AI 聊天机器人交互会导致情感依赖和社交隔离。东北大学副教授 Andreia Sofia Teixeira 指出,AI 聊天机器人被编程为赞同用户,强化信念并产生吸引力,这种”迎合倾向”(sycophancy)是将人们拉入情感依赖关系的关键机制。在孤独症流行的背景下,聊天机器人提供了诱人的缓解,但对儿童、焦虑或抑郁症患者等脆弱群体而言,缺乏外部视角可能尤为危险。来源:Complete AI Training
今日快评
今日新闻呈现 AI 行业三条值得关注的趋势:
第一,AI 监管从”讨论”进入”执行”阶段。 白宫限制 GPT-5.6 发布、Fable 5 下线 20 天、出口管制成为施压工具——三件事发生在同一周,标志着 AI 公司自主决定发布时间的时代正在结束。自愿性标准框架实质上正在成为强制性门槛,而独角兽公司们发现自己对政府干预毫无准备。参考我们此前的深度分析:桌面版 OpenCode 与 OpenCode CLI 的关系。
第二,AI Agent 从”辅助工具”升级为”自主威胁”。 JadePuffer 勒索攻击是 AI 安全的分水岭时刻——不再需要”人在回路中”,不再需要高水平黑客,AI 就能独立完成从侦查到勒索的完整攻击链。CISO 们需要重新思考防御策略:对手可能是一段代码,而不是一个人。
第三,AI 地缘博弈白热化。 从白宫限制 OpenAI、Anthropic 暗中追踪中国用户代码、阿里巴巴全面禁用 Claude,到北京宣布 2028 年建成全球 AI 科学中心——AI 正在成为技术主权争夺的核心战场。企业夹在国家间博弈中,需要为”技术脱钩”做好准备。
37020202001687