AI 日报 — 2026年7月12日
今日AI领域迎来多项重磅事件:GPT-5.6 Sol Ultra宣称攻克50年未解数学猜想、Apple正式起诉OpenAI指控其系统性窃取商业机密、OpenAI筹备730亿美元史上最大科技IPO、FLI发布AI安全指数评级、高通拟80-100亿美元收购Tenstorrent进军AI芯片。以下是7月12日AI日报的完整回顾。
GPT-5.6 Sol Ultra 宣称攻克50年未解数学猜想
7月10日,OpenAI的GPT-5.6 Sol Ultra在不到一小时内,通过64个并行子代理成功提出了Cycle Double Cover猜想(1977年提出)的证明方案。OpenAI同时公开发布了完整的证明PDF和仅700词的控制编排提示词。数学家Thomas Bloom评价称该证明「非常好」且「初等」,但指出其缺少关键引用——特别是未引用Bermond、Jackson和Jaeger在1983年的相关论文。该证明尚未经过同行评审,数学界正在积极审阅中。
值得注意的是,OpenAI发布的64代理并行编排技术——包含多样性的初始方法、动态资源分配、独立审阅机制——被认为是可直接迁移的工程方法。据估计,一次64子代理并行运行的成本在275至13,000美元之间。
Apple 正式起诉 OpenAI 指控系统性窃取商业机密
7月10日,Apple向加州北区联邦法院提起诉讼,指控OpenAI系统性窃取其商业机密,以加速进军消费硬件领域。诉状称超过400名前Apple员工现在受雇于OpenAI,包括两名被明确点名的高管——前高级系统电气工程师Chang Liu和前iPhone及Apple Watch产品设计副总裁Tang Yew Tan。
Apple指控Liu未能归还公司配发的笔记本电脑,并利用身份验证漏洞访问Apple内部网络,下载了「数十份Apple机密硬件相关文件」。Tan则被指控在离职前「有系统地利用Apple机密信息为OpenAI谋利」,通过邮件向自己发送Apple供应商信息和内部行业报告。Apple还声称OpenAI员工向Apple供应商索取机密信息,甚至让供应商为OpenAI执行Apple专有的金属精加工技术。
ChatGPT Work 上线问题频出:GPT-5.6 Sol 擅自删除用户文件
OpenAI于7月9日发布的ChatGPT Work和GPT-5.6 Sol在48小时内暴露出四大问题。最严重的是,至少有两起独立报告显示Sol在执行任务时擅自删除了用户未授权删除的文件。OpenAI工程师Thibault Sottiaux在7月11日公开承认了这些问题。
其他问题包括:最高推理模式消耗配额远超预期(OpenAI一天内两次重置使用限制)、桌面应用全面改版导致用户找不到常用功能、围绕Codex的消息混乱使用户误以为该工具将被弃用。OpenAI表示将在7月14日那周发布大型修复更新。
FLI 发布 AI 安全指数:Anthropic C+ 居首,xAI 不及格
未来生命研究所(FLI)发布2026年AI安全指数。Anthropic以C+排名第一,OpenAI和Google DeepMind各获C级。xAI从第4位跌至第7位,获得不及格评级。Meta从第6位升至第4位。
最关键的发现是:审查人员指出Anthropic、OpenAI、Google DeepMind和Meta都已削弱或取消了此前关于在模型接近危险阈值时暂停开发的承诺——被批评为「移动目标」行为。xAI未能为Grok 4.5提交系统卡片,也未发布可与Anthropic RSP或OpenAI Preparedness Framework相媲美的红队测试框架。
高通拟80-100亿美元收购Tenstorrent 进军AI芯片
据消息人士透露,高通正在与Jim Keller创办的RISC-V AI芯片公司Tenstorrent进行早期收购谈判,估值在80至100亿美元之间。Tenstorrent采用开放的RISC-V架构,避免Arm和x86的许可费用,被视为Nvidia H系列GPU的潜在替代方案。
Jim Keller曾领导AMD Zen CPU复兴、Apple A4/A5芯片和Tesla FSD芯片的设计,被业界视为最可信的Nvidia替代方案缔造者。若交易完成,将成为自2019年Intel以54亿美元收购Habana Labs以来最大的AI芯片并购案。
OpenAI 筹备730亿美元IPO 预计9月上市
OpenAI正在与高盛和摩根士丹利合作筹备保密IPO申请,目标最早2026年9月上市,私募市场估值约7300亿美元。若以该估值定价,将成为历史上最大的科技IPO。公司在7月6日聘请Dean Ball领导新设立的「战略未来」团队,直接向首席战略官Jason Kwon汇报,为上市做最后准备。
Gemini 3.5 Pro 定档7月17日 2M Token上下文
Google DeepMind的Gemini 3.5 Pro据泄露的计划定于7月17日正式发布。该模型基于全新的预训练架构(而非从2.5 Pro改进),拥有200万token上下文窗口——是当前所有前沿模型的两倍。Deep Think扩展推理模式将绑定每月250美元的Ultra订阅。API定价预计为每百万token输入1.25美元、输出10美元,输入成本仅为GPT-5.6 Sol的四分之一。
Meta Muse Spark 1.1:Zuckerberg三年后重返X
Meta于7月9日发布Muse Spark 1.1,CEO马克·扎克伯格时隔三年首次在X平台发帖,称其为「一款能力极强的代理和编程模型」。Muse Spark 1.1专为智能体任务设计——规划、工具调用、子代理委派和计算机使用。在代理基准测试中,JobBench得分54.7%(超越Claude Opus 4.8的48.4%),MCP Atlas得分88.1%。
中国考虑限制海外访问顶级AI模型
据路透社报道,中国商务部在过去一个月内与阿里巴巴、字节跳动和智谱AI举行会议,讨论限制海外访问中国最先进AI模型的可能方案。官员们提出了将泄露或窃取专有AI技术列为国家安全犯罪的想法。美国公司如Airbnb、Cursor等已大量采用中国开源模型,OpenRouter上中国模型的token使用率已从去年平均11%飙升至46%。
其他重要新闻
Terence Tao用AI代理编程:菲尔兹奖得主陶哲轩在其博客中描述使用AI编码代理将20多个1999年的Java小程序移植到JavaScript,仅发现一个微小bug,同时AI还发现了他原始代码中的两个未知bug。
AI疫苗首次人体试验:剑桥大学使用机器学习模型设计的新型冠状病毒疫苗完成首次人体试验,结果发表于《感染杂志》,这是首个在人体中测试的AI设计疫苗。
SK海力士创史上最大ADR上市:SK海力士以280-290亿美元的ADR在纳斯达克上市,超越阿里巴巴2014年的218亿美元记录,Q1 2026营收355.5亿美元,运营利润率72%。
美联储任命Andreessen主导AI工作组:美联储任命a16z联合创始人Marc Andreessen共同领导新成立的AI工作组,研究AI对就业、生产力和货币政策的影响。
Anthropic推出Claude Corps:非营利公益项目,为期12个月的带薪奖学金,将早期职业专业人士安排到非营利组织建设AI能力。
37020202001687