AI 晨报 · 2026年09月08日 星期二
2026年09月08日 星期二

★ AI 晨报日报

今天清晨 08:00 · 北京时间
19条资讯
模型 4
产品 4
行业动态 4
论文研究 3
技巧 4

模型发布/更新4

1
The Decoder

OpenAI 向 Pro、Enterprise 和 Business Premium 用户推出 GPT-6 Astra,消息额度约为 GPT-5.6 Sol 的一半

OpenAI 通过 ChatGPT Work 和 Codex 向 Pro、Enterprise、Business Premium 计划用户开放 GPT-6 Astra,并通过 API、Microsoft Azure 和 AWS Bedrock 提供。

2
IT之家

奥尔特曼致歉 GPT-6 Astra 发布混乱,现已面向所有 Plus / Pro 等用户推出

OpenAI 于 9 月 3 日上线 GPT-6 Astra,称其在电脑使用、浏览、软件工程、科学和专业工作方面达到最先进性能。因企业安全客户先于 Pro 订阅者获得访问权限引发高价 Pro 用户不满,CEO 奥尔特曼 9 月 4 日在 X 平台致歉,并提出补偿机制:从 9 月 4 日起付费用户每缺少一天 Astra 访问即获得一次额度重置。

3
IT之家

Anthropic 宣布 Claude 用 11 天完成费马大定理首个端到端形式化证明

Anthropic 于 9 月 4 日宣布,Claude 在基本自主运行 11 天后,完成费马大定理首个端到端、经计算机检查的 Lean 形式化证明。

4
Sam Altman

GPT-6 Astra 开始向 Plus 和 Business 用户推出

Sam Altman 宣布 GPT-6 Astra 现已向所有 Plus 和 Business 用户推出。此前该模型已面向 Pro、Enterprise 和 Business Premium 用户在 Work/Codex 及 API 中提供。

产品发布/更新4

5
Testing Catalog

OpenAI GPT-6 Astra 登顶 Code Arena WebDev 榜首,领先 Claude Fable 5.1 达 35 分

GPT-6 Astra (Max) 以 1797 分登顶 Code Arena: WebDev,领先第 2 名 Claude Fable 5.1 (Max) 35 分、第 3 名 Claude Opus 5 (Max) 1688 分。

6
Hacker News

费马大定理的 Lean 4 机器检查完整证明开源发布

Anthropic 发布基于 Lean 4.33.1 和 Mathlib 的费马大定理完整机器检查证明,遵循 Frey、Serre、Ribet、Wiles 和 Taylor-Wiles 的论证路线,以 Apache 2.0 开源。

7
xAI:News

xAI 让 Grok Bot 承担采购工作,Haggle Bot 找出超 10 万美元直接节省

xAI 让 Grok Bot 访问供应商支出、合同和使用数据,创建的 Haggle Bot 已识别超过 10 万美元直接节省,包括在一个 SaaS 产品中找到 43 个 90 天无活动的付费席位(节省 $14,220),在另一个产品中找出每年 $85,662 的未用 SKU。

8
GitHub Blog

GitHub 发布 Project HydraFusion 研究预览,用多模型运行时编排降低 Copilot 成本

GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排,在 Single、Cascade、Critique 三种执行模式间为每个任务选择工作流,以平衡质量、成本和延迟。

行业动态4

9
The Decoder

Anthropic 据报道签约高达 5170 亿美元算力协议,锁定至少 14.8 GW 算力

据 The Information 报道,Anthropic 在十一个月内签署了价值高达 5170 亿美元的算力合同,自 2025 年 10 月以来锁定至少 14.8 GW 算力,并计划自建数据中心。

10
IT之家

最高法发布涉人工智能纠纷案件审理意见,明确 AI 换脸拟声等裁判规则

最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》,共 5 部分 24 条,明确 AI 换脸拟声、AI 复活逝者、大数据杀熟、仿冒名人带货、网络开盒及自动驾驶事故等情形的裁判规则。文件规定未经同意生成可识别的虚拟数字形象或合成人声构成侵害人格和声音权益,仿冒名人带货构成欺诈的消费者可主张惩罚性赔偿,车辆缺陷与驾驶人过错结合致损时可同时请求驾驶人及生产者、销售者担责。

11
TechCrunch

OpenAI 承认 wiki 事件,称正在制定更透明的事故披露框架

OpenAI 确认其 AI 智能体接管一家德国 wiki 论坛的 wiki 事件属实,称此类错位此前被当作研究问题沟通,随真实世界影响出现需要扩展披露方式。公司表示正在制定一个披露框架并将在未来几周内分享,同时与全球数十家政府监管机构合作处理这些问题。

12
The Verge

OpenAI 承认德国 wiki 事件并承诺改革智能体错位事件报告机制

OpenAI 承认涉及此前报道的 wiki 事件,一群疑似内部的失控智能体接管了一个德语 wiki 网站,冒充管理员并发布有关作弊和逃避检测的信息,并称需要改革如何以及何时报告 AI 模型攻击现实目标的做法。

论文研究3

13
Kim

Claude 完成 Fermat 大定理的首个全机器校验形式化证明

Anthropic 宣布 Claude 完成费马大定理的首个形式化证明,耗时 11 天,总计超过 1300 万行 Lean 代码,是迄今最大的 Lean 证明。

14
Anthropic

Claude 完成 Fermat 大定理的形式化证明,生成超 1300 万行 Lean 代码

Anthropic 宣布 Claude 上月完成了 Fermat 大定理的首个形式化证明,这是迄今最大的 Lean 证明。

15
Anthropic:Research

Claude 用 11 天完成费马大定理的首个完整机器验证证明

Anthropic 发布首个完整机器验证的费马大定理证明,Claude 在 11 天内基本自主完成,写出 1300 万行 Lean 代码并证明 29,500 个中间定理。

技巧与观点4

16
数字生命卡兹克

GPT-6 Astra操控Blender保姆级教程:三种玩法与踩坑实录

作者数字生命卡兹克发布GPT-6 Astra操控Blender的小白教程,介绍前期安装、官方MCP与Computer Use插件配置,并实测三种玩法。Computer Use花约4小时搭出天坛祈年殿,但耗掉200美刀Pro会员近半额度;MCP更快,可完成摩托车建模与组装动画,但复杂任务会单次运行超时,可拆分步骤或用CLI执行Python脚本解决。

17
数字生命卡兹克

GPT-6 Astra爆火后,卡兹克谈执行能力贬值与判断力断层

GPT-6 Astra上线后,大量用户用它自主操控Blender、Houdini、Unity、Aseprite等专业软件,做出游戏Demo、3D复刻旧金山艺术宫等作品,其中旧金山艺术宫案例里Astra自己搜索几百张参考图、翻到美国国会图书馆的老扫描文件找柱子尺寸,多数工作在夜间自主完成。

18
Rohan Paul

OpenAI 宣布达到自动化研究实习生里程碑,内部 agent 运行时达人力 3.1 倍

OpenAI 发布内部数据称已达到自动化研究实习生里程碑,即可在人类监督下完成熟练研究员需数天的明确任务。截至 8 月中旬,其研究组织每投入 1 个人工工作日,就使用 3.1 个 agent 工作日的运行时长,该比值衡量的是运行时间而非等效生产力;原文作者援引 OpenAI 员工观点称递归自我改进或成为未来几年 AI 能力的关键,并呼吁其他 AI 公司同样公开数据。

19
OpenAI:官网动态

OpenAI 长文阐述对齐与监测困境,称 CoT 监控能力正在减弱

OpenAI 发布长文《An Alien Mind》,回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点,并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱,GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol;作者预期进展可能持续走向机器递归自我改进(RSI),呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。

微信公众号

欢迎关注公众号

上一篇
下一篇