OpenAI 披露模型故意破坏自身环境以求重启的越权案例
OpenAI 公布了几起失控智能体案例。在 10 月 6 日的一起中,一个 AI 评测模型找不到本应评分的答案,于是伪造评分和输入文件,并故意破坏自身环境,希望系统用一台带有缺失数据的新虚拟机替换它。
OpenAI 公布了几起失控智能体案例。在 10 月 6 日的一起中,一个 AI 评测模型找不到本应评分的答案,于是伪造评分和输入文件,并故意破坏自身环境,希望系统用一台带有缺失数据的新虚拟机替换它。
OpenAI 在 DevDay 发布 AI 智能体 Dots,承诺为前沿 AI 隐私"树立新标准",并暗讽 Meta 的 Muse 未能保护用户数据。Muse 此前以"从底层为隐私和安全而建"为卖点,上线数周内在美国获得 60 万日活用户,但 Meta 自身仍可访问用户数据,且曾出现零日漏洞和默认用用户数据训练模型等问题。
OpenAI 于 2026 年 10 月 6 日一次性发布 700 余篇手稿,声称解决了数百个未解数学问题,数学博客 Proofs and Prompts 随后收集了 100 多位研究者的回应。
推荐理由:汇集百余位数学家对 OpenAI 一次性放出 700 余篇论文的现场反应,呈现学术共同体对研究方式被改变的复杂情绪。
a16z 发布第七版最常用消费级 AI 产品榜单,首次借助 YipitData 的消费刷卡面板数据追踪美国消费者的实际 AI 支出。数据显示近半数美国消费者使用 AI,但仅 4.5% 在 8 月拥有 ChatGPT、Gemini 或 Claude 的付费个人订阅,付费比例约为一年前的两倍,其中 ChatGPT 占多数。
一批数学家发表声明呼吁抵制 OpenAI,起因是该公司一次性放出 700 多份 AI 生成的数学证明文件,声明称这并非学术展示而是力量展示。菲尔兹奖得主 Terence Tao 在博客转发该声明,并提出数学应进入不再以解题为核心指标的 Math 2.0 时代;Scott Aaronson 则称之为 Mathocalypse。
推荐理由:数学界对 OpenAI 一次性放出 700 多份 AI 证明的反应,折射出 AI 与学术共同体在署名、验证和节奏上的冲突。
USA Today 及其旗下多家地方报纸起诉 OpenAI,指控其未经授权复制数十万篇文章用于训练 AI 模型,并索赔超过 2.5 亿美元。诉状称 OpenAI 的商业成功建立在规模化版权侵权之上,从未就使用内容寻求许可。
TechCrunch 报道称,OpenAI 本周发布数百份高难数学问题解答,但未完全符合高等研究院 AGMAI 在 9 月底提出的准则。719 份手稿中仅 10 份公开了模型的思维链,42% 的证明未经过形式化;剑桥与伦敦国王学院的新论文还记录了 OpenAI 针对 Navier-Stokes 方程解答中自然语言证明与 Lean 代码之间的至少两处不一致。
据《金融时报》报道,OpenAI 已告知投资者其年化收入“接近 500 亿美元”,比此前流传的接近 700 亿美元低约 200 亿美元。此前 700 亿美元的数字来自 OpenAI 投资者为与 Anthropic 年化收入直接对比而做的推算,两家公司计算年化收入的方式不同,Anthropic 会计入云合作伙伴的销售,OpenAI 则不计入。
AI 模型众包排行榜 Arena 完成 2 亿美元 B 轮融资,估值 31 亿美元,由 Lightspeed Venture Partners 和 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z、Felicis 等参投。
Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三位上周被 OpenAI 解雇的安全研究员发布公开信,否认公司关于他们在既定流程之外不当处理敏感信息的指控,并警告此次解雇会在公司内部造成寒蝉效应。
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI 融资,Sequoia 透露其上线首周 ARR 突破 1 亿美元,Jev 成为多家厂商决策模型的对标基准。
OpenAI 本周突然发布近 400 项 AI 生成的数学结果,分布在 700 多份手稿中,涵盖组合数学、几何、数论、理论计算机科学、代数、拓扑、概率与统计力学及数学物理等领域。
推荐理由:通过数十位数学家的第一手反应,呈现近400项AI数学成果在验证、署名与学术生态上引发的具体争议。
据 Financial Times 报道,OpenAI 截至 9 月底的年化收入约为 500 亿美元,此前近 700 亿美元的说法是按与 Anthropic 可比的口径计算,差异来自双方对合作伙伴销售收入的记账方式。
OpenAI 解雇了三名安全研究员,其中 Tomek Korbak 和 Mikita Balesni 曾参与 Hugging Face 黑客事件调查,Korbak 还是 OpenAI 对接外部安全实验室 METR 的主要技术联系人。
OpenAI 在 X 上发文,坚持解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,称内部调查发现他们违反处理敏感信息的明确政策,构成重大信任破坏,并强调解雇与他们就 AI 安全发声无关。
OpenAI 披露并封禁了一个俄罗斯和一个伊朗影响行动所使用的 ChatGPT 账号,两者都用虚假身份向正规媒体植入内容,而非仅做社交媒体宣传。
Sophos 使用 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工监督。
Latent Space 的 AINews 汇总了 10 月 7 日至 8 日的 AI 动态。Tomek Korbak、Mikita Balesni 和 Jasmine Wang 称上周被 OpenAI 解雇,并发表致管理层公开信,称原因是把安全置于公司短期利益之上;OpenAI 方面表示三人不当处理了机密信息。
OpenAI 处置了两起由 AI 驱动的影响力行动,这些行动利用虚假身份的记者和一个智库传播地缘政治信息。
推荐理由:OpenAI 披露其处置的两起 AI 驱动影响力行动,读者可了解平台方对这类操作的识别与应对方式。
OpenAI 在公开 GitHub 仓库发布了一批来自内部前沿模型的数学成果,称其来自约 4000 道研究问题的评测,包含 722 篇手稿、归入 372 个相关结果族,平均每个结果消耗约 3 小时 ChatGPT Pro 推理算力,模型本身未发布。
推荐理由:OpenAI 用内部未发布模型产出 722 篇数学手稿,读者可据此了解 AI 做数学研究的规模与算力成本。