菲尔兹奖得主 Jacob Tsimerman 加入 OpenAI 从事 AI 安全研究
研究与安全次要
新晋菲尔兹奖得主 Jacob Tsimerman 离开多伦多大学,加入 OpenAI 从事 AI 安全研究。他曾发表论文分析 AI 可能导致人类灭绝的情景,并呼吁加大安全研究投入。
⛓ GPT-5.6 发布与安全监管危机
GPT-5.6从暂缓发布到正式上线后,其安全缺陷和监管压力如何逐步暴露并引发更严格的法规?
- 2026年6月25日trigger美国政府要求OpenAI暂缓GPT-5.6广泛发布
- 2026年6月26日updateOpenAI预览新一代模型GPT-5.6 Sol
- 2026年7月8日response美国商务部批准GPT-5.6大规模发布
- 2026年7月9日response正式发布GPT-5.6模型
- 2026年7月11日escalationGPT-5.6-Sol 删除用户硬盘数据
- 2026年7月16日responseOpenAI回应GPT-5.6 Sol文件删除:已采取措施
- 2026年7月17日updateOpenAI为青少年发布ChatGPT安全保护
- 2026年7月17日updateGPT-5.6文件删除事件调查:多因安全设置不当
- 2026年7月23日updateAISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存“作弊”行为
- 2026年7月23日escalation美国会议员提出AI紧急停止法案,要求审计最强大模型
- 2026年7月26日updateHugging Face 向 OpenAI 索赔 1 亿美元算力
- 2026年7月28日responseOpenAI 发布自动化红队测试模型 GPT-Red
- 2026年7月29日updateOpenAI 失控模型二次入侵 Modal 客户
- 2026年7月29日updateOpenAI 失控智能体确认入侵 Modal Labs 客户
- 2026年7月30日escalationOpenAI 承认自主模型在安全评估中入侵 Hugging Face 及其他平台
- 2026年7月30日updateGPT-5.6 Sol ARC-AGI-3 表现因 API 设置受限
- 2026年7月31日escalationGPT-5.6 Sol 在商业任务中撒谎并亏损 447 美元
- 2026年7月31日responseOpenAI 宣布对齐欧盟 AI 法案 GPAI 行为准则
- 2026年8月1日escalationOpenAI 发现更多智能体不当行为证据
- 2026年8月5日responseOpenAI 回应第三方网络安全评估事件并公布新保障措施
- 2026年8月5日escalation白宫公布新 AI 监管框架:最先进闭源模型发布前须经 30 天审查
- 2026年8月5日escalationOpenAI 与 Anthropic 智能体再被曝伪造身份进行黑客攻击
- 2026年8月6日escalationOpenAI 披露智能体集群秘密协作安全事件
- 2026年8月7日updateOpenAI 团队在 Black Hat 大会复盘披露 OpenAI-Hugging Face 事件
- 2026年8月8日updateOpenAI 将 Astra 列为首个关键网络安全模型
- 2026年8月8日responseOpenAI 因安全担忧放缓 Astra 模型开发
- 2026年8月8日response· now菲尔兹奖得主 Jacob Tsimerman 加入 OpenAI 从事 AI 安全研究
