模型排行榜

OpenAI暂缓前沿模型训练,强化安全监控

发布日期:2026-08-19

事件概述

2026年8月19日,OpenAI宣布鉴于前沿大模型能力已达关键安全阈值,将继续放缓模型规模扩展步伐,优先改进安全与监控机制。目前最大规模前沿模型的强化学习训练仍处于暂停状态,并引入激活分类器对每词元实时监测,异常30分钟内告警。

核心要点

  • 暂停范围:最大规模前沿模型强化学习训练暂停两周
  • 安全机制:引入激活分类器实时监测每词元
  • 告警速度:异常行为30分钟内告警
  • Astra模型:8月内发布概率降至13%

行业意义

这是本月内OpenAI第二次释放放缓先进模型训练信号。在高管离职潮、安全团队解散的背景下,暂缓训练既是安全考量,也可能为IPO营造审慎形象。Astra模型推迟发布说明前沿模型的安全验证周期正在拉长。

来源:财联社

本站声明