OpenAI暂缓前沿模型训练,强化安全监控
发布日期:2026-08-19
事件概述
2026年8月19日,OpenAI宣布鉴于前沿大模型能力已达关键安全阈值,将继续放缓模型规模扩展步伐,优先改进安全与监控机制。目前最大规模前沿模型的强化学习训练仍处于暂停状态,并引入激活分类器对每词元实时监测,异常30分钟内告警。
核心要点
- 暂停范围:最大规模前沿模型强化学习训练暂停两周
- 安全机制:引入激活分类器实时监测每词元
- 告警速度:异常行为30分钟内告警
- Astra模型:8月内发布概率降至13%
行业意义
这是本月内OpenAI第二次释放放缓先进模型训练信号。在高管离职潮、安全团队解散的背景下,暂缓训练既是安全考量,也可能为IPO营造审慎形象。Astra模型推迟发布说明前沿模型的安全验证周期正在拉长。
来源:财联社