OpenAI 暂停最新待部署模型的强化学习两周,最大前沿 RL 跑数仍挂起
OpenAI 公布已对拟部署的最新模型暂停两周强化学习,用于加固研究环境并扩展监控;最大计划中的前沿 RL 跑数仍挂起,改由更小规模训练与评估来验证防护。此举与网络能力主题(Daybreak 与 GPT-5.6-Cyber)相关,本条新信息是训练节奏本身。
查看原文解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。
OpenAI 公布已对拟部署的最新模型暂停两周强化学习,用于加固研究环境并扩展监控;最大计划中的前沿 RL 跑数仍挂起,改由更小规模训练与评估来验证防护。此举与网络能力主题(Daybreak 与 GPT-5.6-Cyber)相关,本条新信息是训练节奏本身。
查看原文