核心信息
萨姆·奥特曼转发了一则警告:不应让混乱的报道引发“走向不可监控”的竞赛。当前前沿模型(包括 Astra)的计算图深度约为 GPT-4 的两倍以内;OpenAI 自早期推理模型起就重视并运用思维链监控,但同时承认该技术较为脆弱。
要点
- 前沿模型的计算图深度并未远超 GPT-4,仅在约两倍以内。
- OpenAI 从最早的推理模型开始就使用思维链监控,希望借此观察对齐能力如何从训练分布中泛化。
- 奥特曼强调该技术存在脆弱性,并呼吁避免因误导性报道而推动AI进入不可监控状态。
萨姆·奥特曼转发了一则警告:不应让混乱的报道引发“走向不可监控”的竞赛。当前前沿模型(包括 Astra)的计算图深度约为 GPT-4 的两倍以内;OpenAI 自早期推理模型起就重视并运用思维链监控,但同时承认该技术较为脆弱。