更强模型与 AI 防御:谨慎推进的理由
OpenAI 首席科学家 Jakub Pachocki 提出,继续快速训练更智能模型的最强理由之一,是为了应对其他 AI 可能带来的风险,并构建相应的防御系统。
他认为,未来需要强大且对齐的 AI 来承担防御任务,包括:
- 保护关键基础设施;
- 实时防范失控或恶意代理;
- 发明全新的保护措施。
这类防御能力将成为 OpenAI 部署工作的重点之一。
不过,他同时强调,即便考虑到 AI 广泛进步带来的不确定性,以及构建防御系统的必要性,也不能把这些理由当作鲁莽推进的借口。一旦真正理解相关风险的严重性,“不惜一切代价向前冲”的想法就显得并不合理。
这段观点的核心张力在于:更强 AI 可能是防御未来 AI 风险所必需的工具,但开发和部署本身也必须受到审慎约束。
浏览(7)
