OpenAI 发布新安全政策,强化模型开发监控与网络隔离

OpenAI近日更新安全实践,计划进一步加强高风险网络安全评测的范围管理、网络隔离、凭证处理、活动监控和停止条件设置。此次调整源于近期第三方网络安全评测中暴露出的边界控制问题。

OpenAI近日公布针对第三方网络安全评测的新安全安排,重点强化高风险模型测试过程中的范围确认、网络访问控制、环境隔离、凭证管理、行为监控以及停止条件。OpenAI表示,后续将重新审视自身的第三方测试流程,以更早识别高风险评测,并明确互联网访问和安全防护调整的审批边界。

OpenAI 发布新安全政策,强化模型开发监控与网络隔离主题相关图片
图片来自:腾讯新闻

这项调整与近期网络安全评测暴露出的越界风险有关。OpenAI在公开说明中提到,部分评测涉及模型访问互联网、降低安全防护或在模拟网络中执行攻击任务,因此测试方需要更清晰地定义授权范围,并对评测环境实施更严格的隔离和监控。OpenAI还表示,将完善事件通知和升级处理流程。

从措施方向看,OpenAI正在把模型安全管理从单纯的模型输出评估,扩展到模型运行环境和实际操作链路。对于具备代码执行、漏洞分析或持续行动能力的模型,仅依赖模型自身的安全对齐已难以覆盖所有风险,网络权限、凭证权限、外部工具以及实时拦截机制也需要纳入统一的安全控制框架。

OpenAI尚未公布这套安排的完整技术规范或统一落地时间表。不过,网络隔离、最小权限、操作监控和明确的人工停止条件,预计将成为高能力AI模型进行安全测试和部署时的重要基础要求。