

一向以激进研发著称的 OpenAI 主动放缓了未发布的下一代大模型 Astra 的研发速度。历经内部评估,Astra 在网络安全方面的能力过强,写代码、找漏洞、自动规划攻击步骤等技能组合起来,可能接近一个点满黑客技能树的「数值怪」。官方直言无法排除其具有关键网络攻击能力的风险。

为防患于未然,OpenAI 全方位放大对 Astra 的测试和安全防护。给它安排了完全隔离的测试环境,对所有 Agentic 应用展开全局无死角的通用监控。这表明 OpenAI 对 Astra 的安全问题极为重视,力求将其控制在安全范围内。

友商 Anthropic 在 AI 安全问题上反复横跳。曾承诺若 AI 能力超越人类控制就暂停训练,今年 2 月却撤掉该条款,理由是担心其他友商继续部署会让世界更不安全。但 6 月又发布具有网络攻击能力模型的安全阉割版,并呼吁全球暂停 AI 开发。相比之下,OpenAI 此次主动放缓研发显得更为谨慎。

目前美国政府正在建立针对 AI 模型发布前的评估框架,但诸多问题尚无定论,如企业与政府的日常对接方式、审查流程耗时、谁能拥有和审查模型等。这使得 AI 企业在发展过程中面临不确定性,也影响着 OpenAI 对 Astra 的后续安排。
编辑观点:OpenAI 放缓 Astra 研发体现了对安全的重视,在政府监管不明和友商态度不一的情况下,如何平衡安全与发展是其面临的挑战,也为整个 AI 行业发展带来思考。


被折叠的 条评论
为什么被折叠?



