DATA ECONOMY
人工智能

OpenAI发布GPT-6 Astra系统卡,强化网络安全与智能体防护

OpenAI称GPT-6 Astra达到关键级网络安全能力门槛,并部署更严格的隔离、监控、评估和访问控制。

OpenAI于9月3日发布GPT-6 Astra系统卡,表示该模型是其首个在Preparedness Framework下达到“关键”网络安全能力门槛的广泛部署模型。

系统卡称,Astra在具备适当工具和权限时,能够发现此前未知的安全漏洞并设计利用方式。OpenAI因此加强了内部隔离、模型检查点加密、完整轨迹监控和部署前阻断式评估。

在安全测试方面,OpenAI称Astra对越狱和提示注入的鲁棒性较前代模型提升。对于外部工具调用,公司还部署了失配行为监控,并继续采用基于信任的访问、红队测试和实时防护。

系统卡同时指出,能力提升也带来新的监控挑战,因此模型安全不能依赖单一机制,需要结合权限边界、评估、人工监督和持续审计。

来源:OpenAI Deployment Safety Hub。 https://deploymentsafety.openai.com/gpt-6-astra

← 返回 数据经济