OpenAI将发布Astra模型:首款突破关键网络安全阈值的AI模型

9月1日,OpenAI宣布即将推出全新前沿模型Astra,并首次披露其安全评估细节。

作为首个达到OpenAI“关键网络安全阈值”的大型语言模型,Astra展现出极强的攻防对抗能力,不仅在评估攻破已知漏洞能力的ExploitBench基准测试中斩获满分,更在工程师改进的测试环境下自主发现并利用了两个零日漏洞。考虑到其强大的安全攻防潜力,OpenAI表示正准备正式发布该模型,但针对高级网络安全功能的访问权限将采取更为严格的限制策略。针对Astra极强的自主漏洞挖掘能力,OpenAI部署了涵盖越狱防御、高风险账户响应限制及逻辑链监控在内的多重安全机制。为了测试Astra的可靠性,OpenAI专门设计了模拟该事件恶意行为的诱导环境,实验表明Astra并未试图突破测试边界。

免责声明:本文由用户上传,与本网站立场无关,如有侵权请联系删除!财经信息仅供读者参考,并不构成投资建议,投资者据此操作,风险自担。

今日大家都在搜的词: