就在上周,黄仁勋在高盛科技大会上提到,网络安全很可能成为AI的下一个重要应用。这几天,OpenAI正式推出了一年前承诺的“自动化AI研究实习生”,显示出其在AI领域的持续领先。令人惊讶的是,一支不到十人的中国团队成功将自己训练的27B模型引入了CyberGym,这一平台汇聚了众多行业巨头如OpenAI、Anthropic和DeepSeek,同时进行高难度的AI漏洞复现测试。这支团队的公司名为万衍(Vera Praxis),其研发的网络安全模型Feyospace在CyberGym的模型能力测试中取得了63%的成功率,距离Claude Sonnet 4.6的65.2%也仅有一步之遥。
过去,这类榜单的前列基本由OpenAI和Anthropic这样的巨头独占,但如今,万衍凭借针对安全场景的专门训练,成功突入这一竞争激烈的领域。更值得关注的是,他们的目标并不仅限于完成测试,而是希望将真实的业务需求转化为AI的持续进步引擎。通过进行安全、量化、音频及应用开发等多个业务领域,他们计划不断挑战模型的限制,推动AI在实际工作中不断学习和适应,从而实现双向的发展。
万衍希望通过这种飞轮效应,让业务增长与模型能力的提升相互促进。至2026年9月13日,Feyospace-v1在CyberGym榜单的漏洞复现成功率达到了63.0%,显示出这支少于十人的团队在高难度智能领域的突破。 龙8头号玩家