AI Daily
返回首页

· KrASIA

Z.ai称开源GLM-5.3在发现软件漏洞方面略胜Anthropic的Mythos 5

Z.ai称开源GLM-5.3在发现软件漏洞方面略胜Anthropic的Mythos 5

图片: Markus Spiske 来自 Unsplash

中国人工智能公司Z.ai发布基准测试结果,称其新的开源模型GLM-5.3在识别软件漏洞方面略微优于Anthropic受限的Mythos 5。该公司表示将把公开发布推迟约两周以开展额外的安全工作,并将把其最敏感的网络安全功能置于经过验证的用户计划之下。

中国人工智能公司Z.ai发布了GLM-5.3的基准测试数据,称这一新的旗舰模型在识别软件漏洞方面可以媲美甚至略微超越领先的美国系统,同时在长周期编程任务上缩小了与Anthropic的差距。该模型使用与前代GLM-5.2相同的基座,但在编程和网络安全评测中报告了更强的成绩。 在CyberGym这一测试模型能否检查源代码、定位漏洞并加以验证的基准上,Z.ai表示GLM-5.3得分为84.5%,略高于Anthropic的Mythos 5的83.8%和OpenAI的GPT-5.6 Sol的83.6%。这些数字由Z.ai自行公布,尚未经过独立验证。 当任务从发现漏洞转向将漏洞武器化时,情况则有所不同。Z.ai报告称,GLM-5.3在ExploitBench上得分为54.4%,而Mythos 5为78.0%。在限时测试中,GLM-5.3在两小时内完成了105项攻击开发任务,六小时内完成130项,远不及Mythos 5。Z.ai还表示,该模型在测试期间在包括Linux、WebKit和FreeBSD等主要开源代码库中发现了1,097个严重漏洞,并称漏洞利用链推理能力源自后训练而非有意设计。 基于上述能力,Z.ai表示将把公开发布推迟约两周,以进行进一步的安全检查并加强防护措施,最敏感的网络安全功能初期将仅限于在可信访问计划下选定的合作伙伴和经过验证的用户使用。Anthropic对Mythos采取了更为严格的路线,该模型是其Claude Fable 5模型移除网络安全防护后的版本,仅向经过审核的组织开放。 市场的反应不同于以往的发布。在GLM-5.3宣布当天,即8月14日,Z.ai在香港上市的股票收跌3.6%,这与今年夏初GLM-5.2受到的热烈欢迎形成对比,当时该股自1月上市以来到6月底已上涨超过2,000%。

来源与版权

原始来源: KrASIA

Z.ai称开源GLM-5.3在发现软件漏洞方面略胜Anthropic的Mythos 5 — AI Daily