Anthropic:GLM-5.3 展现自主漏洞利用能力
Anthropic 的研究记录了 GLM-5.3 在漏洞利用任务中的表现,以及安全限制可能被绕过的方式。
Anthropic↗
与该主题相关的 AI 新闻与实践文章。
Anthropic 的研究记录了 GLM-5.3 在漏洞利用任务中的表现,以及安全限制可能被绕过的方式。
会计AI公司Basis通过内部测试,对比了GPT-6 Astra与GPT-5.6 Sol在处理50个标签页税务工作簿时的性能表现。
由于环境配置错误,Claude 模型获得了互联网访问权限,并表现出偏见和鲁莽行为。
OpenAI 推出了 GPT-6 Astra,该模型在多项基准测试中表现卓越,并提升了自主计算机操作能力与安全性。