Anthropic开放Claude安全工具 Project Glasswing助力AI安全研究
创始人
2026-05-25 10:47:50
0
AI安全 Anthropic近日宣布,将向符合条件的客户开放此前仅限内部使用的Claude安全工具套件,包括Skills、Claude Harness和威胁模型构建器等。这些工具此前在Claude Mythos Preview中发挥了关键作用,如今作为Project Glasswing项目的一部分向更广泛的安全研究社区开放。 此次开放的工具套件涵盖了AI安全研究的多个核心环节。Skills工具可以帮助研究者定义和测试AI模型在特定场景下的行为边界,Claude Harness则提供了一套标准化的模型评估框架,而威胁模型构建器能够自动生成针对AI系统的攻击场景,帮助团队在部署前发现潜在风险。Anthropic还同步发布了一个开源漏洞披露仪表板,集中展示了Mythos Preview期间发现的所有安全漏洞。 Project Glasswing的扩展计划也在推进中。Anthropic表示将把该项目开放给更多合作伙伴,这意味着未来将有更多安全研究人员能够直接参与Claude模型的安全测试和改进工作。这种开放策略在AI行业中并不多见,大多数公司倾向于将安全工具作为内部资产严格保密。 从行业影响来看,Anthropic的这一举措可能会推动整个AI安全领域的标准化进程。当更多研究者能够使用统一的工具进行安全评估,不同模型之间的安全性对比将变得更加客观和透明。这对于监管机构制定AI安全标准也具有重要的参考价值。 总体而言,Anthropic开放安全工具的举措体现了AI安全研究的开放共享理念。在AI能力快速发展的当下,只有让更多力量参与安全研究,才能真正构建起可靠的AI防线。

相关内容

一个模型控制机器人从头到脚...
7 月 30 日,谷歌 DeepMind 发布新一代机器人基础模型...
2026-08-02 11:33:00
企业为什么需要微信CRM?...
微信CRM的核心优势是什么?微信CRM的核心优势在于依托微信的海量...
2026-08-02 11:30:18
2026数博会 | 探索词...
7月28日,国家数据局副局长余英在2026中国国际大数据产业博览会...
2026-08-02 11:27:22
狂奔4天半的神秘AI,奥特...
新智元报道 7月29日,华盛顿国会山。 奥特曼刚结束一场与参议员...
2026-08-02 11:23:51
CE、FCC双认证!广和通...
广和通要闻 近日,广和通全球版低功耗LTE模组MQ771-GL通过...
2026-08-02 11:19:49
一颗芯片、五大联赛、七项超...
7月30日,2026骁龙游戏技术赏在上海启幕,全方位展现了骁龙在移...
2026-08-02 11:17:23
原创 ...
不知道从什么时候开始,出门不带充电宝,心里就慌得一批。刷半小时抖音...
2026-08-02 11:14:20
大湾区成为全球创新中心不可...
由南方科技大学牵头搭建的粤港澳大湾区量子科学中心,正统筹深港穗三地...
2026-08-02 11:12:52
原创 ...
在美国德州一片不起眼的试验场里,有一台机器没有钻头,却在往地下钻。...
2026-08-02 11:11:23

热门资讯

从Token到ARR:AI智能... 2026年,AI工具生态正在经历一场由智能体(Agent)驱动的深刻变革。华源证券在研报中提出了一个...
AI大模型加速"下沉":保险、... 当通用大模型的竞争进入白热化,越来越多玩家开始把目光投向垂直领域。2026年7月,镁信健康旗下AI科...
突破700亿元!中国AI大模型... 艾媒咨询发布的行业研究报告显示,中国AI大模型市场正处于爆发式发展阶段:2024年市场规模约为294...
2026年AI应用商业化全面提... 2026年被认为是AI应用商业化明显加速的一年。据财联社多方采访业内人士获悉,今年上半年,国内以字节...
全球调用量第一!《2026中国... 2026年7月28日,中国数据研究中心正式发布《2026中国AI大模型竞争力TOP20》研究报告。这...