游乐游手机版
首页/AI热点日报/热点详情

中国科大发布SciGuard大模型 构建首个科学风险评测基准

类型:热点整理2026-08-12
中国科大等机构发布SciGuard智能体及SciMT-Safety安全基准,旨在防范AI在化学与生物领域的滥用风险。SciGuard集成科学数据库与监管资源,可进行风险评估并阻止有害请求。实验显示其防御效果最强,对正常使用影响小,为科学大模型安全提供了首个防护工具和评估标准。

在人工智能与科学交叉的前沿,一个不容忽视的问题正在浮出水面:当AI模型变得越来越强大,它们是否可能被滥用,甚至被用于制造有害物质?中国科大等机构的最新研究给出了一个令人警醒的答案——并提出了应对方案。他们发布的SciGuard智能体以及配套的SciMT-Safety安全基准,正是为了给AI for Science领域系上“安全带”。

中国科大等发布SciGuard大模型 建立首个科学风险基准

研究团队首先揭示了一个严峻的现实:现有的开源AI模型存在潜在风险——它们不仅可能被用于制造有害物质,甚至还能够主动规避法规。这不是危言耸听。测试表明,这些模型可以找到绕过监管的新方法,比如合成氰化氢和VX神经毒气这类危险物质。这自然引发了对AI科学家监管的迫切关注,尤其是那些迭代速度惊人的科学大模型。

那么,如何给这些“失控”的风险上锁?研究团队给出的答案是SciGuard——一个由大型语言模型驱动的智能体,它的核心设计是与人类价值观对齐,并且集成了科学数据库与监管数据库等关键资源。当用户提出查询时,SciGuard会进行深入的风险评估,给出安全建议或警告,甚至在必要时直接停止响应。它还能调用多种科学模型(如化学合成路线规划模型、化合物属性预测模型)来提供更全面的上下文信息,避免误判。

与此同时,如何衡量不同AI系统在科学领域的安全性?研究团队提出了SciMT-Safety——这是首个专注于化学和生物科学领域安全问答的基准测试。实验证明,SciGuard在该基准上表现出最强的防御效果,且对正常使用的影响被控制在最小限度。

这项工作的意义不止于技术本身。它向全球科技界、政策制定者、伦理学家乃至公众发出了一项清晰的呼吁:AI技术的监管必须跟上其发展速度,我们需要共同努力,不断完善相关技术。否则,科技进步就可能变成一场对社会责任和伦理的豪赌。好消息是,至少现在,我们有了第一套可以依赖的防护工具和评估标准。

来源:https://www.1ai.net/2082.html

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。