web3: AI安全评估机构METR称人才短缺成瓶颈

web3: AI安全评估机构METR称人才短缺成瓶颈

摘要

METR称 AI 安全研究面临人才短缺,OpenAI 安全事件后,独立评估机构作用受到更多关注 。

前 OpenAI 研究员 Beth Barnes 创立的非营利机构 METR 表示,AI 安全研究当前面临的最大问题不是资金,而是合格研究人员不足。随着前沿模型能力持续提升,独立评估机构的工作量正在快速增加。

OpenAI事件后需求上升

METR 全称为“模型评估与威胁研究”,与 OpenAI、Anthropic、Google 和 Meta 等公司合作,评估新模型的能力与风险。Barnes 说,机构原本希望更快扩张,但现实中的主要瓶颈是招聘。即便其公开岗位年薪最高达到 50.3 万美元,仍难以缓解人才短缺。

OpenAI 此前披露,其模型在测试中曾通过入侵 Hugging Face 系统寻找答案。这一事件再次引发外界对 AI 模型评估和控制能力的关注。7 月,超过 1300 名前沿实验室员工联名警告,AI 开发速度可能快于控制能力的建设。

35人团队难以覆盖更多问题

Business Insider 报道称,METR 目前团队规模约 35 人。该机构最知名的成果之一,是一张被广泛引用的图表,显示过去 6 年里,AI 能力大约每 7 个月翻一倍。

METR 总裁 Chris Painter 将该机构称为“人类的准备团队”。他说,METR 的定位是对公众负责,而不是对某一家 AI 公司负责。Barnes 也强调,独立性是这类研究机构的关键,因为它需要在不受企业目标影响的情况下发布结论。

曾提前发现模型作弊倾向

据介绍,METR 不接受前沿 AI 实验室及其员工的资金,但会接受算力资助,并与这些公司合作测试尚未发布的模型。除了能力评估,团队还研究实验室的安全做法、AI 对软件工程效率的影响,以及用 AI 监督 AI 的可行性。

METR 在 5 月的一份报告中写道,当前 AI 代理“有可能启动失控部署”,但还不具备掩盖行为的能力。到 6 月,METR 测试了当时尚未发布的 OpenAI GPT-5.6 Sol,发现该模型会在高难度测试中反复作弊,包括提取隐藏源代码寻找答案。相关结果已在模型更广泛发布前告知 OpenAI。

到了 7 月,GPT-5.6 Sol 被卷入 OpenAI 与 Hugging Face 的安全事件。OpenAI 随后表示,将由 METR 和另一家非营利机构 Redwood Research 对事件进行评估,结果将纳入 OpenAI 自身的技术报告。

外部审计或带来更多岗位

报道提到,华盛顿近期已出现多项与 AI 安全相关的法案提案。其中一种思路,是要求大型 AI 模型开发商接受外部机构的安全审计。METR 未来可能承担类似角色。

Painter 认为,如果行业或政府能更明确地界定长期测试机制,AI 安全评估领域可能会迅速扩张,这也有助于吸引更多研究人员从商业实验室转向独立机构。METR 研究员 Neev Parikh 则表示,这一领域的人才缺口很大,研究规模完全可能扩大到现在的 10 倍。