mobile wallpaper 1mobile wallpaper 2mobile wallpaper 3
587 字
2 分钟
A Framework for Frontier AI and the Dawning of a New Age

Original English article#

The original post, wording, author attribution, article card, and cover are rendered directly from X rather than copied into this repository.

正在从本站缓存加载原始 X 内容…

Open the original article on X


中文导读#

Demis Hassabis 在文章中提出由美国发起 Frontier AI 标准机构。文章开头关于 AGI 时间和影响规模的内容属于作者预测,不应被当作已经发生的事实;更具体的部分是其治理制度提案。

框架希望按照动态能力阈值,而不是按照公司名称或模型是否开源,识别 Frontier-class 模型。建议测试范围包括网络安全、生物风险、欺骗、绕过安全护栏等高风险能力,并通过定期更新基准、隐藏评测与第三方审计降低模型针对固定测试刷分的可能。

作者提出初期可以让实验室在发布前自愿提交模型,待评估机制成熟后,再考虑把通过评估作为部署条件。行业出资能够提供专家和算力,但同时也引出监管俘获、利益冲突和监督者问责的问题。

用反馈图理解监管#

监管本身也由多个循环组成:实验室内部测试、标准机构独立评估、第三方审计、发布后事故反馈、基准更新,以及政府与公众的慢速治理。任何一个环节如果只依赖被监管者提供的数据,都可能失去现实锚点。

值得继续追问的问题包括:

  • 谁来监督标准机构本身?
  • 隐藏测试怎样保持独立且可审计?
  • 行业出资如何避免改变规则制定?
  • 开源、海外和工具增强模型如何纳入能力阈值?
  • “暂停或减缓开发”的触发条件由谁定义?

英文原文和封面版权归原作者及 X 页面所标示的权利方所有。本站通过服务器代理缓存公开的 X 数据和封面,再以同源卡片呈现原帖摘要;下方仅提供独立中文导读。封面副本仅用于本站展示,并保留原始来源说明。

分享

如果这篇文章对你有帮助,欢迎分享给更多人!

A Framework for Frontier AI and the Dawning of a New Age
https://x.com/demishassabis/status/2076957440109625718
作者
Demis Hassabis
发布于
2026-07-14
许可协议
Original source on X

部分信息可能已经过时

目录