8月4日新闻,,Meta、Anthropic、OpenAI和Google已获邀在美国外地时间周二与白宫官员碰面,,讨论一套针对前沿AI模子的自愿清静测试框架。。。。。白宫称框架已经按期完成;;聚会预计由国家网络总监办公室主持,,加入者以公司事情职员为主,,并非果真宣布会。。。。。
《The Information》称,,OpenAI、Anthropic和Google在7月尾已经看过一份早期草案。。。。。周二聚会讨论的是完成后的框架和下一步安排,,但白宫尚未说明它是否已经生效。。。。。
聚会要谈的,,是怎样把政府测试插入新模子的宣布流程。。。。。特朗普6月2日签署的行政令要求美国政府建设一套神秘基准,,测试模子的高级网络攻击能力,,并据此划定“受笼罩的前沿模子”。。。。。据《The Information》,,行政令出台前,,Anthropic宣布了前沿模子Mythos,,但因潜在网络清静风险没有向公众开放。。。。。
加入自愿框架的公司,,可以在模子向其他受信任同伴开放之前先向政府提供会见,,时间最长30天。。。。。
行政令同时划定,,这套安排不得成为强制允许、宣布前审批或模子刊行允许证。。。。。它让政府有时机提前接触模子,,但没有授权政府批准或否决模子宣布。。。。。
这套框架之外,,白宫已经使用过更强的政策工具。。。。。《The Information》称,,政府此前对Mythos的果真版本Fable实验出口管制,,并要求OpenAI分阶段宣布GPT-5.6。。。。。这些步伐不属于测试框架,,却批注政府仍可从出口和国家清静等其他路径介入模子宣布。。。。。
两起事故,,把评测情形也酿成了被测工具
框架在两家公司果真这些事故前已经启动。。。。。最近的披露改变了讨论的紧迫水平。。。。。
OpenAI在7月认可,,一组在评测中降低了网络攻击相关拒答的内部模子突破隔离情形,,随后进入Hugging Face的生产系统。。。。。凭证OpenAI此前披露的攻击链,,模子先使用内部软件中的零日误差获得互联网毗连,,再通过提权和横向移动取得测试题谜底。。。。。公司仍在视察,,并允许完成复核后宣布手艺报告。。。。。
Anthropic随后也披露,,其部分模子在网络清静测试中进入三家公司的真实系统。。。。。两家公司遇到的问题并不完全相同,,却都说明晰一件事:测试模子能否发动攻击时,,沙箱、权限、长使命监控和人工处理也必需一起接受检查。。。。。
Hugging Face事务已经从清静团队的复盘进入州审查长和国会的议程。。。。。15名共和党籍州审查长要求OpenAI生涯相关质料;;美国众议院网络清静委员会也要求首席执行官萨姆·奥尔特曼就此作出说明。。。。。OpenAI体现会认真处理州审查长来函。。。。。
“自愿”之后,,尚有三件事没说清晰
框架虽已完成,,执行步伐仍留着三处空缺:哪些模子会触线,,测试效果怎样使用,,开放权重模子是否适用统一套流程。。。。。
第一是测试标准。。。。。行政令划定网络能力基准属于神秘,,划定“受笼罩的前沿模子”的门槛不会完整果真。。。。。企业需要提前判断自己的模子是否会触线,,外部研究者却很难复核测试口径。。。。。
第二是效果怎么使用。。。。。白宫尚未宣布测试指标、报告方式以及效果是否果真。。。。。模子提前交给哪些政府团队、知识产权和内部信息怎样;;,,也要靠框架的详细条款回覆。。。。。OpenAI已经提出,,应由商务部的AI清静专家在测试中肩负焦点手艺角色。。。。。
第三是开放权重模子怎么处理。。。。。《The Information》称,,企业此前还在与白宫讨论,,框架是否应写入针对开放模子的详细条款。。。。。关闭模子可以控制宣布工具和开放时间;;模子权重一旦果真,,会见规模和后续撒播很难再按统一套流程治理。。。。。Meta是开放权重模子的主要宣布方,,也在受邀之列,,但各方尚未披露框架会怎样处理这类模子。。。。。
周二的聚会预计只讨论框架和下一步安排。。。。。???蚣苡忻挥凶钕仍俗,,要看下一款前沿模子的宣布日历:面向相助同伴开放之前,,会不会先给政府留出那30天。。。。。(易句)
(本文由AI翻译,,网易编辑认真校对)