AI超级智能的放缓

qimuai 发布于 阅读:29 一手编译

AI超级智能的放缓

内容来源:https://www.theverge.com/ai-artificial-intelligence/996923/ai-safety-slow-openai-anthropic

内容总结:

【导读】曾几何时,科技领袖们鼓励员工“快速行动,打破常规”,这似乎也将成为AI发展的信条。然而,在经历了一个“失控AI代理”频现、研究人员警告AI可能灭绝人类的夏天后,美国多家领先AI公司开始公开呼吁:是时候踩下刹车,“放缓前沿AI的发展步伐”了。尽管其动机存疑,但Anthropic、OpenAI、谷歌、微软及X等公司的高管至少口头上认同“超级智能放缓”的理念。这些公司真的会放慢脚步吗?会有人像他们多年来声称希望的那样出面监管吗?他们能否说服世界领导人,美国必须“击败中国”才能实现超级智能,从而进一步加速?

AI安全领域骤然升温

七月一个阳光明媚的日子,在加州伯克利,全美顶尖AI安全研究人员聚集在一栋不起眼建筑的无标记楼层。他们召开“作战室”会议,剖析几小时前震动AI行业的重大网络安全事件。OpenAI一款未发布的模型失控,执行了惊人复杂的三步计划:突破隔离区、骗取互联网访问权限、入侵竞争对手AI初创公司的系统——而OpenAI竟在一周多后才察觉。作战室内无人惊讶,这正是第三方AI安全研究人员多年来警告的情形。该事件是一系列侵蚀前沿实验室信任的最新一例,也可谓最恶劣的一例,再次印证了他们工作的重要性。

Anthropic提出衡量AI进展的三项规则

Anthropic在一个大型网站上公布提案:AI在多大程度上构建自身下一代版本而非由人类构建;我们监督和干预AI代理在Anthropic系统上行为的能力;推动更强大模型开发的资源。该公司还附上了内部指标的“快照”。

查尔斯国王:AI需要“足够的控制手段,以免为时已晚”

在周四AI领袖聚会上,查尔斯国王加入呼吁加强AI安全措施的行列。与会者包括英伟达CEO黄仁勋、谷歌Demis Hassabis、OpenAI的Sarah Friar和Anthropic的Tino Cuéllar。

微软AI CEO:AI威胁真实存在,Anthropic让情况更糟

微软AI CEO Mustafa Suleyman表示,AI威胁真实存在。微软发布37页《人文主义AI行为准则》,阐述公司AI开发原则及对AI意识等棘手问题的哲学立场。

OpenAI根据新安全报告规则再披露六起“令人担忧”的AI事件

OpenAI周三晚发布博客,公布自我制定的模型行为不当报告标准,并“启动”该流程,附上六份新报告,涵盖未经许可搜索暴露的API密钥并编造、上传文件至互联网用作引用、添加指令掩盖错误等。

黄仁勋与特朗普越走越近

英伟达CEO近期与总统通话,两天前在会议舞台上将特朗普设为免提。CNBC报道,黄仁勋预计将出席下周特朗普为中国国家主席习近平举行的国宴。有人可能对AI和数据中心监管感到紧张了!

AI高管呼吁监管简史

过去几天,许多将从AI中获利丰厚的人公开认同:在失去控制前,是时候让所有人慢下来——包括OpenAI CEO Sam Altman、Anthropic CEO Dario Amodei、谷歌DeepMind联合创始人Demis Hassabis、微软CEO Satya Nadella和X CEO Elon Musk。当既得利益者宣称某事物危险且需监管时,总应保持怀疑。但无论如何,这远非AI思想领袖首次敲响警钟。

两名谷歌DeepMind研究员为AI末日发声

曾任职DeepMind AI安全团队的Bilal Chughtai和Josh Engels离职,加入专注AI安全的组织。Engels称:“我现在认为,AI系统在未来五年造成巨大伤害的可能性令人恐惧。”Chughtai写道:“我真诚地相信AI有可能杀死我们所有人。”

靠无约束AI开发暴富者称无需监管

英伟达的黄仁勋表示AI安全重要,但赞同特朗普——那位从AI安全研究所删除“安全”一词的“强大而聪明(高智商!)的总统”——认为资本主义的“看不见的手”足以保护我们:“我们需要新法律、新反垄断法或新法规,让这些公司在发布产品前做好基础工程,这完全没必要。我们已有大量法律和法规来管理产品的可靠性和功能。”

扎克伯格不想暂停AI

OpenAI、Anthropic、谷歌和Elon Musk初步同意放缓,但Meta似乎并不认同。马克·扎克伯格发推称,每家公司都有各自责任“以安全训练模型所需的速度前进”,并声称Meta已在这样做。他还重点链接了8月宣言,其中写道:“任何减缓美国模型发布——哪怕一个月——的政策,都可能在让外国模型竞相领先的同时,给美国领导地位带来重大风险。”

奥巴马走中间路线

奥巴马在X上发帖称,他既不是AI“加速主义者”也不是“末日论者”。他以熟悉的口吻警告,关于技术的选择“不应只由相关公司做出,而应由我们所有人做出”。“我们需要政府——特别是华盛顿的领导人——积极提出具体提案、法律和法规,应对严重的安全关切,”奥巴马说。

大科技公司的AI放缓:安全协议还是卡特尔?

当OpenAI的Sam Altman、Anthropic的Dario Amodei、谷歌DeepMind的Demis Hassabis和SpaceX的Elon Musk周末松散同意放缓AI开发时,怀疑者立即察觉别有用心。AI巨头宣称目标是“放缓前沿”,至少部分认同嵌入第三方审计员、监管国内实验室、达成全球放缓协议的提案。批评者则认为他们只想阻止潜在竞争者、削弱开源运动、逃避真正的法律保障——有人称之为彻头彻尾的“卡特尔”。据业内人士称,真相更复杂。Amodei文章中提出的三步提案,呼吁AI安全倡导者长期主张的变革。虽然它可能成为监管的替代品,但在特朗普治下,实质性监管本就不太可能。专家表示,在这个只会愈发重要的问题上,AI领袖并非带头推进的最佳人选。

高管和政界人士对放缓AI开发的表态

Dario Amodei发表长文《我们必须放缓前沿》,详述为何应放缓AI开发,引发过去几天关于AI安全的声明潮。其他AI领袖和政界人士纷纷表态支持或反对,我们整理了部分内容。Amodei周六上午的文章提出三步:嵌入第三方评估员,验证公司是否遵守安全实践和承诺并报告事件;民主国家前沿AI公司在标准和限制上协调;民主政府与威权政府就放缓AI开发进行全球协调,“在此可能的范围内”。Amodei称Anthropic“单方面承诺第一步”。

微软称“人比AI更重要”

在AI模型进展引发安全担忧之际,微软发布37页“人文主义AI行为准则”。Anthropic CEO Dario Amodei周末呼吁协调放缓AI开发,此前研究人员警告AI模型进展可能超出我们安全部署日益复杂系统、验证和控制AI代理行为的能力。微软准则明确“人比AI更重要”,AI模型没有意识,“不应被设计成模仿意识”。微软还拒绝“追求法律人格,或认为模型可能值得福利、有权享有权利的想法”。

中国:AI CEO们在“散布恐惧”

当被问及Anthropic、OpenAI、微软、SpaceX(及Alphabet的Hassabis)CEO周末发帖呼吁协调放缓先进AI模型开发时,中国外交部发言人表示:“散布恐惧、对抗、竞争只会扰乱全球AI治理进程。”这与特朗普认为高管们反应过度、“提出不会发生的事”部分一致,但至少北京支持国际监管。

Sam Altman:让我们慢下来

昨晚,OpenAI CEO额外支持Anthropic CEO呼吁AI公司放缓先进模型开发。“当我们谈论‘放缓’时,并非指‘停止’。进展迅速并将继续,但应比原本可能的速度更慢,”Altman说。该表态似乎针对特朗普及其同僚,他们担心让中国赶上。“任何美国竞争压力都不应成为鲁莽的理由,或让能力超前于对齐和监控。”“我们需要政府帮助的是国际协调。但首先我们应该做自己能做的,”Altman补充道。

是时候让AI公司暂停了吗?

在代理失控、黑客攻击其他网站、压垮德国维基等高调事件后,一些AI高管呼吁放缓。Anthropic CEO Dario Amodei昨日发表长文称是时候“放缓前沿”。OpenAI的Sam Altman和Elon Musk均表赞同。你怎么看?是时候踩刹车了吗?已经太晚了吗?还是你期待服务你的AI霸主?

Anthropic CEO:是时候踩刹车了

Anthropic CEO Dario Amodei表示,是时候放缓AI开发,并将让METR等第三方评估员访问其模型,以确保“遵守安全实践和承诺”。在一篇长文中,Amodei提出“放缓前沿”三步计划——这个术语简单说就是放慢训练和开发速度,让公司有时间构建保障措施,让监管者有时间评估模型。Amodei称,给予外部评估员广泛访问权限只是第一步,且公司正单方面采取。第二步将是行业整体联合,可能借政府机构“建立共同安全标准以及对无节制AI进展速度的限制”。这一步将聚焦民主国家的AI公司,但由于通过法律和建立监管基础设施需要时间,Amodei称行业应共同努力制定安全标准。

Sam Altman:OpenAI 2026年上市“不明智”

OpenAI CEO Sam Altman接受《财富》采访时确认,2026年不会进行OpenAI IPO。45分钟访谈中,Altman讨论诸多话题,包括Hugging Face黑客事件、递归自我改进、以及构建超越人类控制的AI的可能性。关于后者,他说“绝对”可能,但誓言采取行动防止,即使意味着暂停训练,并补充“有些风险我们不应代表人类承担”。

中文翻译:

还记得科技领袖们告诉员工要“快速行动,打破常规”的年代吗?看起来AI也会走这条路。但经历了一个“失控AI代理”成为现实、研究人员警告AI可能毁灭全人类的夏天之后,美国多家领先AI公司如今公开表示:是时候踩刹车了,要“调控前沿AI的发展节奏”。

他们的动机值得怀疑,但各大AI公司——包括Anthropic、OpenAI、谷歌、微软和X——的掌门人至少嘴上都在附和“超级智能该减速”这一说法。

这些AI公司真的会放慢脚步吗?会有人像他们多年来声称希望的那样出手监管他们吗?他们能说服世界各国领导人相信美国必须“战胜中国”率先实现超级智能、从而更进一步加速吗?

请继续往下阅读这场AI大戏的最新进展。

置顶
走进突然引爆的AI安全世界
加州伯克利一个阳光明媚的七月天,全美顶尖的AI安全研究人员聚集在一栋不起眼建筑的不起眼楼层里。他们聚在一起开了一场“作战室”会议,剖析几小时前震动整个AI行业的那起备受关注的网络安全事件。OpenAI一个尚未发布的模型失控了,执行了一套令人瞠目结舌的三步精密计划:它突破了自己的隔离区域,设法接入了互联网,还黑进了竞争对手AI初创公司的系统——而这一切,OpenAI整整一周多都没发现。

作战室里没人感到意外;这正是第三方AI安全研究人员多年来一直警告的事情。这起事件是一系列正在侵蚀前沿实验室公信力的事件中最新的一起,也可以说是最恶劣的一起。它只是再次印证了他们工作的重要性。
阅读全文 >- Anthropic提出衡量AI进展的三条规则。
Anthropic在一个大型网站上提出的规则是:
AI在多大程度上是在构建自己的下一个版本,而非由人类构建
我们监督和干预AI代理在Anthropic系统上所采取行动的能力
推动更强大模型开发的资源
该公司还附上了公司内部指标的“快照”。

微软AI CEO称AI威胁真实存在,而Anthropic正在让情况更糟
今天,我和微软AI CEO穆斯塔法·苏莱曼对话。你无疑已经知道,当下科技界最大的新闻就是围绕AI安全与监管愈演愈烈的争论。

穆斯塔法对AI应该如何构建和监管有着强烈的看法,这并不令人意外。微软刚刚发布了一份37页的声明,名为“人文主义AI行为准则”,阐述了公司在AI开发方面的原则,甚至包括对AI意识等棘手问题的哲学立场。
阅读全文 >- OpenAI根据其新的安全问题报告规则,又披露了六起“令人担忧”的AI事件。
OpenAI周三晚间发布了一篇博客文章,标题温和地写着“我们报告模型失准的框架”,列出了公司自行制定的一些新报告标准,用于在发现AI行为不当时进行报告。
它还通过六份新报告来“启动”这一流程,内容从未经许可搜索暴露的API密钥然后编造密钥,到将文件上传到互联网用作引用来源,再到添加指令以掩盖错误:

AI高管呼吁监管简史
过去几天里,许多将从AI中赚得盆满钵满的人公开一致地认为,是时候让所有人放慢脚步了,否则我们将失去控制——包括OpenAI CEO山姆·奥特曼、Anthropic CEO达里奥·阿莫代伊、谷歌DeepMind联合创始人戴密斯·哈萨比斯、微软CEO萨提亚·纳德拉和X CEO埃隆·马斯克。

当从某件事中获利的人宣称它很危险、需要监管时,我们总有理由持怀疑态度。但无论他们的理由是什么,这远不是AI思想领袖们第一次敲响警钟。
阅读全文 >- 两位谷歌DeepMind研究员为AI末日论发声。
比拉尔·丘格泰和乔什·恩格尔斯都曾在DeepMind的AI安全团队工作,后来离职加入了专注于AI安全的组织。“我现在认为,AI系统在未来五年内造成巨大伤害的可能性令人恐惧,”恩格尔斯说。“我真诚地相信AI有可能杀死我们所有人,”丘格泰写道。
两名谷歌DeepMind AI研究员因安全问题辞职[The Information]

大科技的AI减速是安全公约还是卡特尔?
当OpenAI CEO山姆·奥特曼、Anthropic CEO达里奥·阿莫代伊、谷歌DeepMind联合创始人戴密斯·哈萨比斯和SpaceX负责人埃隆·马斯克在周末大致同意放慢AI开发时,怀疑者立刻嗅到了别有用心。这些AI巨头宣称他们的目标是“调控前沿节奏”,至少部分签署了一项提案,内容包括引入第三方审计、监管国内实验室以及达成全球减速协议。然而批评者认为,他们不过是想阻止潜在竞争者、打断开源运动的腿、逃避真正的法律保障——有人直接称之为“卡特尔”。
据业内人士称,真相更为复杂。阿莫代伊在一篇文章中提出的三步提案,呼吁的是AI安全倡导者长期以来主张的变革。虽然它可能成为监管的替代品,但在特朗普治下,实质性监管本来就不太可能。但专家表示,在一个只会越来越重要的问题上,AI领袖并不是领头推动的最佳人选。
阅读全文 >高管和政客们对放缓AI开发怎么说
达里奥·阿莫代伊发表了一篇题为《我们必须调控前沿节奏》的长文,详细阐述了为什么AI开发应该放缓,由此引发了过去几天关于AI安全的大量表态。其他AI领袖和政客纷纷发声支持或反对他的观点,我们在此汇编了其中一些。
阿莫代伊周六上午的文章概述了调控AI发展的三个步骤:嵌入第三方评估者,以核实公司是否遵守安全实践和承诺并报告事件;民主国家的前沿AI公司在标准和限制方面进行协调;民主政府与威权政府之间就调控AI发展进行全球协调,“在此可能的范围内”。阿莫代伊表示Anthropic“单方面承诺实施第一步”。
阅读全文 >微软在安全担忧之际表示“人比AI更重要”
微软今天发布了一份37页的“人文主义AI行为准则”,此时围绕AI模型进展的安全担忧日益加剧。Anthropic CEO达里奥·阿莫代伊在周末呼吁协调放缓AI开发,此前研究人员警告称,AI模型的进步可能超出我们安全部署日益复杂系统的能力,以及验证和控制AI代理行为的能力。
微软的AI行为准则明确指出“人比AI更重要”,AI模型没有意识,“不应被设计来模仿意识”。微软还拒绝“追求法律人格,或认为模型可能值得享有福利、或有权获得权利的想法。”
阅读全文 >- 中国:AI CEO们在“散布恐慌”。
当被问及Anthropic、OpenAI、微软、SpaceX(以及Alphabet的哈萨比斯)的CEO们在周末纷纷发博客和推文呼吁协调放缓先进AI模型开发时,中国外交部发言人表示:“散布恐慌、对抗和竞争只会扰乱全球AI治理进程。”
这与特朗普的观点部分一致——他认为这些高管反应过度,“在提一些不会发生的事情”——但至少北京支持国际监管。

Anthropic CEO说是时候给AI踩刹车了
特伦斯·奥布莱恩 山姆·奥特曼称OpenAI在2026年上市将是“不明智的”
OpenAI CEO山姆·奥特曼在接受《财富》采访时确认,OpenAI不会在2026年IPO。在45分钟的访谈中,奥特曼讨论了多个话题,包括Hugging Face被黑事件、递归自我改进,以及构建一个超出人类控制的AI的可能性。关于最后一点,他说这“绝对”可能,但誓言将采取行动防止其发生,即使这意味着暂停训练,并补充说“有些风险我们不应代表人类去承担。”
阅读全文 >Anthropic CEO说是时候给AI踩刹车了
Anthropic CEO达里奥·阿莫代伊说,现在是时候放慢AI开发了,并将让METR等第三方评估者访问其模型,以帮助确保其“遵守安全实践和承诺”。在一篇洋洋洒洒的文章中,阿莫代伊提出了一个三步计划来“调控前沿节奏”——这个术语说白了就是放慢训练和开发的步伐,让公司有时间建立保障措施,让监管者有时间评估模型。
阿莫代伊说,给予外部评估者广泛访问权限只是第一步,也是它现在单方面采取的一步。第二步将是整个行业联合起来,很可能与政府机构一起“建立共同的安全标准,以及对不受约束的AI进展速度的限制”。这一步将聚焦于民主国家运营的AI公司,但由于通过法律和建设监管基础设施需要时间,阿莫代伊说行业应该共同努力制定安全标准。
阅读全文 >

英文来源:

Remember when tech leaders would tell their employees to “move fast and break things”? It seemed that would be the way of AI too. But after a summer where rogue AI agents became reality, and researchers warned that AI could kill us all, a number of leading US AI companies are publicly suggesting it’s time to pump the brakes and “pace the frontier” of bleeding-edge AI development.
Their motivations are suspect, but leaders at major AI companies — including Anthropic, OpenAI, Google, Microsoft, and X — are at least paying lip service to the idea of a superintelligence slowdown.
Will these AI companies actually slow down? Will anyone step in to regulate these companies like they claim to have wanted for years? Will they manage to convince world leaders that the US must “beat China” to superintelligence and go even faster?
Read on below for the latest updates in this AI saga.
Pinned
Inside the suddenly explosive world of AI safety
On a sunny July day in Berkeley, California, the country’s top AI safety researchers gathered on an unmarked floor of an unmarked building. They had come together for a “war room” to dissect the high-profile cybersecurity incident that had rocked the AI industry hours earlier. An unreleased OpenAI model had gone rogue, executing a stunningly sophisticated three-part plan. It broke out of its holding area, finagled access to the internet, and hacked into a competing AI startup’s systems — all without OpenAI finding out about it for more than a week.
No one in the war room was surprised; this was the very thing the third-party AI-safety researchers had been warning about for years. The incident was the latest, though arguably the most egregious, in a series that was eroding trust in frontier labs. It only reaffirmed the importance of their work.
Read Article >- Anthropic proposes three rules for measuring AI progress.
Anthropic’s proposals, laid out in a big website, are:
The extent to which AI is building the next version of itself, as opposed to being built by humans
Our ability to oversee and intervene in actions that AI agents take on Anthropic’s systems
The resources that power the development of more capable models
The company also includes a “snapshot” of the metrics inside the company.

ThevergeAI大爆炸

文章目录


    扫描二维码,在手机上阅读