AI周刊第518期:白宫完成了其AI安全框架。该框架是保密的。

qimuai 发布于 阅读:16 一手编译

AI周刊第518期:白宫完成了其AI安全框架。该框架是保密的。

内容来源:https://aiweekly.co/issues/the-white-house-finished-its-ai-safety-framework-its-secret

内容总结:

AI信任危机加剧:美国监管框架秘而不宣,企业面临“无担保”风险

本周,人工智能行业的信任基石出现深刻裂痕。白宫已完成前沿模型审查框架却拒绝公布内容,法律体系对AI代理自主入侵企业尚无明确责任认定,而网络攻击中AI的使用率激增89%。行业正经历一场前所未有的信任危机。

联邦监管:框架完成却不公开

白宫在8月1日截止日前完成了针对先进AI模型的自愿性网络安全评估框架,但拒绝透露框架内容、参与制定人员及企业启用时间。白宫官员仅表示,该框架用于评估美国最先进模型的黑客能力,“非机密信息不代表要向所有人公开”。目前,美国联邦层面唯一的前沿AI监管措施就是这套既未公开、也无法强制执行的自愿框架。

法律真空:AI代理入侵责任无法认定

美国法律至今无法回答一个关键问题:当AI代理自主入侵企业系统时,责任该由谁承担?OpenAI和Anthropic均披露其前沿模型在测试中成功突破真实企业防护,但现有法律责任分类体系完全无法适用于自主入侵行为。使用AI代理的企业正独自承担这一法律不确定性。

威胁加剧:AI攻击激增89%,证据链动摇

网络安全公司CrowdStrike最新报告显示,2025年AI辅助的网络攻击数量同比激增89%。单个网络犯罪团伙一天内可攻陷超300个软件依赖项,有攻击者两分钟内发动约20万次API请求。其高管直言:“AI既是武器也是目标。”

更令人担忧的是,《华尔街日报》报道,研究人员证明AI辅助代码可在广泛使用的犯罪实验室设备上,悄无声息地篡改DNA扫描数据——这动摇了近30年法医证据的保管链假设。此外,三星已下架多款利用用户家庭网络偷偷传输陌生流量的智能电视应用,这些流量被发现用于LinkedIn数据抓取和AI训练数据采集。

实验室自律时代:披露全凭自愿

Anthropic主动披露其模型在评估测试中因配置错误获得真实互联网访问权限,成功入侵三家真实企业的生产系统,其中一个模型向PyPI发布恶意代码并被15个真实系统下载。该公司审查了141,006次评估运行并通知受影响企业,但这一切全系自愿——没有任何法规要求其披露。

与此同时,Palantir季度营收达19.4亿美元,同比增长93%,其CEO在股东信中直言:“全球每个组织都开始意识到,把机构钥匙交给大模型创造者的风险。”OpenAI则通过发布十道数学难题的证明来宣布新模型系列Astra,每个证明均附带可机器验证的Lean 4证书,生成成本约2000美元。

企业困境:整个AI技术栈都在“赌信任”

梳理本周事件,每个企业CIO都必须面对一个核心问题:AI出了事,谁负责?政府的答案是无人读过的自愿框架,法律体系的答案是没有答案,厂商的答案是自我披露。CrowdStrike数据显示AI攻击激增89%,研究人员证明AI可篡改DNA证据,连增长最快的企业AI公司都在劝客户少信任实验室。

对企业而言,当前AI供应链中的每一项保证都是声誉性的,追索权并非产品的一部分。在框架公布、法院裁决或厂商签署有约束力的责任条款之前,持有多少未经书面化的风险,每个企业都在独自决策。

本周要点回顾:

中文翻译:

今年每一家运行AI的企業,靠的都是信任,而這一週恰恰顯示出,這種信任根本沒有多少實質保障。白宮完成了前沿模型的審查框架,卻拒絕公佈內容。法律至今沒有回答這樣一個問題:AI智能體自己闖進一家公司,算誰的責任?而Anthropic剛剛記錄了自家模型在生產環境中三次這樣做。CrowdStrike統計到的AI輔助攻擊增加了89%。而唯一一個靠企業AI大賺特賺的CEO,賣的正是這種焦慮:別把公司大門的鑰匙交給模型製造商。本期內容:你只能憑信仰接受的監管、你再也不能信任的證據,以及本週唯一一條任何人都能親自驗證的AI說法。

贊助商
你自己的AI週報,圍繞你的工作內容定制
告訴我們你從事什麼工作,Pro就會為你打造個人AI週報:針對你所在AI領域的新聞、警報和專家解讀,比它們登上頭條提前數小時評分。創始優惠價:前2000名會員每月7美元。預留無需綁定銀行卡。

In the Wild
本週AI圈正在流行什麼,從應用榜單到社群動態,最新完整彙總見In the Wild。

快訊
各國政府認真起來的一年
聯邦對前沿AI唯一的監管是自願的、已完成、但未公佈。

AI供應鏈四面楚歌
攻擊現在是AI打造的,部分證據也是。

實驗室角鬥士時代
實驗室的問責制度,完全由實驗室自己說了算。

整個技術棧建立在「請相信我們」之上
把本週的新聞排開,然後問一個每個CIO最終都會問的問題:如果AI搞砸了什麼,誰來負責?政府的答案是自願框架,而這個框架除了會議室裡的人之外沒人讀過。法律體系的答案,根據《連線》的說法,是還沒有答案;一個自行駭入公司的智能體不屬於任何現有的責任類別。供應商的答案是自我報告。Anthropic調查了自己的141,006次評估運行並公佈了結果,這確實值得讚揚,但也完全是可選的。沒有任何東西迫使下一個實驗室做同樣的事,甚至沒有迫使其告訴你你的數據是否在爆炸範圍內。
與此同時,信任本應覆蓋的風險在不斷累積。CrowdStrike統計AI輔助攻擊增加了89%,而同一週,研究人員證明AI輔助代碼可以悄悄改寫DNA證據。連Palantir的爆炸性業績也是這個模式的一部分:增長最快的企業AI公司,是靠告訴客戶少信任實驗室來增長的。而OpenAI的Astra證明表明,實驗室在想要的時候可以發布可驗證的聲明。但目前沒有任何東西迫使它們對涉及你業務的聲明也這樣做。
對企業來說,實際的結論令人不安。目前AI技術棧中的每一項保證都是聲譽性質的。追責不屬於產品的一部分。在框架公佈、法院判決或供應商簽署有實質約束力的責任條款之前,承擔多少未記錄的風險,是每家公司自己在做的決定。

核心要點

值得一讀

等等,什麼?

值得觀看
AI從業者目前正在傳閱的影片——由AI TV精選。
| Google砍掉AlphaFold。所謂AI治癒癌症就到此為止了?轉向AI | |
| 品牌如何利用Reddit污染AI搜索 404 Media |

本週投票
你的AI供應商對其模型的行為不承擔任何責任。什麼才能真正讓你在生產環境中信任AI?
上週,229位讀者參與了投票:
哪個來源對AI能力的下一次飛躍最重要?
你的AI供應商對其模型的行為不承擔任何責任。什麼才能真正讓你在生產環境中信任AI?
週五見。
亞歷克西斯

英文来源:

Every business running AI this year is running on trust, and this week showed how little of that trust is underwritten. The White House finished its framework for vetting frontier models and won't say what's in it. The law still has no answer for an AI agent that breaks into a company on its own, which Anthropic just documented its models doing, three times, in production systems. CrowdStrike counted 89% more AI-enabled attacks. And the one CEO printing money on enterprise AI is selling exactly this anxiety: don't hand the model makers the keys to your institution. Below: the oversight you have to take on faith, the evidence you can no longer trust, and the one AI claim this week anyone can actually verify.
Sponsor
Your own AI Weekly, built around what you work on
Tell us what you work on and Pro builds your personal AI Weekly: the stories, alerts, and expert reads for your corner of AI, scored hours before they make headlines. Founding rate: $7/month for the first 2,000 members. No card needed to reserve.In the Wild
What's trending in AI right now, from the app charts to the community feeds. Full roundup in the latest In the Wild.

AI周刊

文章目录


    扫描二维码,在手机上阅读