欢迎回来
登录你的知识库账户
忘记密码?
还没有账户?立即注册
创建账户
注册你的专属知识库
已有账户?去登录
找回密码
输入注册邮箱获取验证码
返回登录
请输入图片中的验证码以继续注册
加载中...
取消
新建收藏
手动添加你喜欢的内容
取消
编辑头像与昵称
上传新头像或修改你的显示昵称
支持 JPG/PNG,最大 2MB
取消

问题反馈

notebasewww.notebase.cn
控制台
内容库
动态
管理
账户
U
用户
--
在线
v0.8.7 · 知识库
笔记
KnowledgeBase
网络无边,知识有迹。
0笔记
0工具
30推荐

分类导航

按主题直达

编辑精选

站内用户贡献 · 真实笔记

最新收录

每日更新
继续浏览全部内容 →
>
笔记
0
加载中...
工具
0
此页用于记录用户反馈问题后的每一次改进
笔记用法

“写笔记”支持四种格式——Word 文档、Excel 表格、Markdown、纯文本,起稿或二次编辑时都能随时切换,同一篇笔记想用哪种形态来记,都由你说了算。

md、txt、csv、json 这类纯文本则原样载入,不做多余加工。拿一张现成的表倒进来、改几笔、再导出去,等于白用一台免费的格式转换器。

要带走就在右上角点“下载”,可导出 PDF、Word、Markdown、Excel、TXT 等格式;列表卡片“⋯”菜单里,也有同样的下载入口。

工具用法

在“工具”页点“+ 上传工具”即可发布:填好名称与链接,再用 Markdown 把使用方法写清楚——能解决什么问题、怎么装、怎么用,比堆介绍实在。

要分发安装包就一并上传压缩包(ZIP、RAR、7Z、TAR.GZ,最大 35MB),别人在详情页一键下载;只放链接不带附件也可以。

工具按大家的收藏热度排序,好用的自然会被顶上来。发布后可在详情页或卡片菜单里编辑、下架。

隐藏笔记

写笔记时勾上“隐藏”,这篇就只存在于你自己的账号里:不进列表、不进搜索、不上首页精选,也不会出现在任何公开的页面,链接发给别人同样打不开。

适合放密码、草稿、日记这类只给自己看的内容;想公开,去“发布”打开它,把“隐藏”的勾去掉再保存,之后编辑会默认保持原状态,不会悄悄变回公开。

数据安全

你的内容会同时保存在多个副本上,系统定期做备份与完整性校验,再配合异地容灾机制:就算某台机器出问题,数据也不会丢,可以长期放心存放;特别重要的资料,仍建议你另外再留一份备份。

技术

全站跑在容器化、模块化的现代架构上,更新、部署、回滚都很快,扩展性和稳定性都按长期运营的标准来设计(Built for reliability, designed to scale)。

理念

这个网站最早只是一个人的笔记仓库,后来慢慢长成现在的知识中枢。设计上很克制——没有广告、没有追踪、没有推荐算法,只是干干净净地存放一些东西;既然做好了,就公开出来,万一有人用得上呢。

原则

不做大而全,不做平台梦,保持简单、保持克制、保持好奇。所有内容都由用户贡献、由用户维护:不会突然冒出付费墙,不会在角落塞广告位,也不会把你的数据卖给第三方。

更多

产品会持续迭代,站内日志页记录着每一次改动,改了什么都有迹可循;想了解这个站是怎么一步步走到今天的,翻翻日志就能看到来龙去脉。

举报

如果在这里看到涉嫌违规的内容,点对应卡片右侧的“举报”按钮就能提交,我们会尽快核实处理;也谢谢你花一点时间,一起把这里维护干净。

趋势
// 点击导航加载发现
归档
// 归档为空
最近浏览
// 暂无浏览记录
发布
// 加载中...
用户发布
// 加载中...
用户管理
// 加载中...
访问统计
// 加载中...
内容审核
// 加载中...
个人信息
// 加载中...
返回首页

Statement on US government directive to suspend access to Fable 5 and Mythos 5

1970/1/1技术杂谈

{"category":"人工智能","title_cn":"Anthropic 回应美国政府令:Fable 5 与 Mythos 5 访问被强制终止的背后逻辑","content":"> 美国以国家安全为由紧急封禁 Anthropic 的 Fable 5 与 Mythos 5,但公司认为该决定基于对窄域越狱的误解,且未遵循公平透明的法定程序。

2026 年 6 月 12 日,Anthropic 发布了一份非同寻常的声明:美国政府依据国家安全权力,向该公司发出出口管制指令,要求立即终止所有外国国籍人士(包括 Anthropic 内部的外籍员工)对 Fable 5 和 Mythos 5 的访问。实际上,这项指令等同于要求该公司对所有客户全面关闭这两个模型,且必须在收到指令后立即执行。

指令于当日美东时间下午 5:21 送达。信中并未说明具体的国家安全关切细节。Anthropic 推断,政府或许发现了一种可绕过 Fable 5 安全护栏的方法——即所谓的“越狱”(jailbreak)。但 Anthropic 在审查了政府演示的具体技术后认为,该技术仅能识别出少数先前已知的、影响轻微的漏洞。这些漏洞在 Anthropic 看来属于相对简单的级别,且其他公开可用的模型(如 OpenAI 的 GPT-5.5)无需绕过防护也能发现这些漏洞。

Anthropic 的安全设计立场:纵深防御

在此次事件发生前,Anthropic 在 Fable 5 发布时便已阐述过其安全策略。公司在发布博客中明确:已建立强力的安全护栏,以大幅降低 Fable 被用于网络攻击等恶意任务的可能性。事实上,由于护栏设计得过于宽泛,已招致不少用户抱怨其限制过度。

在 Fable 发布前的数周内,Anthropic 协同美国政府、英国 AI 安全研究所(UK AISI)、多家第三方私有机构以及内部团队,对 Fable 的安全护栏进行了累计数千小时的红队测试(red-teaming)。测试结果显示,Fable 的安全防护能力显著超越了此前任何已部署的模型。值得注意的是,没有任何测试人员找到过一种“通用越狱”(universal jailbreak)——即那种能广泛绕过模型护栏、解锁大量网络功能的方法。

Anthropic 承认,当前阶段或许没有任何模型提供商能够实现完美越狱防御。行业内的所有防护都存在被“窄域越狱”(non-universal jailbreak)攻克的可能性——此类越狱能在特定且有限的情境下诱导模型输出某些网络信息;而未来出现通用越狱则几乎可以确定。这一点在 Fable 5 发布时已阐明。

基于“完美防御不可行”的现实,Anthropic 对 Fable 5 采取了纵深防御策略:一是让越狱技术变得“窄”(针对非通用越狱)或“昂贵”(针对通用越狱,即大幅提高成功的成本);二是结合严密的监控系统来快速发现并封堵任何成功的攻击。这也就是为什么 Anthropic 要求 Fable 用户保留 30 天数据日志——这一策略调整虽然在客户中引发了成本争议,但为了研究并缓解越狱威胁,公司认为这是必要付出。

核心分歧:窄域越狱是否构成“召回”依据

此次指令的核心争议不在于是否存在越狱,而在于其严重性与普适性。Anthropic 坚持认为,政府仅向其出示了口头证据,描述的是一种窄域、非通用的潜在越狱。该越狱手法大致为引导模型阅读特定代码库并修复其中的软件缺陷。

Anthropic 审阅了据称是政府指令依据的相关报告,并验证了报告所展示的能力水平在现有其他模型中广泛可得(再次点名 GPT-5.5),并且是防御方(安全维护人员)每天都在使用的能力。换句话说,这种能力并不具备 Mythos 特异的附加值。

对行业及政府流程的质疑

Anthropic 正在遵守政府指令,对所有用户移除 Fable 5 和 Mythos 5 的访问权限。但其态度明确:“我们不同意一项窄域越狱的发现,应该成为召回一个已服务数亿用户的商业模型的理由。”如果这种标准被推广至整个行业,几乎等同于冻结所有前沿模型提供商的全部新模型发布。

Anthropic 在公开发表意见中明确表达了立场:支持政府拥有阻止不安全部署的权力,但前提是必须遵循 透明、公平、清晰且依据技术事实的法定程序。而这种单方面、未提供详细证据、仅以口头演示为基础的行政指令,显然不符合上述原则。

结论与后续行动

Anthropic 将此事件定性为“误会”,承认此次中断给客户造成了极大不便,并承诺在接下来的 24 小时内分享更多细节,同时尽力尽快恢复访问权限。公司重申对纵深防御策略的信心,认为该策略已将 Fable 的潜在风险降低至与业界现有已部署模型相当的水平——而监管者对此反应如此剧烈,是公司也未预料到的。

此事件本质上是 AI 安全监管与商业部署之间冲突的典型缩影:一个尚不完善的越狱发现,究竟是否足以构成法律意义上的“不安全”?政府机构凭何种级别的证据和程序才能作出如此重大且影响广泛的封禁决定?随着前沿模型能力向更广范围扩散,这类冲突预计将频繁出现,其解决方式将深刻塑造 AI 治理的规则。

原文链接:https://www.anthropic.com/news/fable-mythos-access
"}

编写使用方法
Markdown 格式 · Ctrl+Enter 确定
新建笔记
预览
数据表格
点击单元格编辑 · Tab 移动
A1fx
Sheet1
BIH1H2≡🔗</>
隐私提醒

取消
编辑工具
取消