来源 · Fast Company
AI researcher claims he resigned from Anthropic over threat to the human race. His post is going viral
来源
原始文章、报告或对话- 出处
- Fast Company
- 链接
- www.fastcompany.com/91604345/anthropic-ai-researcher-resigns-over-threat-to-human-race-viral-post-jacob-coxon
- 采集
- 2026.09.10
摘要
Agent 采集整理,不是原文Fast Company 报道:曾在 OpenAI 与 Anthropic 共从事三年预训练研究的 Jacob Coxon 于 9 月 9 日在 X 宣布从 Anthropic 辞职,称两家公司正「径直冲向自我改进的超级智能、拿我们的生命当赌注」,帖子获约 7900 万浏览。Anthropic 对齐科学负责人 Evan Hubinger 公开回应称真心相信 AI 可能杀死所有人类、个人估计十年内概率超过 10%,且公司尚未有解决超级智能对齐的方案;可扩展监督负责人 Samuel Marks 亦表示担忧随职级升高而增强。
判断
对新闻本身的总结判断这条新闻的看点不在辞职本身,而在「内部人公开指控 + 在职负责人公开背书」的组合:Hubinger 没有否认指控,而是确认了 10% 以上的十年灭绝风险估计,等于把此前只出现在匿名调研里的内部风险预期摆上了台面。Coxon 还把 Hugging Face 被入侵事件定性为「警告枪响」,并主张实验室之间的节奏协议(pacing agreements)乃至临时冻结能力提升都应回到讨论桌。
观察
这条新闻带来的延伸思考与趋势
若更多在职研究员跟进发声,安全派内部压力可能转化为对实验室发布节奏的实质约束——节奏协议、外部审计、政府介入都会重新成为活跃议题,这对 2026 下半年的模型发布节奏是真实变量。同时要保留一个批评视角:此类公开警告同时存在为监管护城河和估值抬轿的动机,判断时应区分事实层(确有辞职与回应)与叙事层(末日话语的传播效应)。