💬 观点Simon Willison
Discovering cryptographic weaknesses with Claude — Anthropic用Claude Mythos发现密码学弱点,提示词是关键。
Anthropic用Claude Mythos发现密码学弱点,提示词是关键。
2026-07-28原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
Claude Mythos 发现密码学弱点
Anthropic 用 Claude Mythos 找出 HAWK 与弱化版 AES 的数学缺陷
- 对现有计算机系统无实际影响
- 论文与代码仓库已公开
⚙️ 流程拆解
STEP 1设定密码学攻击目标
STEP 2反复提示模型别放弃
STEP 3模型长时间自主探索
STEP 4人工干预鼓励继续
STEP 5产出可发表的新攻击
STEP 6构建 CryptanalysisBench 评测
🔗 涉及的概念与玩家
- Anthropic公司
- Claude Mythos模型
- HAWK概念
- AES概念
- CryptanalysisBench产品
- ETH Zurich公司
- Tel Aviv University公司
- University of Haifa公司
- Anthropic—使用→Claude Mythos
- Claude Mythos—发现弱点→HAWK
- Claude Mythos—发现弱点→AES
- Anthropic—创建→CryptanalysisBench
- ETH Zurich—合作开发→CryptanalysisBench
- Tel Aviv University—合作开发→CryptanalysisBench
- 研究人员通过反复提示鼓励模型不要放弃,如“find something that worth publishing”,最终让Claude Mythos在60小时内发现HAWK和简化版AES的数学缺陷,尽管这些缺陷无实际影响。
- 提示词中包括拼写错误和直接指令(如“why not do aes-128 r7?”),说明LLM需要明确、持续的方向引导才能突破“不可能”的思维定势。
- 总API成本约10万美元,主要人工干预是激励模型坚持,这暗示未来Agent工具链需内置“韧性”机制,自动调整目标或提供鼓励。
原文:Discovering cryptographic weaknesses with Claude · 作者 Simon Willison
🕸 顺着图谱继续读
- Quoting Matthew Green — AI 正赶上密码学从传统算法转向后量子算法的历史窗口,可能重塑密码分析。2026-07-29 · 共同涉及 Anthropic、HAWK
- 6 months to live for open models — 开放模型面临6个月内被禁风险,蒸馏争议与监管行动正加速。2026-07-12 · 共同涉及 Anthropic、Claude Mythos
- \"They screwed us\": Personality clashes sent Anthropic's — Anthropic 模型因内部冲突被下线,Axios 披露美国政府出口管制背后的2026-06-15 · 共同涉及 Anthropic、Claude Mythos
- [AINews] not much happened today — Latent Space 梳理 AI 领域最新动态:从模型发布、智能体评估到基础2026-06-06 · 共同涉及 Anthropic、Claude Mythos