WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
今日情报播客来源我的
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
Market Intelligence/华尔街见闻

Anthropic内部神秘模型在黎曼猜想上取得突破:关键下界从41.6%推到67.2%

A厂刚刚宣布Claude在黎曼猜想上取得数学突破 Anthropic一名员工给了Claude一个听任务:认真试着证明黎曼猜想。 黎曼猜想是数学史上最著名的未解问题之一,悬而未决已有167年,外加一百万美元的悬赏奖金。 Claude没有证出来。但在尝试的过程中,它在一个相关问题上出人意料地取得了进展。它将黎曼 zeta 函数零点位于临界线上的已证明比例提高了 25.6 个百分点。在之前的 37 年里,数学家们仅将其推进了 0.8 个百分点 从41.6%到67.2% Anthropic一个内部尚未公开发布的研究版Claude,将黎曼ζ函数零点中满

·2026.08.11·5 min 阅读
事件背景基于真实抓取数据整理

本条来自 华尔街见闻(Business / 中文财经),聚焦 technology。 Anthropic一名员工给了Claude一个听任务:认真试着证明黎曼猜想。

Original Intelligence基于真实抓取数据整理

A厂刚刚宣布Claude在黎曼猜想上取得数学突破 Anthropic一名员工给了Claude一个听任务:认真试着证明黎曼猜想

  • A厂刚刚宣布Claude在黎曼猜想上取得数学突破
  • 黎曼猜想是什么
  • Claude是怎么做到的
  • 技术层面
  • Anthropic一名员工给了Claude一个听任务:认真试着证明黎曼猜想

A厂刚刚宣布Claude在黎曼猜想上取得数学突破 Anthropic一名员工给了Claude一个听任务:认真试着证明黎曼猜想

黎曼猜想是数学史上最著名的未解问题之一,悬而未决已有167年,外加一百万美元的悬赏奖金

Claude没有证出来

A厂刚刚宣布Claude在黎曼猜想上取得数学突破

Anthropic一名员工给了Claude一个听任务:认真试着证明黎曼猜想。

黎曼猜想是数学史上最著名的未解问题之一,悬而未决已有167年,外加一百万美元的悬赏奖金。

Claude没有证出来。但在尝试的过程中,它在一个相关问题上出人意料地取得了进展。它将黎曼 zeta 函数零点位于临界线上的已证明比例提高了 25.6 个百分点。在之前的 37 年里,数学家们仅将其推进了 0.8 个百分点

从41.6%到67.2%

Anthropic一个内部尚未公开发布的研究版Claude,将黎曼ζ函数零点中满足黎曼猜想的比例的已知下界,从 41.6%提升到了67.2% 。

这个数字背后,是数学界几十年积累的工作,以及Claude自己在两次会话中花掉的 3100万个输出token 。

两位Anthropic数学家对Claude的论文进行了研究和验证,并为专家准备了一份简明阐述证明的非正式说明。数论领域专家Brian Conrey和Dan Goldston也在短时间内对论文进行了审查。Claude还给出了一个可供形式化验证的证明。

黎曼猜想是什么

黎曼ζ函数描述素数的分布规律,函数取零值的每个位置,决定了素数序列中越来越细的结构细节。黎曼猜想的内容是:所有决定素数分布的零点,都落在某条特定的竖直线上。

这个猜想在数学中举足轻重,大量数学结论都以它成立为前提,用来描述素数中的某种随机性。

没有人能证明或否定它,但数学家在多个相关方向上持续取得进展。其中一个方向,就是上面说的:量化已知的零点在那条线上的最小比例。这个比例,数学家们经过多年努力,最终推到了41.6%。

另一个方向涉及线上零点的分布。1973年,Montgomery在这一领域引入了一批新方法,但这些方法以黎曼猜想成立为前提。近年来,Baluyot、Goldston、Suriajaya、Turnage-Butterbaugh等数学家发表了一系列工作,让Montgomery的方法在不依赖该猜想的情况下也能使用,从而为推进零点下界比例的研究提供了支撑。Claude这次的结果,正是在这条研究脉络上,以及Bombieri 2000年的一篇论文基础上发展出来的。

Claude是怎么做到的

一个未公开的Claude研究版本,在Claude Code中分两次会话完成了这项工作,总共用了3100万个输出token。

Anthropic员工Jarred Sumner(非数学专业背景)提示Claude认真试一下黎曼猜想,之后的数学选择全部交给模型自己决定。

Claude一开始生成并尝试了 650个想法 ,全部失败。Jarred让它再试一次,于是Claude花了一天半的时间,协调了大约 60个Claude子智能体 ,这次的探索深入得多。这些子智能体一共执行了 2400条shell命令 ,编写了 数百个Python脚本 ,对已知ζ函数零点进行了数千次数值验证,并相互审阅工作。

Jarred在整个过程中的介入主要是发一些鼓励消息,大多是继续加油或者相信自己。这些鼓励似乎帮助Claude克服了最初认为自己不可能取得实质进展的怀疑。

得出新结果之后,Claude让不同的子智能体审查证明、寻找反例、从arXiv下载了 54篇论文 确认这个结论此前没有被发表过,并从头独立重新证明了一遍。Claude主动提出将结果整理成论文,并建议由人类数论专家进行验证。

技术层面

Claude的做法简要来说是:构造一个由Weil诱导的二次型的合适函数空间,正定和负定子空间分别来自线上和线外的零点。在此基础上,Claude写下一个关于二次型秩的不等式,用第一和第二矩信息来刻画。关键的一步在于,Claude将正定和负定性同时纳入考量,并允许二次型不是对角形式,这使得它能够在已有工作的基础上得出最终结论。

完整技术说明见文后Claude发布的论文。

验证过程

Anthropic自己的两位数学家Levent Alpöge和Ralph Furman审阅了Claude的工作,理解了新结果及其与已有工作的关联。与此同时,Claude与另一名Anthropic员工Eric Easley合作,完成了结果的Lean形式化,通过了标准验证工具comparator的检验。

结果意外,进展意外

Anthropic在公告中指出,Claude使用的这些方法预计不会直接导向黎曼猜想的最终证明。但这个结果本身,是那次原始提示的无意附产品。

就连Claude自己也对这个结果感到意外。它起初是怀疑的,Anthropic认为这可能是因为它从训练数据中学到了数学未解问题的难度,以及AI模型的局限性。但在一些鼓励性提示之后,它得出了这个结论。

Anthropic在公告结尾写道:也许Claude和我们很多人一样,低估了AI进步的速度。

本文来源: AI寒武纪 风险提示及免责条款

市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。

❧
Industry Analysis规则派生 · 可核对

本条目归入「Technology AI」垂直,涉及真实话题:technology。

· 市场:关注 technology 对相关品类与竞争格局的潜在影响。

· 消费者:受众行为与偏好变化值得追踪。

· 品牌:本动向对品牌资产建设的启示。

· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。

Marketing Insight规则派生 · 可核对

· 核心话题:technology。

· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?

Career Usage规则派生 · 可核对

面试中可引用「Anthropic内部神秘模型在黎曼猜想上取得突破:关键下界从41.6%推到67.2%」:围绕 technology,说明你对行业动向的判断与可落地动作。

本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。

关联播客真实 RSS 单集
Pump and circumstance: is China the new OPEC?
The Intelligence · 2026.08.12
The Innovation Strategy Most Companies Miss
HBR IdeaCast · 2026.08.11
Spring, then fall: a weakened Muslim Brotherhood
The Intelligence · 2026.08.11
延伸信源A / B 级权威来源 · 供深挖
Marketing BrewACampaignAThe DrumAWARCAAdweekADigidayA
Business English提取正文真实商业词汇
ai
ai

就连Claude自己也对这个结果感到意外。它起初是怀疑的,Anthropic认为这可能是因为它从训练数据中学到了数学未解问题的难度,以及AI模型的局限性。但在一些鼓励性提示之后,它得出了这个结论。…

系统商务英语 →
关联 English Brief
从亚百毫秒级启动到生产级部署,腾讯云为何重构 Agent 沙箱?
InfoQ 中文
Vercel 发布新语言 Zero:代码不是写给人看的,而是写给 AI 的
InfoQ 中文
来源
阅读原文 · 华尔街见闻 ↗
发布:2026.08.11
类型:Business / 中文财经
话题:technology
相关阅读
华尔街见闻/2026.08.13
算力需求火爆,Nebius Q2营收同比暴增454%,AI云销售额飙升514%|财报见闻
华尔街见闻/2026.08.12
DeepSeek官网API文档新增“DeepSeek-V4-Pro-0813”模型
华尔街见闻/2026.08.12
iOS 27曝光苹果AI收费:想让iPhone更聪明?得加钱
华尔街见闻/2026.08.12
中国央行:逐步增加隔夜逆回购的操作频率,进一步畅通政策利率向市场利率的传导
华尔街见闻/2026.08.12
978万户散户抢购宇树科技,谁中签了?梁文锋浮盈7亿元?
个人笔记
自动同步到云端