WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
今日情报播客来源我的
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
Market Intelligence/量子位

百年黎曼猜想被Claude破了新纪录!是个未公开新模型

把下界推高了一大截

一水·2026.08.11·4 min 阅读
事件背景基于真实抓取数据整理

本条来自 量子位(AI / 中文),聚焦 technology。 刚刚,A社官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展。

Original Intelligence基于真实抓取数据整理

把下界推高了一大截

  • 都知道素数就是只能被1和自身整除的整数,比如2、3、5、7、11……
  • 它们是构成整数的基础,但出现的位置看上去却毫无章法:
  • 鉴于完整证明实在太难,于是数学家换了一条路线:
  • Claude:我?黎曼猜想??(A社版奔波儿灞)
  • 刚刚,A社官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展

把下界推高了一大截

刚刚,A社官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展。

它将满足黎曼猜想的黎曼ζ函数零点比例的下界,从41.6%提高到了67.2% 。

这个数字上一次被人类往前推动,还是经过几代数学家接力、用几十年一点点磨出来的。

结果Claude这次虽然没打下终极Boss(A社:没有完全解决猜想),却在半路顺手刷新了一项长期纪录。

Claude完成这次研究,靠的是60个智能体、3100万输出Token。

人类负责情绪价值,AI负责推进数学前沿(doge)。

它由德国数学家黎曼在1859年提出,至今已难倒人类167年,谁能证明出来,就能拿走100万美元大奖。

用最不绕弯子的话说,它研究的是素数背后隐藏的规律。

都知道素数就是只能被1和自身整除的整数,比如2、3、5、7、11……

它们是构成整数的基础,但出现的位置看上去却毫无章法:

为了找到其中的规律,黎曼研究了一个叫“黎曼ζ函数”的数学函数,这个函数有许多能让函数值变成0的“零点”。

黎曼猜测,其中所有“非平凡零点”,都排列在复平面上实部等于1/2的同一条直线上。

黎曼ζ函数的所有非平凡零点,实部都等于1/2 。

数学家之所以如此在意,是因为这些零点与素数分布紧密相关。

如果黎曼猜想成立,就意味着素数的分布虽然看起来随机,背后的波动却始终被限制在一个精确范围内。大量建立在“假设黎曼猜想成立”基础上的数学结论,也能获得真正可靠的地基。

过去一百多年里,数学家已经用计算机验证了海量零点,发现它们全都乖乖落在临界线上。

但验证再多,也只能说明“检查过的都对”,无法证明无限多个零点永远不会出现一个“叛徒”。

鉴于完整证明实在太难,于是数学家换了一条路线:

既然暂时证明不了“所有零点都在线上”,那能不能先证明“至少有一定比例的零点在线上”?

经过几代数学家接力,这个比例的已知下界被一点点推到了41.6%。

而Claude这次做的,就是把它一口气提高到了67.2%。

注意,这并不等于“黎曼猜想被证明了67.2%”,也不代表剩下32.8%的零点不满足猜想。

Claude证明了,至少67.2%的非平凡零点位于临界线上。

虽然距离要求“全部零点都在线上”的黎曼猜想,仍然存在本质差距。

但对于一个被人类磨了几十年的长期纪录来说,从41.6%直接跳到67.2%,成绩已经足够扎眼。

至于Claude怎么做到的,根据A社描绘的故事,开局就很“不讲武德”。

没办法,谁让A社员工Jarred一上来就把整个猜想的证明任务甩给了Claude:

Claude:我?黎曼猜想??(A社版奔波儿灞)

fine,虽然有亿点难,但谁让咱是给人类打工的,开干吧……

于是,在没有精心设计的解题路线,也没有数学家在旁边手把手指导的情况下,Claude先是一口气生成并尝试了650个思路。

按理说,到这里故事就该结束了,毕竟这可是从1859年悬到现在、无数顶级数学家都没能拿下的终极难题。

但Jarred仍不死心,他给Claude再次下了一个非常简单粗暴的指令:

没想到Claude很快就“开悟”了,因为它知道“摇人”了。

第二轮,Claude在Claude Code里拉起约60个子智能体,花了一天半时间,执行2400条Shell命令、写下数百个Python脚本,还围绕已知的黎曼ζ函数零点进行了数千次数值检验。

这60个智能体有的负责提出新思路,有的沿着重点方向继续推导,有的专门寻找反例,还有一批直接充当审稿人,负责给其他智能体挑错。

最终,有2个智能体竟然真的提出了关键数学思路 。

13个负责提供辅助想法,30个探索了其他方向但没能成功,13个专门验证论证,最后2个帮忙把成果整理成论文。

而作为这支队伍里唯一的人类,Jarred的主要工作竟是不断发送鼓励??

就这么“哄”了一天半,Claude虽然没能证明黎曼猜想,却意外发现:

如果把几项已有数学成果重新组合起来,似乎可以突破一个停滞多年的纪录。

❧
Industry Analysis规则派生 · 可核对

本条目归入「Technology AI」垂直,涉及真实话题:technology。

· 市场:关注 technology 对相关品类与竞争格局的潜在影响。

· 消费者:受众行为与偏好变化值得追踪。

· 品牌:本动向对品牌资产建设的启示。

· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。

Marketing Insight规则派生 · 可核对

· 核心话题:technology。

· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?

Career Usage规则派生 · 可核对

面试中可引用「百年黎曼猜想被Claude破了新纪录!是个未公开新模型」:围绕 technology,说明你对行业动向的判断与可落地动作。

本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。

关联播客真实 RSS 单集
The Innovation Strategy Most Companies Miss
HBR IdeaCast · 2026.08.11
Spring, then fall: a weakened Muslim Brotherhood
The Intelligence · 2026.08.11
Leadership Summit 2026: AT&T CEO John Stankey on Developing Technology and Talent in the AI Era
HBR IdeaCast · 2026.07.16
延伸信源A / B 级权威来源 · 供深挖
Marketing BrewACampaignAThe DrumAWARCAAdweekADigidayA
Business English提取正文真实商业词汇
ai
ai

人类负责情绪价值,AI负责推进数学前沿(doge)。…

系统商务英语 →
关联 English Brief
把 AI 视频的钱花在刀刃上,不是每一刀上
InfoQ 中文
代理技能 Ponytail 在贡献者提出质疑后修正了自身的基准测试结果
InfoQ 中文
来源
阅读原文 · 量子位 ↗
发布:2026.08.11
类型:AI / 中文
话题:technology
相关阅读
量子位/2026.08.11
一家新能源大厂,如何撑起全球最大AI算力超级单体?
量子位/2026.08.11
GPU开始金融化!黄仁勋拉上华尔街搞5000亿美元融资
量子位/2026.08.11
Claude骂声中启动「隐形水印」:新模型全量嵌入,标记所有文字
量子位/2026.08.11
当AI开始“自作主张”,谁来为智能体戴上“项圈”?全球AI安全实战化大考,中国方案打入前三
量子位/2026.08.11
五大高校联手发榜!首份机器人三视角世界模型评测结果出炉,榜单持续更新中
个人笔记
自动同步到云端