Hacker News 中文摘要

RSS订阅

数学与理论计算机科学的十大进展 -- Ten advances in mathematics and theoretical computer science

文章摘要

OpenAI分享了十个在数学和理论计算机科学领域取得的重要进展,这些成果解决或推进了长期悬而未决的难题,涵盖高维几何、编码理论等领域,旨在加速科学发现。

文章总结

近日,OpenAI 分享了其在数学与理论计算机科学领域的十项重要进展。这些成果由下一代模型 Astra 的内部版本完成,涉及高维几何、编码理论、算术电路复杂度、群论、算子代数、量子复杂度、格密码学及极值组合学等多个领域,均对长期悬而未决的开放问题取得了实质性突破或解决。具体成果包括:高维球体堆积的新上界、二进制码与球面码尺寸的指数级改进、非 sofic 群的存在性构造、Connes 刚性猜想的反驳、算术电路计算永久式的新下界、量子并行重复定理的指数级推广、最近向量问题的多项式因子硬度、Ehrhart 体积猜想在所有维度上的解答、多色三角形 Ramsey 数的超指数下界,以及极值图论中紧致性与退化性猜想的解决。OpenAI 强调,这些数学论证由系统生成,人类负责整理手稿、在 Lean 中形式化证明并确保其正确性。同时,OpenAI 表示尊重数学界对 AI 角色的不同看法,并希望通过提供免费工具(如面向学术研究者的 ChatGPT)支持科学家与数学家,共同推动学科发展。

评论总结

根据评论内容,总结主要观点如下:

1. 对AI数学突破的认可与担忧(平衡呈现) - 积极观点:AI推动数学走向主流,为人类数学家开辟新方向(piker: "these results are bringing math mainstream... an exciting time to go even deeper")。AI的贡献已不可否认,目标不断后移(Chance-Device: "The impact of AI is getting undeniable... next they’ll have to be outside the stadium entirely")。 - 担忧观点:对数学家存在生存威胁,可能终结科学(melagonster: "this is the end of science";DrBazza引用《银河系漫游指南》比喻AI取代人类思考者)。但部分评论认为AI目前缺乏直觉,只能辅助而非替代(DrBazza: "current models can't 'intuit' and come up with conjectures")。

2. 对研究透明度和成本的质疑 - 实验设计不透明:怀疑$2000成本被夸大,要求披露总问题数、尝试次数和计算资源(aabhay: "lack of transparency... how many total problems were given... how many attempts")。 - 成本对比:好奇与雇佣人类博士的成本差异(0x5FC3: "How much... to 'buy' these advances from PhDs";emil-lp: "total cost... including salary")。

3. 对AI贡献本质的哲学讨论 - 工具论:AI无自我意识,应视为工具而非作者(zkmon: "AI has no self-awareness. It's a tool... Do you attribute the build to the tool?")。 - 创新性存疑:AI是否只是组合现有工具而非创造新思想(kcexn: "simply an effective method to exhaustively search the literature... or contribute new ideas?")。

4. 对实际应用和未来影响的期待 - 呼吁关注现实问题:希望AI用于气候、粮食安全等(christofosho: "more time and money put into real-world problems";amazingamazing: "quality of life increases for the average person")。 - 对AGI的讨论:数学突破是否意味着AGI已近(petilon: "At what point can we say AGI has been achieved?"),但部分观点认为不会引发快速技术爆炸(ultimatefan1: "does not make me think we are on the cusp of a foom style fast takeoff")。

5. 对发表形式和同行评审的批评 - 缺乏署名和评审:未列出人类贡献者姓名(macleginn: "not a single human contributor's name listed"),且博客文章替代了同行评审(amai: "Have blog posts replaced peer-reviewed academic papers?")。 - 证明可读性差:Lean证明长达5万行,难以追踪(joshlk: "Some of the Lean proofs are 50k lines";frenzyguy: "models have jumped hoops... hard to track")。