天才的失败:AI实验室的知识傲慢 -- When Genius Fails: The Intellectual Arrogance of the AI Labs
文章指出,OpenAI前员工Aschenbrenner因过度自信导致其200亿美元对冲基金失败,说明专家在单一领域的成功不代表在所有领域都正确,警示了AI实验室中的智力傲慢问题。
Qwen3.8-27B -- Qwen3.8-27B
阿里通义千问发布Qwen3.8系列模型,包括27B参数的多模态稠密模型,性能超越Qwen3.7-Plus,在编程和办公场景表现优异,支持262K原生上下文并可扩展至百万token,同时开源了Max级模型。
每个该死的网站(2020) -- Every Fucking Website (2020)
文章讽刺了当前网站普遍存在的强制Cookie同意弹窗现象,指出这是法律要求但用户体验极差,并调侃用户投票导致了这种局面。
澳大利亚家用电池热潮助力批发电价减半 -- In Australia, a Home Battery Boom Has Helped Cut Wholesale Power Prices in Half
澳大利亚通过大力补贴家用电池,一年内安装超50万套,数量超过美国。此举有效利用过剩太阳能,使批发电价降低约一半,成为全球典范。
致机场工作人员 -- Dear people who work at the airport
致机场工作人员:我们乘客也在尽力配合。对你们而言机场是日常,但对首次乘机的老人来说,你们的术语和指令令人困惑。你们矛盾的通知和公开羞辱让我们焦虑。请理解,我们并非故意添乱。
DeepSeek 峰谷定价更新 -- DeepSeek peak/off-peak pricing update
DeepSeek发布V4-Pro版本,带来重大智能体升级和灵活推理模式,支持OpenAI Responses API并优化Codex集成。同时更新API定价,引入峰谷费率,谷时价格降低50%。
为什么Opus 5用起来感觉更差? -- Why does Opus 5 feel worse to work with?
作者认为Opus 5虽在能力上优于前代,但使用体验却更差,因为它缺乏主动提问、不擅自假设或修改计划,导致用户需更谨慎监督。推测原因包括追求自我改进AI和应对基准测试压力。
关于你不懂的事情的博客 -- Blog about things you don't understand yet
每篇博客文章都让我学到至少两件新事物:写作的初衷和写作过程中的发现。如果写作时没有新收获,文章就不值得发表。
哥德尔证明的原理(2020) -- How Gödel's Proof Works (2020)
1931年,哥德尔提出不完备定理,证明任何数学公理体系必然存在无法证明的真命题,且无法自证一致性,粉碎了数学完备性的梦想。此后数学家发现了许多类似不可解问题。
组织如何运用AI:来自ChatGPT的证据 [pdf] -- How Organizations Use AI: Evidence from ChatGPT [pdf]
该研究通过分析ChatGPT企业账户数据,揭示了截至2026年3月企业采用生成式AI的四大特征:使用量快速增长、大型高价值企业更倾向采用、活跃使用覆盖各职能和职级且早期职业者使用强度高、使用范围涵盖广泛的知识工作任务。