Show HN: Cactus Hybrid——我们教会了Gemma 4识别何时出错 -- Show HN: Cactus Hybrid: We taught Gemma 4 to know when it's wrong

Cactus公司开发了一种混合AI模型,在小模型本地运行的同时,通过内置探针对答案进行0到1的置信度评分。当置信度低于0.85时,自动将查询路由到更大模型处理。其Gemma 4 E2B混合模型仅需将15-35%的查询转给Gemini 3.1 Flash-Lite,即可在多数基准测试中达到同等水平。

Codeberg 禁止加密货币项目 -- Codeberg Bans Cryptocurrency Projects

Codeberg组织提出一项2026年大会提案,建议禁止加密货币相关项目,认为这类内容可能损害平台声誉,但强调该限制并非穷尽列举。

MUD能否评估LLM?一个99美元的概念验证 -- Can a MUD evaluate LLMs? A $99 proof of concept

CrucibleBench是一个评估AI智能体行为的研究基准,将语言模型置于持久化文本世界中,NPC有记忆、信任积累且错误会留痕,模型需在50回合内完成隐藏社交目标。目前第一阶段概念验证已发布,涵盖13个模型、650次运行。

优质非虚构书籍是AI垃圾内容的对立面 -- Quality non-fiction books are the antithesis of AI slop

大学期间在图书馆整理书籍的经历,让我通过随机翻阅每本书的一页,偶然接触到许多有趣内容,如希腊神秘宗教等。这让我意识到,高质量的非虚构书籍能带来深度思考,与当下泛滥的AI生成内容形成鲜明对比。

我检查了我的带回家面试项目。那是一个完整的操作。 -- I Inspected My Take-Home Interview Project. It Was a Whole Operation

一位软件工程师在LinkedIn上收到一份高薪Python开发职位邀请,月薪1万至1.5万美元。尽管对方提前透露薪资等行为存在可疑之处,但出于好奇,他决定继续跟进并保持警惕。

鬼剪——或为何剪切粘贴功能处处失灵 -- Ghost Cut – or why Cut and Paste is broken everywhere

本文指出,所有文字处理器、代码编辑器和浏览器文本框中的“剪切与粘贴”功能都存在三大缺陷:剪切无法完全撤销、剪切后文档重新排版导致粘贴位置丢失、以及剪切与粘贴操作不具原子性。

约翰·C·德沃夏克去世 -- John C. Dvorak has died

我们沉痛宣布,约翰·C·德沃夏克(John C. Dvorak)去世,享年74岁。他是我们深爱的丈夫、父亲,也是《无议程秀》的珍贵主持人。更多信息将后续公布。

每个人都应该了解SIMD -- Everyone Should Know SIMD

SIMD(单指令多数据)并非如普遍认为的那样复杂难懂,它其实可以很简单。掌握基本模式后,编写SIMD代码就像写for循环一样容易,每个开发者都应该了解这一基础概念。

OpenNode – 比特币支付处理器 -- OpenNode – Bitcoin Payment Processor

OpenNode提供闪电般快速的比特币支付处理服务,支持通过API、电商插件或托管支付页面实现低成本的比特币收款与结算。

AI实验室在“鹈鹕最大化”吗? -- Are AI Labs Pelicanmaxxing?

文章探讨了AI实验室是否针对“鹈鹕骑自行车”这一非正式基准测试进行优化。作者通过生成1008张SVG图像,用LLM评分并分析七个前沿模型,揭示了模型可能为迎合该测试而刻意调整的现象。