本期热点#

今天最先闯入视野的,是 OpenAI 宣布其模型在十道尘封已久的数学难题上取得突破。这不是一次普通的跑分,每个结论都经过了形式化验证,意味着"AI 参与科学研究"从口号变成了可以检验的事实。把它作为今天的开场很合适,因为这一期的主线恰好就是 AI 的多重身影:它一边改变科学研究的方式,一边让万亿参数模型进入普通笔记本,一边催生只为一个人或一家人写的软件;而与之并行的,是关于开放协议、账单透明、数字权利这些"看不见的战场"的讨论。最后,一篇关于"如何安静地待着"的随笔和纽约一栋被广告牌藏了一百年的小楼,把话题拉回人与城市本身。

科学与研究#

科学研究正在成为 AI 最引人注目的新战场,今天的头条恰好证明了这一点。

OpenAI 发布十项数学突破,每个结论都经过机器验证#

OpenAI 的这篇博客 宣布,其内部测试中的下一代模型 Astra 在十道长期没有实质进展的数学难题上取得了突破,涵盖高维球堆积、编码理论、群论、格密码等领域。这些题目大多搁置了十年以上,部分更久;模型生成的论证由人类研究者整理成稿,再用 Lean 证明助手逐一验证,验证代码已全部开源。据 OpenAI 估算,生成这些论证的全部算力成本约为 2000 美元。

Hacker News(下称 HN)社区的反应两极分化。有评论者称这是"有史以来最具影响力的数学出版物之一",认为人类几乎无法独立完成需要横跨多个数学领域的范式转换;也有评论者怀疑宣传成分,提醒关键要看同行评议与复现。还有用户注意到,这条新闻甚至没有登上首页榜首,猜测是被无法接受 AI 进展的人标记压制——不过另一派反驳说,论坛用户完全有权对 OpenAI 的宣传稿持保留态度。

讨论见 Hacker News 帖子

技术与产品#

技术板块今天有一条共同的暗线:那些我们以为理所当然的东西——订阅工具、开放协议、快速生成的代码——背后都藏着更复杂的现实。

谷歌如何一步步"消灭"了 RSS 订阅生态#

OpenRSS 的长文 梳理了谷歌二十多年来的操作:RSS(一种让网站向订阅者推送更新内容的开放格式)曾是普通用户订阅网站的常用方式,早期 Chromium 浏览器内置 RSS 订阅按钮,后来无解释移除;2007 年收购 FeedBurner 后关闭其 API,又在 2022 年大幅削减服务;2013 年直接关停广受欢迎的 Google Reader,官方理由是"使用率下降",而同期谷歌正在强推几乎没人用的 Google+。文章认为,谷歌靠开放的 RSS 协议积累用户与影响力,却在锁定用户后转身拆台,是开放互联网面临的主要威胁之一。

HN 评论区普遍认同这一判断。有人回忆,关停 Reader 的借口尤其讽刺,因为当时的 Google+ 才是真正的无人问津;曾在谷歌工作的工程师也惋惜,当时把 Reader 并入 Google+ 本有机会,却被浪费。一位曾为中东地区异见博客提供帮助的人士提到,Reader 被关甚至成了民间组织与谷歌会面时最先提出的抱怨——表面可笑,实则严肃。原文写的是技术史批判,评论区补上的是亲历者视角。

讨论见 Hacker News 帖子

WASTE:把 2.78 万亿参数的模型搬进普通笔记本#

WASTE 项目 用纯 C 语言写了一个推理引擎,让完整的 Kimi K3 模型——2.78 万亿参数、转换后约 982 GB——在 64 GB 内存的消费级笔记本上运行,速度约每秒半个 token(token 是模型处理文本的基本单位),最低只需约 29 GB 内存。原理并不玄乎:这类模型每次只激活约 4% 的参数,闲置权重不必常驻内存,引擎把它们按磁盘布局存放、按需流式读取,再用剩余内存做缓存。作者强调,这不是蒸馏或剪枝的缩水版本,结果已与官方参考实现逐层验证。

评论区先怀疑后认可。有人一开始质疑代码和说明文字都由 LLM 代写,作者坦然以"claude"署名提交记录,反而赢得不少理解,有评论者说"诚实标注 AI 协作值得鼓励"。工程细节也收获好评:缓存命中率从 14% 提升到 38%,靠的是提前预读而非读更多数据,被评价为"聪明且可验证"。当然也有人提醒,每秒半 token 的速度离实用还很远,但作为工程里程碑,它第一次把万亿参数模型拉进了个人电脑的射程。

讨论见 Hacker News 帖子

AI 生成的是原型,不是产品#

这篇博客 提醒被"人人都会写代码"冲昏头脑的人:用几句话让 AI 生成一个能跑的原型,和交付一个能上线的产品之间,隔着漫长的距离。原型会崩溃、缺少错误处理、可能泄露密钥,数据模型加一个用户就散架。作者认为,软件开发真正的难点从来不是写语法,而是判断力——该做什么、如何设计、何时说不;计算机科学教育的价值,正在于建立"系统如何运行、如何失败"的心智模型,这正是看懂 AI 生成代码里隐患的前提。

HN 评论区的经验之谈很有共鸣。一位开发者说,自己正准备扔掉一个用 LLM 写了几个月的项目——每次单独的修改看起来都合理,整体却悄悄烂成难以言说的样子,他感叹模型缺少程序员那种整体架构判断力。还有评论补充,代码库足够大时,让 AI 循环找 bug 会边修边造新 bug。这与原文的判断一致:AI 加速了从零到一,却没有缩短从"能跑"到"能用"的距离。

讨论见 Hacker News 帖子

商业与平台#

平台与用户之间的信任账本,是今天商业板块的主角。

Cursor 隐藏账单信息,用户质疑"花钱看得到吗"#

Cursor 官方论坛的这条帖子 汇集了大量用户投诉:使用量页面原本显示"花了多少钱",最近被换成"消耗了多少 token",日常开支无法直观追踪,CSV 导出里的美元信息也被削弱。官方员工回应称这是刻意设计——套餐包含额度与按需付费混在一起,直接显示美元容易让用户误以为被多收费;超出的按需部分仍显示美元,总额可在专门的支出页面查看。

HN 讨论很快从费用问题转向 Cursor 的整体处境。有 2023 年就开始付费的老用户说,自己已半年没打开 Cursor,现在用 Claude Code 和 Codex 写代码、在 GitHub 上审查;也有人为 Cursor 辩护,认为它的集成体验依然无可替代、支持所有模型是独特优势。更有评论者把矛头指向整个行业:AI 编程工具定价混乱、模型更新太快,用户根本无从比较性价比。官方解释的是设计逻辑,社区不满的是信任本身——账单越不透明,用户越怀疑。

讨论见 Hacker News 帖子

政策与治理#

政策板块的两篇文章互为镜像:一边是国家间的监控合作,一边是跨越 25 年的出口管制历史。

加拿大悄然签署《联合国网络犯罪公约》,被指"披着反网络犯罪外衣的监控条约"#

Michael Geist 的文章 指出,加拿大政府上月中旬在几乎没有关注的情况下签署了《联合国打击网络犯罪公约》,并宣称这是保护儿童与人权保障的胜利。Geist 认为,这份源自 2017 年俄罗斯倡议的公约,本质是一份广泛的跨境监控与电子证据共享协议;加拿大曾与美国、欧盟一起反对其谈判进程,去年河内签署仪式上还缺席,九个月后却悄悄签字,而主要盟友至今未签。

HN 评论区把话题拉得更宏观。有人发问,何时能看到推进数字权利而非蚕食数字权利的立法,并呼吁一份保护设备自主权、免于大规模监控的"数字权利法案";有人提到美国众议员 Thomas Massie 的隐私法案,要求政府调取元数据前必须取得令状、禁止无证人脸识别。也有评论者直白地说,答案很简单:监控工具是门赚钱的生意。原文揭示的是条约风险,评论区补充的则是制度层面的无力感。

讨论见 Hacker News 帖子

25 年前是密码学,今天是模型权重#

这篇回忆 从作者 25 年前购买开源操作系统 OpenBSD 的光盘说起:那时美国把强加密算法视为武器、禁止向外国人输出,OpenBSD 团队把开发分散到加拿大、德国等地绕开出口管制,“因为我们能做到"成为开源史上的著名宣言。作者认为,同样的逻辑正在 AI 领域重演——美国商务部要求某 AI 实验室在让外国雇员接触最新模型前先申请许可证,与当年的加密管制如出一辙;而这类管制只束缚守规者,真正有决心的人总能拿到前沿能力。

HN 评论区从历史案例展开类比。有用户认为 DRM 同理:它只让守法的消费者不便,破解者只要成功一次,所有人就能免费拿到无保护版本;也有人反驳说,DRM 的目标本就是劝退"顺手为之"的中间人群。还有评论指出,流媒体时代合法渠道足够方便,盗版反而失去吸引力——可见产品体验比防破解更重要。原文讲的是政策与历史,评论区补上的是消费与产业的另一面。

讨论见 Hacker News 帖子

社会与文化#

如果说前面的板块在谈技术如何改变世界,社会与文化板块则在谈技术之外、人本身的事。

如何"存在”:为什么我们连安静坐三分钟都做不到#

这篇随笔 提出一个实验:静坐三分钟,什么都不做,同时保持满足。作者发现,大多数人几秒钟就受不了,急着找事做或刷手机;他还引用一项研究——许多人宁可给自己施加电击,也不愿独自沉思。作者认为,人类似乎"对当下过敏",购物、争吵、无意识进食、灾难性刷屏都是逃避存在本身的策略,并给出一个简单练习:以一次呼吸为单位,放松身体,拥抱呼吸中出现的感受,几秒钟一次,慢慢延长。

HN 讨论从文章延伸到劳动史。有人引用《四千周》的观点,认为工业革命前人们按"任务"而非"小时"生活,农活有自然的间隙;多位有农场经验的人证实,传统农活虽辛苦但终有做完的时候。也有评论质疑"静坐即存在"的说法太玄,而实践者则分享,每天几分钟静坐观察思绪,往往能看清自己真正想做的事。原文提供的是一套方法,评论区补上的,是对"忙碌"这件事本身的历史反思。

讨论见 Hacker News 帖子

软件只为一家人而写#

Adam Waxman 的文章 记录了他用 AI 为家人做软件的半年:把睡眠顾问的 PDF 方案变成自动重排作息的睡眠应用、根据当日跑步量计算奶昔配方的健身应用、基于自身比赛数据的马拉松计划,还有"爵士版多邻国"和体检记录整理工具。他回溯 2020 年 Robin Sloan 为家人做的只有 4 个用户的 App,认为 AI 让"个人软件"终于成为可能——不必考虑用户画像和订阅层级,只为爱的人下厨;妻子最喜欢的睡眠应用功能,不会有突然的改版或广告洪流。

HN 评论区许多人晒出自己的"一人软件":有人列出用语音指挥的木工房音乐播放器、把一句话饭食换算成营养数据的记录器、给全屋温度传感器做的小面板,并感叹"这些应用普遍比应用商店里的更好用"。也有人质疑 AI 估算卡路里的准确性,作者则详细解释了食材与"家庭配方"的计算逻辑。原文讲的是技术可行性,评论区印证的是这种做法的普遍吸引力。

讨论见 Hacker News 帖子

一栋小楼挡住梅西百货一百年,如今重见天日#

Ephemeral New York 的报道 讲了一个绝佳的纽约故事:先驱广场梅西百货旗舰店中间,一栋被巨型广告牌遮挡了一百多年的五层小楼,最近随着广告牌拆除终于重见天日。1901 年梅西百货计划迁到先驱广场,买下了几乎所有地块,唯独这块角落归牧师 Duane Pell 所有,他要价 25 万美元;梅西答应后,Pell 却转头以 37.5 万美元卖给了竞争对手——于是这栋小楼从此"插"在梅西百货正中,成了纽约最著名的钉子户。

评论区大多是好奇与惊叹。有人问楼里是否住人,知情者回答一楼是商铺、上层基本空置;有人推测外墙一百年没被雨水冲刷,广告牌拆掉后显得破败。还有评论补充,这个地段广告位的价值远超任何租金收入——就像时代广场那栋藏着纽约时报老楼的建筑。原文讲的是建筑与商业史,评论区关心的是这栋楼现在和未来的命运。

讨论见 Hacker News 帖子

尾巴#

今天的 Hacker News,AI 的身影无处不在:它首次成体系地改写数学研究的版图,把万亿参数模型搬进普通笔记本,也让"只为一个人写软件"成为现实。与此同时,关于 RSS 生态被大平台拆毁的往事、AI 工具账单的不透明,以及国家间监控合作的扩张,提醒我们技术变强的另一面,是开放与信任的持续拉扯。而一篇关于"如何安静地待着"的随笔和纽约那栋倔强的小楼,又把视线拉回最朴素的问题:我们如何存在,以及我们选择与什么共存。我们下期再见。