1007 | AI时代的代码、工具与新世界

||Download

Show notes

从AI编程与个人软件,到开源工具与前沿模型研究,再到安全法律、科学与商业动态——本期用一组最新新闻,串联起AI如何改变我们写代码、看病、做研究和做生意。

时间轴

  • 00:00:04 开场
  • 00:00:52 AI 编程与个人软件
  • 00:05:12 开源工具的硬实力
  • 00:09:52 前沿模型与新形态的AI
  • 00:14:30 AI自己做出研究
  • 00:18:59 安全、隐私与法律
  • 00:22:41 科学、能源与自然
  • 00:26:00 商业风云
  • 00:28:18 收尾

相关信息

本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。

Transcript

茉莉: 欢迎回到节目,我是茉莉。

白桦: 我是白桦。今天这一期有点特别,因为我们手里攥着一堆过去二十四小时里的故事,而且它们之间其实有一条暗线,就是不管是写代码的、用软件的,还是做能源做科学的,大家都在重新想一个问题:过去那套大平台、大机构的打法,还灵不灵?

茉莉: 对,所以今天我们不讲流水账,一个故事一个故事聊透。从几个由 AI 写出来的小软件说起,一路聊到欧洲的大模型、AI 自己做数学研究,再聊隐私监管、地热发电,最后是媒体和开发工具行业的两笔大账。老规矩,我们不背新闻稿,重点放在讨论本身上。那我们就直接开始。

白桦: 先说第一个,Berth。它是一个开源的 macOS 应用加守护进程,干的事是让你在自己的机器上跑编码代理,关键点是笔记本睡觉了,代理还在干活。

茉莉: 这个点子一下就击中了很多人。因为用 Claude Code、Codex 这类工具的人都遇到过那个尴尬:你想让代理跑一个长任务,比如大重构,结果你合上电脑出门,任务就断了。Berth 把代理搬到后台守护进程里,等于把“人在场”这个前提解掉了。

白桦: 讨论里有几种声音。一种是比较兴奋的,觉得这才是“个人软件时代”该有的样子,工具就应该长在你自己的机器上,数据不出门,算力也用你自己的。另一种更谨慎的,问的是安全边界:一个常驻的守护进程替你跑代理,代理能碰什么文件、能跑什么命令,这个权限模型怎么定,评论区并没有给出统一答案,更多是各家有各家的担忧。

茉莉: 同一个讨论串里,还有人把 Berth 放到更大的趋势里看,说这类“为一个人服务的小工具”正在取代传统大软件。有个很出名的论点是说,未来的个人应用会是那种做出来只解决你自己一个奇怪需求的东西,而大平台继续管通用需求。评论区为此吵得不轻。

白桦: 对,反方意见很典型:平台之所以是平台,是因为维护成本、更新成本、安全补丁,这些事个人项目根本扛不住。一位持怀疑态度的人就说,你 vibe code 出来的东西,三个月后你自己都看不懂了,谁来修?这个“能不能长期维护”的问题,到今天也没有答案,而且我觉得它会一直跟着这类项目。

茉莉: 说到这儿,正好有一个活生生的例子,Darkplug。这是一个 iPhone 应用,把一个二十美元的 Shelly 智能插座变成暗房放大器的定时器。传统暗房放大器定时器是胶片时代的老器材,讲究 f-stop 计时法和试条测试。作者直接用 Codex 把它 vibe code 出来了。

白桦: 这个项目的可爱之处在于它极度小众。全世界还需要暗房放大器定时器的人,可能装满一个咖啡馆都不到。但正因为小众,大公司永远不会做,只有个人软件这条路能走通。评论区里有暗房爱好者现身说法,说这正好是他们想要的东西,也有人开始好奇 Shelly 的本地控制接口稳不稳定,毕竟你的暗房流程现在押在一个第三方固件上。

茉莉: 不过也有个很诚实的作者反思,跟这个话题接得上。有开发者写文章说,vibe coding 其实不如亲手写代码好玩。他的说法很有意思:乐趣是“前置”的,就是最爽的部分在最开始,你说一句需求、代码哗哗出来,但后面没有那种“活儿干得漂亮”的满足感,也没有学习的过程。

白桦: 这个观点在评论区引发了很真实的共鸣和反驳。同意的人说,他们自己也有这种感觉,看着 AI 生成代码,像看别人替你玩游戏,通关了但不是你通关的。反对的人则说,乐趣的来源变了而已,从前是乐趣在实现里,现在是乐趣在设计和调试里,如果你还只把快乐寄托在敲键盘上,那是没跟上。我觉得这个争论其实没有输赢,它取决于你写代码到底是为了结果还是为了过程。

茉莉: 还有一个历史视角补进来,特别应景。Alan Kay 1993 年那篇《Smalltalk 的早期历史》最近又被翻出来热了一轮。评论区在吵一个老问题:Smalltalk 这么优雅的东西为什么输给了 Java?

白桦: 挺多人给出的解释指向工程现实:Smalltalk 生态封闭、商业授权贵、性能跟不上、没有赶上企业采购的窗口期,而 Java 是免费、兼容、有 Sun 押注的。但更有意思的一批评论把这个故事接到了 AI 时代,说我们现在看 AI 生成代码,和当年看“更安全的语言、更好的环境没能赢”,是同一类问题——技术上的优越从来不保证胜出,胜出的是适配当时生态和商业节奏的那个。

茉莉: 这就自然引出下一个话题了。如果个人和小社区在做软件,那他们手里的“硬活”做得怎么样?我们看两个例子。第一个是 AnyPS5,一个开源工具,名字很直白,它把 PS5 的可执行文件直接移植到 Linux 和 Windows 上跑,注意,不是模拟器。

白桦: 这点值得展开一下。模拟器是虚拟整台主机的硬件,慢、而且法律上灰。AnyPS5 的思路是做系统库层面的翻译,目前已经映射了百分之八十七的系统库,许可证是 GPL-2,星标六千五,进展不慢。

茉莉: 讨论里懂行的人分成两派。一派觉得这条路是对的,因为 PS5 本来就是 x86 架构加类 Unix 系统,跟 PC 的距离比老主机近得多,翻译系统调用和库比模拟 GPU 硬件务实。另一派泼冷水,说百分之八十七只是“已映射”,不等于“能跑”,最后那百分之十几往往是音视频、图形这类最硬的骨头,而且一旦跑到需要反作弊、需要系统级验证的地方,工程量会陡增。

白桦: 还有一层争论是关于长期支持的。主机固件在更新,每次更新都可能改变系统库的行为,一个社区项目能不能持续追着索尼跑,这是评论区分歧最大、也最没人敢打包票的地方。不过多数人同意一件事:就算最后只能跑一小部分游戏,作为逆向工程的公开资料,它本身就有价值。

茉莉: 同一个话题下的第二个例子,Penguin Mail。GPL-3 许可,Rust 写的 GTK 邮件客户端,跑在 Linux 上,支持 Gmail、Outlook 和 IMAP,还带日历。

白桦: 它最容易被讨论的一点是那个“可选的 AI 助手”,默认关闭。评论区几乎一致欣赏这个默认设置,很多人说这才是把 AI 功能当配料而不是当主菜的正确姿势,装不装、开不开,用户说了算。也有 Rust 社区的人关注工程细节,关心它跟 GTK 的绑定质量、内存安全在邮件解析这种充满畸形输入的场景里能带来什么。

茉莉: 顺着“社区自建替代方案”这个思路,还有三个小例证。一个是 tapo 这个库,版本 0.11.1,它支持了 TP-Link 一个没有官方文档的协议叫 TPAP,用的是 SPAKE2+ 认证。意义在哪?TP-Link 官方有个“第三方兼容性”开关,开了它,第三方软件才能控制你的智能设备。但这个库逆向了协议之后,用户可以不开那个开关,照样用第三方工具。

白桦: 评论区里做智能家居的人特别有共鸣。开兼容开关等于扩大设备的网络暴露面,很多人的路由器上就因为这个而犹豫。一个社区库通过逆向把选择权还给用户,这就是典型的“社区自己补上大公司没给的路”。当然也有人提醒,逆向未文档化协议意味着固件一升级就可能全断,这是这类项目的宿命。

茉莉: 还有 Gleam,1.19 版本做了个很聪明的底层改动。它以前编译成 Erlang 源代码,再交给 Erlang 编译器;现在直接生成 Erlang 的抽象语法形式,跳过了中间的源代码这一层。

白桦: 结果是编译快了很多,而且报错栈里的行号是精确的,直接指向你的 Gleam 源码。评论区里写 BEAM 生态的人很兴奋,说这种“贴着编译器内部接口干活”的改法比表面上的版本号升级重要得多,等于把开发体验里最烦的两个痛点,慢和行号错位,一起解决了。

茉莉: 第三个是 Polars 2.0。Rust 的数据框架,这次把 SQL 提升为一等公民,默认开启 spill-to-disk,大约到内存的百分之八十就往磁盘溢写,还加了 Map 数据类型。更关键的是基准测试里,它在 TPC-H 和 TPC-DS 上领先 DuckDB 和 DataFusion。

白桦: 讨论里最有意思的是关于那个默认溢写设置的争论。喜欢的人说,数据处理最恶心的就是跑到一半内存爆了,默认安全比默认快更符合真实工作负载。怀疑的人则说,任何“默认”都是一种立场,溢写会掩盖你查询写得烂的事实,也有人盯着那些基准数字问测试条件是不是对 DuckDB 公平。这仨谁也没说服谁,但没有人否认 Polars 这两年追得很快。

茉莉: 好,从小工具往上看一层,就是大模型本身了。这轮最大的新闻是 Mistral Large 4,内部代号“Le Chonk”,这个外号本身就说明他们的文化。参数总量一万亿,活跃参数四百九十亿,多模态,开放权重本月晚些时候放出。

白桦: 两个细节很值得说。第一,训练是在欧洲做的,用了三千八百张 Grace Blackwell,这在主权 AI 的叙事里是个大动作。第二,它的成绩单:在 DeepSWE 上跟 GLM 5.3 掰手腕,在开放权重模型里领跑,落后于的是中国的闭源阵营。还有一个挺具体的数字,在一个复现和修补真实漏洞的测试里拿了百分之八十二。

茉莉: 讨论区的分歧焦点就一个:开放权重放出来之前,一切都是纸面数字。持乐观态度的人说,Mistral 这次等于欧洲第一次真正站上前沿竞争的牌桌,欧洲有算力、有团队、有政策意愿,这本身就是历史性的。持怀疑态度的人说,我们被“开放权重即将发布”忽悠过太多次,等权重真落地下、社区真跑过分再说,而且前沿模型发布后的实际体感经常跟发布会叙事有落差。

白桦: 还有一个结构性问题被反复提出来:开放权重到底意味着什么?你能本地部署,但一千亿参数的模型你本地跑不动,那这个“开放”对你来说是不是只是名义上的?这个问题没有被解决,只是被各方各自表述了一遍。

茉莉: 围绕模型产品形态,还有几个小故事可以并进这个讨论。一个是 OpenAI 的 Decisions API 进了公开测试,它做的事是让模型判断条件、在选项里做选择、按评分标准打分,输入价格约百万 token 一毛美元,支持图片输入。市面上还有个更便宜的竞争对手叫 Jev。

白桦: 评论区对这个 API 的看法挺两极。一派觉得这是把“模型即服务”往“模型即判断”推进,很多业务流程里人类要做的其实就是判断题,把它 API 化是很自然的抽象。另一派则直接问:这跟你在自己应用里写一段 prompt 有什么本质区别?是不是把简单的事包装成产品来卖钱?

茉莉: 另一个是 Google 的 EmbeddingGemma 2。Apache-2.0 许可,七亿四千万参数,原生多模态,里面文本部分两亿七、视觉一亿七、音频三亿,主打端侧嵌入。

白桦: 这个方向的讨论焦点是“小而开放”的价值。不少人认为,嵌入模型不需要大,端侧跑、免 API 调用、数据不出设备,这对很多隐私敏感场景反而比旗舰模型更实用。也有人质疑多模态融合在小模型里的实际效果,说三个模态塞进七亿参数,每个模态分到的容量都很紧。

茉莉: 还有两条跟模型生态的动向有关。OpenSSH 10.6 发布了,他们自己说以后会更频繁地发安全版本,原因之一是 AI 发现漏洞的速度在加快。这次版本还缓解了一个 SSH 压缩相关的侧信道攻击。

白桦: 这个消息在讨论里被读出了两层意思。一层是工程层面的,侧信道攻击比逻辑漏洞难防,缓解而不是根治说明问题还在观察期。另一层是更有意思的元层面:一个维护了二十多年的老项目,因为 AI 找 bug 的能力变强,被迫改变自己的发布节奏。有评论者说这可能是未来所有核心基础设施项目的宿命,安全审计的攻防节奏被 AI 重置了。

茉莉: 最后一条产品形态的新闻是关于 Claude Code 的“建议消息”功能。有一篇文章提出一个观点,说这个功能的真正目标客户不是开发者,而是模型本身,等于让模型在对话里引导你。

白桦: 评论区相当冷。主流的怀疑声音认为,与其说是“面向模型的产品设计”,不如说更朴素的解释是数据收集,你点或不点那些建议,都在告诉厂商你的意图分布。也有少数人持不同意见,觉得把产品功能往阴谋论上解读太容易了,引导式交互本来就是工具设计的常态。没有共识,但这个争论本身说明大家对“AI 产品的默认交互到底为谁服务”越来越敏感。

茉莉: 好,接下来这一段可能让有些听众吃惊:AI 不光在写代码,它开始产出能站得住的研究结果了。最大的那条,一篇论文声称给出了第一个次二次的 3SUM 算法,复杂度是 n 的 1.9992 次方,还带一个次立方的全点对最短路径结果。

白桦: 先给不熟理论计算机科学的朋友补一下背景。3SUM 是一个经典问题:给一堆数,找三个加起来等于零的。几十年里大家都假设它需要大约 n 平方的时间,一大堆条件下界都建立在这个假设上。这次的结果是 n 的 1.9992 次方,听起来只快了一丁点,但它推倒的是一个几十年的关键假设,连锁反应会很大。

茉莉: 而且发现这个算法的是 Claude,验证是在 Lean 4 里做的形式化证明。这一点在讨论里是全场最炸的部分。有人惊叹于“AI 发现加形式化验证”这个组合的意义:证明不需要信任模型的话,机器发现的东西可以直接被数学共同体检验。也有人立刻降温,说 n^1.9992 距离真正的突破还有距离,它更像一次证明“假设不是铁律”的示波实验,离实用还远。

白桦: 还有一派人在讨论更深的问题:这算不算“AI 做出了研究”?有人认为这就是研究,发现加验证一个不缺。有人认为这还不是,因为提出“往这个方向找”的洞察还是人给的。我觉得最诚实的评论是那个悬而未决的:这样的结果能不能扩展到更多问题?一次成功可能是撞大运,能复现的流程才是方法论。

茉莉: 配套的还有一条,OpenAI 自己在 GitHub 上发布了内部前沿模型的数学成果,配了 Lean 形式化,还咨询了普林斯顿高等研究院的顾问团队。你看,两大实验室不约而同都在往“形式化验证的 AI 数学”这个方向走。

白桦: 讨论里大家把这读成一个信号:形式化证明正在变成 AI 数学输出的质检标准,因为纯自然语言的“我证出来了”没法用。也有人关心 OpenAI 这次发布是不是对外部研究的一次试探,边界在哪、多少会公开、多少留给内部,这些都没有答案。

茉莉: 跟这个话题搭着的是 openTPU,一个由 AI 设计的开源 AI 加速器,跑在 Kintex-7 的 FPGA 卡上,能运行 Qwen3 这类模型,经过自我改进之后最高跑到每秒八十六个 token。

白桦: 评论区里玩 FPGA 的人给出了很专业的解读。八十六 token 每秒在一块不算新的 Kintex-7 上,对推理来说是个能用的速度,而“AI 设计硬件、AI 再改进自己设计的硬件”这个循环才是重点。怀疑者则指出,FPGA 上的成功和真正的 ASIC 之间隔着流片的成本和工程,这条路要走到“能造出芯片”还有很长一段。有人还把这件事和刚才的数学发现并列,说这是 AI 第一次同时交出“可验证的数学”和“能跑的硬件”两类成果,虽然两个都还处在早期。

茉莉: 在这个“AI 走进现实世界”的语境下,还有一条边缘但很说明问题的新闻。犹他州成了第一个允许 AI 直接检查病人并开处方的州,具体是一个叫 Nolla Health 的应用,看痤疮、开外用药,每月四块九毛九,全程没有医生直接监督。

白桦: 讨论里医学背景的人立场很分裂。支持者说,痤疮的诊断和开药是高度模式化的、低风险的场景,AI 做这个比让病人等三周皮肤科门诊合理,价格还便宜。反对者马上接话:一旦开了“没有直接监督”这个口子,今天的痤疮就是明天的别的病,监管的滑坡是从最无害的病例开始的。还有人问责任归属:开错药了,谁担责?应用、模型还是州政府?这个问题在讨论里没有答案。

茉莉: 好,从 AI 的能力聊到 AI 时代的秩序问题,安全、隐私和法律。这条最重磅的是 Psiphon。它是一个翻墙和抗审查工具,两千万用户。加拿大有一项法案叫 C-22,一旦通过,会强制要求这类服务的供应商在产品里植入秘密的监控接口。Psiphon 已经公开表态:法案通过,我们就撤出加拿大。

白桦: 这个表态背后的逻辑值得讲透。对一个抗审查工具来说,可信度就是全部资产。用户敢用你,是因为相信你那边没有后门。一旦法律强制你装一个连你自己都不能说的后门,等于你的产品在全球市场瞬间失去可信度,所以“退出加拿大”不是情绪化的抗议,而是商业模式上的必然。

茉莉: 讨论里的观点分布也很清楚。支持法案的一方说,现代犯罪走网络,执法部门需要合法的介入渠道,这是治安的现实。反方马上反驳,说加密后门在技术上就是给所有人留门,犯罪分子会绕开,受害的是所有普通用户,这在全球密码学界是有共识的老结论。还有人点出更微妙的一层:一个加拿大公司被迫给本国政府留后门,它在全球几十个受审查国家的用户怎么办?两千万用户不是数字,是人。

白桦: 而且没人知道抗议有没有用。法案的实施细节还没落地,评论区里加拿大网友说他们正在联系议员,最终会怎样,现在是完全未知的。

茉莉: 另一条法律新闻是加州的 1406 号法案,九月三十日签署。它堵的是所谓“蒙大拿牌照漏洞”,过去有人把车注册到蒙大拿的壳公司名下,逃避加州的车辆税。新法规定,壳公司的成员要为车辆税承担个人责任。

白桦: 讨论里这个话题意外地热闹,因为蒙大拿牌照是超跑圈流传多年的省钱秘籍,很多评论者自己就见过或者听说过。有人欢呼说早该堵了,这是明晃晃的逃税。也有人抬杠说,避税和逃税的界线本来就模糊,用州际注册规则是规则允许的玩法,加州现在溯及既往地追责,法理上站不站得住还有争议。个人责任这条是最狠的,因为壳公司没了隔离层,签字的人自己上。

茉莉: 同一个安全话题里还有一条重炮。Techdirt 写了一篇关于 Meta 的 Muse 的文章,Muse 是 Meta 的一个代理产品,但它带着对用户敏感信息的广泛访问权限。Techdirt 的判断很直接:这是严重的隐私和安全失败。

白桦: 更扎眼的是 Hacker News 上的反应。相当多的评论者说,这不是疏忽,而是这家公司的行为模式,从过去的一系列隐私丑闻看,他们说,Meta 系统性地倾向于先收集后道歉。当然也有少数声音说,把每一条产品决策都解读成恶意剧本,未免过度归因,大公司的产品失败多数还是普通的大公司式混乱。这算老争论了,但每次都会重新点燃。

茉莉: 顺手还接到 OpenSSH,因为它也属于“安全基础设施在压力下变化”这个主题。你会发现今天这三件事——Psiphon、1406 法案、Muse,说的是同一个问题的三个面:谁来为你的数据和你的安全划线。法律划线,可能划到监控去;公司划线,可能划到收集去;而 Psiphon 的选择是,宁可退场也不划那道线。

白桦: 然后我们把镜头拉远,看科学、能源和自然,这里的主题其实是“长期”这两个字。先说能源,Fervo 宣布完成了世界上第一座增强地热电站,地点在犹他州,叫 Cape Station。整个首期只用了二十三个月建成,这是规划一百兆瓦的第一个部分,而整个场地最终可以做到四个吉瓦。

茉莉: 二十三个月这个数字在讨论里被反复咀嚼。传统地热和核电项目的建设周期是以十年计的,Fervo 用的是页岩油气行业的技术,水平钻井加压裂,把油气行业的快速迭代文化搬到了地热上。评论区里能源行业的人很兴奋,说这可能是十年里清洁能源最重要的一条新闻,因为地热是极少数能提供全天候基荷电力的可再生资源,跟风光是互补的。

白桦: 也有冷静的声音。有人问,四个吉瓦是最终潜力,不是承诺,中间还有钻井成本、地震风险管控、并网排队这些硬门槛;二十三个月是首期,后面扩建的进度才是真正的考验,这一点目前没人能保证。还有人把这条和 AI 扯到一起,说数据中心要的清洁基荷电力,地热可能是最现实的答案之一。

茉莉: 同在科学这条线上,2026 年诺贝尔物理学奖颁给了 Francis Halzen,表彰的是冰立方,IceCube,以及在它探测到的高能天体物理中微子。

白桦: 给听众补个背景:冰立方是在南极冰盖里埋下的一立方公里探测器,靠的是纯净深冰当介质,捕捉宇宙深处来的中微子。它是个荒野级的大科学工程,当年很多人觉得不可能建成。

茉莉: 讨论里几个层次。物理圈的人说,中微子天文学打开了宇宙的一扇新窗,以前我们只能看光,现在能看到不 interacting 的信使,来自黑洞、超新星这些极端天体。另一批人聊的是大科学项目的耐心:冰立方从构想到拿奖跨越了三十年,这种时间尺度和我们前面聊的二十三个月建电站,是个很好的对照,有的突破靠快,有的突破只能靠慢。

白桦: 还有两个自然科学的注脚可以放在这里。一个是关于生物量的排名:按总质量算,黑云杉一种树就超过一百一十亿吨,排在所有物种第一;动物里牛最多,六亿五千万吨;人类大约三亿五千万吨,跟南极磷虾打了个平手。

茉莉: 这个数字每次拿出来都让人心里一沉。牛的重量几乎是人类的两倍,而牛是我们养的。评论区的讨论顺着就往食物系统走了。另一个是生态学的研究,说大自然“恢复”的能力被高估了:一个地方失去了物种之后,生态位不会在人类时间尺度上被快速填满。也就是说,灭绝不是删掉一个名字,而是拆掉一根承重梁,而且没有维修队。

白桦: 这两条放在诺贝尔奖和地热后面特别合适,因为它们讲的是同一个道理:有些系统破坏得很快,恢复得极慢,而人类最擅长的就是低估后者。

茉莉: 好,最后聊聊商业。两个大新闻。第一个,Paramount Skydance 完成了对华纳兄弟探索的合并,交易额一千一百一十亿美元,合并后的实体就叫 Skydance,而且挑战这笔交易的法律诉讼失败了。

白桦: 评论区里娱乐行业观察者的态度比较一致地悲观。他们的理由是:媒体行业过去十年最大的问题就是规模不解决任何问题,探索合并时代华纳就试过,剪内容、裁员、品牌稀释。现在把两个都背着重负的公司再捆在一起,一千一百亿的价签之后是巨额债务,接下来大概率是又一轮内容整合和裁员。也有少数人持相反观点,说流媒体竞争格局太碎了, consolidating 到更少的玩家手里,对订阅用户来说反而可能更清晰。

茉莉: 真正的未知是整合:两家公司的文化、片库、技术栈怎么合,合并后的第一年基本决定了这笔交易是神来之笔还是又一次-media 灾难。没人敢预测。

白桦: 第二个商业新闻对开发者的冲击更直接:JetBrains 录得了有记录以来的首次净亏损,2025 年亏了三亿一千五百万捷克克朗。但注意,营收还在涨,涨了百分之六点二六。

茉莉: 这个组合很反直觉,所以讨论特别多。一种解释指向竞争环境:AI 编码工具在分食开发者的钱包,一个订阅制 AI 助手的价格可能比一套 IDE 便宜一个量级,而 JetBrains 的产品定价模式是建立在“IDE 是最贵的开发工具”这个旧假设上的。另一种解释指向自身成本,AI 时代研发投入暴涨,收入涨百分之六、研发涨百分之三十,账就是这么亏的。

白桦: 评论区里老用户有很多感情牌,说 JetBrains 的 IDE 手感仍然是最好的,不愿看它倒下;也有人冷冷地说,软件行业的历史就是这样的,体验更好但不适应范式转移的产品,一个接一个地成为 Smalltalk。这又绕回了我们开头聊的那个 Alan Kay 的话题,技术上的优越从来不保证商业上的生存。

茉莉: 对,你看今天的整期节目,其实就是这一个母题的各种变奏。Darkplug 和 Berth 在证明个人软件可以赢,JetBrains 在提醒既得利益者会输;Mistral 在冲击前沿,Claude 在推倒数学假设;Psiphon 宁可退出也不开后门,而加州在追那些钻空子的壳公司。

白桦: 留在空中的问题也很多:AI 写的小软件能不能活过一年?Mistral 开放权重落地后会怎样?3SUM 的结果能不能推广?C-22 法案最终会不会通过?地热的四个吉瓦能不能兑现?这些问题我们都不下结论,留给时间。

茉莉: 我们也不给标准答案,节目就是把讨论摆出来。今天的所有事实都来自公开报道和讨论本身,我们的角色是把它讲清楚。

白桦: 感谢收听,我是白桦。

茉莉: 我是茉莉,我们下期见。