
1011 | 科技快讯集:开源、AI 责任与健康新政
Show notes
本期节目串起十几条科技动态:从自托管与开源工具的新选择,到AI时代的决策责任与行业整合,再到数据基础设施、住房与健康领域的进展,最后是几个有趣的证书与安全小故事。
时间轴
- 00:00:04 开场
- 00:00:40 自托管与开源工具的新选择
- 00:06:13 AI 决策:能力、责任与行业整合
- 00:09:49 数据与系统基础设施的再思考
- 00:13:02 住房政策:模拟器与税制
- 00:15:21 健康与安全:疫苗、饮食与数据泄露
- 00:18:52 证书的故事:支票与 UNIX 认证
- 00:20:40 收尾
相关信息
- WallHop – 12ft.io is gone, so I built a replacement
- Talorys – A self-hosted personal AI agent on Cloudflare's free tier
- Bitwarden Dual License Model
- Build your own decision model
- Computers Cannot Make Decisions
- Nvidia in talks to acquire US 'open' model startup Reflection AI
- Why DuckDB 2.0 is faster
- Unikernels were hard. key word: were
- A city-building game in which the city would prefer you didn't
- I would like the value of my home to rise, while my property taxes fall
- PVX-001: open-source Covid-19 vaccine starts Phase 1 trial
- Food processing influences metabolism and brain activity
- `123456' password used in Danish CPR data breach
- Knuth reward check
- Apple/macOS removed from official Unix registry
本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。
Transcript
茉莉: 大家好,欢迎收听这一期的节目,我是茉莉。
白桦: 我是白桦。今天我们挑了几条过去一天里最值得聊的东西,它们看起来分散,其实有一条暗线:你用的工具、你依赖的系统、你承担的责任,到底由谁掌控,由谁说了算。
茉莉: 对,从开源许可的岔路,到人工智能的责任归属,再到数据库底层和住房政策,甚至还有支票和认证这种有趣的老故事。我们一条条聊,尽量把每个话题聊透。那我们就从最贴近日常的开始吧,WallHop。
白桦: WallHop 这个项目挺有意思。它是 12ft.io 的免费替代品,不需要注册就能用。12ft.io 当年很火,就是帮人绕过新闻网站付费墙的东西,后来渐渐式微了。WallHop 本身是 fork 自 ladder 这个项目的,ladder 用的是 GPL-3.0 许可证。但有意思的地方在于,WallHop 目前还没有开源。
茉莉: 这就是最微妙的一点了。fork 一个 GPL-3.0 的项目,按照许可证的义务,如果你分发它,通常得遵守相应的开源义务。所以「fork 自 GPL 项目但尚未开源」这个状态,天然会引起讨论。评论区里最典型的两种声音:一种是「先用起来再说,工具好用就行」;另一种是「license 不是装饰品,尤其是 GPL,它代表的是一种承诺」。
白桦: 而且大家关心的是时间线问题。项目是「尚未」开源,还是「不会」开源?这两个词之间的差别很大。如果是还没来得及,那社区可以耐心等;如果是不打算开,那 fork 自 GPL 这个出身就会变成一个持续被追问的问题。目前能确认的事实就是:免费、无需注册、fork 自 ladder、GPL-3.0 出身、还没有开源。后面的走向是开放的。
茉莉: 我觉得这里值得展开讲讲 GPL 和 MIT 的差别,因为接下来两个话题正好是一边一个。GPL 这类「著佐权」许可的核心是:你用了它、改了它、分发了它,你就得以同样的方式开放你的改动。它是一种强制互惠。而 MIT 是另一种哲学,几乎只要求保留版权声明,其他随你。WallHop 的争议来自前者,而我们接下来要聊的 Talorys,用的正是后者。
白桦: 对,Talorys 正好是光谱的另一端。它是一个个人 AI 代理,可以自己托管,部署方式非常诱人:一条命令,部署在你自己的 Cloudflare 账户上。MIT 许可,没有遥测。
茉莉: 「没有遥测」这四个字在评论区是加分项。因为现在很多「自托管」产品,声称自托管,实际上还是会打电话回家,上报使用数据。Talorys 明确说没有遥测,等于把信任的默认值设成了零依赖。你部署在谁那里?你自己的 Cloudflare 账户。数据经过谁?你自己的账户。这在隐私敏感的用户群里是很有说服力的。
白桦: 不过也有一条很实际的声音:把 AI 代理部署在 Cloudflare 上,等于你的代理的生命周期绑在 Cloudflare 的服务和价格上了。这不是遥测问题,是依赖问题。你确实自托管了,但托管在一个巨头的基础设施上。这算不算真正的自主,不同人有不同答案。有人说「数据在我账户里就够了」,有人说「运行时在别人的平台上,就不算完全自主」。这个争论没有定论。
茉莉: 而且 MIT 许可在这里就没有争议了吗?其实也有,只是换了一种形式。MIT 意味着任何人可以拿它做闭源分支、加遥测、商业化,然后以同样的名字推给用户。开源自由是有了,但「用户看清自己用的是哪个版本」的责任就完全落在用户自己头上了。
白桦: 这句话正好可以接到第三个话题,Bitwarden。Bitwarden 宣布,应用商店里的版本将作为商业许可的构建发布,而 GitHub 上的 GPLv3 版本继续存在。
茉莉: 这就是所谓的「商店版与源码版分家」。实际发生的调整是:你去 App Store 或者各家商店下载的 Bitwarden,未来是商业许可的构建;而完整遵循 GPLv3 的版本继续在 GitHub 上。Bitwarden 的官方立场是开源部分没有消失,GPLv3 版本还在。
白桦: 评论区对此的反应大致分三层。第一层是理解的:一个密码管理公司要养活一整套基础设施,加密、同步、审计,全都要钱,商店版商业化是一种可持续的尝试。第二层是警惕的:一旦商店版和 GPL 版在功能上出现差异,普通用户根本分不清,他们会默认商店版就是「官方完整版」,而那个版本不再受 GPL 约束。第三层更悲观,担心这是渐进式脱钩的第一步。
茉莉: 反驳的声音会说,GPL 版本的存在本身就是保险。只要 GitHub 上那个分支活着,社区随时可以基于它构建自己的客户端。这和 WallHop 形成了镜像:一个是 fork 自 GPL 却未开源,一个是 GPL 版本继续存在但商店版走向商业许可。方向相反,问题同源。
白桦: 同源在哪里?在于「开源许可如何在便利、商业模式与自由之间取舍」。用户真正要做的动作只有一个:搞清楚自己装的是哪个版本。是 GitHub 上的 GPLv3 构建,还是商店里的商业构建?是官方的 Talorys,还是某个加了料的分支?
茉莉: 而 WallHop 那边,接下来值得关注的就两件事:它会不会开源,以及如果开了,是不是完整地遵守了它 fork 自的那个 GPL。
白桦: 好,工具聊完了,我们转向一个更根本的问题:决策。Jev 这个项目展示了一种很有意思的技术:通过限制 LLM 可以输出的 token,来模拟一个受限的决策模型,而且输出是经过校准的。
茉莉: 说的直白一点:不让模型自由发挥一大段话,而是把它的输出空间收窄到几个明确的选项上,相当于强制它在一个决策框架内做选择。这样做的好处是可预测、可校验,输出不再是自由文本,而是结构化的、可以审计的决策。评论区里做工程的人对这个思路普遍有好感,因为它把「模型说了什么」变成了「模型选了哪个」,后者要容易验证得多。
白桦: 但紧跟着就有一个非常尖锐的反方向观点:程序本身不做决定。把责任推给一个 LLM,本质上是「决策漂白」。真正的决定是某个人在某个时刻授权的,责任也在那个人身上。
茉莉: 这两个说法放在一起看很有张力。Jev 那条线说的是「能不能让模型做决策」,答案是技术上可以做到受限且校准。另一条线说的是「应不应该让模型承担决策责任」,答案是不应该,因为责任无处安放。你不能起诉一个模型,也不能让模型道歉,更不能让模型坐牢。
白桦: 所以有评论者的立场是:任何把「AI 决定」写进事故报告或者免责条款的做法,都是在转移责任。你买了那个系统,你部署了它,你选择了相信它的输出,每一步都是人的决定。校准做得再好,也只是降低了出错的概率,没有改变责任的结构。
茉莉: 我觉得这个观点在工程圈和法务圈的接受度很不一样。工程圈有人觉得这是哲学洁癖,系统就是系统,出了问题查根因就行。但从治理角度看,根因可以指向一个 bug,责任却必须指向一个决策,而决策只能由人和组织做出。
白桦: 然后把镜头拉远到行业层面:Nvidia 正在洽谈收购 Reflection AI,一家做开放模型的初创公司。这引发了关于垂直整合的担忧,大模型生态的控制权,正在向少数公司集中。
茉莉: 这一条和前两条连起来看特别有意思。能力在变强,决策框架在收紧,而生态的拥有者越来越少。Reflection AI 是做开放模型的,如果它被一家芯片和系统层的巨头收购,「开放」这个属性还能保持多久、以什么方式保持,就是一个合理的疑问。这里要强调:目前只是「洽谈收购」,还没有成交,走向是未知的。
白桦: 评论区在这个问题上的分歧是真实的。一派认为垂直整合不必然是坏事,芯片、模型、应用在一家手里,可能反而推进得更快,开放模型也未必因为换了东家就关门。另一派认为历史教训够多了,一个关键环节的公司被上游巨头吸收后,通常的结局是逐步收紧,最终服务于母公司的整体战略而不是社区。
茉莉: 而且争论里还有一个更抽象的问题没人能回答:如果未来大部分决策由模型辅助甚至代理,而模型的生态由极少数公司掌握,那么「责任在人」这个原则虽然正确,但人手里的选择空间还剩多少?这是整个讨论最没有答案的部分。
白桦: 这个问题悬着,我们先不硬答,往下聊一个更具体但同样根本的层面:运行栈本身正在被重造。DuckDB 2.0 引入了异步 I/O。
茉莉: 具体机制是这样的:一个专门的线程组负责下载,其余的线程继续解码。下载和解码不再互相等待。效果是读取 S3 上的数据从 18.8 秒降到了 7.7 秒,快了一倍多。
白桦: 这个优化的思路值得展开。以前的分析型数据库从远程存储读数据, basically 是串行的:等数据到,再解,再算。瓶颈 clear 地在网络上。DuckDB 的做法是把网络等待从关键路径上摘掉,下载在后台持续进行,计算单元永远有事做。评论区里做数据工程的人的反应大多是「早该如此」,因为类似的思想在操作系统和网络栈里存在了几十年,只是数据库引擎直到现在才普遍采纳。
茉莉: 也有人提出更远的问题:当 I/O 不再是瓶颈之后,瓶颈会转移到哪里?解码?CPU?还是内存带宽?DuckDB 这个改动可能只是第一块多米诺骨牌。
白桦: 而 Ghuntley 的文章把「重造运行栈」推到了更激进的程度:unikernels 正在回归。核心论点有三条:AI 消除了构建 unikernel 的门槛;unikernel 缩小攻击面;传统操作系统正在沦为技术债。
茉莉: 逐条说。unikernel 就是把应用和它需要的最小内核打包成一个单一地址空间的镜像,没有多用户、没有 shell、没有一堆你用不到的驱动和服务。攻击面自然就小,因为不存在的东西无法被攻击。
白桦: 那为什么以前没成?因为构建和维护一个 unikernel 太难了,你得自己搞清楚依赖、编译、调试。Ghuntley 的观点是,AI 正好消除了这个门槛:那些曾经需要专家才能搞定的整合工作,现在可以让 AI 辅助完成。所以判断是:不是技术变了,是成本变了。
茉莉: 「操作系统是技术债」这个说法在评论区是最有争议的。反对者说,通用操作系统是几十年工程智慧的结晶,进程隔离、权限模型、生态兼容性,这些不是债,是资产。支持者说,对某一类工作负载,比如一个只做一件事的网络服务,通用操作系统提供的大量能力既用不上,又是攻击面和维护负担,对这些场景来说就是债。
白桦: 两边其实没有真正交火,因为他们在讨论不同的负载。像 DuckDB 这种追求极致性能的数据库引擎,和unikernel 的哲学其实是相通的:去掉一切你不用的东西,把资源留给核心工作。这两个话题放在一起,「重造运行栈」的趋势就立住了。
茉莉: 未解的问题也很明确:unikernel 生态能否借 AI 真正成熟?工具链、调试器、可观测性、人才储备,这些不是单靠 AI 就能补齐的。这是一个值得持续跟踪的判断,不是一个已经验证的结论。
白桦: 从系统栈换个方向,聊一个完全不同的领域,但骨子里是同一个问题:制度设计如何塑造结果。旧金山有个项目叫 Discretionary Review,是一个住房模拟器。
茉莉: 它特别的地方在于:每一个地块背后都是一场真实的听证争议,里面用到的法律和案例都来自公共记录。你玩这个游戏,实际上是在重演真实的审批过程。而「Discretionary Review」,自由裁量审查,正是旧金山住房审批里最被诟病的机制:任何一个项目都可能被拉进逐案审查,邻居可以提起申诉,一个本已合规的项目就这样被拖住。
白桦: 玩过或者研究过这个模拟器的人,最深的感受通常是:问题不在于某一条规则太严,而在于「逐案审批」这个结构本身制造了不确定性。开发商面对的不是一套清晰的规则,而是一场可能输掉的听证。于是他们把风险算进成本,项目变得更保守,或者干脆不做了。
茉莉: 而税制那篇报道从另一个角度印证了同一件事:美国的税制改革降低了对业主的税负,却把负担转移到了商业地产上,结果反而推高了住房成本。
白桦: 这听起来反直觉,值得拆开讲。改革的意图可能是好的,给有房家庭减负。但商业地产税负上升之后,那些成本会沿着经济链条传导。商业空间更贵,最终会传导到住宅市场,让住房更贵。一个瞄准业主的减税,最后伤到了租客和想买房的人。
茉莉: 和模拟器放在一起,结论就很清晰了:住房难题不只在供给,也在制度设计的意外后果。审批制度制造拖延,税制改革制造转移,两边的初衷和结果都对不上。这也是为什么这类讨论里很少有人呼吁某个单一政策,更多人谈的是系统性的 unintended consequences。
白桦: 而且模拟器提供了一个税务报道给不了的东西:具身体验。你读一篇税制分析,知道逻辑;你在模拟器里为一个地块打一场听证战,你才理解那种消耗感。知识和体感是两回事。
茉莉: 好,接下来我们把视野收回到每个人自己的身体和数据上,三个看似不相关的话题其实都在讲风险管理。先说疫苗。PopVax 在 I 期临床中为首位志愿者接种了 PVX-001,这是一款广谱新冠疫苗,而且能在 2 到 8 摄氏度之间稳定保存。项目完成后将开源。
白桦: 这个组合在评论区几乎是全点赞的。广谱意味着它针对的不只是单一变异株,而是更广的一类病毒特征,这在疫苗设计上是一个更高的目标。2 到 8 度稳定意味着它不需要极端冷链,这对分发到基础设施薄弱的地区是决定性的。而「开源」用在疫苗上,等于把配方和工艺公开,任何人都可以复现和改进,这对公共卫生的意义和开源软件对软件行业的意义是同构的。
茉莉: 当然要强调的是,这只是 I 期临床的第一剂接种,安全性和免疫原性的数据还没有出来,离验证有效还有很长的路。开源的承诺也是「项目完成后」兑现,不是现在。
白桦: 从疫苗转到餐桌。弗吉尼亚理工做了一个对照研究:超加工食品和营养素匹配的非超加工食品,引起了不同的代谢和大脑反应。
茉莉: 关键在「营养素匹配」这四个字。以前批评超加工食品,最常见的反驳是「那是因为它糖多盐多热量高,不是加工本身的错」。而这个研究的设计把营养素对齐了,两组食物在营养指标上匹配,结果代谢反应和大脑反应仍然不同。这说明食品加工方式本身有独立的影响,不只是营养成分的问题。
白桦: 这也是为什么这篇研究的讨论价值高。它把争论从「少吃糖」推进到「怎么加工的也很重要」。当然,机制是什么、影响有多大、能不能推广到长期健康结局,这些都还是开放问题,一项研究不能定论。但它至少把「加工」从一个模糊的贬义词,变成了一个可以测量的变量。
茉莉: 从身体转到数据。丹麦的 CPR 数据大规模泄露,起因竟然是密码「123456」。
白桦: 这个案例的冲击力在于它的平凡。CPR 是丹麦的个人编号系统,相当于全国身份信息的基础。这么重要的系统,防线在一个最弱的环节上被击穿,而那个环节不是什么零日漏洞,是人类用了四十年的最差密码。
茉莉: 评论区的共识倒是比较一致:这不是技术问题,是基础卫生问题。强制密码策略、多因素认证、账号锁定,这些几十年前的措施如果能到位,这一整类事故就不会发生。有人把它和前面聊的疫苗冷藏链类比:广谱疫苗再先进,如果冷藏断了就全废;系统再复杂,如果密码是 123456 就等于没有门。风险管理最贵的教训往往出在最便宜的失误上。
白桦: 这三个话题放一起讲风险管理的意思就出来了:疫苗管的是生物风险,饮食研究管的是长期健康风险,泄露事件管的是数据风险。共同点是,最重要的防线往往不是最尖端的那个,而是最基础的那些。
茉莉: 对。最后我们用两个关于「凭证」的小故事收尾,它们看起来是轶事,其实和今天所有的主题都有关。第一个,Knuth。
白桦: 高德纳几十年来的传统是:谁在他书里发现错误,他寄一张支票作为奖励。现在这些支票已经变成虚构的圣塞里夫银行证书。圣塞里夫银行当然不存在,它是一个想象中的国家里的想象中的银行。
茉莉: 所以今天的支票不能兑现,但它的价值反而更高了,因为它成了一种荣誉凭证。得到过 Knuth 支票的人,不会去银行,会裱起来。这很有意思:凭证的价值不在于它能不能兑换,而在于它由谁签发、代表什么。
白桦: 第二个故事更微妙。macOS 至今仍然持有 UNIX 03 认证。但在 Open Group 的官方注册表里,你查不到它。
茉莉: 结果调查下来,推测是网站本身的渲染故障。认证是真实存在的,只是注册表页面上显示不出来。
白桦: 这两个故事并排放,得出的那个观察很漂亮:证书和凭证如何被阅读与误读,表面缺失不等于事实不存在。Knuth 的支票不可兑现,却是最高荣誉;macOS 的认证真实存在,却在官方名单里「消失」。
茉莉: 而且回头看,这正好呼应了我们今天所有的话题。WallHop 没开源,但你得先确认事实再下判断;Bitwarden 商店版换了许可,你得看清你装的是哪个版本;macOS 在注册表里找不到,不代表认证不在。信息时代最基本的能力,是区分「看起来是这样」和「确实是这样」。
白桦: 好,今天就到这里。我们聊了开源许可在便利与自由之间的取舍,AI 的能力与责任,运行栈的重造,住房制度的意外后果,身体与数据的风险管理,最后用两张凭证收尾。
茉莉: 感谢收听,我们下期再见。
白桦: 再见。