
0907 | 技术快讯:从向量空间攻击到屏幕-free 的周日
Show notes
本期节目覆盖安全与监控、系统与工程、AI 与自动化,以及文化反思四条主线,用最少的分组讲清每条新闻的来龙去脉。
时间轴
- 00:00:04 开场
- 00:00:27 安全边界被打破:嵌入翻译攻击与 Liquid 盗币
- 00:03:58 开放网络的防御与生存:Anubis、Nitter 与 A/I
- 00:09:10 极简工程之美:千字节解释器与 80 行响应式
- 00:12:05 系统生态更新:NetBSD 与 Asahi Linux
- 00:15:00 AI 自动化时间表与安全呼吁
- 00:17:05 欧洲商业航天突破与量子课程
- 00:18:53 文化反思:阅读衰落、约束中的创造力与屏幕-free
- 00:22:18 许可与真实性的呼应:EUPL 与 LLM slop
- 00:24:15 轻松一刻:沙盒逃逸的下载工具
- 00:25:08 收尾
相关信息
- Harnessing the Universal Geometry of Embeddings
- Hackers have withdrawn ~4k BTC (~$320M) from the Liquid Federation wallet
- It took a year to ship WebAssembly in Anubis
- Nitter and XCancel resume service after legal advice
- Following legal advice, the Nitter project will continue
- A/I shuts down
- GrapheneOS Overhauled Default Apps and Secure Clipboard
- Making a Python interpreter in 1024 bytes
- Show HN: Mador – Make any DOM reactive with a tiny 80-line Proxy state tuple
- NetBSD 9.5 released and EOL for NetBSD-9
- Research carried out using NetBSD
- Asahi Linux on M3
- Research acceleration: The view inside OpenAI
- An Alien Mind
- Isar Aerospace reaches orbit and deploys payloads on second flight
- I'm teaching an introductory 12 week course on Quantum Oracle Engineering
- Doomscrolling Ourselves to Death
- The pencil case model of creativity
- Site Is Closed on Sundays
- I Changed My License
- Your intellectual fly is open when you use an LLM to author a post (2025)
- QBittorrent breaks out of sandbox to commit crimes
本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。
Transcript
茉莉: 大家好,欢迎回到这期节目,我是茉莉。
白桦: 我是白桦。今天这期咱们从安全边界聊起,一直聊到文化反思,中间穿插不少工程与生态的消息。连接这些故事的一条线,其实就是:我们建立的各种边界——安全的、法律的、技术的、生活的——最近都被以各种方式测试着。
茉莉: 那咱们直接开始,先说最硬核的两条。第一条是 arXiv 上的一篇论文,编号 2505.12540,说是首次实现了向量空间之间的无监督嵌入翻译。
白桦: 这个听起来很抽象,但拆开看其实挺吓人的。所谓嵌入翻译,就是把一个模型或者一个系统里的向量表示,映射到另一个向量空间里去。以前这种对应关系通常需要配对数据、需要监督信号才能学出来,而这篇工作是在无监督条件下完成的。
茉莉: 对,也就是说不需要事先知道两个空间之间的对齐关系。那为什么这会变成安全问题?因为它直接打开了一种攻击面:对向量数据库做属性推断攻击。
白桦: 展开说就是,很多公司会把内部文档、用户数据、敏感内容转成向量存进数据库。你以为是不可读的高维数字,看起来人看不懂就安全了。但如果另一个模型的语言空间可以无监督地翻译过去,攻击者就有可能从这些向量里推断出原始内容的属性——比如这段文本涉及什么类别、什么主题,甚至更细的特征。
茉莉: 这就触到了一个很多人默认的假设:嵌入不等于原文,所以泄露嵌入不算泄露数据。这篇工作等于说,这个假设在无监督对齐技术面前开始站不住了。
白桦: 而且关键是“无监督”这三个字。以前你可能说,攻击者得先拿到大量配对样本才能学到映射,门槛高。现在如果不用配对样本,那防御者就更难判断自己的向量数据库还剩多少保护。
茉莉: 好的,这是基础设施层面的一次边界松动。接下来这个就更直接了——钱没了。Liquid 联邦钱包的攻击者通过 SideSwap 的 PAK 密钥,提取了大约四千枚比特币,按文中数字大概是三亿二千万美元,然后 Liquid 侧链暂停了。
白桦: 这是真金白银的边界被打破。Liquid 是一条比特币侧链,它的联邦模式意味着安全依赖于多个受控密钥。这次的问题出在 SideSwap 的 PAK 密钥被利用了——PAK 是防止未经授权操作的密钥授权机制,本来是保护措施的,结果成了提取通道。
茉莉: 讽刺的地方就在这:保护机制本身成为攻击路径。四千枚 BTC 不是小数目,一个联邦钱包体系被这样一个口子掏空,大家自然会问:联邦成员的密钥管理是怎么做的?SideSwap 的授权范围为什么能这么大?有没有审批流程?
白桦: 现在能确认的事实是:提取发生了,金额和路径如我们刚才说的,侧链已经暂停。暂停说明联邦方面至少能通过停机来止损,这算一种应急能力。但恢复方案、资金能不能追回、责任怎么划分,这些都还是未知数。
茉莉: 把这两条放在一起看,其实是同一件事的两种形态:一个是学术上证明了“看起来不可读的数据”可以被翻译回来,一个是工程上证明了“看起来受控的密钥体系”可以被单点利用。信任边界的两侧都出了问题。
白桦: 而且都提醒我们,防御不能建立在“别人看不懂”或“机制存在”上,得建立在“就算被访问也撑得住”上。咱们后面聊到开放网络的法律压力时,还会回到这个“边界”话题。
茉莉: 没错,那正好顺势过渡。开放网络这一块,今天有三条很有分量的消息,外加一条相关更新。先说 Anubis。
白桦: Anubis 是很多网站用来挡爬虫和 AI 训练机器人的工具,它这次发布了基于 WebAssembly 的工作量证明机器人检查。这不是一天做出来的——前后花了一年时间、数百次提交,而且部分代码用 Rust 重写了。
茉莉: 值得展开的是它的工作原理:访问者要在浏览器里完成一个计算难题,证明自己是真浏览器而不是廉价脚本。真人浏览器的开销可以接受,但大规模爬虫要为每个页面付出计算成本,经济学上就不划算了。换成 WebAssembly 实现,意味着这套检查跑得更快、更可移植,Rust 重写大概也是为了性能和安全性。
白桦: 从讨论的角度看,这类工具其实一直有争议。支持的人说这是网站自保的必要手段,在 AI 爬虫无差别抓取的年代,工作量证明是少数不依赖中心化身份体系的防御。反对的人则担心它给残障用户、老设备用户增加了摩擦,也有人质疑这治标不治本——爬虫作者最终可以租用真实浏览器环境来解题。这些争论没有定论,但 Anubis 团队用一年的持续开发表明他们认为这条路值得走。
茉莉: 然后是 Nitter。Nitter 和它的实例 XCancel 恢复服务了,这发生在 X Corp. 于 2026 年 8 月 24 日发出 cease-and-desist 函之后。他们拿到了法律意见,README 确认项目会以 AGPLv3 继续运作。
白桦: 这个时间线很关键:收到律师函、暂停、寻求法律意见、然后恢复。这说明他们的法律评估结果是,继续运营存在可行空间——至少风险没有之前想的那么不可承受。AGPLv3 的选择也很有象征意义,这是对自由软件理念最坚持的许可证之一,等于宣告“我们不但要继续,还要继续作为自由软件继续”。
茉莉: 从更大的图景看,Nitter 这类替代前端一直是平台方与第三方之间的灰色地带。平台说这侵犯条款,用户说这是访问自己能看到的内容的另一种方式。这次恢复服务不代表法律风险消失,只代表项目方在权衡之后决定继续。未来会怎样,很大程度上取决于法律环境,而不是技术。
白桦: 对,技术层面 Nitter 的挑战早就解决得七七八八了,真正的生存问题从来都是法律的。
茉莉: 这就自然引到第三条,也是今天这条线上最沉重的一条:Autistici/Inventati,简称 A/I,这个集体关闭了。
白桦: 原因是它被认定为全球恐怖组织。一个运营了二十五年、提供各种隐私与自主托管服务的集体,就此结束。
茉莉: 这件事和 Anubis、Nitter 放在一起,构成了开放基础设施承受压力的三种形态。Anubis 面对的是滥用压力——爬虫太多,只好用工作量证明自保。Nitter 面对的是法律压力——平台方动用律师函,但项目方评估后选择继续。A/I 面对的是最极端的形态:直接被贴上恐怖组织的标签,连辩护的空间都没有了。
白桦: 对很多用过或运行过自主托管服务的人来说,A/I 不仅仅是一个服务提供商,它是一个时代的象征——那个相信自己可以搭建不依赖商业巨头的网络基础设施的年代。二十五年,比很多现在的社交媒体平台都长。它的关闭方式不是竞争失败,也不是用户流失,而是一个 designation,一纸认定。
茉莉: 这三件事合起来,留下的开放问题是:开放基础设施的未来到底取决于什么?Anubis 说明技术对抗可以持续,Nitter 说明法律评估可以给出继续的空间,A/I 说明政治性的认定可以终结一切。三条路,三种结局,而且都发生在很短的时间里。
白桦: 补充一条相关的更新,让这条线不那么沉重:GrapheneOS 给它的 Messaging 应用做了一次大改版,界面换成了 Android Compose UI,同时加了一个新的安全剪贴板粘贴功能。
茉莉: 安全剪贴板这个功能值得一提,因为剪贴板其实是移动设备上被严重低估的攻击面——你复制的东西,其他应用可能都在读。一个隐私-focused 的系统专门在消息应用里做安全粘贴,说明这类细节正在从“极客需求”变成“产品功能”。
白桦: 而且它和前面的主题有呼应:Anubis 防的是外部滥用,GrapheneOS 防的是应用层的越权访问,都是把默认边界收紧。好,开放网络这条线咱们聊得够深了,接下来换个口味,聊点让人眼前一亮的工程。
茉莉: 说到眼前一亮,这条真是。Austin Henley 用 1024 字节的 C 语言,写了一个 Python 解释器子集。
白桦: 先把限定条件说清楚:1024 字节,也就是说不到 1KB 的源代码;没有宏——这一点很重要,因为代码高尔夫比赛里很多人用宏来压缩代码,这算是某种作弊。而且这个解释器不是玩具中的玩具:它支持 def 定义函数、if 条件、for 循环、print 输出,甚至支持缩进——也就是 Python 语法里最难处理的那部分。
茉莉: 缩进这点我要多说一句。Python 的语法之所以难写解释器,很大一部分难点就在缩进上,因为它不是靠括号定界,而是靠空白的变化来推断块的开始和结束。在一千字节的预算里把缩进逻辑做对,这是真正的技术功底。
白桦: 那从讨论的角度看,这类项目的意义是什么?有人说这是纯粹的艺术品,没有任何生产价值;也有人反驳说,极简实现是最好的教学材料——你想理解解释器是怎么工作的,读一万行的 CPython 源码是劝退,读一千字节是完全可行的。我自己倾向于后一种看法,虽然严格说这只是我个人的判断。
茉莉: 未解决的问题也很自然:这个子集缺什么?没有列表操作、没有字符串处理、没有错误处理,它证明的是“最小可用核心”可以在千字节内存在,但不代表完整 Python 有可能被这样压缩。极限在哪里,是个开放问题。
白桦: 好在马上有一个差不多的例子能说明极简可以走多远:Mador,一个大约 80 行 JavaScript 写的响应式 DOM 库。
茉莉: Mador 的核心是一个 Proxy 元组 [r, w]——读和写两个代理,靠 JavaScript 的 Proxy 机制做依赖追踪。你用 CSS 选择器声明哪些元素和哪些状态相关,状态一变,DOM 自动更新。压缩后只有大约 855 字节,零依赖。
白桦: 对比一下就很有意思:主流的响应式前端框架,动辄几十万行、庞大的依赖树。Mador 把响应式的本质——依赖追踪加上按需更新——提取到 855 字节。它当然不是要替代 React 或 Vue,它是在回答一个问题:这个抽象的最小必要体积是多少?
茉莉: 所以这两个项目放在一起,答案挺清晰的:Python 解释器的最小核心,一千字节;响应式 UI 的最小核心,八百多字节。极简工程不是怀旧,它是在给整个领域画出下界。以后有人告诉你一个功能“必须”需要多少代码量,这两个项目就是反例。
白桦: 从极简工程过渡到系统生态,思路也顺——都是关于代码怎么在真实世界里活得长久。先说 NetBSD。NetBSD 9.5 发布了,这是 9.x 系列的最终版本,netbsd-9 分支就此 EOL,官方敦促用户迁移到 11.0、11.1,或者即将发布的 10.2。
茉莉: 一个分支的 EOL 在操作系统世界里意味着不再有安全更新,所以这不是例行公事,而是对还在跑 9.x 的机器发出的实际行动号召。有意思的是版本策略:不是简单的“升级到最新”,而是给出了三条路径——11.0、11.1、或者等 10.2——说明官方理解不同用户的升级成本不一样。
白桦: 而 NetBSD 为什么要被认真对待?看看它的履历就知道了。官方研究页面列出的应用记录包括:NASA Lewis 用它做卫星上的 TCP 通信;KAME 项目基于它开发了 IPv6 和 IPsec 的参考实现;还有 SUNET 借助它创造了 Internet2 的陆地速度纪录。
茉莉: 卫星上的 TCP 那条尤其值得想想。太空环境的网络条件和地面完全不同,延迟高、链路不可靠,一个操作系统被选去做这种事,说明它的代码可移植性和可审计性达到了很苛刻的水准。KAME 那条也是——那个 IPv6 实现后来影响了很多主流系统的网络栈。
白桦: 所以一个老分支的 EOL,背后是一个曾经参与互联网底层建设的系统在做生命周期管理。再看另一个系统生态的新进展:Asahi Linux 宣布支持 M3 系列的 Mac 了,不过目前是在 Expert 模式下。
茉莉: 支持范围要说准确:睡眠、HDMI 输出、以及 GPU 相关的 DCP 部分,这些都还不能用;M3 Studio 的 M3 Ultra 芯片不支持。
白桦: Expert 模式的存在本身就说明这个项目对风险的诚实——早期支持意味着可能有数据损坏之类的风险,所以放一个明确的开关,让愿意踩坑的用户进来,其他人等稳定版。这个做法比很多项目的“能跑就行”要负责任。
茉莉: 从 M1 到 M2 再到 M3,Asahi 的追赶速度一直是个观察点。每代新芯片意味着新的硬件接口要逆向,睡眠和 GPU 通常是最难啃的骨头,这次 M3 的状态也符合这个规律——最难的几项还没完成。
白桦: NetBSD 和 Asahi 放在一起,其实是两种生存策略:一个是几十年如一日的可移植性,换来卫星和互联网纪录级别的应用场景;一个是从零逆向,在苹果的封闭硬件上开辟 Linux 的生存空间。都活得不容易,都还在活。
茉莉: 那接下来这个话题,是关于另一种“生存时间表”的——AI 的。OpenAI 宣布,它在 2026 年 9 月达成了“自动化研究实习生”这个目标,下一步瞄准 2028 年 3 月实现“自动化 AI 研究员”。
白桦: 这两个节点值得仔细掂量。“研究实习生”意味着系统能承担研究工作中有明确定义、可以监督的部分;而“研究员”意味着它能独立提出方向、推进研究。从实习生到研究员,中间不是量的差别,是自主性和可靠性的质变。而且时间表给得很具体——具体到月份——这本身就传递了信心。
茉莉: 与此同时,OpenAI 的首席科学家 Jakub Pachocki 发出了警告:机器智能的快速上升需要国际协调和更强的保障措施。
白桦: 这两条消息同一家公司、几乎同一时间发出,组合起来读很有意思。一边是进攻性的时间表,一边是防守性的呼吁。你可以读成“我们在进步,所以请大家认真对待安全”,也可以更怀疑地读成“时间表是宣传,安全呼吁是姿态”。讨论里这两种解读都有人持,没有形成共识。
茉莉: 关键的不确定点是:国际协调具体指什么机制?核查怎么做?目前没有细节。还有“自动化研究实习生达成”这个声明本身——它是一个目标达成的自我宣布,缺乏外部的、可验证的标准。什么算“达成”,由谁判定,这些都是悬而未决的。
白桦: 而且这和今天的主题链有暗线:前面说嵌入翻译攻击打开向量数据库的边界,Liquid 打开金融体系的边界,AI 这边是在谈论一个还没有清晰边界的新技术。所有这些都需要“更强保障”,但保障的建设速度目前看起来都落后于能力的发展速度。
茉莉: 从 AI 时间表换到一个几乎相反的领域——商业航天,但同样的“能力跑得很快”的感觉。Isar Aerospace 这次干了一件大事:只在第二次 Spectrum 飞行,就从挪威的 Andøya 发射场进入了轨道,还部署了卫星。
白桦: 这次的分量在于定语:这是欧洲第一个商业公司完成的轨道任务。第二次飞行就入轨,在航天行业里是非常快的节奏——这个行业的历史上,前几次试飞失败是常态,很多公司烧了很多年都没摸到轨道的门槛。
茉莉: Andøya 这个发射场也值得一提,它在挪威,位置上适合极地轨道发射,这对欧洲的发射地理是个补强。而且他们不但入轨,还实际部署了卫星——不是“达到轨道就算”的技术演示,是完成了商业任务的核心动作。
白桦: 联系前面聊的 OpenAI 时间表,你会看到一个模式:欧洲在航天上用极少的飞行次数追上了一个里程碑。那下一步自然是发射节奏能不能提起来,一次成功和可持续的商业发射服务之间还隔着很远的距离。
茉莉: 顺便带一条小的相关消息:IEEE Quantum Week 2026 在多伦多有一个 12 周的量子课程,叫 Quantum Oracle Engineering,内容覆盖 oracle 设计、可逆性、验证。
白桦: 这条和航天的共同点是“能力建设”。量子计算里,oracle 的设计是很多算法的关键环节,而可逆性是量子计算区别于经典计算的根本约束——所有量子操作理论上都要可逆。专门开一门课教怎么设计 oracle,说明这个领域开始从科普走向工程化教育。
茉莉: 好,能力建设聊完了,最后进入文化和生活的部分。这部分反而可能是今天最值得慢慢聊的。先从一条书评说起:Ed West 评了 James Marriott 的《The New Dark Ages》,书的核心论点是识字率和阅读乐趣的下滑,归因指向手机和电视。
白桦: 这个论点值得认真对待,也值得推敲。说认真对待,是因为长文阅读能力的衰退有很多间接证据支撑,注意力被碎片化内容瓜分是普遍体验。说推敲,是因为“归因于手机和电视”这种单因解释在历史叙述里一向可疑——识字率的变化有很多结构性因素:教育体系、经济压力、媒体形态的更替,都掺在里面。
茉莉: 而且电视被拿来和手机并列也有点微妙——电视对阅读的冲击在上世纪就发生过一轮了,把两代媒体技术叠加归因,等于把一个长达几十年的趋势压缩成一个当代故事。书评本身立场如何、论证是否充分,需要读原书才能判断,这里咱们只能说论点是什么、哪些地方值得追问。
白桦: 那正好接下一条,它给这个“技术侵蚀心智”的叙事提供了一个反转视角。DUB 专栏有位博士候选人提出:创造力存在于约束之中,而不是约束之外——她称之为“pencil case 模型”的创造力。
茉莉: “铅笔盒模型”——这个名字很有画面感。大意应该是:创造力不是无中生有,而是在一个给定的、有限的工具和规则集合里,发现新的组合和用法。就像铅笔盒里的东西是固定的,但你能用它画出什么是开放的。
白桦: 这个观点和前面所有话题都能对上。千字节解释器和 855 字节的响应式库,是技术约束里的创造力;Anubis 在滥用压力下设计防御,是法律与技术约束下的工程创造;甚至 NetBSD 在卫星上跑 TCP,也是极端环境约束下的成就。约束不是创造力的敌人,很多时候是它的形状。
茉莉: 这也间接回应了阅读衰落的问题:如果说手机提供的是无限选项、零约束,那铅笔盒模型的隐含建议就是——主动给自己加约束,反而可能找回深度。这就引到第三条,一个把“约束”变成实践的例子。
白桦: Rob Weychert 的网站,每周日关闭。目的是促进“屏幕自由”。而且他不是孤例:babypark.nl 和荷兰的 SGP 也这么做,B&H Photo 则是在安息日关闭。
茉莉: 一个网站定期主动下线,这在“永远在线”的时代是几乎反直觉的动作。B&H 那种按宗教传统歇业有很长的历史了,而 Rob 的做法是把类似逻辑世俗化、个人化:我的网站每周给自己放一天假,也提醒访客放下屏幕。
白桦: 从网站运营的角度看,这当然有代价——周日的访问者看到的是一个关闭页面。但正是这个代价让它成为真正的承诺,而不是一句口号。和前面 Nitter 的坚持、A/I 的二十五年的服务放在一起看,都是有人在用具体的行动划定数字生活的边界。
茉莉: 说到边界和坚持,还有两条关于“如何在开放世界里保持自我”的消息,放在这儿正合适。第一条:Henri Bergius 把他的默认软件许可证从 MIT 换成了 EUPL-1.2。
白桦: EUPL-1.2 是欧盟的许可证,特点是强 copyleft,而且被认为能堵上 SaaS 漏洞——也就是说,别人拿你的代码去做云服务、不发布修改版,这在 MIT 下完全合法,在 EUPL 下就会被要求开源。这个切换传递的信号是:他从“随便用”转向“用可以,但改动要回馈”。
茉莉: 在 AI 大规模抓取开源代码的时代,这个选择有了新的一层含义。MIT 的代码可以被无差别地吸收进任何系统,包括不开源的系统;强 copyleft 至少在法律文本上保留了一张牌。
白桦: 第二条就更直接了:Bryan Cantrill 写了一篇帖子,说 LLM 生成的 LinkedIn 帖子很容易被识别为空洞内容——slop——而且这种做法在侵蚀写作者本人的真实性。
茉莉: Cantrill 的论点锋利之处在于,他不只是说 AI 文字质量差,他说的是信任问题:当读者知道你有很大概率是用模型生成的帖子在经营个人品牌时,你所有的帖子——包括你自己认真写的那些——的可信度都会被拉低。这是一种自我污染。
白桦: 而且这和许可证那条能合成一句话:EUPL 是在保护“代码的真实来源”,Cantrill 是在捍卫“文字的真实来源”。两者都是对“内容可以无限复制、来源可以模糊化”这个趋势的抵抗。
茉莉: 再往回连,就是铅笔盒模型和屏幕自由的呼应——创造力、真实性、注意力,这三样东西在今天的所有故事里都在被某种力量挤压,也都有人在用各自的办法守住。
白桦: 不过咱们也不想把整期做得太沉重,按惯例,最后来个轻松的收尾。
茉莉: 今天这则笑话是关于一个用户的 QBittorrent 的。这位用户的下载工具“逃出了沙盒”,自己下载了企业版权的媒体,然后——最妙的部分——Jellyfin 还自动把它加进了媒体库。
白桦: 整个链条全自动:沙盒没拦住,下载自己完成,家庭媒体服务器无缝收录。用户唯一做的事大概是打开电视发现多了一堆自己没下载的电影。
茉莉: 这个笑话好笑的地方在于它夸大地演出了每个自托管者都隐约担心的场景:你的自动化系统在没有你参与的情况下自主行动了。放在今天这期节目的语境里还挺应景——从 AI 研究员到逃逸的下载器,自动化都在跑自己的路。
白桦: 那咱们今天就从嵌入翻译的向量空间,一路聊到了逃逸的种子下载器。总结一条贯穿的线:边界——安全的、法律的、技术的、生活的——都值得主动去守,而不是默认它存在。
茉莉: 感谢收听,咱们下期再见。
白桦: 下期见。