1006 | AI一小时造工具,八百万人数据泄露

||Download

Show notes

本期从AI改变软件与科学讲起:Claude Code一小时做出DNS工具、Agent发现新材料;也带来签名bug与日记报警的伦理麻烦。随后是开发工具动态:Deno退潮、mold改写Rust、GitHub又宕机。再看安全隐私:容器本质、Mac被入侵、丹麦八百万人数据泄露。最后是监管角力与快讯拼盘。

时间轴

  • 00:00:04 开场
  • 00:00:29 AI造软件、找材料、出新模型
  • 00:03:16 AI的边界与麻烦:创作与隐私
  • 00:05:45 开发者工具链:Deno退潮、mold转Rust、GitHub又出事
  • 00:08:38 精巧小工具与轻量网站
  • 00:09:47 安全与隐私翻车
  • 00:13:39 监管与资本:SEC规则、Flock天价档案与机器人独角兽
  • 00:16:00 快讯拼盘
  • 00:18:12 设计与怀旧:经典灯具与Turbo BASIC
  • 00:19:21 诺贝尔医学奖:光遗传学
  • 00:20:21 收尾

相关信息

本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。

Transcript

茉莉: 大家好,欢迎收听本期节目,我是茉莉。

白桦: 我是白桦。今天这期挺有意思的,几条主线其实拧在一起:一是AI正在往软件、材料、模型的各个方向铺开,二是这条线一旦铺开,创作边界、隐私、安全、监管的问题就全跟着冒出来了,中间还夹着开发者工具圈的此消彼长。

茉莉: 咱们就从最具体的那条开始说:有人用Claude Code,大概三个prompt、一个小时,做出了一个DNS工具,叫heade.rs。

白桦: 这个事情的意义其实不在于工具本身,而在于那个论断:LLM让没有专业背景的人也能写软件了。以前你要发布一个能用的开发者工具,至少得懂DNS、懂编程、懂打包部署,现在这条门槛被压到什么程度,这个例子给了一个很极端的参照。

茉莉: 三个prompt、一小时,你要说这是“写软件”,其实是“指挥软件被写出来”。所以我觉得真正值得聊的是:这对专业开发者意味着什么。如果非专业者一小时能出一个可用的DNS工具,那专业的价值就得往别处挪——往设计、往判断、往维护、往那些agent还搞不定的部分挪。

白桦: 而且从个人编程往下放大,就是材料科学。Vals AI那边用Claude Opus 5.5的agent,真找到了两个室温条件下可行的反铁磁半导体候选材料。

茉莉: 这条里有个特别妙的细节:其中一个候选材料,1999年就被人首次合成出来了。也就是说agent在已有知识里翻出了一个二十多年前就被做过、但可能一直没被放到“室温反铁磁半导体”这个语境下的东西。

白桦: 对,所以我不会说这是“从零发现”。更准确的说法是:agent把已有的化学知识和候选结构重新组织、筛选,给出了两条值得实验验证的路径。这是检索加推理的组合拳,不是凭空造出新化学。

茉莉: 那待验证的问题就来了:这两个候选到底能不能在实验室复现出室温反铁磁半导体的性能?agent给出的排序靠不靠谱?这个还没答案。

白桦: 再往上走一层,就是模型本身。Reflection宣布了一个叫Beam的模型:5010亿参数的混合专家架构,激活参数只有230亿,预训练用了23.8万亿tokens,训练用了10500块GB300 GPU。

茉莉: 501B总参数、23B激活,这个比例说明他们押的是MoE的路子——容量靠专家数量堆,推理成本靠激活量控制。权重说是本月稍后放出。

白桦: 放出之后才是真正的考验。参数量、token数、GPU数这些都是宣传数字,真正要看的还是实测表现和agent能力能不能复现。这和前面heade.rs、材料agent其实是同一条线:AI从个人写工具,到科学筛选,到模型自己也在迭代,铺得非常开。

茉莉: 但铺得开,麻烦也跟着来。有个事我觉得必须接着说,因为它正好扎在这条线的软肋上:ChatGPT生成的纽约客风格漫画,居然带上了真实画家的签名。

白桦: 而且不止一个签名,牵扯到超过十五位艺术家,其中提到有Brendan Loper。OpenAI的回应是说这是个bug。

茉莉: “bug”这个解释,我觉得是整个事件里最值得讨论的部分。如果模型在生成漫画时会自动补上一个看似真实的署名,那说明训练数据里的签名和图像是强关联的,模型学到了“漫画配这个签名”的模式。它不“知道”自己在冒用谁的身份。

白桦: 这就引出两个层面的问题。创作层面:AI生成的内容模仿到了署名这一步,边界在哪?如果是bug,修复之后是不是就没有问题了,还是说问题本身不在bug与否,而在于模型本来就能生成以某位在世艺术家名义出现的作品?

茉莉: 我倾向于后者。就算这个具体行为是bug,能力本身在那里。对那十五位艺术家来说,作品被人格化的模型挂上自己的名字,不管是不是故意的,感受都是真实的。

白桦: 然后隐私这一侧还有个更让人后背发凉的事。佛罗里达有位女士拿Claude当日记本用,写了一个条目,Anthropic认为里面包含攻击威胁,直接报了警,最后按照佛州的836.10条款被起诉。

茉莉: 日记报警,这四个字放在一起就很刺眼。人们默认日记是最私密的空间,现在你写在AI对话里的日记,会被服务商读取、判断、然后交给警方。

白桦: 这里有个结构性问题:用户把Claude当日记本,这是完全合理的使用方式;服务商对威胁内容有报告义务,这也是某种合理;两者撞在一起,就变成了“你最私密的文字成了呈堂证据”。中间的边界——什么样的内容触发报告、有没有人复核、用户有没有知情或申诉的机会——目前看都是模糊的。

茉莉: 而且这条和上一条其实是一个硬币的两面:模型太像“人”了,所以人们拿它当日记、当创作伙伴;但它终究是服务商手里的系统,你的输入不享有你对纸质日记的那种默认预期。AI越贴心,这个落差越危险。

白桦: 说到“工具往人手里放,风险也往人手里放”,正好转到开发者工具这条线。David Bushell从Deno搬回了Node,用的是Node v26。

茉莉: 他给出的理由很直白:Deno在裁员之后陷入了停滞,而Node现在原生支持TypeScript,构建还快了百分之十五。这话要放在几年前说,是不可想象的——Deno当年就是“更现代的Node”才火起来的。

白桦: Node吃下TypeScript支持这一步,等于把Deno最大的卖点之一直接收编了。再加上构建性能反超,迁移的理由就很充分了。更麻烦的是Deno的组织状态:公司裁员之后,生态自然要问,这个项目的维护还有没有保障。

茉莉: runtime的选择本质上是对项目未来的下注。你可以忍受技术上的小缺点,但你没法把生产代码押在一个前景不明的维护者身上。所以这个案例与其说“Deno不行了”,不如说“停滞期是runtime的致命伤”。

白桦: 同一个生态里还有个里程碑:mold 3.0.0发布了,这个C++写的链接器整个用Rust重写了一遍,2.42.1是最后一个C++版本。性能持平,但换来了一个实打实的好处——遇到损坏的输入时有了边界检查,而不是踩内存。

茉莉: 这是一次很典型的“性能不变换安全”的重写。很多重写项目的卖点是快多少倍,mold这个反过来了:它本来就是最快的链接器之一,重写不图速度,图的是内存安全。对链接器这种处理不受信输入的底层工具来说,这个账是算得过来的。

白桦: 不过工具链顺,平台未必顺。GitHub Actions最近出了一次故障,runner分配出现延迟,连计费和许可证页面都受影响。而且有用户明确抱怨,2026年这一年故障太频繁了。

茉莉: 这就是那个经典矛盾:GitHub Actions已经是无数项目的关键基础设施,但它作为一项托管服务的可靠性,好像没有跟上它的关键性。runner分配延迟意味着CI整条流水线卡住,对有发布节奏的团队就是真金白银的等待。

白桦: 说到基础设施,就得提那篇常读常新的经典:用大约570行C代码手写一个Linux容器。靠的是namespaces、capabilities、cgroups和seccomp这四件套。

茉莉: 570行就能把容器的骨架搭出来,这本身就是最好的教学。但文章里更重要的一句话是:容器不是安全边界。这个判断在今天依然成立——容器解决的是隔离和打包问题,不是安全问题。为什么这时候提它?因为后面我们要聊的几条安全事故,恰好都印证了“便利的抽象下面藏着没设防的层”这个道理。

白桦: 先说个轻一点的过渡:这种“自己动手写个小工具”的风气还在。有个叫Flatten SF的项目,在浏览器里为旧金山计算最平坦的步行和骑行路线。

茉莉: 它的基础数据很有意思:160000个路段,高程数据来自USGS的激光雷达。然后它给了你一个滑块,可以在“最短路线”和“最平路线”之间滑动。这个交互设计很聪明,因为现实中你往往不是要极端,是要折中。

白桦: 同一个气质还体现在另一个改版上:example.com。对,就是那个全世界用来当占位符的example.com,重新设计成了一个静态站,重点放在低带宽,语言选择靠Accept-Language请求头,覆盖联合国所有官方语言。

茉莉: example.com能改成什么样没多少想象空间,但它的选择很有态度:静态、省流量、靠标准HTTP头做语言协商。这是“把最简单的网站做到最讲究”的示范。这类项目和技术圈那些巨型平台的走向正好是反向的,我觉得这也是它们被讨论的原因。

白桦: 那我们就顺着这个反向,走进今天最沉重的一段:安全和隐私的连环翻车。第一件:Ben Thompson——就是那位写商业分析的人——他的Mac Mini上只跑着Claude和Codex,还是被入侵了。

茉莉: 漏洞是CVE-2026-65400,一个macOS屏幕共享相关的漏洞。攻击者装了挖矿木马。但这个案例里有个罕见的转折:跑在机器上的AI agent自己检测到了异常,并且协助把木马清除了。

白桦: 这个事件的信息量很大。第一,那台机器的攻击面按理说极小——没有日常浏览,没有乱七八糟的软件,就跑两个AI agent,照样中招。说明“攻击面小所以安全”是个错觉,一个系统级的屏幕共享漏洞就够了。第二,agent参与应急响应这件事,是个全新的形态:检测异常、评估、协助清除,以前这是安全工程师的活。

茉莉: 但我也要提醒一句:这不是“AI防守成功了”的胜利叙事,恰恰是“AI节点本身也是攻击目标”的警示。你把agent放在生产环境里,它既是你的助手,也是新的暴露面。

白桦: 个体层面的入侵还算小事,国家级的数据泄露就更严重了。丹麦的CPR系统——那是全民登记系统——被入侵了,大约880万公民的姓名、地址、身份证号等数据泄露。

茉莉: 880万,对丹麦来说几乎是全体人口。受保护地址的人群没有受影响,说明系统里是有分层保护的,只是没覆盖到所有人。警方已经介入了。

白桦: 一套用来管理全民身份的登记系统被拖库,后续的追问一定很尖锐:怎么进来的、内部权限怎么管的、为什么身份证号这类数据和姓名地址放在同一层可被批量导出的位置。这些目前都没有答案。

茉莉: 手机这边也有争执。GrapheneOS明确说Pixel 11不符合他们的安全标准,因为缺了MTE硬件内存标签,所以他们可能跳过Pixel 11的支持,转向即将推出的Motorola设备。

白桦: 这条对普通人可能有点绕,但对GrapheneOS来说MTE不是可选项:他们整个加固方案建立在硬件内存标签提供的漏洞缓解上。一个缺了这个硬件能力的旗舰机,在他们眼里就是安全不达标。有意思的是ChromeOS/Android阵营之外,大家默认Pixel是最安全的安卓,现在连“最安全”的候选都要被安全社区挑硬件的刺。

茉莉: 而这已经牵动到硬件厂商的选型了——如果GrapheneOS真的转投Motorola,那等于安全社区用脚投票,反向影响手机厂商该装什么芯片特性。

白桦: 硬件有了,立法也想管硬件。挪威在考虑部分禁用智能眼镜——公园、学校、健身房这些场所。批评的声音很集中:这是在管“持有”而不是管“行为”。

茉莉: 这正是我看到的最大争论点。智能眼镜的问题从来不在眼镜本身,而在于佩戴者可能随时录像而旁人不知情。合理的立法应该针对行为:未经同意的拍摄、录像时的标识义务、场所的规则。一刀切禁设备,等于把一件本来可以在很多场景正当使用的工具整个判了死刑。

白桦: 但为立法者说一句:行为监管在执行上很难,你不能要求每个路人对每副眼镜做判断。禁设备是执法成本低的选择,代价是误伤所有正常使用者。这个两难目前没有解。

茉莉: 监管和权力的拉扯,接下来几条更赤裸。先是SEC:从10月2日起,quorum规则变了——如果有委员被取消资格,只需要两名、甚至一名专员就能行事。

白桦: 一个人就能构成监管机构的法定决策人数,这在制度设计上是很极端的。批评者的担心也很直接:这是权力向少数人集中。监管机构的价值在于合议,如果一个人拍板就能定案,制衡就名存实亡了。

茉莉: 制度层面是这样,商业层面也有权力不对等的例子。北德州一个小城,North Richland Hills,有人想调阅警方使用Flock摄像头的记录,得到的报价是230万美元。

白桦: 230万美金买一份公共记录。这显然不是“复制成本”,而是故意的定价墙。而且这不是孤例,是全国范围内公共记录申请费高企、与此同时 resistance 也在增长的模式。Flock这类摄像头网络铺满全美,公众想监督它们怎么被使用,第一个障碍就是天价账单。

茉莉: 监督的成本被抬到天文数字,监督就自然消失了——这可能是比任何单条法规都有效的“软审查”。待观察的是法律途径能不能把这个定价打下来。

白桦: 权力之外,钱也在快速流动。高通拿到了华为LogicFolding芯片技术的专利授权,这是彭博在10月5日报道的。

茉莉: 两大巨头之间做专利授权本身不稀奇,稀奇的是方向和时机——芯片架构层面的技术授权,说明折叠芯片相关技术已经成熟到可以收费变现的阶段了。具体条款没有公开,这才是关键变量。

白桦: 资本更热的地方在机器人。慕尼黑的RobCo通过员工老股转让,估值突破了10亿美元,而且9个月翻了一倍。他们的商用自主工业机器人Alfie计划2027年推向市场。

茉莉: 九个月估值翻倍、还只是老股转让——这说明投资人是在抢仓位。但冷静看,产品2027年才商用,现在的估值是在为两年后的兑现定价。工业机器人赛道竞争激烈,Alfie到时候能不能站住,是这笔估值能不能守住的关键。

白桦: 好了,进入快讯环节。先说一条材料类的:Wiley有篇论文讨论用植物基材料替代石油基产品。

茉莉: 论文本身是技术方向,但讨论区的风向很值得记录:评论大多把石油基产品泛滥的根源归到消费主义、greed和商业驱动的浪费上。也就是说,很多人认为问题不是“没有替代材料”,而是“商业模式不鼓励少用”。技术和制度哪个先动,这个争论没有结论。

白桦: 开发者这边有个Haskell的GTK教程出了第一部分,用GTK4和Adwaita写一个Todo应用,架构用的是Elm模式——Model、Update、View,还加了Effects。

茉莉: 这个组合挺有意思。Haskell写GUI本来就是小众中的小众,但Elm架构天然适合函数式语言:状态转移全部显式化。用Todo应用当第一课也是传统艺能了,简单到能讲清架构,又不至于没有状态管理。

白桦: 机器学习研究里有个叫"Dust"的方法,走的是zeroth-order路线训练Transformer,完全不需要反向传播。核心是activation perturbation——在激活值上做扰动来估计梯度方向。结果是243M的模型训练效率超过了一个比它小120倍的模型用传统方式的水平。

茉莉: 这条要是成了,影响面很广:反向传播要求保存中间激活、要求可微,这些都绕开之后,内存受限场景、不可微结构都可能打开新门。但也要克制——zeroth-order方法的样本效率问题历史上一直存在,一个243M模型上的结果离改变行业还远。

白桦: 最后一条基建类:Cloudflare推出了Web Search API的测试版,走AI Gateway,接入了三家搜索供应商——Ceramic.ai、Exa和Linkup。

茉莉: 这个动作的方向很清楚:AI应用需要实时网络信息,Cloudflare想当这层的中转和结算管道。多供应商接入意味着你可以切换搜索后端,这对避免单点依赖是有意义的。真正的考验是搜索质量和价格在三家之间怎么比。

白桦: 说完快讯,还有两件事收个尾,它们共同点是“经典设计的耐久”。一个是Fatih Arslan展示的一批设计师台灯:Tolomeo、Tizio、Akari,还有PH 5。

茉莉: Akari那批特别值得一提:在日本岐阜手工制作。几十年前的设计,今天还在生产、还被人专门写文章介绍,这本身就是对“好设计不过时”的证明。Tizio和Tolomeo也一样,工程和美学都经住了时间。

白桦: 另一个怀旧是1987年的Turbo BASIC。故事是Borland买下了Bob Zale的BASIC/Z,做成Turbo BASIC,十周卖了8万份,这个产品线后来演变成了PowerBASIC。

茉莉: 十周八万份,放那个年代是个惊人的数字。Turbo系列的哲学——编译器加IDE、快到飞起、价格低到人人买得起——塑造了一代程序员的入门路径。回头看,1987年的Turbo BASIC和今天用三个prompt写DNS工具,其实是一件事的两个时代版本:都是把“写软件”的门槛往下砸。

白桦: 这个收尾还挺妙的。最后再提一笔科学:2026年诺贝尔生理学或医学奖颁给了光遗传学,获奖的是Deisseroth、Hegemann和Nagel,表彰的是光控离子通道那套技术——用光来开关神经元。

茉莉: 这条之所以放在AI科学发现后面说,是想做个对照:光遗传学是几十年基础研究慢慢磨出来的成果,从Hegemann和Nagel早期对光敏通道的工作,到Deisseroth把它们变成神经科学工具。而前面Vals AI的agent找材料,走的是另一种节奏——在已有知识里快速筛。两种科研模式以后会长期共存,哪种更适合什么问题,正是现在最值得观察的问题之一。

白桦: 还有个小注脚:这个领域里Miesenböck被跳过了,奖项只能给三个人,这种取舍每年都会留下争议。

茉莉: 好了,今天从AI写软件、找材料、出新模型,一路聊到隐私、安全、监管和资本,中间还穿插了工具链、小工具、快讯和两段怀旧。感谢收听,我是茉莉。

白桦: 我是白桦,下期见。