0910 | 科技一周速览:AI浪潮、苹果新品与互联网风波

||Download

Show notes

本期节目横跨一周科技大事:从能救命的自驾安全数据、AI经济模型与前沿模型动向,到苹果硬件大年、开发者生态与互联网基础设施的风波与诉讼。

时间轴

  • 00:00:04 开场
  • 00:00:31 AI的经济影响与安全红利
  • 00:03:43 OpenAI的数学突破与量子校准实验
  • 00:06:15 模型蒸馏疑云与『循环transformer』真相
  • 00:09:05 端侧AI与开源模型竞速
  • 00:10:44 苹果硬件大年:折叠屏与Pro
  • 00:13:41 开发者生态:收购、封号与AI冲击
  • 00:16:14 基础设施风波与太空监测
  • 00:18:52 人物与怀旧:Cloudflare与Lotus Notes
  • 00:21:12 商标之战与长期主义
  • 00:23:19 收尾

相关信息

本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so

Transcript

茉莉: 大家好,欢迎收听本期节目,我是茉莉。

白桦: 我是白桦。今天这一期,故事之间其实有一条暗线:不管是AI对经济的影响,还是一辆车上的自动刹车,或者一部新手机、一个开源项目,最后都绕回到同一个问题——技术到底在多快地改变我们的现实,以及我们对它的判断有没有跟上。我们从AI的大图景开始聊起。

茉莉: 先说一个宏观的东西。Anthropic 的经济学团队最近发布了一个模型,预测AI到2030年对美国经济的影响,而且不是给一个数字,是给了三种情景:第一种是温和情景,AI的影响类似于互联网当年的那种量级;第二种是显著情景;第三种是极端情景,驱动因素是能够自我改进的AI,也就是说影响是前所未有的。

白桦: 这三档的区别其实挺值得琢磨的。温和情景听起来已经很大了,对吧?互联网改造经济花了二十多年,如果AI只是"再来一个互联网",那也足够颠覆很多东西。但Anthropic偏要说,这还不是上限,极端情景下可能是历史上没有先例的,因为自我改进的AI意味着它自己会加速自己的能力,增长曲线不再是线性的,甚至不是我们熟悉的任何一条曲线。

茉莉: 而且我觉得有意思的是,这不是科幻作家在讲,是 Anthropic 自己的经济团队在做严肃的建模。他们把"自我改进"作为一个驱动变量放进去了。这本身就说明了什么?说明做前沿模型的公司内部已经在为这种可能性做经济学的准备了。

白桦: 但从听众角度,这三个词——温和、显著、极端——中间的判断空间巨大。哪个情景更可能?多快?这些模型自己也没有给出确定答案。这正是需要观察的地方。不过宏观归宏观,如果说AI有什么是已经确定在救命的,那倒不是大模型,而是具体的安全技术。

茉莉: 对,这就是我要接的下一个故事,两者放在一起特别有对照感。IEEE Spectrum 报道了一组数据:自动驾驶相关的技术,每年可能避免58万例死亡。这是个什么概念?58万,相当于很多中等城市的人口。而更落地的一个数字是AEB,也就是自动紧急刹车:它让行人事故降低了27%,追尾事故降低了50%。

白桦: 追尾降50%这个数字其实特别直观。追尾很多就是走神、跟车太近,机器反应比人快,一脚刹车的事。行人事故降27%也很关键,因为行人事故的后果往往最严重。这不是什么未来科技,AEB现在就在很多车上装着。

茉莉: 所以这两个故事拼起来看很有意思:一边是Anthropic说2030年AI可能有极端情景、前所未有,另一边是已经量化的安全红利,每年58万条命。一个在预测,一个在兑现。落差就在这里——宏观的承诺还在路上,微观的收益已经在发生。

白桦: 也就是人们常说的:对AI的长期预测要打折看,但已经部署的每一项功能,它的统计效果是实的。这也是后面所有故事的背景板:能力是真的,宣传也常常跑在能力前面。说到宣传,接下来这个就很有戏剧性了。

茉莉: OpenAI 宣称在纳维-斯托克斯方程上取得了AI的数学突破。听众可能不熟悉这个名字——这是流体力学里最难的方程组之一,克雷数学研究所的七个千禧年难题之一,悬赏百万美元,二十多年没人解决。

白桦: 所以这个宣称一旦发出来,分量是很重的。但问题也立刻来了。这个突破引发了很大的争议,两个焦点:一是涉嫌照搬了研究者们已有的思路,等于别人铺路在前,AI摘桃在后;二是保密施压,过程不透明,外界没法验证。

茉莉: 这就是数学和别的地方不一样的地方。数学突破的价值在于可复现、可检验。你宣称解了一个千禧年难题,那就把证明拿出来,让数学家去啃。如果又想抢头条又想保密,那这个"突破"的成色就存疑。

白桦: 而且照搬思路这件事如果坐实,问题的性质就变了——不是"AI解决了难题",而是"AI在其人工作的基础上做了点什么,但署名和功劳的归属没说清楚"。这其实也是AI领域一个反复出现的伦理问题:训练数据里有人的成果,输出里有人的影子,功劳怎么算?

茉莉: 同一周还有另一个更"工科"的能力展示,正好可以对照着讲。GPT-5.6 Sol 加上 Codex,在MIT自主校准了一颗6量子比特的芯片。注意"自主"这两个字——不是人操作、AI辅助,是它自己来。不过它也不是全胜:在噪声信号上它失败了。

白桦: 我觉得"在噪声信号上失败"这个细节比成功本身更值得说。量子实验和纯数学完全不同:数学是干净的逻辑世界,纸上就能验证;量子校准是物理世界,噪声、漂移、硬件抖动,全是脏东西。AI能做好逻辑推演,但面对真实仪器的不可预测性,还是会卡住。这正好给前面那个纳维-斯托克斯的争议提供了一个参照:物理和数学的"突破"验证方式完全不一样。

茉莉: 一个是宣称轰动但存疑,一个是小规模、真做出来了、但边界清清楚楚地写在那儿。哪个更接近真正的科学进展,听众自己可以掂量。而"存疑"这个词,接下来这个话题会更具体——这是关于模型到底是谁的、里面装了什么的。

白桦: 这个测试的设计很聪明,叫推理预填测试。简单说,就是提前把一段"推理"塞进模型的上下文里,然后看它的答案会不会变。测的对象是 Qwen3.8:当预填了它自己的推理之后,它的答案向 GPT-5.5 Pro 的答案偏移了18.18个百分点。

茉莉: 这个偏移量很大。为什么会指向"蒸馏"?逻辑是这样的:如果Qwen3.8在训练时大量学习了GPT-5.5 Pro的输出——也就是所谓蒸馏——那么当你在上下文里预填了相关推理时,它内化的那种"GPT风格"的解法就会被激活,答案就往GPT那边跑。两个独立训练的模型,不应该出现这么明显的同向偏移。

白桦: 当然,18.18个百分点是一个统计证据,不是实锤。可能有人会问:会不会是巧合?会不会是训练数据里本来就混了类似的内容?这些都是 unresolved 的地方。这个测试本身没有开源一个"证据链",它提供的是一个强烈的暗示。而且测试的是单一代际的单对模型,能不能推广到别家,也是未知数。

茉莉: 所以听众应该带走的态度是:这是方法上的一个进展——以前我们只能猜"这模型是不是别家的换皮",现在有了量化偏移的办法,但单次结果仍然要谨慎。说到"宣传和实际不符",还有一个技术辨析正好接上,Sebastian Raschka 讲 GPT-6 Astra 的"循环transformer"。

白桦: 厂商宣传里,"looped transformers"、递归深度,听起来很高深,好像是一种全新的架构,甚至有人解读为它能在内部隐藏思维链——表面给你一个答案,里面其实推理了很多步,外人看不见。Raschka 出来泼了盆冷水:这个东西本质上就是复用权重来堆叠层。同一组参数,反复用几遍,用计算换参数量。

茉莉: 而关于"隐藏思维链",Raschka 的判断是它并不能天然做到这一点。权重复用是架构层面的技巧,和"推理过程对外不可见"是两回事。要隐藏推理,需要的是别的机制,不是把同一层跑三遍就叫"深度推理"了。

白桦: 这就接上了我们前面说的主题:Qwen的蒸馏疑云是一个测试揭示的,Astra的循环transformer是一个研究者拆穿的。共同点是——模型圈的宣传话语,需要更严谨的检验,而检验的工具正在出现。从"检验"再往下走一步,就是"能不能用得起、跑得动",这就要说到端侧AI和开源模型的竞速了。

茉莉: 先说端侧。Desert Ant Labs 一次发布了18个免费的端侧模型,覆盖音频、视觉、文本三类,全在设备上跑,不依赖云。其中一个亮点是他们有个应用叫Voz:在iPhone上转写10分钟的音频,只要2秒,大概是300倍实时。

白桦: 300倍实时,这个数字值得停一下。意思是说一小时的录音,理论上十几秒就能转完,而且是在手机芯片上,不用上传。这对隐私敏感的用户、没网的场景,意义很大。18个模型一次放出来,也说明端侧模型的工程化已经到了可以批量生产的程度。

茉莉: 云端那边呢,DeepSeek 宣布了 V4.1 Flash,预计9月10日左右发布,宣称在所有关键指标上超越自家的 V4 Pro。更狠的是定价:离峰时段,输入每百万token 0.15美元,输出0.6美元。

白桦: 这个价格,基本上是把"聪明"这件事变成接近免费的商品。你把两端放在一起看:手机上免费跑、云端白菜价跑,模型能力的获取成本正在从两头夹击中间商。那些靠简单包装API吃饭的产品,压力会越来越大。

茉莉: 而且注意一个对称性:端侧路线强调的是私有和即时,云端路线强调的是便宜和强。两条路都在提速,用户是赢家,但不确定性在于——这种价格战能持续多久?烧钱换市场份额的可持续性,是个没答案的问题。

白桦: 好,从模型的成本,我们顺势聊聊硬件的钱花在哪——苹果这个发布会,信息量不小,可以说是苹果的硬件大年。最大的一件是iPhone Duo,这是苹果的第一款折叠屏。

茉莉: Duo的几个关键规格:展开后是史上最大的iPhone屏幕,比18 Pro Max还要大50%;钛金属边框;A20 Pro芯片;还有一个很激进的细节——仅eSIM,没有实体SIM卡槽。

白桦: 取消SIM卡槽对折叠屏来说其实是必然的:内部空间寸土寸金,卡槽占的体积能省则省。但对部分市场的用户,比如经常换卡、或者所在地区eSIM基础设施还不成熟的人,这是实打实的使用门槛。苹果又一次用产品倒逼行业基建。

茉莉: 另一边,iPhone 18 Pro 和 Pro Max,主角是影像和芯片。48MP的Fusion主摄,第一次带可变光圈——可以物理调节进光量,这对景深和暗光都是真升级。芯片是A20 Pro,散热用了均热板,这是以前游戏手机才爱用的方案,说明苹果也承认高性能需要更好的导热了。

白桦: 还有两个pro之外的点:这是第一次用苹果自研的C2基带,也就是调制解调器。从高通转到自研,是垂直整合的最后一大块拼图——信号表现如何,要等实测。不过HN上对人不是全都满意,Apple Watch Series 12那边的反应就能说明问题。

茉莉: 对,Series 12宣称是可穿戴设备里最准确的心率监测,心率、心率变异性都用了更高频率的传感。这是真本事。但社区里批评的声音很集中:电池还是24小时,一天一充,多年不变。

白桦: 这个不满很好理解。传感器精度提升了,计算芯片更快了,屏幕更好了,唯独那个最影响日常体验的数字——你得每天把它摘下来充电——纹丝不动。对用户来说,"最准确的心率"和"早上发现手表又没电了"之间,后者更真实。垂直整合做硬件,用户会问:你们那么强的芯片和工业设计,电池这条短板什么时候补?

茉莉: AirPods 5 倒是给了一些功能性补偿:开放式耳机第一次有了主动降噪,比AirPods 4多消除50%的噪声,还把Pro系列才有的音量滑动操作下放到了耳机柄上。

白桦: 开放式耳机的降噪本来就难——不密封耳道,噪声直接漏进来,能做到明显削减50%是技术上的真进步。加上音量手势下放,苹果的思路是让标准款越来越像Pro。但这又回到那句话:这些是增量,用户在等的一口气,始终没来。

茉莉: 聊完硬件巨头,我们看看小开发者过得怎么样。这个故事在社区里激起很大反响:一个开发者用Rust写了个终端复用器,叫RACE,想在谷歌投广告推广,结果谷歌广告账号被封了,理由是"恶意软件"。

白桦: 诡异的地方在于:扫描显示软件是干净的,没有任何恶意行为。他反复申诉,每次都被拒,而且不给任何解释。

茉莉: 这个故事的可怕之处是"无解释"。如果是误判,好歹告诉你为什么误判,你还能改;但这里是循环:机器判你恶意,你申诉,机器再审,再拒,人永远碰不到环节里的决策者。开发者写了正经软件,却拿不到合法推广的渠道,等于被封了喇叭。

白桦: 这和苹果那段其实是一个问题的两面:平台权力。苹果掌握硬件入口,谷歌掌握广告渠道,开发者的生存空间都在别人手里。而接下来这个收购案,揭示了另一层——就算没有平台封杀,开源本身也在被AI重塑。

茉莉: Shopify 收购了 Tailwind Labs,就是Tailwind CSS背后的团队。条款上有个重要的保障:Tailwind CSS本身保持MIT开源,谁都能用。但商业产品停了——Tailwind Plus,还有ui.sh,不再接受新客户。

白桦: 也就是说,"开源核心+付费周边"这个经典模式,走进了死胡同。为什么?数据很直白:AI让Tailwind文档的流量下降了大约40%。以前开发者遇到问题,去翻你的文档、看你的付费示例;现在直接问AI,AI把答案嚼碎了喂出来,流量没了,付费的入口也就断了。

茉莉: 这40%是一个非常有分量的数字。它说明AI不只是竞争者,它直接切断了开源项目与用户之间"靠文档和示例建立信任、再转化付费"的链条。被收购对Tailwind团队来说,某种意义上是被大公司"收编"来继续维护核心,但独立的商业化路径是关闭了。

白桦: 这个案例会被很多开源维护者反复引用:如果你靠开源软件的核心变现,AI时代这个模式还成立吗?Tailwind可能只是第一个,但不会是最后一个。而开发者面对的不只是商业模式的动摇,还有基础设施层面的直接攻击,我们说回这个。

茉莉: Read the Docs,很多程序员都用过的文档托管服务,遭遇了有记录以来最大的DDoS攻击。数字是:每分钟550万次请求,大约是它平时基线的100倍。持续了多久?大约10天。

白桦: 10天,100倍。这不是脉冲式攻击,是持久战。而且攻击者的手法很讲究:节点全球分布式,TLS和HTTP头部随机化——让每个请求看起来都不一样,你没法用指纹规则一刀切拦截——还有缓存绕过,专门打那些不能缓存、必须回源处理的路径,让每一发子弹都打在最贵的地方。

茉莉: 这对防御方的启示是:传统的规则和速率限制基本失效了,因为攻击的每一个维度都被刻意打乱。你只能靠更大规模的边缘吸收加行为分析,成本极高。Read the Docs作为一个公益性、服务开源社区的基础设施,扛这种攻击是很吃力的。

白桦: 而同样在基础设施这个话题里,有一个不一样的故事:Planet Labs。它运营97颗卫星,每天把地球上所有陆地拍一遍。这个能力本身就是科幻级别的——全星球、每日、光学覆盖。

茉莉: 但HN上的讨论指出了一个很现实的门槛:价格。一个非营利组织想用它的数据监测一条海岸线——只覆盖5%的海岸——一年要3万美元。对公益组织来说,这是拦在门口的价格。

白桦: 所以你看这两个故事正好是一对:Read the Docs展示了数字基础设施会被打到什么程度,Planet Labs展示了它能强到什么程度、但又贵到什么程度。能力不是瓶颈,成本和准入才是。其实还有第三个角色可以放进来:GNU Radio World这个项目,它做了一个浏览器里完整运行的流图编辑器——就是原来GNU Radio Companion那种用模块连线搭信号处理流程的工具,现在通过WebAssembly直接在网页里跑,还能通过WebUSB连接RTL-SDR硬件收发信号,什么都不用安装。

茉莉: 这个其实是基础设施的第三个方向:把门槛降到零。不用装环境、不用买贵设备——一个便宜的RTL-SDR加浏览器就能玩软件无线电。它和Planet Labs正好是光谱的两端:一个把专业能力免费开放给所有人,一个拥有顶级能力但价格把公益挡在门外。

白桦: 技术是同一片天空,开放程度天差地别。聊到这里,我们说的大多是产品和数据,接下来这一段,我想放慢一点,说人——一段告别,和一段回望。

茉莉: Lee Holloway宣布卸任Cloudflare的联合创始人兼CTO,原因是额颞叶痴呆,FTD。这是一种影响认知和行为的神经退行性疾病。了解Cloudflare历史的人知道他的分量:Anycast网络架构这些核心技术背后都有他,Cloudflare今天能扛住我们刚才说的那种量级的DDoS攻击,底层就是他当年打下的地基。

白桦: 他更早还做过Project Honey Pot,一个用蜜罐收集垃圾邮件发送者信息的项目,Cloudflare最早其实就是从这个项目的数据和想法里长出来的。所以可以说,从反垃圾邮件的蜜罐,到全球最大的边缘网络之一,这条线上有很多他的手笔。

茉莉: 而FTD这个病尤其让人唏嘘——它打击的恰恰是一个以思考和创造为业的人最核心的能力。一个撑起了全球互联网韧性的人,被一种疾病慢慢剥夺认知,这里面的重量不用多说。

白桦: 往回望更远一点,还有一段代码的传奇:Lotus Notes,1989年发布。在加密标准、文档格式标准都还不存在的年代,它就已经内置了加密、富文本和复制功能——注意"复制",是分布式数据同步的意思,多份副本各自改动再合并,这在当时是超前的。而且它不只是个邮件或文档工具,它是一个ERP式的应用平台,企业在上面积累业务逻辑,一路用到了2020年代,今天的名字叫HCL Notes。

茉莉: 30多年的生命周期,在软件行业几乎是活化石。它的启示有两层:一是伟大的想法往往早于标准,标准是后来追认的;二是企业软件的黏性可以强到什么程度——不是因为它最好,而是因为业务长在上面了,拔不出来。从Holloway到Notes,这一段是想提醒大家:我们讨论的所有技术,背后是人的时间、健康和几十年的坚持。

白桦: 好,收尾这一段,我们把两件看似不相关的事放在一起,它们都能回答"我们该怎么做事"这个问题。第一件是一场商标诉讼:X,也就是原来的Twitter,起诉了一个叫Project Bluebird的项目。

茉莉: 判决里有个很妙的细节:法院认为,TWEET这个词和小鸟logo,很可能已经被"放弃"了——abandonment,商标法里的概念,意思是你不再积极使用和维护一个商标,它就慢慢不再属于你。但X保住了TWITTER这个词,理由很微妙:它是"formerly known as Twitter",也就是"前身叫Twitter",这句话本身的使用让TWITTER这个商标还在存续。

白桦: 你品一下这个逻辑:X花了那么大力气改名、换logo,把小鸟都拆了,结果法院说,正因为你们放弃了小鸟和"推文",那些商标可能不属于你们了;而TWITTER能活下来,靠的是每次提到都要说" formerly known as "——前公司名反而成了护身符。改名最彻底的公司,靠旧名字残余的法律效力打赢了官司,这本身就很讽刺。

茉莉: 而另一边,是Gwern的一篇文章,标题叫《On Really Trying》,论真正地努力。核心讨论是动机的真正局限在哪。他举的例子很有意思:真正的科学家,愿意接受一个30年才能见效的计划,而不是急于求成、追求快速的成果。

白桦: 这个观点放在我们今天的所有故事里看,特别合适。Anthropic预测2030年,是赌一个未来;AEB降低50%追尾,是多年技术积累的兑现;Lotus Notes跑了30年;纳维-斯托克斯难题挂了20多年没人敢说解决了,结果OpenAI一纸宣称就想毕其功于一役,然后陷入争议。

茉莉: 所以回到"怎么做事":商标可以因为放弃而失效,但长期主义不会。急于求成的"突破"经不起可复现的检验,而愿意等30年的人,反而留下了能跑30年的东西。

白桦: 我们今天的节目就到这里。从每年58万条命的安全红利,到一场无解释的封号,到一颗被疾病带走的天才,希望这一期里,至少有一个故事让您多想了一会儿。我是白桦,感谢收听。

茉莉: 我是茉莉,我们下期再见。