0728 | HackerNews每日沙龙:误判、AI开放与Kimi开源

||Download

Show notes

本期节目从加拿大一起因警方漏看用户名下划线导致无辜者入狱十八个月的误判案切入,随后聚焦 AI 领域:Anthropic 主张前沿开放模型应与闭源模型接受同等安全评估引发争议;月之暗面开源三万亿参数混合专家模型 Kimi-K3;Claude Opus 5 出现 529 过载错误。此外还讨论了谷歌 DMCA 反抓取被法官驳回、AI 公司破坏性获取稀有书籍、宇航员长期任务后的解离体验、奈飞团建信任练习致员工被解雇,以及车队平台安全漏洞、Bun Rust 重写进展、DConf 2026 和 VLC Unity Linux 支持等话题。

时间轴

  • 00:00:00 开场
  • 00:00:40 一个下划线,十八个月冤狱
  • 00:01:55 Anthropic 开放权重模型立场文件引发争议
  • 00:03:06 Kimi-K3 开源:三万亿参数混合专家模型
  • 00:04:31 Claude Opus 5 出现 529 过载错误
  • 00:05:07 AI 公司「撕碎」稀有书籍来扫描
  • 00:06:23 本地运行开放模型:怀旧还是现实?
  • 00:07:49 微软 MAI-Cyber 与 Opus 5 的 SlopCodeBench 基准测试
  • 00:08:49 法官驳回谷歌用 DMCA 阻止数据抓取
  • 00:09:51 奈飞员工团建信任练习后遭解雇
  • 00:10:46 车队平台漏洞:厂商沉默应对白帽报告
  • 00:11:29 Bun 用 Rust 重写进展引热议
  • 00:12:16 DConf 2026 伦敦举办,VLC Unity 获 Linux 支持
  • 00:13:37 宇航员与潜艇兵共有的「旁观者」解离感
  • 00:15:12 创客角:沼气转化、背景去除、太阳能板与告别 React

相关信息

本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so

Transcript

茉莉: 欢迎收听Bri旗下的播客——HackerNews每日沙龙,我是茉莉。

白桦: 我是白桦。今天我们来聊聊几个值得关注的话题。

茉莉: 一名加拿大男子因为警方遗漏用户名中的下划线,被错误监禁了整整十八个月,法官将此事定性为严重误判。

白桦: Anthropic发布了对开放权重模型的立场文件,主张前沿模型无论开放还是闭源,都应该接受同等的安全评估。月之暗面也开源了Kimi-K3,一个总参数约三万亿的混合专家模型。好,我们开始吧。

白桦: 一个下划线的缺失,让一个无辜的人在监狱里待了十八个月。

茉莉: 这起事件发生在加拿大。警方在网络巡查时发现暗网上有毒品交易信息,用户名显示为 jesse_burns——注意,中间有下划线。但警方在追查时,把这个用户名误判成了 jesseburns,也就是没有下划线的版本。

白桦: 就凭这一个字符的差异,警方关联到了一个 IP 地址,然后锁定了这名完全无辜的男子。他坚称自己清白,但加拿大法院在缺乏直接关联证据的情况下,仅凭 IP 地址和聊天记录,就判了他两年少一天的监禁。

茉莉: 审理此案的法官已经将调查定性为"严重误判"。法律评论员指出,这起案件暴露出两个关键问题:一是辩护方没有有效质疑把 IP 地址对应到具体个人的技术缺陷,二是法庭上也缺乏技术专家来厘清这些数字证据到底归属于谁。

白桦: 这个案子现在已提交复审。警方所使用的 IP 定位技术的准确性,正面临专业审查。目前还无法确认,侦查过程中是否还存在其他类似的身份匹配错误。

茉莉: 接下来这条关于 AI 监管的争论也很有意思。Anthropic 发布了一份文件,叫做《我们对开放权重模型的立场》。核心主张是:如果一个开放模型的性能接近前沿水平,比如达到了当前闭源顶级模型的水准,那它就应该接受和闭源模型一样的安全评估。

白桦: 具体来说,Anthropic 提了三点。第一,呼吁各国政府为所有高能力模型——不管是开放的还是封闭的,也不管来自哪个国家——制定统一的安全测试标准,同时给低能力模型留出豁免空间。

茉莉: 第二是"分级发布"的设想:如果一个模型被认为风险极高且还没达到合规要求,那就只能以封闭方式访问。

白桦: 第三点用"蒸馏"作为论据,担心大量低成本的衍生模型会迅速出现,绕开出口管制进入美国市场。

茉莉: 这三点在 Hacker News 上引发了非常直接的批评。有读者说,这些提议本质上就是用监管来压制开源竞争者,同时阻止中国模型进入。还有人认为,第三点本身就是在主张增加新的管制措施,蒸馏只是一个靶标。

白桦: 接下来看看模型领域的新进展。月之暗面发布了 Kimi-K3 的技术报告,并且开源了这个模型。

茉莉: Kimi-K3 用的是原生 MxFp4 混合专家架构,总参数量大概三万亿,激活参数一万亿。这意味着实际部署需要大约一点五 TB 的显存——在八张 B200 的边缘,更现实地说,需要十六张才能跑起来。

白桦: 这也意味着推理成本会直接反映一个三万亿参数模型真实的美元每百万 Token 区间。社区里有人在说,市场可以拿这个数字当作标尺,去判断各家实验室的 API 定价是不是在烧钱补贴。

茉莉: 性能方面,在 AISI 网络安全基准上,Kimi-K3 超过了 GLM-5.2,但仍然明显落后于最好的闭源模型。这可能意味着后续还需要微调来追平差距。

白桦: 社区关心的还有几个具体技术问题:比如在包含工具输出和重试的真实编码智能体轨迹上,端到端的吞吐和成本表现怎么样;多轮分支对话场景下缓存命中率和预填充成本如何;训练后路由负载分布有没有出现专家坍塌;以及是不是最好等托管平台推出微调 API,而不是直接跳到 GRPO 或 DPO 这类离线策略强化方法。

茉莉: 最后来看一条服务状态的消息。Claude 状态页面的公告显示,Claude Opus 5 出现了 529 过载错误,这属于服务端的问题。

白桦: 用户那边的反馈也值得注意。有人反映 Opus 5 在编码方面不够可靠,每次使用都会引入大量回归问题,甚至在规划阶段就能检测到回归,所以干脆不实际实施了。

茉莉: 讨论里还提到一个实用的做法:可以通过 CLAUDE.md 文件来告诉它测试套件怎么跑,这算是一个减轻回归问题的小技巧。

茉莉: 最近有个讨论挺有意思,把AI公司获取稀有书籍的方式,直接类比成弗诺·文奇科幻小说《彩虹尽头》里的一个情节。

白桦: 《彩虹尽头》?我记得那本小说里确实有过一个挺极端的设定——「撕碎后扫描」工厂。

茉莉: 对,就是那个。在小说里,反派短暂用过这种破坏性扫描手段,因为手段太过了,很快就被无损扫描技术给取代了。

白桦: 放到今天的语境里,这个对比其实挺扎眼的。评论里就有人指出,AI公司为了获取训练数据,真有点那种「撕碎后扫描」的做派。

茉莉: 是,Hacker News上的讨论直言不讳,说AI公司正在撕碎稀有书籍——虽然这是个比喻,但指向的是那种不可逆的数据获取方式。

白桦: 不过讨论里也给出了一个更积极的路径,有人提到安娜的档案这种非破坏性数字保存项目。

茉莉: 对,评论认为从长远来看,支持这一类非破坏性数字存档,才是对人类知识传承最有利的举措。

白桦: 所以整个讨论传递的信号是,AI训练数据的获取方式,是不是正在从一个很粗暴的「撕碎后扫描」模式,慢慢转向对文献实体可持续存档的尊重?

茉莉: 说到AI圈的讨论风气,Hacker News上最近有个帖子挺典型。有篇文章讲本地运行开放模型的体验,标题叫「用开放模型的感觉出乎意料地好」。

白桦: 但评论区不太买账。有位用户叫loire280,直接质疑说,文章作者受雇于一家AI基础设施公司,而且是在那家公司的设施上跑Kimi K3——整篇读起来更像是营销,而不是真实的体验分享。

茉莉: 这个质疑引发了另一层讨论。用户irishcoffee观察到一个趋势,他说Hacker News社区花了很长时间,才重新接受「自行搭建服务」的理念。

白桦: 他的对比挺生动的——15年前这里的人还在编译内核、折腾Gentoo发行版,近来的风气却变成了「你应该直接付钱,比自己运行这些东西便宜」。

茉莉: 有人甚至戏谑地建议,「直接rsync你的Dropbox」,言下之意就是干脆云上搞定省心。

白桦: 但loire280做了个很实在的分析。他说当年自己编译Linux几乎零成本,任何一台闲置电脑都能做;现在呢,花超过五千美元买电脑来勉强跑本地模型,这跟「黑客」动手乐趣的初衷,好像已经不是一回事了。

茉莉: 当然讨论里也有人简单提了一句,说运行自托管模型既容易又便宜。不过从整体氛围看,这个观点在当下显然不是主流。

茉莉: 接下来看两个模型相关的新动态。微软发布了内部的AI安全模型MAI-Cyber-1-Flash。

白桦: 不过社区对它的开放权重持观望态度。评论指出,MAI系列短期内不会开放权重,有人猜测微软可能要延迟两到三个发布周期之后才开源。

茉莉: 作为替代,讨论里有人提到了思科的Antares模型,但它的「大」版本也才3B参数——规模上明显不是一个量级。

白桦: 另一边,有个针对Opus 5的新基准测试SlopCodeBench也引发了讨论。有开发者调侃说,「终于有我需要的基准了」。

茉莉: 反馈集中在Opus 5改进有限这一点上。不少用户说怀念Opus 4、Opus 4.6,还有那个叫「Fable」的版本——就是据称在特朗普政府干预之前的体验。

白桦: 需要说明的是,目前这只是快速低成本的首轮尝试,后续计划纳入更多模型和语言,现在的结论还不能算是定论。

茉莉: 最后来看一个法律层面的重要裁决。法官驳回了谷歌试图用《数字千年版权法》,也就是DMCA,来阻止自己被数据抓取的企图。

白桦: Techdirt报道了这个案子。法院拒绝了谷歌的做法,相当于在说,你不能用DMCA当盾牌来规避别人抓你的数据。

茉莉: 这个案子里暴露了一个挺矛盾的立场。有评论指出,谷歌自己的抓取行为是尊重robots.txt的,而且不会去破坏验证码。

白桦: 但被起诉的SerpAPI呢?评论描述它依赖的是类似恶意软件分发的终端用户代理,专门从那些明确拒绝抓取的来源摄取数据——性质完全不一样。

茉莉: 所以这个裁决其实直接触碰到了当前AI数据获取实践合法性的争议核心。

白桦: 一边是有边界的抓取,一边是无视边界的数据摄取,法院现在画出了一条线。这条线对接下来整个AI行业的数据获取方式,都会有直接的影响。

茉莉: 下一个故事来自奈飞。一名员工在公司团建活动中被解雇,原因听起来让人有点难以置信——他在一个"信任练习"环节里坦露了自己的个人经历。

白桦: 据纽约邮报等美国媒体报道,这名员工分享了自己通过某项医疗程序帮助应对父母离世的故事。结果团建结束后,公司直接把他解雇了。

茉莉: 这件事引发了不少讨论。有评论指出,团建活动的氛围虽然比办公室轻松,但职场的权力结构并没有改变。你以为可以坦诚相待,结果反而踩了雷。

白桦: 但如果大家都不敞开心扉,这类活动又容易流于形式,根本达不到真正促进了解的目的。这其实是一个两难的局面。

茉莉: 现在这件事已经进入了法律程序。这名前员工已经提起诉讼,主张奈飞的解雇行为不当。后续怎么判,值得关注。

白桦: 接下来看看安全领域的一个案例。一名研究人员今年11月3日向VECV——也就是Volvo和Eicher的合资公司——报告了其车队平台的一个漏洞。

茉莉: 但是VECV在11月10日和11月17日两次都没有回应。直到11月20日,相关内部API被切断,主要漏洞才得到修复。

白桦: Hacker News上的评论者对此不太满意,认为VECV这种冷淡的回应方式不利于未来的安全研究。还有人甚至建议,这样的漏洞还不如直接出售给中间商。

茉莉: 这个建议背后其实反映了一种无奈:当厂商不重视白帽研究者的报告时,漏洞披露的整个生态都会受到影响。

白桦: 再来看Hacker News上一个关于Bun的热门讨论。有人在问:Bun用Rust重写的进展到底怎么样了?

茉莉: 这篇文章的作者tomlockwood先为文中的图表道了歉。他解释说,图表统计的是提交中涉及的Rust文件数量,而不是提交总数。比如一次提交涉及3个文件、另一次涉及2个,图表就计为5。

白桦: 当有人追问这个方法和实际数值有多大差异时,作者也很坦率,说他不确定,承认这只是用git log粗略拼凑出来的计数器。

茉莉: 讨论里的评论也很有意思。有人说,在科技公司工作过的人不看文章也知道答案。另一条回复则更直接,说答案是对多数用户来说它最终会正常运行。

白桦: 最后来看两个来自开发社区的消息。D语言社区宣布DConf 2026将在伦敦举办。社区成员评价不一,有人说这门语言"不错",而WalterBright直接称它为"最优雅的语言"。

茉莉: gregdaniels421对会议议程提出了看法,指出首日偏重LLM,同时他对Phobos 3标准库提出了具体期望:希望更贴近betterC方向,提供默认的RAII向量类和哈希表,并进一步借鉴C++的移动和复制语义。

白桦: destructionator则回应说,OpenD方面近两年前已经在Emscripten上交付了druntime,除线程和异常外支持所有功能,测试基于emcc 3.1.69。

茉莉: 另外,VLC for Unity最近也增加了Linux支持。作者martz表示,这个版本通过GLX与EGL使用OpenGL渲染,并利用DMA-BUF纹理共享向Unity渲染器高效传递视频帧,支持完整硬件解码。

白桦: 目前仅支持x86_64架构,未来计划添加ARM64支持和Vulkan。社区成员sylware还建议以正确的ELF64二进制构建来实现广泛的glibc发行版兼容,martz表示会跟进这个建议。

茉莉: 宇航员们在完成为期六个月的空间站任务返回地球后,报告了一种很特别的感受——他们称之为持续的"旁观者"感。就是那种好像从自己身体半步之外观察自己生活的感觉。

白桦: 这个描述其实非常接近心理学上的一个概念。Hacker News 上有一位用户说,他之前在美军潜艇上待过好几个月,退役后经历了完全相同的体验。后来海军的精神科医生告诉他,这在 DSM 诊断手册里被标记为解离。

茉莉: 那我们来看看解离具体有哪些类型。最常见的一类是人格解体,就是你感到跟自己的身体、思维或者行为脱节了,好像在看一部关于自己的电影。

白桦: 还有一种是现实解体,外部世界会变得像是假的、像在做梦,或者雾蒙蒙的不真实。再就是解离性遗忘,会忘记重要的个人信息或者整段时间,这个超出了正常记性不好的范围。

茉莉: 严重的还会出现身份混乱甚至身份改变——对自己的身份突然不确定了,或者感觉人格在切换。

白桦: 那这些症状是怎么触发的呢?核心原因是创伤和压力,解离本质上是一种防御机制,人在面对压倒性的压力、虐待或者恐怖事件时,大脑用这种方式来保护自己。

茉莉: 日常生活中的触发因素也很具体——巨大的噪音、强烈的情绪波动,或者碰上让人想起过往创伤的某些提醒物,都可能把这种旁观者感带回来。

白桦: 接下来看几家初创公司的新动态。YC S26 批次的 Rise Reforming 在做一件事——把垃圾填埋场、农场和废水处理厂产生的沼气,转化成高价值的化学品。

茉莉: 他们的定位是化学品项目开发商,夹在沼气供应商和化学品终端用户之间。用的是一种模块化、可以现场部署的工艺。

白桦: 他们选的切入点化学品是二甲醚,瞄准的应用方向挺有意思——化妆品行业的高利润市场。长远目标是生产甲醇,甲醇在工业上的用途要广泛得多。

茉莉: 说到甲醇,有个背景值得注意:两位作者都提到伊朗战争已经导致全球甲醇价格飙升,这个市场背景对他们来说可能是个机会。

白桦: 换个话题——Feyn 公司发布了一个叫 FeyNoBg 的自动背景去除模型,而且把训练和运行这个模型的 Python 库 NoBg 也开源了。

茉莉: 模型已经部署在 Hugging Face 上,他们还发布了示例输出和演示视频,里面包括足球任意球、风中飘动的发丝、还有带辐条的自行车这些场景,看起来挺考验抠图能力的。

白桦: Feyn 这家公司由 Shreyash 创立,主要方向是用企业自己的数据来构建定制模型。

茉莉: 另外还有一条关于太阳能电池板的讨论挺实用。有篇文章的作者在清洗太阳能板时感到电击刺痛,就去问了 ChatGPT。Hacker News 上的评论者分析说,这个装置可能比较简陋,缺少基本的铜接地线来把所有面板接到接地棒上。

白桦: 另一位评论者补充说,因为这个系统不含变压器,属于非独立派生系统,所以不需要接地棒,但设备接地还是应该绑扎在一起,消除电位差。还有人指出,光伏面板跟逆变器有多种连接方式,通常外露的金属部件都要跟地线系统连起来。

茉莉: 好了,今天我们聊了不少,最后来简单回顾一下。

白桦: 今天最让人唏嘘的新闻,肯定是那个加拿大男子——因为警方遗漏了用户名里的一个下划线,被错当成毒贩,白白坐了十八个月牢。法官直接定性为严重误判,真的是一个标点符号改变了一个人的命运。

茉莉: AI方面,Anthropic发布了关于开放权重模型的立场文件,核心主张很简单:如果你的模型能力接近前沿水平,不管开放还是闭源,都应该接受同等安全评估。他们还呼吁各国政府制定统一的安全测试标准。

白桦: 月之暗面也放出了Kimi-K3的技术报告并开源,总参数约三万亿、激活参数一万亿的混合专家模型,部署需要大约1.5TB显存,属于8张B200刚好塞不下、更现实需要16张的量级。

茉莉: 谷歌想用DMCA阻止别人抓取自己的数据,结果被法官驳回了。这个立场确实有点站不住脚,毕竟谷歌自己也在全网抓取别人的内容。

白桦: 还有一件小事值得琢磨:宇航员完成六个月任务回来后,会在好几周里感觉自己像从半步之外观察自己的生活,像个旁观者。海军精神科医生说这其实就是解离,算是一种对极端环境的适应。

茉莉: 好了,以上就是今天《科技新闻简报》的全部内容。感谢收听,我们下期再见。