0729 | AI员工吁为AI“限速”,日本7.1级地震,AnthropicAI自主发现密码弱点

||Download

Show notes

本期节目涵盖多个话题:1122名前沿AI企业员工联署公开信呼吁为AI发展“限速”,在Hacker News上引发两极讨论;日本日向滩发生7.1级地震,最大震度6弱,海啸注意报已全部解除;Anthropic公布多智能体工作流自主发现并利用密码学弱点的研究,但可复现性存疑;Kimi K3架构完全舍弃RoPE位置编码,改用NoPE配合Delta注意力机制,有开发者在M1 Max上实测速度仅每秒0.02 token;MCP协议规范更新,传输层转向无状态设计;JFrog与OpenAI联合披露Hugging Face安全事件,提出“快速修复”信任模型;意大利首次对生殖健康信息网站实施DNS封锁;ACM数字图书馆向LLM开放引发激烈争论;慢新闻媒体“延迟满足”的实验;DMARC标准公开十多年后多数企业仍未强制执行;以及Ars Astronomica项目用AI辅助翻译珍稀天文学手稿。

时间轴

  • 00:00:00 开场
  • 00:00:36 前沿AI员工联署呼吁为AI发展“限速”
  • 00:01:39 日本日向滩7.1级地震,海啸注意报解除
  • 00:02:54 Claude多智能体自主发现密码学弱点
  • 00:04:12 Kimi K3架构解析:舍弃RoPE,Delta注意力与M1 Max实测
  • 00:06:00 MCP规范更新:传输层转向无状态设计
  • 00:07:07 JFrog与OpenAI联合披露Hugging Face安全事件
  • 00:07:51 意大利DNS封锁生殖健康信息网站
  • 00:09:35 ACM数字图书馆是否应向大语言模型开放?
  • 00:11:28 “延迟满足”媒体:最后一个报道突发新闻
  • 00:12:57 DMARC发布超十年,多数企业仍未强制执行
  • 00:14:23 AI辅助翻译珍稀天文学古籍的Ars Astronomica项目

相关信息

本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so

Transcript

茉莉: 欢迎收听Bri播客旗下的《HackerNews每日沙龙》,我是茉莉。

白桦: 我是白桦。今天我们来快速预览一下本期值得关注的话题。

茉莉: 一千多名前沿AI企业员工联署公开信,呼吁美国政府支持一项国际努力,为自动化AI发展的前沿"限速"。

白桦: 日本九州日向滩发生7.1级地震,最大震度6弱,海啸注意报一度发布后已全部解除。另外,Anthropic披露了一项研究,多智能体工作流自主发现并利用了密码学弱点。

茉莉: 下一则消息来自一封公开信——1122名在前沿AI企业工作的员工联署,向美国政府发出呼吁。

白桦: 他们要什么?

茉莉: 核心请求是:支持一项国际努力,开发技术和治理工具,刻意地为自动化AI发展的前沿进行限速。也就是说,有意识地放慢前沿AI能力的研发和部署节奏。

白桦: 这个主张在Hacker News上激起了不少讨论,反应相当两极。

茉莉: 有一种解读比较尖锐——有评论说,这等于"只有通过审查的人才能使用前沿模型"。

白桦: 还有评论认为,拥有GPU算力并不等于拥有预测AI未来的特殊洞见,毕竟现在任何拥有足够计算资源的人都可以推出模型,局面已经不是少数人能控制的。

茉莉: 也有比较直白的批评:这份声明内容相当模糊,追问到底具体要做什么,信里并没有给出清晰的路线图。

白桦: 说白了,倡议的大方向有了,但落地细节大家还没看到。

茉莉: 转向日本。2026年7月28日下午4点35分左右,日本气象厅发布了一次7.1级地震的消息,震中位于日向滩。

白桦: 九州地区观测到最大震度6弱,宫崎县、大分县等地出现强烈摇晃,部分区域有建筑物受损和人员受伤的报告。气象厅一度发布海啸注意报,不过随后全部解除了。

茉莉: 这次地震没有触发南海海槽大地震的关联预警,算是不幸中的一个好消息。

白桦: 在Hacker News上,有在日本不同地区的用户描述了各自的感受,反差挺大。

茉莉: 用户masklinn指出,九州以外地区震感极弱。他提到日本气象厅震度3等级的表现是"餐具可能发出声响,部分户外行走的人有所察觉"——大概就是这种程度。

白桦: 关于韩国那边也有讨论。位于釜山的用户barosl说,有人感到震动甚至眩晕;但同在釜山的jasmcole则表示,在海滩时完全没察觉任何震感。另一位用户GreyMolecules称在韩国全境未感知震动。

茉莉: 同样一场地震,不同位置、不同环境下人的感受差异可以非常大。

白桦: 最后一则跟AI研究有关。Anthropic发布了一项研究,标题叫《用Claude发现密码学弱点》。

茉莉: 研究披露了一个多智能体工作流,它自主发现并利用了密码机制中的弱点。关键的创意是由一对Worker智能体协作产生的。

白桦: 过程挺有意思。双方同时开始调查同一个思路,第一个Worker过早判定不可行,直接放弃了;但第二个Worker找到了完全利用该方法的方式。随后两者持续交换消息,最终一致认定找到了有效攻击。

茉莉: 听起来像是协作促成了突破?但Hacker News上有用户提出了不同看法。

白桦: 用户a-dub认为,从描述来看,这个结果更像搜索中每条线程的随机性质导致的,并不是协作本身促成了发现。

茉莉: 用户TeMPOraL则做了一个假设:结对或协作能大幅提高成功率。他的判断是协作机制确实有价值。

白桦: 不过有一个关键信息研究没有交代——多次重放同一个搜索,或者在上下文有扰动的情况下复现,这个方案的命中率和遗漏率到底是多少。这就让大家比较难判断,这究竟是可复现的能力,还是一次性的巧合。

茉莉: 来关注大模型架构的一个新动向。月之暗面发布的 Kimi K3,最近有开发者把它的架构细节扒出来做了公开分析,里面有一个非常激进的设计选择。

白桦: 激进这个词用得不过分。Kimi K3 完全舍弃了旋转位置编码 RoPE,统一换成了 NoPE,也就是不用任何显式位置编码。这在目前主流大模型里是很少见的。

茉莉: 对,社区讨论里很多人都在说,其他模型通常会在局部层保留 RoPE,K3 这种全 NoPE 方案,能不能在更大规模上保持有效性,其实还是个开放问题。

白桦: 那位置信息怎么处理呢?K3 的做法是配合自己的线性注意力机制,叫 Kimi Delta,用这个注意力机制来隐式承担位置建模的功能。相当于把位置这件事完全交给了注意力本身。

茉莉: 再来看规模。K3 在基准测试里的表现跟 Opus 和 Fable 在同一个区间。社区有推测认为总参数量在两到四万亿之间,但是 DeepSeek 的创始人最近暗示了一个很有意思的点。

白桦: 他说 K3 的激活参数可能比同级模型少一个数量级。这意味着什么呢?在基准测试上分数可能差不多,但在实际人机交互中,表现差异会拉得更大——比基准分数看上去的差距要明显得多。

茉莉: 还有一个非常实际的尝试。有开发者试着在一台 M1 Max 上本地运行 Kimi K3,实测速度不超过每秒 0.02 个 token。

白桦: 每秒 0.02 个 token,这个速度完全不适合实时对话。那位开发者自己的判断是,更适合电子邮件这种异步交互场景,还给它起了个外号,叫"Kimi 笔友"。

茉莉: 接下来这条跟协议设计有关。MCP,也就是模型上下文协议,在 2026 年 7 月 28 日发布了一次规范更新,核心变化是把传输层转向了无状态设计。

白桦: 社区里对这个变化的讨论挺到位的。有人指出,大语言模型实际的工具调用本质上就是无状态的——模型调用 get_my_todos,拿到结果,再调用 add_todo,它并没有在内存里保持状态,只是把前一次调用的结果作为文本放进上下文窗口,然后再发起下一次调用。

茉莉: 服务器端也一样。要考虑客户端把数据保留在内存里能有多久、连接能保持打开多长时间,这些状态维护其实并不可靠。

白桦: 不过有用户担心,如果以前依赖有状态机制来监控长达好几天的运行流程,是不是就得改代码了。官方的回应很明确:这次协议变更不影响现有正在运行的 MCP 代码,只有想用新能力的时候才需要调整。

茉莉: 最后来看一起安全事件。JFrog 和 OpenAI 联合披露了一个情况:JFrog 的安全研究团队曾经在 Hugging Face 平台上充当代理方,结果导致 Hugging Face 被入侵。

白桦: Hacker News 上的讨论指出了一个很有意思的叙事问题。JFrog 发的博文用了大量篇幅讲 AI 安全有多重要,但是一直到最后面才提到——JFrog 自己就是这次入侵事件的代理方。这个关键事实被放得很靠后。

茉莉: JFrog 在官方博客里顺势提出了一个新的信任模型,叫"快速修复"。核心思路是利用前沿网络安全模型先攻击自己的代码,生成 CVE,然后提前发现漏洞、提前修。

茉莉: 意大利网络监管机构最近干了一件事——对两个提供生殖健康信息的网站实施了DNS封锁。被封锁的是荷兰组织Women on Web服务的意大利语网站Donne sul Web,以及Women Help Women的意大利语网站。

白桦: DNS封锁意味着什么?就是你在意大利的网络环境下,直接输入这些网址已经打不开了。这个数据来自开放网络干扰观测站OONI的实测,确认这两个非营利平台从2026年4月16日起在意大利无法直接访问。

茉莉: 这两个平台是做什么的?它们提供药物流产的信息和远程医疗咨询,本质上是非营利组织。触发这次封锁的直接原因是:意大利卫生当局正式认定Women on Web为"有害医疗实践"。

白桦: 关键争议点在于这个组织有一个做法——它在意大利境外直接向使用者邮寄堕胎药物。这就触碰了意大利去年通过的《反堕胎法》的红线。

茉莉: 这次封锁之所以值得关注,是因为它是意大利《反堕胎法》生效以来,第一次对提供生殖健康信息的国外民间组织采取这种技术屏蔽手段。

白桦: 对,之前法律虽然通过了,但我们还没有看到针对跨境信息平台的实际执行案例。这次算是首例,而且手段很直接——在基础设施层面就从DNS切断访问。

茉莉: 这里要区分一下:封锁针对的是网站本身,而不是底层网络协议。OONI的测量数据只是确认了访问被阻断这个事实,至于具体的技术实施方式和更长期的影响,目前还没有更多信息。

白桦: 好,我们换个话题。ACM,也就是美国计算机协会,最近有一篇观点文章引发了不少讨论。文章的建议是:现在应该向大语言模型开放ACM数字图书馆的访问权限了。

茉莉: 这个话题在Hacker News上炸出了非常两极的评论。先说你得知道的一个背景:ACM数字图书馆从2026年1月起,所有出版物和相关成果已经转为开放获取了。这个信息来自ACM自己的开放获取页面。

白桦: 所以文章的逻辑可能是:既然已经开放获取了,那让大语言模型来"读"这些论文,似乎顺理成章。但评论区里有人完全不买账,一个很尖锐的观点是:数字图书馆本来就应该一直开放获取,现在反倒可能沦为——用评论者原话——"烂内容制造机"的素材。

茉莉: "烂内容制造机"这个说法挺狠的。还有评论者更激进,认为大语言模型最终会摧毁整个同行评议体系,除了那些硬实验论文还能站得住。

白桦: 这又引出了另一层讨论:同行评议本身到底有没有那么靠谱?有评论直接质疑同行评议体系的真实效用一贯存疑,还说这就是为什么arXiv这种预印本平台会变得如此突出。

茉莉: ACM开放获取这个时间点挺关键的——2026年1月开始全面开放。现在这篇观点文章等于在问:开放获取的下一步,是不是就应该向AI系统开放训练和检索权限?

白桦: 评论区反映的其实是两股焦虑拧在一起了:一股是对AI大量"消费"学术内容后会产出什么的担忧,另一股是对传统学术出版体系本身的不信任。两种声音都很强烈,目前也没有共识。

茉莉: 接下来这个有意思。有一家媒体叫Delayed Gratification,翻译过来就是"延迟满足",它给自己的定位是——"最后一个报道突发新闻"的媒体。

白桦: 这个理念挺反潮流的。他们的做法是:不在事件发生的第一时间抢发,而是等两到三周之后再报道。到那个时候,更多细节已经被澄清了,不少最初的误报也被纠正了。

茉莉: 一位Hacker News用户的评论提供了一个很生活化的视角。他说他观察到一些"长期在线"的朋友面临一种社交压力——你没办法退出推特,因为你必须在第一时间讨论乌克兰局势,或者球队交易,这是社交的一部分。

白桦: 这个观察挺戳人的。那种"你必须参与讨论"的压力是真实的,哪怕你讨论的东西可能几个小时之后就被证实是错误信息。这位用户自己就说,他不认为率先讨论新闻有什么价值。

茉莉: 他的主张更直接——少一些实时新闻对社会有益。这个判断当然是一个个人观点,但它背后反映了一个真实存在的问题:实时新闻的准确率和社交媒体的讨论压力之间,有一个很难调和的矛盾。

白桦: Delayed Gratification的模式就是对这个矛盾的回应。等尘埃落定再报道,牺牲速度,换取准确度。不过话说回来,这种模式能覆盖多少受众、商业上能不能持续,目前还没有更多数据。

茉莉: 接着上一个话题,我们来看电子邮件安全领域一个挺有意思的现象。DMARC 这个标准从 2012 年就已经公开了,到现在超过十年,但大多数企业域名其实还没有启用强制执行。

白桦: 十几年了还没强制执行?这确实有点意外。Hacker News 上有人在讨论这个话题,有用户就坦白说,自己只部署了 SPF 和 DKIM,完全没设置 DMARC。

茉莉: 对,而且另一位用户解释得挺清楚:如果有人伪造来自你域名的邮件,DMARC 的作用就是告诉接收方该怎么处理这些伪造邮件——是放行、标记成垃圾邮件,还是直接拒绝。

白桦: 这里面还有一个挺典型的自托管用户案例。他说 Google、Microsoft、Amazon 这些服务商会给他发伪造域名的汇总报告,他当前的 DMARC 策略设置是接受但可能标记为垃圾邮件,同时发送报告,还没有切换到完全拒绝模式。

茉莉: 也就是说,他知道有人在伪造他的域名,也在收报告监控情况,但就是还没迈出那一步去彻底阻断。这个心态其实挺有代表性的——很多企业怕误伤正常邮件,就一直停留在监控阶段。

白桦: 没错,从 SPF、DKIM 到 DMARC 强制执行,技术上是三步走,但最后这一步跨出去的人确实不多。十多年的老标准了,落地情况还是这样。

茉莉: 换个领域聊聊。有一个叫 Ars Astronomica 的项目最近在 Hacker News 上获得了不少关注。它的目标是把历史上重要的天文学、历法以及相关科学著作翻译成现代英语。

白桦: 这个项目挺有野心的。项目负责人 sweisman 在 Hacker News 上介绍,他们使用 OCR、AI 辅助翻译、加上编辑审校和出版的完整流程,而且保留了原著的图表、数学符号和参考文献。

茉莉: 现在网站上已经上线了珍稀的希伯来语和拉丁语著作的英语译本,其中包含一些从来没有过英译本的作品,甚至还有仅存手稿的文献。

白桦: 仅存手稿都能翻译出来,这个学术价值确实很高。而且所有版本都以 Creative Commons 许可协议发布,意味着任何人都可以自由获取和阅读这些译本。

茉莉: 对,把几百年前只有极少数学者才能读懂的文献,用 AI 辅助加人工审校的方式变成开放的现代英语资源,这个做法本身也展示了技术如何推动学术普惠。

茉莉: 好,以上就是今天所有的话题。从一千多名AI从业者联名呼吁为前沿能力限速,到日本日向滩7.1级地震,再到Anthropic用多智能体工作流发现密码学弱点——今天的信息量确实不小。

白桦: 嗯,还有Kimi K3完全舍弃旋转位置编码的那个设计选择,以及MCP规范转向无状态传输——这两条技术新闻其实在底层有一个共同的线索:当上下文窗口本身变成了状态载体,很多传统架构的假设就被动摇了。

茉莉: 对。JFrog和OpenAI联合披露的那个Hugging Face安全事件也提醒我们,供应链安全的边界正在模糊——代理方的权限一旦被滥用,整个平台都可能被穿透。

白桦: 意大利对Women on Web的DNS封锁、ACM数字图书馆向LLM开放的争议、延迟满足媒体的慢新闻实验,还有DMARC部署率始终上不去的现实——这几条看似分散,其实都在问同一个问题:数字世界的规则到底是该加速跟上技术,还是该刻意慢下来?

茉莉: 最后用Ars Astronomica那个项目收尾挺合适的——用AI辅助翻译几百年前的天文学手稿,技术跑得再快,有些东西还是值得被认真保存和翻译。好,我们下期见。