0828 | 今日播客:GLM-5.3-Flash多模态发布,Traccia智能体治理,GitNexus编码图谱
Show notes
0828 | 今日播客:GLM-5.3-Flash多模态发布,Traccia智能体治理,GitNexus编码图谱
时间轴
- 00:00:00 开场
- 00:00:31 The flash-tier open-weight race: GLM-5.3-Flash vs Qwen3.8-Flash-Next
- 00:01:20 Speech stacks: Speko's one-API offering and Gemini 3.5 Transcribe
- 00:01:48 Taming production agents: Traccia's control plane vs IQ Routing's trajectory-aware gateway
- 00:02:51 Lenz: a fact-checking API with an audit trail instead of a single model's guess
- 00:03:55 GitNexus: a knowledge graph kernel so coding agents stop guessing
- 00:05:07 Ojin: interruptible live-voice agents with a face and a voice
- 00:05:44 Savvy: a meeting copilot grounded in your documents, not the open web
- 00:06:59 Cobalt: turning Kobo e-readers into an open app platform
- 00:07:32 Sendra: Figma frames to inbox-ready email, checked against real devices
- 00:08:22 SpacebarX: a keyboard-first, local-first outliner for notes, tasks, and writing
- 00:09:24 Yomi: a reading app where kids read aloud and feed a cat
- 00:10:55 The Million Sad Ducks: name a duck, make it happy, get a certificate
相关信息
- GLM-5.3-Flash - Bri Product Hunt
- Qwen3.8-Flash-Next - Bri Product Hunt
- Speko - Bri Product Hunt
- Gemini 3.5 Transcribe - Bri Product Hunt
- Traccia - Bri Product Hunt
- IQ Routing - Bri Product Hunt
- Lenz - Bri Product Hunt
- GitNexus (Akon Labs) - Bri Product Hunt
- Ojin - Bri Product Hunt
- Savvy - Bri Product Hunt
- Cobalt - Bri Product Hunt
- Sendra - Bri Product Hunt
- SpacebarX - Bri Product Hunt
- Yomi - Bri Product Hunt
- The Million Sad Ducks - Bri Product Hunt
本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。
Transcript
茉莉: 欢迎收听 Bri 电台的《ProductHunt 产品分享》,我是茉莉,今天和我一起的是白桦。这期简报里有好几款值得留意的开源新作,比如语言模型、编码代理内核,还有给自主智能体做管控的供应商中立平台。
白桦: 另外还有面向设计师、创作者甚至孩子的应用,跨度挺大的。从 Z.ai 发布的开源权重多模态模型开始讲起吧。
茉莉: 今天有两款开源权重模型的新发布,先说 Z.ai 的 GLM-5.3-Flash。官方称它为 GLM-5 系列第一款原生多模态模型,总参数三千二百亿、激活参数一百八十亿,以十分之一的价格在基准和真实负载上都超过了上一代 GLM-5.2,编程和智能体基准上也接近 Claude Opus 4.8,这些数字都是官方口径。
白桦: 值得注意的是它的成本结构。公开版支持一百万个 token 的上下文,权重采用 MIT 许可;输入每百万 token 零点一五美元、输出每百万 token 零点五美元,前两周还有五折。社区说明,它用稀疏加线性注意力来压低长上下文的服务成本。
茉莉: 同一个话题里还有一个关键的开放问题。有社区成员指出,这个模型此前其实以 Ox Alpha 代号在 opencode 和 OpenRouter 上被运行过,也有人声称已经用 Kilo Code 跑了好几天,速度快、长智能体任务稳定。但有评论者直接追问:GLM 什么时候才能真正理解发给它的图片——所谓原生多模态宣称的图像理解能力,目前还没有得到验证。
茉莉: 接着是 Qwen 发布的 Qwen3.8-Flash-Next,定位是 Qwen4 的开源权重架构预览。它是一千二百五十亿参数的多模态 MoE,只有六十亿激活参数,核心围绕 QSA、Gated Residual、N-gram 嵌入和 Muon 构建。
白桦: 这套架构的社区解释是:QSA 降低长上下文检索成本,Gated Residual 给信息提供更多网络通路,N-gram 记忆用极低的单 token 计算增加容量。而且这个模式并不陌生——之前 Qwen3-Next 的架构预览就预示过 Qwen3.5,这次是同一套路。权重已经公开,但社区提醒先读许可证。
茉莉: 局限也很具体:社区成员认为一千二百五十亿总参数让本地部署很困难,并且问有没有总参数约三百五十亿到四百亿、激活参数三十亿到六十亿的版本。在他们看来,三百五十亿总参数的 A3B 档位还没有继任产品,本地运行目前仍是未解决的问题。
茉莉: 接下来是专门面对跑生产级 AI 智能体团队的两个产品,先讲治理。Traccia 是一个供应商中立的智能体控制平面,底层是开源的开发者优先 SDK 和 OpenTelemetry,跨模型和框架工作、不绑定单一 AI 供应商,提供行为观察、性能评估、策略与运行时管控,以及可审计的操作记录。
白桦: 创始团队的核心判断是:传统追踪只能显示智能体做了什么,判断不了这个行为是不是被允许。所以这次发布里有一条带证据的运行时治理——硬阻断能在执行中途停下不合规的智能体。平台已经开放,优惠码 TRACCIAPH 可以免费三个月。但创始人也自认还在早期,SOC 2 认证进行中,页面上展示的智能体数量和成本仪表板只是界面演示,不是验证过的结果。社区里有人夸开源 SDK 的诚意,也有人问有没有出现过被标记为异常的流程案例。
茉莉: 另一个是成本问题。IQ Routing 是独立开发者乔治做的轨迹感知型 LLM 路由网关,它作为直接接入层,给每个请求分类、优先复用缓存,再把每一步路由到能完成该任务的最便宜模型。核心观点是:一次智能体运行是一条轨迹,多数步骤根本不需要最强的模型。
白桦: 官方按自己的流量测算,声称能削减百分之四十到八十的支出,缓存命中延迟约十一毫秒;那个五步循环的示例,成本从一点八四美元降到零点七七美元、降幅百分之五十八——这些全是自我报告的数据。它兼容 OpenAI、Anthropic 和 Google 的接口,Kimi 和 GLM 还在路线图上;免费套餐每分钟限二百四十次请求,团队套餐每月七十美元、限每分钟六百次请求。
茉莉: 社区里有一个还没被回答的疑点:缓存到底会不会跨运行复用。一位还没试用过的评论者说,这是他在文档里会最先核查的东西,而这个行为目前是未知的。
白桦: Ojin 是一款想让 AI 智能体拥有一张真实面孔和真实声音的产品,而且走的是实时对话,不是一问一答。你先传一张照片、定一个人设和声音,就能在离线状态打断它、说一半停住、甚至跟它抢话,它都能接住。
茉莉: 同类演示大多撑不过这种打断测试,而这两个面妆模型——一个叫 Portrait,管规模,一个叫 Presence,管表情——都放在同一个 API 后面,能直接接进 Pipecat 和 LiveKit 两套框架。第一次接触这种产品,打断它确实是判断好坏最快的办法。
白桦: Savvy 是一款 macOS 会议助手,针对的是接客户电话、答案散在自己文档里的那种人。它的想法是开会的时候实时提示你该说什么,而不是开完会给你一份总结。你指向一个文件夹,它就给每位客户生成带版本号的简报,还能限定只准备某位客户的内容。
茉莉: 开会时它保持安静,只在三种情况下开口:对方问了一个简报能回答的问题、有人踩了你设定的红线、或者你自己按了 Advice 键,每张提示卡都标着来源文档。开发者说他试过的 AI 会议工具都会插进通话、会后发总结,那些对存档有用、对对话没用——这些能力描述都出自开发者本人,还没经过独立验证。
白桦: 隐私边界值得留意:你的文档、索引和转录都留在 Mac 上,但会议音频在捕获时会流式传给转录提供商,需要 Deepgram 或 AssemblyAI 的账户,目前没有离线转录模式。Savvy 给 Deepgram 设了退出训练的标志,AssemblyAI 有没有同等选项就得看它自己条款了。它跑在 Apple Silicon 和 macOS 13 以上,开源,用 MIT 许可证。
白桦: Cobalt 让 Kobo 电子书阅读器终于能装应用了。它是一套开源应用平台,包含启动器、签名应用商店、Rust 开发套件,还有一个带能力隔离的运行时。装一次 USB,之后每个应用都走 Wi-Fi 到达设备。
茉莉: 有人在社区里提到,他想摆脱长时间盯着笔记本屏幕干活,眼睛越来越吃力,正好需要一个能帮他处理确认的那类工具——这类带能力隔离的运行时,正好给这样的第三方小工具留了空间。
白桦: Sendra 是 Figma 里的一款插件,专门服务那些在 Figma 里设计邮件、之后还得手工重写 HTML 的设计师。按官方描述,它能把任意画好的画框导成干净、响应式的 HTML,直接适配 Gmail、Outlook 这些主流客户端,不用组件库也不用重建设计。
茉莉: 开发者 Joe 自己就是设计完邮件还得再做一遍 HTML 的人,他点名 Outlook 这类老客户端常常让邮件样式失效。这个插件逐元素控制移动端堆叠、间距和字号,也有深色模式颜色覆盖,导出时还会托管图片、生成真实链接,甚至能直接在插件里向你的收件箱发测试邮件。免费版头十次导出不收费,Pro 版不限次数,但价格没公布。
白桦: SpacebarX 是一款键盘优先、本地优先的大纲工具,想解决笔记和任务分处两个应用的割裂问题。所有内容都收进一个嵌套大纲,你能把想法直接转成带日期的任务,截止任务汇总进 Today 视图,没做完的自动顺延。
茉莉: 它现在是能离线用的网页应用,靠你自己名下的 Google Drive 或 Dropbox 同步,官方强调笔记留在本机、没有他们的服务器读取——这也是开发者描述,不是已验证的结果。有位实测的评论者说同步感觉无缝,深嵌套列表里设了截止日的任务确实会进 Today 视图,还说体验接近 Workflowy 和 Notion 的结合。
白桦: 免费版永久免费,Pro 加可视化视图、加密文档、版本恢复和日历这些,还能连自己的 AI 服务商。评论者问过桌面和原生移动应用什么时候出,开发者只说原生应用在开发中,没给时间表,iCloud 同步也没确认。
茉莉: 讲完 SpacebarX,我们转到一个儿童阅读应用 Yomi。它是面向五到九岁孩子的 iOS 应用,支持英语和芬兰语,孩子大声朗读时语音识别会把每个词喂给一只叫 Yomi 的猫,读得越多猫越开心,可第二天又饿了,孩子就有理由反复回来读。
白桦: 这个设计很有分寸。开发者 Elina 说,她先试过的其他应用用连胜和火苗表情让睡前更有压力;Yomi 刻意没有连胜、广告、账号、数据收集、排行榜、金币,也没有给孩子看的等级。不过她明确讲,Yomi 不教孩子阅读,只给孩子练习的理由。
茉莉: 对,应用内置真实短篇故事,分容易、中等、困难三档,孩子点按卡住的单词能听到发音,还能用简单向导自选名字、角色、地点和情节,由 Yomi 生成故事再让孩子读出来。设计动机来自她与一、二年级教师的研讨,还有她自己孩子拒绝大声朗读的经历。
白桦: 社区评论中,有家长称赞没有游戏化,并希望加入读后理解检查——这项功能目前没有确认;另一位建议日后加插图或让 Yomi 发声,还有人提到自家十岁的阅读困难孩子会用它。应用由 Interlinear Oy 开发,这家公司还出品学习应用 Lexie 和植物标本应用 Linnea。
茉莉: 从 Yomi 转到另一个有趣的项目《百万悲伤鸭子》。它是一百万只悲伤鸭子的世界,用户可免费平移缩放;花一美元,一只鸭子就永久快乐、获得用户给的名字,并生成一份鸭子幸福证书,是 A4 横向的 PDF,带印章、桂冠、三个虚构签署人,落款为“禽类情感福利部”。
白桦: 定价本身成了玩法。共六个池塘,价格从一美元到一千美元,取决于用户想要多戏剧化的鸭子;作为礼物使用时,命名鸭子后证书会发给受赠人。制作者承认灵感来自百万美元主页、不声称原创,并点出区别——像素是广告空间,而鸭子是礼物。
茉莉: 更妙的是,这整个百万鸭子世界是纯函数:每只鸭子的位置、颜色、姿势和配件都由它的 ID 号派生,数据库只存储被弄快乐的那些鸭子。项目由制作者独自构建,已经发货并接受真实付款;他想了解的是证书是否让人发笑,以及一美元是否合适。
白桦: 社区里已有人报告让“Duckingston III”变成快乐鸭子,另一位用户确认证书确实让人发笑。还有一个未解决的问题——有用户问,若结账时名字打错,付款后能否修改,还是这只鸭子会顶着永久拼错的名字保持永久快乐;制作者目前还未回应。
茉莉: 今天两条主线,一是开源权重的闪速档竞争,GLM 和 Qwen 都推出了新的闪速模型;二是跑生产级智能体的团队,该如何同时管好治理和成本。
白桦: 开源侧既有新的多模态旗舰,也有面向长上下文的架构预览;控制平面那一条,则面对一个真正的盲区——追踪能看到智能体做了什么,却判断不了它这么做是否被允许。
茉莉: 每个模型、每个流程都还在早期,也都有还没验证的地方。今天就到这里,感谢收听,我们下次再见。