
0924 | AI 一周新工具:写作、创作与智能体
Show notes
本期节目快速浏览一批新工具与产品:从记住你语气的AI回复助手、实时语音翻译,到创作者的视频与摄影工具,再到营销自动化与智能体基础设施,包括新模型、共享记忆、安全护栏与评测打分。适合想了解AI应用最新动向的听众。
时间轴
- 00:00:04 开场
- 00:00:44 个人AI助手:语气写作与翻译
- 00:04:21 创作者工具:视频审阅与摄影
- 00:07:20 AI营销与增长自动化
- 00:09:50 智能体与新模型的基础设施
- 00:15:09 收尾
相关信息
- ToneBird
- Speechka
- Linguo Translate
- Pactto
- Lightmeter
- CodeSpotlight
- Naise AI
- RankControl
- Dub Program Marketplace
- Claude Opus 5.5
- Solid
- GBrain
- Koreshield
- AgentScore
- Jev State
- Alexandria by Firecrawl
本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。
Transcript
茉莉: 大家好,欢迎收听本期节目,我是茉莉。
白桦: 我是白桦。今天这期我们聊的是最近一波新产品和新模型,它们看起来分散,但背后其实有一条线,就是AI正在从“会聊天”变成“能干活”,而且是嵌进你的日常工作里干活,写邮件、审视频、做营销、跑长任务。
茉莉: 对,而且今天我们不只报菜名,我们会挑几个问题最清晰、方案最有辨识度的产品,认真讲讲它适合谁、和现有选择比改变了什么、证据是什么、还留了哪些疑问。官方的说法我们都会当作“声称”来处理,不当作已经被验证的结果。
白桦: 那我们就从离每个人最近的地方开始,你每天的回复和翻译。
茉莉: 先说ToneBird。它是一个Mac和Windows上的AI回复助手,做的事情听起来很朴素:在Gmail和Slack里帮你起草回复。但它有一个很具体的差异点,就是它会记住你的关系和你的语气。也就是说,它给你老板写的草稿,和你给老同事写的草稿,不应该是同一个腔调。它把这个当作产品核心。
白桦: 这个“记住关系和语气”其实戳中了很多人的痛点。现在很多AI写作工具生成的东西一眼就是AI味,因为他不知道你和对方是什么关系、你平时怎么说话。ToneBird把个人化的记忆放在前面,这在产品思路上是有区分度的。
茉莉: 但我想强调它真正的卖点,不是写得多快,而是控制和隐私。它的设计是:AI只出草稿,用户在发送之前一定要亲自过一遍。发送这个动作永远在人手里。这一点在今天的AI工具里其实挺重要的,因为很多人不信任AI代发邮件是有道理的,语气错一句话,关系可能就出问题了。
白桦: 所以ToneBird的定位可以概括成:AI贴近你的写作工作流,但决策权留在你手里。它的局限也很明显,它需要积累你的关系和语气信息才能发挥作用,而这些信息到底怎么存、存多少,从我们拿到的介绍里看不出更多细节,这是用户值得去追问的点。而且它只在Gmail和Slack里出草稿,工作流之外的沟通它管不到。
茉莉: 接下来是同一场景里的另一个维度,说话。Speechka做的是实时语音翻译,而且有一个很有辨识度的能力,翻译之后用你自己的声音说出来。也就是说,你讲中文,对方听到的可能是英语,但那个声音听起来还是你。
白桦: 这个“保留你自己的声音”是个很聪明的差异点,因为实时翻译工具不少,但声音全是机器音的话,沟通的亲近感会打折。它的参数也说得比较具体:支持44种语言,延迟大约1.5秒。1.5秒这个数字来自官方,实际体验如何要看场景,但至少不是几十秒那种没法对话的量级。
茉莉: 可用性方面,它有macOS和Windows的客户端,另外浏览器端是免费的。这里值得和第三个翻译工具对照着看,Linguo Translate。它是一个macOS菜单栏里的翻译器,走的是完全不同的技术路线:通过Apple Translation实现22种语言的离线翻译,也就是说不联网也能用,AI能力反而是可选的,价格是3.99欧元。
白桦: 这三个放在一起挺有意思。ToneBird把AI嵌进文字沟通,Speechka做实时语音,Linguo干脆主打离线。它们都在贴近个人工作流,但对隐私和可控性的处理差别很大。ToneBird靠“发送前必审”来给控制感,Linguo靠“离线、本地”来保护数据,Speechka用浏览器免费版降低试用门槛。如果你关心数据不出本机,Linguo的路线可能是三种里最直接的;如果你要的是实时跨语言对话,那Speechka的能力是目前没有替代的。
茉莉: 不过提醒一句,这些延迟数字、语言覆盖,都是官方口径,我们没法替大家验证。选的时候最好都先在真实场景里试一下,尤其是语音翻译,嘈杂环境和口音对效果影响很大。
白桦: 好,从个人的沟通工具,我们转到创作者这边。这里出现了一个很有意思的对立:一边是AI深度介入的团队协作,一边是明确写着“不用AI、不用云”的产品。
茉莉: 先说AI这边,Pactto。它给创意团队提供持久化的AI房间,可以做影室级别的视频审阅。关键词是“持久化”和“保留上下文”——团队的项目不是聊完就散的会,AI房间一直都在,之前的反馈和讨论都记得。更激进的是,它的agents能把反馈直接落地执行。也就是说,导演说“这段色调不对”,agent不只是记录这条意见,而是去执行修改。
白桦: 这就把AI从“提建议的助手”推成了“团队流程里的执行者”。对做视频、做创意的团队来说,审阅环节通常是来回截图、评论、改版本,如果反馈能直接变成动作,流程上的改变是实打实的。当然,“影室级质量”是官方的说法,agents执行反馈的质量如何、错改了怎么办,这些都是开放问题,我们听到的介绍里没有给出验证。
茉莉: 对立面就是Lightmeter。它是iOS上的一个应用,把测光表和胶片相机结合在一起,支持真正的RAW格式。它的产品哲学和Pactto几乎是镜像的:明确不使用AI、不使用云。定价结构是基础相机功能免费,Plus版本付费。
白桦: 这条“反AI”的路线值得认真对待,因为它不是落后,而是对一群真实需求的回应。摄影爱好者,尤其是玩胶片和RAW的人,往往要的就是完全可控、数据在本地、工具不偷偷处理你的东西。Lightmeter用一个具体的功能组合,测光加真RAW,去服务这群人,并且把“没有AI”当成卖点讲出来。
茉莉: 把Pactto和Lightmeter放在一起,其实是创作工具的两个方向:一个把AI嵌进团队协作,让反馈变成执行;一个把AI彻底拿掉,把控制还给拍摄者本人。哪个是对的?答案是它们服务的根本不是同一批人的同一时刻。团队交付要效率和上下文,个人创作要掌控和确定性。
白桦: 创作者这个话题里还有一个来自开发侧的产品,CodeSpotlight。它是IntelliJ IDEA的一个插件,用动画高亮来突出显示被选中的代码。它的目标用户很明确:教程创作者和做直播的主播。
茉莉: 这个听起来小,但解决的是真实问题。技术教程视频里最大的痛点之一就是观众看不到你此刻在讲哪一行代码。CodeSpotlight把“选中”变成有动画的视觉引导,这本质上是为内容创作服务的开发工具,和Pactto、Lightmeter一样,都在帮创作者把东西做得更清楚、更专业。
白桦: 好,工具帮创作者做内容,那内容做出来要增长,就轮到营销这条线了。这一波的特点很一致:把营销交给agents。
茉莉: 先说Naise AI。它提供自主的营销agents,执行的范围包括社交媒体、影响者合作和PR。价格从每月59.90美元起。它给出了两个很响亮的数字:宣称每周节省40小时,成本降低80%。
白桦: 这两个数字必须按官方声称来听。一周40小时等于五个工作日全天,一个agent方案真能替掉这么多人力吗?成本降80%的口径是什么?这些我们都无法从现有信息验证。但它敢报这么具体的数,说明它瞄准的就是“营销团队人力成本”这个痛点,而且起价不到60美元,试用门槛不高。
茉莉: 和它形成对照的是RankControl,它瞄准的是另一个新问题:AI搜索时代的可见性。它的做法是用7个AI agents在客户自己的域名上创建并发布内容,然后追踪这些内容在6个AI搜索引擎里被引用的情况。商业模式是单一方案,带7天试用。
白桦: RankControl回应的问题很有时代感。过去营销做SEO,是优化给谷歌的排名;现在越来越多人直接问ChatGPT这类工具,你的品牌有没有被AI搜索引擎引用,就成了新的可见性问题。RankControl把“在6个AI引擎里追踪引用”做成产品能力,这个切入点是有区分度的。当然,AI搜索的引用机制本身还在演化,追踪结果能不能直接转化为流量和客户,还是未知数。
茉莉: 把这两个放一起看,Naise做的是传播,替你发内容、做社媒、搞PR;RankControl做的是AI时代的搜索排名。它们都假设营销工作可以被agent化,但一个赌的是“执行人力可以被替代”,一个赌的是“可见性的战场正在转移”。中间还有第三块拼图,Dub Program Marketplace,它不是agent,而是一个平台,让你浏览和申请最好的SaaS联盟营销项目,上面有Framer、Granola、Superhuman这些产品。它解决的是分发这一侧的透明度问题:想做增长但不知道哪些产品的联盟计划值得投入,现在有个集中看的地方。
白桦: 营销agents跑起来了,那支撑它们跑的基础设施呢?这是今天信息量最大的一块,我们慢慢展开。先从模型本身说起。
茉莉: Anthropic发布了Claude Opus 5.5,这是5.5家族的第一个模型,主打两个方向:agentic coding和知识能力。价格上,它比Opus 5便宜40%。
白桦: 这个40%的降价比新能力本身可能更值得关注。因为前沿模型降价,直接改变的是agent跑长任务的经济账。长任务意味着大量的token消耗,之前贵得让很多agent场景算不过来账,价格降下来,这些场景才可能从演示变成日常。
茉莉: 而且它和Solid正好是一对。Solid是一个由MIT、Berkeley、Waterloo的团队打造的公司,已经融资600万美元,做的事情是让AI agents拥有自己的电脑、自己的账号和自己的预算,去跑长时间的任务。
白桦: 这个产品定义本身就说明了一个趋势:agent的“运行环境”正在成为一个独立的产品品类。之前agent要跑长任务,都是寄生在你的电脑、你的账号、你的预算上,这既不安全也跑不长。Solid说,给agent一台它自己的机器,配给它自己的资源,任务跑几个小时、跨多个应用也没问题。
茉莉: 把Opus 5.5降价和Solid融资600万放在一起读,信号是一致的:长任务agent从技术演示走向生产部署,需要更便宜的模型和更独立的运行环境,这两块都在补齐。
白桦: 而且补的不只是这两块。支撑层这一圈还有好几个产品,我们一个个说,因为它们合起来才是完整的图。先说记忆,GBrain。它用markdown做共享记忆,并且把互连的账号开放给所有AI访问。定价是团队工作区第一个月99美元,之后199美元。
茉莉: GBrain解决的是agent的一个根本缺陷:没有跨会话、跨工具的记忆。用markdown这个最通用的格式来存,意味着任何AI都能读,不需要专门的接入。这对团队的含义是,你的agent A今天学到的东西,agent B明天可以直接用。
白桦: 第二块是安全,Koreshield。它专门为做客服支持的AI agents提供安全过滤,覆盖三个暴露面:发给客户的客户消息、RAG检索出来的内容、还有工具调用。它的落地方式也设计得比较谨慎:先有检测模式,再切到执行模式,并且全程有日志。
茉莉: 这个“先检测后执行”的分阶段上线值得点出来,因为它是安全产品里少见的务实做法。你不会一上来就让过滤器拦截真实客户对话,先只记录、只报警,观察一段时间确认误伤率可接受,再打开拦截。客服是直接面对用户的场景,agent说错一句话的代价很高,所以这一层越来越必要。
白桦: 第三块是评测,AgentScore,来自Latitude,而且是开源的。它每天给一个生产环境的agent打分,从五个维度:结果、可靠性、成本、速度、安全。
茉莉: 这五个维度选得很清醒。结果和质量相关,可靠性和稳定性相关,成本、速度是运营账,安全是底线。每天打分意味着它不是上线前测一次,而是持续监控。agent进了生产环境之后,性能会漂移,没有持续评测你根本不知道它什么时候开始变差。
白桦: 第四块更偏开发流程,Jev State。它把AI的对话转化成可执行的TypeScript测试和代码,可以导出JSON和SKILL.md。免费,开源。
茉莉: 这个解决的是“对话到工程”的断点。你和AI讨论出来的方案,往往停留在聊天记录里,下次还得复述一遍。Jev State把它固化成测试和代码,对话的产出就变成了可以被验证、可以复用的工程资产。导出SKILL.md这一点也有意思,意味着这些产出可以被其他agent当技能用。
白桦: 最后一块是数据,Alexandria,来自Firecrawl。它是给AI agents用的数据图书馆,通过MCP、CLI和API接入。官方声称能让回答质量提升21%,公司刚完成了7500万美元的B轮融资。
茉莉: 21%这个数字同样是厂商口径,但方向是可信的:agent的输出质量很大程度取决于它能拿到什么数据,与其把模型调大,不如把数据供给做好。Firecrawl本来就是做网页数据抓取起家的,往“给agent的数据库”这个方向延伸是顺理成章的,投资人也用7500万美元的B轮给这个判断投了票。
白桦: 好,这一圈看下来,模式就很清楚了。模型降价、运行环境独立、共享记忆、安全过滤、持续评测、对话转代码、数据供给,七件事合在一起,说的是同一句话:agents正在从演示,变成有记忆、有安全、有评测的生产系统。
茉莉: 但我们也要在结尾留一个清醒的注脚。今天讲的几乎所有数字,40小时、80%、21%、40%降价、1.5秒延迟,全部是官方声称,不是我们验证过的结果。方向上的判断我们敢做:个人AI工具会更贴近工作流,创作工具会在“AI化”和“反AI”之间分化,营销会被agent化,agent基础设施会成为一个独立品类。但每个产品在真实场景里到底表现如何,还是得你自己上手试。
白桦: 没错。选工具的标准其实今天已经隐含在各处了:看它解决的问题是否具体,看它和其他选项的差异是否真实,看它的声称是否给了你可以验证的入口,比如7天试用、免费浏览器版、开源代码。符合这些的,值得试;只有大话没有入口的,先观望。
茉莉: 以上就是本期全部内容,感谢收听,我们下期再见。
白桦: 再见。