当「顺便发」成为系统调用:我把播客发布变成聊天的自然动作

当「顺便发」成为系统调用:我把播客发布变成聊天的自然动作

这篇博客其实不是要介绍某个新功能,而是想记录一个让我自己觉得「系统终于活过来了」的瞬间。


从「点按钮」到「顺便说一句」

过去发一期播客,流程大概是这样的:打开后台、上传音频、填标题、写简介、选封面、点发布。每一步都不难,但每一步都在打断思路。

现在呢?跟大模型聊天的时候,说一句「把刚才那篇关于XX的文章做成播客发出去」,它自己就完成了。

这个变化的本质不是「少点几个按钮」,而是发布这件事,从需要我主动切换到某个后台界面,变成了对话流里的一个自然动作。我的操作对象从「界面上的按钮」变成了「大模型的意图」,系统负责理解并执行剩下的所有事。

怎么做到的:MCP 是关键的一环

这套能跑起来,核心是自写的一个 MCP(模型上下文协议)Server

大模型本身没有权限碰我的存储和发布接口,但通过 MCP 工具,它获得了「调用发布播客」这个能力。当我在对话框里说那句话,模型就会调用对应的 MCP 工具,触发本地小主机执行 TTS 生成、上传 R2、更新 D1 数据库、刷新 XML 文件——全程我不需要离开聊天界面。

这也是为什么我把 TTS 这类重计算逻辑放在本地小主机上,而不是塞进 Cloudflare Worker:省费用、避上限,本地算力做生成,云端只做分发,各取所长。


至此,「内容复利飞轮」闭环了

这套系统现在跑通的链路大概是这样的:

  • 捕获:Knowly 监听剪贴板、Taio 随手记、浏览器剪藏——零摩擦输入,随时随地
  • 编排:WeClaw + 自写 MCP Server——自然语言触发,AI 调度任务
  • 生成:本地小主机跑 TTS、各类 Agent 并行处理——算力本地化,不依赖云函数
  • 存储:R2(分发) + iCloud(个人) + NAS(归档)——3-2-1 备份,永不丢失
  • 分发:D1 动态生成 XML 供播客客户端拉取,同时同步到博客和 IMA——一次生成,全世界可达

现在,我跟大模型说的每一句话,都有潜力经过这套管道沉淀为音频、文字或结构化数据。对抗遗忘不再是口号,而是嵌入日常对话的底层机制。


但还没完:下一步是「记忆检索」

目前这套 MCP Server 暴露给大模型的工具主要是「发布播客」这条链路。但真正让我觉得还有一层天花板没捅破的,是下面这个想法:

如果把「检索 NAS 里的旧文档」「查询某条历史记忆」「读取 R2 里的图片列表」也做成 MCP 工具呢?

到那时候,大模型等于拥有了我全部数字资产的只读 + 写入权限。我在对话框里问「去年三月份我写过一篇关于 X 的文章,帮我找出来做成播客再发一遍」,系统就能自己完成检索、生成、发布的全流程——这就不再是「AI 助理」,而是真正意义上以人为核心、以 AI 为认知引擎的个人操作系统

这个目标,正在一步步接近。