概览
Agent Bridge 让 AI Agent(Claude Code、Cursor、Cowork 等)远程控制 Web2MD Chrome 扩展来批量转换 URL——尤其是 Reddit、JS 渲染或需要登录的页面,这些页面会拦截服务端 API 访问。 AI Agent 不再调用会被 Reddit 拦截的 Web2MD API,而是通过 Native Messaging 向你本地的 Chrome 扩展发送命令。扩展会用你真实的浏览器会话——带着你的 cookies 和登录状态——在后台标签页中打开每个页面,提取内容,转换为 Markdown,再返回结果。Agent Bridge 需要 PRO 套餐,并且你的机器上要安装 native messaging host。扩展必须在 Chrome 中处于打开状态。
架构
所有通信都在本地完成——不会有任何数据离开你的机器。Native Host 只监听
localhost:12315。
设置
步骤 1:构建 MCP Server
步骤 2:安装 Native Messaging Host
- 把 host 文件复制到
~/.web2md/(避开 macOS TCC 对~/Desktop的限制) - 解析出
node的绝对路径(Chrome 启动时 PATH 很有限) - 把 NM manifest 写入 Chrome 的
NativeMessagingHosts目录
步骤 3:配置 MCP
- Claude Code
- Cursor
- Claude Desktop
在
~/.claude/settings.json 中添加:步骤 4:验证
在 Chrome 中打开chrome://extensions → 点击 Web2MD 的 “Service Worker” 链接 → 查看 Console:
可用工具
Agent Bridge 暴露了三个 MCP 工具——根据传输方式和批处理需求选择。三者的完整文档见 MCP Server 页面,这里只做快速对比。agent_convert
通过 native messaging 用 Chrome 扩展转换单个 URL。
返回: 包含标题、来源 URL、字数和阅读时长的 Markdown 内容。
最适合: Reddit 帖子、需要登录的页面、JS 渲染的站点。
agent_batch_convert
批量转换最多 50 个 URL。URL 依次处理——扩展在后台标签页中打开每个页面,提取内容,关闭标签页,然后处理下一个。
返回: 每个 URL 的结果会在完成时流式返回,并附带一份汇总。
最适合: 研究类工作流——批量转换 Reddit 帖子、HN 讨论串,或供 AI 分析的竞品页面。
bridge_convert_url
通过扩展经本地 HTTP bridge(而非 native messaging)抓取单个 URL 的 HTML,再在服务端转换。对于一次性转换,功能上与agent_convert 类似,但不需要安装 native messaging host——只需扩展已安装并运行。
所有成功的转换都会自动保存到你的控制台历史记录,并附带 AI 生成的摘要和标签。
使用示例
转换一个 Reddit 帖子
转换一个 Reddit 帖子
你: 把这个 Reddit 帖子转成 Markdown:https://www.reddit.com/r/LangChain/comments/1siwh6q/…Agent: (调用
agent_convert) 这是转换后的帖子,其中有 7 条评论在讨论法律文档场景下的 RAG 精度问题……批量转换用于研究
批量转换用于研究
你: 批量转换这 5 个 Reddit URL,并总结关键要点:
- https://reddit.com/r/MachineLearning/comments/…
- https://reddit.com/r/LocalLLaMA/comments/…
- https://reddit.com/r/LangChain/comments/…
- https://reddit.com/r/artificial/comments/…
- https://reddit.com/r/ChatGPT/comments/…
agent_batch_convert) 已成功转换 5/5 个 URL。以下是关键要点……转换需要登录的页面
转换需要登录的页面
你: 转换我公司内部 wiki 页面:https://wiki.internal.com/architectureAgent: (调用
agent_convert) 由于你在 Chrome 中已登录该站点,我成功提取了完整内容……支持的站点
Agent Bridge 使用与扩展相同的 27 个站点专用提取器——每一个都知道如何从对应站点的 DOM 或 API 中提取干净内容,而不是退回到抓取原始页面 HTML。社交与讨论区(7)
社交与讨论区(7)
Reddit · Hacker News · Twitter/X · Quora · Xiaohongshu(小红书) · Zhihu(知乎) · Instagram
AI 对话导出(2)
AI 对话导出(2)
Claude 对话记录 · 其他 AI 聊天平台(ChatGPT、Gemini 等,通过通用 DOM 提取器支持)
文档与知识库(6)
文档与知识库(6)
Wikipedia · arXiv · OpenAI Docs · 基于 Mintlify 的文档站 · Notion · Google Docs
开发与代码(3)
开发与代码(3)
GitHub Issues/PR · Stack Overflow · dev.to
内容发布(3)
内容发布(3)
Medium · Substack · Product Hunt
中文/CJK 平台(4)
中文/CJK 平台(4)
WeChat(微信公众号) · Bilibili(哔哩哔哩) · Feishu(飞书)——再加上前面提到的 Xiaohongshu 和 Zhihu。代码中把这整个类别标记为差异化程度最高的提取器组——几乎没有竞品能处理这些平台。
视频与媒体(1)
视频与媒体(1)
YouTube(字幕提取)
办公与生产力(5)
办公与生产力(5)
Gmail · LinkedIn · Amazon(产品页面) · Canvas LMS · XenForo 论坛
故障排查
'Native host not installed' 或 'not found'
'Native host not installed' 或 'not found'
Chrome 没有加载 NM manifest。完全退出 Chrome(Cmd+Q)再重新打开。 仅重新加载扩展是不够的。
'Native host has exited' 立即出现
'Native host has exited' 立即出现
Chrome 无法执行 host 脚本。常见原因:
- 找不到
node——重新运行./install.sh,它会使用 node 的绝对路径 - Host 位于受 TCC 保护的目录(
~/Desktop、~/Documents)——重新运行安装脚本,把它移动到~/.web2md/
MCP 报 'Agent connection error'
MCP 报 'Agent connection error'
Native Host 的 TCP server 没有运行。请确认:
- Chrome 已打开
- Web2MD 扩展已加载
- Service Worker 控制台显示 “TCP relay ready on port 12315”
'Failed to extract content from the page'
'Failed to extract content from the page'
扩展未登录。在 Chrome 中打开 Web2MD 弹窗,登录你的 PRO 账户。
'Tab load timeout'
'Tab load timeout'
目标页面加载太慢。对于慢速站点这是正常现象。扩展每个标签页最多等待 15 秒。Reddit 使用 JSON API 提取器,不需要打开标签页,所以 Reddit 上的超时通常意味着帖子 URL 无效(404)。
转换结果没有出现在控制台历史记录里
转换结果没有出现在控制台历史记录里
保存历史记录需要扩展以 PRO 账户登录状态运行。保存操作是”发出后不管”的——如果 API 调用静默失败,转换结果就不会出现。请检查你的认证 token 是否有效。
与 MCP Server 的区别
经验法则: 公开页面用
convert_url。想用扩展的浏览器会话但不想安装 native messaging host 时用 bridge_convert_url。Reddit、需要登录的页面、大量依赖 JS 的站点、需要批量处理,或想通过 agent_convert 的 skill 参数应用 Skill 时,用 agent_convert / agent_batch_convert。