什么是 RTC Agent
一句话定义:开源的网站 AI 助手后端,通过标准化的 Remote Tool Calling 协议,让你的网站几行代码接入透明、高效、低成本的 AI 助手。
RTC Agent 让 AI 在服务端推理,工具在前端执行——读取页面内容、操作虚拟文件系统、调用业务接口——所有过程通过 WebSocket 实时同步,对你的用户完全可见。

谁应该使用 RTC Agent?
Section titled “谁应该使用 RTC Agent?”- SaaS 产品团队:想为自己的产品添加 AI 助手,但不想重构后端
- 前端开发者:希望快速集成 AI 能力,专注于业务逻辑而非 AI 基础设施
- 对隐私敏感的应用:医疗、金融、企业内部工具,数据不能离开用户设备
前端虚拟文件系统
Section titled “前端虚拟文件系统”基于 IndexedDB 构建,AI 工具(read / write / ls / grep)直接操作前端文件,数据不离开用户浏览器。
Script 工具 + Function 组合
Section titled “Script 工具 + Function 组合”开发者只需维护自己的 Function 库,Agent 通过 script 工具在前端执行,并能自由组合多个 Function 完成复杂任务——无需预定义 workflow。
💡 开发者视角:你只需定义业务原子能力(Function),Agent 自己学会如何组合它们。就像给 AI 一套乐高积木,它自己会拼出你想要的形状。
基于 Centrifuge WebSocket,消息双向推送,支持流式输出、工具调用进度、状态同步。
双层记忆:Session Memory(会话上下文压缩)+ User Memory(跨会话长期记忆,支持向量检索)。AI 真正”记住”你的用户。
自动压缩长对话,Token 消耗可控。告别”上下文超限”报错。
子代理 + 目标驱动
Section titled “子代理 + 目标驱动”复杂任务自动拆解,多个专业子代理并行工作;AI 设定、追踪、完成多步骤目标,turn-boundary checkpoint 保证任务不丢失。
核心数据流:
- 所有 Function 和文件数据都在浏览器的 IndexedDB 中,服务端不接触业务数据
- Agent 引擎通过 RTC 协议向浏览器发起工具调用,浏览器执行后回传结果
- 记忆系统和上下文管理在服务端运行,负责对话质量优化
| 传统方案 | RTC | RTC + Function | |
|---|---|---|---|
| 工具执行位置 | 服务端 ❌ | 前端 ✅ | 前端 ✅ |
| 数据流向 | 上云 🔒 | 留在用户设备 🔐 | 留在用户设备 🔐 |
| 扩展方式 | 改服务端代码 | 定义前端工具 | 只需定义 Function,Agent 自己学会组合 |
对比其他 AI 助手方案
Section titled “对比其他 AI 助手方案”| 方案 | 接入成本 | 可观测性 | Token 成本 | 错误率 | 隐私安全 |
|---|---|---|---|---|---|
| RTC Agent | 低 — 几行代码 | 完全透明 | 低 | 低 | 数据不出前端 |
| 视觉解析 (截图+OCR) | 中等 | 黑箱 | 极高 | 较高 | 需上传截图 |
| DOM 爬取 (服务端解析) | 复杂 | 部分可见 | 中等 | 中等 | 数据上云 |
| 浏览器插件 | 需安装 | 较好 | 中等 | 中等 | 本地运行 |
每种方案都有适用场景:视觉解析适合遗留系统零改造接入,浏览器插件适合离线场景。RTC Agent 的优势在于——不需要安装、不需要截图、不需要改服务端,几行代码就能让 AI 以结构化方式理解并操作你的网站。