产品概述
Respan(前身为 Keywords AI)是面向 AI Agent 可观测性与评估的统一控制平面。它捕获每次 LLM 调用、工具调用、路由决策和内存状态的完整执行链路,让团队对 Agent 在生产环境中的真实行为了如指掌。Respan 不止于可见性,更形成完整闭环:自动运行工作流级别的评估、定位根因、推荐修复方案,并支持团队直接从平台发布提示词和模型变更。Respan 获得 Y Combinator 和 Gradient 投资,服务于每小时处理数百万次 LLM 调用的团队,并通过 ISO 27001、SOC 2、GDPR 和 HIPAA 合规认证。
主要功能
| 端到端链路追踪 | 捕获生产环境中100%的请求,提供完整的 span 级别详情——包括输入、输出、工具调用、路由决策、延迟、成本及自定义元数据——并自动重建为多步骤 Agent 的完整执行树。 |
| 自动化评估工作流 | 在单一评估流水线中整合代码检查、人工审核与 LLM 裁判,当提示词、模型或 Agent 行为发生变化时自动触发——无需额外工具。 |
| AI 评估 Agent | 业界首创的 Agent,能够分析多次试验中的失败案例、将根因定位到具体决策节点、推荐下一步应添加的评估项,并智能采样线上流量供人工审核。 |
| 提示词与模型部署 | 直接在界面中对提示词和模型变更进行版本管理、测试与发布上线,支持回滚,并可使用相同的生产数据与历史版本进行 A/B 对比。 |
| 自适应 AI 网关 | 单一网关接入 500+ 模型,支持灵活路由、服务商抽象、BYOK(自带密钥)及自动故障转移——无需重建基础设施。 |
| 实时监控与告警 | 自定义仪表盘支持 80+ 图表类型,实时追踪质量、延迟、成本与错误率。当行为出现漂移或异常时,通过 Slack、邮件或短信发送告警,并可自动触发后续评估或数据集构建。 |
使用场景
- AI Agent 调试:工程团队可直接在回放沙盒中打开任意生产链路,复现故障、测试修复方案并确认解决结果,无需凭感觉排查。
- 回归保护:频繁迭代提示词或模型的团队使用 Respan 在每次发布前对历史基线运行评估,在影响用户之前提前发现质量回归问题。
- 大规模 LLM 监控:每小时处理数百万次 LLM 调用的企业(如语音 AI 平台)利用 Respan 的异步日志记录与线程分组功能,在大规模场景下跨 Agent、语言和业务场景保持全面可见性。
- 从生产数据构建数据集:生产链路自动转化为带标注的评估数据集,省去手动构建测试集的繁琐工作,并确保评估始终基于真实用户使用情况。
- 提示词优化:团队利用实时生产数据流直接在平台上运行自动提示词工程,持续提升 Agent 输出质量,无需离线实验周期。









