### [Respan](https://dkwy.com/) **Published:** 2026-05-06T11:00:04 **Author:** 蛋壳 **Excerpt:** Respan(前身为 Keywords AI)是面向 AI Agent 可观测性与评估的统一控制平面。它捕获每次 LLM 调用、工具调用、路由决策和内存状态的完整执行链路,让团队对 Agent 在生产环境中的真实行为了如指掌。Respan 不止于可见性,更形成完整闭环:自动运行工作流级别的评估、定位根因、推荐修复方案,并支持团队直接从平台发布提示词和模型变更。Respan 获得 Y Combinator 和 Gradient 投资,服务于每小时处理数百万次 LLM 调用的团队,并通过 ISO 27001、SOC 2、GDPR 和 HIPAA 合规认证。 ## 产品概述 Respan(前身为 Keywords AI)是面向 AI Agent 可观测性与评估的统一控制平面。它捕获每次 LLM 调用、工具调用、路由决策和内存状态的完整执行链路,让团队对 Agent 在生产环境中的真实行为了如指掌。Respan 不止于可见性,更形成完整闭环:自动运行工作流级别的评估、定位根因、推荐修复方案,并支持团队直接从平台发布提示词和模型变更。Respan 获得 Y Combinator 和 Gradient 投资,服务于每小时处理数百万次 LLM 调用的团队,并通过 ISO 27001、SOC 2、GDPR 和 HIPAA 合规认证。 ## 主要功能 | | | | --- | --- | | **端到端链路追踪** | 捕获生产环境中100%的请求,提供完整的 span 级别详情——包括输入、输出、工具调用、路由决策、延迟、成本及自定义元数据——并自动重建为多步骤 Agent 的完整执行树。 | | **自动化评估工作流** | 在单一评估流水线中整合代码检查、人工审核与 LLM 裁判,当提示词、模型或 Agent 行为发生变化时自动触发——无需额外工具。 | | **AI 评估 Agent** | 业界首创的 Agent,能够分析多次试验中的失败案例、将根因定位到具体决策节点、推荐下一步应添加的评估项,并智能采样线上流量供人工审核。 | | **提示词与模型部署** | 直接在界面中对提示词和模型变更进行版本管理、测试与发布上线,支持回滚,并可使用相同的生产数据与历史版本进行 A/B 对比。 | | **自适应 AI 网关** | 单一网关接入 500+ 模型,支持灵活路由、服务商抽象、BYOK(自带密钥)及自动故障转移——无需重建基础设施。 | | **实时监控与告警** | 自定义仪表盘支持 80+ 图表类型,实时追踪质量、延迟、成本与错误率。当行为出现漂移或异常时,通过 Slack、邮件或短信发送告警,并可自动触发后续评估或数据集构建。 | ## 使用场景 - **AI Agent 调试:**工程团队可直接在回放沙盒中打开任意生产链路,复现故障、测试修复方案并确认解决结果,无需凭感觉排查。 - **回归保护:**频繁迭代提示词或模型的团队使用 Respan 在每次发布前对历史基线运行评估,在影响用户之前提前发现质量回归问题。 - **大规模 LLM 监控:**每小时处理数百万次 LLM 调用的企业(如语音 AI 平台)利用 Respan 的异步日志记录与线程分组功能,在大规模场景下跨 Agent、语言和业务场景保持全面可见性。 - **从生产数据构建数据集:**生产链路自动转化为带标注的评估数据集,省去手动构建测试集的繁琐工作,并确保评估始终基于真实用户使用情况。 - **提示词优化:**团队利用实时生产数据流直接在平台上运行自动提示词工程,持续提升 Agent 输出质量,无需离线实验周期。 ---