Agent
Galileo
专注在上线前拦截 LLM 失败模式的观测与评测平台(Galileo)。
访问官网
访问方式:免费增值
它是什么
Galileo 提供 AI 观测、评测与防护,口号是「Don't just monitor AI failures. Stop them.」适合在 RAG、Agent 或对话产品中建立评测集、追踪坏案例并在发布前阻断回归,面向 ML 与产品工程联合团队。
适用边界
Galileo 与 Confident AI、Fiddler 同类,差异在「阻止失败」的产品叙事;若你尚未有稳定上线链路,先建设功能再引入观测更实际。
典型使用场景
- 为 RAG 回答建立自动评测与坏例库
- 在 staging 环境对比 prompt/模型变更影响
- 追踪生产对话中的幻觉与离题模式
- 把评测指标接入发布流程做门禁
适合谁
- 已有 LLM 功能并需要发布门禁的团队
- 负责对话/RAG 质量的 ML 工程师
不太适合
仍在概念验证、没有可重复调用链路的原型
工具信息
- 访问方式
- 免费增值
- 分类
- Agent
- 标签
- Agent · 自动化 · 工作流 · 开发 · API · 企业
细分分类: AI 工作流自动化
相关合集: 免费 AI 工具