Agent
Giskard
面向 LLM 的红队测试、对抗探测与安全护栏开源+企业平台。
访问官网
访问方式:开源
它是什么
Giskard 提供持续红队、LLM 评测与 AI Guardrails,内置大量对抗性探测用例,帮助发现偏见、注入与幻觉等风险。适合在金融、医疗等监管行业上线前对模型与 Agent 做安全扫描,也可自托管核心组件。
适用边界
Giskard 明显站在「安全/red team」一侧,不是通用评测仪表盘;若你只关心回答是否相关,应和 Galileo 类观测工具区分。
典型使用场景
- 对聊天机器人跑对抗性探针与越狱测试
- 在 CI 中集成 LLM 安全评测套件
- 为 RAG 系统检测敏感话题与幻觉回答
- 部署 Guardrails 拦截高风险输出
适合谁
- 受监管行业上线 LLM 前的安全团队
- 需要系统化 adversarial 测试的 ML 平台
不太适合
内部低风险的创意写作工具,无需红队流程
工具信息
- 访问方式
- 开源
- 分类
- Agent
- 标签
- Agent · 自动化 · 工作流 · 开发 · API · 企业
细分分类: AI 工作流自动化