AI安全评测工具测模型的越狱、偏见和泄露,上线前把关。它做红队、扫描和报告,企业和监管常用它,也做合规,挑时候看覆盖全不全、误报多不多,以及能不能接流水线。
斯坦福推出的语言模型全面评测套件,覆盖能力、多模态、安全等方向,用统一基准横向比较各家大模型。