RED HAT Openshift AI

科技人工智能

决策模型Jev性能未超越LLM评判和传统分类器

Red Hat AI Safety团队发布了一项技术评估,对比了TypeSafe AI的Jev决策模型与传统文本分类器和LLM-as-a-judge方法在AI安全守卫中的表现。该研究通过在提示注入和内容安全两个基准测试中对9种方法进行评估,结果显示Jev决策模型在速度和准确性上并未超越LLM-as-a-judge或预…