ai-evaluation

github.com
Открыть сайт

Open-source LLM and agent evaluation framework with 50+ metrics, LLM-as-Judge augmentation, and guardrail scanners (jailbreak, PII, prompt-injection). Useful for scoring RAG outputs, agent trajectories, and function-calling behavior in data-science workflows.

Описание

Характеристики

Тип Репозиторий
КатегорияGitHub-проекты / Из awesome-списка
Цена открытый код
Платформа Своё развёртывание
Системы исходный код
Язык сайтаen
GitHubfuture-agi/ai-evaluation

Платформы

Исходный код

future-agi/ai-evaluation

Найден в источниках

Похожие в разделе «GitHub-проекты»

Предложить сайт в каталог

Пришлите ссылку — остальное мы выясним сами.

Мы рассмотрим, что вы прислали, и добавим в каталог, если подойдёт.

Не знаете, как внедрить? Мы поможем

Расскажите про задачу — подберём инструменты и подскажем, с чего начать.

0 / 5000
Проверочный код

Поля со звёздочкой обязательны. Данные используются только для ответа.