
Evalview MCP
Подключить Evalview MCP
Выберите способ запуска и свой MCP-клиент. Ниже останется одна готовая инструкция, которую можно проверить и скопировать.
Способ подключения
Куда подключить
Скопируйте и проверьте
Claude Desktop / Claude Code
Клиент запускает MCP-сервер как локальный процесс.
- 1.Откройте настройки MCP в Claude.
- 2.Добавьте сервер с указанной командой и переменными окружения.
- 3.Перезапустите Claude, если сервер не появился автоматически.
{
"mcpServers": {
"evalview-mcp": {
"command": "uvx",
"args": [
"evalview"
]
}
}
}Сгенерировано из существующей команды запуска. Желательно сверить с README.
Инструкция собрана из данных карточки и пока не отмечена как проверенная редакцией. Сверьте команду с README источника и не передавайте лишние права или секреты.
Как оценить Evalview MCP
Evalview MCP относится к AI и машинное обучение, Разработка. Ниже собраны проверяемые признаки, по которым его можно сравнить с другими серверами каталога.
- Происхождение
- Проект сообщества
- Лицензия
- Apache-2.0
- Реализация
- Python
- Транспорт
- stdio
Что проверить перед выбором
- Изучите README, открытые issues и историю последних изменений в репозитории.
- Проверьте команду установки и зависимости перед запуском в рабочем окружении.
- Ограничьте доступ MCP-сервера только нужными файлами, API и переменными окружения.
Карточка отредактирована 20.07.2026.
Автоматическая проверка источника ещё не выполнена. Внешних источников в карточке: 1.
Характеристики
Общее
- СтатусСообщество
- Разработчикhidai25
- ЛицензияApache-2.0
Технологии
- ЯзыкиPython
- Транспортstdio
Описание
Возможности
- Создание золотых эталонов: запись корректного поведения агента по каждому сценарию
- Обнаружение скрытых регрессий: фиксация изменений в выборе инструментов, структуре ответа, качестве вывода
- Разделение дрифта: сервер отличает смену модели/провайдера от регрессии вашего кода
- Автоматическое исцеление: повтор проблемных вызовов с проверкой, шлюзами и аудитом
- Детерминированное воспроизведение: кассеты записывают вызовы один раз, CI проигрывает их без живых сервисов
- Фиксация метаданных: для каждого прогона сохраняется модель, провайдер, время, версия агента
- Интеграция с CI/CD: проверки запускаются автоматически в пайплайне
- Поддержка мультиагентных сред: LangGraph, CrewAI
- Классификация изменений с градуированной оценкой уверенности (не бинарный ответ)
- Инспекция дрифта: наглядное сравнение эталонного и нового выполнения
- Аудит всех исцелений и проверок с логом для команды
- Шлюзы проверки: перед автоматическим исцелением изменение должен одобрить разработчик
Как подключить
Установка через uvx:
uvx evalview
Пример конфигурации для Claude Desktop:
{
"mcpServers": {
"evalview": {
"command": "uvx",
"args": ["evalview"]
}
}
}
Перезагрузите клиент, и MCP-сервер появится в списке доступных инструментов. Для других клиентов (Windsurf, Cursor) укажите ту же команду в настройках MCP.
Примеры запросов
- «Запусти регрессионный тест для агента поддержки и покажи, какие отклонения от эталона появились»
- «Сравни последние десять выполнений с золотым эталоном и выдели изменения в выборе инструментов»
- «Проверь, изменилось ли поведение после обновления модели GPT-4o, и дай оценку уверенности для каждого отклонения»
- «Запиши новый эталон для сценария оформления заказа и настрой автоматический запуск проверки после каждого деплоя»
- «Покажи историю дрифта за последнюю неделю и отфильтруй только регрессии системы (не провайдера)»
Технические детали
- Язык: Python
- Транспорт: stdio
- Лицензия: Apache-2.0
- Совместимые клиенты: Claude Desktop, GitHub Actions, любые MCP-клиенты (Windsurf, Cursor)
- Поддерживаемые фреймворки агентов: LangGraph, CrewAI, OpenAI, Claude