Главная · Тег
Benchmark
Benchmark в экосистеме Claude Code: 11 инструментов. Популярные: benchmark coding агентов, benchmark производительность измерение Claude Code, оптимизация claude-flow v3. У каждого — описание на русском, команда установки и ссылка на исходники.
agent-eval — benchmark coding агентов
affaan-m/everything-claude-code
Benchmark система для сравнения coding агентов на реальной кодовой базе: метрики и воспроизводимость.
benchmark — benchmark производительность измерение Claude Code
affaan-m/everything-claude-code
Измерение и benchmark производительности в Claude Code.
agent-v3-performance-engineer — оптимизация claude-flow v3
ruvnet/ruflo
Оптимизация производительности claude-flow v3 через агрессивный benchmarking и валидацию.
agent-performance-benchmarker — benchmark консенсус протоколов
ruvnet/ruflo
Benchmarking фреймворк для распределённых консенсус протоколов: throughput и latency измерения.
agent-benchmark-suite — трекинг производительности агентов
ruvnet/ruflo
Отслеживает производительность агентов со временем и ловит регрессии до попадания в продакшн.
benchmark-to-brief — benchmark в бриф конкурентный анализ маркетинг
postplusai/postplus-skills
Преобразование конкурентного benchmark в маркетинговый бриф.
alicloud-platform-multicloud-docs-api-benchmark — benchmark мультиоблачных API доков
cinience/alicloud-skills
Сравнивает документацию API провайдеров при архитектуре multicloud или миграции.
benchmark-agents — Vercel benchmark агенты сравнение тест
vercel-labs/vercel-plugin
Сравнительный тест AI агентов на Vercel платформе.
benchmark-testing — Vercel benchmark тестирование платформа
vercel-labs/vercel-plugin
Benchmark тестирование Vercel платформы и приложений.
benchmark-sandbox — Vercel sandbox benchmark изолированный тест
vercel-labs/vercel-plugin
Изолированный sandbox benchmark для Vercel.
alicloud-platform-multicloud-docs-api-benchmark-test — smoke тест multicloud benchmark
cinience/alicloud-skills
Smoke тест сьют для benchmark мультиоблачной документации API Alibaba Cloud.