Главная · Тег

Оценка

Оценка в экосистеме Claude Code: 177 инструментов — 124 скилла, 47 MCP-серверов, 6 плагинов. Популярные: App Store Google Play ASO здоровье скор, оценка CLI агентов Google, оценка задач Supercent IO. У каждого — описание на русском, команда установки и ссылка на исходники.

aso-audit — App Store Google Play ASO здоровье скор
coreyhaines31/marketingskills
Тянет live данные из App Store или Google Play и оценивает листинг по ASO.
31.6k ★17.9k установок
google-agents-cli-eval — оценка CLI агентов Google
google/agents-cli
Оценка Google Agents CLI.
2.7k ★11.2k установок
task-estimation — оценка задач Supercent IO
supercent-io/skills-template
Оценка задач.
88 ★10.5k установок
agent-evaluation — оценка полного жизненного цикла
supercent-io/skills-template
Структурированный подход к оценке AI агентов охватывающий полный жизненный цикл: от разработки до продакшна.
88 ★10.1k установок
llm-evaluation — оценка LLM Wshobson
wshobson/agents
Оценка LLM.
36.2k ★7.8k установок
eval-harness — жгут оценки Claude Code
affaan-m/everything-claude-code
Жгут оценки.
202.7k ★5k установок
code-maturity-assessor — оценка зрелости кода Trail of Bits
trailofbits/skills
Оценка зрелости кодовой базы.
5.5k ★4k установок
agent-eval — benchmark coding агентов
affaan-m/everything-claude-code
Benchmark система для сравнения coding агентов на реальной кодовой базе: метрики и воспроизводимость.
202.7k ★3.9k установок
skill-judge — судья скиллов Softaworks
softaworks/agent-toolkit
Судья скиллов (оценка).
1.9k ★3.8k установок
evaluation-methodology — методология оценки агенты
wshobson/agents
Методология оценки.
36.2k ★3.4k установок
healthcare-eval-harness — harness оценки здравоохранения Affaan
affaan-m/everything-claude-code
Harness оценки здравоохранения.
202.7k ★3.2k установок
ljg-rank — ранжирование LJG Lijigang
lijigang/ljg-skills
Ранжирование LJG.
5.4k ★3.2k установок
eval-driven-devOfficial — разработка управляемая оценкой GitHub
github/awesome-copilot
Разработка, управляемая оценкой.
34.3k ★2.8k установок
dcf-valuationOfficial — оценка DCF офис финансы
claude-office-skills/skills
Оценка DCF для офиса.
182 ★2.7k установок
adk-eval-guide — методология оценки ADK агентов
google/adk-docs
Методология оценки Google ADK агентов: метрики, тест-кейсы и паттерны улучшения качества ответов.
1.4k ★2.6k установок
legal-risk-assessmentOfficial — оценка юридических рисков Anthropics
anthropics/knowledge-work-plugins
Оценка юридических рисков.
18.8k ★2.5k установок
langsmith-evaluator — оценщик LangSmith официальный
langchain-ai/langsmith-skills
Оценщик LangSmith.
127 ★2.2k установок
langsmith-dataset — датасет LangSmith официальный
langchain-ai/langsmith-skills
Датасет LangSmith.
127 ★2.1k установок
printing-press-score — Printing Press оценка
mvanhorn/cli-printing-press
Оценка контента Printing Press.
2.8k ★2k установок
aso-audit — комплексный ASO health check оценка
eronred/aso-skills
Комплексный ASO health check: проверяет listing по всем ключевым параметрам.
1.4k ★2k установок
risk-assessmentOfficial — оценка рисков Anthropics
anthropics/knowledge-work-plugins
Оценка рисков.
18.8k ★1.6k установок
performance-reviewOfficial — оценка эффективности Anthropics
anthropics/knowledge-work-plugins
Оценка эффективности (HR).
18.8k ★1.5k установок
vendor-reviewOfficial — ревью вендора Anthropics
anthropics/knowledge-work-plugins
Ревью вендора.
18.8k ★1.4k установок
ai-evals — систематические оценки AI продуктов
refoundai/lenny-skills
Проектирование и реализация систематических оценок AI продуктов: метрики, тест-кейсы и анализ.
978 ★1.4k установок

Похожие теги