Главная · Тег
Оценка
Оценка в экосистеме Claude Code: 177 инструментов — 124 скилла, 47 MCP-серверов, 6 плагинов. Популярные: App Store Google Play ASO здоровье скор, оценка CLI агентов Google, оценка задач Supercent IO. У каждого — описание на русском, команда установки и ссылка на исходники.
aso-audit — App Store Google Play ASO здоровье скор
coreyhaines31/marketingskills
Тянет live данные из App Store или Google Play и оценивает листинг по ASO.
google-agents-cli-eval — оценка CLI агентов Google
google/agents-cli
Оценка Google Agents CLI.
task-estimation — оценка задач Supercent IO
supercent-io/skills-template
Оценка задач.
agent-evaluation — оценка полного жизненного цикла
supercent-io/skills-template
Структурированный подход к оценке AI агентов охватывающий полный жизненный цикл: от разработки до продакшна.
llm-evaluation — оценка LLM Wshobson
wshobson/agents
Оценка LLM.
eval-harness — жгут оценки Claude Code
affaan-m/everything-claude-code
Жгут оценки.
code-maturity-assessor — оценка зрелости кода Trail of Bits
trailofbits/skills
Оценка зрелости кодовой базы.
agent-eval — benchmark coding агентов
affaan-m/everything-claude-code
Benchmark система для сравнения coding агентов на реальной кодовой базе: метрики и воспроизводимость.
skill-judge — судья скиллов Softaworks
softaworks/agent-toolkit
Судья скиллов (оценка).
evaluation-methodology — методология оценки агенты
wshobson/agents
Методология оценки.
healthcare-eval-harness — harness оценки здравоохранения Affaan
affaan-m/everything-claude-code
Harness оценки здравоохранения.
ljg-rank — ранжирование LJG Lijigang
lijigang/ljg-skills
Ранжирование LJG.
eval-driven-devOfficial — разработка управляемая оценкой GitHub
github/awesome-copilot
Разработка, управляемая оценкой.
dcf-valuationOfficial — оценка DCF офис финансы
claude-office-skills/skills
Оценка DCF для офиса.
adk-eval-guide — методология оценки ADK агентов
google/adk-docs
Методология оценки Google ADK агентов: метрики, тест-кейсы и паттерны улучшения качества ответов.
legal-risk-assessmentOfficial — оценка юридических рисков Anthropics
anthropics/knowledge-work-plugins
Оценка юридических рисков.
langsmith-evaluator — оценщик LangSmith официальный
langchain-ai/langsmith-skills
Оценщик LangSmith.
langsmith-dataset — датасет LangSmith официальный
langchain-ai/langsmith-skills
Датасет LangSmith.
printing-press-score — Printing Press оценка
mvanhorn/cli-printing-press
Оценка контента Printing Press.
aso-audit — комплексный ASO health check оценка
eronred/aso-skills
Комплексный ASO health check: проверяет listing по всем ключевым параметрам.
risk-assessmentOfficial — оценка рисков Anthropics
anthropics/knowledge-work-plugins
Оценка рисков.
performance-reviewOfficial — оценка эффективности Anthropics
anthropics/knowledge-work-plugins
Оценка эффективности (HR).
vendor-reviewOfficial — ревью вендора Anthropics
anthropics/knowledge-work-plugins
Ревью вендора.
ai-evals — систематические оценки AI продуктов
refoundai/lenny-skills
Проектирование и реализация систематических оценок AI продуктов: метрики, тест-кейсы и анализ.