Главная · Скиллы · firecrawl-agent

firecrawl-agentAI-агент для сложных сайтов

firecrawl/cli

Firecrawl агент автономно навигирует по сложным многостраничным сайтам и извлекает структурированные данные JSON по заданной схеме.

Установка

npx -y skills add firecrawl/cli --skill firecrawl-agent --agent claude-code

Firecrawl Agent

AI-агент для автономного извлечения данных: навигирует по сложным сайтам и возвращает структурированный JSON. Используйте, когда нужны структурированные данные с сайтов — ценовые планы, списки продуктов, каталоги, любые данные в виде JSON со схемой. Работает 2–5 минут. Более мощный, чем простой скрапинг, для многостраничного структурированного извлечения.

Когда использовать

  • Нужны структурированные данные со сложных многостраничных сайтов
  • Ручной скрапинг потребовал бы навигации по многим страницам
  • Нужно, чтобы AI сам нашёл, где живут данные

Быстрый старт

# Извлечение структурированных данных
firecrawl agent "extract all pricing tiers" --wait -o .firecrawl/pricing.json

# С JSON-схемой для структурированного вывода
firecrawl agent "extract products" \
  --schema '{"type":"object","properties":{"name":{"type":"string"},"price":{"type":"number"}}}' \
  --wait -o .firecrawl/products.json

# Сфокусироваться на конкретных страницах
firecrawl agent "get feature list" --urls "<url>" --wait -o .firecrawl/features.json

Параметры

ПараметрОписание
--urls <urls>Начальные URL для агента
--model <model>Модель: spark-1-mini или spark-1-pro
--schema <json>JSON-схема для структурированного вывода
--schema-file <path>Путь к файлу JSON-схемы
--max-credits <n>Лимит кредитов для этого запуска агента
--waitЖдать завершения агента
--prettyКрасивый вывод JSON
-o, --output <path>Путь к файлу вывода

Советы

  • Всегда используйте --wait для получения результатов inline. Без него возвращается job ID.
  • Используйте --schema для предсказуемого структурированного вывода — иначе агент возвращает произвольные данные.
  • Запуски агента потребляют больше кредитов, чем простые scrape. Используйте --max-credits для ограничения расходов.
  • Для простого однострочного извлечения предпочитайте scrape — быстрее и дешевле.

Из того же репозитория

firecrawlавтономный веб-скрапинг
firecrawl/cli
Автономный скрапинг для сложных задач: описываете что нужно — не пишете ломкие скраперы. Работает с JS-рендеренными сайтами там, где другие дают сбой.
42866k установок
firecrawl-scrapeчистый markdown из любого URL
firecrawl/cli
Извлекает чистый LLM-оптимизированный markdown с любого URL через Firecrawl: статические страницы и JS-рендеренные SPA.
42851k установок
firecrawl-searchвеб-поиск с извлечением контента
firecrawl/cli
Веб-поиск с опциональным извлечением полного содержания страниц: структурированный JSON вместо простых сниппетов.
42850.9k установок
firecrawl-crawlмассовое извлечение сайтов
firecrawl/cli
Массовое извлечение структурированного контента с целых сайтов или разделов через Firecrawl: URLs, markdown, метаданные в одном запросе.
42849.9k установок
firecrawl-mapкарта всех URL сайта
firecrawl/cli
Находит и перечисляет все URL сайта через Firecrawl с опциональным поиском для поиска конкретных страниц на больших ресурсах.
42849.7k установок
firecrawl-downloadскачивание сайта в локальные файлы
firecrawl/cli
Маппирует и скрапит целые сайты в организованные локальные директории: markdown, ссылки и скриншоты в нескольких форматах.
42849.6k установок