firecrawl-agentAI-агент для сложных сайтов
firecrawl/cli
Firecrawl агент автономно навигирует по сложным многостраничным сайтам и извлекает структурированные данные JSON по заданной схеме.
Установка
npx -y skills add firecrawl/cli --skill firecrawl-agent --agent claude-codeFirecrawl Agent
AI-агент для автономного извлечения данных: навигирует по сложным сайтам и возвращает структурированный JSON. Используйте, когда нужны структурированные данные с сайтов — ценовые планы, списки продуктов, каталоги, любые данные в виде JSON со схемой. Работает 2–5 минут. Более мощный, чем простой скрапинг, для многостраничного структурированного извлечения.
Когда использовать
- Нужны структурированные данные со сложных многостраничных сайтов
- Ручной скрапинг потребовал бы навигации по многим страницам
- Нужно, чтобы AI сам нашёл, где живут данные
Быстрый старт
# Извлечение структурированных данных
firecrawl agent "extract all pricing tiers" --wait -o .firecrawl/pricing.json
# С JSON-схемой для структурированного вывода
firecrawl agent "extract products" \
--schema '{"type":"object","properties":{"name":{"type":"string"},"price":{"type":"number"}}}' \
--wait -o .firecrawl/products.json
# Сфокусироваться на конкретных страницах
firecrawl agent "get feature list" --urls "<url>" --wait -o .firecrawl/features.json
Параметры
| Параметр | Описание |
|---|---|
--urls <urls> | Начальные URL для агента |
--model <model> | Модель: spark-1-mini или spark-1-pro |
--schema <json> | JSON-схема для структурированного вывода |
--schema-file <path> | Путь к файлу JSON-схемы |
--max-credits <n> | Лимит кредитов для этого запуска агента |
--wait | Ждать завершения агента |
--pretty | Красивый вывод JSON |
-o, --output <path> | Путь к файлу вывода |
Советы
- Всегда используйте
--waitдля получения результатов inline. Без него возвращается job ID. - Используйте
--schemaдля предсказуемого структурированного вывода — иначе агент возвращает произвольные данные. - Запуски агента потребляют больше кредитов, чем простые scrape. Используйте
--max-creditsдля ограничения расходов. - Для простого однострочного извлечения предпочитайте
scrape— быстрее и дешевле.
Из того же репозитория
firecrawl — автономный веб-скрапинг
firecrawl/cli
Автономный скрапинг для сложных задач: описываете что нужно — не пишете ломкие скраперы. Работает с JS-рендеренными сайтами там, где другие дают сбой.
firecrawl-scrape — чистый markdown из любого URL
firecrawl/cli
Извлекает чистый LLM-оптимизированный markdown с любого URL через Firecrawl: статические страницы и JS-рендеренные SPA.
firecrawl-search — веб-поиск с извлечением контента
firecrawl/cli
Веб-поиск с опциональным извлечением полного содержания страниц: структурированный JSON вместо простых сниппетов.
firecrawl-crawl — массовое извлечение сайтов
firecrawl/cli
Массовое извлечение структурированного контента с целых сайтов или разделов через Firecrawl: URLs, markdown, метаданные в одном запросе.
firecrawl-map — карта всех URL сайта
firecrawl/cli
Находит и перечисляет все URL сайта через Firecrawl с опциональным поиском для поиска конкретных страниц на больших ресурсах.
firecrawl-download — скачивание сайта в локальные файлы
firecrawl/cli
Маппирует и скрапит целые сайты в организованные локальные директории: markdown, ссылки и скриншоты в нескольких форматах.
