Главная · Скиллы · firecrawl-parse

firecrawl-parseпарсинг Firecrawl CLI

firecrawl/cli

Парсинг Firecrawl.

Установка

npx -y skills add firecrawl/cli --skill firecrawl-parse --agent claude-code

Firecrawl Parse

Конвертация локального документа в чистый Markdown на диске. Поддерживаемые форматы: PDF, DOCX, DOC, ODT, RTF, XLSX, XLS, HTML/HTM/XHTML. Используйте при запросах: «разобрать этот PDF», «конвертировать документ», «прочитать файл», «извлечь текст из», а также когда передан локальный путь к файлу (не URL).

Когда использовать

  • Есть файл на диске (не URL), нужен его текст в Markdown
  • Пользователь прислал PDF/DOCX и просит рассказать содержимое или сделать резюме
  • Для URL-источников использовать scrape вместо этого скилла

Быстрый старт

Всегда сохранять в .firecrawl/ с флагом -o — разобранные документы могут весить сотни КБ и засорить контекст при выводе в stdout. Добавить .firecrawl/ в .gitignore.

mkdir -p .firecrawl

# Файл → Markdown
firecrawl parse ./paper.pdf -o .firecrawl/paper.md

# С AI-резюме
firecrawl parse ./paper.pdf -S -o .firecrawl/paper-summary.md

# Ответ на вопрос по документу
firecrawl parse ./paper.pdf -p "Какова основная гипотеза?" -o .firecrawl/answer.md

# XLSX → Markdown
firecrawl parse ./data.xlsx -o .firecrawl/data.md

Опции

ФлагОписание
-o <path>Путь для сохранения файла (обязательно)
-SСгенерировать AI-резюме документа
-p "<вопрос>"Ответить на вопрос по содержимому документа
--formatФормат вывода (по умолчанию: markdown)

Рабочий процесс

  1. Убедиться что путь к файлу локальный (не URL)
  2. Создать директорию .firecrawl/ если её нет
  3. Запустить firecrawl parse с флагом -o
  4. Прочитать сохранённый .md файл для ответа пользователю

Требования

Firecrawl CLI: npm install -g firecrawl или через npx firecrawl. Требует API-ключ Firecrawl (переменная FIRECRAWL_API_KEY).

Из того же репозитория

firecrawlавтономный веб-скрапинг
firecrawl/cli
Автономный скрапинг для сложных задач: описываете что нужно — не пишете ломкие скраперы. Работает с JS-рендеренными сайтами там, где другие дают сбой.
42866k установок
firecrawl-scrapeчистый markdown из любого URL
firecrawl/cli
Извлекает чистый LLM-оптимизированный markdown с любого URL через Firecrawl: статические страницы и JS-рендеренные SPA.
42851k установок
firecrawl-searchвеб-поиск с извлечением контента
firecrawl/cli
Веб-поиск с опциональным извлечением полного содержания страниц: структурированный JSON вместо простых сниппетов.
42850.9k установок
firecrawl-agentAI-агент для сложных сайтов
firecrawl/cli
Firecrawl агент автономно навигирует по сложным многостраничным сайтам и извлекает структурированные данные JSON по заданной схеме.
42850k установок
firecrawl-crawlмассовое извлечение сайтов
firecrawl/cli
Массовое извлечение структурированного контента с целых сайтов или разделов через Firecrawl: URLs, markdown, метаданные в одном запросе.
42849.9k установок
firecrawl-mapкарта всех URL сайта
firecrawl/cli
Находит и перечисляет все URL сайта через Firecrawl с опциональным поиском для поиска конкретных страниц на больших ресурсах.
42849.7k установок