PDF OCR Extraction
О программе
Этот навык позволяет извлекать текст с помощью OCR из сканированных PDF-файлов и изображений, делая их доступными для поиска и оцифрованными. Он поддерживает пакетную обработку, сохранение макета и ограниченное распознавание рукописного текста. Разработчики могут использовать его для преобразования документов на основе изображений в структурированный, машиночитаемый текст.
Быстрая установка
Claude Code
Рекомендуетсяnpx skills add openclaw/skills -a claude-code/plugin add https://github.com/openclaw/skillsgit clone https://github.com/openclaw/skills.git ~/.claude/skills/PDF OCR ExtractionСкопируйте и вставьте эту команду в Claude Code для установки этого навыка
GitHub репозиторий
Часто задаваемые вопросы
Что такое Skill PDF OCR Extraction?
PDF OCR Extraction — это Claude Skill от openclaw. Skills объединяют инструкции и ресурсы, которые Claude загружает по мере необходимости, чтобы выполнять задачи, связанные с PDF OCR Extraction, без дополнительных запросов.
Как установить PDF OCR Extraction?
Используйте команды установки на этой странице: добавьте PDF OCR Extraction в Claude Code как плагин или клонируйте репозиторий в каталог skills, затем перезапустите Claude, чтобы загрузить Skill.
К какой категории относится PDF OCR Extraction?
PDF OCR Extraction относится к категории Документы.
Можно ли использовать PDF OCR Extraction бесплатно?
Да. PDF OCR Extraction размещён на AIMCP и доступен для бесплатной установки.
Похожие навыки
Этот навык предоставляет рекомендации по семантическому версионированию (semver) и стандарты форматирования журнала изменений для релизов программного обеспечения. Используйте его при подготовке выпусков, чтобы правильно увеличивать номера версий (мажорные/минорные/патчи) и структурировать записи в журнале изменений. Он включает правила для идентификаторов предварительных релизов и понятные примеры для разработчиков.
Этот навык форматирует сообщения коммитов Git в соответствии со стандартом Conventional Commits. Он предоставляет шаблоны и определения типов (такие как `feat`, `fix`, `refactor`), чтобы обеспечить единообразие при написании или проверке коммитов. Используйте его в процессе создания коммитов для формирования понятной и структурированной истории изменений.
Этот навык обеспечивает высокопроизводительную токенизацию с использованием Rust-библиотеки от HuggingFace, обрабатывая 1 ГБ текста менее чем за 20 секунд. Он поддерживает алгоритмы BPE, WordPiece и Unigram, а также позволяет обучать пользовательские токенизаторы и отслеживать выравнивание. Используйте его, когда требуется производственно-быстрая токенизация или для создания пользовательских токенизаторов, интегрированных с экосистемой transformers.
nano-pdf — это инструмент командной строки, который позволяет разработчикам редактировать PDF-файлы с помощью инструкций на естественном языке, например, изменять текст или исправлять опечатки на конкретных страницах. Он идеально подходит для быстрых программных изменений PDF прямо из терминала. Всегда проверяйте результат, так как нумерация страниц может различаться в разных версиях.
