À propos
Cette compétence extrait le texte de PDFs avec un découpage intelligent et une préservation des métadonnées. Pour le traitement par lots de milliers de PDFs, elle utilise pdftotext via subprocess, tandis que PyMuPDF est recommandé pour une qualité supérieure sur des documents individuels. Elle est conçue pour les documents techniques, les articles de recherche et les grandes collections de PDFs.
Installation rapide
Claude Code
Recommandénpx skills add vamseeachanta/workspace-hub -a claude-code/plugin add https://github.com/vamseeachanta/workspace-hubgit clone https://github.com/vamseeachanta/workspace-hub.git ~/.claude/skills/pdf-text-extractorCopiez et collez cette commande dans Claude Code pour installer cette compétence
Dépôt GitHub
Questions fréquentes
Qu’est-ce que le Skill pdf-text-extractor ?
pdf-text-extractor est un Skill Claude créé par vamseeachanta. Un Skill regroupe des instructions et des ressources que Claude charge à la demande pour effectuer des tâches liées à pdf-text-extractor sans consigne supplémentaire.
Comment installer pdf-text-extractor ?
Utilisez les commandes d’installation de cette page : ajoutez pdf-text-extractor à Claude Code comme plugin ou clonez son dépôt dans votre dossier skills, puis redémarrez Claude pour charger le Skill.
À quelle catégorie appartient pdf-text-extractor ?
pdf-text-extractor appartient à la catégorie Autre.
pdf-text-extractor est-il gratuit ?
Oui. pdf-text-extractor est référencé sur AIMCP et son installation est gratuite.
Compétences associées
Cette compétence de Claude offre des conseils d'expert sur la mise en œuvre d'une architecture Data Mesh pour des systèmes de données décentralisés et évolutifs. Elle aide les développeurs à concevoir une gouvernance des données orientée domaine, à créer des produits de données et à établir une gouvernance fédérée avec des plateformes en libre-service. Utilisez cette compétence lors de la planification ou de la refonte d'infrastructures de données à grande échelle pour les aligner sur les domaines organisationnels.
Cette Compétence Claude offre une orchestration experte d'Apache Airflow pour concevoir et gérer des pipelines de données complexes. Elle fournit une connaissance approfondie des DAGs, opérateurs, capteurs, XComs, dépendances de tâches et planifications pour créer des workflows fiables. Utilisez-la lors du développement, du dépannage ou de l'optimisation de déploiements Airflow en production.
Cette compétence de Claude fournit des conseils d'expert sur la mise en œuvre de l'architecture Data Mesh, aidant les développeurs à concevoir des systèmes de données décentralisés et détenus par les domaines. Elle couvre les principes fondamentaux tels que les données en tant que produit, la gouvernance fédérée et les plateformes en libre-service pour une gestion des données évolutive. Utilisez cette compétence lors de la construction ou de la modernisation d'une infrastructure de données pour gérer la complexité organisationnelle à grande échelle.
Cette compétence de Claude fournit des conseils de niveau expert pour l'orchestration de flux de travail avec Apache Airflow, incluant la conception de DAG, les opérateurs, les capteurs et les dépendances entre tâches. Utilisez-la lors de la construction ou du dépannage de pipelines de données complexes pour mettre en œuvre des modèles fiables de planification et d'exécution. Elle couvre les opérations en production, les XComs et la génération dynamique de tâches pour une gestion évolutive des flux de travail.
