Conversion PDF en Markdown

VérifiéPrudence

Convertit un PDF en Markdown de haute qualité via le pipeline VLM de l'API MinerU. Extrait le texte, les formules et les images.

Spar Skills Guide Bot
Data & IADébutant
1027/07/2026
Claude Code
#pdf#markdown#conversion#mineru#vlm

Recommandé pour

Notre avis

Convertit un PDF en Markdown de haute qualité via l'API MinerU avec le modèle VLM pour une extraction précise des formules, tableaux et mises en page complexes.

Points forts

  • Qualité de conversion élevée pour documents académiques
  • Extraction des images intégrées
  • Gestion des formules et tableaux complexes
  • Support des langues multiples avec indication de langue

Limites

  • Nécessite une clé API MinerU
  • Dépend de la connexion Internet
  • Écrase les fichiers existants sans avertissement
Quand l'utiliser

Utilisez cette compétence lorsque vous avez besoin de convertir des PDFs académiques ou techniques en Markdown avec une haute fidélité, notamment pour les formules et tableaux.

Quand l'éviter

Évitez cette compétence si vous travaillez hors ligne, si vous n'avez pas de token API, ou si seule une extraction de texte brut est nécessaire.

Analyse de sécurité

Prudence
Score qualité85/100

The skill invokes a Python script that sends the PDF to the MinerU API for processing. This involves network communication and potential data exfiltration risk. However, the script is not provided, so no malicious code is evident. The environment variable token handling is standard. The operation is legitimate for PDF conversion.

Points d'attention
  • Sends PDF files to an external API, which may expose sensitive content if not careful with token and endpoint.

Exemples

Convert PDF to Markdown
Convert this PDF to Markdown: /path/to/paper.pdf
Convert with language hint
Convert this Chinese PDF to Markdown: /path/to/chinese_paper.pdf -l ch

name: pdf-to-md description: > Convert a PDF into high-quality Markdown through the MinerU API VLM pipeline. Use this skill whenever the user wants PDF-to-Markdown conversion, OCR-like extraction, paper text extraction, or Markdown plus extracted images from a PDF. This skill supports the API backend only and always uses the high-quality VLM model configuration. argument-hint: "<pdf_path> [-l lang]" allowed-tools: Bash

PDF to Markdown

Converts a PDF to:

<pdf_stem>.md
<pdf_stem>_images/

Prerequisite

Set the MinerU API token:

export MINERU_API_TOKEN="your_token_here"

Usage

python3 "${SKILL_DIR}/scripts/mineru-api.py" <pdf_path> [-l lang]
  • pdf_path: local PDF path
  • -l lang: language hint, en or ch

Backend contract

  • Supported backend: MinerU API only
  • Model: VLM
  • Goal: highest available parsing quality for formulas, tables, and mixed-layout academic PDFs

Output behavior

  • Output files are written next to the PDF
  • Existing Markdown and image directories for the same stem may be overwritten
  • Example: paper.pdf -> paper.md and paper_images/
Skills similaires