Files
SnapOtter/apps/docs/fr/tools/pdf/pdf-to-text.md
T
SnapOtterandGitHub 4963ab3bbd feat(docs-i18n): translate all documentation into 20 languages
All 181 docs markdown files translated into 20 languages (apps/docs/<locale>/**). Companion to the i18n code PR; admin-merged because the file count exceeds GitHub's per-PR CI trigger limit. Validated by pnpm i18n:check (all surfaces, 0 stale/missing) and a clean all-locale docs build.
2026-07-11 13:52:47 +08:00

1.4 KiB

description, i18n_source_hash, i18n_provenance, i18n_output_hash
description i18n_source_hash i18n_provenance i18n_output_hash
Extraire le texte brut d'un PDF. 15a7bc1cdf8f human 6420be9c79b2

PDF vers texte

Extrayez tout le texte brut lisible d'un document PDF dans un fichier texte.

Point de terminaison de l'API

POST /api/v1/tools/pdf/pdf-to-text

Accepte des données de formulaire multipart avec un fichier PDF.

Paramètres

Cet outil n'a aucun paramètre configurable. Téléversez un PDF et son contenu texte sera extrait.

Exemple de requête

curl -X POST http://localhost:1349/api/v1/tools/pdf/pdf-to-text \
  -H "Authorization: Bearer si_your-api-key" \
  -F "file=@report.pdf"

Exemple de réponse

{
  "jobId": "a1b2c3d4-e5f6-7890-abcd-ef1234567890",
  "downloadUrl": "/api/v1/download/a1b2c3d4-e5f6-7890-abcd-ef1234567890/report.txt",
  "originalSize": 520000,
  "processedSize": 14300,
  "chars": 14300
}

Remarques

  • Format d'entrée accepté : .pdf.
  • Il s'agit d'un outil rapide (synchrone) qui renvoie le résultat directement.
  • Le champ chars de la réponse indique le nombre de caractères extraits.
  • Seul le texte intégré numériquement est extrait. Pour les documents numérisés ou les PDF basés sur des images, utilisez plutôt l'outil OCR de PDF.