Files
SnapOtter/apps/docs/fr/tools/pdf/ocr-pdf.md
T
SnapOtterandGitHub 4963ab3bbd feat(docs-i18n): translate all documentation into 20 languages
All 181 docs markdown files translated into 20 languages (apps/docs/<locale>/**). Companion to the i18n code PR; admin-merged because the file count exceeds GitHub's per-PR CI trigger limit. Validated by pnpm i18n:check (all surfaces, 0 stale/missing) and a clean all-locale docs build.
2026-07-11 13:52:47 +08:00

2.3 KiB

description, i18n_source_hash, i18n_provenance, i18n_output_hash
description i18n_source_hash i18n_provenance i18n_output_hash
Extraire le texte de documents PDF à l'aide d'une OCR assistée par IA. 1431fcba180b human 76a0a8e20bc9

OCR de PDF

Extrayez le texte de documents PDF à l'aide de la reconnaissance optique de caractères assistée par IA. Prend en charge plusieurs niveaux de qualité et plusieurs langues. Nécessite l'installation du pack de fonctionnalités OCR.

Point de terminaison de l'API

POST /api/v1/tools/pdf/ocr-pdf

Accepte des données de formulaire multipart avec un fichier PDF et un champ settings facultatif au format JSON.

Paramètres

Paramètre Type Requis Par défaut Description
quality string Non "balanced" Niveau de qualité OCR : fast, balanced, best
language string Non "auto" Langue du document : auto, en, de, fr, es, zh, ja, ko
pages string Non "all" Sélection de pages, par exemple "all", "1-3", "1,3,5"

Exemple de requête

curl -X POST http://localhost:1349/api/v1/tools/pdf/ocr-pdf \
  -H "Authorization: Bearer si_your-api-key" \
  -F "file=@scanned.pdf" \
  -F 'settings={"quality": "best", "language": "en", "pages": "1-5"}'

Exemple de réponse

Renvoie 202 Accepted. Suivez la progression via SSE à /api/v1/jobs/{jobId}/progress.

{
  "jobId": "a1b2c3d4-e5f6-7890-abcd-ef1234567890",
  "async": true
}

Remarques

  • Format d'entrée accepté : .pdf.
  • Il s'agit d'un outil d'IA qui nécessite l'installation du pack de fonctionnalités OCR. Si le pack n'est pas installé, l'API renvoie 501 Not Implemented.
  • Le niveau de qualité fast utilise un modèle plus léger pour un traitement plus rapide ; best utilise un modèle plus précis au prix de la vitesse.
  • Le réglage de langue auto tente de détecter automatiquement la langue du document.
  • Vous pouvez cibler des pages spécifiques à l'aide de plages ("1-3"), de listes séparées par des virgules ("1,3,5"), ou de "all" pour chaque page.
  • Pour les PDF qui contiennent déjà du texte sélectionnable, envisagez plutôt d'utiliser l'outil PDF vers texte, plus rapide.