mirror of
https://github.com/snapotter-hq/SnapOtter.git
synced 2026-08-03 07:46:42 +02:00
All 181 docs markdown files translated into 20 languages (apps/docs/<locale>/**). Companion to the i18n code PR; admin-merged because the file count exceeds GitHub's per-PR CI trigger limit. Validated by pnpm i18n:check (all surfaces, 0 stale/missing) and a clean all-locale docs build.
2.3 KiB
2.3 KiB
description, i18n_source_hash, i18n_provenance, i18n_output_hash
| description | i18n_source_hash | i18n_provenance | i18n_output_hash |
|---|---|---|---|
| Extraire le texte de documents PDF à l'aide d'une OCR assistée par IA. | 1431fcba180b | human | 76a0a8e20bc9 |
OCR de PDF
Extrayez le texte de documents PDF à l'aide de la reconnaissance optique de caractères assistée par IA. Prend en charge plusieurs niveaux de qualité et plusieurs langues. Nécessite l'installation du pack de fonctionnalités OCR.
Point de terminaison de l'API
POST /api/v1/tools/pdf/ocr-pdf
Accepte des données de formulaire multipart avec un fichier PDF et un champ settings facultatif au format JSON.
Paramètres
| Paramètre | Type | Requis | Par défaut | Description |
|---|---|---|---|---|
| quality | string | Non | "balanced" |
Niveau de qualité OCR : fast, balanced, best |
| language | string | Non | "auto" |
Langue du document : auto, en, de, fr, es, zh, ja, ko |
| pages | string | Non | "all" |
Sélection de pages, par exemple "all", "1-3", "1,3,5" |
Exemple de requête
curl -X POST http://localhost:1349/api/v1/tools/pdf/ocr-pdf \
-H "Authorization: Bearer si_your-api-key" \
-F "file=@scanned.pdf" \
-F 'settings={"quality": "best", "language": "en", "pages": "1-5"}'
Exemple de réponse
Renvoie 202 Accepted. Suivez la progression via SSE à /api/v1/jobs/{jobId}/progress.
{
"jobId": "a1b2c3d4-e5f6-7890-abcd-ef1234567890",
"async": true
}
Remarques
- Format d'entrée accepté :
.pdf. - Il s'agit d'un outil d'IA qui nécessite l'installation du pack de fonctionnalités OCR. Si le pack n'est pas installé, l'API renvoie
501 Not Implemented. - Le niveau de qualité
fastutilise un modèle plus léger pour un traitement plus rapide ;bestutilise un modèle plus précis au prix de la vitesse. - Le réglage de langue
autotente de détecter automatiquement la langue du document. - Vous pouvez cibler des pages spécifiques à l'aide de plages (
"1-3"), de listes séparées par des virgules ("1,3,5"), ou de"all"pour chaque page. - Pour les PDF qui contiennent déjà du texte sélectionnable, envisagez plutôt d'utiliser l'outil PDF vers texte, plus rapide.