mirror of
https://github.com/snapotter-hq/SnapOtter.git
synced 2026-08-03 07:46:42 +02:00
All 181 docs markdown files translated into 20 languages (apps/docs/<locale>/**). Companion to the i18n code PR; admin-merged because the file count exceeds GitHub's per-PR CI trigger limit. Validated by pnpm i18n:check (all surfaces, 0 stale/missing) and a clean all-locale docs build.
1.4 KiB
1.4 KiB
description, i18n_source_hash, i18n_provenance, i18n_output_hash
| description | i18n_source_hash | i18n_provenance | i18n_output_hash |
|---|---|---|---|
| Extraire le texte brut d'un PDF. | 15a7bc1cdf8f | human | 6420be9c79b2 |
PDF vers texte
Extrayez tout le texte brut lisible d'un document PDF dans un fichier texte.
Point de terminaison de l'API
POST /api/v1/tools/pdf/pdf-to-text
Accepte des données de formulaire multipart avec un fichier PDF.
Paramètres
Cet outil n'a aucun paramètre configurable. Téléversez un PDF et son contenu texte sera extrait.
Exemple de requête
curl -X POST http://localhost:1349/api/v1/tools/pdf/pdf-to-text \
-H "Authorization: Bearer si_your-api-key" \
-F "file=@report.pdf"
Exemple de réponse
{
"jobId": "a1b2c3d4-e5f6-7890-abcd-ef1234567890",
"downloadUrl": "/api/v1/download/a1b2c3d4-e5f6-7890-abcd-ef1234567890/report.txt",
"originalSize": 520000,
"processedSize": 14300,
"chars": 14300
}
Remarques
- Format d'entrée accepté :
.pdf. - Il s'agit d'un outil rapide (synchrone) qui renvoie le résultat directement.
- Le champ
charsde la réponse indique le nombre de caractères extraits. - Seul le texte intégré numériquement est extrait. Pour les documents numérisés ou les PDF basés sur des images, utilisez plutôt l'outil OCR de PDF.