Files
SnapOtter/apps/docs/it/tools/pdf/ocr-pdf.md
T
SnapOtterandGitHub 4963ab3bbd feat(docs-i18n): translate all documentation into 20 languages
All 181 docs markdown files translated into 20 languages (apps/docs/<locale>/**). Companion to the i18n code PR; admin-merged because the file count exceeds GitHub's per-PR CI trigger limit. Validated by pnpm i18n:check (all surfaces, 0 stale/missing) and a clean all-locale docs build.
2026-07-11 13:52:47 +08:00

2.2 KiB

description, i18n_source_hash, i18n_provenance, i18n_output_hash
description i18n_source_hash i18n_provenance i18n_output_hash
Estrai testo da documenti PDF usando l'OCR basato sull'IA. 1431fcba180b human 123adeee3212

OCR PDF

Estrai testo da documenti PDF usando il riconoscimento ottico dei caratteri basato sull'IA. Supporta più livelli di qualità e diverse lingue. Richiede l'installazione del bundle della funzionalità OCR.

API Endpoint

POST /api/v1/tools/pdf/ocr-pdf

Accetta dati di form multipart con un file PDF e un campo JSON opzionale settings.

Parameters

Parameter Type Required Default Description
quality string No "balanced" Livello di qualità OCR: fast, balanced, best
language string No "auto" Lingua del documento: auto, en, de, fr, es, zh, ja, ko
pages string No "all" Selezione delle pagine, es. "all", "1-3", "1,3,5"

Example Request

curl -X POST http://localhost:1349/api/v1/tools/pdf/ocr-pdf \
  -H "Authorization: Bearer si_your-api-key" \
  -F "file=@scanned.pdf" \
  -F 'settings={"quality": "best", "language": "en", "pages": "1-5"}'

Example Response

Restituisce 202 Accepted. Monitora l'avanzamento tramite SSE su /api/v1/jobs/{jobId}/progress.

{
  "jobId": "a1b2c3d4-e5f6-7890-abcd-ef1234567890",
  "async": true
}

Notes

  • Formato di input accettato: .pdf.
  • Questo è uno strumento IA che richiede l'installazione del bundle della funzionalità OCR. Se il bundle non è installato, l'API restituisce 501 Not Implemented.
  • Il livello di qualità fast usa un modello più leggero per un'elaborazione più rapida; best usa un modello più accurato a scapito della velocità.
  • L'impostazione della lingua auto tenta di rilevare automaticamente la lingua del documento.
  • Puoi selezionare pagine specifiche usando intervalli ("1-3"), elenchi separati da virgole ("1,3,5"), o "all" per ogni pagina.
  • Per i PDF che contengono già testo selezionabile, considera l'uso dello strumento più veloce PDF in testo.