Sub-skill of pdf: OCR for Scanned Documents (+3).
Scanned 9/9/2026
Install to Claude Code
npx -y skills add vamseeachanta/workspace-hub --skill ocr-for-scanned-documents --agent claude-codeInstalls into .claude/skills of the current project.
Are you the author of Ocr For Scanned Documents?
Add the live security badge to your README — it updates automatically with every re-scan.
[](https://www.skillsdirectory.com/skills/vamseeachanta-ocr-for-scanned-documents-workspace-hub)More formats (shields.io, HTML) on the badges page.
---
name: pdf-ocr-for-scanned-documents
description: 'Sub-skill of pdf: OCR for Scanned Documents (+3).'
version: 1.2.2
category: data
type: reference
scripts_exempt: true
---
# OCR for Scanned Documents (+3)
## OCR for Scanned Documents
```python
import pytesseract
from pdf2image import convert_from_path
images = convert_from_path("scanned.pdf")
for i, image in enumerate(images):
text = pytesseract.image_to_string(image)
print(f"Page {i+1}:\n{text}")
```
## Add Watermark
```python
from pypdf import PdfReader, PdfWriter
reader = PdfReader("document.pdf")
watermark = PdfReader("watermark.pdf")
writer = PdfWriter()
for page in reader.pages:
page.merge_page(watermark.pages[0])
writer.add_page(page)
writer.write("watermarked.pdf")
```
## Extract Images
```python
from pypdf import PdfReader
reader = PdfReader("document.pdf")
for page_num, page in enumerate(reader.pages):
for img_num, image in enumerate(page.images):
with open(f"image_{page_num}_{img_num}.png", "wb") as f:
f.write(image.data)
```
## Password Protection
```python
from pypdf import PdfReader, PdfWriter
reader = PdfReader("document.pdf")
writer = PdfWriter()
for page in reader.pages:
writer.add_page(page)
writer.encrypt("user_password", "owner_password")
writer.write("protected.pdf")
```
Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.
No comments yet. Be the first to comment!