a922117b3d8df924fb541b235463ee52afad118b
html-to-pdf
Sluzba prevadi HTML dokument na PDF. Prijme adresu dokumentu nebo HTML primo v tele requestu a vrati soubor PDF. Je navrzena pro dokumenty o stovkach az tisicich stranek.
Bezi v AppFactory na https://services.csbot.cz/apps/html-to-pdf.
Jak to funguje
Dva render enginy:
- WeasyPrint je vychozi. Ma spravne CSS Paged Media, tedy countery stranek, opakovane hlavicky tabulek a zalozky. Nizka pametova narocnost. Nespousti JavaScript.
- Chromium pres Playwright zvladne i dokumenty dokreslovane JavaScriptem. Nema pouzitelne countery stranek, cisla se proto dopisuji do hotoveho PDF.
Velke dokumenty se renderuji po castech a vysledky se slucuji. Cisla stranek a obsah se dopocitavaji dvoupruchodovym renderem, aby po slouceni sedely.
Spusteni
docker build -t html-to-pdf .
docker run --rm -p 8000:8000 html-to-pdf
Priklad volani
Maly dokument synchronne:
curl -X POST http://localhost:8000/convert \
-H "Content-Type: application/json" \
-d '{"source": {"url": "https://example.com/dokument.html"}}' \
--output dokument.pdf
Velky dokument asynchronne:
# zarazeni do fronty
curl -X POST http://localhost:8000/jobs \
-H "Content-Type: application/json" \
-d '{
"source": {"url": "https://example.com/velky.html"},
"page_numbers": {"enabled": true},
"toc": {"enabled": true}
}'
# stav
curl http://localhost:8000/jobs/<job_id>
# stazeni
curl http://localhost:8000/jobs/<job_id>/result --output velky.pdf
Dokumentace
Podrobnosti jsou ve slozce documentation:
- api.md endpointy a telo requestu
- architektura.md jak sluzba funguje uvnitr
- konfigurace.md environment variables
- provoz.md nasazeni a znama omezeni
- zmeny.md zaznam zmen
Interaktivni dokumentace API je na /docs.
Languages
Python
98.7%
Dockerfile
1.3%