2026-09-03 10:52:54 +02:00
2026-09-03 10:52:54 +02:00
2026-09-03 10:52:54 +02:00
fix
2026-09-03 10:03:10 +02:00
2026-08-27 10:06:16 +00:00
2026-08-27 10:06:16 +00:00
2026-08-27 10:06:16 +00:00
2026-08-27 14:50:10 +02:00
2026-08-27 14:50:10 +02:00
2026-08-27 14:50:10 +02:00

html-to-pdf

Sluzba prevadi HTML dokument na PDF. Prijme adresu dokumentu nebo HTML primo v tele requestu a vrati soubor PDF. Je navrzena pro dokumenty o stovkach az tisicich stranek.

Bezi v AppFactory na https://services.csbot.cz/apps/html-to-pdf.

Jak to funguje

Dva render enginy:

  • WeasyPrint je vychozi. Ma spravne CSS Paged Media, tedy countery stranek, opakovane hlavicky tabulek a zalozky. Nizka pametova narocnost. Nespousti JavaScript.
  • Chromium pres Playwright zvladne i dokumenty dokreslovane JavaScriptem. Nema pouzitelne countery stranek, cisla se proto dopisuji do hotoveho PDF.

Velke dokumenty se renderuji po castech a vysledky se slucuji. Cisla stranek a obsah se dopocitavaji dvoupruchodovym renderem, aby po slouceni sedely.

Spusteni

docker build -t html-to-pdf .
docker run --rm -p 8000:8000 html-to-pdf

Priklad volani

Maly dokument synchronne:

curl -X POST http://localhost:8000/convert \
  -H "Content-Type: application/json" \
  -d '{"source": {"url": "https://example.com/dokument.html"}}' \
  --output dokument.pdf

Velky dokument asynchronne:

# zarazeni do fronty
curl -X POST http://localhost:8000/jobs \
  -H "Content-Type: application/json" \
  -d '{
        "source": {"url": "https://example.com/velky.html"},
        "page_numbers": {"enabled": true},
        "toc": {"enabled": true}
      }'

# stav
curl http://localhost:8000/jobs/<job_id>

# stazeni
curl http://localhost:8000/jobs/<job_id>/result --output velky.pdf

Dokumentace

Podrobnosti jsou ve slozce documentation:

Interaktivni dokumentace API je na /docs.

S
Description
html-to-pdf
Readme
134 KiB
Languages
Python 98.7%
Dockerfile 1.3%