diff --git a/app/main.py b/app/main.py index 065eff8..0f2f5fd 100644 --- a/app/main.py +++ b/app/main.py @@ -18,7 +18,8 @@ from .routers import meta, transcribe configure_logging() DESCRIPTION = """ -Přepis hovorů / audia dvěma engine (Deepgram + OpenAI Whisper) a jejich AI sloučení. +Přepis hovorů / audia dvěma engine (Deepgram + OpenAI) a jejich AI sloučení do jednoho +co nejpřesnějšího přepisu — vše v jednom requestu. ### Přihlašovací údaje (hlavičky) Secrets se předávají v hlavičkách u každého requestu — nikdy v těle ani v URL: @@ -26,12 +27,19 @@ Secrets se předávají v hlavičkách u každého requestu — nikdy v těle an - `X-Deepgram-Api-Key` — Deepgram API klíč (Deepgram Console → API Keys) - `X-OpenAI-Api-Key` — OpenAI API klíč (platform.openai.com → API keys) -### Endpointy -- `POST /transcribe/dual` — vrátí dva nezávislé přepisy (`text1` = Deepgram, `text2` = Whisper) -- `POST /transcribe/combined` — dual + `merged` (sloučený výsledek dle `combine_prompt`) +### Endpoint +- `POST /dual-with-merge` — audio přepíše paralelně Deepgramem i OpenAI (whisper-1) a oba + texty sloučí přes OpenAI Chat dle `combine_prompt`. Vrací JSON + `{"gpt": ..., "deepgram": ..., "merge": ...}` + (`gpt` = OpenAI whisper-1, `deepgram` = Deepgram, `merge` = sloučený výsledek). Audio se posílá jako proměnná `file` (multipart/form-data). Ostatní parametry (modely, jazyk, prompt) jsou form fields v POST. + +### Chyby +JSON `{error, message, detail}`. 400 = špatný/prázdný nebo nepodporovaný audio soubor, +401 = chybějící nebo upstreamem odmítnutý API klíč, 429 = rate limit, 502 = výpadek +upstreamu. """ app = FastAPI(