fix
This commit is contained in:
@@ -23,18 +23,28 @@ jsou form fields v POST. API klíče jsou v X- hlavičkách. Výstup je vždy JS
|
||||
| `whisper_model` | text | `whisper-1` | OpenAI přepisový model |
|
||||
| `chat_model` | text | `gpt-4o` | OpenAI chat model pro sloučení |
|
||||
| `language` | text | `cs` | Jazyk (ISO kód) |
|
||||
| `diarize` | bool | `true` | Deepgram diarizace |
|
||||
| `diarize` | bool | `true` | Deepgram diarizace (rozlišení mluvčích) |
|
||||
| `smart_format` | bool | `true` | Deepgram smart formatting |
|
||||
|
||||
Nezadá-li se `combine_prompt`, použije se výchozí prompt z `app/prompts.py`.
|
||||
|
||||
### Rozlišení mluvčích a kvalita
|
||||
|
||||
- Při `diarize=true` (výchozí) Deepgram interně zapne i `utterances` a přepis `deepgram`
|
||||
se vrací se štítky mluvčích, např. `Mluvčí 0: ...` / `Mluvčí 1: ...`. Plochý přepis bez
|
||||
mluvčích (samotné `alternatives[0].transcript`) se použije jen jako fallback.
|
||||
- `gpt` (Whisper) je plynulý, ale **bez mluvčích** a občas halucinuje na tichu/šumu —
|
||||
proto se volá s `temperature=0`.
|
||||
- `merge` sjednotí oba zdroje: použije strukturu mluvčích z Deepgramu, doplní chybějící
|
||||
repliky z Whisperu a ignoruje zjevné halucinace (řídí výchozí `combine_prompt`).
|
||||
|
||||
### Odpověď
|
||||
|
||||
```json
|
||||
{
|
||||
"gpt": "přepis z OpenAI (whisper-1)",
|
||||
"deepgram": "přepis z Deepgramu",
|
||||
"merge": "sloučený, co nejpřesnější výsledný přepis"
|
||||
"gpt": "Dobrý den, tady je asistentka ...",
|
||||
"deepgram": "Mluvčí 0: Dobrý den, tady je asistentka ...\nMluvčí 1: Ne, teď to nejde.",
|
||||
"merge": "Asistent: Dobrý den, tady je asistentka ...\nVolající: Ne, teď to nejde."
|
||||
}
|
||||
```
|
||||
|
||||
|
||||
Reference in New Issue
Block a user