Welche Modelle Sie laden müssen und wie groß sie sind
Es sind zwei Modelle, beide werden einmalig geladen:
- das Spracherkennungsmodell — 181 MB, macht aus der Stimme Text;
- das Sprachmodell (LLM) — 1 GB, verteilt den Text auf die Felder der Inspektion.