Qué modelos hay que descargar y cuánto ocupan
Son dos modelos, los dos se descargan una sola vez:
- el modelo de reconocimiento del habla — 181 MB, convierte la voz en texto;
- el modelo de lenguaje (LLM) — 1 GB, reparte el texto por los campos de la inspección.