Ποια μοντέλα κατεβαίνουν και πόσο χώρο πιάνουν
Τα μοντέλα είναι δύο και κατεβαίνουν μία φορά:
- το μοντέλο αναγνώρισης ομιλίας — 181 MB, μετατρέπει τη φωνή σε κείμενο·
- το γλωσσικό μοντέλο (LLM) — 1 GB, μοιράζει το κείμενο στα πεδία της επιθεώρησης.
Τα μοντέλα είναι δύο και κατεβαίνουν μία φορά: