LLM & Modelli Su iPhone un LLM va alla velocità della memoria, non dei TOPS L'A20 Pro raddoppia i core del Neural Engine, ma un LLM di terze parti genera token leggendo i pesi dalla memoria: il guadagno arriva dalla banda, non dai TOPS. Adriano Amalfi 11 set 2026 6 min di lettura