Incolla l'export JSON della trascrizione (con timestamp e speaker). Node orchestra i 7 step; l'intelligenza sta nel modello.