●  COME FUNZIONA — QUATTRO FASI, NESSUN CLOUD NEL CICLO

Quattro passi. Un solo Mac.

Tutto ciò che segue accade sul tuo computer. Non ci sono code, caricamenti né account tra il tuo testo e l'audio finito.

FASE 01

Parti dalle parole che hai

Incolla direttamente il testo, trascina un file — TXT, MD, EPUB, PDF, DOCX, SRT, VTT o HTML — oppure porta un copione basato sui personaggi per produzioni multi-voce. L'app mantiene intatti capitoli e struttura, e puoi unire, dividere o saltare capitoli prima che venga elaborato qualsiasi cosa.

NOTA SUI FORMATI — questa versione legge TXT, MD, EPUB, PDF, DOCX, SRT, VTT e HTML — oppure incolla semplicemente il testo. I PDF scansionati richiedono un livello di testo per essere importati; la modifica della struttura funziona allo stesso modo in entrambi i casi.

FASE 02

Scegli una voce — o rendila familiare

La libreria contiene 63 voci integrate — 54 preset Kokoro più 9 voci Qwen. Oppure clona una voce familiare da una breve registrazione pulita — da sei a dieci secondi — e riutilizzala in ogni progetto. In Modalità Copione l'app suggerisce una voce per ogni parlante — tu confermi e puoi cambiare ognuna di esse a mano.

CONSIGLIO DI REGISTRAZIONE — una stanza silenziosa, un inizio pulito all'inizio di una frase e una trascrizione che corrisponda a ogni parola. Questa è tutta la ricetta; un input migliore batte un input più lungo.

FASE 03

Il tuo Mac diventa il motore

La sintesi vocale avviene in locale — al primo avvio scarica i pacchetti sul dispositivo (motore + voci, da ~700MB fino ad alcuni GB con tutti i pacchetti vocali, una volta sola), poi lo studio funziona completamente offline. I lavori lunghi restano visibili e interrompibili, e rivedere un paragrafo ti permette di rigenerarlo senza ricominciare da capo. Leggi la pagina privacy per sapere esattamente cosa tocca la rete (quasi niente).

FASE 04

Aprilo ovunque

Conserva l'audio dei capitoli — inclusi gli audiolibri con capitoli M4B — per qualsiasi player, distribuisci una pagina HTML autonoma con evidenziazione parola per parola per la lettura segui-testo, crea un video per il grande schermo o invia il lavoro finito via Email, Telegram o Discord (Email 25MB · Telegram 50MB · Discord 8MB). Un buon primo progetto è un audiolibro di famiglia — basta un capitolo per sentire l'intera pipeline.

ELMREN VOICE PER MACOS 13+ · $40 UNA TANTUM · PROVA: 120 MINUTI DI SINTESI · PERIODO DI 7 GIORNI