Estensioni

Questa sezione definisce le impostazioni per il riconoscimento vocale e per il rilevamento degli oggetti.

Prima di poter configurare e utilizzare il riconoscimento vocale e il rilevamento degli oggetti, è necessario installare Python3. Una volta installato, è consigliabile utilizzare un ambiente virtuale (venv) per mantenerlo separato da Kdenlive e dagli altri utilizzi presenti sul sistema.

Se hai già installato Python 3, passa direttamente alla pagina di configurazione del Riconoscimento vocale o del :Rilevamento degli oggetti.

Installazione di Python

Installazione su Linux

Nella maggior parte delle distribuzioni Linux, Python è installato per impostazione predefinita. Puoi verificarlo eseguendo python3 –version in un terminale. Di seguito sono riportati i passaggi fondamentali per installare Python3 su Ubuntu. Se la tua distribuzione non è basata su Ubuntu fai riferimento alla documentazione specifica, oppure cerca le istruzioni per l’installazione su Internet.

$ sudo apt updates
$ sudo apt install python3

Il pacchetto Python di terze parti fondamentale di cui potresti aver bisogno è pip. Python 3.4 e le versioni successive includono pip per impostazione predefinita, ma puoi comunque verificarlo eseguendo command -v pip in un terminale (alcune distribuzioni utilizzano pip per Python2, e pip3 per Python 3). Se pip non è presente, puoi installarlo con

$ python3 -m ensurepip --upgrade

In caso di problemi, fai riferimento a pip installation guide.

Nota

Nei paragrafi seguenti, pip è il termine generico per tutte le versioni di pip, inclusa pip3. Usa il comando pip corretto per il tuo sistema operativo.

Installazione su Windows

Scarica Python dalla pagina ufficiale Python download.

Seleziona «Aggiungi python.exe al PATH»

Seleziona «Installa adesso»

Riconoscimento vocale

Questa sezione viene utilizzata per configurare la funzionalità di riconoscimento vocale di Kdenlive, e per la gestione dei vari modelli per i due motori, VOSK e Whisper.

Avvertimento

Il riconoscimento vocale non funziona nella versione 21.04.2 a causa di alcuni problemi con l”API Vosk. Usa la versione 21.04.1, oppure la 21.04.3 o le successive.

Motori vocali

Ci sono due motori per la sintesi vocale: VOSK e Whisper. Whisper di OpenAI è un modulo di riconoscimento vocale per uso generico addestrato su un ampio insieme di dati audio diversificati, ed è in grado di eseguire la traduzione vocale e l’identificazione della lingua.

Whisper è più lento di VOSK nella CPU, ma è un po” più preciso. Whisper crea frasi con i segni di punteggiatura, anche nella modalità base.

Devi installare i modelli da usare con questi due motori.

Suggerimento

Se stai utilizzando la versione Flatpak di Kdenlive, potresti riscontrare dei problemi con l’installazione dei modelli vocali: l’approccio sandbox di Flatpak impedisce a Kdenlive di eseguire pip. Esiste una possibile soluzione alternativa, utilizzando il comando $ flatpak run --command=/bin/bash org.kde.kdenlive, seguito da $ python -m ensurepip, e infine da $ python -m pip install -U openai-whisper torch (per gentile concessione di Veronica Explains). La tua esperienza potrebbe variare.

L’altra opzione consiste nel selezionare Whisper, e poi di fare clic su Installa traduzione multi lingua: in questo scaricherai e installerai le dipendenze necessarie, e Kdenlive riconoscerà il percorso di installazione di Python e pip. Infine, potrai seguire le istruzioni per configurare VOSK e Whisper disponibili qui.

VOSK

../../_images/configure_speech2text_vosk_conf_2412.webp

Python funziona, ma VOSK non è ancora utilizzabile a causa della mancanza dei modelli vocali.

Devi scaricare prima un modello vocale dalla pagina degli scaricamenti di alphacephei[1]. Segui il collegamento (2), e scarica i modelli necessari.

Per impostazione predefinita, i modelli delle lingue sono installati nelle seguenti cartelle:

Linux:

~/.local/share/kdenlive/venv/Lib

Windows:

%LocalAppData%\kdenlive\venv\Lib

Se desideri utilizzare una cartella specifica, seleziona l’opzione Cartella dei modelli personalizzati (3) e inserisci il percorso nel campo di testo sottostante, oppure fai clic sun document-openApri file per selezionare la cartella desiderata. Se utilizzi la cartella predefinita, questa verrà visualizzata a titolo informativo nel campo di testo Cartella dei modelli.

Se hai installato VOSK in una versione precedente di Kdenlive e ora hai scelto la cartella venv per Python, allora puoi eliminare le librerie VOSK installate in precedenza utilizzando il seguente comando da terminale:

$ pip uninstall vosk srt

Fai clic su Aggiungi modello e inserisci il percorso dei file che hai scaricato.

../../_images/configure_speech2text_new_dictionary_2412.webp

Fai clic su document-openFinestra apri per aprire il gestore di file del sistema operativo, in modo da spostarti dove hai scaricato i file, poi seleziona il file del modello che vuoi aggiungere.


../../_images/configure_speech2text_vosk_drag_2412.webp

In alternativa, trascina il modello linguistico desiderato dalla pagina di scaricamento di alphacephei[1] nella finestra dei modelli (4): Kdenlive lo scaricherà e lo estrarrà automaticamente nella cartella predefinita, o in quella personalizzata che hai specificato.

Nota

I modelli sono file compressi (.zip), e possono occupare diversi GB di spazio: a seconda della connessione Internet, i tempi di scaricamento potrebbero essere lunghi. Una volta completato lo scaricamento, i file devono essere estratti: anche qui, questa operazione potrebbe richiedere molto tempo in base alle caratteristiche del sistema. Kdenlive potrebbe sembrare non rispondere, ma in realtà sta lavorando in background: sii paziente.

Quando i modelli sono stati installati, Kdenlive visualizza la dimensione della cartella dei modelli: fai clic sulla Cartella dei modelli per aprirla con il gestore di file del tuo sistema operativo.

Whisper

../../_images/configure_speech2text_whisper_install_2412.webp

Installa le dipendenze mancanti

Quando passi a Whisper per la prima volta devi installare le dipendenze mancanti (circa 2 GB da scaricare).

Poi devi scaricare uno o più modelli vocali.

../../_images/configure_speech2text_whisper_2412.webp

Whisper è installato, ma non è stato ancora scaricato nessun modello vocale

1:

Whisper è selezionato per il riconoscimento vocale

2:

Se si lascia l’impostazione su Rilevamento automatico, Kdenlive cercherà di individuare la lingua da utilizzare per il riconoscimento vocale. Se i risultati non dovessero essere corretti, seleziona qui quella corretta.

3:

Per il riconoscimento vocale puoi passare da CPU a GPU; in quest’ultimo caso ne serve però una che supporta CUDA.

4:

Solo per la GPU: quando viene rilevata una scheda video NVIDIA GTX 16xx, Kdenlive disabilita automaticamente la mezza precisione (FP16). Se usando la GPU hai problemi, puoi disabilitare la mezza precisione.

5:

Puoi chiedere a Whisper di tradurre il testo in inglese. Se invece hai bisogno di traduzioni in altre lingue, fai clic su Installa traduzione multi lingua: in questo modo si attiverà SeamlessM4T[2] e verranno scaricati e installati i relativi modelli (circa 10 GB di dati). Da questo momento in poi, l’elaborazione avverrà offline.

Fai clic su Gestisci modelli, oppure utilizza il modello turbo facendo clic su :guilabel:`Scarica (1.4GB). Maggiori informazioni sui modelli disponibili sono disponibili nella pagina del Whisper source code page.

../../_images/configure_speech2text_whisper_models_2412.webp

Scarica e gestisci i modelli con Whisper

Kdenlive mostra il processo di scaricamento.

I modelli vocali installati sono contrassegnati da un cerchio pieno. Puoi eliminarli facendo clic su Disinstalla modello

I modelli disponibili sono contrassegnati da un cerchio vuoto: puoi installarli cliccando su Installa modello.

../../_images/kdenlive2405_speech-to-text_whisper_installed.webp

Quando tutto è configurato correttamente, viene visualizzata questa schermata: tutto verde!

Percorso nel quale Whisper è installato:

Linux:

~/.local/share/kdenlive/venv/Lib

Windows:

%LocalAppData%\kdenlive\venv\Lib

I modelli di sintesi vocale Whisper sono archiviati qui:

Linux:

~/.local/share/kdenlive/opencvmodels

Windows:

%AppData%\kdenlive\opencvmodels

Per scaricare e iniziare la traduzione dei sottotitoli, segui questi passaggi.

Puoi controllare gli aggiornamenti facendo clic su Controlla la configurazione

Se hai installato VOSK in una versione precedente di Kdenlive e ora hai scelto la cartella venv per Python, allora puoi eliminare le librerie VOSK installate in precedenza utilizzando il seguente comando da terminale:

$ pip uninstall openai-whisper

Nota

Se durante il riconoscimento vocale ricevi messaggi ricorrenti relativi alla mancanza di file di modelli, verifica dove ti porta il collegamento accanto alla Cartella dei modelli. Se è ~/.cache, dove è presente una cartella denominata Whisper contenente tutti i modelli che hai scaricato, copia semplicemente questa cartella nella posizione indicata dal messaggio di errore come mancante (molto probabilmente: ~/.var/app/org.kde.kdenlive/cache)

Rilevamento degli oggetti

La prima volta che utilizzi il rilevamento degli oggetti devi installare l’estensione.

../../_images/kdenlive2504_object-detection_plugin-to-be-installed.webp

L’estensione viene installata nella cartella:

Linux:

~/.local/share/kdenlive/venv-sam

Windows:

%LocalAppData%\kdenlive\venv-sam

Se tutto è stato installato correttamente, dovrebbe apparire così:

../../_images/kdenlive2504_object-detection_plugin-installed.webp

Quando tutto è configurato correttamente, viene visualizzata questa schermata: tutto verde!

1:

Modello Puoi scaricare vari modelli per il rilevamento degli oggetti.

2:

Dispositivo Per il rilevamento degli oggetti puoi scegliere se utilizzare la CPU o la GPU. Per il rilevamento degli oggetti tramite GPU, è necessaria una che supporti CUDA. Kdenlive cerca automaticamente di individuare la scheda grafica: se supporta CUDA (GPU Nvidia), allora verrà installato il driver necessario che ne permette l’utilizzo. Diversamente, qualora cioè la scheda grafica non supporti CUDA, o non viene rilevata da Kdenlive, allora verrà visualizzata solo l’opzione CPU. Supporto alla GPU Se la GPU Nvidia non è presente nell’elenco, prova a installarne una alternativa seguendo questi passaggi.

3:

Trasferisci il video alla CPU per risparmiare memoria della GPU Se hai delle clip di lunga durata su cui Kdenlive deve rilevare degli oggetti, allora potrebbe verificarsi un crash. Se questa opzione è abilitata, parte della memoria utilizzata viene trasferita alla RAM anziché utilizzare la memoria della GPU.

4:

Usa solo i pacchetti di sistema Quando è abilitata, Kdenlive utilizzerà la versione di SAM2 installata nel sistema. Solo per utenti esperti, dato che bisogna installare correttamente tutto da soli.

5:

Cartella dei modelli Facendo clic sul collegamento si aprirà la cartella in cui sono salvati i modelli SAM2, con l’indicazione delle dimensioni della cartella stessa. L’opzione:guilabel:Elimina tutti i modelli cancellerà il contenuto di questa cartella.

6:

Dimensione delle estensioni Facendo clic sul link si aprirà la cartella in cui sono memorizzati gli script Python per venv-sam, con l’indicazione delle dimensioni della cartella stessa. L’opzione Disinstalla estensioni disinstallerà Python per venv-sam.

Installazione manuale della GPU

Se Kdenlive non rileva automaticamente la tua GPU NVIDIA, puoi provare a installarla manualmente.

L’accelerazione GPU funziona solo con CUDA (Compute Unified Device Architecture), che è un’architettura computazionale parallela proprietaria di NVIDIA.

Controlla la versione di CUDA installata:

  • apri una shell di comandi (in Windows: Windows+R, digita cmd e premi Invio)

  • Digita nvidia-smi -version

Dovresti ottenere qualcosa del genere:

../../_images/kdenlive2504_cuda-version-installed.webp

Qui la versione CUDA è 12.8

Ora fai clic su Supporto GPU

Puoi selezionare una versione di CUDA uguale o inferiore a quella rilevata

../../_images/kdenlive2504_cuda-version-to-be-installed.webp

Seleziona una versione di CUDA che sia inferiore a quella rilevata.

Fai clic su Applica

Nella finestra successiva fai clic su Continua

../../_images/kdenlive2504_cuda-installation.webp

Kdenlive avvia lo scaricamento di tutti i file necessari per l’utilizzo della GPU. Una volta terminato dovresti vedere la tua GPU nella sezione Dispositivo, come mostrato qui di seguito:

../../_images/kdenlive2504_cuda-installed.webp

Installazione della GPU riuscita


../../_images/configure_speech2text_vosk_models_alphacephei_2412.webp