Vai al contenuto principale

Identificazione degli speaker

Quando rivedi la trascrizione di un meeting in Copera, ogni segmento parlato è etichettato con la persona che lo ha detto. Questo si ottiene combinando il tracking dello speaker attivo in tempo reale durante il meeting e la diarizzazione basata su AI durante l’elaborazione successiva.

Come funziona​

L’identificazione degli speaker avviene in due fasi:

1. Tracking in tempo reale durante il meeting​

Mentre il meeting è in corso e la trascrizione è attiva, il frontend tiene traccia di quale partecipante parla in ogni momento usando la rilevazione dello speaker attivo di Copera. Questi dati — una timeline di chi parlava e quando — vengono inviati al backend e archiviati insieme alla registrazione audio.

2. Elaborazione successiva con diarizzazione AI​

Dopo che la registrazione della trascrizione si interrompe, l’audio viene inviato al servizio speech-to-text, che esegue la propria diarizzazione degli speaker: divide l’audio in segmenti e etichetta ciascuno con un’etichetta generica di speaker (Speaker A, Speaker B, ecc.).

Poi il sistema esegue un algoritmo di matching che confronta i dati dello speaker attivo in tempo reale del passo 1 con il risultato della diarizzazione del passo 2. Trovando coincidenze temporali, assegna automaticamente le etichette generiche ai nomi reali dei partecipanti.

Vedere gli speaker nella trascrizione​

Quando apri una trascrizione nel visualizzatore di sessioni, il pannello Speakers a sinistra mostra tutte le persone identificate. Ogni speaker è rappresentato con il suo avatar (se corrisponde a un membro del workspace) e gli viene assegnato un colore unico. Gli interventi della trascrizione usano lo stesso colore, facilitando lo scorrere di una trascrizione lunga e vedere a colpo d’occhio chi ha detto cosa.

Puoi cliccare uno speaker nel pannello Speakers per filtrare la trascrizione e mostrare solo i suoi interventi. Clicca di nuovo per togliere il filtro e tornare a mostrare tutti gli interventi.

Correggere l’assegnazione degli speaker​

A volte il matching automatico può non essere del tutto preciso, soprattutto in meeting con molti partecipanti che parlano in rapida successione. Puoi riassegnare manualmente qualsiasi etichetta di speaker:

  1. Nel pannello Speakers, clicca l’avatar accanto a un’etichetta di speaker.
  2. Appare un menu a discesa con tutti i partecipanti del meeting.
  3. Seleziona il partecipante corretto e tutti gli interventi di quello speaker si aggiornano subito.
  4. Puoi anche aggiungere uno speaker personalizzato (per nome e email) per partecipanti esterni che non erano membri del workspace.

Quando apri il menu di selezione speaker, la trascrizione viene filtrata automaticamente su quello speaker e riproduce il suo primo intervento, così puoi ascoltare la voce e confermare l’assegnazione corretta.

Consigli per maggiore accuratezza​

  • Evita di parlare contemporaneamente: quando più persone parlano insieme, al sistema risulta più difficile distinguere gli speaker.
  • Usa microfoni individuali: se i partecipanti condividono un solo microfono (ad esempio in una sala conferenze), il sistema può raggrupparli come un unico speaker.
  • Le registrazioni più lunghe aiutano: più audio ha il sistema, con maggiore precisione può identificare i diversi pattern di voce.