Vai al contenuto principale

Identificazione degli speaker

Quando rivedi la trascrizione di un meeting in Copera, ogni segmento parlato è etichettato con la persona che lo ha detto. Questo si ottiene combinando il tracking dello speaker attivo in tempo reale durante il meeting e la diarizzazione basata su AI durante l’elaborazione successiva.

Come funziona

L’identificazione degli speaker avviene in due fasi:

1. Tracking in tempo reale durante il meeting

Mentre il meeting è in corso e la trascrizione è attiva, il frontend tiene traccia di quale partecipante parla in ogni momento usando la rilevazione dello speaker attivo di Copera. Questi dati — una timeline di chi parlava e quando — vengono inviati al backend e archiviati insieme alla registrazione audio.

2. Elaborazione successiva con diarizzazione AI

Dopo che la registrazione della trascrizione si interrompe, l’audio viene inviato al servizio speech-to-text, che esegue la propria diarizzazione degli speaker: divide l’audio in segmenti e etichetta ciascuno con un’etichetta generica di speaker (Speaker A, Speaker B, ecc.).

Poi il sistema esegue un algoritmo di matching che confronta i dati dello speaker attivo in tempo reale del passo 1 con il risultato della diarizzazione del passo 2. Trovando coincidenze temporali, assegna automaticamente le etichette generiche ai nomi reali dei partecipanti.

Vedere gli speaker nella trascrizione

Quando apri una trascrizione nel visualizzatore di sessioni, il pannello Speakers a sinistra mostra tutte le persone identificate. Ogni speaker è rappresentato con il suo avatar (se corrisponde a un membro del workspace) e gli viene assegnato un colore unico. Gli interventi della trascrizione usano lo stesso colore, facilitando lo scorrere di una trascrizione lunga e vedere a colpo d’occhio chi ha detto cosa.

Puoi cliccare uno speaker nel pannello Speakers per filtrare la trascrizione e mostrare solo i suoi interventi. Clicca di nuovo per togliere il filtro e tornare a mostrare tutti gli interventi.

Correggere l’assegnazione degli speaker

A volte il matching automatico può non essere del tutto preciso, soprattutto in meeting con molti partecipanti che parlano in rapida successione. Puoi riassegnare manualmente qualsiasi etichetta di speaker:

  1. Nel pannello Speakers, clicca l’avatar accanto a un’etichetta di speaker.
  2. Appare un menu a discesa con tutti i partecipanti del meeting.
  3. Seleziona il partecipante corretto e tutti gli interventi di quello speaker si aggiornano subito.
  4. Puoi anche aggiungere uno speaker personalizzato (per nome e email) per partecipanti esterni che non erano membri del workspace.

Quando apri il menu di selezione speaker, la trascrizione viene filtrata automaticamente su quello speaker e riproduce il suo primo intervento, così puoi ascoltare la voce e confermare l’assegnazione corretta.

Consigli per maggiore accuratezza

  • Evita di parlare contemporaneamente: quando più persone parlano insieme, al sistema risulta più difficile distinguere gli speaker.
  • Usa microfoni individuali: se i partecipanti condividono un solo microfono (ad esempio in una sala conferenze), il sistema può raggrupparli come un unico speaker.
  • Le registrazioni più lunghe aiutano: più audio ha il sistema, con maggiore precisione può identificare i diversi pattern di voce.