Como a diarização separa as vozes
A diarização separa vozes diferentes dentro da faixa de participantes. O ISPer usa modelos locais via sherpa-onnx, com pyannote e 3D-Speaker.
Instalar os modelos
Em Configurações > Reuniões, use "Baixar modelos" para instalar os modelos de diarização. O pacote é pequeno perto dos modelos Whisper e roda localmente.
Pela CLI:
cargo run --release -p isper-cli -- models download-diarizeComo o fluxo aparece
- A reunião é salva e aberta imediatamente com o rótulo
Participantes. - A identificação roda em segundo plano.
- Ao terminar, os segmentos viram
Participante 1,Participante 2e assim por diante. - O banco, a Biblioteca e o Markdown são atualizados.
Ajustar separação de vozes
Se o ISPer juntar ou separar demais os falantes, calibre o threshold sem recompilar:
$env:ISPER_DIARIZE_THRESHOLD = "0.2"
isper-cli diarize fixtures/duas-vozes-16k.wavValores menores tendem a criar mais falantes distintos. O padrão documentado no projeto é 0.3.
Renomear participantes
Na Biblioteca, clique em Participante 1 e digite o nome real. A mudança vale para toda a reunião e mantém a cor daquele falante.