Deteção de Similaridade
O sistema utiliza inteligência artificial para detetar e agrupar automaticamente as reclamações similares, facilitando a identificação de problemas recorrentes e o tratamento em lote.
Vista geral
┌─────────────────────────────────────────────────────────────────────────┐
│ PIPELINE DE SIMILARIDADE │
├─────────────────────────────────────────────────────────────────────────┤
│ │
│ RECLAMAÇÕES VETORIZAÇÃO CLUSTERING GRUPOS │
│ ┌──────────┐ ┌──────────┐ ┌──────────┐ ┌──────────┐ │
│ │ Texto │ ──▶ │ TF-IDF │ ──▶ │ Cosine │ ──▶ │ Grupos │ │
│ │ reclamação│ │ Cohere │ │ Similarity│ │ similares│ │
│ └──────────┘ └──────────┘ └──────────┘ └──────────┘ │
│ │
└─────────────────────────────────────────────────────────────────────────┘
Tecnologias utilizadas
O sistema combina duas abordagens de vetorização:
| Método | Descrição | Vantagens |
|---|---|---|
| TF-IDF | Term Frequency-Inverse Document Frequency | Rápido, funciona offline |
| Cohere Embeddings | Embeddings semânticos via API Cohere | Compreensão contextual profunda |
Acesso
A deteção de similaridade é visível em:
- Lista de reclamações: Ícone de agrupamento nas reclamações similares
- Detalhe da reclamação: Secção "Reclamações similares" no fundo da página
- Relatórios: Análise de clusters de reclamações
Grupos similares
Apresentação na lista
As reclamações agrupadas são apresentadas com:
| Elemento | Descrição |
|---|---|
| Ícone de grupo | Indica pertença a um grupo |
| Número de similares | Badge com o número de reclamações ligadas |
| Score de similaridade | Percentagem de similaridade (70-100%) |
Expandir/Recolher os grupos
Na lista de reclamações:
- Clique no ícone ▶ para expandir um grupo
- As reclamações similares aparecem em sub-lista
- Clique em ▼ para recolher o grupo
Limiar de similaridade
O sistema considera duas reclamações como similares se o seu score ultrapassar 70%.
| Score | Interpretação |
|---|---|
| 90-100% | Muito similares (possível duplicado) |
| 80-89% | Similares (mesma problemática) |
| 70-79% | Potencialmente relacionadas |
| < 70% | Não agrupadas |
Casos de utilização
Identificar problemas recorrentes
- Aceda à lista de reclamações
- Filtre por categoria ou região
- Observe os grupos de similaridade
- Identifique os padrões recorrentes
Tratamento em grupo
Para reclamações muito similares:
- Identifique o grupo
- Trate a reclamação principal
- Aplique a mesma resolução às reclamações ligadas
- Documente em cada reclamação a referência cruzada
Detetar duplicados
As reclamações com score > 90% podem ser duplicados:
- Verifique as informações do reclamante
- Compare as datas de criação
- Se duplicado confirmado, funda ou feche uma das reclamações
Configuração
Ativação do clustering
O clustering está ativado por defeito. Para configurar:
Variáveis de ambiente:
| Variável | Descrição | Padrão |
|---|---|---|
COHERE_API_KEY | Chave API Cohere para embeddings | - |
SIMILARITY_THRESHOLD | Limiar de similaridade (0-1) | 0.7 |
ENABLE_SIMILARITY | Ativar/desativar | true |
Modo degradado
Se a API Cohere não está disponível:
- O sistema utiliza apenas TF-IDF
- A qualidade permanece boa para textos similares
- Menos performante em reformulações
Funcionamento técnico
Pipeline de tratamento
- Extração: O texto da reclamação (assunto + descrição) é extraído
- Limpeza: Remoção de pontuação, normalização
- Vetorização: Transformação em vetor numérico
- Cálculo de similaridade: Distância cosseno entre vetores
- Clustering: Agrupamento por limiar
Atualização automática
O clustering é recalculado:
- Na criação de uma nova reclamação
- Aquando da modificação de uma descrição
- Via tarefa agendada diária (batch)
Estatísticas
Nos relatórios
O separador Relatórios > Reclamações apresenta:
| Indicador | Descrição |
|---|---|
| Número de clusters | Total de grupos identificados |
| Tamanho médio | Número médio de reclamações por grupo |
| Top clusters | Os grupos mais importantes |
| Evolução | Tendência dos problemas recorrentes |
Análise por categoria
Os clusters são analisáveis por:
- Categoria de reclamação
- Região geográfica
- Período temporal
- Prioridade
Boas práticas
:::tip Recomendações
- Examine os grandes clusters: Indicam um problema sistémico
- Verifique os duplicados: Score > 90% = verificação manual
- Documente as ligações: Referencie as reclamações ligadas nos comentários
- Trate em grupo: As reclamações similares merecem frequentemente uma resposta coordenada :::
Permissões necessárias
| Ação | Permissão |
|---|---|
| Ver grupos similares | plaintes.view |
| Configurar o clustering | parametres.edit |
Limitações
- O clustering funciona melhor com descrições detalhadas
- As reclamações muito curtas podem ser mal classificadas
- As línguas misturadas (Português/Crioulo) podem afetar a precisão