Pular para o conteúdo principal

Deteção de Similaridade

O sistema utiliza inteligência artificial para detetar e agrupar automaticamente as reclamações similares, facilitando a identificação de problemas recorrentes e o tratamento em lote.

Vista geral

┌─────────────────────────────────────────────────────────────────────────┐
│ PIPELINE DE SIMILARIDADE │
├─────────────────────────────────────────────────────────────────────────┤
│ │
│ RECLAMAÇÕES VETORIZAÇÃO CLUSTERING GRUPOS │
│ ┌──────────┐ ┌──────────┐ ┌──────────┐ ┌──────────┐ │
│ │ Texto │ ──▶ │ TF-IDF │ ──▶ │ Cosine │ ──▶ │ Grupos │ │
│ │ reclamação│ │ Cohere │ │ Similarity│ │ similares│ │
│ └──────────┘ └──────────┘ └──────────┘ └──────────┘ │
│ │
└─────────────────────────────────────────────────────────────────────────┘

Tecnologias utilizadas

O sistema combina duas abordagens de vetorização:

MétodoDescriçãoVantagens
TF-IDFTerm Frequency-Inverse Document FrequencyRápido, funciona offline
Cohere EmbeddingsEmbeddings semânticos via API CohereCompreensão contextual profunda

Acesso

A deteção de similaridade é visível em:

  1. Lista de reclamações: Ícone de agrupamento nas reclamações similares
  2. Detalhe da reclamação: Secção "Reclamações similares" no fundo da página
  3. Relatórios: Análise de clusters de reclamações

Grupos similares

Apresentação na lista

As reclamações agrupadas são apresentadas com:

ElementoDescrição
Ícone de grupoIndica pertença a um grupo
Número de similaresBadge com o número de reclamações ligadas
Score de similaridadePercentagem de similaridade (70-100%)

Expandir/Recolher os grupos

Na lista de reclamações:

  1. Clique no ícone para expandir um grupo
  2. As reclamações similares aparecem em sub-lista
  3. Clique em para recolher o grupo

Limiar de similaridade

O sistema considera duas reclamações como similares se o seu score ultrapassar 70%.

ScoreInterpretação
90-100%Muito similares (possível duplicado)
80-89%Similares (mesma problemática)
70-79%Potencialmente relacionadas
< 70%Não agrupadas

Casos de utilização

Identificar problemas recorrentes

  1. Aceda à lista de reclamações
  2. Filtre por categoria ou região
  3. Observe os grupos de similaridade
  4. Identifique os padrões recorrentes

Tratamento em grupo

Para reclamações muito similares:

  1. Identifique o grupo
  2. Trate a reclamação principal
  3. Aplique a mesma resolução às reclamações ligadas
  4. Documente em cada reclamação a referência cruzada

Detetar duplicados

As reclamações com score > 90% podem ser duplicados:

  1. Verifique as informações do reclamante
  2. Compare as datas de criação
  3. Se duplicado confirmado, funda ou feche uma das reclamações

Configuração

Ativação do clustering

O clustering está ativado por defeito. Para configurar:

Variáveis de ambiente:

VariávelDescriçãoPadrão
COHERE_API_KEYChave API Cohere para embeddings-
SIMILARITY_THRESHOLDLimiar de similaridade (0-1)0.7
ENABLE_SIMILARITYAtivar/desativartrue

Modo degradado

Se a API Cohere não está disponível:

  • O sistema utiliza apenas TF-IDF
  • A qualidade permanece boa para textos similares
  • Menos performante em reformulações

Funcionamento técnico

Pipeline de tratamento

  1. Extração: O texto da reclamação (assunto + descrição) é extraído
  2. Limpeza: Remoção de pontuação, normalização
  3. Vetorização: Transformação em vetor numérico
  4. Cálculo de similaridade: Distância cosseno entre vetores
  5. Clustering: Agrupamento por limiar

Atualização automática

O clustering é recalculado:

  • Na criação de uma nova reclamação
  • Aquando da modificação de uma descrição
  • Via tarefa agendada diária (batch)

Estatísticas

Nos relatórios

O separador Relatórios > Reclamações apresenta:

IndicadorDescrição
Número de clustersTotal de grupos identificados
Tamanho médioNúmero médio de reclamações por grupo
Top clustersOs grupos mais importantes
EvoluçãoTendência dos problemas recorrentes

Análise por categoria

Os clusters são analisáveis por:

  • Categoria de reclamação
  • Região geográfica
  • Período temporal
  • Prioridade

Boas práticas

:::tip Recomendações

  1. Examine os grandes clusters: Indicam um problema sistémico
  2. Verifique os duplicados: Score > 90% = verificação manual
  3. Documente as ligações: Referencie as reclamações ligadas nos comentários
  4. Trate em grupo: As reclamações similares merecem frequentemente uma resposta coordenada :::

Permissões necessárias

AçãoPermissão
Ver grupos similaresplaintes.view
Configurar o clusteringparametres.edit

Limitações

  • O clustering funciona melhor com descrições detalhadas
  • As reclamações muito curtas podem ser mal classificadas
  • As línguas misturadas (Português/Crioulo) podem afetar a precisão

Ver também