Descrição
Fornece tokenizadores e medidas de similaridade de strings para Python. Ajuda limpeza de dados, correspondência de entidades, deduplicação, busca e vinculação de registros a comparar valores de texto em escala.
Pontuações de similaridade são heurísticas, não prova de identidade. Ajuste limites e revise correspondências antes de mesclar registros ou tomar decisões que afetem usuários.