Ir para o conteúdo
OneKitly

Remover palavras duplicadas

Mantenha apenas a primeira ocorrência de cada palavra do texto.

Abre Remover palavras duplicadas e obténs uma resposta de imediato, sem criar conta. Está arrumada em Transformar e limpar no nosso catálogo, ao lado de Remover linhas duplicadas e Ordenar palavras alfabeticamente.

Como usar

  1. Abra a ferramenta — sem registo nem instalação.
  2. Introduza os seus dados ou ajuste as opções disponíveis.
  3. Obtenha o seu resultado ao instante e copie-o ou descarregue-o.

Perguntas frequentes

O que é Remover palavras duplicadas?

Mantenha apenas a primeira ocorrência de cada palavra do texto.

Em que casos se usa na prática?

Limpar um texto colado antes de o reutilizar: remover duplicados de uma lista, uniformizar maiúsculas, tirar acentos para um nome de ficheiro ou ordenar linhas.

Qual é o erro mais comum?

Ordenar texto como se fosse ASCII. As letras acentuadas ficam depois do Z numa ordenação por bytes, o que coloca «Zurique» antes de «Émile» e produz uma lista que nenhum leitor aceitará.

Em que difere Remover palavras duplicadas de Remover linhas duplicadas?

Estão próximos mas respondem a perguntas diferentes: Remover linhas duplicadas é o que deves abrir quando se trata de elimine as linhas repetidas mantendo a ordem de aparição original. Escolhe o que corresponde ao teu ponto de partida — ambos são gratuitos.

Existe uma ferramenta para o passo seguinte?

Ordenar palavras alfabeticamente é o mais próximo a seguir a este: Ordene todas as palavras do seu texto por ordem alfabética.

Que mais vale a pena ter aberto ao lado?

Duplicar cada linha e Encontrar linhas duplicadas — surgem na mesma tarefa com frequência suficiente para merecerem outro separador.

De onde vêm os dados?

As transformações usam o tratamento Unicode do navegador, pelo que as mudanças de maiúsculas e a ordenação respeitam a localização, não a ordem de bytes. Nada é truncado: sai tudo o que entrou.

Para saber mais

Todos os guias
GuiaLocalizar e substituir: as armadilhas das expressões regulares, demonstradas uma a umaGanancioso contra preguiçoso sobre a mesma cadeia, o ponto que salta as quebras de linha, $& e $$ na substituição, uma regex /g reutilizada que salta uma linha em silêncio, e porque /i nada sabe do i turco. Cada falha executada no Node, com uma rotina contar-e-depois-substituir que as apanha.ExplicaçãoEncontrar duplicados numa lista sem folha de cálculoDuas linhas que parecem idênticas muitas vezes não são. A caixa, um espaço final, um espaço inquebrável e duas codificações diferentes da mesma letra acentuada foram passados pelo detetor de duplicados, e ele não assinalou nenhum em três dos quatro casos.ExplicaçãoDetetar o idioma de um texto e porque os textos curtos falhamMedido, não afirmado: 90 frases curtas reais em seis idiomas, nenhuma recusada e 68 certas — 76%, caindo para 64% abaixo de dezasseis letras. Quatro das respostas erradas voltaram com 100% de confiança.TutorialFiltrar linhas por um padrão sem linha de comandosIsto é o grep para quem não usa grep, com uma diferença importante: a procura é uma subcadeia literal, pelo que uma expressão regular a sério devolve uma caixa vazia e nenhum erro. Cada afirmação foi verificada executando a ferramenta.GuiaLimpar uma lista colada de uma folha de cálculo ou de um PDFUma colagem transporta carateres invisíveis: espaços inquebráveis, hífenes condicionais, espaços de largura nula, tabulações e CRLF. Quatro ferramentas de limpeza foram passadas por cada um, e usam três definições diferentes de espaço.ExplicaçãoRetirar os acentos estraga a pesquisa — até o fazer dos dois ladosRebater os diacríticos é um passo de normalização, e a normalização só funciona quando a mesma função corre sobre o índice e sobre a consulta. NFC contra NFD com os pontos de código à vista, e as letras — ø, ł, ß, œ, ı — que saem do rebatimento intactas.