Vai al contenuto
OneKitly

Rimuovi parole duplicate

Mantieni solo la prima occorrenza di ogni parola nel testo.

Apri Rimuovi parole duplicate e ottieni subito una risposta, senza creare un account. È collocato sotto Trasformare e pulire nel nostro catalogo, accanto a Rimuovi righe duplicate e Ordina parole in ordine alfabetico.

Come si usa

  1. Apri lo strumento — senza registrazione né installazione.
  2. Inserisci i tuoi dati o regola le opzioni disponibili.
  3. Ottieni il risultato all'istante, poi copialo o scaricalo.

Domande frequenti

Che cos'è Rimuovi parole duplicate?

Mantieni solo la prima occorrenza di ogni parola nel testo.

In quali casi si usa davvero?

Ripulire un incollato prima di riusarlo: togliere duplicati da un elenco, uniformare le maiuscole, rimuovere gli accenti per un nome file o ordinare righe.

Qual è l'errore più comune?

Ordinare il testo come se fosse ASCII. Le lettere accentate finiscono dopo la Z in un ordinamento per byte, mettendo «Zurigo» prima di «Émile» e producendo un elenco che nessun lettore accetterà.

In cosa differisce Rimuovi parole duplicate da Rimuovi righe duplicate?

Sono vicini ma rispondono a domande diverse: Rimuovi righe duplicate è quello da aprire quando si tratta di elimina le righe ripetute mantenendo l'ordine originale. Scegli quello che corrisponde al tuo punto di partenza — entrambi sono gratuiti.

Esiste uno strumento per il passo successivo?

Ordina parole in ordine alfabetico è il più vicino dopo questo: Ordina tutte le parole del testo in ordine alfabetico.

Cos'altro conviene tenere aperto accanto?

Duplica ogni riga e Trova righe duplicate: ricorrono nella stessa attività abbastanza spesso da meritare una seconda scheda.

Da dove vengono i dati?

Le trasformazioni usano la gestione Unicode del browser, quindi cambi di maiuscole e ordinamento rispettano la locale, non l'ordine dei byte. Nulla viene troncato: esce tutto ciò che è entrato.

Per approfondire

Tutte le guide
GuidaTrova e sostituisci: le trappole delle espressioni regolari, dimostrate una per unaGoloso contro pigro sulla stessa stringa, il punto che salta gli a capo, $& e $$ nella sostituzione, una regex /g riusata che salta una riga in silenzio, e perché /i non sa nulla della i turca. Ogni guasto eseguito in Node, con una routine conta-poi-sostituisci che li intercetta.SpiegazioneTrovare i duplicati di un elenco senza foglio di calcoloDue righe che sembrano identiche spesso non lo sono. Le maiuscole, uno spazio finale, uno spazio unificatore e due codifiche diverse della stessa lettera accentata sono stati passati nel rilevatore di duplicati, che in tre casi su quattro non ne ha segnalato nessuno.SpiegazioneRilevare la lingua di un testo, e perché i testi brevi fallisconoMisurato, non affermato: 90 frasi brevi reali in sei lingue, nessuna rifiutata e 68 giuste — il 76%, che scende al 64% sotto le sedici lettere. Quattro delle risposte sbagliate sono tornate con il 100% di fiducia.TutorialFiltrare righe secondo uno schema, senza riga di comandoQuesto è grep per chi non usa grep, con una differenza importante: la ricerca è una sottostringa letterale, quindi una vera espressione regolare restituisce un riquadro vuoto e nessun errore. Ogni affermazione è stata verificata eseguendo lo strumento.GuidaPulire un elenco incollato da un foglio di calcolo o da un PDFUn incolla porta con sé caratteri invisibili: spazi unificatori, trattini morbidi, spazi a larghezza zero, tabulazioni e CRLF. Quattro strumenti di pulizia sono stati eseguiti su ciascuno, e usano tre definizioni diverse di spazio.SpiegazioneTogliere gli accenti rompe la ricerca — finché non lo fai da entrambi i latiRipiegare i segni diacritici è un passaggio di normalizzazione, e la normalizzazione funziona solo se la stessa funzione gira sull'indice e sulla query. NFC contro NFD con i punti di codice in chiaro, e le lettere — ø, ł, ß, œ, ı — che escono dal ripiegamento intatte.