Ir al contenido
OneKitly

Texto

29 guías sobre texto

Contar, comparar, limpiar y convertir texto. Guías sobre lo que un carácter, una palabra y un byte significan para una máquina — y por qué los tres recuentos de un mismo párrafo rara vez coinciden.

Empezar por aquí

Ordenados por cuántas páginas del sitio enlazan con ellos, no por tráfico.

  1. 1Numerar las líneas de un texto para una revisión entre varias personasLa numeración empieza en 1 y no se puede poner a 0, la alineación se hace con espacios y no con ceros, y la herramienta que los quita deshace ocho de los once separadores sin tocar la indentación. Lo que sigue sin poder hacer es distinguir tus números de los suyos.
  2. 2Detectar el idioma de un texto y por qué los textos cortos fallanMedido, no afirmado: 90 frases cortas reales en seis idiomas, ninguna rechazada y 68 acertadas — un 76%, que baja al 64% por debajo de dieciséis letras. Cuatro de las respuestas erróneas volvieron con un 100% de confianza.
  3. 3Filtrar líneas por un patrón sin línea de comandosEsto es grep para quien no usa grep, con una diferencia importante: la búsqueda es una subcadena literal, así que una expresión regular de verdad devuelve un cuadro vacío y ningún error. Cada afirmación se comprobó ejecutando la herramienta.

Nuestras herramientas para esta sección

Todas nuestras herramientas de texto e idioma

Últimas publicaciones

14 de agosto de 2026
Explicación · Texto

Detectar el idioma de un texto y por qué los textos cortos fallan

Medido, no afirmado: 90 frases cortas reales en seis idiomas, ninguna rechazada y 68 acertadas — un 76%, que baja al 64% por debajo de dieciséis letras. Cuatro de las respuestas erróneas volvieron con un 100% de confianza.

Daniel Okonkwo · 17 min

13 de agosto de 2026
12 de agosto de 2026
Guía · Texto

Generar correctamente una clave secreta de aplicación

Cómo distinguir un generador de claves secretas sólido de uno dudoso, con este como ejemplo trabajado: qué fuente aleatoria llama, cómo calcular la entropía por tu cuenta y qué se rompe de verdad el día que rotas la clave.

Daniel Okonkwo · 14 min

Tutorial · Texto

Numerar las líneas de un texto para una revisión entre varias personas

La numeración empieza en 1 y no se puede poner a 0, la alineación se hace con espacios y no con ceros, y la herramienta que los quita deshace ocho de los once separadores sin tocar la indentación. Lo que sigue sin poder hacer es distinguir tus números de los suyos.

Daniel Okonkwo · 16 min

10 de agosto de 2026
Explicación · Texto

Contar caracteres frente a un límite que ha puesto otro

Un emoji vale 1 carácter, o 7, o 11, o 25, según quién cuente. Cuál quieren decir tu formulario, tu base de datos y tu pasarela de SMS, y una prueba de un solo pegado para saber a cuál te enfrentas.

Daniel Okonkwo · 13 min

Explicación · Texto

Mayúscula inicial y mayúsculas de título: las reglas cambian según el idioma

Las mayúsculas de título inglesas tienen tres cortes distintos según el manual de estilo. El español, el francés, el portugués y el italiano no tienen ninguno. El alemán pone en mayúscula cada sustantivo. La herramienta no sabe nada de esto: aquí está exactamente lo que hace.

Daniel Okonkwo · 14 min

Explicación · Texto

Extraer todas las direcciones de correo o URL de un bloque de texto

Una URL al final de una frase se queda con el punto; una dirección de correo al final de esa misma frase, no. Un nombre acentuado dentro de una dirección vuelve truncado. Cada caso se pasó por las herramientas y aquí está la salida exacta.

Daniel Okonkwo · 14 min

7 de agosto de 2026
Tutorial · Texto

Filtrar líneas por un patrón sin línea de comandos

Esto es grep para quien no usa grep, con una diferencia importante: la búsqueda es una subcadena literal, así que una expresión regular de verdad devuelve un cuadro vacío y ningún error. Cada afirmación se comprobó ejecutando la herramienta.

Daniel Okonkwo · 11 min

Explicación · Texto

Encontrar duplicados en una lista sin hoja de cálculo

Dos líneas que parecen idénticas a menudo no lo son. La caja, un espacio final, un espacio duro y dos codificaciones distintas de la misma letra acentuada se pasaron por el buscador de duplicados, y no señaló ninguno en tres de los cuatro casos.

Daniel Okonkwo · 11 min

6 de agosto de 2026
Guía · Texto

Limpiar una lista pegada desde una hoja de cálculo o un PDF

Un pegado arrastra caracteres que no se ven: espacios duros, guiones opcionales, espacios de ancho cero, tabulaciones y CRLF. Se pasaron cuatro herramientas de limpieza por cada uno, y usan tres definiciones distintas de espacio.

Daniel Okonkwo · 12 min

14 de julio de 2026
9 de julio de 2026
Explicación · Texto

Quitar los acentos rompe la búsqueda — hasta que lo haces en los dos lados

Plegar los diacríticos es un paso de normalización, y la normalización solo funciona cuando la misma función corre sobre el índice y sobre la consulta. NFC frente a NFD con los puntos de código a la vista, y las letras — ø, ł, ß, œ, ı — que salen del plegado intactas.

Daniel Okonkwo · 16 min

8 de julio de 2026
Tutorial · Texto

Limpiar texto desordenado: el orden de las operaciones que sí importa

Quitar etiquetas antes de decodificar entidades, recortar antes de deduplicar, colapsar los espacios al final. Tres órdenes ejecutados en Node, un pipeline de nueve pasos en la secuencia correcta y los caracteres invisibles — U+00A0, U+200B, U+FEFF — que sobreviven a cualquier limpieza ingenua.

Daniel Okonkwo · 15 min

3 de julio de 2026
Comparativa · Texto

camelCase, snake_case, kebab-case: cuál usar, y por qué rara vez eliges tú

Las convenciones no son cuestión de gusto. El guion es el operador menos, así que kebab-case no puede ser un identificador en la mayoría de lenguajes, y por eso justamente lo usan CSS y las URL. Además, el viaje de ida y vuelta con siglas que corrompe nombres en silencio, y la regla que lo arregla.

Daniel Okonkwo · 13 min

1 de julio de 2026
30 de junio de 2026
14 de mayo de 2026
6 de octubre de 2025
Explicación · Texto

Contar palabras es ambiguo, y cada herramienta responde distinto

Un recuento de palabras es una definición, no una medida. Contamos el mismo párrafo de cuatro formas y obtuvimos 25, 28, 33 y 38; luego contamos 50 000 caracteres de prosa corriente y obtuvimos acuerdo dentro del 4,5 %. La diferencia se debe por completo a compuestos, cifras y URL.

Daniel Okonkwo · 12 min

3 de octubre de 2025
Guía · Texto

Formatear números para seis idiomas: separadores, moneda y la vuelta al valor

1.234,56 y 1,234.56 son el mismo número, y confundirlos cambia el valor que lee un lector. Ejecutamos Intl.NumberFormat para las seis locales del sitio e imprimimos cada separador —incluido el invisible que usa el francés— y luego medimos por qué parseFloat no puede deshacer nada de eso.

Daniel Okonkwo · 14 min

29 de septiembre de 2025
26 de septiembre de 2025
Explicación · Texto

Las falsas fuentes de tu biografía no son fuentes: qué son en realidad esos caracteres

Una 𝐀 que parece negrita no es la letra A en negrita: es U+1D400, un carácter distinto inventado para las matemáticas. Imprimimos los puntos de código, medimos el coste en bytes, rompimos la búsqueda, la ordenación y el recuento de palabras con ellos, y escaneamos el bloque para encontrar sus 28 huecos.

Daniel Okonkwo · 13 min

2 de julio de 2025
Guía · Texto

Las listas de tareas en Markdown y qué se renderiza de verdad en cada sitio

Las listas de tareas no están en CommonMark. Son una extensión de GitHub Flavored Markdown, y por eso el mismo fichero muestra casillas en un sitio y corchetes literales en otro. La regla exacta del marcador, qué hace el anidamiento y una tabla de qué es CommonMark, qué es GFM y qué no es ninguno — comprobado contra ambas especificaciones y cuatro renderizadores.

Daniel Okonkwo · 12 min

1 de julio de 2025
Explicación · Texto

Dónde puede cortarse una línea: el algoritmo Unicode detrás de cada párrafo ajustado

«Cortar en los espacios» falla en la mayoría de los sistemas de escritura. UAX #14 da a cada carácter una clase de corte de línea; buscamos las nuestras en Unicode 17.0.0 y ejecutamos una implementación conforme sobre espacios duros, guiones blandos, espacios de ancho cero, URL, japonés y tailandés.

Daniel Okonkwo · 13 min

30 de junio de 2025
Guía · Texto

Convertir entre formatos de lista sin perder datos: las reglas de comillas que nadie lee

Pasar de una lista con saltos de línea a una lista con comas es trivial hasta que un elemento contiene una coma. Las reglas de comillas de la RFC 4180, por qué un campo CSV puede contener un salto de línea, por qué las hojas de cálculo europeas usan el punto y coma, y qué le hace un elemento vacío a la ida y vuelta — cada caso ejecutado e impreso.

Daniel Okonkwo · 14 min

26 de junio de 2025
3 de junio de 2025
Guía · Texto

Quitar el Markdown: lo que el texto plano pierde, y en qué se equivoca una regex

Un enlace se convierte en texto con su destino borrado, una lista anidada pierde su jerarquía, una tabla se vuelve una fila de palabras. Luego la mitad técnica: el markdown no tiene una especificación única, y un limpiador a base de regex destroza un nombre de archivo, un signo de multiplicación y el interior de un bloque de código — todo confrontado con un analizador de verdad.

Daniel Okonkwo · 13 min

2 de junio de 2025
Explicación · Texto

Lo que un verificador de palíndromos debe decidir antes de poder responder

Caja, espacios, puntuación y diacríticos: cuatro políticas, seis frases reales, y la respuesta cambia con cada una. Luego la mitad más difícil — invertir una cadena no está definido de por sí, y la inversión por unidad de código rompe los emojis y desprende los acentos, demostrado en Node.

Daniel Okonkwo · 12 min

30 de mayo de 2025
Guía · Texto

Buscar y reemplazar: las trampas de las expresiones regulares, demostradas una a una

Codicioso contra perezoso sobre la misma cadena, el punto que se salta los saltos de línea, $& y $$ en el reemplazo, una regex /g reutilizada que se salta una fila en silencio, y por qué /i no sabe nada de la i turca. Cada fallo ejecutado en Node, con una rutina contar-y-luego-reemplazar que los atrapa.

Daniel Okonkwo · 14 min

29 de mayo de 2025