Lección 12 / 20

Trabajar con texto

En esta lección medirás un texto y extraerás una parte de él.

length() devuelve el tamaño y substr($texto, 0, 5) extrae cinco unidades a partir de la posición 0. Fíjate en que print admite varios argumentos separados por comas y los imprime uno detrás de otro.

El código de ejemplo muestra el tamaño del texto y su comienzo.

Y aquí aparece la trampa más importante de Perl con el español. Sin más preparación, Perl trata el texto como una secuencia de bytes, no de caracteres. El signo ¡ ocupa dos bytes en UTF-8, así que el tamaño sale mayor de lo que esperas y substr corta a mitad de camino: por eso el resultado es ¡Hol, cuatro letras y no cinco. Por eso las etiquetas del ejemplo dicen «bytes» y no «caracteres».

La solución existe y es corta: añadir use utf8; arriba para que Perl entienda que el código fuente está en UTF-8, y binmode(STDOUT, ':utf8'); para que la salida también lo esté. A partir de ahí length cuenta caracteres de verdad. Es una de esas cosas que conviene saber antes de procesar textos en español, no después.

📖 Código de referencia
✍️ Tu código
Escribe tu código y pulsa «Ejecutar»

🧪 Este sitio no puede compilar ni ejecutar Perl directamente, así que comprueba al instante si lo que escribiste coincide con el código de referencia (la corrección ocurre por completo en tu navegador; no se envía nada a ningún servidor).

Espacio publicitario (banner)
Espacio publicitario (en el artículo)