FreeToGenerate.com

Las 24 letras, generadas desde la base de datos de caracteres Unicode y no escritas a mano.

Las 24 letras

Pulsa cualquier letra para copiarla

NombreMayúsculaMinúsculaPuntos de códigoParecido latino
AlphaU+0391 / U+03B1A / a
BetaU+0392 / U+03B2B
GammaU+0393 / U+03B3ninguno
DeltaU+0394 / U+03B4ninguno
EpsilonU+0395 / U+03B5E
ZetaU+0396 / U+03B6Z
EtaU+0397 / U+03B7H
ThetaU+0398 / U+03B8ninguno
IotaU+0399 / U+03B9l / i
KappaU+039A / U+03BAK
LamdaU+039B / U+03BBninguno
MuU+039C / U+03BCM
NuU+039D / U+03BDN / v
XiU+039E / U+03BEninguno
OmicronU+039F / U+03BFO / o
PiU+03A0 / U+03C0ninguno
RhoU+03A1 / U+03C1P / p
SigmaU+03A3 / U+03C3ninguno
TauU+03A4 / U+03C4T
UpsilonU+03A5 / U+03C5Y / u
PhiU+03A6 / U+03C6ninguno
ChiU+03A7 / U+03C7X
PsiU+03A8 / U+03C8ninguno
OmegaU+03A9 / U+03C9ninguno

La sigma tiene una segunda minúscula, ς (U+03C2), que solo se usa al final de palabra.

Analiza un texto

También disponible en: English · Português · Français · العربية

Alfabeto griego

Cada letra con sus puntos de código y su parecido latino, y la única letra que complica pasar el griego a minúsculas.

¿Qué es el alfabeto griego?

El alfabeto griego tiene 24 letras, de alfa a omega. Lleva unos tres mil años en uso continuado, lo que lo convierte en el alfabeto más antiguo que todavía se escribe hoy con vocales como letras de pleno derecho: esa fue su innovación. El griego moderno lo usa como sistema de escritura corriente, igual que el español usa el latino.

Casi todos los demás lo usamos como almacén de símbolos. Pi es la constante del círculo, sigma un sumatorio, delta una variación, lambda una longitud de onda y también una función, mu una millonésima, omega el ohmio. La estadística vive de alfa, beta y ji; la física de partículas ha recorrido el alfabeto entero más de una vez. Y en el mundo universitario estadounidense da nombre a las fraternidades.

La tabla de arriba se genera desde la base de datos de caracteres Unicode, así que las letras, sus nombres y sus códigos vienen del archivo que los define y no de una copia de otra copia. Cada letra muestra su forma mayúscula y minúscula, los dos puntos de código y si Unicode la considera confundible con una letra latina. Pulsa cualquiera para copiarla.

Cómo usar esta página

  1. Busca la letra y púlsala. Al pulsar la mayúscula o la minúscula copias ese carácter al portapapeles. La columna de códigos indica exactamente qué carácter te llevas, y eso importa más de lo que parece: varias letras griegas tienen gemelas latinas idénticas a la vista que no son en absoluto el mismo carácter.
  2. Pega en el recuadro cualquier texto sospechoso. Si un nombre de usuario, un dominio o un archivo lleva letras griegas haciéndose pasar por latinas, el analizador las enumera con su posición, su nombre Unicode y la letra que imita cada una, y después te muestra cómo se lee el texto una vez sustituidas.
  3. Fíjate en la comparación de minúsculas. El recuadro pasa tu texto a minúsculas dos veces: una tomando la cadena entera y otra carácter a carácter. En cualquier idioma salvo el griego los dos resultados son idénticos. Cuando difieren, estás viendo el fallo que se explica más abajo.

Por qué pasar el griego a minúsculas no es cosa de un carácter

La sigma es la única letra griega con dos minúsculas. La minúscula corriente es σ, U+03C3. A final de palabra se escribe ς, U+03C2, la sigma final. Cuál de las dos corresponde depende únicamente de dónde caiga la letra dentro de la palabra, y eso hace del griego el único alfabeto donde cambiar de caja no es consultar una tabla.

Se puede ver en directo. La palabra griega para calle, ΟΔΟΣ, pasa a minúsculas terminando en ς (U+03C2), porque el programa ve que esa sigma es la última letra. Pasa esos mismos cuatro caracteres uno a uno y el resultado acaba en σ (U+03C3), porque un carácter suelto no tiene ninguna palabra en la que ser el último. Dos grafías de la misma palabra, del mismo texto de partida, según qué función hayas llamado.

Recorrimos las 24 letras para medir cuán excepcional es: la sigma es la única en la que los dos métodos discrepan. Pon cualquier otra letra griega al final de una palabra y ambos caminos dan lo mismo. La regla es la condición Final_Sigma de Unicode, y es la única correspondencia de caja sensible al contexto en el algoritmo por defecto; todo lo demás sí es una tabla.

Lo que hace duradero este fallo es que en ningún otro sitio se nota. Lo comprobamos en español, inglés, portugués, francés, alemán y ruso: pasar a minúsculas carácter a carácter es correcto en todos, tildes y eñes incluidas. Así que un bucle escrito a mano, un tokenizador que baja la caja mientras trocea o un generador de slugs que trabaja carácter a carácter superan cualquier prueba que a su autor se le ocurra escribir, y luego producen en silencio una segunda grafía de cada palabra griega acabada en sigma.

Hay una trampa emparejada en los viajes de ida y vuelta. Pasar el griego a mayúsculas y volver a minúsculas devuelve el original en las 24 letras. Al revés no: σοφοσ, escrita con sigma corriente al final, sube a ΣΟΦΟΣ y vuelve como σοφος, con sigma final. Ambas sigmas suben a la misma Σ, de modo que la distinción se destruye antes incluso de que corra el paso de bajada. Normalizar la caja del griego para comparar dos cadenas es seguro; normalizarla y guardar el resultado, no.

Letras que no son la letra que aparentan

Catorce de las 24 mayúsculas están marcadas por Unicode como confundibles con una letra latina básica: alfa con A, beta con B, épsilon con E, zeta con Z, eta con H, iota con l, kappa con K, my con M, ny con N, ómicron con O, rho con P, tau con T, ípsilon con Y y ji con X. Cada uno de esos pares son dos caracteres distintos que tu vista no puede separar.

Conviene leer los pares despacio, porque las formas no siguen a los sonidos. Rho suena como una r y tiene forma de P. Eta es una e larga y tiene forma de H. Ji es un sonido parecido a la j y se escribe X; ípsilon es una u escrita Y. Quien translitere por la forma en vez de por el sonido las invierte todas, que es otra razón menor para tener la tabla a mano.

Esa lista no es juicio nuestro. Sale de confusables.txt, el archivo de datos de Unicode que sustenta el UTS 39, los mecanismos de seguridad que usan registradores de dominios y navegadores para detectar identificadores suplantados. Así que las diez mayúsculas ausentes —delta, theta, lambda, xi, pi, sigma, phi, psi, omega y gamma— faltan porque Unicode no las considera confundibles, no porque nadie mirara. También hay ocho minúsculas señaladas, incluidas la inquietante sigma por o y gamma por y.

La parte práctica: la normalización NFKD no unifica ninguna de las catorce. Normalizar es el reflejo habitual para comparar cadenas que puedan escribirse de varias formas, y resuelve de verdad tildes, ligaduras y caracteres de ancho completo, pero una eta mayúscula griega haciendo de H lo atraviesa intacta, por los dos lados, y sigue siendo distinta. Un detector de parecidos basado en normalizar y comparar no atrapa ni una sola de estas. Ese es justamente el hueco que cubre el analizador de arriba.

Límites honestos

Los nombres de la tabla son los nombres que Unicode da a los caracteres, conservados en su grafía Unicode y no traducidos. Las letras griegas tienen nombres perfectamente buenos en español, y si escribes prosa debes usarlos; pero el cometido de esa columna es decir qué carácter estás mirando, y el nombre Unicode es el que lo identifica sin ambigüedad.

Que dos letras se parezcan de verdad depende de la tipografía. La lista de confundibles de Unicode es un dictamen general, y cada fuente puede ensanchar o estrechar la distancia: algunas dan a las mayúsculas griegas proporciones algo distintas de sus gemelas latinas, y unas pocas acercan letras que normalmente se distinguen bien. Toma la columna como un aviso de qué pares conviene revisar, no como una afirmación sobre la fuente de tu pantalla.

Y sobre todo: encontrar una letra confundible no significa que algo vaya mal. Una palabra griega corriente está llena de ellas. ΑΘΗΝΑ es casi por entero letras que Unicode marca como confundibles, y no es más que el nombre de una ciudad. Lo que de verdad indica problema es mezclar alfabetos dentro de una misma secuencia, porque una palabra mitad griega y mitad latina no es palabra en ninguno de los dos idiomas. El analizador informa de eso por separado, y es la línea a la que hay que atender.

¿Por qué es gratis?

Porque es una tabla y unas cuantas comparaciones de cadenas. Todo lo de esta página ocurre en tu navegador: nada de lo que pegues en el analizador se sube, nada se guarda y ningún servidor interviene en leer una lista de 24 letras.

Así que no hay cuenta, ni registro, ni nada reservado. El script que genera la tabla desde la base de datos de caracteres Unicode y confusables.txt está en el repositorio junto a la página, con las 128 comprobaciones que verifican el comportamiento de la sigma, los viajes de ida y vuelta y las afirmaciones sobre parecidos, incluidos los controles negativos que impiden que esas pruebas pasen por el motivo equivocado.