Medición
Cuánto acierta este traductor de braille español
Se compara con liblouis, la implementación de referencia, en cada compilación: 5033 textos, el 100% idénticos. Aquí está el método, y por qué esa cifra tiene que ser exactamente esa.
- Pregunta
- ¿El braille que escribe este sitio es el mismo que produce la implementación de referencia?
- Comparado con
- liblouis 3.29.0 (es-g1), tabla "unicode.dis,es-g1.ctb"
- Sobre
- 5001 palabras y 32 frases construidas
- Guardado en
data/es-reference.tsv
El resultado
| Qué se comprueba | Cuántos | Idénticos |
|---|---|---|
| Palabras de la lista de frecuencia | 5001 | 100% |
| Frases con mayúsculas, cifras, signos de apertura y comillas angulares | 32 | 100% |
| Total | 5033 | 100% |
Las palabras son las más frecuentes del español en orden de frecuencia, de hermitdave/FrequencyWords —subtítulos de OpenSubtitles, CC BY-SA 4.0— filtradas a las que solo contienen letras españolas. Las frases están escritas a mano porque una lista de palabras en minúscula no puede ver lo que más falla: las mayúsculas, los números, la ¿ y la ¡ de apertura, y las comillas angulares.
Por qué el 100% no es una nota alta
En braille español de grado 1 cada letra es una celda y no hay nada que decidir. No existe una escritura defendible distinta de la de referencia: cualquier discrepancia es un defecto de la tabla. Por eso la cifra esperada es exactamente el 100%, y por eso publicarla dice menos de lo que parece —lo que diría algo es no alcanzarla.
El contraste con el inglés es el dato interesante. El braille inglés unificado de grado 2 abrevia, y abreviar admite criterio: dos transcriptores competentes pueden escribir la misma palabra de dos formas defendibles. El motor inglés de este sitio se queda en el 99,72% frente a la misma referencia, y publica las palabras que falla una por una. Ese 99,72% es un resultado más difícil que este 100%.
Grado 1, sin abreviaturas. El braille español abreviado —la estenografía— es un sistema aparte con su propia medición pendiente, y afirmar aquí que está cubierto antes de medirlo sería exactamente el error que esta página existe para no cometer. Tampoco entran la notación matemática ni la musical, que son códigos propios.
Las siete letras que lo hacen necesario
Si el braille español fuera el inglés con acentos, no haría falta ni tabla ni medición. No lo es. Estas siete letras son una celda cada una aquí, y cada una ocupa una celda que el braille inglés ya tenía dada a otra cosa:
| Letra | Celda | Puntos | En braille inglés | Puntos en inglés |
|---|---|---|---|---|
á | 1-2-3-5-6 | 3 celdas | 4-5 3-4 1 | |
é | 2-3-4-6 | 3 celdas | 4-5 3-4 1-5 | |
í | 3-4 | 3 celdas | 4-5 3-4 2-4 | |
ñ | 1-2-4-5-6 | 3 celdas | 4-5 1-2-4-5-6 1-3-4-5 | |
ó | 3-4-6 | 3 celdas | 4-5 3-4 1-3-5 | |
ú | 2-3-4-5-6 | 3 celdas | 4-5 3-4 1-3-6 | |
ü | 1-2-5-6 | 3 celdas | 4-5 2-5 1-3-6 |
Y no son un caso raro: el 17,8% de las 5001 palabras españolas más frecuentes —891 de ellas— lleva alguna. Escribir español con la tabla inglesa no falla de vez en cuando: falla en casi una de cada cinco palabras, y falla en silencio, porque el resultado sigue pareciendo braille.
Compruébalo tú
Nada de esto hay que creérselo. liblouis es software libre y está en los repositorios de cualquier distribución, así que la comparación se rehace en dos órdenes:
lou_translate unicode.dis,es-g1.ctb <<< "mañana"
y el resultado tiene que ser el mismo que devuelve el traductor de esta sección para la misma palabra. El archivo de referencia completo está en el repositorio, en data/es-reference.tsv, con el texto y la salida esperada en cada línea.
Si lees braille y algo de aquí está mal, dilo. Una corrección de alguien que lee con los dedos vale más que cualquier prueba automática.
La cifra como imagen
Para citarla, enlazarla o ponerla en una diapositiva.
