FreeToGenerate.com

100% gratis · sin registro · todo en tu navegador

0

Todo ocurre en tu navegador. No se sube nada.

También disponible en: English · Português · Français · العربية

Convertidor de HTML a Markdown

Pega HTML y obtén Markdown limpio al instante, con opción de conservar lo que Markdown no puede escribir.

¿Qué es convertir HTML a Markdown?

Convertir HTML a Markdown es tomar el marcado que usa cualquier página web —etiquetas de párrafo, encabezado, lista, enlace— y reescribirlo en la sintaxis ligera de Markdown: # para encabezados, * para listas, [texto](url) para enlaces, y así con el resto. El resultado es texto plano que cualquier editor lee sin problema, mucho más corto que el HTML original y sin una sola etiqueta angular de por medio.

Quien necesita esto casi siempre está moviendo contenido de un formato a otro: pegar el cuerpo de una página para guardarla como nota, convertir la exportación con formato de un editor de texto en el README de un repositorio, alimentar un generador de sitios estáticos que solo acepta Markdown, o llevar documentación desde una intranet a una wiki que la prefiere así. En los cuatro casos el problema es el mismo: sobra HTML y hace falta Markdown limpio, sin copiar etiqueta por etiqueta a mano.

Esta herramienta convierte HTML a Markdown pegando el código a la izquierda y viendo el resultado a la derecha al instante, con dos casillas para decidir cómo se trata lo que Markdown no sabe escribir.

Cómo se usa

  1. Pega tu HTML. Copia el código fuente o el fragmento que quieras convertir y pégalo en el panel de la izquierda.
  2. Ajusta las opciones. Activa o desactiva los extras de GitHub y decide si el HTML sin equivalente se conserva o se elimina.
  3. Copia el resultado. El Markdown aparece a la derecha mientras escribes, listo para copiar con un clic.

Por qué no hay una cifra oficial de precisión

No existe una especificación que defina este sentido. CommonMark dice con precisión cómo un documento Markdown se convierte en HTML, pero no dice una sola palabra sobre el camino contrario, así que no hay una batería oficial que un conversor de HTML a Markdown deba superar. Cualquiera que anuncie una conversión «100% precisa» está afirmando algo que, en sentido estricto, ni siquiera está definido en ningún sitio.

Ante la falta de especificación, lo que sí se puede medir es si el viaje de ida y vuelta se sostiene: tomar HTML, convertirlo a Markdown, convertir ese Markdown de nuevo a HTML, y comprobar si vuelve igual. Se hizo con las 652 salidas HTML esperadas de la batería de pruebas de CommonMark. El resultado: 472 de 652 vuelven idénticas byte a byte (72,4%), y 540 de 652 vuelven idénticas si se ignoran los espacios en blanco irrelevantes entre etiquetas (82,8%).

Esas cifras corresponden a la configuración con la que se publica la página, que conserva el HTML que Markdown no puede expresar. Medido con esa opción desactivada, el mismo viaje da 471 y 538: conservar lo que el formato no sabe decir no solo es la opción segura, también es, por muy poco, la más fiel.

Activar o desactivar los extras de GitHub —tablas, texto tachado, listas de tareas— no mueve esa cifra ni un punto, porque la batería de CommonMark no contiene ni una sola tabla: solo pone a prueba la sintaxis que la propia especificación define. Los extras importan para el HTML que de verdad circula por la web, no para esta puntuación.

De qué están hechas las diferencias

Lo interesante no es el 72,4% sino de qué están hechas las 112 diferencias. Cincuenta y cinco —algo menos de la mitad— son los llamados bloques HTML y HTML en línea de la propia especificación de CommonMark: fragmentos que sencillamente no tienen ninguna forma de escribirse en Markdown, con ninguna herramienta. Las otras 57 son una cola mucho más fina donde el HTML vuelve equivalente pero redactado de otra manera: nueve casos en listas, nueve en enlaces, siete en elementos de lista, seis en código en línea, cinco en bloques de código, cinco en énfasis, y cifras de una sola unidad en el resto.

Ese primer grupo señala algo del formato, no de esta herramienta: Markdown no puede expresar todo lo que expresa HTML. Su sintaxis cubre encabezados, párrafos, listas, citas, código, énfasis, enlaces, imágenes y líneas divisorias —y nada más—. Un <div>, un <span>, una clase CSS, un id, la alineación de una celda de tabla o un vídeo incrustado no tienen ninguna sintaxis Markdown que los represente, los escriba quien los escriba.

Por eso esta herramienta, por defecto, conserva como HTML literal todo lo que Markdown no puede expresar, en vez de quitar las etiquetas y dejar solo el texto suelto —aplanar sin avisar una tabla en un párrafo corrido es la clase de pérdida que nadie nota hasta que ya es tarde—, y por eso el panel bajo el resultado enumera cada etiqueta sin equivalente y cuántas veces aparece. La opción de eliminarlas sigue disponible para quien la prefiera, pero es la elección con pérdida y la página lo dice tal cual.

La conversión usa el propio analizador de HTML del navegador en vez de traer uno aparte. No es solo una cuestión de peso: el analizador del navegador interpreta el HTML mal formado o poco habitual exactamente igual que lo haría al mostrar la página, así que lo que se convierte aquí es lo mismo que verías si abrieras ese HTML.

¿Por qué es gratis?

La conversión entera ocurre en tu navegador: no hay servidor de por medio, no se sube ni un byte del HTML que pegas, y no hace falta crear una cuenta para usarla. El Markdown que sale no lleva ninguna marca de agua ni aviso añadido —es exactamente el texto que copias, nada más—. Por eso la herramienta puede ser gratis sin condiciones: no cuesta nada de servidor porque el trabajo lo hace tu propio equipo.