Comparativa··6 min de lectura

Gulag Cleaner CLI (Python) frente a la versión web: qué comparten y cuál usar

Gulag Cleaner existe como línea de comandos en Python y como web en el navegador. Instalación, opciones, tabla comparativa y cuándo conviene cada una.

Gulag Cleaner no es solo una web. El proyecto original nació como una herramienta de línea de comandos en Python, con el núcleo escrito en Rust, y ese mismo núcleo, compilado a WebAssembly, es el que ejecuta gulagcleaner.pro dentro del navegador. Las dos versiones hacen lo mismo con el PDF; cambian la instalación, la forma de usarlas y un par de extras. Esta comparativa te dice cuál conviene en cada caso.

Qué comparten

El método. Gulag Cleaner no recorta los anuncios: extrae el archivo original manipulando la estructura interna del PDF, porque Wuolah y StuDocu incrustan cada página real dentro de una página nueva con banners, portada y marcas. El resultado conserva la calidad del documento de origen, y en ninguna de las dos versiones el archivo sale de tu equipo.

La CLI: instalación y uso

Necesitas Python instalado. Después, en una terminal:

pip install gulagcleaner
gulagcleaner apuntes.pdf

Acepta uno o varios archivos, y también carpetas enteras, lo que la convierte en la opción natural para limpiar todo un cuatrimestre de golpe. Además del PDF limpio muestra los metadatos que encuentra en el archivo, como autor, asignatura o universidad. Sus opciones:

OpciónQué hace
-rSustituye el archivo original por la versión limpia.
-sNo muestra los metadatos de los archivos limpiados.
-nFuerza el método «ingenuo», más conservador.
-hMuestra la ayuda.
-vMuestra la versión instalada.

También se puede llamar desde tu propio código:

from gulagcleaner.clean import clean_pdf_path

clean_pdf_path("entrada.pdf", "salida.pdf")

La web: gulagcleaner.pro

Nada que instalar: se abre en cualquier navegador de los últimos tres años, también en el móvil. El motor es el mismo, compilado a WebAssembly, y se ejecuta en tu dispositivo. Añade dos cosas que la CLI no tiene: una vista previa de las primeras seis páginas con el recuento de páginas eliminadas antes de descargar, y una red de seguridad que ejecuta el motor en dos modos, descarta cualquier resultado sin páginas o con más del 80 % del documento eliminado, y te devuelve el original si ninguno pasa la prueba. A cambio, limpia un archivo cada vez.

Cara a cara

CLIWeb
InstalaciónPython y pipNinguna
Dónde se procesa el PDFEn tu ordenadorEn tu navegador, sin subidas
Varios archivos y carpetasSí, de una vezUno cada vez
Vista previa antes de guardarNoSí, seis primeras páginas
Comprobación del recuento de páginasManual (opción -n)Automática, en dos modos
Metadatos del PDFNo
MóvilNo
Actualizacionespip install -U gulagcleanerAl recargar la página
LicenciaGPL-3GPL-3, mismo motor

Cuál elegir

  • Un archivo suelto, desde cualquier sitio o desde el móvil: la web.
  • Decenas de PDFs o una carpeta por asignatura: la CLI.
  • Quieres ver el resultado antes de guardarlo: la web.
  • Quieres integrarlo en un script o en tu propio programa: la CLI y su función clean_pdf_path.

Código abierto, dos webs

El motor, la CLI y las distribuciones en Rust y WebAssembly viven en GitHub bajo licencia GPL-3, y el paquete de Python en PyPI. gulagcleaner.pro es una versión web independiente basada en ese motor, no afiliada a gulagcleaner.com, la web del proyecto original. La historia completa está en la historia open source detrás de Gulag Cleaner.

¿Listo para limpiar tu PDF?
100% local. Sin subidas. Gratis para siempre.
Abrir el limpiador →

Seguir leyendo