Gulag Cleaner CLI (Python) frente a la versión web: qué comparten y cuál usar
Gulag Cleaner existe como línea de comandos en Python y como web en el navegador. Instalación, opciones, tabla comparativa y cuándo conviene cada una.
Gulag Cleaner no es solo una web. El proyecto original nació como una herramienta de línea de comandos en Python, con el núcleo escrito en Rust, y ese mismo núcleo, compilado a WebAssembly, es el que ejecuta gulagcleaner.pro dentro del navegador. Las dos versiones hacen lo mismo con el PDF; cambian la instalación, la forma de usarlas y un par de extras. Esta comparativa te dice cuál conviene en cada caso.
Qué comparten
El método. Gulag Cleaner no recorta los anuncios: extrae el archivo original manipulando la estructura interna del PDF, porque Wuolah y StuDocu incrustan cada página real dentro de una página nueva con banners, portada y marcas. El resultado conserva la calidad del documento de origen, y en ninguna de las dos versiones el archivo sale de tu equipo.
La CLI: instalación y uso
Necesitas Python instalado. Después, en una terminal:
pip install gulagcleaner gulagcleaner apuntes.pdf
Acepta uno o varios archivos, y también carpetas enteras, lo que la convierte en la opción natural para limpiar todo un cuatrimestre de golpe. Además del PDF limpio muestra los metadatos que encuentra en el archivo, como autor, asignatura o universidad. Sus opciones:
| Opción | Qué hace |
|---|---|
-r | Sustituye el archivo original por la versión limpia. |
-s | No muestra los metadatos de los archivos limpiados. |
-n | Fuerza el método «ingenuo», más conservador. |
-h | Muestra la ayuda. |
-v | Muestra la versión instalada. |
También se puede llamar desde tu propio código:
from gulagcleaner.clean import clean_pdf_path
clean_pdf_path("entrada.pdf", "salida.pdf")La web: gulagcleaner.pro
Nada que instalar: se abre en cualquier navegador de los últimos tres años, también en el móvil. El motor es el mismo, compilado a WebAssembly, y se ejecuta en tu dispositivo. Añade dos cosas que la CLI no tiene: una vista previa de las primeras seis páginas con el recuento de páginas eliminadas antes de descargar, y una red de seguridad que ejecuta el motor en dos modos, descarta cualquier resultado sin páginas o con más del 80 % del documento eliminado, y te devuelve el original si ninguno pasa la prueba. A cambio, limpia un archivo cada vez.
Cara a cara
| CLI | Web | |
|---|---|---|
| Instalación | Python y pip | Ninguna |
| Dónde se procesa el PDF | En tu ordenador | En tu navegador, sin subidas |
| Varios archivos y carpetas | Sí, de una vez | Uno cada vez |
| Vista previa antes de guardar | No | Sí, seis primeras páginas |
| Comprobación del recuento de páginas | Manual (opción -n) | Automática, en dos modos |
| Metadatos del PDF | Sí | No |
| Móvil | No | Sí |
| Actualizaciones | pip install -U gulagcleaner | Al recargar la página |
| Licencia | GPL-3 | GPL-3, mismo motor |
Cuál elegir
- Un archivo suelto, desde cualquier sitio o desde el móvil: la web.
- Decenas de PDFs o una carpeta por asignatura: la CLI.
- Quieres ver el resultado antes de guardarlo: la web.
- Quieres integrarlo en un script o en tu propio programa: la CLI y su función
clean_pdf_path.
Código abierto, dos webs
El motor, la CLI y las distribuciones en Rust y WebAssembly viven en GitHub bajo licencia GPL-3, y el paquete de Python en PyPI. gulagcleaner.pro es una versión web independiente basada en ese motor, no afiliada a gulagcleaner.com, la web del proyecto original. La historia completa está en la historia open source detrás de Gulag Cleaner.