⏱️ Lectura: 18 min
Pegás el link de una noticia bloqueada por un paywall en wallhop.io y, en unos segundos, el texto completo aparece en la pantalla, sin crear cuenta y sin pagar un centavo. No hay magia: es el mismo patrón que usó 12ft.io durante años, hasta que los medios aprendieron a reconocerlo y bloquearlo sitio por sitio.
📑 En este artículo
- TL;DR
- ¿Qué es una herramienta de paywall bypass?
- Por qué importa apostar a la técnica y no a la herramienta
- Breve historia de saltar un paywall
- Cómo saltar un paywall: proxies, cachés y user-agents falsos
- Ejemplos prácticos con WallHop
- Cómo empezar a usar un bypass de paywall
- Casos de uso reales
- Errores comunes y buenas prácticas
- Comparativa con alternativas
- Profundizando: la carrera entre detección y evasión
- Preguntas frecuentes
- Referencias
WallHop ofrece tres formas de uso (poner una barra delante del link, un bookmarklet y un atajo de iPhone) y dos endpoints para automatizar, /raw y /api. Lo que importa no es si WallHop funciona hoy, sino cómo funciona por dentro: proxies, cachés y cabeceras falsificadas, la lógica que sobrevive aunque la herramienta de turno desaparezca.
TL;DR
- WallHop deja pegar el link de un artículo con paywall y leerlo completo sin pagar.
- Un proxy pide la página en tu nombre; una caché sirve una copia que ya indexó un buscador.
- El user-agent spoofing hace creer al servidor que la petición viene de un bot, no de un humano.
- 12ft.io perdió fuerza cuando los medios bloquearon su tráfico por IP y encabezados.
- Combinar proxy, caché y spoofing es más confiable que depender de una sola herramienta como WallHop.
¿Qué es una herramienta de paywall bypass?
Una herramienta de paywall bypass es un servicio web que permite saltar un paywall de un artículo noticioso reconstruyendo su versión pública, mediante proxies, cachés de buscadores o cabeceras HTTP falsificadas, sin crear cuenta, sin pagar al medio original y sin revelar la dirección IP real del lector.
WallHop, igual que su predecesor 12ft.io, no inventa contenido ni rompe ningún cifrado: le pide al servidor del medio la misma página que vería un buscador, que casi siempre atraviesa el muro de pago porque el medio necesita que Google lea el artículo completo para indexarlo. La herramienta solo automatiza ese pedido y te entrega el resultado.
Esa es la razón por la que ninguna de estas herramientas necesita vulnerar nada: el servidor del medio ya decide, caso por caso, mostrar el contenido completo a ciertos visitantes. El truco entero consiste en calificar como uno de esos visitantes.
Por qué importa apostar a la técnica y no a la herramienta
El caso de 12ft.io es la advertencia. Durante años fue la forma más simple de saltar un paywall: pegabas el link y el sitio mostraba una ventana superpuesta con el artículo sin pagar. Empezó como un truco universal y terminó siendo una lista cada vez más larga de excepciones, porque cada medio que detectaba su tráfico (por el User-Agent, por el Referer o directamente por la IP de sus servidores) lo bloqueaba de forma puntual. Hoy 12ft.io ya no funciona de manera confiable con buena parte de los sitios grandes.
WallHop resuelve el mismo problema con otra implementación: un dominio nuevo, endpoints /raw y /api pensados para integrarse en scripts, y un bookmarklet que evita escribir la URL completa a mano. Pero la lógica de fondo (proxear la petición, fingir ser otro cliente) es la misma que usaba 12ft.io. Si WallHop crece lo suficiente para que los medios noten su tráfico, el desenlace puede repetirse: bloqueos sitio por sitio hasta que la tasa de éxito caiga.
⚠️ Ojo: la propia página de WallHop lo advierte: «Paywalls pay for journalism. If there’s a paper or news site you read every day, please subscribe to it.» La herramienta está pensada para el artículo suelto que alguien te mandó por chat, no para reemplazar una suscripción que sostiene una redacción.
Breve historia de saltar un paywall
El truco no nació con WallHop ni con 12ft.io. Google tuvo durante años un operador cache: en su buscador que mostraba su propia copia indexada de cualquier página, incluidas muchas con paywall, hasta que lo retiró de los resultados en 2024. Mientras existió, era la forma más simple de esquivar un muro de pago sin tocar siquiera el sitio original.
Después llegó una generación de sitios que directamente reformateaban el artículo quitándole el paywall con una capa de lectura superpuesta, el mismo concepto que hizo popular a 12ft.io desde 2019. Funcionaban bien hasta que los medios empezaron a filtrar ese tráfico específico, primero con reglas manuales por dominio y después con servicios de protección anti-bot de terceros.
En paralelo, archive.today (también conocido como archive.ph) tomó otro camino: en vez de proxear en tiempo real, guarda copias permanentes de páginas que cualquiera puede pedir que se archiven una sola vez. Esa copia queda pública para siempre, sin depender de que el servicio siga esquivando bloqueos activamente.
WallHop es la última vuelta de ese ciclo: mismo patrón de proxy que 12ft.io, con un dominio sin historial de bloqueos todavía. La pregunta que vale la pena hacerse no es si WallHop va a durar, sino qué técnica concreta usa, porque esa es la que vas a necesitar cuando WallHop, tarde o temprano, enfrente el mismo desgaste.
Cómo saltar un paywall: proxies, cachés y user-agents falsos
Detrás de cualquier bypass de paywall hay, en general, tres familias de técnicas. Ninguna explota una vulnerabilidad: todas aprovechan que el servidor del medio decide qué mostrar según quién parece estar preguntando.
Proxies: pedir la página por otro
Un proxy es un intermediario que hace la petición HTTP en lugar del navegador del lector. WallHop funciona así cuando usás el prefijo / delante de cualquier URL: el servidor de WallHop es el que efectivamente contacta al medio, no tu navegador. Para el medio, la visita parece venir de la infraestructura de WallHop, con su propia IP y sus propias cabeceras, no de la IP residencial del lector.
Esto importa porque muchos paywalls «suaves» (los que cuentan artículos gratis por mes con una cookie) solo bloquean por IP o por historial de navegador. Un proxy que nunca visitó el sitio antes arranca con ese contador en cero cada vez, aunque el lector real ya haya agotado su cuota.
Cachés: leer la copia que ya existe
Una caché no le pide nada al medio en el momento: sirve una copia que alguien más (un buscador, un archivador, otro lector) ya guardó antes. archive.today es el ejemplo más conocido: cualquiera puede archivar una URL una sola vez y, a partir de ahí, esa copia queda pública para siempre, incluso si el medio bloquea después todo acceso directo o retira el artículo original.
La ventaja de una caché frente a un proxy es la permanencia: no importa si WallHop sigue en línea el año que viene, la copia archivada no depende de ningún servicio activo. La desventaja es que alguien tiene que haberla creado antes; si nadie archivó esa URL, no hay nada que leer.
User-agent spoofing: fingir ser otro cliente
Cada petición HTTP lleva una cabecera User-Agent que dice, en teoría, qué navegador o programa está preguntando. Muchos paywalls consultan esa cabecera (y a veces el Referer) para decidir si el visitante es un bot de indexación, al que hay que mostrarle todo, o una persona, a la que hay que cobrarle. Cambiar esa cabecera para parecer Googlebot en lugar de un navegador normal es lo que se conoce como user-agent spoofing.
import requests
headers = {
"User-Agent": "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)"
}
resp = requests.get("https://www.unperiodico.com/articulo-con-paywall", headers=headers)
print(resp.status_code, len(resp.text))
Este script pide la página haciéndose pasar por el bot de indexación de Google (reemplazá la URL por la del artículo real que quieras probar). Si el medio sigue la práctica habitual de mostrarle todo a Googlebot para no perder posicionamiento, la respuesta trae el HTML completo del artículo; si el medio ya filtra también por IP, la petición devuelve el mismo bloqueo que vería cualquier lector sin suscripción.
flowchart TD
A["El lector pega el link del artículo"] --> B["La herramienta elige el método"]
B --> C["Proxy: pide la página en nombre del lector"]
B --> D["Caché: sirve una copia ya indexada"]
B --> E["User-Agent falso: se hace pasar por un bot"]
C --> F["El medio entrega el HTML completo"]
D --> F
E --> F
F --> G["El lector lee el artículo sin paywall"]
Ejemplos prácticos con WallHop
WallHop expone la misma lógica de proxy de tres formas distintas, pensadas para necesidades distintas.
La más simple es el prefijo: anteponer una barra / a cualquier URL completa. Pegar https://wallhop.io/https://www.unperiodico.com/articulo-con-paywall en la barra de direcciones hace que WallHop pida esa página y te devuelva el resultado dentro de su propia interfaz, con sus botones y su cabecera encima.
Los dos endpoints pensados para integrarse en otro programa son /raw y /api. El primero devuelve directamente el HTML del artículo, sin la interfaz de WallHop encima:
curl "https://wallhop.io/raw/https://www.unperiodico.com/articulo-con-paywall"
El resultado esperado es el documento HTML completo del artículo (las etiquetas <article>, el texto del cuerpo, las imágenes), igual que si hubieras abierto la página con una suscripción activa. El segundo endpoint, /api, apunta al mismo patrón pero pensado para devolver el contenido ya extraído en lugar del HTML crudo, útil si vas a mostrar el texto en otra aplicación en vez de en un navegador.
También existe un bookmarklet y un atajo de iPhone que hacen lo mismo con un clic: toman la URL que estás mirando y la reenvían a WallHop con el prefijo correspondiente. Un bookmarklet equivalente, con el mismo patrón, es tan simple como esto:
javascript:location.href='https://wallhop.io//'+location.href;
Al hacer clic en ese marcador estando en la página bloqueada, el navegador reemplaza la URL actual por la versión de WallHop de esa misma dirección. Es el mismo truco del prefijo, solo que automatizado para no tener que copiar y pegar nada.
💡 Tip: si necesitás revisar varias URLs seguidas, el endpoint
/rawes más cómodo que la interfaz web porque podés meterlo directo en uncurlo en el script de Python de la sección anterior, encadenando una petición por cada link.
Cómo empezar a usar un bypass de paywall
No hace falta instalar nada para saltar un paywall: todo corre en el navegador o en una sola línea de terminal.
- Copiá la URL completa del artículo bloqueado, con
https://incluido. - Pegala después de
https://wallhop.io/en la barra de direcciones (una sola barra separa la URL que sigue). - Si preferís la terminal, corré
curl "https://wallhop.io/https://www.unperiodico.com/articulo-con-paywall", cambiando esa última URL por la del artículo real que querés leer. - Si el artículo sigue bloqueado, probá buscar esa misma URL en archive.today: es posible que alguien ya la haya archivado antes.
Casos de uso reales
El caso que describe la propia WallHop en su página es específico: alguien te manda por chat el link de una nota de un diario al que nunca te vas a suscribir, y querés saltar un paywall para leerla una sola vez. Ahí un proxy puntual tiene sentido, mientras que armar una cuenta de prueba o pagar un mes completo por un artículo no lo tiene.
Otro caso típico es el de un investigador o periodista que necesita revisar decenas de artículos de distintos medios para un informe puntual, sin presupuesto para suscribirse a cada uno. Ahí el endpoint /api o un script con user-agent spoofing resuelven el volumen mejor que abrir pestaña por pestaña.
El tercer caso es el de archivar: cuando una fuente importante para una investigación puede desaparecer o moverse, pasar la URL por archive.today antes de que eso ocurra conserva la evidencia aunque el medio original la borre o la mueva detrás de un paywall más estricto después.
El cuarto caso es el verificador de hechos o el abogado que necesita confirmar la redacción exacta de una nota citada en otro medio, sin que eso implique consumir habitualmente a ese medio ni justifique pagar una suscripción completa por una sola consulta puntual.
Errores comunes y buenas prácticas
- Asumir que una herramienta de bypass de paywall funciona para siempre. Los medios ajustan sus reglas de bloqueo con frecuencia; lo que hoy entra sin problema puede estar bloqueado la próxima semana.
- Depender de una sola vía. Si WallHop falla con un sitio puntual, probar archive.today o un script propio con otra cabecera suele resolver el mismo caso.
- Usarlo para el medio que leés todos los días. Una herramienta anti-paywall sirve para el artículo suelto, no para reemplazar una suscripción que pagás porque leés ese medio seguido: eso directamente deja sin ingresos a la redacción que escribió la nota.
- Ignorar que algunos paywalls son «duros». Un paywall que nunca entrega el HTML completo al servidor, porque el contenido se carga después de validar la sesión del lector, no se salta con ningún proxy ni con ninguna caché: ahí no hay nada que extraer.
- Confundir bloqueo con error. Un código HTTP 403 o 451 al usar un proxy casi siempre significa que el medio detectó la IP o el User-Agent del proxy, no que el artículo no exista.
Comparativa con alternativas
Ninguna de estas opciones es superior en todos los casos; cada una falla de una forma distinta, así que conviene elegir según el caso puntual.
| Opción | Cuándo usarla | Ventaja | Limitación |
|---|---|---|---|
| WallHop (proxy con prefijo de URL) | Artículo puntual que no vas a volver a leer | No requiere instalar nada | Depende de que el medio no bloquee su IP o User-Agent |
| archive.today | Cuando alguien ya archivó esa URL antes | Copia permanente, no depende de que WallHop siga en línea | Si nadie la archivó antes, no existe la copia |
| Script propio con User-Agent falso | Automatizar muchas URLs de una vez | Control total sobre cabeceras y reintentos | Hay que mantenerlo porque cada medio cambia su detección |
| Modo lector del navegador | Paywalls blandos que solo ocultan con CSS o JavaScript | No sale del navegador, no hay petición extra | No sirve si el servidor nunca entrega el HTML completo |
Profundizando: la carrera entre detección y evasión
Del lado del medio, bloquear un proxy como WallHop no es tan simple como banear una IP. Los proxies modernos rotan direcciones, así que muchos paywalls combinan varias señales a la vez: la cabecera User-Agent, la cabecera Referer (de dónde vino el clic), la ausencia de cookies previas típicas de un navegador real y, en algunos casos, huellas de la conexión TLS que delatan si la petición viene de una librería como requests de Python en lugar de un navegador real.
Esto explica por qué el script de user-agent spoofing de la sección anterior no funciona siempre: cambiar una sola cabecera engaña a un paywall simple, pero no a uno que cruza varias señales a la vez. Ahí es donde un proxy como WallHop tiene ventaja sobre un script casero, porque opera a mayor escala y puede ajustar toda su infraestructura (rotar IPs, variar cabeceras completas) más rápido que un desarrollador individual manteniendo un script propio.
También existen servicios de protección anti-bot de terceros que los medios grandes contratan específicamente para filtrar este tipo de tráfico, evaluando patrones de comportamiento además de cabeceras sueltas: cuántas páginas pide el mismo cliente por minuto, en qué orden, con qué pausas entre una petición y la siguiente. Un proxy que sirve a miles de usuarios distintos genera patrones de tráfico muy distintos a los de un lector humano, y esa diferencia es justamente lo que estos servicios buscan detectar.
Del otro lado, las herramientas de bypass de paywall tienden a apoyarse en una asimetría estructural: a los medios les conviene que Google indexe el artículo completo, porque de ahí viene gran parte de su tráfico de búsqueda. Mientras esa necesidad de indexación exista, va a seguir existiendo una versión completa de cada artículo servida a algún tipo de cliente automatizado, y esa es, en el fondo, la grieta que explota cualquier intento de rodear un paywall. Cerrarla del todo implicaría que el medio deje de aparecer en buscadores, algo que casi ningún editor está dispuesto a aceptar.
sequenceDiagram
participant L as Lector
participant W as WallHop
participant M as Medio de noticias
L->>W: pega la URL del artículo
W->>M: solicita la página con otra cabecera
M-->>W: responde con el HTML completo
W-->>L: muestra el artículo sin el paywall
Note over L,W: la sesión del lector nunca toca el medio original
📖 Resumen en Telegram: Ver resumen
Tu próximo paso: probá el endpoint /raw de WallHop con un artículo real que tengas bloqueado ahora mismo y compará el resultado con pegar esa misma URL en archive.today.
Preguntas frecuentes
¿WallHop es legal?
Depende de la jurisdicción y de los términos de uso del medio, que suelen prohibir explícitamente eludir el paywall. WallHop no publica contenido ajeno: reenvía una petición HTTP, algo técnicamente similar a lo que hace cualquier buscador. Eso no elimina el conflicto con los términos de servicio del medio, que sí pueden considerarlo una infracción contractual aunque no sea un delito.
¿Por qué un evasor de paywall como WallHop podría terminar bloqueado igual que 12ft.io?
Porque la defensa más simple para un medio es la misma en los dos casos: identificar el tráfico del proxy (por IP, por User-Agent o por patrones de petición) y negarle la respuesta completa. Cuantos más lectores usen la misma herramienta, más fácil es para el medio reconocer su huella y bloquearla.
¿Qué diferencia a un proxy de una caché en un bypass de paywall?
El proxy le pide la página al medio en el momento, cada vez que alguien lo usa; la caché sirve una copia que ya quedó guardada antes, sin volver a tocar al medio. Por eso una caché como archive.today sigue funcionando incluso si el medio bloquea después todos los proxies conocidos.
¿El user-agent spoofing funciona con cualquier medio?
No. Funciona con los paywalls que solo verifican esa cabecera para decidir si el visitante es un bot de indexación. Los medios que combinan el User-Agent con la IP, el historial de cookies o huellas de conexión más avanzadas no se saltan cambiando una sola cabecera.
¿Existe una alternativa legal a un bypass de paywall?
Sí: la mayoría de los medios ofrece planes de suscripción digital, y muchas bibliotecas públicas dan acceso gratuito a bases de datos de prensa con el carné de socio. Para el uso ocasional, esas vías evitan por completo la zona gris legal de un evasor de paywall.
Referencias
- WallHop: página oficial del servicio, con los endpoints /raw, /api y el bookmarklet descritos en este artículo.
- archive.today: servicio de archivado público que guarda copias permanentes de páginas, muchas con paywall.
- Wikipedia: Paywall: definición y contexto histórico del modelo de suscripción en medios digitales.
- MDN: User-Agent header: documentación oficial de la cabecera HTTP que identifica al cliente ante el servidor.
📱 ¿Te gusta este contenido? Únete a nuestro canal de Telegram @programacion donde publicamos a diario lo más relevante de tecnología, IA y desarrollo. Resúmenes rápidos, contenido fresco todos los días.
Imagen destacada: Foto de Gene Gallin en Unsplash
¿Te sirvió? ¿Te dio otro error? Contalo abajo: las preguntas se responden y le sirven al siguiente que llegue.
Dejar un comentario
0 Comentarios