¿Es legal hacer scraping en LinkedIn? Lo que realmente decidió el caso hiQ

El titular de hiQ contra LinkedIn decía que hacer scraping de perfiles públicos es legal. La nota al pie es que hiQ aún así perdió. Aquí está lo que realmente resolvió el fallo, dónde está la línea y cómo recopilar datos públicos de manera correcta.

Preguntar si hacer scraping en LinkedIn es legal te dará un sí confiado de la mitad de internet y un no confiado de la otra mitad. Ambos tienen mitad de razón. El caso al que todos apuntan - hiQ Labs contra LinkedIn - dictaminó que hacer scraping de perfiles públicos no es una violación de delitos informáticos. También terminó con hiQ perdiendo. Entender por qué es la diferencia entre recopilar datos de LinkedIn de manera segura y construir un negocio basado en un titular mal interpretado. Este es un resumen informativo, no un consejo legal - verifica tus propios hechos con un abogado.

Lo que realmente decidió hiQ contra LinkedIn

hiQ construyó productos con datos extraídos de perfiles públicos de LinkedIn. En 2017, LinkedIn envió un cese y desista citando la Ley de Fraude y Abuso Informático (la CFAA, 18 U.S.C. § 1030, una ley anti-hackeo de 1986). hiQ demandó. El Noveno Circuito otorgó una orden judicial en 2019, la Corte Suprema devolvió el caso en junio de 2021 para reconsiderarlo a la luz de Van Buren contra Estados Unidos - que acababa de restringir lo que significa "exceder el acceso autorizado" - y en abril de 2022 el Noveno Circuito reafirmó su posición: extraer datos que están disponibles públicamente, sin necesidad de inicio de sesión, no es "acceso no autorizado" bajo la CFAA. Ese es el buen titular, y es real.

La parte que se omite: hiQ aún así perdió

Más tarde en 2022, al ser devuelto, el tribunal encontró que hiQ había incumplido el Acuerdo de Usuario de LinkedIn - el contrato que aceptas al usar la plataforma - y el asunto se resolvió en un acuerdo. Así que la CFAA (ley de acceso informático de estilo criminal) no detuvo el scraping, pero la ley de contratos sí lo hizo. Esta es la división que importa: ganar en la CFAA no es lo mismo que ganar en general. Los Términos de Servicio son una capa separada y ejecutable. Un caso relacionado vio a una empresa llegar a un acuerdo con LinkedIn después de usar detalles de pago falsos para pasar el muro de pago - un recordatorio de que cómo accedes a los datos es tan legalmente cargado como qué recopilas.

Diagrama de la línea de tiempo del caso hiQ Labs contra LinkedIn desde el cese y desista de 2017 hasta el fallo del contrato de 2022
hiQ ganó en la CFAA y perdió en el contrato - las dos mitades del fallo apuntan en direcciones opuestas.

Público vs detrás del muro es todo el juego

La línea divisoria que trazaron los tribunales es el acceso. Los datos que puedes ver sin iniciar sesión, sin cuenta, se encuentran en la zona de menor riesgo que abordó el Noveno Circuito. En el momento en que inicias sesión, has aceptado el Acuerdo de Usuario y su cláusula de no-scraping - y ahora estás en territorio de contrato, donde LinkedIn ha ganado. LinkedIn también lo hace cumplir técnicamente: la navegación sin iniciar sesión encuentra un muro de inicio de sesión o un desafío rápidamente, y la automatización abusiva recibe una respuesta de bloqueo HTTP 999 que no es un código de estado estándar en absoluto - es la señal propia de LinkedIn de que piensa que eres un bot. Si tu plan depende de iniciar sesión y martillar, tanto la ley como la plataforma están en tu contra.

Cómo recopilar datos públicos de LinkedIn de manera correcta

Para la investigación B2B legítima - firmografía, páginas de empresas, información de roles públicos - el patrón más seguro es estrecho y aburrido a propósito:

El acceso limpio y geográficamente coherente también ayuda aquí. Las páginas públicas se localizan, y una solicitud que proviene de una IP residencial plausible en el país correcto se lee como un visitante ordinario en lugar de un bot de centro de datos - lo que te mantiene viendo las mismas páginas públicas que vería un usuario normal, sin que el muro de inicio de sesión se active temprano. Nuestra guía para scraping de generación de leads B2B cubre la construcción de esa canalización de manera responsable.

La disciplina en las tasas importa tanto como la calidad de la IP. El crawling agresivo no es solo un riesgo técnico - socava cualquier argumento de que estás actuando como un visitante razonable, que es exactamente el marco en el que depende una posición de interés legítimo o uso justo. Espacia las solicitudes desde IPs residenciales limpias, almacena en caché lo que ya has visto, y nunca intentes acelerar más allá del muro de inicio de sesión con automatización diseñada para parecer muchos usuarios separados. Lento, transparente y solo público no es solo la postura de cumplimiento; también es la que sigue funcionando, porque no da a los sistemas anti-abuso de la plataforma una razón para escalar contra ti en primer lugar.

Obtén IPs residenciales limpias para la recopilación de datos públicos

La capa de privacidad se sitúa sobre la cuestión del acceso

Incluso cuando el acceso está bien, los datos en sí pueden llevar obligaciones. Los nombres, roles y fotos son datos personales, y en la UE el GDPR se aplica independientemente de si el perfil era público o no - por lo que necesitas una base legal, minimización de datos y una forma de honrar las solicitudes de eliminación. Las leyes de privacidad estatales de EE. UU. se están moviendo en la misma dirección. "Disponible públicamente" responde a la cuestión del acceso; no apaga la ley de privacidad. Nuestros resúmenes de GDPR y datos personales extraídos y legalidad del scraping web en 2026 profundizan en ambas capas.

Lista de verificación comparando la recopilación de datos públicos de LinkedIn de menor riesgo frente al scraping de mayor riesgo detrás del inicio de sesión
Permanece sin iniciar sesión, permanece agregado, respeta los Términos - ese es el borde práctico de la zona segura.

Preguntas frecuentes

¿Es legal hacer scraping en LinkedIn?

El scraping de datos públicos y sin iniciar sesión de LinkedIn se consideró en hiQ contra LinkedIn que no viola la CFAA. Pero hiQ aún así perdió por incumplimiento del Acuerdo de Usuario de LinkedIn, por lo que hacer scraping mientras se está conectado - lo que acepta esos Términos - conlleva un riesgo real de contrato. Los datos públicos son la zona de menor riesgo; los datos detrás del inicio de sesión no lo son. Esta es información general, no un consejo legal.

¿Qué cambió realmente el fallo de hiQ?

Estableció que acceder a datos web disponibles públicamente no es "acceso no autorizado" bajo la CFAA - un estrechamiento significativo de ese estatuto anti-hackeo. No hizo que todo el scraping de LinkedIn fuera legal: los Términos de Servicio, el copyright y la ley de privacidad son capas separadas, y finalmente se encontró que hiQ había incumplido el contrato de LinkedIn.

¿Puedo hacer scraping en LinkedIn sin iniciar sesión?

Las páginas públicas sin iniciar sesión son el camino más seguro, pero LinkedIn muestra un muro de inicio de sesión y desafíos rápidamente, y bloquea la automatización agresiva con una respuesta HTTP 999 no estándar. Recopilar solo lo que un visitante desconectado puede ver, a tasas educadas desde IPs residenciales limpias, te mantiene en la zona que los tribunales abordaron. No uses cuentas falsas para llegar más lejos.

¿El GDPR se aplica a los perfiles públicos de LinkedIn?

Sí. Bajo el GDPR, los datos personales siguen siendo datos personales incluso cuando son visibles públicamente, por lo que recopilar nombres, roles o fotos de residentes de la UE necesita una base legal, minimización y una ruta para honrar la eliminación. "Público" resuelve la cuestión del acceso, no la de privacidad - trata los datos de perfil como regulados desde el principio.

El resumen honesto: hiQ hizo que el scraping de datos públicos fuera defendible contra reclamos de delitos informáticos, pero las capas de contrato y privacidad aún están vigentes, y hiQ en sí mismo perdió en el contrato. Permanece sin iniciar sesión, permanece agregado, respeta los Términos y los robots, y trata los datos personales como regulados - y estarás recopilando en el lado correcto de la línea que realmente trazaron los tribunales.

Comienza con proxies residenciales geográficamente precisos y cumplidores