1 puntos por GN⁺ 3 시간 전 | 1 comentarios | Compartir por WhatsApp
  • El tribunal desestimó la demanda que calificaba la recolección de resultados de búsqueda de Google por parte de SerpAPI como una violación de la prohibición de evasión de la Sección 1201 de la DMCA, aunque dejó abierta la posibilidad de volver a presentarla con un alcance más acotado
  • SearchGuard, que bloquea solicitudes automáticas, se aplica a todos los resultados de búsqueda sin importar si están protegidos por copyright, por lo que no se considera una medida tecnológica de protección que controle el acceso a obras protegidas
  • Puede aparecer un Knowledge Panel con imágenes licenciadas de terceros incluidas en los resultados de búsqueda, pero no todos los resultados ni todos los paneles contienen contenido protegido por copyright
  • Bajo la DMCA, una medida tecnológica debe controlar el acceso a una obra con autorización del titular del copyright, pero Google tampoco logró demostrar suficientemente que SearchGuard fue implementado y operó con esa autorización del titular del copyright
  • Google puede acotar la demanda a contenido sobre el que sí tenga derechos, y SerpAPI también podría excluirlo de su recolección, lo que frena la estrategia de intentar controlar toda la información pública de búsqueda mediante la DMCA

La disputa entre Google y SerpAPI

  • En diciembre de 2025, Google presentó una demanda bajo la Sección 1201 de la DMCA contra SerpAPI por recolectar resultados de búsqueda de Google
  • El tribunal desestimó la demanda, aunque dejó margen para que Google modifique sus alegatos y la presente otra vez
  • SerpAPI recopila páginas de resultados de buscadores y ofrece en la práctica una API no oficial de resultados de búsqueda, facilitando a desarrolladores, empresas de IA, investigadores y compañías el acceso a información pública de búsqueda
  • A medida que el valor de los datos aumenta en la era de la IA, crecen los intentos de levantar barreras de acceso a partes de la web pública, y en ese proceso también pueden terminar bloqueados usuarios comunes

Relación con la demanda de Reddit

  • Reddit presentó en otoño de 2025 una demanda separada contra SerpAPI y Perplexity, entre otros
    • Alegó que SerpAPI proporcionó contenido de Reddit a otros operadores a través de resultados de búsqueda de Google, violando la cláusula de prohibición de evasión de la DMCA
    • El copyright de las publicaciones de Reddit pertenece a los usuarios, y lo que SerpAPI recolectó directamente no fue Reddit sino Google
    • Existe un contrato de API entre Reddit y Google, pero los demandados no son parte de ese contrato
  • En el caso de Reddit siguen en curso las solicitudes de desestimación de los demandados, mientras que en el caso de Google el tribunal desestimó primero la demanda

Alcance de aplicación de la Sección 1201 de la DMCA

  • La Sección 1201 de la DMCA fue creada originalmente para imponer responsabilidad por el mero acto de evadir medidas tecnológicas de protección como el DRM
    • Está redactada de forma amplia para que romper el DRM o difundir métodos para evadirlo también pueda derivar en responsabilidad por infracción de copyright
    • Estas medidas tecnológicas también se han usado en casos sin relación directa con el copyright, como restringir el uso de tinta de impresoras de terceros o controles de apertura de garajes
  • El tribunal también revisó el precedente relacionado con las impresoras Lexmark, pero concluyó que no aplica en este caso
    • El precedente relacionado que perjudicó a Lexmark surgió de la legislación marcaria, no de la DMCA, y su reclamo bajo la Sección 1201 tampoco tuvo éxito

Cómo funciona SearchGuard

  • SearchGuard envía un desafío de JavaScript cuando Google recibe solicitudes de búsqueda desde una fuente que no reconoce, para verificar si se trata de una persona real o de software automatizado
    • El navegador envía a Google una respuesta con cierta información sobre el usuario y el entorno
    • En el navegador de una persona, JavaScript se ejecuta automáticamente y casi no interrumpe la experiencia de uso
    • Los sistemas de consultas automatizadas a gran escala por lo general no pueden resolver el desafío, por lo que se les niega el acceso a los resultados de búsqueda de Google
  • Google afirmó que la recolección automatizada solo le genera un costo muerto (deadweight loss), y que SearchGuard bloquea el acceso automatizado no autorizado
  • Sin embargo, SearchGuard no selecciona solo contenido protegido por copyright, sino que controla el acceso automatizado al conjunto completo de resultados de búsqueda, estén protegidos o no

Por qué el conjunto completo de resultados de búsqueda no es una obra protegida

  • Los resultados de búsqueda de Google muestran información pública obtenida de internet y organizada según su relevancia
  • Google no alegó que google.com ni los propios resultados de búsqueda mostrados allí estén protegidos por la legislación de copyright
  • En ocasiones los resultados incluyen un Knowledge Panel, que puede contener imágenes protegidas por copyright licenciadas de terceros
    • El Knowledge Panel no aparece en todos los resultados de búsqueda
    • Incluso cuando aparece, no siempre contiene contenido protegido por copyright
  • Por lo tanto, entre lo que controla SearchGuard se mezclan resultados con material protegido por copyright y otros sin él
  • Como la DMCA no se aplica si lo que controla la medida tecnológica no está protegido por copyright, las reclamaciones bajo §1201(a)(1)(A) y §1201(a)(2) respecto de resultados de búsqueda sin contenido protegido no se sostienen jurídicamente

Requisito de autorización del titular del copyright

  • Según §1201(a)(3)(B), para que una medida tecnológica controle efectivamente el acceso a una obra, la información, el procedimiento o el tratamiento necesarios para acceder deben aplicarse con autorización del titular del copyright
  • La jurisprudencia del Ninth Circuit también interpreta que el demandante debe alegar y probar que esa medida fue implementada y operó con autorización del titular del copyright
  • Google respondió que, más que quién desplegó SearchGuard, lo relevante era quién podía evadir la medida, pero el tribunal no aceptó ese argumento
    • Los casos Disney Enterprises v. VidAngel y Universal City Studios v. Corley citados por Google interpretan §1201(a)(3)(A), que define la “evasión de una medida tecnológica”
    • La cuestión aquí corresponde a §1201(a)(3)(B), que establece las condiciones para que una medida tecnológica controle efectivamente el acceso a una obra
  • Google sostuvo que los titulares del copyright apoyaban la protección mediante SearchGuard, pero aun así no cumplió con el requisito de demostrar que la medida fue implementada y operó con autorización real de esos titulares

Posible alcance de futuras demandas tras la desestimación

  • No todas las defensas de SerpAPI fueron aceptadas, pero por ahora se desestimó la totalidad de la demanda bajo la DMCA de Google
  • Google no puede volver a presentar la misma demanda respecto de resultados de búsqueda sobre los que no posee copyright
  • Sin embargo, sí podría presentar una demanda más limitada, acotada a contenido sobre el que Google tenga derechos, como un Knowledge Panel
  • SerpAPI podría modificar su método de recolección para excluir contenido creado por Google y así evitar una demanda más acotada
  • En su postura sobre la decisión de desestimación, SerpAPI afirmó que se rechazó el intento de usar la DMCA para controlar incluso el acceso a páginas públicas, y dijo que seguirá apoyando a desarrolladores, empresas de IA, investigadores y compañías que dependen de la información pública de búsqueda
  • Que Google, cuya base de negocio se construyó sobre la recolección de la web, use ahora la DMCA para impedir que se recolecten sus propios resultados de búsqueda equivale a retirar la escalera de acceso al internet abierto después de haber subido por ella

1 comentarios

 
GN⁺ 3 시간 전
Comentarios en Hacker News
  • Me resultaría más aceptable si Google ofreciera una API decente para los resultados de búsqueda. Pero la API anterior fue descontinuada y no hay alternativa, así que pienso seguir usando servicios de terceros que hacen scraping de los resultados de Google hasta que cambien la política

    • Tengo curiosidad por ver cómo cambiará esto ahora que la UE obligó a Google a compartir datos de búsqueda
      https://abcnews.com/Technology/wireStory/eu-forces-google-sh...
    • Deberían revivir la vieja API de búsqueda de Nelson Minar o algo parecido. Las respuestas basadas en búsqueda de la API de Gemini son convenientes, pero no son lo bastante generales
    • Dejé de usar Google cuando empezaron a exigir JavaScript para buscar, y ese día sentí que fue cuando la web abierta realmente murió
  • Esto es el comportamiento típico de una gran empresa con recursos enormes. Es muy posible que Google esperara llegar a un acuerdo, o que SerpAPI, que parece mucho más pequeña que ellos, no pudiera afrontar los costos del litigio
    Google tiene tanto dinero que probablemente ni siquiera el principio de que el perdedor paga las costas la haría desistir de demandar

  • La UE protege al fabricante de una base de datos, independientemente de la expresión creativa, si hubo una inversión sustancial cualitativa o cuantitativamente en recopilar, verificar y presentar el contenido. La ley de copyright de EE. UU. exige un mínimo de originalidad en la selección, coordinación o disposición de los datos para que haya protección
    Los resultados de búsqueda de Google son simples hechos, pero la frontera es difusa si se intenta distinguir eso de un mapa, que sí estaría protegido por copyright. Rastrear la web y clasificar resultados requiere un esfuerzo enorme, y PageRank en sí mismo también debería estar protegido por copyright, en mi opinión

    • Los mapas no son una comparación adecuada; las fotos son un mejor ejemplo. Un mapa no copia el original tal cual ni lo muestra directamente sin cambios, sino que exige decisiones claras de creatividad sobre qué incluir, qué quitar, qué exagerar y qué distorsionar. Por eso los mapas de una misma zona pueden variar tanto
      En cambio, los resultados de búsqueda son una concatenación de varios fragmentos de texto de páginas, pegados tal como aparecen en el original, así que la creatividad involucrada probablemente se parece más a la de una fotografía
    • Google empezó a cruzar claramente esa línea cuando comenzó a dar en los resultados de búsqueda la respuesta misma del contenido
    • Han pasado más de 20 años desde el artículo de PageRank, y Google dejó de usar PageRank hace unos 15 años, así que creo que ese punto ya quedó atrás
  • Una razón importante por la que debería ser posible hacer scraping de las páginas de resultados es que Google sigue mostrando anuncios fraudulentos como los de sitios intermediarios de ETA y ESTA: https://www.bbc.co.uk/news/technology-56886957

    • Vale la pena imaginar cómo cambiaría el mundo si las grandes empresas de publicidad en internet asumieran parte de la responsabilidad por las estafas y el malware que ayudaron a propagar
    • El servicio británico de registro de tierras es parecido. Aunque sé que tengo que encontrar el sitio .gov, aun así tengo que intentarlo varias veces, y la vez pasada solo me di cuenta de que había entrado a un sitio con anuncios cuando me pidió pagar por un servicio que es gratis en el sitio del gobierno
  • Es irónico que el éxito de Google se construyera rastreando e indexando la web abierta. Se entiende que quiera proteger su producto, pero si elimina una API barata y además bloquea a terceros que llenan ese vacío, termina creando por sí misma la demanda de scraping que quería frenar

  • Me confunde si esto significa que ahora cualquiera puede hacer scraping legalmente de los resultados de búsqueda de Google

    • Que algo sea legal y que Google no haga todo lo posible por impedirlo son cosas completamente distintas
  • En la entrada del blog faltó mencionar que esta demanda se presentó porque OpenAI recolectó resultados de búsqueda de Google mediante SerpApi. Alphabet también es inversionista de Anthropic, y hay expectativa por la demanda enmendada que se presentará antes del 10 de agosto
    https://searchengineland.com/inside-google-searchguard-46767...

  • En algún momento hará falta una reforma de la DMCA

    • No es nada nuevo, pero este artículo vuelve a mostrar muy bien lo terrible que es la DMCA como ley. No entiendo cómo todavía no la han corregido
    • Habría que abolir el propio sistema de copyright
  • Este fallo puede sentirse satisfactorio, pero también refuerza que el propio scraping de Google es totalmente legal. Puede que Google haya visto esta demanda como una situación de ganar por ambos lados: o hundir a un competidor al iniciar el litigio, o, incluso perdiendo, conseguir un precedente que la proteja a futuro

    • No me gusta Google, pero convertir en ilegal el scraping de datos públicos abre demasiadas posibilidades de abuso, así que este resultado es lo mejor
    • Creo que Google ya no tiene foso. A mi alrededor casi nadie usa la búsqueda de Google, los modelos para programación permiten un desarrollo mucho más profundo, y muchísimos ingenieros desempleados podrían invadir el terreno de los productos de Google con herramientas de programación que multipliquen la productividad por 10
      Hace poco alguien replicó Google G Suite y sacó un resultado excelente, y Drive y Search también se volverán productos reemplazables. Debe de haber miles de personas que querrían crear directamente un sistema operativo para teléfonos, y Chrome también parece reemplazable. Firefox subió 1 punto porcentual de cuota el mes pasado
      Aun así, el efecto de red de YouTube es difícil de romper, y Google Cloud probablemente no vaya a desaparecer