- Hace unos meses, se anunció una recompensa de $10,000 para quien lograra visualizar mejor el espacio ISBN de los datos de Anna’s Archive
- Esta visualización muestra los archivos ya preservados y los que aún no lo están, e incluye un conjunto de datos que indica cuántas bibliotecas tienen libros con ISBN
- Mucha gente participó y presentó ideas creativas. La pasión y la energía puestas en este proyecto fueron impresionantes
- El objetivo es identificar cuántos de los libros que existen en el mundo ya han sido preservados y cuáles deberían ser la prioridad a futuro
Visualización básica
- Expresa de forma concisa la mayor “lista de libros” de la historia humana en una imagen de menos de 300kb.
- Incluye diversas fuentes de datos: All ISBNs, Anna’s Archive, Google Books, Internet Archive, etc.
Desafío y ganadores
- Se decidió ofrecer un primer premio de $6,000, un segundo premio de $3,000 y un tercer premio de $1,000. Debido a la gran participación, se decidió otorgar el tercer premio a cuatro personas, con $500 para cada una.
- 1er lugar $6,000: phiresky - Destaca por sus opciones de visualización flexibles y una implementación rápida y fluida.
- 2do lugar $3,000: hypha - Su visualización a nivel macro es impresionante y ofrece una UI fácil de usar.
- 3er lugar $500 #1: maxlion - Impresionan sus distintas vistas, especialmente las de comparación y editoriales.
- 3er lugar $500 #2: abetusk - Sobresale por su excelente función de comparación.
- 3er lugar $500 #3: conundrumer0 - Impresiona como herramienta de visualización muy flexible.
- 3er lugar $500 #4: charelf - Ofrece funciones simples pero efectivas.
Ideas destacadas
- BWV_1011: rascacielos para la rareza
- robingchan: estadísticas en tiempo real
- reguster: anotaciones y estadísticas en tiempo real
- orangereporter: vista de mapa y filtros únicos
- joe.davis: excelente esquema de colores base y mapa de calor
- timharding: cambio fácil para comparar datasets rápidamente
- j1618: etiquetas bonitas
- immartian: barra de escala que muestra la cantidad de libros
- backrndsource: muchos sliders para comparar datasets como si fueras DJ
Conclusión
- Se planea integrar la obra ganadora del primer lugar en el sitio web principal, y también se están considerando otras propuestas.
- Se está pensando cómo organizar el proceso de identificar, verificar y preservar libros raros.
- Gracias a todas las personas que participaron, y también a quienes mostraron interés en este proyecto.
1 comentarios
Opiniones en Hacker News
La obra ganadora fue una visualización que también se había comentado recientemente en HN.
Es impresionante tanto por sus decisiones técnicas como por el diseño gráfico, y visualiza con elegancia 2 mil millones de libros como si fueran estanterías.
Discusión relacionada en HN: https://news.ycombinator.com/item?id=42897120
Me sorprendió un poco que mi trabajo quedara en tercer lugar. Supongo que valoraron su simplicidad y la visualización.
Todavía se puede ver en https://isbnviz.pages.dev
Para ser honesto, creo que estos dos trabajos son mejores: https://bwv-1011.github.io/isbn-viewer/, https://anna.candyland.page/map-sample.html
En particular, el trabajo de bwv es técnicamente similar, pero en general es mucho mejor que el mío y se acerca más a lo que yo quería construir.
Pero, comparando tu trabajo con el de bwv, no estoy de acuerdo en que bwv sea técnicamente superior en todos los aspectos.
Le faltan funciones de comparación, selección de ISBN y generación de enlaces; bwv parece haberse enfocado en una función para resaltar libros raros, dejando de lado otros requisitos que Anna’s Archive quería.
Desde fuera, parecía que ese era el objetivo principal de este intento.
Realmente genial. Aunque encontré algo raro.
Busqué “Stubborn Attachments” y apareció bien, y en la misma estantería había varios libros de Stripe Press.
Entre ellos hay un libro de Stephanie Friedman llamado “Zero to One Hundred”, pero al buscarlo en Amazon aparece con otro título. Como aún no se publica, es posible que el título no esté definido, así que eso se entiende: https://a.co/d/bQX5CNf
Lo raro es que si busco “Zero to One Hundred”, el título que se ve en la estantería, no aparece; pero si busco por ISBN sí aparece, y el nombre en los resultados se muestra con otro título.
Así que la misma posición en la estantería se ve distinta según qué se haya buscado. Todavía no leí el artículo del blog sobre cómo funciona esta visualización, así que no sé cuál es la causa.
Si buscas el ISBN en la web, aparece “Zero to One Hundred” con la portada de “Built to Grow”, y también pasa al revés.
Además, con el mismo ISBN asociado a los dos títulos anteriores, también aparece “Experiment, Build, Scale”, que es como se muestra en la visualización.
Parece que, de los libros de Stephanie, el único que está en Google Books es “Experiment, Build, Scale”, mientras que en Worldcat aparece “Zero to One Hundred” con la portada de “Built to Grow”.
La mayoría de las librerías en línea están mezcladas de esta forma, así que parece más bien un problema de calidad de datos upstream, y es difícil culpar a la herramienta.
Interesante. Si haces zoom en https://archive.anarchy.cool/maps/isbn.html se ven varias cosas. Lamentablemente, no parece haber enlaces directos por coordenadas o nivel de zoom.
Al este de la sección en alemán se puede encontrar a editoriales como Hueber Verlag, con un patrón que parece haber dispersado números ISBN a intervalos de aproximadamente 1,360,000.
Sé que los ISBN tienen checksum y que eso crea huecos entre números, pero aun así se generan patrones repetitivos con mucho espacio vacío, lo que parece desperdiciar bastante los grandes rangos que tiene la editorial.
¿No hay reglas sobre cómo deben asignar los números las editoriales? Sería bueno que pudieran devolver bloques sin usar que ya no necesitan.
También se me ocurre que, si publicas materiales de aprendizaje en 30 idiomas, pueden surgir varias “ideas” para la asignación de ISBN: https://de.wikipedia.org/wiki/Hueber_Verlag
En las visualizaciones de grandes datasets en las que se espera que el usuario “explore” por su cuenta, siento que por lo general son bonitas, pero no aportan una revelación especial.
En vez de transmitir un mensaje o una narrativa concreta, simplemente invitan a pasear; estas visualizaciones me parecen especialmente de ese tipo.
Si no estás modelando un volumen tridimensional real, como en imágenes médicas o CAD, la “exploración forzada” que agrega el 3D solo oculta los insights.
Esa es toda la información que transmite, y no hay una estructura jerárquica que ayude al descubrimiento u organice el contenido.
Además, el mismo texto puede aparecer varias veces con distintas encuadernaciones, una diferencia que desde la perspectiva de los ebooks tampoco tiene mucho sentido.
El problema mayor es que “Anna’s Archive” no es un repositorio legal de libros, sino un sitio pirata, y lo que muestran es una exhibición descarada de la completitud del robo y de la ausencia de compensación resultante.
Habría sido mucho más interesante si fuera una interfaz basada en un sistema jerárquico como LoC, para acceder a libros legales realmente disponibles en https://www.gutenberg.org/, a libros subidos en http://onlinebooks.library.upenn.edu/ o a libros en desarrollo en https://www.wikibooks.org/.
Apenas vi la imagen de arriba, me dieron ganas reflejas de abrir un programa de desfragmentación de disco
Participar fue muy divertido, y felicidades a todos los involucrados
Para quien tenga curiosidad, mi propuesta todavía está viva: https://d199hl4t3ts6d9.cloudfront.net/
Todo mi cariño sincero para todas las bibliotecas sombra. De verdad hacen la obra de Dios
Me dio tristeza ver el “estante” de mi país y encontrar tantos títulos faltantes
Al punto de que me dieron ganas de ir a bibliotecas locales y digitalizar yo mismo libros viejos, descatalogados y que hoy ya no se consiguen
Se está perdiendo demasiado conocimiento
Me pregunto por qué no se ve una zona hispanohablante clara en esta visualización de ISBN
El inglés ocupa 2 cuadros, y Francia, Alemania, Japón, la Unión Soviética, China, etc. tienen secciones grandes, pero España no tiene una sección grande
¿De verdad hay tan pocos libros en español? ¿O la distribución está sesgada principalmente hacia el mundo angloparlante?
Como alguien que creció en bibliotecas y librerías en español, rodeado de libros en español, se siente un poco raro que nuestra parte se vea tan pequeña en este mapa del mundo
Los ISBN y títulos se extraen del conjunto de datos de https://annas-archive.li/datasets, que incluye principalmente revistas y libros en chino, inglés y francés
Por ejemplo, Alemania publica 5 veces más libros que Países Bajos, y España publica 2 veces más que Países Bajos: https://internationalpublishers.org/wp-content/uploads/2023/11/IPA-Nielsen-BookData-IPA-Full-Report-23022024.pdf
Pero en la visualización, Alemania se ve similar a Países Bajos, y España y México no encajan bien con las etiquetas superiores: https://software.annas-archive.li/AnnaArchivist/annas-archive/-/issues/244#note_2913
Hay un bloque grande que parece decir Argentina o Peru, y los títulos están en los bordes de ese gran bloque
No tiene el nombre en el centro como otros bloques principales, sino que está vacío; si todo eso fuera Argentina me sorprendería un poco, pero si ese bloque fuera la zona hispanohablante, tendría bastante sentido
La propuesta ganadora se parece un poco al administrador de archivos Eagle mode, donde haces zoom para ver los archivos dentro de un directorio y sigues haciendo zoom para entrar a subdirectorios
https://eaglemode.sourceforge.net/emvideo.html