Wikipedia

Resultados de la búsqueda

jueves, 18 de diciembre de 2025

¿Lección aprendida?

Bueno, me dije a mi mismo que iba a mantener la consistencia en esto de publicar así que solo lo haré por el bien de la conservación. (Mentira, desde enero que no publico nada y esto lo tenía en el borrador así que aprovecho de escribir encima)


1)El sitio objeto es AnimexTremist, un sitio de animé y manga que funcionó desde el 14 de Junio del 2004 y dejó de funcionar el año 2016 (no tengo la fecha exacta pero por la información que se puede rescatar del sitio con las capturas que encontré en la wayback machine de internet archive, el último capítulo de One Piece que subieron a la página es el 824, que se lanzó el 25 de abril ese año, así que doy por hecho que ese fue el último año en que los dueños o administradores del sitio decidieron actualizar la página). 

captura wayback machine
Luego explico por qué no muestro una captura directa del sitio.


2)Estoy seguro de que repetiré esto muchas veces en este post pero sí, imagino que hay mil formas de hacer esto pero se me ocurrió y decidí hacerlo.
Así que decidí respaldar toda los archivos multimedia dentro del sitio (wallpapers, música, videos, apps, utilitarios). ¿Por qué? porque se me dio la gana 😎.








3)Quizás en otro post escriba la metodología y el procedimiento con más detalle, ha pasado demasiado tiempo desde que lo hice y guardé la evidencia en un disco duro, pronto lo estaré subiendo.

4)Básicamente lo que hice fue: Guardar los wallpapers/artbooks que estaban en el sitio. Estos estaban catalogados por nombre de serie(alfabético) y cada serie contenía entre 40 y 200 imágenes con arte custom/ wallpapers y toda la parafernalia que se podía encontrar del animé y en un sitio de animé de la epoca. Luego construí un script con python que accediera a los directorios del sitio para que buscara en específico (con la url que le entregase) las imágenes relacionadas a la serie en específico, lo recopilara y lo guardara en una especie de log (.txt) para listarlo y tener las urls con extensión .jpg. Una vez obtenía la lista con urls, iba a JDownloader y se las entregaba, esto hacía que lo descargara en batches de 20 o 40, a veces más.

Ahora viene lo que mencioné un poco arriba y quizás este sea la señal que finalmente me termine de dar un propósito...

Mi amigo lo decidió llamar el "accidente" del arqueólogo. Aquí la historia se vuelve un poco agridulce.
Resulta que Animextremist, al ser un sitio que llevaba años en stand-by, tenía una estructura de cristal. Mientras corría mi script para automatizar la captura de imágenes, el servidor del sitio parece haber entrado en pánico por el volumen de peticiones. Poco después, el perdí el acceso directo a Animextremist. Así que asumí lo peor. El sitio definitivamente había muerto.

Me sentí un poco ridículo porque al intentar solucionar un problema que se veía venir, un problema latente que acecha cada vez más en el "antiguo" internet, terminé siendo yo el causante de la desaparición de estos archivos. Como un explorador que, provoca un derrumbe por el simple hecho de estar ahí. Sin embargo, gracias a esa idea y a ese script, logré rescatar 20 carpetas antes del colapso final. Ahora, lo que queda es ese rincón del 2004 que vive en mi disco duro y quizás en un futuro, en este blog.

La arqueología digital es una carrera contra el tiempo.


Disclaimer: Este proceso no es el definitivo, a mi parecer es super mega ultra rudimentario y deben haber por lo menos 100 formas de hacerlo sin que parezca tan tedioso pero por ahora las desconozco, por lo mismo agradezco cualquier sugerencia/comentario sobre como optimizar este proceso. Estaré actualizando el procedimiento que realicé para que quede documentado. 

martes, 7 de enero de 2025

Manos a la obra

Se postergó por mucho tiempo, pero bueno, el hecho de que esté escribiendo esta entrada en este blog significa que por fin me decidí a darle forma "física" a mis pensamientos. Hace años que sueño despierto y trato siempre de enfocar mis energías en una sola actividad, pero termino saboteándome porque hago más cosas de las que debería, y al final nunca termino nada. Es una mala costumbre que arrastro desde tiempos inmemoriales, y que se fue acentuando con el paso del tiempo a medida que encontraba más cosas que llamaban mi atención.

Lo juro, lo intento con todo... Desde dibujar, aprender a tocar el bajo, escribir (aunque no se me da), practicar un deporte a tiempo completo, armar gunpla, coleccionar cómics, devorar libros como un gusano de biblioteca (fallido), ser rata de laboratorio, traducir (eso sí lo logré, me costó, pero lo conseguí), programar como analista (lo intento), cocinar (también lo intento), aprender ruso (duré dos semanas), coleccionar consolas de videojuegos... y la lista sigue y sigue hasta un punto casi infinito.

Esa es mi lucha: intento aprender algo, pero no lo perfecciono. Luego paso a lo siguiente, y así con todo lo que forma parte de mi vida. Sé que suena un poco mediocre e incluso conformista desde cualquier punto de vista, y me siento culpable, pero así están las cosas. Si cambian en el futuro, perfecto. PERO, por ahora nos conformaremos con completar esta pequeña entrada de introducción, porque hay muchas cosas por hacer en el futuro.

Esta vez, mi concentración —o gran parte de ella— estará destinada al beneficio de los internautas que, como yo, añoran alguna parte de lo que fue el internet. Porque, a medida que pasa el tiempo, esto se desmorona, se cae a pedazos, y quedan pocos lugares seguros donde navegar libremente y sin restricciones (y no me refiero a las libertades absurdas de ciertos individuos). Hay demasiado copyright, demasiados acuerdos internacionales, demasiadas penalizaciones de megacorporaciones voraces que buscan acaparar, cercenar o censurar el conocimiento. Me refiero al conocimiento en todos sus aspectos. Sin embargo, mi trabajo será un poco más superficial que todo lo que acabo de despotricar en estas líneas.

Esta historia se origina en los años en que consumía manga, cómics americanos y novelas gráficas (digo "americanos" porque generalizaré y daré énfasis a lo que más consumía) en línea. Nada legal, claro está, pero hace diez años el internet aún conservaba la esencia con la que se había erguido durante tantos años. Todavía se podía acceder a un montón de contenido de forma gratuita, sin tantas pantallas de verificaciones de identidad ni cuentas pagadas.

No sé qué más escribir porque estoy perdiendo el hilo conductor. ¿Ya mencioné que me distraigo fácilmente?

En conclusión, quiero intentar hacer algo bien, o al menos en orden, alguna vez en mi vida. Quiero incursionar en la arqueología digital. Sí, arqueología digital.
¿QUÉ ES ESO?
¿SE LO INVENTÓ ESTE OCIOSO?
Bueno, quizás sí, lo inventé mientras intentaba hilar estas ideas. Tal vez incluso consulté el concepto con ChatGPT, como todo el mundo. Pero sí, el concepto es real, existe, y aunque no lo crean, es más necesario ahora que nunca. El mundo está cambiando a un ritmo acelerado, y ya no hay vuelta atrás. Es crucial que alguien intente rescatar un poco de lo que era la antigua internet.

No es que yo sea el primero en pensarlo; ya hay mucha gente y organizaciones que intentan preservar lo que pueden en una suerte de biblioteca digital al estilo de la Biblioteca de Alejandría. Internet Archive, por ejemplo. Sí, ellos mismos. Hacen un gran trabajo, y siempre hay grupos de hackers respaldados por gobiernos y megacorporaciones que intentan derribar su sitio. Pero bueno, esa es otra historia.

Espero que, de todo lo que he escrito, se haya entendido el propósito de este blog.
Un abrazo,

Rubén

¿Lección aprendida?

Bueno, me dije a mi mismo que iba a mantener la consistencia en esto de publicar así que solo lo haré por el bien de la conservación. ( Ment...