Este blog ya no está activo, sigue informándote aquí:

Mostrando entradas con la etiqueta Internet Archive. Mostrar todas las entradas
Mostrando entradas con la etiqueta Internet Archive. Mostrar todas las entradas

lunes, 13 de octubre de 2014

La COPE, La Cache, The Archive y El Robot .txt

Hace unos día vi el siguiente tweet de la cope con su correspondiente contestación.


Que, unido a otro tweet que me he encontrado hoy sobre el robot.txt de la cope.es me ha activado el sentido arácnido.


Así que me he puesto a comprobar quien de los dos lados mentía. Estaba claro, pero tenia que hacerlo.  Lo primero que he hecho es comprobar el robot.txt a mano con lo que me he encontrado con lo siguiente. 


Bueno, pues si no me lo puedes ofrecer lo tendré que conseguir. Así que he utilizado el robot.txt Extractor de la herramienta [Parameter Fuzz] para obtenerlo y veréis que la similitud con la foto es bastante grande solo que ya han sacado ese enlace. 


Ahora ya me podía creer que lo habían tocado, al menos actúan rápido. Pero, como tenia la url, de la noticia la he buscado por la cache de Google y en la misma pagina pero nada solo me he encontrado con este error 404 tan sugerente.


Pues nada, como Internet es así de chulo y aquí no se escribe con lapiz sino con tinta indeleble. Me he dirigido a [The Archive] a ver lo que encontraba con la url www.cope.es el día 9 de noviembre (como se ve en el primer tweet). The Archive solo hizo tres Snaps con esa url y en ninguna de ellas estaba la noticia. Pero, si otra de menos alarmante e igual de falsa. 



Pero, al poner la url entera (www.cope.es/detalle/muere-la-auxiliar-de...etc) es otra cosa.


Así que no se quien es el pobre Community Manager de la cuenta de Twitter pero el o sus jefes se han cubierto de gloria. xD

Sed Buenos ;) 

viernes, 5 de julio de 2013

Internet Archive.- Llevame Al Pasado

Algo que es muy cierto y cada vez mas gente se está dando cuanta de que todo lo que alguna vez se sube algo Internet  se queda en Internet.  Una manera de saber o de encontrar los artículos borrados o archivos que estaban subidos a una pagina y que se borraron por X o por Y razones, es mira en Internet Archive.

"El Internet Archive es una organización sin animo de lucro que fue fundada, para construir una biblioteca de Internet. Sus fines son ofrecer acceso permanente a investigadores, historiadores, académicos, personas con discapacidad y el público en general a las colecciones históricas que existen en formato digital. Fundado en 1996 y ubicado en San Francisco , el Archivo ha recibido donaciones de datos de Alexa Internet y otros. A finales de 1999, la organización comenzó a crecer para incluir colecciones más bien redondeado. Ahora, el Internet Archive incluye textos , audio , imágenes en movimiento , y software , así como páginas web archivadas en nuestras colecciones, y proporciona servicios especializados para la lectura de adaptación y acceso a la información de las personas ciegas y otras personas con discapacidades."
Por ejemplo, si buscamos por la web de la Moncloa podremos, y clasificados por días,  saber que días prometieron lo que después no cumplieron. 



Sed Buenos ^^