17

كيف يعمل موقع Web.Archive.org و استطاع حفظ الصفحات في تلك السنين ؟!

  • RCE

السلام عليكم ورحمة الله تعالى و بركاته

الكل يعلم بموقع ويب ارشيف الذي يحتوي على عدد ضخم من الصفحات المحفوظة منذ الازل ، لكل هل يوجد منكم من سأل كيف يعمل الموقع ؟؟ ببساطة و على عجالة من أمري D:

  • يعمل الموقع بتقنية WebCrawler و حفظ الصفحات و تستخدمها برامج ( فحص المواقع في اكتشاف الثغرات )
https://ar.wikipedia.org/wiki

زاحف_الشبكة

  • مؤسسة The Wayback Machine التي بدأت في حفظ الصفحات منذ سنة 1996 دون ان نعلم ذلك و قد تم عمل تحديث لها لتشمل جميع المواقع الجديدة و اعتمدت على عدة مواقع مثل ( أليكسا Alexa )

  • يصل معدل التخزين في موقع الأرشيف 100 تيرابايت

  • يقوم الارشيف بحفظ الصفحات الديناميكية صفحات HTML + الجافاسكربت و بالاضافة الى بعض الملفات الامتدادية و المرفقات احيانا RAR + ZIP

  • يتعطل احيانا حفظ الصفحات بعدد من الاسباب منها حسب ما تم ذكره لديهم :

http://pastebin.com/UqTS1pAX

للمزيد من المعلومات :

https://goo.gl/vvRREU
يرجى الدخول لحسابك أو تسجيل حساب لتستطيع إضافة تعليق
حساب جديد دخول

التعليقات

ذلك الموقع هو أداة من أهم الأدوات في فحص الدومينات المنتهيه لرؤية ماكان عليه المحتوى السابق قبل إصطياد الدومين :) دائماً استخدمه ولم اسئل نفسى يوماً كيف يعمل ذلك الموقع

معلومات قيمه زادت معرفتى أكثر بـما أتعامل معه ، شكراً على الإفادة .

فقط 100 تيرابايت ؟

قليل جدا !!

طبعا هذا احصاء بسيط و هو في تزايد

Density: 1.4 PetaBytes

1.4PetaBytes = 1400 terabyte

حسب الرابط الذي أرفقه الأخ ahmadyosr

الحجم المستعمل في 2014 كان :

Total used storage: 50 PetaBytes

اعتذر حسبت بيانات دون قراءة

اخي كيف يمكن من هذا موقع ارشيف ان اكتب مقالات حصرية لمدونتي بلوجر وشكرا ارجو المساعدة