[سؤال للنقاش] كيف يعمل موقع pdfdrive

تحية طيبة،

انتشر في مواقع اوتطبيقات التواصل دعوات لزيارة موقع pdfdrive.net لتحميل الكتب مجانا في مجالات عدة.. زرت الموقع وتصفحته فبدا لي أن الموقع يعتمد على عناكب بحث آلية تبحث عن ملفات pdf على الويب ثم يقوم الموقع بفهرسة هذه الروابط وإنشاء صفحات التحميل، علما بأن التحميل لا يكون من الموقع مباشرة بل من الموقع الأصلي.

هل اعتقادي هذا صحيح؟ وما هي التقنيات التي يمكن استخدامها للقيام بذلك ؟

يرجى الدخول لحسابك أو تسجيل حساب لتستطيع إضافة تعليق
حساب جديد دخول

التعليقات

أظن الفكرة سهلة لكن تتطلب برمجية مدروسة، الموقع و الله أعلم و ما علِمته من كلامك تعمل crawling للمواقع و تستخرج المطلوب حول تحليل خوارزميات معينة تتبع الكلمات كـ تحميل، انقر هنا .. الخ.

أنا ذكرت رأيي ولست متأكدا تماما منه. لكني مهتم بمعرفة التفاصيل البرمجية.

أعتقد أن الشرط الوحيد في خوارزمية الزحف (Crawling) هي أن يكون الملف بصيغة pdf (هل هناك شروط أخرى؟ لا أدري!)

ماذا عن التصنيفات؟ هل يتم إنشاءها تلقائيا أيضا؟

كيف يمكن تحديد التصنيف المناسب للملف؟ وفهرس الكلمات المفتاحية (هل تستخرج من اسم الملف بغض النظر عن محتواه؟)