প্রায় প্রতিটি SEO সমস্যা আসলে তিনটি পর্যায়ের একটিতে সমস্যা। একটি সার্চ ইঞ্জিনকে আপনার পাতা খুঁজে পেতে হয়, সেটি সংরক্ষণ ও বুঝতে হয়, আর তারপর একটি নির্দিষ্ট সার্চের জন্য সেটি বেছে নিতে হয়। এগুলো আলাদা ধাপ, আর একটি পাতা সম্পূর্ণ ভিন্ন কারণে যেকোনো একটিতে ব্যর্থ হতে পারে।
সার্চ ইঞ্জিন এমন প্রোগ্রাম চালায়, সাধারণত crawler বা spider বলা হয়, যা লিংক অনুসরণ করে ওয়েবে ঘুরে বেড়ায়। একটি crawler একটি পাতায় পৌঁছায়, সেটি পড়ে, তাতে থাকা প্রতিটি লিংক নোট করে, আর সেই লিংকগুলো পরে দেখার জন্য একটি তালিকায় যোগ করে। বিশাল মাপে পুনরাবৃত্তি করে, এভাবেই একটি সার্চ ইঞ্জিন কী কী আছে তা আবিষ্কার করে।
ব্যবহারিক পরিণতি: যে পাতায় কিছুই লিংক করে না তা খুঁজে পাওয়া খুব কঠিন। একটি পাতা যদি কোথাও থেকে লিংক করা না থাকে — আপনার নিজের navigation থেকে নয়, অন্য একটি পাতা থেকে নয়, একটি sitemap থেকে নয় — একটি crawler-এর সেখানে যাওয়ার কোনো পথ নেই আর এটি কখনো সেটি খুঁজে না-ও পেতে পারে।
একটি পাতা খুঁজে পাওয়া আর সেটি সংরক্ষণ করা এক নয়। Crawl করার পর, ইঞ্জিন বোঝার চেষ্টা করে পাতাটি কী নিয়ে — এর বিষয়, এর কন্টেন্ট, এর ভাষা, এটি অন্য পাতার সাথে কীভাবে সম্পর্কিত — আর সেটি index নামের একটি বিশাল ডেটাবেসে সংরক্ষণ করে। শুধু index-এ থাকা পাতাই ফলাফলে দেখা যেতে পারে।
একটি পাতা crawl হয়েও index না হতে পারে। সাধারণ কারণ: ইঞ্জিন সেটিকে সংরক্ষণের যোগ্য হওয়ার মতো যথেষ্ট নয় বলে বিচার করেছে, এটি অন্য একটি পাতার প্রায়-হুবহু নকল, অথবা পাতাটি স্পষ্টভাবে index না হওয়ার অনুরোধ করেছে।
Crawl হওয়া মানে index হওয়া নয়
এই পার্থক্যটি এই কোর্সের প্রায় অন্য যেকোনো কিছুর চেয়ে বেশি গুরুত্বপূর্ণ। "Google আমার পাতায় এসেছে" আর "Google আমার পাতা দেখাবে" আলাদা দাবি। Search Console (পরে কভার করা হয়েছে) সেগুলো আলাদাভাবে জানায়, আর দুটি গুলিয়ে ফেললে মানুষ ভুল সমস্যা ঠিক করতে চলে যায়।
কেউ সার্চ করলে, ইঞ্জিন তার index-এ এমন পাতা খোঁজে যা query-র উত্তর দিতে পারে, আর সেগুলোকে একটি ক্রমে সাজায়। সেই ক্রম সাজানোকেই মানুষ ranking বলে।
যে সিস্টেমগুলো ক্রম ঠিক করে সেগুলো প্রকাশিত নয়, আর সেগুলো ঘন ঘন বদলায়। প্রকাশ্যে যা জানা তা ব্যাপক: ইঞ্জিন বিবেচনা করে কন্টেন্টটি ব্যক্তিটি যা চাইছে বলে মনে হয় তার সাথে কতটা মেলে, গুণমান আর নির্ভরযোগ্যতার সংকেত, ব্যবহৃত ডিভাইসে পাতাটি ভালো কাজ করে কিনা, আর অন্য সাইট এটিকে কীভাবে উল্লেখ করে। যে কেউ সঠিক সূত্র জানার দাবি করছে সে জানে না।
পর্যায়গুলো ক্রমিক হওয়ায়, "আমার পাতা দেখা যাচ্ছে না"-এর সমাধান সম্পূর্ণভাবে নির্ভর করে এটি কোথায় থেমেছে তার উপর:
| কোথায় থেমেছে | এর অর্থ কী | কোথায় দেখবেন |
|---|---|---|
| কখনো crawl হয়নি | ইঞ্জিনের পাতাটিতে যাওয়ার কোনো পথ নেই | Internal লিংক, sitemap, robots.txt |
| Crawl হয়েছে, index হয়নি | পাওয়া গেছে, কিন্তু সংরক্ষণের যোগ্য বিচার হয়নি | কন্টেন্টের গুণমান, নকল, noindex ট্যাগ |
| Index হয়েছে, খারাপ র্যাংক | সংরক্ষিত, কিন্তু অন্য পাতার কাছে হারছে | প্রাসঙ্গিকতা, কন্টেন্টের গভীরতা, লিংক, গতি |
আসল সমস্যা যখন একটি ব্লক করা crawler, তখন কন্টেন্টের গুণমান নিয়ে কাজ করে কিছুই হয় না। পরের পাঠগুলো সেই টুলগুলো কভার করে যা আপনাকে বলে আপনি আসলে কোন পর্যায়ে আটকে আছেন।
আপনি publish চাপা মাত্র এর কিছুই ঘটে না। একটি নতুন পাতাকে আবিষ্কৃত হতে, সারিতে যেতে, crawl হতে, মূল্যায়িত হতে, আর index হতে হয়, তারপর অবস্থানের জন্য প্রতিযোগিতা করতে হয় — একটি প্রক্রিয়া যা মিনিটে নয়, দিন বা সপ্তাহে মাপা হয়। আবিষ্কারকে একটু এগিয়ে দেওয়ার উপায় আছে, এই কোর্সে পরে কভার করা হয়েছে, কিন্তু কিছুই পুরো পাইপলাইনটিকে তাৎক্ষণিক করে না।