Crawl, Index ও Rank: গুগল কীভাবে আপনার ওয়েবসাইট খুঁজে পায় ও র‍্যাঙ্ক করে — সহজ বাংলা গাইড

সর্বাধিক আলোচিত

অনেকেই ওয়েবসাইট বানান, কিন্তু কিছুদিন পর একটি অস্বস্তিকর প্রশ্ন সামনে আসে—গুগলে সাইটের নাম বা নতুন আর্টিকেল সার্চ করেও কিছু দেখা যাচ্ছে না কেন?

ধরুন, ঢাকার মিরপুরে আপনার ছোট একটি অনলাইন পোশাকের ব্যবসা আছে। নতুন ওয়েবসাইট বানালেন, পণ্যের ছবি দিলেন, ব্লগও লিখলেন। কিন্তু ওয়েবসাইট তৈরি করলেই গুগল সেটি সঙ্গে সঙ্গে সার্চ ফলাফলে দেখাবে—বিষয়টি এমন নয়।

এখানেই Crawl Index Rank পার্থক্য বুঝতে হয়।

আমি কাজ করতে গিয়ে অনেকবার দেখেছি, সাইট মালিক বলছেন, “পেজ তো লাইভ আছে, গুগলে আসে না কেন?” আসলে লাইভ থাকা, গুগলের পেজটি খুঁজে পাওয়া, সেটি নিজের ডেটাবেজে রাখা এবং কোনো কিওয়ার্ডে ভালো অবস্থানে দেখানো—চারটি বিষয় এক নয়।

Technical SEO Audit করতে হলে তাই আগে জানতে হবে তিনটি মূল পর্যায়: Crawl, Index এবং Rank।

Crawl, Index ও Rank — এই তিনটি কি আলাদা?

হ্যাঁ। এগুলো আলাদা কিন্তু পরস্পরের সঙ্গে যুক্ত তিনটি ধারাবাহিক পর্যায়।

প্রথমে গুগল আপনার পেজ Crawl করে, অর্থাৎ সেটি খুঁজে পেয়ে ডাউনলোড ও পড়ে। এরপর পেজটি উপযুক্ত মনে হলে Index করে, অর্থাৎ বিষয়বস্তু বিশ্লেষণ করে নিজের সার্চ ইনডেক্সে সংরক্ষণ করে। সবশেষে কোনো ব্যবহারকারী প্রাসঙ্গিক কিছু সার্চ করলে গুগল নির্ধারণ করে আপনার পেজটি ফলাফলের কোন অবস্থানে থাকবে—এটাই Ranking

বিষয় Crawl (ক্রল) Index (ইন্ডেক্স) Rank (র‍্যাঙ্ক)
কাজ কী পেজ খুঁজে পাওয়া, ডাউনলোড ও পড়া পেজের বিষয়বস্তু বিশ্লেষণ করে ইনডেক্সে রাখা সার্চ ফলাফলে পেজটির অবস্থান নির্ধারণ
কে করে মূলত Googlebot গুগলের ইনডেক্সিং সিস্টেম গুগলের সার্চ ও র‍্যাঙ্কিং সিস্টেম
কখন হয় পেজ আবিষ্কারের পর Crawl হওয়ার পর, যদি পেজটি ইন্ডেক্সযোগ্য হয় প্রাসঙ্গিক সার্চের সময়
ব্যর্থ হলে কী হয় গুগল পেজের কনটেন্ট জানতে পারে না পেজ সাধারণত সার্চ ফলাফলে আসবে না পেজ ইনডেক্সে থাকলেও ভালো অবস্থান পাবে না
টুল দিয়ে চেক Google Search Console Google Search Console Google Search Console-এর Performance তথ্য

একটি সহজ তুলনা করা যায়। ধরুন, কোনো প্রকাশক নতুন একটি বই ঢাকার একটি বড় লাইব্রেরিতে পাঠাল। বইটি লাইব্রেরিতে পৌঁছানো ও কর্মচারীর হাতে যাওয়া হলো Crawling। বইটি পড়ে উপযুক্ত বিভাগে ক্যাটালগ করে রাখা হলো Indexing। আর পাঠক কোনো বিষয়ের বই চাইলে তাকে কোন বইটি আগে দেখানো হবে, সেটা অনেকটা Ranking-এর মতো।

এ কারণেই Crawled ≠ Indexed ≠ Ranked।

Steps of Google Search - Crawl Index Rank

Crawl বা ক্রলিং কী?

Crawling হলো সেই পর্যায়, যেখানে গুগল আপনার ওয়েবপেজ খুঁজে বের করে এবং তার কনটেন্ট ডাউনলোড ও পড়ে।

গুগলের প্রধান crawler-এর নাম Googlebot। একে web spider বা bot-ও বলা হয়। Googlebot আগে থেকে পরিচিত পেজের বিভিন্ন লিংক অনুসরণ করে নতুন URL আবিষ্কার করতে পারে। XML Sitemap থেকেও গুগল নতুন বা গুরুত্বপূর্ণ URL সম্পর্কে জানতে পারে।

এই জায়গায় Crawl Index Rank পার্থক্য পরিষ্কার না থাকলে একটি সাধারণ ভুল হয়। অনেকে Search Console-এ দেখেন Googlebot পেজটি Crawl করেছে, তারপর ধরে নেন পেজটি নিশ্চয়ই গুগলে রয়েছে। বাস্তবে Crawl হওয়া মানেই Index হওয়া নয়।

Googlebot কীভাবে কাজ করে?

Googlebot-কে পাড়ার সেই ডাকপিয়নের সঙ্গে তুলনা করতে পারেন, যিনি এক বাড়িতে চিঠি দিতে গিয়ে পাশের বাড়ির ঠিকানাও জানতে পারেন।

একটি পরিচিত পেজে Googlebot একটি নতুন লিংক দেখল। সেই URL পরে গুগলের crawl queue-তে যেতে পারে। Crawl queue হলো এমন একটি অগ্রাধিকারভিত্তিক তালিকা, যেখানে Googlebot কোন URL কখন Crawl করবে তা ব্যবস্থাপনা করা হয়।

সব পেজ সমান হারে Crawl হয় না। উচ্চমানের সিগন্যাল থাকা, নিয়মিত আপডেট হওয়া কিংবা বেশি inbound link পাওয়া পেজ তুলনামূলক ঘন ঘন Crawl হতে পারে।

Googlebot শুধু HTML-এর কয়েক লাইন পড়ে চলে যায়—এমনও নয়। এটি Chrome-ভিত্তিক rendering ব্যবহার করে অনেকটা ব্রাউজারের মতো পেজ render করতে পারে। JavaScript-নির্ভর সাইটের ক্ষেত্রে এই বিষয়টি বিশেষভাবে প্রাসঙ্গিক।

তবে Crawl হওয়ার অর্থ শুধু এটুকুই—গুগল পেজটি পেয়েছে এবং পড়েছে। পেজটি সার্চ ইনডেক্সে রাখবে কি না, সেই সিদ্ধান্ত পরের পর্যায়ের।

robots.txt ও Sitemap — Googlebot-কে গাইড করার দুটি হাতিয়ার

ওয়েবসাইটের robots.txt ফাইলের মাধ্যমে Googlebot-কে জানানো যায় সাইটের কোন অংশ Crawl করা উচিত বা কোন অংশ Crawl করা থেকে বিরত থাকতে হবে।

এটিকে একটি অফিস ভবনের নিরাপত্তারক্ষীর নির্দেশনার সঙ্গে তুলনা করা যায়। তিনি অতিথিকে বলতে পারেন, “দ্বিতীয় তলায় যেতে পারবেন, কিন্তু স্টোররুমে প্রবেশ করবেন না।”

অন্যদিকে XML Sitemap অনেকটা ভবনের একটি মানচিত্রের মতো। এতে গুরুত্বপূর্ণ URL-এর তালিকা থাকে। Google Search Console-এর মাধ্যমে Sitemap জমা দিলে গুগলের জন্য পেজগুলো আবিষ্কার করা সহজ হয়।

তবে Sitemap জমা দেওয়া মানেই প্রতিটি URL অবশ্যই Index হবে—এমন নিশ্চয়তা নেই। একইভাবে robots.txt দিয়ে Crawl বন্ধ করা আর কোনো পেজকে Index থেকে নিশ্চিতভাবে বাদ দেওয়াও এক বিষয় নয়। তাই Crawl ও Index নিয়ন্ত্রণকে আলাদা করে দেখতে হবে।

Crawl Budget কী এবং ছোট সাইটের জন্য কতটা গুরুত্বপূর্ণ?

Crawl budget বলতে একটি নির্দিষ্ট সময়সীমায় Googlebot কোনো সাইটের কতগুলো URL Crawl করবে, সেই সামগ্রিক সক্ষমতা বা সীমাকে বোঝানো হয়।

হাজার হাজার বা লাখো URL-এর বড় সাইটে crawl budget গুরুত্বপূর্ণ হতে পারে। কারণ Googlebot যদি প্রয়োজনহীন, duplicate বা কম গুরুত্বপূর্ণ URL Crawl করতেই বেশি সময় ব্যয় করে, গুরুত্বপূর্ণ নতুন পেজ আবিষ্কারে দেরি হতে পারে।

ছোট ব্লগ বা সাধারণ ব্যবসায়িক সাইটে crawl budget নিয়ে শুরুতেই আতঙ্কিত হওয়ার প্রয়োজন সাধারণত কম। সেখানে ভালো internal linking, পরিষ্কার Sitemap, অপ্রয়োজনীয় URL কমানো এবং Crawl বাধাগুলো ঠিক করা বেশি বাস্তবসম্মত কাজ।

Index বা ইন্ডেক্সিং কী?

Googlebot আপনার পেজ Crawl করার পর দ্বিতীয় পর্যায় হলো Indexing

এখানে গুগল পেজের text, image, video এবং অন্যান্য উপলভ্য তথ্য বিশ্লেষণ করে বোঝার চেষ্টা করে পেজটি আসলে কী নিয়ে। উপযুক্ত হলে সেই তথ্য গুগলের বিশাল search index-এ সংরক্ষিত হয়।

বাংলাদেশি উদাহরণে ভাবুন, একটি জেলা লাইব্রেরিতে নতুন ১০০টি বই এসে পৌঁছেছে। কর্মচারী বইগুলো হাতে পেয়েছেন—এটা Crawling-এর মতো। কিন্তু এরপর তাকে বুঝতে হবে কোনটি ইতিহাস, কোনটি বিজ্ঞান, কোনটি উপন্যাস। তারপর সঠিক ক্যাটালগ ও তাকে রাখতে হবে। এই দ্বিতীয় কাজটাই Indexing-এর সবচেয়ে কাছাকাছি তুলনা।

ক্রল হয়েছে মানে কি ইন্ডেক্স হয়েছে? না

এটি SEO-র সবচেয়ে গুরুত্বপূর্ণ পার্থক্যগুলোর একটি।

Googlebot আপনার URL Crawl করেছে, কিন্তু গুগল সিদ্ধান্ত নিতে পারে পেজটি এখনই Index করবে না। Search Console-এ এজন্য “Crawled – currently not indexed” ধরনের স্ট্যাটাস দেখা যেতে পারে।

আবার “Discovered – currently not indexed” দেখা গেলে বোঝায় গুগল URL-এর অস্তিত্ব সম্পর্কে জানে, কিন্তু এখনও সেটি Crawl করে Index করার পর্যায়ে যায়নি।

অনেক ক্লায়েন্ট প্রথমে এই জায়গাটিতেই বিভ্রান্ত হন। তারা মনে করেন Googlebot পেজে এসেছে মানেই SEO-এর প্রথম বড় কাজ শেষ। বাস্তবে গুগল পেজটি রাখার মতো মনে করছে কি না, সেটিও আলাদা প্রশ্ন।

কোন কারণে পেজ ইন্ডেক্স হয় না?

পেজ Crawl হওয়ার পরও Index না হওয়ার পেছনে কয়েকটি পরিচিত কারণ রয়েছে। Thin content, duplicate content, ভুল করে ব্যবহার করা noindex meta tag অথবা দুর্বল quality signals তার মধ্যে উল্লেখযোগ্য।

Canonical tag-ও এখানে গুরুত্বপূর্ণ। একই বা খুব কাছাকাছি কনটেন্টের একাধিক URL থাকলে canonical-এর মাধ্যমে কোন সংস্করণটিকে preferred version হিসেবে বিবেচনা করতে চান, সেই signal দেওয়া যায়।

“Signal” শব্দটি এখানে গুরুত্বপূর্ণ। Canonical tag গুগলের জন্য absolute directive নয়।

সমস্যা কারণ সমাধান
Crawled – currently not indexed গুগল পেজ Crawl করেছে, কিন্তু এখন Index করেনি কনটেন্টের মান, স্বাতন্ত্র্য ও usefulness পরীক্ষা করুন; গুরুত্বপূর্ণ পেজে internal link দিন
Duplicate content একাধিক URL-এ একই বা প্রায় একই কনটেন্ট প্রয়োজনমতো canonical signal ব্যবহার করুন এবং অপ্রয়োজনীয় duplicate URL কমান
noindex tag ভুলে লাগানো পেজকে Index না করতে নির্দেশ দেওয়া হয়েছে পেজটি Index করতে চাইলে ভুল noindex সরান
robots.txt দিয়ে block Googlebot-এর Crawl বাধাগ্রস্ত হচ্ছে robots.txt পরীক্ষা করে প্রয়োজনীয় URL Crawl করার অনুমতি দিন
Thin content পেজে পর্যাপ্ত স্বতন্ত্র বা প্রয়োজনীয় তথ্য নেই ব্যবহারকারীর প্রশ্নের বাস্তব ও পূর্ণাঙ্গ উত্তর দেওয়ার মতো কনটেন্ট উন্নত করুন

Mobile-First Indexing — জুলাই ২০২৪-এর পর কী বদলেছে?

Mobile-First Indexing নিয়ে এখন আর “গুগল কি আমার desktop version আগে দেখছে?”—এইভাবে ভাবা ঠিক নয়।

Google Search Advocate John Mueller-এর নিশ্চিতকরণ অনুযায়ী, ৫ জুলাই ২০২৪ থেকে Google সব ওয়েবসাইট Crawl ও Index করার জন্য Googlebot Smartphone ব্যবহার করছে। এটি ২০১৬ সালে শুরু হওয়া Mobile-First Indexing প্রক্রিয়ার চূড়ান্ত সমাপ্তি।

অর্থাৎ এখন আপনার mobile version-এ মূল কনটেন্ট অনুপস্থিত, navigation ভাঙা বা গুরুত্বপূর্ণ অংশ ব্যবহার করা কঠিন হলে সেটি গুরুত্ব দিয়ে দেখা দরকার।

ঢাকার অনেক মানুষ ডেস্কটপের চেয়ে ফোনে ওয়েবসাইট বেশি দেখেন—ব্যবহারিক দিক থেকে বিষয়টি আমাদের বাজারেও স্বাভাবিক। তবে Mobile-First Indexing মানে “শুধু মোবাইলের জন্য আলাদা SEO”—এমন নয়। মূল কথা, Googlebot Smartphone যেন আপনার প্রয়োজনীয় কনটেন্ট ঠিকভাবে access ও বুঝতে পারে।

Rank বা র‍্যাঙ্কিং কী?

আপনার পেজ Crawl হলো। Index-ও হলো। এবার কেউ গুগলে প্রাসঙ্গিক কিছু লিখে সার্চ করল।

এখন প্রশ্ন—আপনার পেজ কোথায় দেখা যাবে?

এই অবস্থান নির্ধারণের পর্যায় হলো Ranking।

ধরুন, নীলক্ষেতের একটি বইয়ের দোকানে একই বিষয়ে ৫০টি বই আছে। দোকানদার একজন বিশ্ববিদ্যালয়ের শিক্ষার্থীর প্রয়োজন শুনে সবচেয়ে প্রাসঙ্গিক কয়েকটি বই সামনে রাখলেন। বাকি বইগুলো দোকানে আছে, কিন্তু প্রথমেই দেখানো হচ্ছে না।

গুগল Ranking-কে কিছুটা এভাবেই ভাবা যায়। Index-এ থাকা মানে আপনি “দোকানে আছেন”; প্রথম পাতায় বা ভালো অবস্থানে থাকা আলাদা অর্জন।

গুগল কোন কোন বিষয়ে র‍্যাঙ্ক দেয়?

গুগল ঠিক কতটি Ranking factor ব্যবহার করে, তার পূর্ণ তালিকা প্রকাশ্যে দেয়নি। “Google-এর ২০০ ranking factors আছে”—এই দাবি SEO জগতে বহু বছর ধরে জনপ্রিয়। কিন্তু গুগল আনুষ্ঠানিকভাবে ঠিক ২০০টি factor নিশ্চিত করেনি।

নিরাপদভাবে বলা যায়, গুগলের ranking systems শত শত signal ও factor বিবেচনা করতে পারে।

কিছু বিষয় সম্পর্কে গুগল প্রকাশ্যে তথ্য দিয়েছে। যেমন Page Speed, mobile-friendliness, HTTPS এবং Core Web Vitals। Backlink-ও ranking signal হিসেবে গুরুত্বপূর্ণ, তবে link-এর সংখ্যা বাড়ানোর চেয়ে গুণগত মান বেশি গুরুত্বপূর্ণ।

এখানেই Crawl Index Rank পার্থক্য আবার কাজে লাগে। Technical সমস্যা ঠিক করে পেজ Index করানো Ranking-এর পূর্বশর্ত হতে পারে, কিন্তু শুধু Index হলেই competitive keyword-এ প্রথম দিকে চলে আসবে না।

র‍্যাঙ্কিং বিষয় কখন নিশ্চিত/প্রাসঙ্গিক হয়েছে গুরুত্ব কীভাবে উন্নত করবেন
Page Speed Desktop: ২০১০; Mobile: ২০১৮ ধীর পেজ ব্যবহারকারীর অভিজ্ঞতা ও Ranking-এ প্রভাব ফেলতে পারে অপ্রয়োজনীয় ভারী রিসোর্স কমান, PageSpeed Insights দিয়ে পরীক্ষা করুন
Mobile-friendliness ২০১৫ মোবাইল ব্যবহারকারীর জন্য উপযোগিতা গুরুত্বপূর্ণ Responsive layout ও mobile usability ঠিক রাখুন
HTTPS ২০১৪ নিরাপদ সংযোগ একটি Ranking signal বৈধ SSL/HTTPS ব্যবহার করুন
Core Web Vitals জুন ২০২১ থেকে ranking systems-এর অংশ বাস্তব page experience-এর গুরুত্বপূর্ণ পরিমাপ LCP, INP ও CLS উন্নত করুন
Backlinks নির্দিষ্ট একক বছর নয় গুণগত ও প্রাসঙ্গিক link authority signal দিতে পারে প্রাসঙ্গিক, বিশ্বাসযোগ্য উৎস থেকে স্বাভাবিক link অর্জন করুন
E-E-A-T Search Quality Rater Guidelines-এর framework বিশেষ করে quality assessment বুঝতে সহায়ক; এটি একক সরাসরি ranking factor নয় অভিজ্ঞতা, দক্ষতা, কর্তৃত্ব ও বিশ্বাসযোগ্যতার প্রমাণ স্পষ্ট করুন
Content Quality Google-এর ধারাবাহিক search guidance-এর কেন্দ্রীয় বিষয় ব্যবহারকারীর প্রশ্ন ভালোভাবে সমাধান করার জন্য মৌলিক স্বতন্ত্র, উপকারী ও উদ্দেশ্যপূর্ণ কনটেন্ট তৈরি করুন

Core Web Vitals — ৩টি পরিমাপযোগ্য মেট্রিক

Core Web Vitals বর্তমানে তিনটি মূল metric দিয়ে page experience-এর কিছু গুরুত্বপূর্ণ দিক পরিমাপ করে: LCP, INP এবং CLS।

INP মার্চ ২০২৪-এ FID-এর জায়গা নেয়।

মেট্রিক পূর্ণ নাম কী পরিমাপ করে ভালো স্কোর Ranking-এ প্রাসঙ্গিকতা
LCP Largest Contentful Paint মূল দৃশ্যমান কনটেন্ট কত দ্রুত load হয় ২.৫ সেকেন্ডের মধ্যে Core Web Vitals জুন ২০২১ থেকে ranking systems-এর অংশ
INP Interaction to Next Paint ব্যবহারকারীর interaction-এর পর পেজ কত দ্রুত সাড়া দেয় ২০০ মিলিসেকেন্ডের মধ্যে মার্চ ২০২৪ থেকে FID-এর জায়গায় Core Web Vital
CLS Cumulative Layout Shift পেজ load হওয়ার সময় layout কতটা অনাকাঙ্ক্ষিতভাবে সরে যায় ০.১-এর নিচে Core Web Vitals জুন ২০২১ থেকে ranking systems-এর অংশ

তবে Core Web Vitals ভালো হলেই কোনো দুর্বল কনটেন্ট এক নম্বরে চলে আসবে—এমন ধারণা করা উচিত নয়। Ranking বহু signal-এর সমন্বিত ফল।

E-E-A-T কী এবং কেন এটা গুরুত্বপূর্ণ?

E-E-A-T হলো Experience, Expertise, Authoritativeness এবং Trustworthiness।

এটি Google Search Quality Rater Guidelines-এ ব্যবহৃত quality-evaluation framework। একে চারটি আলাদা সরাসরি ranking factor হিসেবে ধরে নেওয়া ভুল হবে।

সহজভাবে বললে, একটি স্বাস্থ্যবিষয়ক নিবন্ধ কে লিখেছে, লেখকের বিষয়ভিত্তিক দক্ষতা আছে কি না, তথ্য বিশ্বাসযোগ্য কি না এবং ওয়েবসাইটটি নিজের পরিচয় পরিষ্কারভাবে তুলে ধরছে কি না—এসব quality বোঝার ক্ষেত্রে গুরুত্বপূর্ণ।

একইভাবে একজন বাংলাদেশি freelancer যদি “বিদেশি ক্লায়েন্টের invoice payment” নিয়ে নিজের বাস্তব অভিজ্ঞতা, পরিষ্কার ব্যাখ্যা ও নির্ভরযোগ্য তথ্য দিয়ে লেখেন, সেটি এমন একটি generic লেখার চেয়ে পাঠকের কাছে বেশি উপকারী হতে পারে যেখানে কোনো বাস্তব অভিজ্ঞতার ছাপ নেই।

গুগলের original PageRank algorithm Larry Page ও Sergey Brin ১৯৯৮ সালে তৈরি করেছিলেন এবং link authority পরিমাপে এটি ঐতিহাসিক ভূমিকা রাখে। অন্যদিকে BERT natural-language query বুঝতে সাহায্য করে এবং RankBrain বিশেষ করে ambiguous query process করতে ব্যবহৃত machine-learning system।

এগুলোকে একই কাজের বিকল্প হিসেবে দেখা ঠিক নয়।

আরেকটি প্রচলিত ভুল হলো social media likes বা shares-কে সরাসরি Google ranking factor বলা। এগুলো সরাসরি ranking factor হিসেবে নিশ্চিত নয়। Social media আপনার কনটেন্টের visibility বাড়াতে পারে, মানুষ link দিতে পারে, brand পরিচিত হতে পারে—কিন্তু “১০ হাজার Facebook share = Google ranking boost” ধরনের সমীকরণ নেই।

তিনটি ধাপের মধ্যে আসল পার্থক্য কোথায়?

এখন পুরো Crawl Index Rank পার্থক্য একটি বাস্তব দৃশ্য দিয়ে দেখা যাক।

আপনি নতুন একটি আর্টিকেল প্রকাশ করলেন। Googlebot URL খুঁজে পেল এবং Crawl করল। Search Console-এ দেখা গেল পেজটি Crawled হয়েছে, কিন্তু “Crawled – currently not indexed” অবস্থায় আছে।

এর মানে Ranking নিয়ে চিন্তা করার সময় এখনও আসেনি। প্রথম সমস্যা Indexing-এ।

আরেকটি পেজ Google-এর Index-এ আছে। URL সার্চ করলে পাওয়া যায়। কিন্তু “best laptop under 50000 in Bangladesh” ধরনের competitive query-তে প্রথম কয়েক পেজেও দেখা যাচ্ছে না।

এখানে Crawl ও Index দুটোই হয়েছে। সমস্যা এখন Ranking বা query relevance-এর পর্যায়ে।

আবার কোনো গুরুত্বপূর্ণ পেজ internal link-এ নেই, Sitemap-এও নেই এবং Googlebot URL-টি আবিষ্কারই করেনি। এই ক্ষেত্রে content quality নিয়ে Ranking analysis শুরু করা সময়ের অপচয় হতে পারে। প্রথমে discovery ও Crawl নিশ্চিত করতে হবে।

এই তিনটি অবস্থাকে এক করে দেখলে SEO audit প্রায়ই ভুল জায়গা থেকে শুরু হয়।

গুগল সার্চ কনসোল দিয়ে কীভাবে চেক করবেন?

What to Check First

Google Search Console বা GSC হলো গুগলের বিনামূল্যের tool, যার মাধ্যমে সাইটের Crawling, Indexing এবং search performance পর্যবেক্ষণ করা যায়।

একজন non-technical site owner-এর জন্যও এটি সবচেয়ে কার্যকর শুরুর জায়গাগুলোর একটি।

নতুন URL প্রকাশ করার পর Search Console-এ সেই URL-এর অবস্থা পরীক্ষা করুন। গুগল URL সম্পর্কে জানে কি না, Crawl করেছে কি না এবং Index হয়েছে কি না—এসব তথ্য সেখানে পাওয়া যায়।

তারপর Page Indexing সম্পর্কিত রিপোর্টে দেখুন বড় সংখ্যায় কোনো নির্দিষ্ট সমস্যা হচ্ছে কি না। “Crawled – currently not indexed” বা “Discovered – currently not indexed” বেশি হলে প্রতিটি URL আলাদাভাবে না দেখে pattern খোঁজা বেশি কার্যকর।

Sitemap জমা আছে কি না সেটিও পরীক্ষা করুন। বিশেষ করে নতুন বা গঠনগতভাবে বড় সাইটে XML Sitemap গুরুত্বপূর্ণ URL আবিষ্কারে সাহায্য করতে পারে।

Indexing ঠিক থাকলে Performance data-এর দিকে যান। কোন query থেকে impressions আসছে, কোন পেজ clicks পাচ্ছে এবং কোন ধরনের content search visibility পাচ্ছে—এসব দেখে Ranking পর্যায়ের বাস্তব চিত্র বোঝা যায়।

ধাপ ফ্রি Google টুল কী দেখা যায়
Crawl stage Google Search Console URL discovery, crawl সম্পর্কিত status ও সমস্যা
Index stage Google Search Console কোন URL Indexed, Crawled–not indexed বা অন্যান্য indexing status-এ আছে
Rank stage Google Search Console Query, impressions, clicks এবং search performance
Page experience পরীক্ষা Google PageSpeed Insights LCP, INP, CLS-সহ performance তথ্য
সাইট ব্যবহারের আচরণ Google Analytics ব্যবহারকারী সাইটে এসে কীভাবে interaction করছে

এখানে একটি জিনিস মনে রাখুন। Google Analytics দিয়ে Googlebot Crawl বা Index status দেখা যায় না। Analytics মূলত আপনার সাইটে আসা ব্যবহারকারীদের আচরণ বোঝার জন্য। Crawl ও Index diagnosis-এর প্রাথমিক tool হিসেবে Search Console-ই বেশি প্রাসঙ্গিক।

সীমাবদ্ধতা ও যা মাথায় রাখতে হবে

SEO নিয়ে কাজ করতে গেলে কিছু জায়গায় নিশ্চিত উত্তর পাওয়া যায়, আবার কিছু জায়গায় ইচ্ছা করলেও পাওয়া যায় না।

গুগলের ranking algorithm proprietary। গুগল কখনো সরাসরি বলেনি যে ঠিক কতটি ranking factor আছে। তাই “২০০টি confirmed factor” বলে নির্দিষ্ট সংখ্যা ব্যবহার করা নিরাপদ নয়। “Hundreds of factors” বলা বেশি যথাযথ।

একইভাবে Domain Authority বা DA Google-এর metric নয়। এটি Moz-এর তৈরি metric। SEO analysis-এ কেউ DA ব্যবহার করতে পারেন, কিন্তু “Google আমার DA দেখে Ranking দিচ্ছে”—এটি সঠিক ব্যাখ্যা নয়।

আর Ranking-এর নির্দিষ্ট সময়সীমাও বলা যায় না। নতুন পেজ প্রকাশ করে “সাত দিনের মধ্যে প্রথম পেজে আসব” এমন নিশ্চয়তা বাস্তব SEO-তে দেওয়া যায় না। Competition, content quality, site signals, query intent, links এবং আরও অনেক বিষয় ফলাফলে প্রভাব ফেলতে পারে।

আমি সাধারণত একটি জিনিস আগে পরিষ্কার করি: Index হওয়া সাফল্যের শেষ ধাপ নয়। এটি search competition-এ অংশ নেওয়ার সুযোগ পাওয়া।

Crawl না হলে Google পেজটি ঠিকভাবে জানতে নাও পারে। Crawl হলে Index হওয়ার নিশ্চয়তা নেই। Index হলে ভালো Rank পাওয়ার নিশ্চয়তা নেই।

এই তিনটি বাক্য মনে থাকলে SEO diagnosis অনেক পরিষ্কার হয়ে যায়।

এখন আপনার প্রথম কাজ কী হওয়া উচিত?

Crawl Index Rank পার্থক্য বোঝার সবচেয়ে বড় সুবিধা হলো SEO সমস্যা দেখলেই আর সবকিছুকে “Ranking সমস্যা” মনে হবে না।

আজই Google Search Console খুলুন। প্রথমে গুরুত্বপূর্ণ কয়েকটি URL Google জানে ও Crawl করতে পারছে কি না দেখুন। তারপর Indexing status পরীক্ষা করুন। XML Sitemap ঠিক আছে কি না নিশ্চিত করুন। পেজ Index হয়ে থাকলে search performance দেখুন। শেষে PageSpeed Insights দিয়ে অন্তত একটি Core Web Vitals সমস্যা খুঁজে বের করে সেটি উন্নত করার কাজ শুরু করুন।

SEO তখনই সহজ হয়, যখন সমস্যাটি কোন পর্যায়ে ঘটছে সেটি আগে সঠিকভাবে ধরতে পারেন।

প্রায়শই জিজ্ঞাসিত প্রশ্ন

Crawl, Index ও Rank-এর মধ্যে মূল পার্থক্য কী?

Crawl হলো Googlebot-এর মাধ্যমে পেজ খুঁজে পাওয়া ও পড়া। Index হলো পেজের কনটেন্ট বিশ্লেষণ করে Google-এর search index-এ রাখার প্রক্রিয়া। Rank হলো কোনো search query-র জন্য Indexed পেজগুলোর মধ্যে কোনটি কোন অবস্থানে দেখানো হবে, সেই সিদ্ধান্ত।

ওয়েবসাইট গুগলে ইন্ডেক্স হচ্ছে না কেন?

পেজ Crawl হওয়ার পরও thin content, duplicate content, noindex meta tag, দুর্বল quality signals বা Crawl-সংক্রান্ত সমস্যার কারণে Index নাও হতে পারে। Google Search Console-এ URL ও Page Indexing status পরীক্ষা করে সমস্যার ধরন আগে শনাক্ত করা উচিত।

“Crawled – currently not indexed” মানে কী?

এর মানে Googlebot পেজটি Crawl করেছে, কিন্তু বর্তমানে সেটিকে Index-এ অন্তর্ভুক্ত করেনি। পেজটির স্বাতন্ত্র্য, usefulness, content quality এবং internal linking পরীক্ষা করা যেতে পারে।

Mobile-First Indexing মানে কী?

Mobile-First Indexing মানে Google মূলত smartphone crawler দিয়ে ওয়েবসাইটের content Crawl ও Index করে। ৫ জুলাই ২০২৪ থেকে Googlebot Smartphone ব্যবহার করে সব ওয়েবসাইট Crawl ও Index করার প্রক্রিয়া সম্পূর্ণ হয়েছে।

Core Web Vitals কী এবং Ranking-এ এর প্রভাব কতটুকু?

Core Web Vitals হলো page experience পরিমাপের তিনটি metric: LCP, INP এবং CLS। ভালো মান হিসেবে LCP ২.৫ সেকেন্ডের মধ্যে, INP ২০০ মিলিসেকেন্ডের মধ্যে এবং CLS ০.১-এর নিচে ধরা হয়। এগুলো Ranking systems-এর অংশ, তবে একা এগুলোই Ranking নির্ধারণ করে না।

নতুন ওয়েবসাইট Google-এ Rank পেতে কত সময় লাগে?

এর কোনো নিশ্চিত সময়সীমা নেই। Crawl ও Index হওয়া, প্রতিযোগিতা, content quality, backlinks, query relevance এবং অন্যান্য ranking signals-এর ওপর সময় নির্ভর করতে পারে। নির্দিষ্ট কয়েক দিন বা সপ্তাহের নিশ্চয়তা দেওয়া বাস্তবসম্মত নয়।

robots.txt কী করে?

robots.txt ফাইলের মাধ্যমে search crawler-কে জানানো যায় সাইটের কোন অংশ Crawl করা যাবে বা কোন অংশ Crawl করা থেকে বিরত থাকতে হবে। তবে robots.txt, noindex এবং canonical—তিনটির কাজ এক নয়।

Social media share বাড়লে কি Google Ranking সরাসরি বাড়ে?

না। Facebook likes, shares বা অন্য social engagement সরাসরি Google ranking factor হিসেবে নিশ্চিত নয়। তবে social visibility থেকে মানুষের কাছে content পৌঁছাতে পারে এবং পরোক্ষভাবে links বা brand awareness তৈরির সুযোগ হতে পারে।

সর্বশেষ