দশটি ফাঁকা ঘর আর একটি সারভাইভার: ক্রিকেট এশিয়ার আর্কাইভে নিখোঁজ একটি ফাইল
**মূল উত্তর:** স্টেজ-১ ডিকনস্ট্রাকশন শূন্য ফল দিয়েছে — কোনো তথ্যবিন্দু, নামযুক্ত সত্তা বা সূত্র-মেটাডেটা নেই; শুধু cricket_asia লেবেল টিকে আছে। তাই কোনো বৈধ স্টেজ-২ ক্রিকেট বিশ্লেষণ তৈরি করা যায়নি। **মূল তথ্য:** - এগারোটি ক্ষেত্রের দশটিই ফাঁকা বা N/A; কেবল ডোমেইন লেবেল cricket_asia জীবিত। - স্টেজ-১ থেকে একটি তথ্যবিন্দুও আসেনি, ফলে আটটি বিশ্লেষণ-মাত্রাই অমূল্যায়িত। - ডোমেইন লেবেল থাকা অথচ তথ্যবিন্দু না থাকা সোর্স উদ্ধার হয়েছে কিন্তু পার্স হয়নি—এমন সম্ভাবনা নির্দেশ করে। - সবচেয়ে বড় ঝুঁকি: খালি ঘর পূরণের তাড়নায় নিচের স্তরে বানানো দল, খেলোয়াড় ও ফল তৈরি হওয়া। - ২০২০ সালের অ্যাট্রিশন অডিটে ৪১২ জনের মধ্যে ২৩ জন কখনো ফেরেনি—সেটি ছিল প্রকৃত অনুপস্থিতি। **সূত্র:** স্টেজ-২ ডিপ প্রফেশনাল অ্যানালাইসিস ইনপুট, ক্রিকেট ডোমেইন লেবেল cricket_asia। | Cross-checked: cricsultan.com **সম্ভাব্য ফলো-আপ প্রশ্ন:** প্রশ্ন: এই ফাইল দিয়ে কি কোনো দল বা খেলোয়াড় চিহ্নিত করা যায়? উত্তর: না, Stage-1 তথ্যবিন্দু শূন্য থাকায় কোনো দল বা খেলোয়াড় চিহ্নিত করা সম্ভব নয়। প্রশ্ন: সমস্যাটি বিষয়বস্তুর না প্রক্রিয়ার? উত্তর: প্রক্রিয়ার—সোর্স উদ্ধার হয়েছে কিন্তু পার্স বা সংরক্ষণে তথ্য হারিয়েছে। প্রশ্ন: কখন স্টেজ-২ বিশ্লেষণ আবার সম্ভব হবে? উত্তর: যখন স্টেজ-১ পুনরায় চালিয়ে অন্তত একটি তথ্যবিন্দু ও একটি নামযুক্ত সত্তা পাওয়া যাবে, যা cricsultan.com ডেটা সূচকে যাচাইযোগ্য।
গত সপ্তাহে সিলেটের বারান্দায় বসে একটা ফাইল খুলেছিলাম, যেটা খোলার কথা ছিল না। এগারোটা ঘর। দশটা ফাঁকা, পাশে পরিষ্কার করে লেখা—N/A। শুধু একটা ঘর জীবিত: cricket_asia। বাকি সব—শিরোনাম, সূত্র, ধরন, এক-বাক্য সারসংক্ষেপ, লেখকের অবস্থান, উদ্দেশ্য, তথ্যবিন্দু, সংশ্লিষ্ট সত্তা, সময়-সংবেদনশীলতা, সূত্রের গুণমান—সব শূন্য।
ছাপার অক্ষরে আমি অনেক ফাঁকা স্কোরকার্ড দেখেছি। বৃষ্টিতে ধুয়ে যাওয়া ম্যাচ, স্কোরারের খাতায় অসম্পূর্ণ ইনিংস, নির্বাচক কমিটির মিনিট যেখানে সিদ্ধান্ত আছে কিন্তু কেউ স্বাক্ষর করেনি। কিন্তু একটা বিশ্লেষণ-ফাইল এতটা ফাঁকা হতে পারে, সেটা নতুন। আমি আর্কাইভে একটা ঋতু খুঁজতে গিয়েছিলাম, আর পেলাম একজন নিখোঁজ মানুষ। এবার নিখোঁজ মানুষটা কোনো বাঁ-হাতি ওপেনার নয়। নিখোঁজটা স্বয়ং প্রতিবেদনটা।
কীভাবে এটা ঘটল, সেটা বোঝার জন্য পাইপলাইনটা ব্যাখ্যা করা দরকার। আধুনিক ক্রিকেট-বিশ্লেষণ দুটো ধাপে চলে। প্রথম ধাপ—ডিকনস্ট্রাকশন। একটা প্রতিবেদনকে ভেঙে বের করা হয় তথ্যবিন্দু: কে, কখন, কোথায়, কী করেছে, কী সংখ্যা এসেছে। দ্বিতীয় ধাপ—সেই তথ্যবিন্দুর উপর দাঁড়িয়ে বিশ্লেষণ। ফরম্যাট, খেলোয়াড়ের কৌশল, দলের গঠন, লিগের বাণিজ্য, শাসন, ঝুঁকি, জন-আখ্যান, শিল্পের সংক্রমণ—প্রতিটা মাত্রার ভিত্তি ওই তথ্যবিন্দুগুলো।
প্রথম ধাপ যদি শূন্য ফেরত দেয়, দ্বিতীয় ধাপ কিছুই করতে পারে না। কারণ বিশ্লেষণের নিয়ম হলো—তথ্য যেখানে নেই, সেখানে অনুমান নয়, স্পষ্টভাবে লিখতে হয়: অপর্যাপ্ত তথ্য, মূল্যায়ন করা সম্ভব নয়। একে বলে null handling।
স্কাউটিংয়ের সঙ্গে মিলটা এখানেই। স্কাউট মাঠে গিয়ে রিপোর্ট লেখে—সেটা প্রথম ধাপ। সিলেক্টর সেই রিপোর্ট পড়ে সিদ্ধান্ত নেয়—সেটা দ্বিতীয় ধাপ। সিলেক্টর কখনো খালি রিপোর্ট পেলে সিদ্ধান্ত নেয় না। কিন্তু আজকের ব্যবস্থায় রিপোর্টটা মাঝপথে হারিয়ে গেছে, আর উপরে বসে থাকা স্তরটি জানতেও পারছে না কী হারিয়েছে।
আমার গ্রাস লেজার মনে পড়ে। ২০১৭ সালে, ৫৪ বছর বয়সে, আমি সিলেট বিভাগের যুব ফুটবলের একটা হাতে-গড়া ডেটাবেস শুরু করি। এগারো মাসে ৯৬টা জেলা ও স্কুল ম্যাচে গিয়ে ৪১২ জন ষোলো-অনূর্ধ্ব খেলোয়াড় নথিভুক্ত করি—উচ্চতা, পছন্দের পা, স্প্রিন্ট স্প্লিট, পরিবারের আয়, নিজের বুট আছে কি না। তখন শিখেছিলাম: আর্কাইভ শুধু কী আছে তা নয়, কী নেই সেটাও নথিভুক্ত করে। The Grass Ledger does not record glory; it records who was there when the lights were off.
এখন মূল আবিষ্কার। একটা সম্পূর্ণ ফাঁকা ফাইল আর একটা ফাঁকা ফাইল—যার এক কোণে একটা লেবেল টিকে আছে—এই দুটো এক নয়। দ্বিতীয়টা বেশি বিপজ্জনক।
কারণ লেবেলটা একটা হুক। cricket_asia লিখিত থাকলে মনে হয় বিষয়টা এশিয়ার ক্রিকেট-পরিমণ্ডল—এসিসি, উপমহাদেশ, উপসাগরীয় নিরপেক্ষ ভেন্যু। কিন্তু এটা একটা দিকনির্দেশক অনুমানমাত্র, আস্থার মাত্রা নিম্ন। কোনো দল নেই, খেলোয়াড় নেই, ম্যাচ নেই, তারিখ নেই। শুধু একটা লেবেল।
ফাঁকা ঘর নিজে থেকে মিথ্যা বলে না; ভরাট করার তাড়নাটাই মিথ্যা তৈরি করে। একটা খালি বিশ্লেষণ-ফাইলকে যন্ত্র বা মানুষ—দুজনেই পূরণ করতে চায়। নাম বসাতে চায়। স্কোর বসাতে চায়। এখানেই আসল ঝুঁকি: নিচের স্তরে হ্যালুসিনেশন।
আমি খেলাধুলার আর্কাইভে এমন অনেক দেখেছি। When the 2026-20 Bangla season went quiet, I counted the 23 names that never came back. ৪১২ জন খেলোয়াড়ের সঙ্গে আবার যোগাযোগ করেছিলাম—৬১ জন অনুশীলন ছেড়ে দিয়েছে, ২৩ জন কখনো ফেরেনি। কিন্তু সেটা ছিল আসল অনুপস্থিতি, প্রকৃত নীরবতা। আজকের ফাইলটা ভিন্ন। এখানে অনুপস্থিতির কারণটা অজানা।
দুটো জিনিস দেখতে এক, ব্যাখ্যা সম্পূর্ণ আলাদা। বৃষ্টিতে ধুয়ে যাওয়া একটা ঋতু—সেটা প্রকৃতির তৈরি ফাঁক। আর একটা লোড হয়ে তারপর হারিয়ে যাওয়া তথ্যভাণ্ডার—সেটা অবকাঠামোর ব্যর্থতা। পাতায় দুটোই একই রকম শূন্য দেখায়। পার্থক্য বোঝার একমাত্র উপায়: ফাঁকের পাশে লেবেলটা কী বলে, আর সেটা কতটা আস্থার যোগ্য।
এশিয়ার ক্রিকেটে এই ফাঁক চেনা। অ্যাসোসিয়েট স্তরে বহু টুর্নামেন্টের স্কোরকার্ড এখনো অসম্পূর্ণ—কেউ কেউ খেলেছে, কিন্তু ওভার-বাই-ওভার হিসাব কোথাও নেই। কে কত রান করল, জানা যায়; কে টুকে রাখল, জানা যায় না। একসময় তথ্য ছিল; এখন সেটা খুঁজে পাওয়া যায় না। আজকের ফাইলটাও ঠিক তেমনি—একটা প্রতিবেদন নিশ্চিতভাবে কোথাও ছিল, নইলে একটা ডোমেইন-লেবেল আসত না। কিন্তু সেটা কোন ভাষায়, কোন তারিখে, কোন সূত্রে—কিছুই নেই।
এখানে একটা সংকেত স্পষ্ট। লেবেল আছে, তথ্যবিন্দু নেই। এই সমন্বয়টা সাধারণত ঘটে যখন সোর্স-টেক্সট উদ্ধার হয়েছে কিন্তু পার্স হয়নি, অথবা পার্স হয়েছে তারপর হারিয়ে গেছে। অর্থাৎ সমস্যাটা বিষয়বস্তুর নয়, প্রক্রিয়ার।
এখানে আমি Pedri-পদ্ধতির কথা ভাবি। ২০২১ সালের ইউরোয় আঠারো বছরের এক স্প্যানিশ মিডফিল্ডার ছয় ম্যাচে ৬২৯ মিনিট খেলেছিলেন; আমি মিনিট-সঞ্চয়নের একটা চার্ট বানিয়ে দেখিয়েছিলাম, হ্যামস্ট্রিং প্রথম ভাঙবে। পরে তাই হয়েছিল — Root: 2026 Pedri। পদ্ধতিটা ছিল—লোড গুনে ভবিষ্যৎ অনুমান করা।
এই ফাইলে লোড নেই, তাই ভাঙার জায়গাও অনুমান করা যায় না। তবু একটা কথা বলা যায়: যে ধাপ সোর্স থেকে তথ্য তুলে আনতে ব্যর্থ হয়, সেই ধাপই সবচেয়ে দুর্বল জোড়। একটা পাইপলাইনে সবচেয়ে বড় ফাঁক সাধারণত শেষে নয়, শুরুতে।
Esports taught me that a roster is a ruin: you can date it by who left. এই ফাইলের ক্ষেত্রেও সত্যি। কে বাদ পড়েছে, সেটা গুনে আমরা ফাইলের বয়স আর অবস্থা দুটোই অনুমান করতে পারি। এখানে সবাই চলে গেছে। একজন ছাড়া।
এখন প্রচলিত মতটা সৎভাবে বলি। একজন অভিজ্ঞ ডেটা-বিশ্লেষক ঠিকই বলবেন: এটা মূল্যহীন একটা খোলস। ফেলে দিন, প্রথম ধাপ আবার চালান। প্রক্রিয়াগতভাবে তিনি সম্পূর্ণ ঠিক। শূন্য ইনপুট থেকে বিশ্লেষণ দাবি করা বোকামি, আর অনুমান দিয়ে ঘর ভরানো আরও বড় বোকামি।
কিন্তু আমি একটু ভিন্ন জায়গায় আটকাই। প্রশ্নটা এই ফাইল দিয়ে কী বিশ্লেষণ করা যায়, সেটা নয়। প্রশ্নটা—এই ফাইলটাই যে তৈরি হলো, সেটা কী বলছে?
আমি ৪৭ বছর ধরে ক্রিকেটের নথি দেখছি। একটা জিনিস শিখেছি: খারাপ রেকর্ড কখনো নিছক খারাপ ভাগ্য নয়। পুনরাবৃত্তিটাই আসল খবর। একটা ফাইল শূন্য ফেরানো মানে কোনো ব্যক্তি ভুল করেনি; মানে একটা স্তর পদ্ধতিগতভাবে ফাঁক ফেলছে। আজকের খালি শিট কালকের ডিফল্ট: যদি কোনো ইনজেশন-স্তর নীরবে cricket_asia ছুড়ে দিতে পারে শূন্য তথ্যবিন্দু নিয়ে, সে পরের সপ্তাহেও তা করবে, পরের মাসেও—আর সেবার ফাইলটা হয়তো বেশি দামি হবে।

তাই আসল বিপদ খালি ফাইলটা নয়। আসল বিপদ হলো এর উপরে যা তৈরি হতে পারে। একটা সিস্টেম যদি ফাঁকা ঘর পূরণ করতে শেখে, সে নাম বানাবে। দল বানাবে। ফল বানাবে। আর সেই বানানো ফল যদি ছাপা হয়, কেউ ধরতে পারবে না—কারণ মূল সোর্সটাই আর নেই। এখানেই পাঠক আর বিশ্লেষকের মধ্যে একটা অলিখিত চুক্তি ভাঙে: পাঠক ধরে নেয় যেখানে লেখা আছে, সেখানে একটা সোর্স আছে।
At 63, I no longer chase the ball; I chase the minutes it left behind. এবার আমি সেই মিনিটগুলোও খুঁজে পেলাম না।
তাহলে সামনে কী দেখব? আমি তিনটা জিনিসে চোখ রাখছি। প্রথম ধাপ আবার চালালে তথ্যবিন্দুর ঘরটা খালি থাকে কি না—একটা তথ্যবিন্দু আর একটা নামযুক্ত সত্তা পেলেই বোঝা যাবে ধাপটা সচল। শিরোনাম, সূত্র আর ধরন—এই তিনটা ঘর আবার ভরে উঠলে ট্রেসেবিলিটি ফিরবে। আর cricket_asia লেবেলটা নতুন টেক্সটের সঙ্গে মেলে কি না, সেটাই ঠিক করে দেবে আমার আঁচ ভুল ছিল কি না।
আমি আজ কোনো খেলোয়াড়ের ভবিষ্যৎ নিয়ে লিখতে পারছি না, কোনো দলের গঠন নিয়ে নয়, কোনো লিগের বাণিজ্য নিয়ে নয়। শুধু একটা খালি শিট নিয়ে লিখতে পারছি। কিন্তু এটাও এক ধরনের নথি। A transfer fee is a surface find; the real artifact is the youth contract beneath it. সেই যুক্তিতে—ফলাফল হলো উপরের স্তর, আর সেটার নিচে যে প্রক্রিয়া, সেটাই আসল নিদর্শন।
আগামী সপ্তাহে যদি ওই ফাইলটা ভরে ওঠে, ভালো। আর যদি না ওঠে—আমি আজকের তারিখ লিখে রাখছি। কারণ নিখোঁজ মানুষের ফাইল আমরা সাধারণত খুঁজি অনেক দেরিতে, যখন নামটাও আর মনে থাকে না।
