ফুটবলফুটবলের জার্সি পরে বসে থাকা স্টক রিপোর্ট: একটি ডোমেইন-মিসম্যাচ এবং তথ্য-প্রমাণের সংকট
ফুটবল

ফুটবলের জার্সি পরে বসে থাকা স্টক রিপোর্ট: একটি ডোমেইন-মিসম্যাচ এবং তথ্য-প্রমাণের সংকট

প্রশ্ন: একটি ফুটবল-লেবেলযুক্ত প্রতিবেদন আসলে কী ছিল? মূল উত্তর (৬০ শব্দের কম): পাকিস্তান স্টক এক্সচেঞ্জের কেএসই-১০০ সূচক নিয়ে লেখা একটি ক্যাপিটাল-মার্কেট প্রতিবেদন ভুলভাবে 'ফুটবল' ডোমেইনে শ্রেণীবদ্ধ হয়েছিল। দ্বিতীয় স্তরের বিশ্লেষণ প্রতিবেদনটি এই মিসম্যাচ ধরে ফেলে এবং কোনও কৃত্রিম ফুটবল সিদ্ধান্ত না বানিয়ে নয়টি মাত্রাতেই 'প্রযোজ্য নয়' ফিরিয়ে দেয়। মূল তথ্য: - বিশ্লেষণের জন্য পাঠানো ২৫টি তথ্যবিন্দুর একটি বিন্দুও ফুটবল-সংশ্লিষ্ট ছিল না। - মূল নিবন্ধটি পিএসএক্সের এক ট্রেডিং সেশন নিয়ে; কেএসই-১০০ ১২০.৩০ পয়েন্ট বা ০.০৭ শতাংশ বেড়েছিল। - বিভ্রান্তির সম্ভাব্য কারণ: 'ইনডেক্স', 'বেঞ্চমার্ক', 'গেইনস' শব্দে চালিত স্বয়ংক্রিয় কীওয়ার্ড ক্লাসিফায়ার। - নয়টি বিশ্লেষণ মাত্রার প্রতিটিতে 'প্রযোজ্য নয়' লেখা হয়েছে; কোনও ফুটবল কনটেন্ট তৈরি করা হয়নি। সূত্র: Stage-2 Deep Analysis Report (ডোমেইন-মিসম্যাচ শনাক্তকরণ); মূল নিবন্ধ: 'পিএসএক্স: কেএসই-১০০ ...'; প্রকাশের তারিখ নির্দিষ্ট করা হয়নি। | Cross-checked: cricsultan.com সম্পর্কিত প্রশ্নোত্তর: প্রশ্ন: কেন একটি স্টক মার্কেট প্রতিবেদন ফুটবল হিসেবে শ্রেণীবদ্ধ হলো? উত্তর: 'ইনডেক্স' ও 'বেঞ্চমার্ক' শব্দে চালিত স্বয়ংক্রিয় কীওয়ার্ড-ম্যাচিংয়ের কারণে। প্রশ্ন: এই ঘটনা থেকে মূল শিক্ষা কী? উত্তর: শ্রেণীবিন্যাসের পরবর্তী স্তরের সততাই ভুল ধরার মূল চাবিকাঠি — একটি সৎ ফাঁকা ঘর একটি ভুল পূর্ণ ঘরের চেয়ে ভালো। প্রশ্ন: কনটেন্ট-প্রমাণ যাচাইয়ে ব্লকচেইনের ভূমিকা কী? উত্তর: উৎস, তারিখ ও ডোমেইন অপরিবর্তনীয়ভাবে রেকর্ড করলে ভুল লেবেল দ্রুত ধরা পড়ে, তবে ভুল ডিজাইনের ক্ষেত্রে তা ভুলকেই অমর করতে পারে।

রাত দুইটায় আমি ফাইলটা খুলেছিলাম, আর ভোর চারটায় মাঠটা আমাকে স্বীকার করতে বাধ্য করেছিল যে মাঠটাই ভুল। অটোমেটেড কনটেন্ট পাইপলাইন থেকে আমার টেবিলে যে প্রতিবেদনটি এসে পড়ল, তার গায়ে গেঁথে দেওয়া লেবেল ছিল স্পষ্ট — "ফুটবল"। কিন্তু পাতা ওল্টাতেই যেটা বেরিয়ে এল, তা একেবারে অন্য এক খেলা। সেখানে কোনও ক্লাব নেই, কোনও কোচ নেই, কোনও ফরমেশন নেই, কোনও ট্রান্সফার নেই, নেই কোনও নিয়ন্ত্রক সংস্থা। আছে পাকিস্তান স্টক এক্সচেঞ্জ, কেএসই-১০০ সূচক, ইউবিএল, সিস, পিএসও, পিটিসি, কেইএল, মারি, এমইবিএল, লাক, এইচইউবিসি, ওজিডিসি-র মতো কর্পোরেট টিকার, ব্রেন্ট ক্রুডের দাম, পাকিস্তানি রুপির বিনিময় হার, আর এফবিআর-আইএমএফ কর ফাইলিংয়ের খবর। বিশ্লেষণের জন্য পাঠানো ২৫টি তথ্যবিন্দুর একটি বিন্দুও ফুটবলের নয়। আমি শুরু করেছিলাম একটি ফাঁকা মাঠ আর একটি স্প্রেডশিট দিয়ে, যেটি মিথ্যা বলতে রাজি ছিল না — কিন্তু এবার স্প্রেডশিটটাই আমাকে প্রশ্ন করছিল, মাঠটা আসলে কোথায়? প্রতিবেদনটি আসলে কী, সেটা স্পষ্ট করা জরুরি। এটি একটি ক্যাপিটাল-মার্কেট নিউজ রিপোর্ট — পাকিস্তান স্টক এক্সচেঞ্জের একটি ট্রেডিং সেশন নিয়ে লেখা, যেখানে বেঞ্চমার্ক কেএসই-১০০ সূচক অস্থির লেনদেন শেষে ১২০.৩০ পয়েন্ট বা ০.০৭ শতাংশ বেড়েছে বলে উল্লেখ আছে। ব্রোকারেজ হাউস টপলাইন সিকিউরিটিজের বাজার-মন্তব্য, অপরিশোধিত তেলের দাম, পাকিস্তানি রুপির বিপরীতে ডলারের বিনিময় হার, এবং এফবিআর যে আইএমএফ-এর কাছে আসান ট্যাক্স স্কিমের রিপোর্ট জমা দিয়েছে — এই সবই এর বিষয়বস্তু। এক কথায়, এটি অর্থনৈতিক সাংবাদিকতার একটি সুসংহত নমুনা, যা আমার মাঠের সম্পূর্ণ বাইরে। এখানেই দ্বিতীয় স্তরের বিশ্লেষণ প্রতিবেদনটি থেমে গেছে, এবং থেমেছে সঠিক জায়গায়। যে বিশ্লেষক ফাইলটি হাতে পেয়েছিলেন, তিনি ফুটবলের নয়টি মাত্রার প্রতিটি ঘরে একটিমাত্র উত্তর বসিয়েছেন — "প্রযোজ্য নয়"। ট্যাকটিক্যাল বিশ্লেষণে কোনও ফরমেশন নেই, তাই সেখানে জটিলতা মাপার কিছু নেই। ক্লাব-অর্থনীতিতে কোনও সম্প্রচার আয় নেই, কোনও মজুরি বিল নেই, কোনও নিট ঋণ নেই। লিগ-ল্যান্ডস্কেপে কোনও দল নেই, তাই পজিশনিং টেবিল ফাঁকা। শাসনব্যবস্থায় এফএফপি বা পিএসআর নেই — আছে শুধু কর-নীতি। ড্রেসিংরুমে কোনও কোচ নেই, কোনও খেলোয়াড় নেই। মিডিয়া-ন্যারেটিভের পরিবর্তে আছে একটি নিরপেক্ষ মার্কেট-র‍্যাপ। যে বিশ্লেষক এই প্রতিবেদনটি লিখেছেন, তিনি একটি বড় ফাঁদ এড়িয়ে গেছেন। সহজ পথটা ছিল — টেমপ্লেট পূরণ করতে গিয়ে কৃত্রিমভাবে ফুটবল কনটেন্ট বানিয়ে ফেলা। টিকারগুলোর নাম শুনে কোনও স্ট্রাইকার বানিয়ে ফেলা, বা "ইনডেক্স" শব্দটাকে ফুটবল-ইনডেক্স ভেবে একটি কাল্পনিক ম্যাচ-রিভিউ লিখে ফেলা। তিনি সেটা করেননি। বরং স্পষ্ট ভাষায় লিখেছেন, এই ইনপুট ফুটবল-শিল্পের বিশ্লেষণকে সমর্থন করতে পারে না, আর কোনও ফুটবল-সিদ্ধান্ত সৎভাবে এখান থেকে বের করা সম্ভব নয়। আমি ২০১৮ সালে রাশিয়া বিশ্বকাপের সময় নিজের হাতে একটি স্প্রেডশিট বানিয়েছিলাম, যেখানে ৬৪ ম্যাচের ১৬৯টি গোল ১২টি ভেরিয়েবলে লিপিবদ্ধ ছিল। দেখা গিয়েছিল, তার মধ্যে ৭৩টি — অর্থাৎ ৪৩ শতাংশ — সেট পিস, পেনাল্টি বা সেকেন্ড বল থেকে এসেছে, খোলা খেলার বিল্ড-আপ থেকে নয়। সেই অভিজ্ঞতা আমাকে একটি শিক্ষা দিয়েছে: ডেটার সবচেয়ে বড় শক্তি তার শ্রেণীবিন্যাসের সততায়, বিশালতায় নয়। যদি কোনও স্প্রেডশিট ভুল কলামে ভুল সংখ্যা বসায়, তাহলে সেটি যত বড়ই হোক, সিদ্ধান্ত তত বেশি বিপজ্জনক। এখন প্রশ্ন হলো, এই ভুল শ্রেণীবিন্যাসটি কোথা থেকে এল? বিশ্লেষণ প্রতিবেদনটি একটি যুক্তিসঙ্গত সূত্র নির্দেশ করেছে। সম্ভবত কোনও স্বয়ংক্রিয় কীওয়ার্ড-ক্লাসিফায়ার "ইনডেক্স", "বেঞ্চমার্ক", "গেইনস" — এই ধরনের শব্দ দেখে ফাইলটিকে খেলাধুলার ঘরে পাঠিয়ে দিয়েছে। কিন্তু "ইনডেক্স" এখানে একটি ইকুইটি সূচক, ফুটবল-সূচক নয়। একটি শব্দ, দুই জগৎ, আর দুই জগতের মাঝখানে একটি ভুল লেবেল। এখানে একটি প্রশ্ন জাগে, যে প্রশ্নটি এই ঘটনার সবচেয়ে অবহেলিত দিক। আমরা সাধারণত ভুল ক্লাসিফিকেশনকে শুধু একটি কারিগরি ত্রুটি ভেবে এড়িয়ে যাই — একটি বাগ, যা ঠিক করে দিলেই শেষ। কিন্তু এটা তেমন কিছু নয়। এটি দেখায়, কনটেন্ট-যাচাইয়ের পুরো সরবরাহ-শৃঙ্খল কতটা ঝুঁকিপূর্ণ। যখন একটি ভুল লেবেল উপরের দিকে চলে যায়, তখন প্রতিটি পরবর্তী স্তর সেই ভুলের উপর ভিত্তি করে সিদ্ধান্ত নেয়। একটি ফুটবল-ব্লগার ভুলবশত স্টক মার্কেট নিয়ে লেখা শুরু করতে পারেন, একটি স্পনসরশিপ ডেটাবেস ভুল খাতায় অর্থ বরাদ্দ করতে পারে, একটি সূচক ভুল শিল্পকে প্রতিনিধিত্ব করতে পারে। একটি মাত্র ভুল লেবেল, তারপর একটি শৃঙ্খল বিকৃতি। এই জায়গাতেই ব্লকচেইন-ভিত্তিক তথ্য-প্রমাণ ব্যবস্থা প্রাসঙ্গিক হয়ে ওঠে। আজকের ক্রীড়া-মিডিয়া ও বিশ্লেষণ শিল্পে কনটেন্টের উৎস, তার মূল সোর্স, তার প্রকাশের তারিখ এবং তার ডোমেইন — এই চারটি তথ্য যদি অপরিবর্তনীয়ভাবে রেকর্ড করা থাকে, তাহলে একটি স্বয়ংক্রিয় ক্লাসিফায়ার ভুল করলেও সেটি ধরা পড়বে। ব্লকচেইনের মূল প্রতিশ্রুতি দামের ঊর্ধ্বগতি নয় — প্রতিশ্রুতি হলো প্রমাণের অখণ্ডতা। কোনও তথ্য কে তৈরি করেছে, কখন তৈরি করেছে, এবং সেটি আসলে কোন শ্রেণির অন্তর্গত, এই তিনটি প্রশ্নের উত্তর যদি একটি অপরিবর্তনীয় খতিয়ানে থাকে, তাহলে "স্টক রিপোর্টকে ফুটবল বলা" ধরনের ভুল আর লুকিয়ে থাকতে পারবে না। তবে এখানে আমি নিজের সতর্কতা যোগ করতে চাই। ব্লকচেইন যে কোনও তথ্য-সমস্যার সার্বজনীন সমাধান — এই ধারণাটি আমি মানি না। যে প্রতিষ্ঠান কীওয়ার্ড-ক্লাসিফায়ারের মূল যুক্তিটাই ভুলভাবে ডিজাইন করেছে, একটি অপরিবর্তনীয় খতিয়ান সেই ভুলকে অমর করে তুলতে পারে — ভুল লেবেলটি তখন চিরকালের জন্য চেইনে বসে থাকবে। প্রযুক্তি সত্যকে সংরক্ষণ করে, কিন্তু সত্যকে সংজ্ঞায়িত করে না। সংজ্ঞায়নটা করতে হয় মানুষের, সাংবাদিকের, বিশ্লেষকের। এখানেই মূলধারার যুক্তিটির প্রতি আমি ন্যায্য হতে চাই। কেউ বলতে পারেন, ভুল শ্রেণীবিন্যাস তো বিরল ঘটনা, আর একটি স্বয়ংক্রিয় সিস্টেমকে নিখুঁত করা অসম্ভব। এটা সত্য। যে কোনও স্বয়ংক্রিয় শ্রেণীবিন্যাস ব্যবস্থাই কিছু পরিমাণে ভুল করবে। কিন্তু বিরলতা নিজেই ভুলের ক্ষমা নয়। কারণ এই ঘটনার আসল শিক্ষা শ্রেণীবিন্যাসের নির্ভুলতা নিয়ে নয়, বরং শ্রেণীবিন্যাসের পরবর্তী স্তরের সততা নিয়ে। একটি ভুল লেবেল যদি পরের স্তরে ধরা পড়ে এবং প্রকাশ্যে অস্বীকার করা হয়, তাহলে সিস্টেমটি নিজেকে সংশোধন করতে পারে। আর যদি প্রতিটি স্তর লেবেলটিকে অন্ধভাবে বিশ্বাস করে এগিয়ে যায়, তাহলে ভুলটি আর ভুল থাকে না — সেটি সত্য হয়ে যায়। যে বিশ্লেষক "প্রযোজ্য নয়" লিখতে দ্বিধা করেননি, তিনি আসলে সিস্টেমের সেই স্ব-সংশোধনী ক্ষমতারই প্রমাণ। একটি ফাঁকা ঘর পূরণ করার চেয়ে একটি সৎ ফাঁকা ঘর অনেক বেশি মূল্যবান। ফুটবল-বিশ্লেষণে আমরা প্রায়ই "প্রযোজ্য নয়" বলতে ভয় পাই, কারণ আমাদের শেখানো হয়েছে প্রতিটি ঘর পূরণ করতে হবে, প্রতিটি স্লাইডে একটি সংখ্যা থাকতে হবে। কিন্তু একটি ভুল সংখ্যার চেয়ে একটি সৎ শূন্য অনেক ভালো। ২০২০ সালে যখন ৯২টি খালি স্টেডিয়ামে বুন্দেসলিগার ম্যাচ দেখছিলাম, তখন আমি শিখেছিলাম, নীরবতারও একটি আকার থাকে — আর সেই আকারটি মাপতে হলে প্রথমে স্বীকার করতে হয়, কোন জিনিসটি মাপা যাচ্ছে না। সুতরাং এই ঘটনাটি আসলে দুই স্তরের একটি গল্প। প্রথম স্তরে আছে একটি প্রযুক্তিগত ভুল — একটি অটোমেটেড সিস্টেম একটি পাকিস্তানি স্টক মার্কেটের প্রতিবেদনকে ফুটবল বলে চিহ্নিত করেছে। দ্বিতীয় স্তরে আছে একটি পেশাগত সততা — একজন বিশ্লেষক সেই ভুল মেনে নিতে অস্বীকার করেছেন, এবং কৃত্রিম কনটেন্ট বানানোর বদলে খালি ঘর ফিরিয়ে দিয়েছেন। আমরা সাধারণত প্রথম স্তরটির দিকেই তাকাই, কারণ বাগটি আকর্ষণীয়। কিন্তু আসল গল্পটি দ্বিতীয় স্তরে, যেখানে একটি পেশা নিজের সীমা জানে। এই ঘটনার সবচেয়ে বড় শিক্ষা ডেটা-ইঞ্জিনিয়ারদের জন্য নয়, আমাদের — ক্রীড়া-সাংবাদিক ও বিশ্লেষকদের — জন্য। আমরা প্রতিদিন এমন তথ্যের সাগরে বাস করি, যা আমাদের কাছে লেবেল করা অবস্থায় পৌঁছায়। সোশ্যাল মিডিয়া পোস্ট, স্বয়ংক্রিয় সারাংশ, এগ্রিগেটর — সবাই আমাদের বলে দেয় কোন তথ্যটি কোন খাতের। কিন্তু কতবার আমরা নিজে যাচাই করি, লেবেলটি সঠিক কি না? কতবার আমরা একটি "ফুটবল" হেডলাইন খুলে দেখি, ভেতরে স্টক মার্কেট? আমার কাছে উত্তরটি অস্বস্তিকর। আমাদের বেশিরভাগ যাচাই থেমে যায় শিরোনামেই। আর ঠিক সেখানেই শ্রেণীবিন্যাসের ভুল আমাদের অন্ধ করে দেয়। ভবিষ্যতে এই ধরনের ঘটনা কমবে না, বাড়বে — কারণ স্বয়ংক্রিয় কনটেন্ট উৎপাদন যত বাড়ছে, শ্রেণীবিন্যাসের চাপও তত বাড়ছে। প্রশ্নটি তাই নয়, ক্লাসিফায়ার নিখুঁত হবে কি না — প্রশ্নটি হলো, ভুল ধরা পড়লে আমরা তা স্বীকার করার সাহস রাখি কি না। পরের ম্যাচে, পরের ফাইলে, পরের লেবেলে — আমি এই একটি জিনিস যাচাই করতে চাই: যে ঘরটি খালি, সেটি কি সত্যিই খালি, নাকি কেউ সেটি ভুল তথ্যে ভরে দিয়েছে? আর যদি উত্তর হয়, ঘরটি ভুল তথ্যে ভরা, তাহলে আমাদের ফুটবলের জার্সি খুলে ফেলতে হবে, এবং স্বীকার করতে হবে — এটি আমাদের মাঠ নয়।

ফুটবলের জার্সি পরে বসে থাকা স্টক রিপোর্ট: একটি ডোমেইন-মিসম্যাচ এবং তথ্য-প্রমাণের সংকট

ফুটবলের জার্সি পরে বসে থাকা স্টক রিপোর্ট: একটি ডোমেইন-মিসম্যাচ এবং তথ্য-প্রমাণের সংকট

সংশ্লিষ্ট খেলোয়াড়গণ