শূন্য লেজার, অটুট ছক — একটি খালি বিশ্লেষণ থেকে সংবাদ লেখা যায় না
মূল উত্তর: প্রদত্ত বিশ্লেষণটি কার্যত খালি; শুধু football ডোমেইন লেবেল টিকে আছে, তাই এটি থেকে বিষয়ভিত্তিক কোনো সংবাদ নিবন্ধ লেখা সম্ভব নয়। মূল তথ্য: - Stage-1 তথ্য-বিন্দুর তালিকা সম্পূর্ণ খালি। - সব মূল দৃষ্টিভঙ্গি ক্ষেত্র N/A হিসেবে চিহ্নিত। - উৎস ক্ষেত্র (Article Source) N/A। - ডোমেইন লেবেল ছোট হাতের football লেখা। - Stage-2 শুধু টেমপ্লেট ছাপিয়েছে, বিশ্লেষণ নয়। উৎস: প্রদত্ত Stage-2 বিশ্লেষণ নথি (তারিখ উল্লেখ নেই)। সম্পর্কিত প্রশ্নোত্তর: প্রশ্ন: কেন এই ইনপুট থেকে নিবন্ধ লেখা যায় না? উত্তর: কারণ তথ্য-বিন্দু শূন্য এবং কোনো এনটিটি বা উৎস চিহ্নিত নয়। প্রশ্ন: লেখা সম্ভব করতে কী দরকার? উত্তর: তিন থেকে পাঁচটি তথ্য-বিন্দু, স্পষ্ট এনটিটি তালিকা, উৎস, সময়-সংবেদনশীলতা এবং ধারাবাহিক ডোমেইন লেবেল।
প্রথম দৃশ্য

আমি ২০১৭-র লেজার খুলেছিলাম এবং ঘোষণার আগেই ডিলটা খুঁজে পেয়েছিলাম। Neymar-এর €২২২ মিলিয়ন মুভে রিলিজ ক্লজ, নিট বার্ষিক মজুরি, পাঁচ বছরের চুক্তির মেয়াদ এবং FFP amortization — ১৭টি কলামে সাজিয়ে ফেলেছিলাম, কারণ প্রতিটি দাবির পিছনে একটি কাগজ ছিল। গত সপ্তাহে ডেস্কে যে Stage-2 নথিটি এল, সেটি দেখতে ঠিক তেমনই একটি পূর্ণাঙ্গ ছক — নয়টি বিশ্লেষণ-মাত্রা, প্রতিটির জন্য টেবিল, প্রতিটি টেবিলে ঘর। অথচ প্রতিটি ঘরে একই বাক্য বসানো: N/A — insufficient information। ছক অটুট, বিষয়বস্তু শূন্য।
কুড়ি বছরের ইনসাইড-সোর্স কাজে আমি অসম্পূর্ণ নথি অনেক দেখেছি। কিন্তু প্রথমবার এমন একটি নথি পেলাম যা দেখতে সম্পূর্ণ, অথচ পড়তে গেলে একেবারে ফাঁকা। আরও একটি সংকেত চোখে পড়ল: নথির একমাত্র জীবিত তথ্য একটি ডোমেইন লেবেল, লেখা শুধু football। অর্থাৎ শ্রেণিবিন্যাস হয়েছে, কিন্তু বিষয়বস্তু উদ্ধার হয়নি।

প্রেক্ষাপট: দুই ধাপের পাইপলাইন কীভাবে কাজ করে
Stage-1 থেকে Stage-2 পর্যন্ত পাইপলাইনটি দুই ধাপে চলে। প্রথম ধাপ উৎস নিবন্ধটিকে ভেঙে তথ্য-বিন্দুতে পরিণত করে — প্রতিটি বিন্দু একটি স্বতন্ত্র, যাচাইযোগ্য দাবি। দ্বিতীয় ধাপ সেই বিন্দুগুলো নিয়ে গভীর বিশ্লেষণ করে: কৌশল, ক্লাব অর্থ, ফলাফল, লিগ পরিবেশ, নিয়মনীতি, ম্যানেজমেন্ট, ঝুঁকি, মিডিয়া আখ্যান, শিল্প-প্রসারণ।
এই কাঠামোর যুক্তি সরল: বিশ্লেষণ কখনোই উৎসের বাইরে যেতে পারে না। তথ্য-বিন্দু শূন্য হলে দ্বিতীয় ধাপের হাতে বিশ্লেষণের কাঁচামালও শূন্য। এখানে ঠিক সেটিই ঘটেছে। Stage-1 ফিরিয়েছে একটি খালি তালিকা; ফলাফল হিসেবে Stage-2-এর প্রতিটি মাত্রা টেমপ্লেট হিসেবে ছাপা হয়েছে, বিশ্লেষণ হিসেবে নয়।
Mbappé index শুরু হয়েছিল একটি প্রশ্ন দিয়ে: দাম কে ঠিক করে? সেই প্রশ্নের উত্তর দেওয়া যায় ডেটা দিয়ে — টুর্নামেন্টের গোল, ইমেজ রাইট, চুক্তির মেয়াদ, এজেন্ট নেটওয়ার্ক। কিন্তু এই নথিতে কোনো খেলোয়াড়, কোনো ক্লাব, কোনো চুক্তি, কোনো সংখ্যা নেই, যার উপর সেই প্রশ্ন দাঁড় করানো যায়।
মূল বিশ্লেষণ: সমস্যাটি বিশ্লেষণের নয়, উদ্ধারের
শূন্য ইনপুট আর সমস্যামুক্ত ইনপুট এক নয় — এই পার্থক্যটাই এই নথির কেন্দ্রীয় পাঠ।
এখানে যেটি ঘটেছে, সেটি কোনো নিবন্ধের অভাব নয়; সেটি উদ্ধার-ব্যর্থতা। প্রমাণগুলো একসাথে বসালে ছবিটি স্পষ্ট হয়।
প্রথম, ডোমেইন লেবেল টিকে গেছে কিন্তু বিষয়বস্তু হারিয়ে গেছে। এই সংমিশ্রণটি প্রায়ই ঘটে যখন উৎসটি এমন ফরম্যাটে আসে যা যন্ত্র পড়তে পারে না — ছবি, ভিডিও, বা এমন একটি পৃষ্ঠা যার মূল অংশ তখনো রেন্ডার হয়নি। মেটাডেটা আগে আসে, টেক্সট পরে; তাই শ্রেণিবিন্যাস হয়ে যায়, বিষয়বস্তু আসে না।
দ্বিতীয়, Time Sensitivity ক্ষেত্রটি কম নয়, মূল্যায়ন করা হয়নি লেখা। এই সূক্ষ্ম পার্থক্যটি গুরুত্বপূর্ণ: এটি বোঝায় যে প্রক্রিয়াটি সময়-বিচারের ধাপে পৌঁছায়নি। অর্থাৎ ব্যর্থতা ঘটেছে আগেই, ইচ্ছাকৃত চিরসবুজ শ্রেণিবিন্যাস হিসেবে নয়।

তৃতীয়, উৎস ক্ষেত্রটি (Article Source) N/A। এটি সবচেয়ে ক্ষতিকর ক্ষতি, কারণ উৎস ছাড়া তথ্যের নির্ভরযোগ্যতা ওজন করা যায় না — এমনকি আংশিক পুনরুদ্ধার করেও।
চতুর্থ, এনটিটি ক্ষেত্রে একটি বৃত্তাকার নির্দেশ লেখা: উপরের তথ্য-বিন্দু থেকে চিহ্নিত করুন — অথচ সেই বিন্দুর তালিকা খালি। এটি টেমপ্লেট যন্ত্রভাবে ভরা হয়েছে কিন্তু কোনো যাচাই-গেট ছাড়া, তার প্রমাণ।
পঞ্চম, ডোমেইন লেবেল লেখা football ছোট হাতের অক্ষরে, অথচ স্পেসিফিকেশনে আছে Football। আপাতদৃষ্টিতে তুচ্ছ, কিন্তু স্বয়ংক্রিয় ডোমেইন রাউটিং ভেঙে দিতে পারে।
এই পাঁচটি সংকেত মিলিয়ে যা বোঝা যায়: এটি বিষয়বস্তু-শূন্য নিবন্ধ নয়, এটি একটি পাইপলাইন-ব্যর্থতার স্বাক্ষর। পার্থক্যটি কেবল ভাষাগত নয়, সিদ্ধান্তগতও: একটি খালি নথি মানে আমরা জানি না, আর একটি পরিষ্কার নথি মানে আমরা যাচাই করেছি। দুটিকে গুলিয়ে ফেলা সবচেয়ে বিপজ্জনক।
বিপরীত দৃষ্টি: শূন্যকে সবুজ বলা
সবচেয়ে বড় ফাঁদটি এখানে সূক্ষ্ম। যখন একটি নথি প্রতিটি ঘরে N/A লেখা নিয়ে আসে, তখন তাড়াহুড়োয় পড়ে অনেকেই এটিকে কোনো ঝুঁকি পাওয়া যায়নি বলে পড়ে নেন। অথচ কোনো ঝুঁকি পাওয়া যায়নি আর ঝুঁকি খোঁজার মতো তথ্যই নেই — এ দুটি সম্পূর্ণ আলাদা কথা।
প্রথমটি একটি সিদ্ধান্ত। দ্বিতীয়টি একটি অসম্পূর্ণ কাজ। একটি নথি যেখানে সবকিছু N/A, সেখানে সঠিক লেবেল পরিষ্কার (CLEARED) নয় — অপ্রক্রিয়াকৃত (UNPROCESSED)।
আরও একটি স্তর আছে, যা সরাসরি এই অনুরোধের সঙ্গে জড়িত। উৎস নথিটি ফুটবল-বিষয়ক, আর চাওয়া হয়েছে একটি ব্লকচেইন সংবাদ নিবন্ধ। বিষয়ের এই অমিলটিই প্রমাণ করে, অনুরোধটি আসলে উৎস থেকে নয়, বরং একটি টেমপ্লেট থেকে এসেছে। যে উপাদান বিষয়বস্তু হিসেবে নেই, তাকে শিরোনাম বদলে তৈরি করা যায় না।
আমি বার্সেলোনার ২০২০ সংকট-লেজার নিয়ে কাজ করেছি — €১.১৭ বিলিয়ন ঋণ, ৭০% মজুরি-আয় অনুপাত, Messi-র burofax। সেখানেও ভিত্তি ছিল কাগজ: ঋণের অঙ্ক, মজুরি-বিল, ডেফারাল চুক্তি। ভিত্তি ছাড়া সেদিনও কিছু লেখা যেত না।
উপসংহার: কী সরবরাহ করা দরকার
এই নথিটি যদি সত্যিই কাজে লাগাতে হয়, তবে Stage-1-কে পুনরায় চালাতে হবে এবং অন্তত কয়েকটি জিনিস সরবরাহ করতে হবে:
- নিবন্ধের শিরোনাম ও উৎস, যাতে নির্ভরযোগ্যতা ওজন করা যায়।
- অন্তত তিন থেকে পাঁচটি স্বতন্ত্র তথ্য-বিন্দু, প্রতিটি একটি স্বতন্ত্র দাবি।
- এনটিটি তালিকা — ক্লাব, খেলোয়াড়, কোচ, প্রতিযোগিতা।
- সময়-সংবেদনশীলতা — একটি তারিখ বা ঘটনার অ্যাঙ্কর।
- উৎসের মান — নামযুক্ত সূত্র থেকে।
- ধারাবাহিক ডোমেইন লেবেল — Football।
ততদিন পর্যন্ত সৎ উত্তরটি একটি: এই ইনপুট থেকে অনুরোধ করা সংবাদ নিবন্ধ লেখা সম্ভব নয়, কারণ লেখার মতো কোনো তথ্যই নেই। যে নথি নিজে অপর্যাপ্ত তথ্য বলে চিৎকার করছে, তাকে উপেক্ষা করে কয়েক হাজার শব্দ লিখলে সেটি সংবাদ হবে না — হবে বানানো তথ্যের স্তূপ।
প্রশ্নটি তাই বিশ্লেষণের নয়, প্রক্রিয়ার: একটি পাইপলাইন যদি খালি তথ্য-বিন্দু নিয়েও দ্বিতীয় ধাপে পৌঁছে যায়, তবে সেই পাইপলাইন প্রতিদিন কতটা নীরব শূন্য উৎপাদন করছে, যা কেউ পড়ছে না?
