হোমফুটবলশূন্য ইনপুট, ভুয়া আউটপুট: কনটেন্ট পাইপলাইনে ব্লকচেইন কীভাবে সত্যের সীলমোহর বসায়

শূন্য ইনপুট, ভুয়া আউটপুট: কনটেন্ট পাইপলাইনে ব্লকচেইন কীভাবে সত্যের সীলমোহর বসায়

**মূল উত্তর:** ব্লকচেইন কনটেন্ট পাইপলাইনে ডেটা প্রোভেন্যান্স নিশ্চিত করে ক্রিপ্টোগ্রাফিক হ্যাশ ও অন-চেইন অ্যাটেস্টেশনের মাধ্যমে। প্রতিটি ধাপের ইনপুট ও আউটপুট হ্যাশ করে চেইনে লেখা হলে, শূন্য ইনপুট থেকে তৈরি ভুয়া আউটপুট কাঠামোগতভাবেই ধরা পড়ে। ব্লকচেইন গুণমান বিচার করে না, কেবল উৎস ও ধারাবাহিকতা প্রমাণ করে। **মূল তথ্য:** - C2PA জোট ২০২১ সালের ফেব্রুয়ারিতে Adobe, Microsoft, BBC, Intel, Arm ও Truepic নিয়ে গঠিত হয়। - EU AI Act (Regulation (EU) 2024/1689) ১ আগস্ট ২০২৪-এ কার্যকর; বেশিরভাগ বাধ্যবাধকতা প্রযোজ্য ২ আগস্ট ২০২৬ থেকে। - বিটকয়েনের জেনেসিস ব্লক ৩ জানুয়ারি ২০০৯-এ মাইন করা হয়। - IPFS-এ কনটেন্ট আইডেন্টিফায়ার (CID) বিষয়বস্তুর ক্রিপ্টোগ্রাফিক হ্যাশ থেকে তৈরি হয়। - GDPR-এর অনুচ্ছেদ ১৭ মুছে ফেলার অধিকার দেয়, যা ব্লকচেইনের অপরিবর্তনীয়তার সঙ্গে সংঘর্ষে পড়ে। **সূত্র:** Stage-2 ডিপ প্রফেশনাল অ্যানালাইসিস নথি (নয়টি বিশ্লেষণাত্মক মাত্রা, প্রতিটিতে পর্যাপ্ত তথ্য নেই)। নথিতে প্রকাশের তারিখ উল্লিখিত নেই; তাই তারিখ অনুমান করা হয়নি। **সম্পর্কিত প্রশ্নোত্তর:** প্রশ্ন: ব্লকচেইন কি AI-এর ভুল তথ্য ঠেকাতে পারে? উত্তর: না — ব্লকচেইন ভুল তথ্য ঠেকায় না, বরং উৎস ও পরিবর্তনের প্রমাণ রাখে, ফলে ভুল ধরা পড়া সহজ হয়। প্রশ্ন: অন-চেইন সংরক্ষণ ব্যয়বহুল কেন? উত্তর: Ethereum মেইননেটে প্রতিটি বাইটের গ্যাস খরচ থাকে, তাই সাধারণত কেবল হ্যাশ অন-চেইনে লেখা হয় এবং মূল ডেটা অফ-চেইনে থাকে। প্রশ্ন: GDPR-এর সঙ্গে ব্লকচেইনের সংঘর্ষ কোথায়? উত্তর: GDPR-এর অনুচ্ছেদ ১৭ মুছে ফেলার অধিকার দেয়, কিন্তু ব্লকচেইনের অপরিবর্তনীয়তা ডেটা স্থায়ীভাবে সংরক্ষিত রাখে।

আমি লিখতে শিখেছি শেষ বাঁশি বাজার পরের কুড়ি মিনিটে। মাঠ খালি হয়ে যায়, ক্যামেরা সরে যায়, আর ঠিক তখনই আসল হিসাবটা শুরু হয়। আজ আমার হাতে যে নথিটি এসেছে, সেটি সেই মুহূর্তের মতোই — একটি বিশ্লেষণী কাঠামো, নয়টি স্তম্ভ, অথচ প্রতিটি ঘরে একটাই বাক্য: পর্যাপ্ত তথ্য নেই। খেলার স্কোরবোর্ড যদি এমন হতো, কেউ বুঝত না ম্যাচটি আদৌ হয়েছে কি না।

শূন্য ইনপুট, ভুয়া আউটপুট: কনটেন্ট পাইপলাইনে ব্লকচেইন কীভাবে সত্যের সীলমোহর বসায়

পঞ্চাশ বছরের বেশি সময় ধরে আমি ডেটার সঙ্গে কাজ করেছি। পরিসংখ্যানের ডিগ্রি নিয়ে মাঠে ঢুকেছিলাম, কিন্তু শীঘ্রই বুঝেছিলাম সংখ্যা কখনো ভবনের ভিত্তি, কখনো শুধু ভারা। এই নথিটি আমাকে সেই পুরনো শিক্ষাই ফিরিয়ে দিল, তবে নতুন পোশাকে। এখানে যা ধরা পড়েছে, তা কোনো একক প্রতিবেদকের ভুল নয় — এটি একটি স্বয়ংক্রিয় কনটেন্ট পাইপলাইনের কাঠামোগত সমস্যা। পাইপলাইন অটুট, স্থাপত্য নিখুঁত, শুধু ভেতরে কোনো তথ্য নেই। বিপদটা এখানেই: মানুষ শূন্যতা দেখে থেমে যায়, মেশিন শূন্যতা দেখে বানিয়ে বলে।

আধুনিক কনটেন্ট উৎপাদন মূলত তিন ধাপে চলে। প্রথম ধাপ ইনজেশন — কাঁচা লেখা, ডেটা বা রেকর্ড সংগ্রহ। দ্বিতীয় ধাপ এক্সট্রাকশন — সেই কাঁচা উপাদান থেকে তথ্যবিন্দু, সত্তা ও দাবি চিহ্নিত করা। তৃতীয় ধাপ জেনারেশন — সেই চিহ্নিত উপাদান থেকে নতুন লেখা তৈরি। এই তিন ধাপের যেকোনো একটিতে নীরব ব্যর্থতা ঘটতে পারে, আর বাইরে থেকে দেখে বোঝার উপায় থাকে না।

এখানেই আসে ডেটা প্রোভেন্যান্স বা উৎস-সত্যতার প্রশ্ন। প্রোভেন্যান্স কেবল এই নয় যে ডেটাটি কোথা থেকে এসেছে — এটি এই প্রশ্নও করে, এই মুহূর্তে ডেটাটি ঠিক কী ছিল, আর তার আগে ও পরে কী ছিল। ক্রিপ্টোগ্রাফির সহজ হাতিয়ার হলো হ্যাশ ফাংশন, যেমন SHA-256। যেকোনো দৈর্ঘ্যের ডেটা একটি নির্দিষ্ট দৈর্ঘ্যের স্ট্রিংয়ে রূপান্তরিত হয়, এবং এক বাইট বদলালে সেই স্ট্রিং সম্পূর্ণ বদলে যায়। ফলে দুটি জিনিস প্রমাণ করা সম্ভব: একটি নির্দিষ্ট সময়ে ডেটাটি কী ছিল, এবং দুটি ডেটা একই কি না।

কনটেন্ট-অ্যাড্রেসিং এই ধারণারই বাস্তব রূপ। ইন্টারনেটে সাধারণত ফাইল চেনা হয় তার নাম বা ঠিকানা দিয়ে, যা বদলে যেতে পারে। IPFS-এর মতো ব্যবস্থায় ফাইল চেনা হয় তার বিষয়বস্তুর হ্যাশ দিয়ে, যাকে বলা হয় CID বা কনটেন্ট আইডেন্টিফায়ার। নাম বদলাতে পারে, কিন্তু বিষয়বস্তু বদলালে হ্যাশ বদলাবে — তাই নামের আড়ালে কিছু লুকিয়ে রাখা কঠিন।

ব্লকচেইন এখানে যোগ করে সময় ও ধারাবাহিকতা। একটি ব্লকচেইনে প্রতিটি ব্লক তার আগের ব্লকের হ্যাশ ধারণ করে, ফলে একটির পর একটি পরিবর্তন করলে পুরো শৃঙ্খল ভেঙে পড়ে। অনেক লেনদেনের হ্যাশ একটি মার্কেল ট্রি-তে সাজিয়ে শুধু মূল হ্যাশটি চেইনে লেখা যায় — এতে খরচ কমে, প্রমাণ থাকে। বিটকয়েনের জেনেসিস ব্লক ৩ জানুয়ারি ২০০৯-এ মাইন করা হয়েছিল, এবং সেই মুহূর্ত থেকে সময়ের সঙ্গে ডেটার অস্তিত্ব প্রমাণ করার একটি সর্বজনীন স্মারক তৈরি হয়েছে।

শূন্য ইনপুট, ভুয়া আউটপুট: কনটেন্ট পাইপলাইনে ব্লকচেইন কীভাবে সত্যের সীলমোহর বসায়

ভাবুন, একটি কনটেন্ট পাইপলাইনের প্রতিটি ধাপে যদি একটি স্বাক্ষরিত অ্যাটেস্টেশন লেখা হতো। ইনজেশনের পর লেখা হতো: কাঁচা নথির হ্যাশ = X। এক্সট্রাকশনের পর লেখা হতো: তথ্যবিন্দুর হ্যাশ = Y, এবং তার পিতৃ-হ্যাশ = X। জেনারেশনের পর লেখা হতো: আউটপুটের হ্যাশ = Z, পিতৃ-হ্যাশ = Y। এখন যদি এক্সট্রাকশন শূন্য তথ্য ফেরত দেয়, তবে Y অনুপস্থিত থাকবে, আর Z-এর কোনো বৈধ পিতৃ-হ্যাশ থাকবে না। অর্থাৎ শূন্য ইনপুট থেকে তৈরি ভুয়া আউটপুট কাঠামোগতভাবেই ধরা পড়বে — কাউকে সন্দেহ করার দরকার হবে না।

এটি স্মরণ রাখা জরুরি: ব্লকচেইন গুণমান বিচার করে না, সত্যতা বিচার করে না — এটি কেবল উৎস ও ধারাবাহিকতা প্রমাণ করে। একটি লেজার রায় দেয় না, সে কেবল সাক্ষ্য সংরক্ষণ করে। এই পার্থক্যটাই সবচেয়ে বেশি ভুল বোঝা হয়।

প্রযুক্তিটি নতুন নয়। কনটেন্ট প্রোভেন্যান্সের মানদণ্ড নিয়ে ২০২১ সালের ফেব্রুয়ারিতে গঠিত হয় C2PA জোট — অ্যাডোবি, মাইক্রোসফট, বিবিসি, ইন্টেল, আর্ম ও ট্রুপিক-এর মতো প্রতিষ্ঠানগুলি নিয়ে। অ্যাডোবির বাস্তবায়ন কনটেন্ট ক্রেডেনশিয়ালস এখন বহু ক্যামেরা ও সম্পাদনা সফটওয়্যারে ঢুকে পড়েছে। নিয়ন্ত্রণের দিক থেকে, ইউরোপীয় ইউনিয়নের কৃত্রিম বুদ্ধিমত্তা আইন — Regulation (EU) 2026/1689 — ১ আগস্ট ২০২৪-এ কার্যকর হয়েছে, এবং এর বেশিরভাগ বাধ্যবাধকতা ২ আগস্ট ২০২৬ থেকে প্রযোজ্য হবে; এর মধ্যে স্বচ্ছতা-সংক্রান্ত বিধানও আছে, যা কৃত্রিম উপায়ে তৈরি কনটেন্ট চিহ্নিত করার দাবি রাখে।

অর্থনীতির দিকটি না বললেই নয়। Ethereum মেইননেটে অন-চেইন সংরক্ষণ ব্যয়বহুল, কারণ প্রতিটি বাইটের জন্য গ্যাস খরচ দিতে হয়। তাই বাস্তবে মূল ডেটা অফ-চেইনে থাকে, চেইনে ওঠে কেবল হ্যাশ। লেয়ার-টু রোলআপগুলি — যেমন আরবিট্রাম, অপটিমিজম, বেস — এই খরচ অনেক কমিয়ে এনেছে, ফলে ছোট প্রতিষ্ঠানও অ্যাটেস্টেশন লিখতে পারছে।

এখন অস্বস্তিকর অংশটি। ব্লকচেইন আবর্জনা ঢুকলে আবর্জনা বেরোবে — এই সমস্যার সমাধান করে না; অপরিবর্তনীয়তা কেবল আবর্জনাকে স্থায়ী করে দেয়। ভুল তথ্য একবার চেইনে লেখা হলে তা মুছে ফেলা অসম্ভব, আর সেই ভুলের দাম কেউ শোধ করতে পারে না। ব্লকচেইন সমস্যা ধরতে সাহায্য করে, প্রতিরোধ করে না।

অপরিবর্তনীয়তা আর গোপনীয়তার অধিকারের সংঘর্ষটাও অনিবার্য। ইউরোপীয় সাধারণ ডেটা সুরক্ষা বিধিমালার (GDPR) অনুচ্ছেদ ১৭ ব্যক্তিকে তার ডেটা মুছে ফেলার অধিকার দেয়, অথচ ব্লকচেইন কাঠামোতেই বলে — মুছে ফেলা যাবে না। এই সংঘর্ষের কোনো পরিচ্ছন্ন সমাধান এখনো নেই; ব্যক্তিগত ডেটা অন-চেইনে না রাখাই আপাতত সবচেয়ে নিরাপদ পথ।

আরেকটি দুর্বলতা আছে। বেশিরভাগ প্রোভেন্যান্স ডেটা যেহেতু অফ-চেইনে থাকে, তাই বিশ্বাসের মূল ভিত্তিটি ঠিক ততটাই দুর্বল যতটা অফ-চেইন সংরক্ষণাগার। চেইন শুধু বলে, এই হ্যাশটি এই সময়ে ছিল; সে বলে না, এই হ্যাশের পেছনের ডেটা সত্যি ছিল।

আর সবচেয়ে জরুরি কথা — এই নথির সমস্যার আসল সমাধান ব্লকচেইন নয়, একটি নীরস নিয়ম: ন্যূনতম-তথ্য গেট। Stage-2 শুরু করার আগে অন্তত একটি তথ্যবিন্দু এবং একটি নামযুক্ত সত্তা থাকতেই হবে। লেজার ব্যর্থতা লিপিবদ্ধ করে; ব্যর্থতা ঠেকায় না। ঊনসত্তর বছর বয়সে আমি লাইভ টিকার নয়, দীর্ঘ দৃষ্টিভঙ্গির উপর ভরসা করি — আর দীর্ঘ দৃষ্টিভঙ্গি বলে, প্রযুক্তি যত চমকপ্রদই হোক, ভিত্তিটা প্রথমে ঠিক করতে হয়।

প্রতিটি মাঠ একটি পাতা, আর প্রতিটি ম্যাচ এমন একটি খসড়া যা আমরা কখনো শেষ করি না। কনটেন্ট পাইপলাইনও তাই — একটি অসমাপ্ত খসড়া, যার প্রতিটি সংশোধন দৃশ্যমান থাকা উচিত। আগামী দিনে তিনটি জিনিসে চোখ রাখতে হবে: সংবাদমাধ্যমে C2PA মানদণ্ডের গ্রহণ কত দ্রুত বাড়ছে, লেয়ার-টু অ্যাটেস্টেশনের খরচ কতটা নামছে, এবং ২ আগস্ট ২০২৬-এর ইউরোপীয় সময়সীমা কীভাবে বিশ্বব্যাপী প্রকাশনা-রীতিকে বদলে দেয়।

আমি লিখি সেই নীরবতার জন্য, যা ভিড় বিশ্বাস করা বন্ধ করে দেওয়ার পরে আসে। প্রশ্নটি এখন সোজা: যখন প্রতিটি কনটেন্ট পাইপলাইন তার নিজের উৎস প্রমাণ করতে পারবে, তখনও কি আমরা এমন যন্ত্র মেনে নেব, যারা বলার মতো কিছু না থাকলেও বলে?

সংশ্লিষ্ট খেলোয়াড়গণ