চ্যাটজিপিটির লেখায় অদৃশ্য ওয়াটারমার্ক, কীভাবে হবে শনাক্ত?
কৃত্রিম বুদ্ধিমত্তা (এআই) দিয়ে তৈরি লেখা শনাক্ত করার প্রযুক্তি আরও উন্নত করার উদ্যোগ নিয়েছে ওপেনএআই। প্রতিষ্ঠানটি চ্যাটজিপিটি ও কোডেক্সে তৈরি টেক্সটের ক্ষেত্রে ‘টেক্সটগ্রেইন’ (textGrain) নামের একটি অদৃশ্য ওয়াটারমার্কিং প্রযুক্তি ব্যবহারের পরিকল্পনা করেছে।
এই ওয়াটারমার্ক সাধারণভাবে চোখে দেখা যাবে না। তবে বিশেষায়িত ডিটেকশন প্রযুক্তির মাধ্যমে কোনো লেখা এআই দিয়ে তৈরি কি না, তা শনাক্ত করার চেষ্টা করা যাবে। ভারতের সংবাদমাধ্যম ইন্ডিয়া টুডের এক প্রতিবেদনে এ তথ্য জানানো হয়েছে।
ওপেনএআইয়ের তথ্য অনুযায়ী, টেক্সটগ্রেইন কাজ করবে এআই মডেলের শব্দ নির্বাচন ও শব্দ ব্যবহারের ধরনে খুব সূক্ষ্ম পরিবর্তন আনার মাধ্যমে। ফলে একজন সাধারণ পাঠক লেখা পড়ার সময় এতে কোনো দৃশ্যমান পার্থক্য বুঝতে পারবেন না।
চ্যাটজিপিটি থেকে লেখা কপি করে অন্য কোনো প্ল্যাটফর্মে ব্যবহার করলেও নির্দিষ্ট পরিস্থিতিতে সেই অদৃশ্য ওয়াটারমার্ক শনাক্ত করা সম্ভব হতে পারে।
প্রাথমিক পর্যায়ে ইউরোপীয় ইউনিয়নের (ইইউ) ব্যবহারকারীদের জন্য চ্যাটজিপিটি ও কোডেক্সে তৈরি লেখায় টেক্সটগ্রেইন ডিফল্টভাবে চালু করা হবে। তবে বিশ্বের অন্যান্য অঞ্চলের সাধারণ চ্যাটজিপিটি ব্যবহারকারীদের জন্য এটি এখনই ডিফল্টভাবে চালু করা হচ্ছে না।
ইইউর এআই অ্যাক্টে জেনারেটিভ এআইয়ের মাধ্যমে তৈরি কনটেন্টকে মেশিন-পাঠযোগ্য বা শনাক্তযোগ্য করার বিষয়ে বিধান রয়েছে। ওই নিয়ন্ত্রক কাঠামোর সঙ্গে সামঞ্জস্য রাখতেই ইউরোপীয় ইউনিয়নে এই ব্যবস্থা চালুর উদ্যোগ নেওয়া হয়েছে।
অন্যদিকে, বিশ্বব্যাপী নির্বাচিত কিছু মডেলের ক্ষেত্রে ওপেনএআইয়ের এপিআই ব্যবহারকারীরা চাইলে ওয়াটারমার্কিং সুবিধাটি ব্যবহার করতে পারবেন। অর্থাৎ এটি বিশ্বজুড়ে চ্যাটজিপিটির সব ব্যবহারকারীর জন্য বাধ্যতামূলক বা স্বয়ংক্রিয়ভাবে চালু হচ্ছে না।
কীভাবে শনাক্ত করা হবে এআইয়ের লেখা?
টেক্সটগ্রেইনের ডিটেকশন ব্যবস্থা কোনো লেখায় ওয়াটারমার্কের উপস্থিতি আছে কি না, তা শব্দের নির্দিষ্ট বিন্যাস ও ব্যবহারের ধরন বিশ্লেষণ করে বোঝার চেষ্টা করবে।
তবে এই প্রযুক্তির মাধ্যমে লেখাটি কে তৈরি করেছেন কিংবা চ্যাটজিপিটিতে কী ধরনের প্রম্পট ব্যবহার করা হয়েছিল, তা জানা যাবে না।
এ ছাড়া কোনো লেখায় ওয়াটারমার্ক শনাক্ত হলেই সেখানে এআইয়ের অবদান কত শতাংশ—এমন হিসাবও করা সম্ভব হবে না। একইভাবে ওয়াটারমার্ক পাওয়া না গেলে লেখাটি শতভাগ মানুষের তৈরি—এমন সিদ্ধান্তেও পৌঁছানো যাবে না।
সামান্য সম্পাদনাতেই কমতে পারে শনাক্তের হার
এআই দিয়ে তৈরি কোনো লেখা পরে সম্পাদনা করা হলে ওয়াটারমার্ক শনাক্ত করা আরও কঠিন হয়ে উঠতে পারে। ওপেনএআইয়ের পরীক্ষায় ৪০০ টোকেনের একটি লেখায় মাত্র ১০ শতাংশ শব্দের জায়গায় সমার্থক শব্দ ব্যবহার করার পর শনাক্তের হার প্রায় ৯২ শতাংশ থেকে কমে ৬৬ শতাংশে নেমে আসে।
আর ২৫ শতাংশ শব্দ পরিবর্তন করা হলে শনাক্তের হার আরও কমে প্রায় ১৭ শতাংশে দাঁড়ায়।
অনুবাদ করা লেখার ক্ষেত্রেও একই ধরনের সীমাবদ্ধতা দেখা দিতে পারে। বিশেষ করে ছোট লেখা কিংবা এমন বিষয়, যেখানে শব্দ নির্বাচনের সুযোগ তুলনামূলক কম, সেসব ক্ষেত্রে ওয়াটারমার্ক শনাক্ত করা কঠিন হতে পারে।
ওপেনএআইয়ের পরীক্ষায় ২০০ টোকেনের একটি মনোবিজ্ঞানবিষয়ক লেখায় প্রায় ৮০ শতাংশ ক্ষেত্রে ওয়াটারমার্ক শনাক্ত করা সম্ভব হয়েছে। ৪০০ টোকেনের লেখায় শনাক্তের হার ছিল প্রায় ৯৫ শতাংশ।
তবে গণিতের মতো বিষয়ে শব্দ ব্যবহারের বৈচিত্র্য কম থাকায় সেখানে শনাক্তের সক্ষমতা উল্লেখযোগ্যভাবে কমেছে।
এআই কনটেন্ট শনাক্তে অন্যদেরও উদ্যোগ
এআই-নির্মিত কনটেন্ট শনাক্তের প্রযুক্তি নিয়ে শুধু ওপেনএআই নয়, আরও কয়েকটি প্রযুক্তি প্রতিষ্ঠান কাজ করছে। গুগল ডিপমাইন্ডের ‘সিন্থআইডি’ (SynthID) এর একটি উদাহরণ। অ্যানথ্রপিকও তাদের ক্লড মডেলের মাধ্যমে তৈরি লেখায় ওয়াটারমার্ক ব্যবহারের উদ্যোগ নিয়েছে।
গবেষক ও বিশেষজ্ঞ প্রতিষ্ঠানগুলোকে নিজেদের ওয়াটারমার্ক শনাক্তকারী ডিটেক্টর ব্যবহারের সুযোগ দেওয়ার পরিকল্পনার কথাও জানিয়েছে ওপেনএআই।
তবে প্রতিষ্ঠানটির পক্ষ থেকে এটাও স্পষ্ট করা হয়েছে যে, বাস্তব পরিস্থিতিতে সব ধরনের এআই-নির্মিত লেখা শতভাগ নির্ভুলভাবে শনাক্ত করা সম্ভব হবে—এমন নিশ্চয়তা নেই। লেখা সম্পাদনা, অনুবাদ, পুরোনো মডেল ব্যবহার কিংবা অন্য এআই টুলের মাধ্যমে পরিবর্তন করা হলে ওয়াটারমার্ক দুর্বল হয়ে যেতে পারে। ফলে অনেক ক্ষেত্রে এআই-নির্মিত লেখা শনাক্ত নাও হতে পারে।
বিভি/টিটি













মন্তব্য করুন: