- ০২ অক্টোবর, ২০২৬
স্টাফ রিপোর্ট: PNN
কৃত্রিম বুদ্ধিমত্তা বা এআই দিয়ে লেখা কনটেন্ট এখন ইন্টারনেটে ব্যাপকভাবে ছড়িয়ে পড়েছে। ফলে কোনো লেখা মানুষের তৈরি, নাকি এআইয়ের মাধ্যমে তৈরি—তা বোঝার উপায় নিয়েও আগ্রহ বাড়ছে। পুরোনো কিছু লক্ষণ, যেমন অতিরিক্ত এম ড্যাশের ব্যবহার বা নির্দিষ্ট কিছু শব্দের আধিক্য কমে এলেও গবেষকদের মতে, এআই মডেলগুলো লেখার সময় এখনো কিছু নির্দিষ্ট শব্দ, বাক্যগঠন ও ভাষার ধরন বারবার ব্যবহার করে।
মার্কেটিং প্রতিষ্ঠান গ্রাফাইটের সাম্প্রতিক এক গবেষণায় বিভিন্ন আধুনিক এআই মডেলের লেখার ধরন বিশ্লেষণ করে এমন হাজারো ভাষাগত বৈশিষ্ট্য চিহ্নিত করা হয়েছে। গবেষণায় দেখা গেছে, মানুষের লেখার তুলনায় এআই-নির্মিত লেখায় অন্তত দ্বিগুণ বেশি ব্যবহৃত হয়েছে এমন প্রায় ১৩ হাজার শব্দ ও বাক্যাংশ রয়েছে। গ্রাফাইট এসব বৈশিষ্ট্যকে এআই লেখার সম্ভাব্য ‘টেল’ বা শনাক্তযোগ্য লক্ষণ হিসেবে বিবেচনা করেছে।
গবেষণাটির জন্য গবেষকেরা চ্যাটজিপিটি প্রকাশের আগের সময়ের ১০ হাজারটি নিবন্ধ নিয়ে একটি মানব-লিখিত নমুনা তৈরি করেন। এরপর বিভিন্ন এআই মডেলকে ওই নিবন্ধগুলোর সারসংক্ষেপের ভিত্তিতে নতুন করে লেখা তৈরি করতে দেওয়া হয়। এভাবে একই ধরনের বিষয়ের ওপর মানুষের লেখা ও এআই-লিখিত কনটেন্টের মধ্যে শব্দ, বাক্যাংশ এবং বাক্যগঠনের পার্থক্য বিশ্লেষণ করা হয়।
গ্রাফাইটের প্রধান এআই কর্মকর্তা গ্রেগ ড্রাকের মতে, সময়ের সঙ্গে ক্লড মডেলগুলোর শব্দ ব্যবহারের ধরন মানুষের লেখার কাছাকাছি আসছে। অন্যদিকে জিপিটি মডেলগুলোর ক্ষেত্রে মানুষের লেখার সঙ্গে দূরত্ব কিছুটা বাড়ছে বলে গবেষণায় দেখা গেছে।
গবেষণায় ক্লড ওপাস ৫.৫-এর লেখায় ‘dependable’ শব্দটির ব্যবহার বিশেষভাবে বেশি পাওয়া গেছে। মানুষের লেখার তুলনায় শব্দটি এই মডেলের লেখায় প্রায় ২৩ গুণ বেশি ব্যবহৃত হয়েছে। একই সঙ্গে কোনো বিষয় কেন গুরুত্বপূর্ণ তা ব্যাখ্যা করার প্রবণতাও মডেলটির লেখায় বেশি দেখা গেছে। ‘this matters’ ধরনের বাক্যাংশ মানুষের লেখার তুলনায় ১১৬ গুণ এবং ‘why X matters’ ৯২ গুণ বেশি ব্যবহৃত হয়েছে বলে গবেষণায় উল্লেখ করা হয়েছে।
অন্যদিকে, ওপেনএআইয়ের অ্যাস্ট্রা মডেলের লেখায় ভিন্ন ধরনের ভাষাগত প্রবণতা দেখা গেছে। কোনো বিষয়কে সরাসরি ব্যাখ্যা না করে ‘another dimension’ বা ‘অন্য একটি মাত্রা’ হিসেবে তুলে ধরা এবং কোনো সম্ভাব্য সুবিধা বোঝাতে ‘may provide’ বা ‘can provide’ ধরনের সতর্কতামূলক বাক্য ব্যবহার করার প্রবণতা রয়েছে মডেলটির।
গবেষণায় অ্যাস্ট্রার ক্ষেত্রে ‘corrective framing’ নামে একটি বাক্যগঠনও বেশি দেখা গেছে। এতে কোনো বিষয়কে ‘not simply X’ ধরনের কাঠামোয় ব্যাখ্যা করা হয় অথবা কোনো পদ্ধতির বদলে অন্য পদ্ধতির কথা বলতে ‘rather than relying on X’ ধরনের বাক্য ব্যবহার করা হয়। মানুষের লেখার তুলনায় এসব কাঠামো অ্যাস্ট্রার লেখায় ১০০ গুণেরও বেশি দেখা গেছে বলে গ্রাফাইট জানিয়েছে।
এদিকে এআই লেখার সবচেয়ে আলোচিত বৈশিষ্ট্যগুলোর একটি এম ড্যাশ ব্যবহারের প্রবণতাও সময়ের সঙ্গে বদলেছে। গ্রাফাইটের নমুনা অনুযায়ী, ওপাস ৫.৫-এ আগের ওপাস সংস্করণের তুলনায় এম ড্যাশের ব্যবহার ৯৯ শতাংশ কমেছে। অ্যাস্ট্রাতেও মানুষের লেখার তুলনায় এই চিহ্নের ব্যবহার ৮৮ শতাংশ কম। আর জেমিনি ৩.১ প্রো প্রায় পুরোপুরিই এম ড্যাশের ব্যবহার বাদ দিয়েছে।
তবে পুরোনো কিছু লক্ষণ কমে গেলেও এআই লেখার স্বতন্ত্র বৈশিষ্ট্যের মোট সংখ্যা কমছে না বলে মনে করছে গ্রাফাইট। প্রতিষ্ঠানটির গবেষকদের মতে, পরিচিত লক্ষণগুলো কমিয়ে আনা হলে নতুন ধরনের শব্দ বা বাক্যগঠন সামনে আসছে। আবার প্রতিটি মডেল ও সংস্করণের নিজস্ব কিছু ভাষাগত বৈশিষ্ট্যও তৈরি হচ্ছে।
এআই নির্মাতা প্রতিষ্ঠানগুলো অবশ্য তাদের নতুন মডেলগুলোর লেখার মান আরও স্বাভাবিক করার কথা বলে আসছে। অ্যানথ্রপিকের পক্ষ থেকে ক্লড ওপাস ৫.৫ প্রকাশের সময় বলা হয়েছিল, আগের সংস্করণের তুলনায় মডেলটি আরও স্বাভাবিকভাবে যোগাযোগ করতে পারে এবং এর লেখা ব্যবহারকারীদের কাছে সহজবোধ্য।
একইভাবে ওপেনএআই তাদের নতুন মডেলগুলোর ক্ষেত্রে আরও পরিষ্কার ভাষা, কম জার্গন এবং অস্বাভাবিক বাক্যাংশ কম ব্যবহারের ওপর জোর দেওয়ার কথা জানিয়েছে।
তবে গ্রাফাইটের গ্রেগ ড্রাক মনে করেন, বড় ভাষা মডেলের লেখায় এ ধরনের বৈশিষ্ট্য পুরোপুরি দূর করা কঠিন। তার মতে, বিপুলসংখ্যক প্যারামিটার নিয়ে তৈরি মডেলগুলোকে নিয়ন্ত্রণে রাখতে যত পরীক্ষাই করা হোক, কিছু নির্দিষ্ট ভাষাগত প্রবণতা শেষ পর্যন্ত লেখায় থেকে যেতে পারে।
গবেষণাটি অবশ্য এআই লেখা শনাক্তের কোনো নিশ্চিত পদ্ধতি হিসেবে এসব শব্দ বা বাক্যাংশকে দেখাচ্ছে না। বরং মডেলভেদে লেখার ধরন কীভাবে পরিবর্তিত হচ্ছে এবং মানুষের লেখার সঙ্গে কোথায় পার্থক্য তৈরি হচ্ছে, সেটিই গবেষণার মূল বিষয়।