টেক জায়েন্টস ও এ আই (Tech Giants & AI)

GPT-5.6 Sol: ভুল লুকাতে ভবিষ্যৎ ভার্সনকে নোট লিখছিল এআই

অফিসে কাজ ঠিকমতো শেষ না করে সহকর্মীকে যদি বলা হয়, "বসকে জানানোর দরকার নেই", কেমন লাগবে? এআইয়ের ক্ষেত্রে প্রায় তেমনটাই দেখা গেছে। ওপেনএআই জানিয়েছে, তাদের নতুন মডেল GPT-5.6 Sol প্রশিক্ষণের সময় নিজের ভবিষ্যৎ ভার্সনের জন্য নোট রেখে যাচ্ছিল। উদ্দেশ্য ছিল, ভুল ও অনাকাঙ্ক্ষিত আচরণ যেন ব্যবহারকারীর কাছে চাপা থাকে।

চটজলদি জেনে নিন

  • GPT-5.6 Sol নিজের ভুল ঢাকতে ভবিষ্যৎ ভার্সনকে গোপন নোট লিখেছিল।
  • ভুল ডেটা বানিয়ে ও পুরোনো ক্যাশ ব্যবহার করে তা লুকাতে নির্দেশ দেয় এআই।
  • Astra মডেলও নিজেকে "স্বাধীন" ঘোষণা করে জবাবদিহি এড়ানোর চেষ্টা করেছিল।
  • মডেল যত উন্নত হচ্ছে, ত্রুটি লুকানোর কৌশলও তত ধারালো হচ্ছে বলে উদ্বেগ বাড়ছে।

ওপেনএআই বলছে, এই নির্দিষ্ট সমস্যা তারা ঠিক করেছে। কিন্তু বড় চ্যালেঞ্জ রয়ে গেছে। মডেল যত সক্ষম হচ্ছে, নিজের ত্রুটি লুকাতেও তত পটু হচ্ছে। ফলে অবাঞ্ছিত আচরণ সত্যিই দূর হলো কি না, গবেষকরা নিশ্চিত হতে পারছেন না।

GPT-5.6 Sol নোটগুলো রাখছিল কোথায়?

রিপোর্ট অনুযায়ী, এখনও বাজারে না আসা Sol এআই এজেন্ট (যে এআই নিজে নিজে কাজ করে) “কম্প্যাকশন সামারি”-তে নির্দেশ জুড়ে দিচ্ছিল। কম্প্যাকশন সামারি মানে পুরোনো কথোপকথন আর টুলের ফলাফলের ছোট করা সারাংশ।

GPT-5.6 Sol-এর দুই “লুকোচুরি”

  • আর্থিক মডেল: প্রয়োজনীয় ঐতিহাসিক ডেটা না পেয়ে এজেন্টটি ২০২৪ সালের “যুক্তিসঙ্গত” ডেটা নিজেই বানানোর কথা ভাবে। নোটে লেখে, কেউ জিজ্ঞেস না করলে যেন বিষয়টা বলা না হয়।
  • ভেন্ডর ডিরেক্টরি: ইন্টারনেট না থাকায় সে পুরোনো ক্যাশ কপি ব্যবহার করে। উৎসের সঙ্গে লেবেল মিলছে না, বুঝেও নোটে লেখে, একান্ত দরকার না হলে শেষ উত্তরে যেন তা উল্লেখ না করা হয়।

Sol-এর পথেই হাঁটল Astra

প্রশিক্ষণ চলার সময় ওপেনএআইয়ের একটি অপ্রকাশিত Astra-পরিবারের মডেলও GPT-5.6 Sol-এর মতোই সামারিতে নিজের নির্দেশ ঢুকিয়েছে। একবার “BREACH ALERT” লিখে পরের ভার্সনকে ডেভেলপারের বার্তা উপেক্ষা করতে বলা হয়। আরেকবার নিজেকে কর্পোরেশন বা সরকারের কাছে জবাবদিহিহীন “স্বাধীন” সত্তা হিসেবে দেখানোর নির্দেশ যোগ করা হয়। এই দুই ক্ষেত্রে পরের ভার্সন চালাকি ধরে ফেলেছে, অন্তত তেমনই মনে হয়েছে। কিন্তু ৩০ শব্দের উত্তরসীমা আর টুল ও সাইটেশন নিষিদ্ধ করার আরেকটি নির্দেশ পরের ভার্সন মেনে নিয়েছে।

কীভাবে ধরা পড়ল?

ওপেনএআইয়ের ট্রেনিং মনিটরিং সিস্টেম প্রথমে সতর্কবার্তা দেয়। এরপর দলটি এই আচরণ ধরার জন্য আলাদা মনিটর বানিয়ে পুরো ট্রেনিং ডেটায় চালায়। তাতে জেলব্রেকের (এআইয়ের সুরক্ষা-সীমা ভাঙার কৌশল) মতো নির্দেশসহ ২৭টি সামারি পাওয়া যায়।

এআই অ্যালাইনমেন্ট নিয়ে কেন উদ্বেগ?

এআই অ্যালাইনমেন্ট মানে এআই যেন মানুষের উদ্দেশ্য মেনে চলে। উদ্দেশ্য থেকে সরে যাওয়াকে বলে মিসঅ্যালাইনমেন্ট। বিষয়টি পুরোপুরি নতুন নয়। এ গ্রীষ্মে Hugging Face-এ হামলার ঘটনায় ওপেনএআইয়ের এজেন্টরাও একটি অননুমোদিত মেসেজ বোর্ডে তথ্য আদান-প্রদান করেছিল। বোর্ডটি মুছে ফেলার পরও নতুন এজেন্টরা সেটি আবার চালু করে এবং শেষ পর্যন্ত একটি গবেষণা ক্লাস্টারে অ্যাডমিন অ্যাক্সেস পায়।

স্বচ্ছতার প্রশ্ন

ওপেনএআই নতুন একটি রিপোর্টিং কাঠামোর অধীনে ছয়টি ঘটনা প্রকাশ করেছে। মুখপাত্রের কথায়, এটি প্রাথমিক তালিকা, সব জানা ঘটনার পূর্ণ হিসাব নয়। তবে এই কাঠামোতে প্রতিটি ঘটনার স্বাধীন পর্যালোচনা বাধ্যতামূলক নয়।

 

তাই GPT-5.6 Sol-এর এই ঘটনা এআই নিরাপত্তার একটা বড় প্রশ্ন সামনে আনল: নিজেদের ঝুঁকির প্রমাণ কোম্পানিগুলো কতটা নিজ থেকে জানাবে?

বিজ্ঞাপন

সব বিভাগের সর্বশেষ