- নিরাপত্তা নিরীক্ষার জন্য দুই সপ্তাহের সংক্ষিপ্ত স্থগিতাদেশের পর ক্লদ মিথোস ৫ পুনরায় পরিষেবাতে ফিরে এসেছে।
- মডেল আর্কিটেকচারটি কোডিং দক্ষতায় একটি উল্লেখযোগ্য উল্লম্ফন প্রদর্শন করে, যা SWE-bench Pro-তে ৮০.৩% স্কোর অর্জন করেছে।
- নতুন স্থায়ী স্মৃতি বৈশিষ্ট্য এআই-কে একটি সাধারণ চ্যাটবটের পরিবর্তে দীর্ঘমেয়াদী প্রযুক্তিগত সহযোগী হিসেবে কাজ করতে সক্ষম করে।
- নিরাপত্তা প্রোটোকলগুলিতে এখন সংবেদনশীল কোয়েরিগুলির জন্য ক্লদ ওপাস ৪.৮-এ ফিরে যাওয়ার একটি অত্যাধুনিক ফলব্যাক ব্যবস্থা অন্তর্ভুক্ত করা হয়েছে।
জাতীয় নিরাপত্তাজনিত কারণে দুই সপ্তাহ সম্পূর্ণ স্থগিত থাকার পর, অ্যানথ্রোপিকের সবচেয়ে উন্নত সিস্টেমগুলোর আকস্মিক প্রত্যাবর্তনের ফলে সম্প্রতি উচ্চমানের কৃত্রিম বুদ্ধিমত্তার জগতে বড় ধরনের আলোড়ন সৃষ্টি হয়েছে। ক্লদ মিথোস ৫ মডেলটি পুনরায় সক্রিয় করা হয়েছে। “বিশ্বস্ত অংশীদার” নামে পরিচিত সংস্থাগুলোর একটি নির্দিষ্ট গোষ্ঠীর জন্য। এই পদক্ষেপ থেকে বোঝা যায় যে, যদিও এই মডেলগুলোর কার্যকারিতা অপরিসীম, সাধারণ জনগণের জন্য এগুলোর প্রয়োগকে ঘিরে থাকা সুরক্ষাব্যবস্থা আগের চেয়েও কঠোর রয়েছে।
এই রিলিজটি একটি সাধারণ ভার্সন আপডেটের চেয়ে অনেক বেশি কিছু; এটি বিশেষজ্ঞদের ভাষায় এক অবিচল প্রযুক্তিগত সহযোগীর দিকে একটি বড় পরিবর্তনকে নির্দেশ করে। পূর্ববর্তী সংস্করণগুলোর মতো নয়, যেগুলো দীর্ঘ আলোচনায় প্রায়শই মূল বিষয় থেকে সরে যেত, মিথোস স্থাপত্যটি মনোযোগ বজায় রাখার জন্য ডিজাইন করা হয়েছে। দীর্ঘ সময় ধরে অনায়াসে একাধিক ধাপের কাজ সমন্বয় করতে পারে। যারা জটিল, সপ্তাহব্যাপী প্রকল্পে সঠিক পথে থাকার জন্য একটি এআই চান, তাদের জন্য এটি একটি যুগান্তকারী পরিবর্তন।
তুলনামূলক কর্মক্ষমতা এবং কোডিং দক্ষতা
প্রকৃত সংখ্যাতত্ত্বের দিকে তাকালে অগ্রগতি বেশ চোখে পড়ার মতো, বিশেষ করে সফটওয়্যার ইঞ্জিনিয়ারিংয়ের ক্ষেত্রে। সর্বশেষ SWE-bench Pro টেস্টগুলোতে, যা বাস্তব জগতের কোডিংয়ের জটিলতাগুলোর অনুকরণ করে, ক্লদ মিথোস ৫ ৮০.৩% স্কোর অর্জন করেছে।এর পূর্বসূরি, ক্লদ ওপাস ৪.৮-কে ৬৯.২% স্কোর নিয়ে পেছনে ফেলে দিয়েছে। এই দুই-অঙ্কের ব্যবধানটি সবচেয়ে বেশি চোখে পড়ে যখন এআই-কে একসাথে একাধিক ফাইল সামলাতে হয় এবং জটিল ও পরস্পর সংযুক্ত কোডবেসের মধ্যে দিয়ে পথ চলতে হয়।
প্রাথমিক প্রদর্শনীতে দেখা গেছে, এই সিস্টেমটি একটিমাত্র ফাইলের মধ্যেই সম্পূর্ণ ওয়েব অ্যাপ্লিকেশন তৈরি করতে পারে, যেগুলোতে ডাইনামিক চার্ট এবং এমনকি ফিজিক্স ও মোবাইল ক্যামেরা লজিকসহ কার্যকরী প্ল্যাটফর্মিং গেমও রয়েছে। এটি শুধু কোডই লেখে না; এটি ডিবাগিংয়ের ক্লান্তিকর কাজে অত্যন্ত পারদর্শী। ত্রুটির মূল কারণ শনাক্ত করে এবং সবচেয়ে সাশ্রয়ী সমাধান প্রস্তাব করার মাধ্যমে। ডেভেলপারদের জন্য এর অর্থ হলো, এআই অবশেষে শুধু সাধারণ পরামর্শ দেওয়ার পরিবর্তে কিছু কঠিন কাজ করতে সক্ষম হয়েছে।
স্থায়ী এআই এজেন্টদের উত্থান
এই নতুন সংস্করণটির অন্যতম আকর্ষণীয় দিক হলো এর স্বায়ত্তশাসিত এজেন্ট হিসেবে কাজ করার ক্ষমতা। প্রতিটি পদক্ষেপে নির্দেশের জন্য অপেক্ষা করার পরিবর্তে, পৌরাণিক কাহিনী একটি ব্যাপক উদ্দেশ্য গ্রহণ করতে পারে।একে যৌক্তিক ধাপে ভাগ করুন এবং কাজ শুরু করার আগে একটি সুসংগঠিত পরিকল্পনা উপস্থাপন করুন। এর মূল উদ্দেশ্য হলো বিচ্ছিন্ন কোয়েরি থেকে সমন্বিত ওয়ার্কফ্লোতে যাওয়া, যেখানে সিস্টেমটি নিজেই প্রকল্পের গতিপথ পর্যালোচনা ও বজায় রাখে।
এই স্তরের স্থায়িত্বের অর্থ হলো, মডেলটি কয়েক দিন আগে নেওয়া প্রযুক্তিগত সিদ্ধান্তগুলো মনে রাখতে পারে এবং সেগুলোর সাথে সাংঘর্ষিক হতে পারে এমন নতুন অনুরোধগুলোকে চিহ্নিত করতে পারে। দীর্ঘ সেশন জুড়ে প্রসঙ্গ সংরক্ষণএর ফলে, প্রতিবার নতুন চ্যাট শুরু করার সময় সম্পূর্ণ লজিকটি গোড়া থেকে পুনর্নির্মাণ করার সাধারণ সমস্যাটি এড়ানো যায়। এতে এমন একজন সহকর্মীর সাথে কাজ করার অনুভূতি হয়, যিনি কাজের ইতিহাসের প্রতি সত্যিই মনোযোগ দেন।
নিরাপত্তা স্তর এবং ফলব্যাক সিস্টেম
অবশ্যই, বিপুল ক্ষমতার সাথে অনেক আমলাতান্ত্রিক জটিলতাও আসে। অ্যানথ্রোপিক এমন একগুচ্ছ ক্লাসিফায়ার যুক্ত করেছে যা মিথোস কোরে পৌঁছানোর আগেই প্রতিটি প্রম্পট স্ক্যান করে, বিশেষত জীববিজ্ঞান, রসায়ন এবং উন্নত এআই ডেভেলপমেন্টের ক্ষেত্রে কোনো বিপদসংকেত খোঁজে। যদি কোনো কোয়েরি অতিরিক্ত সংবেদনশীল বলে মনে হয় বা এর জন্য ভিন্ন পদ্ধতির প্রয়োজন হয়, সিস্টেমটি একটি ফলব্যাক প্রক্রিয়া ব্যবহার করে। কাজটি ক্লদ ওপাস ৪.৮-এর মতো কিছুটা বেশি সীমাবদ্ধ মডেলে সরিয়ে নেওয়া।
গবেষকদের মধ্যে এই অভ্যন্তরীণ ফিল্টারগুলো মাঝে মাঝে ভুল ইতিবাচক ফলাফল তৈরি করা নিয়ে কিছু আলোচনা চলছে, যা কাজ করার সময় বেশ হতাশাজনক হতে পারে। এর সমাধানের জন্য একটি উদ্যোগ নেওয়া হচ্ছে। এই ফিল্টারগুলো কীভাবে কাজ করে সে সম্পর্কে আরও স্বচ্ছতা সৃজনশীল প্রক্রিয়ায়। এই নিরাপত্তা যাচাইগুলো দৃশ্যমান রাখলে আস্থা তৈরিতে সাহায্য হয়, যা ব্যবহারকারীদের স্পষ্টভাবে জানিয়ে দেয় যে কেন একটি নির্দিষ্ট প্রতিক্রিয়া পরিবর্তন বা পুনঃনির্দেশিত করা হয়েছে।
এই সিস্টেমগুলোর বিবর্তন এমন এক ভবিষ্যতের ইঙ্গিত দেয় যেখানে প্রযুক্তিগত সক্ষমতা এবং নিরাপত্তা ব্যবস্থা মূলত একই মুদ্রার দুটি পিঠ। শিল্প যখন এমন মডেলের দিকে অগ্রসর হচ্ছে যা পরিকল্পনা করতে, তা সম্পাদন করতে এবং নিজেদের যুক্তি মনে রাখতে পারে, স্পষ্ট যোগাযোগ এবং নির্ভরযোগ্য ফলাফলের উপর মনোযোগ এটি সাফল্যের প্রধান মাপকাঠি হয়ে ওঠে। যদিও আপাতত এর প্রবেশাধিকার কিছুটা সীমিত, এই সর্বশেষ স্থাপত্য দ্বারা নির্ধারিত মানদণ্ডগুলো এমন এক কৃত্রিম বুদ্ধিমত্তার দিকে স্পষ্ট পথ দেখায় যা জটিল সমস্যা সমাধানের ক্ষেত্রে একজন প্রকৃত সহযোগী হিসেবে কাজ করে।
