শক্তিশালী, পশ্চিমা ওপেন-ওয়েট এআই সিস্টেমের একটি নতুন ধারা আবার ফিরে আসছে, এবং রিফ্লেকশন ও মিস্ট্রালের নতুন মডেলগুলো চীনের সাম্প্রতিক অগ্রগমনকে সংকুচিত করছে।
এই মডেলগুলো এবং অন্যান্য মডেলগুলো ব্যবসা প্রতিষ্ঠান ও সরকারগুলোকে ওপেনএআই এবং অ্যানথ্রোপিকের বদ্ধ ইকোসিস্টেমের বিকল্প দেবে, সেইসাথে চীনের এমন সব বিকল্পেরও বিকল্প দেবে যা তারা হয়তো নিরাপত্তার কারণে এড়িয়ে চলত।
কিন্তু শক্তিশালী মডেল ওয়েটগুলো বিশ্বে ছড়িয়ে দিলে সেগুলোর সুরক্ষাব্যবস্থা অপসারণ করাও সহজ হয়ে যায়, যা একটি ক্রমবর্ধমান উদ্বেগের কারণ, কারণ মডেলগুলো সাইবারসিকিউরিটির মতো ক্ষেত্রে আরও বেশি সক্ষম হয়ে উঠছে।
তারা যা বলছে: উভয় কোম্পানিই যুক্তি দিচ্ছে এআই প্রতিযোগিতাকে পরিমাপ করার একমাত্র উপায় কাঁচা বুদ্ধিমত্তা নয়, এবং তারা ব্যবহারকারীর নিয়ন্ত্রণের ধারণাটিকে একটি মূল সুযোগ ও আকর্ষণীয় দিক হিসেবে উপস্থাপন করছে।
রিফ্লেকশনের সিইও মিশা লাস্কিন অ্যাক্সিওসকে বলেন, “যখন আপনি বুদ্ধিমত্তার জন্য এতটা অর্থ ব্যয় করছেন, তখন আপনি এটি ভাড়া করার পরিবর্তে নিজের মালিকানায় আনতে চাইবেন। এখানেই ওপেন সোর্স খুব শক্তিশালী, কারণ এটি প্রতিটি স্তরে কাস্টমাইজ করা যায়।”
মিস্ট্রালের বিজ্ঞান বিভাগের ভাইস প্রেসিডেন্ট পিয়ের স্টক বলেছেন, গ্রাহকদের কাছ থেকে তিনি বারবার যে বিষয়গুলো শোনেন তার মধ্যে রয়েছে ডেটা ও মেধাস্বত্বের ওপর নিয়ন্ত্রণ, ব্যবসায়িক ধারাবাহিকতা, মডেল কাস্টমাইজ করার ক্ষমতা এবং খরচ।
একটি সাক্ষাৎকারে স্টক বলেন, “আমি এমন ভবিষ্যতে বাস করতে চাই না যেখানে কোনো অলিগোপলি এই ধরনের বুদ্ধিমত্তার ওপর বন্ধ নিয়ন্ত্রণ প্রতিষ্ঠা করবে।”
বিস্তারিত: রিফ্লেকশন সোমবার বিম (Beam) উন্মোচন করেছে, যা একটি ৫০১ বিলিয়ন প্যারামিটারের মিক্সচার-অফ-এক্সপার্টস মডেল এবং এতে একই সময়ে ২৩ বিলিয়ন প্যারামিটার সক্রিয় থাকে।
রিফ্লেকশনের মতে, বিম চীনের জিএলএম-৫.২ (GLM-5.2)-এর সাথে প্রতিযোগিতামূলক এবং কিছু কোডিং ও এজেন্টিক টাস্কে আলিবাবার কিউয়েন ৩.৮-ম্যাক্স (Qwen 3.8-Max)-এর কাছাকাছি পৌঁছায়। তাদের নিজেদের প্রকাশিত বেঞ্চমার্ক একটি মিশ্র চিত্র দেখায়: কিছু পরীক্ষায় বিম চীনা মডেলগুলোকে ছাড়িয়ে যায় বা প্রায় সমানে সমানে থাকে, আবার অন্যগুলোতে পিছিয়ে পড়ে।
রিফ্লেকশনের মতে, বিম তিন থেকে চার গুণ কম কম্পিউটিং শক্তি ব্যবহার করে জিএলএম-৫.২-এর সমতুল্য রিজনিং পারফরম্যান্স অর্জন করতে পারে — এটি একটি গুরুত্বপূর্ণ বিবেচ্য বিষয়, কারণ অনেক গ্রাহকের কাছে এখন এআই মডেল চালানোর খরচও এর মূল পারফরম্যান্সের মতোই গুরুত্বপূর্ণ।
রিফ্লেকশন (Reflection) এই মাসের শেষের দিকে ‘বিম’ (Beam)-এর ওয়েটস (মডেলের প্যারামিটার বা অভ্যন্তরীণ বিন্যাস) এবং এটি চালানো, মূল্যায়ন ও ফাইন-টিউন করার টুলগুলো উন্মুক্ত করার পরিকল্পনা করছে।
এদিকে, মঙ্গলবার মিস্ট্রাল (Mistral) জানিয়েছে যে তারা তাদের নতুন ফ্ল্যাগশিপ মডেল ‘মিস্ট্রাল লার্জ ৪’ (Mistral Large 4)—যা ‘লে চঙ্ক’ (Le Chonk) নামেও পরিচিত—তার কাজ প্রায় শেষ করে এনেছে। এটি ১ ট্রিলিয়ন প্যারামিটার-বিশিষ্ট একটি মাল্টিমোডাল মডেল, যার মধ্যে ৪৯ বিলিয়ন সক্রিয় প্যারামিটার রয়েছে। মডেলটিকে মিস্ট্রালের নিজস্ব ইউরোপীয় ডেটা সেন্টারে দুই মাস ধরে ৪,০০০ এনভিডিয়া গ্রেস ব্ল্যাকওয়েল (Nvidia Grace Blackwell) জিপিইউ ব্যবহার করে প্রশিক্ষণ দেওয়া হয়েছে।
স্টক (Stock) অ্যাক্সিওস (Axios)-কে বলেছেন যে কোম্পানিটি ‘লে চঙ্ক’-কে বিশ্বের সেরা ওপেন-ওয়েট মডেল হিসেবে মনে করে এবং এটি নির্দিষ্ট কিছু কাজে ক্লোজড বা বদ্ধ মডেলগুলোর চেয়েও ভালো ফলাফল দিতে সক্ষম।
তবে স্টক স্বীকার করেছেন যে মিস্ট্রাল এখনও শীর্ষস্থানীয় ক্লোজড মডেলগুলোর সমকক্ষ হয়ে ওঠেনি। তিনি বলেন, “আমরা এখনও সেই অগ্রবর্তী পর্যায়ে (frontier) পৌঁছাতে পারিনি।”
মিস্ট্রাল প্রাথমিকভাবে একটি নিয়ন্ত্রিত এপিআই (API)-এর মাধ্যমে মডেলটি ব্যবহারের সুযোগ দিচ্ছে। পাশাপাশি, কম বিধিনিষেধ ও উন্নত সাইবার নিরাপত্তা সক্ষমতাযুক্ত একটি সংস্করণ পরীক্ষার জন্য নির্বাচিত অংশীদারদের দেওয়া হচ্ছে। আরও রিইনফোর্সমেন্ট লার্নিং এবং নিরাপত্তা পরীক্ষার পর ২৭ অক্টোবর তারা এর ওয়েটস উন্মুক্ত করার পরিকল্পনা করছে।
মূল প্রেক্ষাপট: ওপেন-ওয়েট এআই (AI)-এর ক্ষেত্রে সাম্প্রতিক অগ্রগতির বড় একটি অংশ এসেছে আলিবাবা (Alibaba), জেড.এআই (Z.ai), মুনশট (Moonshot) এবং ডিপসিক (DeepSeek)-এর মতো চীনা কোম্পানিগুলোর হাত ধরে।
রিফ্লেকশন এবং মিস্ট্রালের প্রতিযোগিতামূলক মডেলগুলোর আগমন ইঙ্গিত দেয় যে, পশ্চিমা ল্যাবগুলো হয়তো এমন একটি ব্যবধান কমিয়ে আনছে যা একসময় কাঠামোগত বা স্থায়ী বলে মনে হচ্ছিল।
তবে একটি বিষয় হলো: ওপেন-ওয়েট মডেলের ক্ষেত্রে গ্রাহকরা যেমন মডেলটির ওপর নিয়ন্ত্রণ পান, ঠিক তেমনি এটি কীভাবে ব্যবহৃত হবে—তার ওপর ডেভেলপার বা নির্মাতার নিয়ন্ত্রণও সীমিত হয়ে পড়ে।
একবার ওয়েটস বা মডেলের অভ্যন্তরীণ বিন্যাস সর্বজনীনভাবে উন্মুক্ত হয়ে গেলে ব্যবহারকারীরা মডেলটিতে পরিবর্তন আনতে পারেন; এমনকি এর নির্মাতার যুক্ত করা সুরক্ষা ব্যবস্থা বা সেফগার্ডগুলোও অপসারণের চেষ্টা করতে পারেন।
বিষয়টি অত্যন্ত গুরুত্বপূর্ণ, কারণ মডেলগুলো এখন সাইবার নিরাপত্তা এবং অন্যান্য সম্ভাব্য ঝুঁকিপূর্ণ কাজের ক্ষেত্রে আরও বেশি সক্ষম হয়ে উঠছে।
বিপরীত যুক্তি: মিস্ট্রাল এবং রিফ্লেকশন যুক্তি দেয় যে উন্মুক্ততা বা স্বচ্ছতা নিরাপত্তাও উন্নত করতে পারে।
লাস্কিন (Laskin) বলেন, বদ্ধ ল্যাবের ভেতরে মাত্র কয়েকশ গবেষকের ওপর নির্ভর না করে একটি বৃহত্তর ইকোসিস্টেমের মাধ্যমে মডেলগুলো যাচাই করা এবং দুর্বলতা খুঁজে বের করা অনেক বেশি নিরাপদ। তবে তিনি এও বলেন যে, সক্ষমতা-ভিত্তিক নিরাপত্তা মানদণ্ড থাকা উচিত যা নির্ধারণ করবে কোনো মডেল—তা ওপেন বা ক্লোজড যাই হোক—উন্মুক্ত করা উচিত কি না।
স্টক ওয়েট মডেল উন্মুক্ত করার ক্ষেত্রে একটি অসুবিধার কথা স্বীকার করলেও যুক্তি দিয়েছেন যে, সক্ষম মডেলগুলো সহজলভ্য করা হলে তা সাইবার প্রতিরক্ষা ব্যবস্থাকে ত্বরান্বিত করতে পারে এবং বাইরের গবেষকদের প্রযুক্তিটি নিরীক্ষা করার সুযোগ করে দেয়। পরীক্ষার জন্য অতিরিক্ত সময় পেতে মিস্ট্রাল একটি পর্যায়ক্রমিক উন্মোচন পদ্ধতি ব্যবহার করছে।
উন্মুক্ত ওয়েট মডেলগুলো এটাও নিশ্চিত করে যে, যারা সাইবার আক্রমণের বিরুদ্ধে প্রতিরক্ষা করছে তাদের কাছে পর্যাপ্ত সরঞ্জাম রয়েছে। স্টক বলেন, “আমরা যদি এমএল৪-সহ (যা সাইবার ক্ষেত্রে বিশ্বের অন্যতম সেরা মডেল) যত বেশি সম্ভব মডেল উন্মুক্ত করি, তাহলে প্রতিরক্ষা ব্যবস্থা আরও অনেক বেশি ত্বরান্বিত হবে।”

































































