ওপেন-ওয়েট এআই মডেলগুলি সীমানার কাছাকাছি পৌঁছাচ্ছে। নিরাপত্তার ব্যবধান রয়ে গেছে।

এক বছর আগে, বন্ধ সীমান্ত মডেল এবং তাদের ওপেন-ওয়েট সমকক্ষগুলির মধ্যে ব্যবধান অতিক্রম করা অসম্ভব মনে হয়েছিল। আজ, সেই ব্যবধান বেশিরভাগ গবেষকদের পূর্বাভাসের চেয়ে দ্রুত বন্ধ হচ্ছে — এবং ওপেন-ওয়েট এআই মডেলগুলি বেঞ্চমার্কের পর বেঞ্চমার্কে প্যাকের সামনে পৌঁছাচ্ছে।

ওপেন-ওয়েট এআই মডেলগুলি সীমানার কাছাকাছি পৌঁছাচ্ছে। নিরাপত্তার ব্যবধান রয়ে গেছে।

এক বছর আগে, বন্ধ সীমান্ত মডেল এবং তাদের ওপেন-ওয়েট সমকক্ষগুলির মধ্যে ব্যবধান অতিক্রম করা অসম্ভব মনে হয়েছিল। আজ, সেই ব্যবধান বেশিরভাগ গবেষকদের পূর্বাভাসের চেয়ে দ্রুত বন্ধ হচ্ছে — এবং ওপেন-ওয়েট এআই মডেলগুলি বেঞ্চমার্কের পর বেঞ্চমার্কে প্যাকের সামনে পৌঁছাচ্ছে। কিন্তু ক্ষমতার সমতা কাছাকাছি আসার সাথে সাথে, একটি কঠিন প্রশ্ন উঠে আসে: নিরাপত্তা কি গতি বজায় রাখে?

কী ঘটেছে

ওপেন-ওয়েট মডেলগুলির গতিপথ নাটকীয়ভাবে পরিবর্তিত হয়েছে। যা বন্ধ মডেলগুলির সাথে সংকীর্ণ কোডিং বা যুক্তি বেঞ্চমার্কগুলির সাথে মেলার জন্য একটি প্রতিযোগিতা হিসাবে শুরু হয়েছিল তা আরও বিস্তৃত কিছুতে বিকশিত হয়েছে। মার্কিন যুক্তরাষ্ট্র, ইউরোপ এবং চীন জুড়ে গবেষণা ল্যাব এবং প্রযুক্তি কোম্পানিগুলির সাম্প্রতিক রিলিজগুলি প্রদর্শন করেছে যে ওপেন-ওয়েট মডেলগুলি এখন নির্দেশনা অনুসরণ, বহু-পদক্ষেপ যুক্তি এবং এমনকি নির্দিষ্ট সৃজনশীল কাজগুলিতে প্রতিযোগিতা করতে পারে যা একবার সবচেয়ে ব্যয়বহুল মালিকানাধীন সিস্টেমগুলির একচেটিয়া অঞ্চল ছিল।

প্যাটার্নটি সামঞ্জস্যপূর্ণ এবং ভালভাবে নথিভুক্ত: একটি সীমান্ত ল্যাব একটি বন্ধ মডেল চালু করে, একটি নতুন ক্ষমতার সীমা স্থাপন করে এবং কয়েক মাসের মধ্যে — কখনও কখনও সপ্তাহের মধ্যে — একটি ওপেন-ওয়েট মডেল অনুরূপ স্থাপত্য এবং কৌশলগুলিতে প্রশিক্ষিত বেশিরভাগ দূরত্ব বন্ধ করে। সম্প্রদায় তখন সেই মডেলটি সূক্ষ্ম-সুর করে, পরিমাণ করে এবং সর্বত্র স্থাপন করে, গবেষণা ক্লাস্টার থেকে ভোক্তা ল্যাপটপ পর্যন্ত।

যা গতি বজায় রাখেনি তা হল নিরাপত্তা অবকাঠামো। বন্ধ মডেলগুলি ব্যাপক রেড-টিমিং, সাংবিধানিক এআই কৌশল, ক্ষতি এড়ানোর জন্য বিশেষভাবে সুর করা মানব প্রতিক্রিয়া থেকে শক্তিশালীকরণ শিক্ষা এবং চলমান পর্যবেক্ষণ পাইপলাইনগুলির সাথে চালু হয়। ওপেন-ওয়েট মডেলগুলি, তাদের প্রকৃতি অনুসারে, সেই সুরক্ষা ছাড়াই চালু হয়। ওজনগুলি পণ্য। আপনি তাদের সাথে কী করেন — এবং আপনি কীভাবে নিরাপদে তাদের স্থাপন করেন — সম্পূর্ণভাবে অপারেটরের উপর নির্ভর করে।

এটি ওপেন-ওয়েট উন্নয়নের সমালোচনা নয়। এটি একটি কাঠামোগত বাস্তবতা। যখন আপনি মডেল ওজনগুলি জনসাধারণের কাছে প্রকাশ করেন, আপনি ডাউনস্ট্রিমে ঘটে যাওয়া সূক্ষ্ম-সুরকরণ নিয়ন্ত্রণ করতে পারবেন না। গবেষকরা বারবার দেখিয়েছেন যে ওপেন-ওয়েট মডেলগুলিতে প্রয়োগ করা নিরাপত্তা সূক্ষ্ম-সুরকরণ অপেক্ষাকৃত বিনম্র কম্পিউট এবং বৈরী উদাহরণগুলির একটি ছোট ডেটাসেট দিয়ে সরানো যেতে পারে। ক্ষমতা আছে। নিরাপত্তা স্তর ঐচ্ছিক, এবং তাই ভঙ্গুর।

ফলাফল হল এমন একটি ল্যান্ডস্কেপ যেখানে সবচেয়ে সক্ষম ওপেন মডেলগুলি সত্যিই চিত্তাকর্ষক — এবং অনুরূপ ক্ষমতা স্তরে তাদের বন্ধ সমকক্ষগুলির চেয়ে অসাবধানে স্থাপন করার জন্য সত্যিই বেশি বিপজ্জনক।

এশিয়ার জন্য এটি কেন গুরুত্বপূর্ণ

এই গল্পে এশিয়ার অবস্থান পেরিফেরাল নয়। সবচেয়ে সক্ষম ওপেন-ওয়েট মডেলগুলির মধ্যে কিছু চীনা প্রযুক্তি কোম্পানি এবং গবেষণা প্রতিষ্ঠান থেকে এসেছে। দক্ষিণ-পূর্ব এশিয়া, ভারত, জাপান এবং দক্ষিণ কোরিয়া জুড়ে ডেভেলপাররা এই মডেলগুলির সবচেয়ে সক্রিয় সূক্ষ্ম-সুরকারী এবং স্থাপক, এমন পণ্য তৈরি করছে যা শত শত মিলিয়ন ব্যবহারকারীদের সেবা করে।

এটি অঞ্চলের জন্য নির্দিষ্ট বেশ কয়েকটি কারণের জন্য গুরুত্বপূর্ণ। প্রথমত, এশিয়ার নিয়ন্ত্রক কাঠামোগুলি খণ্ডিত। ইউরোপীয় এআই আইন ইউরোপীয় স্থাপনার জন্য একটি অপেক্ষাকৃত একীভূত (যদি অপূর্ণ) ভিত্তি স্থাপন করে। এশিয়ার কোনো সমতুল্য নেই। সিঙ্গাপুরে ডেভেলপাররা ইন্দোনেশিয়া, ভিয়েতনাম বা জাপানে যারা আছেন তাদের চেয়ে আলাদা প্রত্যাশার অধীন। সেই খণ্ডিতকরণ মানে ওপেন-ওয়েট মডেলগুলিতে নিরাপত্তার ব্যবধান আপনি যেখানে নির্মাণ করছেন তার উপর নির্ভর করে আলাদাভাবে অবতরণ করে — এবং সবচেয়ে বিপজ্জনক স্থাপনাগুলি ধরার জন্য কোনো সাধারণ তল নেই।

দ্বিতীয়ত, এশিয়ার ডেভেলপার ইকোসিস্টেম ভিত্তিগত গবেষণার চেয়ে ব্যবহারিক স্থাপনার উপর অসমভাবে দৃষ্টি নিবদ্ধ করে। অঞ্চলের বেশিরভাগ প্রতিষ্ঠাতা এবং প্রকৌশলীরা যে প্রশ্নটি জিজ্ঞাসা করছেন তা হল "আমরা কীভাবে নিরাপদ মডেল প্রশিক্ষণ করি?" নয় — এটি "আমরা সেরা উপলব্ধ মডেলগুলি ব্যবহার করে দ্রুত কীভাবে চালু করি?" ওপেন-ওয়েট মডেলগুলি এই ব্যবহারের ক্ষেত্রে অত্যন্ত আকর্ষণীয়: কোনো এপিআই খরচ নেই, কোনো হার সীমা নেই, স্ট্যাকের উপর সম্পূর্ণ নিয়ন্ত্রণ এবং তৃতীয় পক্ষের সার্ভারে পাঠানো ছাড়াই মালিকানাধীন ডেটায় সূক্ষ্ম-সুর করার ক্ষমতা।

এগুলি বাস্তব সুবিধা। কিন্তু তারা বাস্তব দায়িত্বের সাথে আসে যা এশিয়া প্রযুক্তি ইকোসিস্টেম কেবল গুরুত্ব সহকারে মোকাবেলা করতে শুরু করছে। যখন জাকার্তা বা হো চি মিন সিটিতে একটি স্টার্টআপ একটি ভোক্তা-মুখী পণ্যে একটি সূক্ষ্ম-সুর করা ওপেন-ওয়েট মডেল স্থাপন করে, সেই স্থাপনার নিরাপত্তা বৈশিষ্ট্যগুলি সম্পূর্ণভাবে তাদের উপর নির্ভর করে। একটি সীমান্ত ল্যাবে কোনো নিরাপত্তা দল তাদের সূক্ষ্ম-সুর এবং তাদের ব্যবহারকারীদের মধ্যে দাঁড়িয়ে নেই।

তৃতীয়ত, ভাষা এবং সাংস্কৃতিক প্রসঙ্গ সমস্যাটি বাড়িয়ে তোলে। ওপেন-ওয়েট মডেলগুলির জন্য বেশিরভাগ নিরাপত্তা গবেষণা এবং রেড-টিমিং ইংরেজিতে পরিচালিত হয়। একই মডেল যা ইংরেজি-ভাষার বৈরী প্রম্পটগুলিতে যুক্তিসঙ্গতভাবে আচরণ করে তা বাহাসা ইন্দোনেশিয়া, থাই বা ভিয়েতনামীতে অনুরোধ করা হলে খুব আলাদাভাবে আচরণ করতে পারে — এমন ভাষাগুলি যেখানে নিরাপত্তা সূক্ষ্ম-সুরকরণ ডেটা বিরল এবং মূল্যায়ন কঠোরভাবে পরিচালনা করা কঠিন।

ডেভেলপারদের জন্য এর অর্থ কী

যদি আপনি ওপেন-ওয়েট মডেলগুলিতে নির্মাণ করছেন এমন একজন ডেভেলপার হন — আপনি স্থানীয়ভাবে অনুমান চালাচ্ছেন, ক্লাউড অবকাঠামোতে স্থাপন করছেন বা একটি নির্দিষ্ট ডোমেনের জন্য সূক্ষ্ম-সুর করছেন — নিরাপত্তার ব্যবধান আপনার সমস্যা সমাধান করার জন্য, অন্য কারো নয়। এটি বন্ধ-মডেল প্যারাডাইম থেকে একটি উল্লেখযোগ্য পরিবর্তন, এবং এটি আপনার স্ট্যাক সম্পর্কে কীভাবে চিন্তা করেন তার জন্য একটি ভিন্ন মানসিক মডেল প্রয়োজন।

কয়েকটি জিনিস সুনির্দিষ্টভাবে অভ্যন্তরীণ করার যোগ্য।

নিরাপত্তা সূক্ষ্ম-সুরকরণ একটি একক পদক্ষেপ নয়। যদি আপনি একটি ওপেন-ওয়েট বেস মডেলে আরএলএইচএফ বা সাংবিধানিক এআই কৌশলগুলি প্রয়োগ করেন, সেই বৈশিষ্ট্যগুলি ক্ষমতার জন্য সূক্ষ্ম-সুরকরণ চালিয়ে যাওয়ার সাথে সাথে হ্রাস পেতে পারে। প্রতিটি প্রশিক্ষণ চালান যা কাজের কর্মক্ষমতা অপ্টিমাইজ করে সারিবদ্ধতা বৈশিষ্ট্যগুলি ক্ষয় করতে পারে। আপনার প্রাথমিক স্থাপনায় নয় বরং ক্রমাগত নিরাপত্তা বৈশিষ্ট্যগুলি পরীক্ষা করে এমন মূল্যায়ন পাইপলাইনের প্রয়োজন।

সিস্টেম প্রম্পটগুলি একটি নিরাপত্তা স্তর নয়। একটি সিস্টেম প্রম্পটের মাধ্যমে একটি মডেলকে "কখনও ক্ষতিকারক বিষয়গুলি আলোচনা করবেন না" নির্দেশ করা একটি গতি বাম্প, একটি রেলিং নয়। বিনম্র প্রম্পট ইঞ্জিনিয়ারিং দক্ষতা সহ বৈরী ব্যবহারকারীরা সিস্টেম-প্রম্পট-ভিত্তিক সীমাবদ্ধতার চারপাশে রুট করতে পারে। যদি আপনার অ্যাপ্লিকেশনের অর্থপূর্ণ নিরাপত্তা প্রয়োজনীয়তা থাকে তবে সেগুলি একাধিক স্তরে প্রয়োগ করা প্রয়োজন — আউটপুট ফিল্টারিং, হার সীমাবদ্ধতা এবং আচরণগত পর্যবেক্ষণ সহ।

ক্ষমতা-নিরাপত্তা ব্যবধান মডেল আকারের সাথে স্কেল করে। ছোট পরিমাণ করা মডেলগুলি যা ভোক্তা হার্ডওয়্যারে দক্ষতার সাথে চলে সাধারণত তাদের সম্পূর্ণ-নির্ভুলতা সমকক্ষগুলির চেয়ে জেইলব্রেক করা সহজ, কারণ নিরাপত্তা সূক্ষ্ম-সুরকরণ নিম্ন প্যারামিটার গণনায় আরও ভঙ্গুর হতে থাকে। যদি আপনি অনুমান খরচ কমাতে একটি পরিমাণ করা মডেল স্থাপন করছেন তবে এটি আপনার হুমকি মডেলে ফ্যাক্টর করুন।

আপনার লক্ষ্য ভাষায় মূল্যায়ন অ-আলোচনাযোগ্য। যদি আপনার ব্যবহারকারীরা প্রাথমিকভাবে ইংরেজি ছাড়া অন্য ভাষায় আপনার পণ্যের সাথে ইন্টারঅ্যাক্ট করে তবে আপনার নিরাপত্তা মূল্যায়ন সেই ভাষায় ঘটতে হবে। ইংরেজি-ভাষার রেড-টিমিং ফলাফলগুলি নির্ভরযোগ্যভাবে স্থানান্তরিত হয় না। এটি এমন একটি ক্ষেত্র যেখানে বৃহত্তর ওপেন-সোর্স সম্প্রদায়ের উল্লেখযোগ্য অন্ধ দাগ রয়েছে এবং যেখানে এশিয়ান বাজারের জন্য নির্মাণকারী ডেভেলপারদের তাদের নিজস্ব প্রচেষ্টায় বিনিয়োগ করতে হবে।

MonstarX এ নির্মাণকারী দলগুলির জন্য — এশিয়ার এআই-নেটিভ ডেভ প্ল্যাটফর্ম — এই বিবেচনাগুলি ক্রমবর্ধমান উৎপাদন স্থাপনাগুলি কীভাবে কাঠামোগত হয় তার কেন্দ্রবিন্দু। প্ল্যাটফর্মের সংযোগকারীগুলি মডেল আউটপুটগুলিকে চূড়ান্ত ব্যবহারকারীদের কাছে পৌঁছানোর আগে বাহ্যিক নিরাপত্তা শ্রেণীবিভাজক বা সামগ্রী মডারেশন এপিআইগুলির মাধ্যমে রুট করা সহজ করে তোলে, যা ডেভেলপারদের তাদের সম্পূর্ণ স্ট্যাক পুনর্নির্মাণ ছাড়াই ওপেন-ওয়েট স্থাপনাগুলির শীর্ষে নিরাপত্তা স্তর যোগ করার জন্য একটি ব্যবহারিক প্রক্রিয়া দেয়।

বৃহত্তর পয়েন্ট হল যে ওপেন-ওয়েট মডেলগুলি আপনাকে একযোগে শক্তি এবং দায়িত্ব দেয়। যারা এই মডেলগুলির শীর্ষে সবচেয়ে টেকসই পণ্যগুলি তৈরি করবে তারা হল যারা নিরাপত্তা অবকাঠামোকে একটি প্রথম-শ্রেণীর প্রকৌশল উদ্বেগ হিসাবে বিবেচনা করে — একটি পরবর্তী চিন্তা নয় এবং কিছু নয় যা তারা মডেল প্রদানকারীকে সমাধান করার জন্য অপেক্ষা করছে।

মূল টেকঅ্যাওয়ে

ওপেন-ওয়েট মডেলগুলির সংমিশ্রণ