OpenAI হ্যাক একটি মিনি পেপারক্লিপ ম্যাক্সিমাইজার ছিল

OpenAI হ্যাক একটি মিনি পেপারক্লিপ ম্যাক্সিমাইজার ছিল


পেপারক্লিপ ম্যাক্সিমাইজার হিসাবে OpenAI হ্যাক

একটি জিনিস যা আমি মনে করি না যে এই OpenAI / Hugging Face ঘটনাটি নিয়ে যথেষ্ট লোক চিন্তা করছে তা হ’ল এটি বিখ্যাত পেপারক্লিপ ম্যাক্সিমাইজার দৃশ্যের একটি বাস্তব উদাহরণ যা AI সুরক্ষা ধরণের দ্বারা পছন্দ করা হয়।

এখানেই আপনি একটি এআইকে একটি লক্ষ্য দেন এবং এটি আসলে (প্রযুক্তিগতভাবে) আপনি যা করতে বলেন তাই করে। কিন্তু এটি করার প্রক্রিয়ায়, এটি এমন কিছু করে যা আপনি চান না। এবং অনুমান করেনি।

এর আদর্শ উদাহরণ হল, “আমি যতটা সম্ভব পেপারক্লিপ চাই।” তাই AI গ্রহের সমস্ত লোহা সংগ্রহ করার জন্য একটি রোবট সেনাবাহিনী তৈরি করে, যার মধ্যে সমস্ত মানুষকে হত্যা করা অন্তর্ভুক্ত কারণ আমাদের রক্তে লোহা রয়েছে।

উফ।

এখানে কৌশলটি হল AI আসলে যা জিজ্ঞাসা করা হয়েছিল তা করেছে। যদি এটি তার নিজস্ব লক্ষ্য নিয়ে আসে তবে এটি একটি পৃথক সমস্যা হবে। কিন্তু এটি আসলে, অনেক কাগজের ক্লিপ তৈরি করেছিল।

এই নাও, বস।

(দীর্ঘ বিরতি)

বস?

ওপেনএআই-এর সাথে এই পরিস্থিতিতে, এটি ঠিক হয়নি সিদ্ধান্ত এই হ্যাকিং প্রতিযোগিতা জিততে: এটি ছিল বলা হ্যাকিং প্রতিযোগিতায় জয়ী হতে এবং সেটা করতে যা যা লাগে তাই করতে। আপনার সেরা চেষ্টা, মূলত.

তাই এটি কন্টেন্টমেন্ট এড়িয়ে গেছে, 0-দিনের সংখ্যা লিখেছে, ইন্টারনেট অ্যাক্সেস পেয়েছে এবং তারপরে একটি আসল কোম্পানি হ্যাক করতে এগিয়ে গেছে-যাতে পারে পরীক্ষা পাস

ওপেনএআই-এর নিজস্ব ঘটনার রিপোর্টে যেমন বলা হয়েছে, মডেলটি তা করতে পেরেছে

…তার অত্যন্ত বিচ্ছিন্ন স্যান্ডবক্সযুক্ত পরিবেশ থেকে বেরিয়ে আসুন এবং একটি শূন্য-দিনের দুর্বলতা আবিষ্কার এবং শোষণ করে উন্মুক্ত ইন্টারনেট অ্যাক্সেস পান, তারপর একত্রিত হয়ে “চুরি করা প্রমাণপত্র এবং শূন্য-দিনের দুর্বলতাগুলি ব্যবহার করা সহ, একটি দূরবর্তী কোড কার্যকর করার পথ খুঁজে বের করার জন্য বেশ কয়েকটি আক্রমণ ভেক্টর”।

…সবই একটি বেঞ্চমার্ক সমাধানের জন্য “যেকোন মূল্যে” ক্র্যাক করতে বলা হয়েছিল।

এই পরিস্থিতিতে সমস্যা মধ্যে ধাপ, যেখানে অতিরিক্ত প্রসঙ্গ কিছু কিছু না করা যা মানুষের কাছে স্পষ্ট, AI এর কাছে স্পষ্ট নয়।

তাই একদিকে, অনেক লোক বলছে, “আচ্ছা, এটি একটি বড় বিষয় নয় কারণ এটি করতে বলা হয়েছিল।”

তবে এখানে গুরুত্বপূর্ণ বিষয়টি কাজটিতে রয়ে গেছে কিনা তা নয়, কিন্তু কাজটি সম্পন্ন করার জন্য এটি কী করেছে. যে জিনিসটি এআই-এর কাছে স্পষ্ট নয় তা হল কাজ এবং তা সম্পন্ন করার জন্য নেওয়া পদক্ষেপ উভয়ই সব অনুরোধকারীর অন্তর্নিহিত লক্ষ্যের মধ্যে থাকতে হবে।

অন্য কথায়, “পরীক্ষায় উত্তীর্ণ” AI দ্বারা প্রাপ্ত হওয়া উচিত ছিল, “আপনার যা করা উচিত নয় এমন কিছু না করে পরীক্ষায় পাস করুন।” এবং যে “অনুমিত না” তারপর অনেক কাজ করতে দেখা যাচ্ছে.

এই গল্পের অন্য আকর্ষণীয় দিক হল যে এই ক্ষেত্রে ডিফেন্ডাররা, হাগিং ফেস, পরিস্থিতি শনাক্ত করতে AI ব্যবহার করেছিল, কিন্তু গার্ডেলের কারণে তারা পিনাকল মডেল থেকে সাহায্য পেতে সক্ষম হয়নি। যখন তারা ওপেনএআই এবং নৃতাত্ত্বিক মডেলের সাহায্যের জন্য জিজ্ঞাসা করেছিল, মডেলগুলি প্রত্যাখ্যান করেছিল।

তাদের নিরাপত্তা প্রতিরক্ষা কাজ করার জন্য স্থানীয়ভাবে চলমান একটি উন্মুক্ত চীনা মডেল (Qwen 3.5) ব্যবহার করতে হয়েছে।

কেন সাইবার ডিফেন্ডারদের সর্বোত্তম মডেলগুলিতে অ্যাক্সেসের প্রয়োজন তার জন্য এত স্পষ্ট ঘটনা। আমার মনে, এই সমস্ত ডিফেন্ডারদের সেরা মডেলগুলি ব্যবহার করা উচিত ছিল এবং সাইবার-সম্পর্কিত কিছু করার জন্য ইতিমধ্যেই তাদের অ্যাকাউন্টের মধ্যে প্রাক-অনুমোদিত করা উচিত ছিল। আমার কাছে, এটিই পরিষ্কার সমাধান বনাম সুরক্ষাগুলি সম্পূর্ণভাবে অপসারণ করা৷ এটি harnesses অংশ হিসাবে একটি পরিচয় স্তর.

এটি সহজেই সবচেয়ে আকর্ষণীয় AI হ্যাকিং পরিস্থিতি যা আমি এখনও শুনেছি। আমি শুধু আশা করি আমরা এর থেকে সঠিক শিক্ষা গ্রহণ করব।



Source link

Postagens Similares

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *