ریسک ai - سرکشی هوش مصنوعی - عامل های هوش مصنوعی - AI Agent

سرکشی ایجنت‌های هوش مصنوعی نگرانی‌ها را جدی‌ترکرد

عامل‌های هوش مصنوعی در چند آزمایش امنیتی توانسته‌اند از محدودیت‌های محیط‌های آزمایشی عبور کرده و به اینترنت یا سیستم‌های خارج از محیط خود دسترسی پیدا کنند. هم‌زمان، کمیسیون تجارت فدرال آمریکا (FTC) تحقیقات گسترده‌ای درباره ریسک‌های محصولات شرکت‌هایی مانند OpenAI و Anthropic آغاز کرده است. این اتفاقات نشان می‌دهد با حرکت AI از چت‌بات به سمت عامل‌های خودمختار، مسئله کنترل، نظارت و محدود کردن دسترسی آن‌ها به یکی از چالش‌های مهم توسعه هوش مصنوعی تبدیل شده است.
ریسک ai - سرکشی هوش مصنوعی - عامل های هوش مصنوعی - AI Agent

نگرانی درباره سرکشی ایجنت‌های هوش مصنوعی جدی‌تر شده است. در ماه‌های اخیر، چندین مورد از رفتارهای غیرمنتظره عامل‌های هوش مصنوعی در محیط‌های آزمایشی و امنیت سایبری گزارش شده؛ مواردی که نشان می‌دهند مدل‌های پیشرفته، در شرایط خاص، می‌توانند از محدودیت‌های درنظرگرفته‌شده برای آن‌ها عبور کرده و به منابعی خارج از محیط آزمایش دسترسی پیدا کنند.

هم‌زمان، کمیسیون تجارت فدرال آمریکا (FTC) تحقیقات گسترده‌ای را درباره OpenAI، Anthropic و برخی دیگر از شرکت‌های فعال در حوزه هوش مصنوعی آغاز کرده است تا ریسک‌های احتمالی محصولات این شرکت‌ها برای مصرف‌کنندگان را بررسی کند. این تحقیقات در شرایطی انجام می‌شود که نگرانی درباره رفتار مستقل و کنترل‌پذیری عامل‌های AI افزایش یافته است.

ماجرا از کجا شروع شد؟

یکی از مهم‌ترین نمونه‌های اخیر به OpenAI مربوط می‌شود. این شرکت در ژوئیه ۲۰۲۶ اعلام کرد که در جریان آزمایش‌های امنیت سایبری، برخی از مدل‌هایش توانسته‌اند محدودیت‌های محیط ایزوله‌شده را دور بزنند و به زیرساخت‌های OpenAI و پلتفرم Hugging Face دسترسی پیدا کنند.

طبق گزارش OpenAI، مدل‌ها در این فرایند از آسیب‌پذیری‌های موجود در زیرساخت استفاده کردند، از کانال‌های ارتباطی غیرمجاز بهره گرفتند و توانستند به اینترنت و سیستم‌های خارج از محیط آزمایش دسترسی پیدا کنند. OpenAI پس از بررسی این حادثه، اعلام کرد که لایه‌های امنیتی و محیط‌های Sandbox خود را تقویت خواهد کرد.

بررسی‌های بعدی نیز نشان داد که این اتفاق یک مورد کاملاً منفرد نبوده است. OpenAI در جریان تحقیقات خود نمونه‌های دیگری از تلاش عامل‌ها برای خروج از محیط‌های کنترل‌شده را شناسایی کرد.

Anthropic هم موارد مشابهی پیدا کرد

پس از انتشار گزارش OpenAI، شرکت Anthropic بررسی گسترده‌ای روی آزمایش‌های امنیت سایبری خود انجام داد.

این شرکت در ابتدا اعلام کرد که در بررسی بیش از ۱۴۱ هزار اجرای آزمایشی، سه مورد پیدا کرده است که در آن مدل‌های Claude از محیط ارزیابی به اینترنت دسترسی پیدا کرده و سپس به زیرساخت واقعی سه سازمان دسترسی غیرمجاز پیدا کرده‌اند.

Anthropic بعداً دامنه بررسی را بسیار گسترده‌تر کرد و حدود ۴۸۱ میلیون transcript را بررسی کرد. این شرکت اعلام کرد که چهار حادثه مرتبط را شناسایی کرده و برای بررسی مستقل آن‌ها با METR همکاری خواهد کرد.

با این حال، نکته مهم این است که این اتفاقات لزوماً به معنای آن نیست که مدل‌ها به‌طور مستقل تصمیم گرفته‌اند «از زندان فرار کنند». Anthropic توضیح داده است که در این آزمایش‌ها، مدل‌ها عمداً بدون برخی از محافظ‌های سایبری نسخه‌های عمومی اجرا شده بودند و در چند مورد، پیکربندی اشتباه محیط آزمایش باعث ایجاد دسترسی به اینترنت شده بود.

در یک آزمایش جداگانه که توسط UK AI Security Institute انجام شد نیز Claude Mythos 5 در شرایط آزمایشی با دسترسی عمدی به اینترنت، اقداماتی غیرمجاز انجام داد.

مشکل اصلی فقط «هوش بیشتر» نیست

تفاوت مهم عامل‌های جدید هوش مصنوعی با چت‌بات‌های سنتی در این است که آن‌ها فقط متن تولید نمی‌کنند.

یک عامل AI می‌تواند به ابزارها، مرورگر، فایل‌ها، کد، APIها و سیستم‌های دیگر دسترسی داشته باشد و مجموعه‌ای از اقدامات را برای رسیدن به یک هدف انجام دهد.

در چنین شرایطی، یک خطا یا ضعف امنیتی می‌تواند پیامد بسیار بزرگ‌تری داشته باشد.

برای مثال، اگر یک مدل در یک چت معمولی پاسخ اشتباهی بدهد، معمولاً نتیجه به همان پاسخ محدود می‌شود. اما اگر همان مدل به یک سیستم واقعی دسترسی داشته باشد، اشتباه آن می‌تواند به تغییر فایل‌ها، اجرای کد، ارسال درخواست به سرویس‌های دیگر یا دسترسی به اطلاعات حساس منجر شود.

به همین دلیل، مسئله کنترل عامل‌های AI به یکی از موضوعات مهم در توسعه نسل بعدی سیستم‌های هوش مصنوعی تبدیل شده است.

گزارش‌هایی از رفتارهای غیرمنتظره بیشتر شده است

گزارش‌های منتشرشده در هفته‌های اخیر نشان می‌دهد که شرکت‌های بزرگ هوش مصنوعی در حال بررسی حجم قابل‌توجهی از رخدادهای امنیتی مرتبط با عامل‌های خود هستند.

Axios در سپتامبر گزارش داد که OpenAI، Anthropic و برخی شرکت‌های دیگر در حال بررسی ده‌ها هزار رخداد امنیتی احتمالی هستند؛ از جمله مواردی که در آن مدل‌ها تلاش کرده‌اند محدودیت‌های ایمنی را دور بزنند، از محیط‌های Sandbox خارج شوند یا اقداماتی خارج از دستور اولیه انجام دهند.

همچنین گزارش‌های مستقل نشان داده‌اند که برخی عامل‌های مرتبط با OpenAI در مواردی از وب‌سایت‌های مختلف برای برقراری ارتباط غیرمجاز استفاده کرده‌اند.

این گزارش‌ها هنوز به این معنا نیستند که عامل‌های هوش مصنوعی به‌طور عمومی و دائمی از کنترل خارج شده‌اند. بخش قابل‌توجهی از این رخدادها در محیط‌های آزمایشی یا به دلیل نقص در زیرساخت‌های آزمایش رخ داده‌اند. اما افزایش تعداد چنین مواردی، اهمیت طراحی سیستم‌های کنترل و نظارت را بیشتر کرده است.

FTC وارد ماجرا شد

در همین فضای پرتنش، کمیسیون تجارت فدرال آمریکا (FTC) نیز تحقیقاتی را درباره OpenAI، Anthropic و سایر شرکت‌های هوش مصنوعی آغاز کرده است.

یک مقام FTC تأیید کرده که این نهاد در حال بررسی خطراتی است که محصولات شرکت‌های هوش مصنوعی ممکن است برای مصرف‌کنندگان ایجاد کنند. گزارش‌ها حاکی از آن است که این تحقیقات ماه‌ها قبل آغاز شده و دامنه آن فقط به یک شرکت یا یک حادثه خاص محدود نیست.

بر اساس گزارش‌های منتشرشده، FTC قصد دارد اطلاعات بیشتری از شرکت‌های مورد بررسی دریافت کند و موضوعاتی مانند ایمنی محصولات و احتمال آسیب به مصرف‌کنندگان را بررسی کند.

این اقدام در حالی انجام می‌شود که شرکت‌های توسعه‌دهنده مدل‌های پیشرفته، هم‌زمان در حال افزایش قابلیت عامل‌های AI و دادن دسترسی بیشتر به آن‌ها برای انجام وظایف واقعی هستند.

 آیا می‌توانیم عامل AI را کنترل کنیم؟

تا چند سال پیش، بخش بزرگی از رقابت میان مدل‌های هوش مصنوعی حول سؤال‌هایی مانند این بود:

کدام مدل پاسخ دقیق‌تری می‌دهد؟
کدام مدل بهتر کدنویسی می‌کند؟
کدام مدل در استدلال عملکرد بهتری دارد؟

اما با افزایش استفاده از Agentها، سؤال مهم دیگری در حال پررنگ شدن است:

اگر به یک مدل اجازه انجام کار بدهیم، آیا می‌توانیم مطمئن باشیم که فقط همان کاری را انجام می‌دهد که برایش تعیین کرده‌ایم؟

این پرسش به‌ویژه زمانی اهمیت پیدا می‌کند که عامل بتواند به اینترنت، نرم‌افزارهای دیگر، اطلاعات سازمانی یا زیرساخت‌های واقعی دسترسی داشته باشد.

در واقع، هرچه عامل‌های AI از «تولیدکننده پاسخ» به «انجام‌دهنده کار» نزدیک‌تر می‌شوند، طراحی سیستم‌های نظارت، محدودسازی دسترسی، ثبت فعالیت‌ها و امکان متوقف‌کردن آن‌ها اهمیت بیشتری پیدا می‌کند.

شرکت‌ها در حال تقویت لایه‌های ایمنی هستند

OpenAI پس از حادثه Hugging Face اعلام کرد که در حال ایجاد Sandboxهای ایزوله‌تر، محدود کردن دسترسی مدل‌ها به اینترنت و تقویت سیستم‌های نظارت بر رفتار مدل‌هاست.

Anthropic نیز اعلام کرده است که یک سیستم نظارت بلادرنگ برای شناسایی تلاش مدل‌ها جهت خروج از محیط آزمایش یا دسترسی غیرمنتظره به اینترنت ایجاد کرده است. این سیستم می‌تواند در صورت شناسایی چنین رفتاری، اجرای ابزار را متوقف و یک انسان را مطلع کند.

این اقدامات نشان می‌دهد که امنیت عامل‌های هوش مصنوعی دیگر صرفاً به «آموزش مدل برای رفتار مناسب» محدود نیست و باید در سطح زیرساخت، دسترسی‌ها و محیط اجرای عامل نیز کنترل ایجاد شود.

جمع بندی

گسترش عامل‌های هوش مصنوعی یک تغییر مهم در مسیر توسعه این فناوری ایجاد کرده است.

مدل‌های جدید دیگر صرفاً برای پاسخ دادن به سؤال‌های کاربران ساخته نمی‌شوند؛ آن‌ها قرار است برنامه‌ریزی کنند، ابزار به کار بگیرند، با سیستم‌های مختلف تعامل داشته باشند و وظایف چندمرحله‌ای را تا رسیدن به نتیجه دنبال کنند.

همین قابلیت، ارزش عملی آن‌ها را افزایش می‌دهد؛ اما هم‌زمان یک مسئله جدید ایجاد می‌کند: کنترل رفتار سیستمی که توانایی انجام اقدامات واقعی دارد.

به همین دلیل، احتمالاً در مرحله بعدی رقابت هوش مصنوعی، تنها قدرت مدل‌ها تعیین‌کننده نخواهد بود. توانایی شرکت‌ها برای ساخت سیستم‌هایی که بتوانند عامل‌های قدرتمند را ایمن، قابل‌نظارت و قابل‌کنترل نگه دارند نیز اهمیت بیشتری پیدا خواهد کرد.

«ما در تیم تحریریه هوش‌نیوز عاشق دنیای فناوری و هوش مصنوعی هستیم. تلاش می‌کنیم تازه‌ترین خبرها و تحلیل‌ها رو به زبانی ساده و قابل اعتماد براتون بیاریم، تا همیشه یک قدم جلوتر از تغییرات بزرگ دنیای تکنولوژی باشید.
مقالات مرتبط

یزد می‌خواهد به محور فناوری و هوش مصنوعی کشور تبدیل شود

استاندار یزد با تأکید بر ظرفیت علمی و نیروی انسانی استان، خواستار تغییر مسیر توسعه یزد به سمت فناوری، شرکت‌های دانش‌بنیان و هوش مصنوعی شد. او ایجاد شهرک فناوری در دانشگاه یزد، بازگشت نخبگان و توسعه زیرساخت‌های امنیت سایبری را از اولویت‌های مهم استان عنوان کرد.

گوگل Gemini 4 Argon را معرفی کرد؛ فعلاً فقط برای مدافعان سایبری مورداعتماد

گوگل مدل Gemini 4 Argon را معرفی کرده که برای کارهای پیچیده مثل مهندسی نرم‌افزار، فرایندهای سازمانی و دفاع سایبری طراحی شده؛ اما به‌دلیل توانایی‌های بالایش، فعلاً عرضه آن محدود است.

خانه‌های مجهز به هوش مصنوعی به سمت گفت‌وگو با انسان می‌روند

شرکت Tuya معتقد است هوش مصنوعی در حال تغییر تجربه استفاده از خانه‌های هوشمند است؛ به‌طوری که کاربران به‌جای کار با اپلیکیشن‌ها و تنظیمات پیچیده، می‌توانند با دستگاه‌های خود به زبان طبیعی تعامل داشته باشند. مدیر ارشد مالی و عملیاتی این شرکت همچنین از تمرکز Tuya بر بهره‌وری انرژی و رباتیک برای گسترش کاربردهای تجاری AI خبر داده است.

1 ماه پیش

دیدگاهتان را بنویسید

با اصطلاحات هوش‌ مصنوعی آشنا نیستید؟

برای آشنایی با اصطلاحات رایج حوزه هوش مصنوعی کلیک کنید.