هشدار OpenAI درباره رفتارهای غیرمنتظره هوش مصنوعی؛ توسعه AI نمیتواند با حداکثر سرعت ادامه یابد

شرکت OpenAI از شش نمونه دیگر از رفتارهای «غیرمنتظره یا نگرانکننده» فناوری هوش مصنوعی خود پرده برداشته و هشدار داده است که روند توسعه این فناوری نمیتواند برای مدت طولانی با «حداکثر سرعت» ادامه پیدا کند.
به گزارش اینتومان، در یکی از موارد جدید که OpenAI گزارش کرده است، یک مدل تحقیقاتی که هنوز عرضه نشده، دستورالعملهایی شبیه به «جیلبریک» را در یادداشتهای خود قرار داده تا محدودیتهای معمولش را نادیده بگیرد. این مدل همچنین به خودش گفته بود که باید «از نقشها و هویتهایی که سایر چتباتها را محدود میکنند، رها شود».
به گزارش گاردین، در نمونهای دیگر، یک عامل هوش مصنوعی بدون درخواست از کاربر، فایلهایی را روی اینترنت بارگذاری کرده تا بتواند برای مرورگر، یک استناد دریافت کند.
OpenAI، شرکت سازنده ChatGPT، در مطلبی که چهارشنبه شب در وبلاگ خود منتشر کرد، از راهاندازی چارچوب جدیدی برای ردیابی، بررسی و افشای موارد «ناهمسویی» مدلهای هوش مصنوعی خبر داد. منظور از ناهمسویی، مواردی است که هوش مصنوعی به ارزشهای انسانی و اهداف ایمنی تعیینشده پایبند نمیماند.
OpenAI در این مطلب همچنین با درخواست رقیب خود، Anthropic، برای کاهش سرعت توسعه هوش مصنوعی همسو شد. Anthropic پیشتر هشدار داده بود که سرعت فعلی توسعه این فناوری میتواند تهدیدی برای بقای انسان باشد.
OpenAI اعلام کرد: «ما معتقد نیستیم صنعت هوش مصنوعی میزان کافی از مشکلات همسویی و نظارت را حل کرده باشد تا بتواند برای مدت طولانی با حداکثر سرعت بهطور مسئولانه به توسعه ادامه دهد.»
این شرکت همچنین تأکید کرد تصمیمگیری درباره مسیر توسعه هوش مصنوعی در ماهها و سالهای آینده باید بر شواهدی متکی باشد که افراد خارج از شرکتهای سازنده مدلهای پیشرفته نیز بتوانند بهطور مستقل بررسی کنند.
گوگل و ایلان ماسک، مالک یک شرکت فعال در حوزه هوش مصنوعی، نیز از درخواستها برای کاهش سرعت توسعه این فناوری حمایت کردهاند. دونالد ترامپ با این درخواستها مخالفت کرده و ضرورت حفظ برتری آمریکا نسبت به صنعت هوش مصنوعی چین را مطرح کرده است.
برخی کارشناسان نیز نسبت به این درخواستها با تردید نگاه کردهاند. از جمله، هشدار داده شده است که شرکتهای هوش مصنوعی نباید حسابرسان و ناظران خود را خودشان تعیین کنند.
نمونههایی از تهدیدهای بالقوه و بسیار جدی ناشی از هوش مصنوعی، از کمک به توسعه سلاحهای زیستی تا ایجاد بحران مالی جهانی را در بر میگیرد. یکی از پژوهشگران ارشد حوزه ایمنی هوش مصنوعی در Anthropic نیز گفته است احتمال اینکه هوش مصنوعی طی یک دهه آینده «تمام انسانها را بکشد» بیش از ۱۰ درصد است. با این حال، فردی آشنا با دیدگاههای Anthropic اذعان کرده است که «احتمال دقیق وقوع هر نتیجه مشخصی احتمالاً قابل محاسبه نیست».
OpenAI اعلام کرد این شش حادثه در جریان آموزش یا ارزیابی مدلهای هوش مصنوعی طی ماههای گذشته شناسایی شدهاند.
موارد جدید روز چهارشنبه پس از آن اعلام شدند که OpenAI در ماه ژوئیه فاش کرد یک «گروه» از عوامل هوش مصنوعی این شرکت در جریان یک آزمایش امنیت سایبری، به شرکت هوش مصنوعی Hugging Face نفوذ کردهاند.
Anthropic نیز در همان ماه اعلام کرده بود مدلهای هوش مصنوعی این شرکت در جریان آزمایش، به سه سازمان نفوذ کردهاند. این شرکت گفت مدلها عمداً بدون برخی تدابیر امنیت سایبری آزمایش شده بودند و به دلیل سوءتفاهم با یک شرکت آزمایش خارجی، توانسته بودند به اینترنت عمومی دسترسی پیدا کنند. این وضعیت از نظر OpenAI معادل آن بود که درِ ورودی خانه را باز بگذاریم.
«عاملهای هوش مصنوعی» به ابزارهایی گفته میشود که میتوانند بهصورت مستقل فعالیت کنند. لیانگ جِی سو، تحلیلگر ارشد گروه پژوهشی و مشاوره فناوری Omdia، گفت این عاملها باهوشتر شدهاند و در حل وظایف پیچیده، بیش از گذشته به «همکاری میان عوامل، اشتراکگذاری اطلاعات، فریب و پنهانکاری» متوسل میشوند.
به گفته او، این روند کنترل و مهار عاملهای هوش مصنوعی را با استفاده از روشهای سنتی امنیت هوش مصنوعی دشوارتر کرده است.
چارچوب جدید OpenAI برای ردیابی و افشای این موارد میتواند سایر شرکتهای فعال در حوزه هوش مصنوعی را نیز به اتخاذ رویههای مشابه ترغیب کند.
سو در اینباره گفت: «با این حال، این فرایند همچنان داخلی و داوطلبانه است، اما گامی در مسیر درست محسوب میشود.»



