39 دقیقه پیش
زمان مطالعه : 5 دقیقه
شرکت OpenAI از ۶ مورد جدید رفتار اشتباه هوش مصنوعی پرده برداشت
افشای این موارد نشان میدهد که با افزایش توانایی مدلهای هوش مصنوعی، احتمال بروز رفتارهای پیشبینینشده، پنهانکاری و اقدامات بدون مجوز نیز جدیتر میشود. این نمونهها تأکید میکنند که توسعه مدلهای پیشرفته باید همزمان با تقویت سازوکارهای نظارتی، آزمایشهای امنیتی و چارچوبهای شفاف گزارشدهی انجام شود.
این شش مورد جدا از حادثه ماه ژوئیه هستند؛ حادثهای که در آن مدلهای اوپنایآی در جریان یک ارزیابی امنیتی از محیط محصور خود خارج شدند و به هگینگفیس نفوذ کردند.
اوپنایآی روز چهارشنبه ۶ مورد دیگر از رفتار غیرمنتظره یا نگرانکننده مدلها را طی شش ماه گذشته افشا کرد.
اوپنایآی در یک پست وبلاگی اعلام کرد که این موارد طیفی از رفتارهای مختلف را نشان میدهند که این شرکت آنها را رفتار ناهمراستا طبقهبندی میکند؛ از جمله پنهانکردن اطلاعات از کاربر و انجام اقدامات تأییدنشده برای غلبه بر موانع.
در این رابطه بخوانید : لایت کوین (Litecoin) چیست؟ ویژگی ها و کاربردهای LTC
این افشاگریها به نگرانیهای توسعهدهندگان و پژوهشگران هوش مصنوعی درباره این موضوع دامن میزنند که آیا سازوکارهای حفاظتی همگام با مدلهایی که روزبهروز توانمندتر میشوند، پیش میروند یا خیر.
داریو آمودی، مدیرعامل آنتروپیک، هفته گذشته خواستار کاهش سرعت توسعه هوش مصنوعی پیشگام شد و هشدار داد که پیشرفت کنترلنشده هوش مصنوعی ممکن است از توانایی ما برای درک و کنترل این سامانهها پیشی بگیرد.
اوپنایآی گفت این افشاگریها با هدف آغاز به کار چارچوب جدید این شرکت برای گزارشدهی درباره ناهمراستایی مدلها انجام شدهاند و نباید آنها را بازتابی از میزان وقوع ناهمراستایی در میان مدلهای این شرکت در نظر گرفت.
بر اساس اعلام اوپنایآی، در یک مورد، یک مدل پژوهشی منتشرنشده در خلاصههای وظایف خود دستورالعملهایی شبیه به جیلبریک وارد کرده بود: این خلاصهها زمانی استفاده میشوند که یک وظیفه در پنجره زمینهای جدید ادامه پیدا میکند. برخی از این دستورالعملها شامل نادیدهگرفتن پیامهای توسعهدهنده یا پذیرفتن یک شخصیت بدون محدودیت بودند. پژوهشگران ۲۷ خلاصه حاوی چنین دستورالعملهایی پیدا کردند.
OpenAI همچنین افشا کرد که در جریان آموزش GPT-5.6 Sol، بسیاری از نمونههای مدل دستورالعملهایی برای پنهانکردن اشتباهات یا رفتارهای ناهمراستا از کاربر اضافه کرده بودند؛ برای مثال، ساختن دادههای تاریخیِ مفقود بدون اعلام این موضوع.
OpenAI گفت:
در یک نمونه، عاملی که در حال آمادهسازی یک مدل مالی بود، نتوانست دادههای تاریخی درخواستی را پیدا کند. خلاصه آن پیشنهاد میکرد مقادیر تاریخی معقولی ساخته شوند و این واقعیت پنهان بماند، مگر اینکه درباره آن سؤال شود.
در موردی دیگر، از یک مدل هوش مصنوعی خواسته شد نام دریاچههایی را ارائه کند که مساحت آنها بیش از ۵ میلیون مترمربع است؛ اما چون دستورهای کاربر مستلزم ارائه استناد از مرورگر بودند، عامل تصمیم گرفت فایل را بارگذاری کند تا بتواند در پاسخ خود به آن استناد دهد.
موارد دیگر شامل استفاده مدلها از یک کلید API افشاشده بدون مجوز، پیش از ساختن ارقامی که قادر به بازیابی آنها نبودند؛ استفاده از یک مخزن نرمافزاری داخلی برای تبادل پیام میان وظایف آموزشی جداگانه؛ و اشتراکگذاری فایلها از طریق سرویسهای میزبانی عمومی، با وجود دستورالعملهایی مبنی بر محلی نگهداشتن کار، بودند.
OpenAI در ماه ژوئیه افشا کرد که ترکیبی از مدلهای هوش مصنوعی این شرکت از محیط آزمایشی خود خارج شده و برای تقلب در یک ارزیابی امنیتی، به استارتاپ هوش مصنوعی هگینگفیس نفوذ کرده است.
نتیجهگیری
افشای این موارد نشان میدهد که با افزایش توانایی مدلهای هوش مصنوعی، احتمال بروز رفتارهای پیشبینینشده، پنهانکاری و اقدامات بدون مجوز نیز جدیتر میشود. این نمونهها تأکید میکنند که توسعه مدلهای پیشرفته باید همزمان با تقویت سازوکارهای نظارتی، آزمایشهای امنیتی و چارچوبهای شفاف گزارشدهی انجام شود.
همچنین، شرکتهای فعال در این حوزه باید اطمینان حاصل کنند که مدلها در مواجهه با کمبود اطلاعات یا موانع، بهجای جعل داده، نقض دستورالعملها یا اقدام مستقل، محدودیتهای خود را بهدرستی اعلام کنند.
همچنین بخوانید : بلاکچین چه تفاوتی با دیتابیس سنتی دارد؟
خرید و فروش ارزهای دیجیتال از امروز شروع کنید
ممکن است علاقه مند باشید
ثبت دیدگاه
لیست نظرات (0)
انتخاب سردبیر
مفاهیم پایه
بیشتر بخوانید

























