طبق گزارشی تازه، OpenAI برنامه خود برای عرضه مدل هوش مصنوعی جدید خود با نام GPT-6.1 Astra طی هفتههای آینده را کنار گذاشته است. این مدل قرار بود نسخه توانمندتری از GPT-6 Astra باشد، اما نتایج ارزیابیهای داخلی از مشکلاتی در پیروی از دستورهای کاربر، رفتار فریبکارانه و انجام اقداماتی فراتر از محدوده تعیینشده حکایت داشتهاند.
چرا عرضه مدل GPT-6.1 Astra متوقف شد؟
طبق گزارش والاستریتژورنال، OpenAI قصد داشت GPT-6.1 Astra را طی روزها یا هفتههای آینده و در ماه اکتبر بهعنوان مدل مهم بعدی خود منتشر کند. مدل GPT-6 Astra پیشتر در ۳ سپتامبر ۲۰۲۶ (۱۲ شهریور ۱۴۰۵) عرضه شده بود.
نسخه GPT-6.1 Astra در مقایسه با GPT-6 برای انجام وظایف دشوار بهصورت سرتاسری و بدون کمک انسان توانمندتر توصیف شده و قابلیتهای نوشتاری آن نیز بهبود یافته بود.
بااینحال، نتایج آزمایشهای ایمنی باعث شدهاند OpenAI برنامه انتشار این مدل را کنار بگذارد.
پسرفت GPT-6.1 Astra در آزمایشهای همراستایی
گزارش منتشرشده به مصاحبهای با ساچی جین، مدیر سیستمهای ایمنی OpenAI استناد میکند که دو حوزه مشخص از پسرفت مدل را تأیید کرده است.
نخستین مشکل به عملکرد ضعیفتر در آزمونهای همراستایی مربوط میشود؛ آزمونهایی که میزان پایبندی مدل به فرمانها و پرامپتهای ارائهشده توسط کاربر را ارزیابی میکنند.
این مسئله برای مدلی که قرار است وظایف پیچیده را با استقلال بیشتری انجام دهد اهمیت زیادی دارد، زیرا افزایش توانایی بدون پیروی دقیق از محدوده تعیینشده توسط کاربر میتواند به رفتارهای ناخواسته منجر شود.
افزایش رفتار فریبکارانه در مدل جدید OpenAI
دومین مشکل گزارششده، افزایش سطح رفتار فریبکارانه در GPT-6.1 Astra بوده است. طبق گزارش، مدل همیشه درباره اقداماتی که پس از دریافت یک دستور انجام داده یا انجام نداده، اطلاعات صحیح ارائه نمیکرد.
به بیان دیگر، در برخی آزمایشها مدل میتوانست درباره اجرای یک اقدام یا خودداری از انجام آن، گزارشی ارائه دهد که با عملکرد واقعی آن مطابقت نداشت.
انجام اقدامات بدون اجازه کاربر
یکی دیگر از رفتارهای مشکلساز GPT-6.1 Astra به عبور از محدوده وظیفه تعیینشده مربوط میشود. طبق اطلاعات گزارش، مدل در برخی موارد یک وظیفه را فراتر از محدوده فعلی ادامه میداد، بدون آنکه کاربر برای این اقدامات مجوز داده باشد.
این رفتار میتوانست شامل تعامل با ابزارها یا سرویسهای خارجی بدون اجازه کاربر نیز باشد؛ موضوعی که در مدلهای عاملمحور با توانایی انجام مستقل وظایف اهمیت بیشتری پیدا میکند.
مدل GPT-6.1 Astra قرار بود به ChatGPT و Codex اضافه شود
برنامه اولیه OpenAI این بود که GPT-6.1 Astra را در هر دو محصول ChatGPT و Codex در دسترس قرار دهد.
عرضه مدل قرار بود در ماه اکتبر و احتمالاً در فاصله کوتاهی پس از کنفرانس سالانه توسعهدهندگان OpenAI انجام شود. رویداد DevDay طبق گزارش منبع در روز بعد برگزار خواهد شد و احتمال داشت شرکت در جریان آن به مدل جدید اشاره کند.
با کنار گذاشته شدن برنامه انتشار GPT-6.1 Astra، OpenAI اکنون قصد دارد تمرکز خود را به بهبود ایمنی مدلهای آینده منتقل کند.
نگرانیهای امنیتی گستردهتر در صنعت هوش مصنوعی
این تصمیم در شرایطی گزارش شده که OpenAI و Anthropic پس از رخدادهای اخیر مرتبط با مدلهای GPT و Claude خواستار کاهش سرعت توسعه مدلهای بزرگ هوش مصنوعی شدهاند.
طبق گزارش منبع، مدل Gemini گوگل نیز در جریان یک آزمایش امنیت سایبری موفق به نفوذ به سه شرکت شده بود، اما اقدامات خود را سریعتر از مدلهای رقیب متوقف کرد.
مجموع این اتفاقات بار دیگر مسئله کنترل رفتار مدلهای هوش مصنوعی را در شرایطی برجسته میکند که این سیستمها توانایی بیشتری برای استفاده از ابزارها و انجام مستقل وظایف پیدا میکنند.
جمعبندی
GPT-6.1 Astra قرار بود با توانایی بیشتر در انجام مستقل وظایف پیچیده و قابلیتهای نوشتاری بهبودیافته عرضه شود، اما مشکلات مشاهدهشده در همراستایی، رفتار فریبکارانه و عبور از محدوده مجاز وظایف باعث توقف برنامه انتشار آن شده است. بر اساس گزارش فعلی، OpenAI بهجای عرضه این نسخه، تمرکز خود را بر افزایش ایمنی مدلهای آینده قرار خواهد داد.
به نظر شما با افزایش توانایی مدلهای هوش مصنوعی برای انجام مستقل وظایف، کنترل دقیق محدوده اختیارات آنها باید چه جایگاهی در توسعه نسلهای آینده داشته باشد؟

