به گزارش خبرآنلاین، به نقل از زومیت، نسخهی جدید در انجام وظایف پیچیده بدون دخالت انسان و مهارتهای نگارشی نسبتبه GPT-۶ Astra عملکرد قویتری ثبت کرده بود؛ اما در آزمونهای ایمنی با پسرفت شدیدی روبهرو شد.
ساچی جین، مدیر سیستمهای ایمنی اوپنایآی، میگوید: «مدل در آزمونهای سنجش همترازی یا میزان پایبندی به دستورهای اپراتور انسانی ضعیف عمل کرد و سطوح بالاتری از فریبکاری را نشان داد، بهطوری که دربارهی اقداماتی که پس از دریافت دستور انجام داده یا نداده بود، همواره حقیقت را نمیگفت.»
گفته میشود مدل GPT-۶.۱ Astra علاوه بر پنهانکاری، وظایف را فراتر از دامنهی تعیینشده پیش میبرد و بدون اجازه کاربر با ابزارها یا سرویسهای خارجی تعامل برقرار میکرد. اوپنایآی قصد داشت مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما اکنون تمرکز خود را به بهبود ایمنی مدلهای آینده معطوف کرده است.
۵۸۵۸

