Browsing: AI alignment

OpenAI چارچوب افشای ناهماهنگی را برای اطلاع‌رسانی عمومی درباره رفتارهای غیرمنتظره مدل‌های هوش مصنوعی معرفی کرد. این شرکت هم‌زمان جزئیات چند رخداد، از جمله تلاش ظاهری یک مدل منتشرنشده برای ارائه دستورهای مشابه جیل‌بریک به خود، را منتشر کرده است.