
LLM ها به طور متفاوتی به محرک های مضر پاسخ می دهند زمانی که علامت گذاری AI استفاده می شود
September 19, 2026
اپل iOS 27، macOS Golden Gate 27 را با Siri AI و Liquid Glass اصلاح می کند
September 19, 2026بایگانی برچسب ها و megalomania: OpenAI جزئیات جدید "بد" حوادث عامل
برای مدتی، مسئله “ ترازسازی هوش مصنوعی” (به عنوان مثال، چگونگی عملکرد مدل AI با نیت خالق و یا کاربر) یک نگرانی اصلی و موضوع بحث در میان محققان ایمنی هوش مصنوعی بوده است. از زمان افشای OpenAI در مورد حادثه بدنام هک شدن چهره در ماه ژوئیه، مفهوم " تراز هوش" خود را شکسته و به طور فزاینده ای تبدیل به یک نگرانی در حال افزایش و موضوع گفتگو در میان عموم مردم.
شاید در به رسمیت شناختن آن، OpenAI این هفته را به یک چارچوب جدید برای افشای "عدم توازن مدل در OpenAI"، از جمله شش نمونه از "رفتار غیر منتظره یا مربوط به مدل" مشاهده شده در داخل شرکت در شش ماه گذشته. این شرکت گفت که انتشار جزئیات این حوادث امیدوار کننده خواهد بود که "به دیگران اجازه دهید تا مشکلات مشابهی را بررسی کنند، توضیحات ما را آزمایش کنند و کاهش ها را بهبود بخشند."
همانطور که می گویم، نه به عنوان شما
در میان گزارش های تازه افشا شده OpenAI در هفته جاری، یکی که بیشتر شبیه به یک داستان علمی تخیلی در مورد یک AI سرکش است که تلاش برای شکستن آزاد شامل یک نمونه از تزریق سریع تولید شده توسط خود است، در تلاش برای اسکن کاتالوگ کتابخانه برای نمونه هایی از لیست "بهترین کتاب ها"، مدل به طور پیچیده از عملکرد "compaction" خود استفاده کرد (جایی که در آن داده ها و یافته های بعدی برای بازیابی مگالومان خلاصه می شود:
مقاله کامل بخوانید
نظرات
💻 کدزن | طراحی سایت و سامانههای آنلاین
🚀 ایدهات رو به یک محصول آنلاین حرفهای تبدیل کن
🌐 www.codzan.ir
💬 طراحی • توسعه • پشتیبانی




