معرفی مدل‌های جدید ایمنی آنلاین توسط OpenAI

مدل‌های تازه OpenAI برای شناسایی و دسته‌بندی انواع صدمه‌های آنلاین

در تلاش برای ارتقای امنیت آنلاین، OpenAI دو مدل تازه تحت عنوان gpt-oss-safeguard-120b و gpt-oss-safeguard-20b را معرفی کرده است. این مدل‌ها که بر основе مدل‌های gpt-oss توسعه یافته‌اند، به گسترش‌دهندگان این امکان را می‌دهند تا انواع صدمه‌های آنلاین را در پلتفرم‌های خود شناسایی و دسته‌بندی کنند.

به گفته CNBC، این مدل‌ها با همکاری دیسکورد، SafetyKit و ROOST توسعه یافته‌اند و در حال حاضر در حالت پیش‌نمایش تحقیقاتی در دسترس هستند.

ویژگی‌های مدل‌های تازه OpenAI

مدل‌های gpt-oss-safeguard به عنوان مدل‌های وزن-باز در دسترس قرار گرفته‌اند، به این معنی که پارامترهای مدل برای کیفیت خروجی و دقت پیش‌بینی‌ها به صورت عمومی در دسترس هستند. این ویژگی ermög می‌دهد تا کاربران کنترل و شفافیت بیشتری بر خروجی مدل‌ها داشته باشند.

این مدل‌ها نه تنها توانایی استدلال و توضیح روال تصمیم‌گیری خود را دارند، بلکه گسترش‌دهندگان می‌توانند به صورت مستقیم بفهمند که مدل چطور به یک نتیجه خاص رسیده است. برای مثال، یک سایت نقد و بررسی محصولات می‌تواند از مدل‌های gpt-oss-safeguard برای شناسایی بازدیدهای جعلی استفاده کند یا یک انجمن بازی‌های ویدیویی می‌تواند پست‌های مرتبط با تقلب و تخلفات را طبقه‌بندی کند.

با پیشرفت سریع هوش مصنوعی، ابزارهای ایمنی و تحقیقات بنیادی نیز باید همزمان پیشرفت کنند و برای همه قابل دسترس باشند.

کاربران می‌توانند وزن مدل‌ها را از Hugging Face دانلود کنند.معرفه این مدل‌ها می‌تواند به OpenAI کمک کند تا به برخی از منتقدانش در مورد تجاری‌سازی سریع و رشد بدون توجه به اخلاق و ایمنی هوش مصنوعی پاسخ دهد.