
تستهدف عائلة gpt-oss الحديثة من OpenAI (ولا سيما إصداري gpt-oss-20B وgpt-oss-120B) بشكل واضح فئتين مختلفتين من النشر: الاستدلال المحلي البسيط (للمستهلكين/الطرفيات) والاستدلال واسع النطاق في مراكز البيانات. هذا الإصدار - إلى جانب الكم الهائل من أدوات المجتمع المتعلقة بالتكميم، والمحولات منخفضة الرتبة، وأنماط التصميم المتفرقة/مزيج الخبراء (MoE) - يجعل من الجدير طرح السؤال التالي: ما مقدار الحوسبة اللازم فعليًا لتشغيل هذه النماذج وضبطها وخدمتها في الإنتاج؟

تم تصميم GPT-OSS بشكل جيد بشكل غير عادي من أجل إمكانية الوصول: تم تصميم متغير gpt-oss-20B للعمل على وحدة معالجة رسومية واحدة للمستهلك (~16 جيجابايت VRAM) أو أحدث الأجهزة المتطورة

أعلنت شركة OpenAI عن إصدار GPT-OSS، وهي عائلة مكونة من نموذجين لغويين مفتوحين الوزن - gpt-oss-120b و gpt-oss-20b - بموجب ترخيص Apache 2.0 المتساهل،

يُعد إصدار gpt-oss-120b من OpenAI أول إصدار مفتوح الوزن للمنظمة منذ GPT-2، مما يوفر للمطورين ذكاء اصطناعي شفاف وقابل للتخصيص وعالي الأداء