تقدم OpenAI شريحة Jalapeño، وهي شريحة ذكاء اصطناعي تتفوق على Nvidia من حيث الكفاءة والسرعة

  • يحقق معالج Jalapeño، الذي تم تطويره بالتعاون مع Broadcom، أداءً أفضل بمقدار 1,5 إلى 1,9 مرة لكل واط، وزمن استجابة أقل بمقدار 3,6 مرة من معالج Nvidia GB200 وGB300 في اختبارات الاستدلال.
  • تم تصميم الشريحة حصريًا لتشغيل النماذج المدربة مسبقًا، وليس لتدريبها، وتستهلك حوالي 700 واط، مما قد يقلل من تكاليف تشغيل مراكز البيانات.
  • تخطط OpenAI لنشر الأنظمة الأولى مع Jalapeño بحلول نهاية عام 2026 وتوسيع استخدامها خلال عام 2027، بينما تعمل بالفعل على الجيل الثاني والثالث.
  • تحافظ الشركة على تحالفها مع شركة Nvidia لتدريب النماذج، لكنها تسعى إلى تنويع بنيتها التحتية وتقليل اعتمادها على مزود واحد.

شريحة هالابينو من أوبن إيه آي

خطت OpenAI خطوةً هامةً في استراتيجيتها للاستقلال التكنولوجي بعرضها النتائج الأولية لمعالج الذكاء الاصطناعي المُصمم خصيصًا لها، والذي أُطلق عليه اسم Jalapeño. وقد تفوقت هذه الشريحة، التي طُوّرت بالتعاون مع Broadcom، والمُخصصة للاستدلال، على مُسرّعات Nvidia GB200 وGB300 في معيارين رئيسيين: كفاءة المعالجة لكل واط وسرعة الاستجابة. وتُؤكد هذه البيانات، التي نُشرت في مؤتمر Hot Chips وغطتها وسائل إعلامية مثل Bloomberg وThe Verge، مكانة OpenAI غير المسبوقة في سباق تطوير أجهزة الذكاء الاصطناعي.

هذا ليس إعلانًا بسيطًا. حتى الآن، اعتمدت OpenAI بشكل شبه كامل على معالجات Nvidia لتشغيل نماذجها، سواء في مرحلتي التدريب أو الاستدلال - أي عندما يستجيب النظام لاستفسارات المستخدمين. مع معالج Jalapeño، تهدف الشركة إلى خفض تكاليف التشغيل والتحكم في بنيتها التحتية، دون التخلي تمامًا عن Nvidia. ووفقًا لريتشارد هو، رئيس قسم الأجهزة في OpenAI، توفر الشريحة ما يسميه "أفضل ما في العالمين": قدرة عالية على خدمة العديد من العملاء في وقت واحد، وزمن استجابة منخفض للتطبيقات التفاعلية.

OpenAI وBroadcom
المادة ذات الصلة:
شراكة بين OpenAI وBroadcom لإنتاج شرائح الذكاء الاصطناعي المخصصة

ما هو فلفل الهالابينو وكيف يعمل؟

هالابينو عبارة عن دائرة متكاملة مصممة خصيصًا لتطبيقات محددة (ASIC)، مصممة من الصفر لمهمة واحدة: تشغيل نماذج لغوية مُدرَّبة مسبقًا. على عكس وحدات معالجة الرسومات من إنفيديا، وهي معالجات للأغراض العامة، فإن هذه الشريحة مُحسَّنة لمرحلة الاستدلال، حيث يُعالج النظام الطلب ويُنشئ استجابة. وهي غير مُخصصة لتدريب النماذج، وهي مهمة لا تزال من اختصاص وحدات معالجة الرسومات من إنفيديا، والتي ستستمر OpenAI في استخدامها لهذا الغرض.

يركز تصميم الشريحة على تقليل الاختناقات التي تحدث عادةً أثناء الاستدلال، مثل نقل البيانات بين وحدات الذاكرة والحساب. ووفقًا للشركة، تدمج شريحة Jalapeño قسمًا حسابيًا كبيرًا إلى جانب ست وحدات ذاكرة عالية النطاق الترددي (HBM)، مما يسمح بالاحتفاظ بالبيانات محليًا وتجنب عمليات النقل غير الضرورية. علاوة على ذلك، يمكن للشريحة تفعيل المزيج المناسب من الموارد لكل مرحلة معالجة، مما يحسن أداء الذكاء الاصطناعي وكفاءته في استهلاك الطاقة.

شريحة الذكاء الاصطناعي المخصصة من أنثروبيك وسامسونج
المادة ذات الصلة:
تتفاوض شركتا أنثروبيك وسامسونج على إنشاء شريحة ذكاء اصطناعي خاصة بهما لتحدي هيمنة شركة إنفيديا.

نتائج المقارنة المعيارية مع Nvidia

أُجريت الاختبارات باستخدام منصة InferenceX العامة التابعة لشركة SemiAnalysis، والتي تقيس أداء أنظمة الذكاء الاصطناعي في ظروف واقعية. قارنت OpenAI أداء Jalapeño بأفضل النتائج التي حققتها معالجات Nvidia GB200 وGB300 الفائقة، والتي كانت المعايير المتاحة وقت الاختبار. أظهرت النتائج أن Jalapeño يحقق أداءً أفضل في معالجة الذكاء الاصطناعي لكل واط، يتراوح بين 1,5 و1,9 ضعف، مع زمن استجابة إجمالي أقل يتراوح بين 1,7 و3,6 ضعف. تضمنت النماذج المستخدمة في مجموعة الاختبار GPT-OSS 120B وDeepSeek R1 و Kimi K3 ، وهي مزيج يتراوح بين النماذج ذات الأوزان المفتوحة والنماذج الرائدة.

تكتسب هذه الأرقام أهمية خاصة لأن كفاءة الطاقة أصبحت من أبرز تحديات هذا القطاع. تستهلك مراكز بيانات الذكاء الاصطناعي كميات هائلة من الكهرباء، ويمكن أن يؤدي خفض استهلاك الطاقة لكل وحدة عمل إلى توفير كبير. ووفقًا لريتشارد هو، يعمل معالج Jalapeño باستهلاك حوالي 700 واط، وهو رقم منخفض نسبيًا بالنسبة لمسرع استدلال، ويمكنه خفض تكاليف التشغيل بنحو 50% مقارنةً بوحدات معالجة الرسومات التقليدية، بحسب هوك تان، الرئيس التنفيذي لشركة Broadcom.

نقص في رقائق الذكاء الاصطناعي
المادة ذات الصلة:
العاصفة المثالية للسيليكون: لماذا سيستمر نقص رقائق الذكاء الاصطناعي

التعاون مع شركة برودكوم وخارطة الطريق

يُعدّ تطوير معالج هالابينو ثمرة تحالف استراتيجي بين شركتي أوبن إيه آي وبرودكوم، أُعلن عنه في أكتوبر 2025. تُسهم برودكوم بخبرتها في تصميم الرقائق الإلكترونية، والشبكات، والتصنيع، بينما استخدمت أوبن إيه آي نماذج الذكاء الاصطناعي الخاصة بها لتسريع عملية التصميم. انتقلت الشريحة من مرحلة التصميم الأولي إلى مرحلة التصنيع النهائي في تسعة أشهر فقط، وهو وقت قياسي بالنسبة لأشباه الموصلات المتقدمة.

تعمل شركة OpenAI حاليًا على تطوير جيل ثانٍ من المعالج، ولديها جيل ثالث قيد التطوير. وتخطط الشركة لنشر أولى الأنظمة المزودة بمعالج Jalapeño بكميات محدودة جدًا بحلول نهاية عام 2026، وتوسيع نطاق استخدامه بشكل ملحوظ خلال عام 2027. ووفقًا لبلومبيرغ، سيتم النشر في مراكز بيانات مايكروسوفت وشركاء آخرين، ومن المتوقع أن يصل حجمه إلى 10 جيجاوات من قوة الحوسبة بحلول عام 2029. مع ذلك، فإن النتائج المعروضة أولية ولم يتم التحقق من صحتها بعد في بيئة إنتاج واسعة النطاق.

الآثار المترتبة على السوق والمستخدمين

لا يعني إطلاق معالج Jalapeño أن OpenAI تتخلى عن Nvidia. فقد أكدت الشركة أن Nvidia لا تزال شريكًا رئيسيًا، لا سيما في مجال تدريب النماذج، وأن الطلب على قوة الحوسبة مرتفع للغاية لدرجة أنه يتطلب التعامل مع عدة موردين. في الواقع، تتعاون OpenAI أيضًا مع AMD وCerebras، وتتضمن استراتيجيتها بناء بنية تحتية غير متجانسة حيث يتم تخصيص كل عبء عمل لأكثر الأجهزة كفاءة.

لهذا الخبر تداعيات مباشرة على المستخدمين والمطورين. فإذا أوفت شركة جالابينو بوعودها، فقد ينخفض ​​سعر رمز الاستدلال بنسبة تتراوح بين 30% و50% خلال الأشهر الثمانية عشر القادمة، مما يتيح للشركات الناشئة والشركات تقديم خدمات ذكاء اصطناعي بأسعار معقولة وبزمن استجابة أقل. علاوة على ذلك، تشتد المنافسة في سوق رقائق الذكاء الاصطناعي، وهو ما قد يُترجم إلى أسعار أفضل وخيارات أوسع للمستخدمين النهائيين.

أخيرًا، تجدر الإشارة إلى أن الاختبارات لم تتضمن مقارنة مع معمارية Vera Rubin الجديدة من Nvidia، والتي بدأت شحنها مؤخرًا. لذا، قد تتضاءل ميزة Jalapeño عند إطلاق Nvidia لجيلها التالي. مع ذلك، يُظهر تقدم OpenAI أن صناعة الذكاء الاصطناعي تدخل مرحلة جديدة، حيث ستلعب الأجهزة المُخصصة دورًا متزايد الأهمية. إن سباق الكفاءة والسرعة لم يبدأ إلا الآن.

أمازون ستدمج تقنية Nvidia في شرائح الذكاء الاصطناعي وتطلق خوادم جديدة
المادة ذات الصلة:
أمازون ستدمج تقنية Nvidia في شرائح الذكاء الاصطناعي الخاصة بها وتطلق خوادم Trainium الجديدة

أضف كمصدر مفضل في جوجل