يستهدف سوق الاستدلال بالذكاء الاصطناعي منخفض الكمون، بدأت Groq 3 LPX التابعة لـ Nvidia (NVDA.US) الإنتاج الشامل بشكل كامل، وسيتم نشر أول دفعة من الأنظمة في NEBIUS (NBIS.US)
أعلنت شركة Nvidia يوم الاثنين أن نظام Groq 3 LPX على مستوى الرف قد دخل مرحلة الإنتاج الكامل، مما يشير إلى أن تقنية الاستدلال بالذكاء الاصطناعي منخفضة الكمون دخلت مرحلة التنفيذ التجاري فعليًا بعد أن استحوذت الشركة على أصول Groq ذات الصلة مقابل حوالي 20 مليار دولار في العام الماضي.
أفادت تطبيق "زيتون المالية" أن شركة Nvidia (NVDA.US) أعلنت يوم الاثنين أن نظام Groq 3 LPX على مستوى الرفوف قد دخل مرحلة الإنتاج الكامل، مما يمثل دخول تقنية الاستدلال بالذكاء الاصطناعي ذات الكمون المنخفض مرحلة التطبيق التجاري رسميًا بعد أن استحوذت الشركة العام الماضي على أصول Groq ذات الصلة مقابل حوالي 20 مليار دولار. ستُنشر الدفعة الأولى من هذه الأنظمة لدى مزود خدمات الحوسبة السحابية للذكاء الاصطناعي NEBIUS (NBIS.US)، ومن المقرر إطلاقها في وقت لاحق من هذا العام.
قال Dion Harris، المدير الأول في Nvidia، لوسائل الإعلام إن Groq 3 LPX سيتم نشره جنبًا إلى جنب مع معالج Vera المركزي ومعالج Rubin الرسومي من Nvidia في مراكز بيانات Nebius.
يعكس تحقيق الإنتاج السريع لمنتجات Groq أن استدلال الذكاء الاصطناعي منخفض الكمون أصبح سوقًا جديدًا تركز عليه Nvidia بقوة، مع انتقال تطبيقات الذكاء الاصطناعي من تدريب النماذج إلى النشر الفعلي بشكل متزايد. وخاصة في التطبيقات مثل العملاء الأذكياء للذكاء الاصطناعي وبرمجة الذكاء الاصطناعي، حيث تتطلب النماذج إنشاء محتوى بسرعة أكبر لتقليل وقت انتظار المستخدمين.
في ديسمبر الماضي، استحوذت Nvidia على أصول شركة Groq الناشئة المتخصصة في شرائح الذكاء الاصطناعي مقابل حوالي 20 مليار دولار، في أكبر صفقة استحواذ في تاريخ الشركة.
واحدة من أبرز خصائص بنية شريحة Groq هي دمج 500 ميجابايت من ذاكرة SRAM عالية السرعة داخل الشريحة نفسها، لتقليل عنق الزجاجة في نقل البيانات الذي قد تسببه عمليات الوصول إلى الذاكرة التقليدية، وبالتالي تعزيز سرعة الاستجابة أثناء عملية الاستدلال لنماذج الذكاء الاصطناعي.
على عكس وحدات معالجة الرسوميات الرئيسية لـ Nvidia المنتجة بواسطة TSMC (TSM.US)، فإن شرائح Groq تُصنّعها شركة سامسونج.
تقوم Nvidia حاليًا بتجميع 256 شريحة Groq 3 في رف LPX واحد. ووفقًا لبيانات اختبارات الأداء المعيارية من Artificial Analysis والتي استشهدت بها Nvidia، يمكن لنظام Groq 3 LPX تحقيق أداء ينتج حوالي 3400 رمز (token) في الثانية الواحدة.
بالنسبة للذكاء الاصطناعي التوليدي، يمكن اعتبار الـ token كوحدة أساسية للنموذج في معالجة وتوليد النصوص. وكلما ارتفعت سرعة توليد الـ token في الثانية، أصبح الذكاء الاصطناعي قادرًا على الاستجابة بشكل أسرع لطلبات المستخدمين، وهو أمر بالغ الأهمية في تطبيقات مثل برمجة الذكاء الاصطناعي والعملاء الأذكياء في الوقت الحقيقي حيث يكون الكمون مهمًا جدًا.
قال Harris إن الكمون المنخفض يتيح لشركات الحوسبة السحابية التي تقدم خدمات الاستدلال بالذكاء الاصطناعي تقديم خدمات عالية المستوى وبأسعار أعلى للعملاء الذين يطلبون استجابة أسرع.
ومع ذلك، فإن شرائح Groq ليست مصممة لتحل محل وحدات معالجة الرسوميات التقليدية من Nvidia.
تظل وحدات معالجة الرسوميات العمود الفقري للبنية التحتية الحالية لحوسبة الذكاء الاصطناعي، حيث يمكنها تنفيذ تدريب النماذج وتنفيذ مهام الاستدلال، وتتمتع بمرونة أعلى للتكيف مع النماذج والهياكل التقنية المختلفة.
بينما تركز شرائح مثل Groq ذات الكمون المنخفض بشكل محدد على مراحل معينة من عملية الاستدلال بالذكاء الاصطناعي، خاصة مرحلة "فك التشفير" أثناء توليد النموذج للمحتوى.
وقال Harris: "ليس الهدف من ذلك استبدال وحدة معالجة الرسوميات، وإنما استخدام المعالج الأنسب من حيث السعر والأداء حسب أجزاء عبء العمل المختلفة."
وهذا يعني أن Nvidia تحاول بناء بنية حوسبة ذكاء اصطناعي أكثر تخصصًا: حيث تواصل Vera CPU وRubin GPU أداء مهام حوسبة الذكاء الاصطناعي واسعة النطاق، بينما جرى تحسين شرائح Groq خصيصًا لأعباء عمل الاستدلال ذات الكمون الحساس للغاية.
مع انتقال صناعة الذكاء الاصطناعي تدريجيًا من تدريب النماذج الواسع النطاق إلى مرحلة نمو سريع في طلب الاستدلال، تزداد حدة المنافسة في سوق الاستدلال منخفض الكمون.
وأعلنت AMD (AMD.US) في وقت سابق من هذا العام عن دمج نظام الذكاء الاصطناعي الخاص بها على مستوى الرف مع شرائح Cerebras (CBRS.US)، مستهدفة أيضًا سوق الاستدلال بالذكاء الاصطناعي منخفض الكمون.
تتزايد أهمية هذا المجال مع توسع تطبيقات مثل برمجة الذكاء الاصطناعي. وذكرت التقارير أن وضع Ultrafast الذي أعلنت عنه OpenAI مؤخرًا يعد بإنتاج 750 رمزًا في الثانية، وبدعم من البنية التحتية لحوسبة Cerebras.
وبالمقارنة، توضح البيانات التي استشهدت بها Nvidia أن Groq 3 LPX قادر على إنتاج 3400 رمز في الثانية، لكن تختلف شروط الاختبار وسيناريوهات التطبيق بين الأنظمة المختلفة، لذا لا ينبغي اعتبار هذه الأرقام مقارنة مباشرة للأداء.
وفي الوقت نفسه، تسرع Nvidia من شحن نظام Vera Rubin، الذي دخل مرحلة الإنتاج في وقت سابق من هذا العام.
وقد توقع الرئيس التنفيذي لـ Nvidia، Jensen Huang، عند إطلاق Vera Rubin وGroq 3 LPX في مارس من هذا العام، أن تصل مبيعات النظام التراكمية من رقائق Blackwell الحالية إلى نظام Vera Rubin الجديد إلى تريليون دولار بحلول عام 2027.
وكشف Jensen Huang آنذاك أنه في المساحات المخصصة لتطبيقات برمجة الذكاء الاصطناعي في مراكز البيانات، يخطط لتخصيص حوالي ربعها لشرائح Groq، بينما يتم تخصيص الباقي بالكامل لنظام Vera Rubin.
وتبرز هذه النسبة مدى اهتمام Nvidia بسوق الاستدلال منخفض الكمون. ومع التطور السريع لتطبيقات العملاء الأذكياء، وبرمجة الذكاء الاصطناعي، وتطبيقات الذكاء الاصطناعي التوليدي في الوقت الحقيقي، أصبح سرعة الاستدلال مؤشرًا رئيسيًا للمنافسة بين شركات الحوسبة السحابية ومطوري الذكاء الاصطناعي.
دخول Groq 3 LPX مرحلة الإنتاج الكامل رسميًا يعني أيضًا أن Nvidia تنتقل من مورد رئيسي للرقائق المعتمدة على وحدات معالجة الرسوميات إلى توفير بنى حوسبة متخصصة لأعباء عمل الذكاء الاصطناعي المختلفة.
وتترقب السوق أداء Nvidia المالي في الفترة القادمة. من المقرر أن تعلن الشركة عن نتائجها المالية هذا الأربعاء، وإلى جانب الطلب على Blackwell وVera Rubin، من المتوقع أن يتجه اهتمام المستثمرين أيضًا إلى تقدم أعمال الاستدلال بالذكاء الاصطناعي والتطور التجاري لشركة Groq.
إخلاء المسؤولية: يعكس محتوى هذه المقالة رأي المؤلف فقط ولا يمثل المنصة بأي صفة. لا يُقصد من هذه المقالة أن تكون بمثابة مرجع لاتخاذ قرارات الاستثمار.
You may also like
تصعيد جديد في حرب رأس المال على قوة الحوسبة للذكاء الاصطناعي! شركة Lambda التابعة لنظام Nvidia تخطط لجمع تمويل بقيمة 3 مليارات دولار لتعزيز خريطة قوة الحوسبة والاستعداد للاكتتاب العام
شركة خدمات الحوسبة السحابية بالذكاء الاصطناعي Lambda تجري محادثات لجولة تمويلية قد تصل إلى 3 مليارات دولار، استعداداً للاكتتاب العام الأولي المحتمل في العام المقبل.

تراجع صافي الأرباح لا يخفي الزخم الأساسي! أرباح بنك مونتريال (BMO.US) المعدلة للربع الثالث تتجاوز التوقعات، ويخطط لإطلاق برنامج إعادة شراء حتى 25 مليون سهم
تأثرت أرباح بنك مونتريال الصافية في الربع الثالث بانخفاض سنوي نتيجة تأثير مشاريع لمرة واحدة تتعلق ببيع أعمال النقل وتمويل الموردين، ومع ذلك، فقد تجاوزت الأرباح المعدلة للسهم الواحد والإيرادات توقعات السوق، وسجلت أرباح ما قبل خصم الضرائب واحتياطات كل قطاع أعمال رقماً قياسياً. كما أعلن البنك أنه يخطط لإطلاق برنامج إعادة شراء حتى 25 مليون سهم في الربع الثالث.

اجتماع جاكسون هول يصبح لحظة "المشي على الحبل" لـ وولش: يجب عليه الرد على الانتقادات وأيضًا إخفاء دلائل السياسات
كان الخطاب المهم الأول لرئيس مجلس الاحتياطي الفيدرالي كيفن والش اختبارًا لطريقته المختصرة في التواصل، وذلك لأنه تعرض لانتقادات بسبب عدم تصريحاته الصريحة حول القضايا الاقتصادية.

اتجاه الاستثمار في وول ستريت يتغير بشكل مفاجئ! مع ارتفاع عائدات السندات طويلة الأجل، يقوم المتفائلون بالتكنولوجيا بعملية "انسحاب كبير"، والبنوك تتنافس مع الذهب ومناجم النحاس على الصدارة
كان قطاع تكنولوجيا المعلومات الأسبوع الماضي هو الموضوع الاستثماري الأكثر بيعًا في سوق الأسهم الأمريكية بفارق كبير عن القطاعات الفرعية الأخرى، وقد تم دفع هذا البيع الكبير تقريبًا بالكامل من قبل قوى الشراء الطويلة.

