
#
أفاد TechCrunch في 14 أغسطس 2026 بأن الشركة الفرنسية الناشئة Kog تعمل على Kog Inference Engine. والهدف هو استخراج مزيد من سرعة استدلال الذكاء الاصطناعي من وحدات GPU التقليدية في مراكز البيانات. ويشمل العتاد المذكور في التقرير AMD MI300X وNvidia H200.
ويذكر التقرير أن Kog عرضت عرضًا أوليًا مبكرًا باستخدام Laneformer 2B. وفي ذلك العرض، ادّعت الشركة تحقيق 3,000 token في الثانية لكل طلب. وهذه إشارة مبكرة، وليست إثباتًا نهائيًا.
الفكرة الأساسية بسيطة. تريد Kog تحسين أداء الاستدلال على العتاد الموجود بالفعل. وقد يكون ذلك مهمًا عندما ترغب الفرق في مخرجات أكثر من دون تغيير مجموعة وحدات GPU لديها.
ولا يقول التقرير إن الطريقة جاهزة لجميع أحجام النماذج. كما يذكر أن Kog لا تزال بحاجة إلى إثبات النهج على نماذج LLM أكبر. وهذه المحدودية مهمة لأن نتائج النماذج الصغيرة لا تنتقل دائمًا إلى النماذج الأكبر.
بالنسبة للمشترين، تكمن الجاذبية في ضبط التكاليف. فإذا كان النظام قادرًا على تقديم استدلال أسرع على وحدات GPU المملوكة بالفعل، فقد يقلل ذلك الضغط لشراء عتاد جديد. وهذه هي القيمة التجارية الرئيسية التي توحي بها المصدر.
ولا يقدم التقرير أي معلومات عن التسعير أو تفاصيل النشر أو توفر المنتج. كما لا يذكر متى سيكون المحرك متاحًا على نطاق واسع. لذا تبقى الخلاصة العملية مشروطة.
على أي فريق يقيّم هذا النوع من المحركات أن يركز على حجم النموذج، ومعدل الإنتاجية، ومدى ملاءمته للحمل الفعلي. فنتيجة العرض التوضيحي على نموذج واحد لا تضمن النتيجة نفسها على نموذج آخر. والمصدر يوضح هذه الفجوة بجلاء.
كما ينبغي للفرق اختبار ما إذا كانت مكاسب السرعة ستظل قائمة تحت أنماط حركة المرور الخاصة بها. فقد يبدو أداء الاستدلال مختلفًا في عرض تجريبي مضبوط عنه في بيئة الإنتاج. ولا يقدم التقرير تفاصيل كافية لافتراض غير ذلك.
لا يورد المصدر أي حقائق خاصة بالمغرب. والدرس الآمن الوحيد هو درس مشروط وعالمي: إذا كان لدى فريق ما وحدات GPU مناسبة بالفعل، فقد يساعد الاستدلال الأسرع في ضبط تكاليف الحوسبة لخدمات الذكاء الاصطناعي متعددة اللغات.
تستهدف Kog مشكلة عملية: جعل استدلال الذكاء الاصطناعي أسرع على وحدات GPU القياسية في مراكز البيانات. والعرض الأولي لافت، لكنه ليس الكلمة الأخيرة.
والسؤال الأساسي هو ما إذا كان النهج سيتوسع ليشمل نماذج LLM أكبر. وحتى يتم إثبات ذلك، فإن التقرير يدعم الاهتمام، لا اليقين.
أضفوا Intelligence Artificielle Maroc إلى مصادركم المفضلة لرؤية المزيد من أخبارنا ذات الصلة في بحث Google.
نحن نبني منصات ذكاء اصطناعي مخصصة ومنتجات SaaS وتطبيقات أعمال ذكية وأنظمة أتمتة.
هذا النموذج مخصص لطلبات المشاريع وليس للأسئلة العامة حول الذكاء الاصطناعي.