جميعهم يبنون وكلاء ذكاء اصطناعي - ولكن في المحور يوجد النموذج اللغوي الكبير (LLM)، واختيار النموذج الصحيح أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة وقائمة على البيانات؟ في هذا الجلسة، سنغوص في موضوع اختيار النماذج اللغوية الكبيرة. وسنشارك نتائج دراسة اختبرت 15 نموذجًا رائدًا في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل حجم النص الناتج، زمن الاستجابة، التكلفة، الدقة، وكمية المعلومات المستفادة. نتوقع أن تقدم رؤى واضحة حول أداء النماذج الحالية فعليًا - بعيدًا عن المعايير المرجعية والضجة الإعلامية - وما يعنيه ذلك لبناء أدوات مساعدة للبرمجة، ومساعدات للمطورين، وأدوات وكلاء متعددة الوسائط.