جميعهم يبنون وكلاء ذكاء اصطناعي - ولكن في الجوهر يوجد النموذج اللغوي الكبير، واختيار النموذج المناسب أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة مدعومة بالبيانات؟ في هذه الجلسة، سنغوص في موضوع اختيار النماذج اللغوية الكبيرة. وسنشارك نتائج دراسة اختبرت 15 نموذجًا رائدًا في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل الطول الزائد، زمن الاستجابة، التكلفة، الدقة، وكم المعلومات المستفادة. نتوقع أن تقدم رؤى واضحة حول أداء النماذج الحالية فعليًا - وراء المعايير المرجعية والإثارة الإعلامية - وما يعنيه ذلك بالنسبة لبناء أدوات مساعدة للبرمجة، ومساعدات للمطورين، ووكلاء متعددي الوسائط.