جميعهم يبنون وكلاء ذكاء اصطناعي - ولكن في الجوهر تكمن نماذج اللغة الكبيرة (LLM)، واختيار النموذج المناسب أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة ومبنية على البيانات؟ في هذا الجلسة، سنغوص في موضوع اختيار النماذج اللغوية الكبيرة. سنشارك نتائج دراسة اختبرت 15 نموذجًا رائدًا في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل التفريع، زمن الاستجابة، التكلفة، الدقة، وكمية المعلومات المستفادة. نتوقع تقديم رؤى واضحة حول أداء النماذج الحالية فعليًا - وراء المعايير المرجعية والضجة الإعلامية - وما يعنيه ذلك بالنسبة لبناء مساعدات البرمجة، ومساعدات المطورين، والوكلاء متعددي الوسائط.