جميعهم يبنون وكلاء ذكاء اصطناعي - ولكن في المحور يقع نموذج اللغة الكبير، واختيار النموذج المناسب أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة وقائمة على البيانات؟ في هذا الجلسة، سنغوص في موضوع اختيار نماذج اللغة الكبيرة. وسنشارك نتائج دراسة اختبرت 15 نموذجًا رائدة في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل حجم النص الناتج، زمن الاستجابة، التكلفة، الدقة، وكمية المعلومات المستفادة. نتوقع أن نقدم رؤى واضحة حول أداء النماذج الحالية فعليًا - وراء الاختبارات المعيارية والضجة الإعلامية - وما يعنيه ذلك بالنسبة لبناء مساعدي البرمجة، ومساعدي المطورين، والوكلاء متعددي الوسائط.