جميعهم يبنون وكلاء ذكاء اصطناعي - ولكن في المحور يوجد نموذج اللغة الكبير، واختيار النموذج المناسب أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة وقائمة على البيانات؟ في هذا الجلسة، سنغوص في موضوع اختيار نماذج اللغة الكبيرة. وسنزود بنتائج دراسة اختبرت 15 نموذجًا رائدًا في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل التوسع اللفظي، زمن الاستجابة، التكلفة، الدقة، وكمية المعلومات المستفادة. نتوقع أن تحصلوا على رؤى واضحة حول أداء النماذج الحالية فعليًا - وراء الاختبارات القياسية والإثارة الإعلامية - وما يعنيه ذلك لبناء مساعدات البرمجة، وزملاء المطورين الافتراضيين، والوكلاء متعددي الوسائط.