كل شخص يبني وكلاء ذكاء اصطناعي - ولكن في المقام الأول يأتي النموذج اللغوي الكبير (LLM)، واختيار النموذج الصحيح أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة وقائمة على البيانات؟ في هذا الجلسة، سنغوص في عملية اختيار النماذج اللغوية الكبيرة. وسنشارك نتائج دراسة اختبرت 15 نموذجًا رائدًا في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل الإسهاب، زمن الاستجابة، التكلفة، الدقة، وكمية المعلومات المستفادة. نأمل أن نقدم رؤى واضحة حول أداء النماذج الحالية فعليًا - وراء الاختبارات القياسية والتضخيم الإعلامي - وما يعنيه ذلك لبناء أدوات مساعدة في البرمجة، ومساعدات المطورين، والوكلاء متعددي الوسائط.