جميعهم يبنون وكلاء ذكاء اصطناعي - ولكن في جوهرها تكمن النماذج اللغوية الكبيرة (LLM)، واختيار النموذج المناسب أمر بالغ الأهمية. ومع إطلاق نماذج جديدة كل أسبوع، كيف يمكننا اتخاذ قرارات مدروسة مدعومة بالبيانات؟ في هذا الجلسة، سنغوص في موضوع اختيار النماذج اللغوية الكبيرة. وسنشارك نتائج دراسة اختبرت 15 نموذجًا رائدًا في مهام تلخيص الشيفرات البرمجية الواقعية، باستخدام مقاييس عملية مثل حجم الإخراج، زمن الاستجابة، التكلفة، الدقة، وكمية المعلومات المستفادة. نتوقع تقديم رؤى واضحة حول أداء النماذج الحالية فعليًا - وراء الاختبارات القياسية والضجة الإعلامية - وما يعنيه ذلك بالنسبة لبناء وكلاء مساعدين برمجيًا، ومساعدين للمطورين، وأجهزة متعددة الوسائط.