15 أكتوبر - الذكاء الاصطناعي البصري في الزراعة (اليوم الأول)

F5HW+FGX, Vaiaku, Tuvalu

تمت ترجمة بعض المحتوى تلقائيًا.عرض الأصل

وصف

انضم إلينا في اليوم الأول من سلسلة الفعاليات الافتراضية للاستماع إلى خبراء حول آخر التطورات في مجال التقاء الذكاء الاصطناعي البصري والزراعة. **التاريخ والوقت** 15 أكتوبر الساعة 9 صباحًا بالتوقيت الهادئ **المكان** افتراضي. [سجّل الدخول عبر زووم.](https://voxel51.com/events/visual-ai-in-agriculture-october-15-2025) **Paved2Paradise: محاكاة ليدار قابلة للتوسيع من أجل الإدراك في العالم الحقيقي** غالبًا ما يتطلب تدريب نماذج الإدراك القوية للروبوتات والاستقلالية كميات ضخمة ومتنوعة من البيانات ثلاثية الأبعاد. ولكن جمع وتصنيف سحب نقاط ليدار من العالم الحقيقي على نطاق واسع أمر مكلفٌ للغاية ويستغرق وقتًا طويلاً، خاصة عندما تكون التصنيفات عالية الجودة ضرورية. يقدم مشروع Paved2Paradise بديلًا اقتصاديًا: وهو خط أنابيب محاكاة ليدار قابل للتوسيع لإنتاج بيانات واقعية ومصنفة بالكامل مع أقل جهد بشري في التصنيف. الفكرة الأساسية هي "تحليل العالم الحقيقي" من خلال التقاط فحوص الخلفية (مثل الحقول، الطرق، مواقع البناء) وفحوص الكائنات (مثل المركبات، الأشخاص، الآلات) بشكل منفصل. ومن خلال الجمع الذكي بين هذين المصدرَين، يمكن لـ Paved2Paradise تركيب عدد كبير توفيقيًا من مشاهد التدريب المتنوعة. يتضمن خط الأنابيب أربع خطوات: (1) جمع فحوص ليدار واسعة النطاق للخلفية، (2) تسجيل فحوص عالية الدقة لكائنات الهدف في ظروف خاضعة للتحكم، (3) إدخال الكائنات ضمن الخلفيات مع وضع وحجب يتماشيان مع القوانين الفيزيائية، و(4) محاكاة هندسة الليدار لضمان الواقعية. أظهرت التجارب أن النماذج المدربة باستخدام بيانات تم إنشاؤها بواسطة Paved2Paradise تنتقل بكفاءة إلى العالم الحقيقي، وتُحقق أداءً قويًا في الكشف مع الحاجة إلى تصنيف يدوي أقل بكثير مقارنةً بجمع مجموعة البيانات التقليدية. هذه الطريقة ليست فقط فعالة من حيث التكلفة، بل أيضًا مرنة — مما يسمح للممارسين بسهولة التوسع نحو فئات أو مجالات كائنات جديدة عن طريق استبدال فحوص الخلفية أو الكائنات. بالنسبة لممارسي تعلم الآلة العاملين في مجالات الروبوتات، المركبات المستقلة، أو أنظمة الإدراك الحرجة للسلامة، يبرز Paved2Paradise مسارًا عمليًا نحو توسيع بيانات التدريب دون زيادة التكاليف. وهو يسد الفجوة بين المحاكاة والأداء في العالم الحقيقي، ما يتيح التكرار الأسرع والنشر الأكثر موثوقية لنماذج الإدراك. *عن المتحدث* [مايكل أ. ألكورن](https://www.linkedin.com/in/michaelaalcorn/) هو مهندس رئيسي للتعلم الآلي في شركة John Deere\، حيث يعمل على تطوير نماذج التعلّم العميق للإدراك باستخدام بيانات الليدار والصور RGB في أنظمة حرجة للسلامة وتتطلب زمنًا حقيقيًا\. حصل على درجة الدكتوراه في علوم الحاسوب من جامعة أوبرن\، وكان موضوع أطروحته تحسين الرؤية الحاسوبية والشبكات العصبية العميقة الزمكانية\، كما يمتلك تخصصًا فرعيًا في الرياضيات\. تم الاستشهاد بأبحاث مايكل من قبل باحثين في DeepMind\، Google\، Meta\، Microsoft\، وOpenAI\، من بين آخرين\، وكانت ورقته \(batter\|pitcher\)2vec فائزة بجائزة في مؤتمر MIT Sloan Sports Analytics Conference عام 2018\. كما ساهم برمجيًا في scikit\-learn وApache Solr\، وحققت مستودرات GitHub الخاصة به — التي حصلت مجتمعة على أكثر من 2\,100 نجمة — نقطة انطلاق لأبحاث وأكواد إنتاجية في العديد من المؤسسات المختلفة\. **MothBox: جهاز رصد حشرات منخفض التكلفة، مفتوح المصدر، وآلي** سيتحدث الدكتور آندي كوتمير عن تصميم أداة علمية مفتوحة المصدر ومثيرة، تُعرف باسم Mothbox. يُعد مشروع Mothbox فائزًا بالجوائز لمراقبة الحشرات على نطاق واسع من أجل التنوع البيولوجي. وهو جهاز منخفض التكلفة تم تطويره في الغابات الصعبة ببنما، ويقوم بالتقاط صور فائقة الدقة ثم يقوم تلقائيًا بتحديد مستويات التنوع البيولوجي في الغابات والزراعة. بعد آلاف الملاحظات الحشرية ومئات عمليات النشر في بنما، بيرو، المكسيك، الإكوادور، والولايات المتحدة، نحن الآن بصدد تطوير إصدار جديد يمكن تصنيعه لتوزيع هذه الأداة المهمة عالميًا. سنناقش تطوير هذا الجهاز في غابات بنما وأهميته لدراسة التنوع البيولوجي عالميًا. *عن المتحدث* يصمم الدكتور آندي كوتمير طرقًا جديدة للتفاعل مع العالم الطبيعي. عمل مع منظمات كبيرة مثل شبكة كرتون نتورك، IDEO، ومعهد سميثسونيان، وقدّم التدريس كأستاذ متفرغ في الجامعة الوطنية السنغافورية، وحتى تحولت إحدى أبحاثه إلى برنامج تلفزيوني (مضحك) بعنوان "Hacking the Wild"، تم توزيعه عبر شبكات ديسكفري. حاليًا، يقضي معظم وقته في العمل التطوعي مع منظمات صغيرة، وقام مؤخرًا بتأسيس مختبر للصناعات الحرفية في محطة ميدانية، يُدعى Digital Naturalism Laboratories. في غابة جامبوا المطيرة في بنما، يدمج Dinalab العمل الميداني البيولوجي مع الصناعة التكنولوجية ضمن مجتمع من العلماء والفنانين والمهندسين ومحسني الحيوانات المحليين والدوليين. وهو حاليًا مستشار للطلاب كبروفيسور مرتبط في جامعة واشنطن. **النماذج الأساسية للذكاء الاصطناعي البصري في الزراعة** لقد مكّنت النماذج الأساسية من أسلوب جديد لمعالجة المهام، وذلك بالاستفادة من القدرات الناشئة بطريقة بدون تدريب (zero-shot). في هذا الحديث، سأناقش أحدث الأبحاث المتعلقة بتمكين الذكاء الاصطناعي البصري بطريقة بدون تدريب أو عبر التخصيص الدقيق (fine-tuning). وعلى وجه التحديد، سأتناول العمل المشترك حول RELOCATE، وهو معيار بسيط لا يتطلب تدريبًا مصممًا لأداء مهمة صعبة وهي تحديد موقع الاستعلام البصري في مقاطع فيديو طويلة. للتخلص من الحاجة إلى تدريب مخصص للمهمة والتعامل بكفاءة مع مقاطع الفيديو الطويلة، يستفيد RELOCATE من تمثيل قائم على المناطق مستمد من نماذج بصرية مسبقة التدريب. سأناقش أيضًا العمل المشترك المتعلق بتمكين نماذج اللغات الكبيرة متعددة الوسائط (MLLMs) من الإجابة الصحيحة على الطلبات التي تتطلب فهمًا شموليًا مكانزمنيًا: فالنماذج متعددة الوسائط تواجه صعوبة في الإجابة على طلبات تشير إلى 1) بيئة كاملة يمكن لوكيل مزود بنموذج MLLM العمل فيها؛ وفي نفس الوقت تشير أيضًا إلى 2) إجراءات حديثة حدثت للتو وتم ترميزها في مقطع فيديو. ومع ذلك، فإن هذا الفهم الشمولي المكانزمني مهم للوكلاء الذين يعملون في العالم الحقيقي. ويتضمن حلنا تطوير خط أنابيب مخصص لجمع البيانات وتخصيص نموذج MLLM مجهز بمشعات لتحسين كل من الفهم المكاني للبيئة والفهم الزمني للمشاهدات الأخيرة. *عن المتحدث* [أليكس شوينغ](https://www.linkedin.com/in/alexander-s-0a049258/) هو أستاذ مشارك في جامعة إلينوي في أوربانا-شمباين، يعمل مع طلاب موهوبين في مجالات الذكاء الاصطناعي، والذكاء الاصطناعي التوليدي، والرؤية الحاسوبية. حصل على درجة البكالوريوس والدبلوم في الهندسة الكهربائية وتكنولوجيا المعلومات من الجامعة التقنية بميونيخ عامي 2006 و2008 على التوالي، وحصل على درجة الدكتوراه في علوم الحاسوب من ETH زيورخ عام 2014. بعد ذلك، انضم إلى جامعة تورونتو كزميل باحث ما بعد الدكتوراه حتى عام 2016. تشمل اهتماماته البحثية مجالات الذكاء الاصطناعي، والذكاء الاصطناعي التوليدي، والرؤية الحاسوبية، حيث شارك في تأليف العديد من الأوراق العلمية حول فهم المشهد، وخوارزميات الاستنتاج والتعلم، والتعلم العميق، ومعالجة الصور واللغة، والنماذج التوليدية. وقد تم تكريم أطروحته للدكتوراه بوسام ETH، وفاز بحث فريقه بجائزة NSF CAREER. **خارج المختبر: كشف الشذوذ في العالم الحقيقي للرؤية الحاسوبية الزراعية** يُحدث كشف الشذوذ ثورة في التصنيع والمراقبة، لكن ماذا عن الزراعة؟ هل يمكن للذكاء الاصطناعي اكتشاف أمراض النباتات وأضرار الآفات مبكرًا بما يكفي لصنع فرق؟ يوضح هذا الحديث كيف يحدد كشف الشذوذ مشكلات المحاصيل ويحللها باستخدام صحة أوراق القهوة كمثال أساسي. سنبدأ بالنظرية الأساسية، ثم ندرس كيف تكتشف هذه النماذج صدأ الأوراق وأضرار المنقوشة في صور الأوراق. تشمل الجلسة سير عمل شاملاً وعمليًا باستخدام أدوات FiftyOne مفتوحة المصدر للرؤية الحاسوبية، ويغطي إدارة مجموعة البيانات، واستخراج القطع، وتدريب النموذج، وتصوير النتائج. ستحصل على فهم نظري لكشف الشذوذ في الرؤية الحاسوبية وخبرة عملية في تطبيق هذه التقنيات على التحديات الزراعية وغيرها من المجالات. *عن المتحدث* [بولينا راموس](https://www.linkedin.com/in/paula-ramos-phd/) تحمل درجة الدكتوراه في الرؤية الحاسوبية وتعلّم الآلة، ولديها أكثر من 20 سنة من الخبرة في المجال التكنولوجي. وقد كانت تعمل على تطوير تقنيات هندسية متكاملة مبتكرة، بشكل رئيسي في مجالات الرؤية الحاسوبية، والروبوتات، وتعلّم الآلة المطبقة على الزراعة، منذ أوائل العقد الأول من القرن الحادي والعشرين في كولومبيا.

المصدر: meetup عرض المنشور الأصلي

موقع

F5HW+FGX, Vaiaku, Tuvalu

عرض الخريطة

meetup

15 أكتوبر - الذكاء الاصطناعي البصري في الزراعة (اليوم الأول)

قد يعجبك أيضا