مرحبا بكم العميل!
mechb2bصناعة الأخبارفي هذه الورقة ، والتنبؤ نموذج العالم هو عرض على شكل الإنسان المشي للمرة الأولى : البطيخ wm-loco يسمح الروبوت المشي البرقوق كومة في الموقع
عندما الروبوت يواجه تضاريس معقدة مثل البرقوق كومة ، جسر مكسور ، ضيق فقي الدرج ، وما إلى ذلك ، فإن الاختبار الحقيقي يكمن أمامه هو أكثر بكثير من مجرد رؤية القدم .
في سلسلة من الأراضي المسطحة ، وعدم دقة تسوية عادة ما يكون هناك مساحة التكيف ؛ ولكن في متفرق ، منفصلة ، هندسية محدودة في منطقة الهبوط ، الوحيد قد تحول بضعة سنتيمترات إلى خطوة فارغة . مرة واحدة الروبوت يجعل من خيار خاطئ في لحظة ، في كثير من الأحيان قبل أن تتمكن من ضبط الجسم فقد توازنه .
السؤال الحاسم هو ما إذا كان الروبوت يمكن أن نحكم على المستقبل قبل اتخاذ الخطوة الحالية .
من أجل حل هذه المشكلة ، اقترح فريق الخوارزمية من البطاطا الحلوة الروبوت نموذج العالم مرئي سجل اسمه wm-loco لفترة قصيرة .
wm-loco يدخل العالم نموذج الرؤية المستقبلية والحركة الدولة التنبؤ في التضاريس المعقدة المشي الروبوت ، يحمل على نهاية إلى نهاية التدريب المشترك في المحاكاة ، ويدرك صفر اطلاق النار آلة الهجرة . وهذا يعني أن استراتيجية تدريب جيد في المحاكاة يمكن نشرها مباشرة على الروبوت الحقيقي دون الحاجة إلى تعديل من الدرجة الثانية .
wm-loco مخطط : اليسار هو المكتب البولندي للبراءات الاستراتيجية ، والحق هو تعميم نموذج العالم ، وهما حصة التشفير ، نهاية إلى نهاية التدريب المشترك
وباختصار ، فإن الروبوتات القديمة هي أكثر اعتمادا على " ما تراه العين " لتحديد الخطوة التالية . wm-loco يتعلم الروبوت " التنبؤ بالمستقبل قبل قبل اتخاذ قرار بشأن كيفية المضي قدما " .
  لماذا لا يكفي أن نفهم الماضي ؟
الرؤية التقليدية تعزيز التعلم عادة المدخلات الحالية والتاريخية المعلومات البصرية في استراتيجية الشبكة جنبا إلى جنب مع الروبوت حالة الجسم ، ثم النواتج في الوقت الحقيقي السيطرة المشتركة التعليمات .
هذا النوع من استراتيجية تقوم على مراقبة التاريخ ، يمكن أن " ترى " المعلومات التي شهدت بالفعل من قبل الروبوت ، من خلال إدخال إطارات متعددة الصور أو قسم من علم الوجود الدولة التاريخ ، يمكننا أن نحكم على الروبوت قبل الحركة ، كيف التضاريس التغييرات ، وبالتالي توليد الحركة الحالية .
ومع ذلك ، فإن المشكلة هي أن استراتيجية استخدام دائما " الماضي " المعلومات ، لا تعلم صراحة " عمل معين قد يؤدي إلى تغييرات في المستقبل في الدولة " . هذه القيود ليست واضحة على مستوى الأرض و التضاريس العادية ، ولكن مرة واحدة في مواجهة هذه التضاريس محدودة للغاية ، مثل البرقوق كومة ، جسر مكسور ، وضيق فقي الدرج ، الخ ، قصيرة لوحة صنع القرار على أساس مراقبة التاريخ سوف تتضخم بسرعة .
بسبب التضاريس المعقدة ، المشي لم يكن مجرد تراكب سلسلة من الخطوات التي لا علاقة لها .
أين هذه الخطوة سوف تستمر في التأثير على مركز الثقل في الجسم ، ودعم العلاقات ، يتأرجح الساق المسارات ، وما هي المجالات التي يمكن أن تصل إلى الخطوة التالية . العمل الذي يبدو ممكنا في هذه اللحظة قد وضع الروبوت في حالة من الفوضى في اللحظة التالية .
حتى الروبوتات لا تحتاج فقط إلى فهم " ما حدث من قبل " ، ولكن أيضا التنبؤ : إذا كان هذا هو الحال ، ماذا يمكن أن يحدث بعد ذلك ؟
  وضع استراتيجية لفهم المستقبل
wm-loco يتلقى كل من الإنسان والآلة الرؤية العميقة و علم الوجود المعلومات في نفس الوقت ، من خلال تعميم نموذج العالم ، العلاقة الديناميكية بين الروبوت ، الحركة والبيئة يمكن أن يكون باستمرار المستفادة في الفضاء الضمني .
ومن المهم التأكيد على أن الغرض من هذا النموذج العالمي ليس لتوليد الفيديو في المستقبل للعرض ، ولكن تعلم أكثر إحكاما وأكثر ملاءمة في الوقت الحقيقي السيطرة على الدولة في المستقبل التمثيل . wm-loco يحاول الإجابة على ثلاثة أسئلة في كل مرة :
ما هي حالة الروبوتات والتضاريس الآن ؟
ما هي التغييرات في الرؤية والجسم بعد أداء العمل ؟
هل هذا التغيير يساعد على استقرار بعد المشي ؟
في الواقع ، فإن النموذج العالمي يتكون من مسار الذاكرة القطعية و كلمة متغير ضمني : السابق تتراكم التاريخ على طول دورة الزمن ، وهذا الأخير يستدل من الملاحظات الحالية .
من خلال دراسة ملاحظات التعمير المحتملة للدولة نقل مهمة التغذية المرتدة التنبؤ ، نموذج العالم تدريجيا مقتطفات من التمثيل الديناميكي الذي يحتوي على اتجاه الحركة في المستقبل ، ثم يعود إلى المكتب البولندي للبراءات الاستراتيجية .
ونتيجة لذلك ، فإن استراتيجية الحصول على ليس فقط الخطوات ، والعقبات ، مناطق الهبوط في عمق الصورة الحالية ، ولكن أيضا مسار الحركة التاريخية ، ولكن أيضا يحتوي على معلومات تطلعية عن كيفية الروبوت الدولة قد تتطور في المستقبل .
أكبر من العمق الحقيقي في الإطار التالي ، ريكون .
هذا هو الفرق الأساسي بين wm-loco وعادي multiframe المدخلات الاستراتيجية . التاريخ الرصدي أساسا يساعد على فهم الاستراتيجية " ما حدث في الماضي " ؛ نموذج العالم يتعلم المزيد عن العلاقة الدينامية بين الملاحظة ، الحركة ، و الدولة في المستقبل ، مما يسمح استراتيجية للاستدلال على " ما قد يحدث بعد ذلك " .
ولذلك ، فإن استراتيجية صنع القرار لم يعد يعتمد فقط على المعلومات التاريخية ، ولكن لديها القدرة على التنبؤ في المستقبل .
  نهاية إلى نهاية التدريب ، وداع عملية معقدة
من أجل الحصول على الروبوت من خلال التضاريس المعقدة ، العديد من الطرق التقنية تقسيم النظام إلى عدة وحدات ، بما في ذلك الإدراك الحسي ، موطئ قدم التخطيط ، مسار جيل ، استراتيجية المعلم ، وانخفاض مستوى السيطرة .
بعض البرامج تحتاج أيضا إلى تدريب المعلمين " فتح " استراتيجية مع كامل التضاريس القيمة الحقيقية ، ثم نقل القدرة إلى استراتيجية الطلاب باستخدام أجهزة الاستشعار المحمولة جوا من خلال المعرفة التقطير . تكلفة هذا النوع من المخطط هو أطول وصلة التدريب ، المزيد من التصميم اليدوي ، وارتفاع تكلفة بناء البيانات .
وعلى النقيض من ذلك ، wm-loco اختارت أكثر مباشرة وموجزة الطريق : نهاية إلى نهاية التحسين من نموذج العالم والمشي الاستراتيجية في نفس عملية التدريب .
النظام برمته لا يحتاج إلى دليل العلامات ، لا تعتمد على تخطيط مسار القدم ، لا تحتاج إلى المعلم - طالب تقطير متعددة المراحل ، لا تحتاج إلى تعقيد هيكل متعدد الخبراء ، لا تحتاج إلى تدريب عدد وافر من وحدات مستقلة على التوالي . من المدخلات البصرية إلى الحركات المشتركة ، والتدريب في مكان خطوة واحدة .
دينامية المعلومات المستفادة من النموذج العالمي ليس من أجل إعادة بناء ، ولكن مباشرة لخدمة هدف واحد : مساعدة استراتيجية لجعل أفضل قرار بشأن الخطوة التالية .
  أعلى معدل النجاح ، أكثر طبيعية مشية
في نفس المدخلات البصرية و إعدادات المهمة ، الخوارزمية فريق يقارن wm-loco مع خط الأساس المكتب البولندي للبراءات الاستراتيجية .
هناك فجوة واضحة بين الطريقتين كما قدم المنطقة أصبحت أكثر وأكثر متفرق ، ضيقة ومتقطع . تعتمد فقط على استراتيجية المكتب البولندي للبراءات نقية لمراقبة التاريخ ، فإنه من السهل أن تظهر مشاكل في وقت مبكر جدا في البقاء على قيد الحياة ، وكثرة الاستكشافات ، عدم الاتساق بين اليسار واليمين الساقين ، فضلا عن إمكانية متابعة الحركة المحلية ولكن لا يمكن أن يستمر . في بعض التضاريس الصعبة ، المكتب البولندي للبراءات وحدها لا يمكن أن تشكل قدرة مرور مستقرة .
بعد إدخال النموذج العالمي ، فإن معدل نجاح الروبوت في سيناريوهات معقدة مثل البرقوق كومة ، كسر الجسر ، خطوة ضيقة الدرج و جسر خشبي واحد قد تحسنت بشكل ملحوظ ، ما يقرب من 100 ٪ في المحاكاة . وفي الوقت نفسه ، الروبوت يقلل من التعديلات المفاجئة والتردد مشية .
وبعبارة أخرى ، فإن النموذج العالمي ليس فقط يجلب " المشي " ، ولكن أيضا يتيح الروبوت تظهر أكثر تواصلا وأكثر استقرارا في نوايا الحركة عند المشي أرجل أرجوحة ، أقدام و مركز الثقل في الجسم أكثر تماسكا ، اليسار واليمين الساق إيقاع أكثر انسجاما ، الحركة العامة أكثر طبيعية ، أقرب إلى الإنسان المشي .
على متن الطائرة الحقيقية ، نفس مجموعة من الأوزان التي تم نشرها في unitree G1 في صفر اطلاق النار واسطة : ثلاث طبوغرافيا الحجر ، خطوة ، شق تم اختبارها 10 مرات على التوالي ، مع متوسط معدل النجاح 93.3 في المائة . من بينها ، 0.8-meter-wide الفجوة ، الروبوت مع كامل " أرجوحة الساق - القفز - الهبوط " خطوة خطوة - لأسباب تتعلق بالسلامة ، فإن الفريق لم يواصل اختبار أوسع الفجوة ، ولكن هذا هو العمل المفتوح في الوقت الحاضر نادرة حقا آلة تمتد المسافة .
  التحقق من الموقع : أكثر من مجرد عرض
العمل في السوق عموما يظهر عرض الفيديو بعد الفرز ، في كثير من الأحيان من الصعب أن تعكس تماما استقرار الخوارزمية في البيئة الحقيقية .
المشهد هو مختلف تماما . الروبوت يحتاج إلى مواجهة حقيقية استشعار الضوضاء ، تغيير حالة الجهاز ، والإضاءة التدخل وعدم تكرار عملية واحدة . أي خطأ في الإدراك الحسي أو السيطرة سوف يتعرض الجمهور مباشرة .
في الآونة الأخيرة الشمس S600 وسائل الإعلام والاتصالات الاجتماع ، wm-loco الروبوت محمولة على الانتهاء من فتح آلة عرض في الموقع . الخوارزمية يعمل على الروبوت الحقيقي ، الحقيقي استشعار الشمس S600 منصة الحوسبة في الوقت الحقيقي ، واستكمال حلقة مغلقة من الإدراك البصري ، العالم النمذجة كامل الجسم التحكم في الحركة .
بالمقارنة مع التضاريس المعقدة سيرا على الأقدام مظاهرة مع عرض الفيديو ، في الوقت الحقيقي ، في الوقت الحقيقي نشر موثوقية الخوارزمية المقترحة من قبل الكشف عن العمليات الميدانية ، والتي ثبت أن wm-loco هو موثوق بها للغاية ، في الوقت الحقيقي ، وارتفاع معدل النجاح .
نماذج العالم لا تستخدم فقط لتوليد المستقبل ، ولكن أيضا لمساعدة الروبوتات على فهم المستقبل .
عند اتخاذ القرارات على أساس رصد التاريخ ، الروبوت يتحرك نحو استباقية توقع نتائج الحركة ، المشي المنطق يتغير : توقع المستقبل أولا ، ثم اتخاذ الخطوة التالية .
 مقتطفات
أحدث الأخبار