يتم عرض يد ميكانيكية في Robot Mall، أول متجر روبوت ذكي مجسم في العالم 4S، في 13 أغسطس 2025 في بكين، الصين.
في سي جي | مجموعة الصين البصرية | صور جيتي
بكين — علي بابا تستثمر السحابة في نوع جديد من الذكاء الاصطناعي المصمم لتكرار العالم الحقيقي بشكل أفضل باستخدام نهج مختلف عن روبوتات الدردشة مثل ChatGPT من OpenAI.
التحول يتعرف على حدود “نماذج اللغة الكبيرة” تدرب في المقام الأول على النص. وبدلاً من ذلك، بدأ المطورون في التركيز أكثر على “نماذج عالمية“مبني على مقاطع فيديو وسيناريوهات مادية من واقع الحياة.
ولمواكبة هذا الاتجاه، قادت شركة علي بابا استثمارًا بقيمة 2 مليار يوان (290 مليون دولار) في شركة ShengShu، الشركة الناشئة التي تقف وراء أداة إنشاء الفيديو بالذكاء الاصطناعي Vidu، حسبما أعلنت الشركة يوم الجمعة. شاركت TAL Education وBaidu Ventures أيضًا في جولة التمويل من السلسلة B.
ويأتي الاستثمار بعد حوالي شهرين من رفع ShengShu 600 مليون يوان من Qiming Venture Partners وغيرهم من الداعمين. ورفضت الشركة الناشئة الكشف عن تقييمها.
وقال ShengShu إن التمويل الأخير سيدعم تطوير “نموذج عالمي عام” يستخدم الذكاء الاصطناعي لربط مجالين منفصلين حاليًا: العالم الرقمي للألعاب والفيديو الناتج عن الذكاء الاصطناعي، والعالم المادي للقيادة الذاتية والروبوتات.
وقالت الشركة الناشئة البالغة من العمر ثلاث سنوات في بيان: “تعتقد شركة ShengShu أن نموذج العالم العام، المبني على بيانات متعددة الوسائط مثل الرؤية والصوت واللمس، يجسد بشكل طبيعي كيفية عمل العالم المادي من نماذج اللغات الكبيرة”.

وأضاف تشو جون، مؤسس ShengShu، في بيان: “نحن نهدف إلى ربط الإدراك والفعل”، مما يسمح لأنظمة الذكاء الاصطناعي بوضع نموذج أفضل والتنبؤ بسلوك العالم الحقيقي باستمرار.
يُعد أحدث طراز Vidu Q3 Pro من ShengShu، والذي تم إصداره في يناير، من بين أفضل 10 نماذج للذكاء الاصطناعي لإنشاء مقاطع فيديو من النصوص والصور، وفقًا لـ التحليل الاصطناعي.
أطلقت الشركة Vidu عالميًا قبل أشهر من قيام OpenAI بإتاحة أداة Sora الخاصة بها والتي تم إغلاقها الآن لإنشاء فيديو الذكاء الاصطناعي على نطاق واسع. شركات الفيديو القصير الصينية كوايشو وأصدرت ByteDance أيضًا أدوات ذكاء اصطناعي منافسة مماثلة لإنشاء مقاطع الفيديو.
مسابقة النماذج العالمية
قامت شركة علي بابا بتوسيع استثماراتها في الشركات الناشئة ذات الصلة.
قادت شركة التكنولوجيا الصينية العملاقة وBaidu Ventures الشهر الماضي أ استثمار 50 مليون دولار في Tripo AI، وهي منصة تستخدم الذكاء الاصطناعي لإنشاء نماذج رقمية ثلاثية الأبعاد بسرعة من الصور الفوتوغرافية. وقالت تريبو إنها تبتعد أيضًا عن التقنيات التي تستخدمها نماذج اللغة نحو أدوات الذكاء الاصطناعي المتمركزة في الفضاء المادي وتقوم بتطوير نموذج عالمي خاص بها.
وفي سبتمبر، قادت علي بابا أيضًا استثمارًا بقيمة 60 مليون دولار في PixVerse، التي أصدرت الذكاء الاصطناعي نموذج عالمي في وقت سابق من هذا العام والذي يسمح للمستخدمين بتوجيه كيفية ظهور الفيديو أثناء إنشائه.
كما أصدرت شركة علي بابا، التي بدأت في مجال التجارة الإلكترونية، نماذج مجانية ومفتوحة المصدر للذكاء الاصطناعي لتوليد الفيديو، وفي فبراير/شباط، أطلقت نموذجًا لتشغيل الروبوتات.
قالت شركة Shengshu يوم الجمعة إن لديها شراكات استراتيجية مع شركات تعمل على تطوير الذكاء الاصطناعي المتجسد – أنظمة مثل الروبوتات البشرية التي تتفاعل مع العالم المادي – لاستخدامها في البيئات الصناعية والتجارية والمنزلية.
كتب كيفن كيلي، المؤسس المشارك لمجلة التكنولوجيا الأمريكية Wired، أن النماذج العالمية مهمة للغاية بالنسبة للروبوتات لأن التكنولوجيا تحتاج إلى أكثر من مجرد حاملي ماجستير في القانون لكي تعمل. الشهر الماضي على المكدس الفرعي له.
وقال كيلي إنه في نهاية المطاف، لتكرار الذكاء البشري، سيحتاج الذكاء الاصطناعي إلى ثلاثة أشياء: التفكير، وفهم العالم المادي، والتعلم المستمر. وقال إنه في حين أن الذكاء الاصطناعي لفئة التعلم لم يتم تطويره بعد، فقد أنشأت روبوتات الدردشة التي تدعم LLM عنصر المعرفة، مما يجعل النماذج العالمية مجالًا رئيسيًا يتطلب اختراقًا.