• امروز : افزونه جلالی را نصب کنید.
  • برابر با : Thursday - 17 September - 2026
0

برتری چین در هوش مصنوعی ویدئویی؛ فراتر از صنعت سرگرمی

  • کد خبر : 13758
  • 26 شهریور 1405 - 9:00
برتری چین در هوش مصنوعی ویدئویی؛ فراتر از صنعت سرگرمی
در حالی که مدل‌های زبانی بزرگی مانند Kimi K3 شرکت مون‌شات بخش زیادی از توجه‌ها به پیشرفت هوش مصنوعی چین را به خود اختصاص داده‌اند، یکی از حوزه‌هایی که توانمندی چین در آن آشکارتر شده، تولید ویدئو با هوش مصنوعی است؛ حوزه‌ای که اهمیت آن ممکن است بسیار فراتر از صنعت سینما و هالیوود باشد.

به گزارش بلومبرگ، به‌جز گوگل، تقریباً تمامی مدل‌های پیشرو تولید ویدئو در جهان چینی هستند. براساس رتبه‌بندی پلتفرم Artificial Analysis، ۹ مورد از ۱۰ سامانه برتر تبدیل متن به ویدئو متعلق به شرکت‌های چینی است.

بایت‌دنس و مینی‌مکس اخیراً نسخه‌های جدید مدل‌های تولید ویدئوی خود را با فاصله کوتاهی عرضه کرده‌اند. پیش از آن نیز مدل مرموز «Happy Horse» به‌طور غیرمنتظره در رتبه‌بندی‌های جهانی ظاهر شد و بعداً مشخص شد پروژه‌ای متعلق به علی‌بابا بوده است. Kling متعلق به Kuaishou و Vidu شرکت ShengShu Technology  نیز از دیگر مدل‌های مطرح چینی هستند. به این ترتیب، چین مجموعه گسترده‌ای از بازیگران قدرتمند را در حوزه‌ای ایجاد کرده که برخی شرکت‌های بزرگ آمریکایی توجه کمتری به آن نشان داده‌اند.

این ابزارها اکنون به‌طور فزاینده در آژانس‌های تبلیغاتی و استودیوهای سرگرمی استفاده می‌شوند و در توسعه سریع صنعت «میکرودراما» یا سریال‌های بسیار کوتاه در چین و بازارهای خارجی نیز نقش داشته‌اند. کاهش هزینه تولید محتوا از طریق هوش مصنوعی، این فناوری را به یکی از مسیرهای بالقوه درآمدزایی برای شرکت‌های چینی تبدیل کرده است.

با این حال، اهمیت راهبردی مدل‌های ویدئویی ممکن است در حوزه‌ای کاملاً متفاوت آشکار شود: توسعه «مدل‌های جهان» (World Models). این مدل‌ها به‌عنوان یکی از مسیرهای نسل آینده هوش مصنوعی مطرح هستند و هدف آنها تنها درک زبان نیست، بلکه باید بتوانند قوانین فیزیکی، حرکت اشیا، روابط علت و معلولی و نحوه تعامل اشیا در محیط واقعی را نیز درک و پیش‌بینی کنند.

چنین قابلیتی می‌تواند پایه توسعه نسل جدید ربات‌های انسان‌نما و خودروهای خودران باشد. برخی متخصصان هوش مصنوعی حتی توسعه مدل‌های جهان را مسیری محتمل‌تر برای دستیابی به هوش عمومی مصنوعی نسبت به ساخت چت‌بات‌های هرچه بزرگ‌تر می‌دانند.

مدل تولید ویدئو برای ساخت تصاویر متحرک واقع‌گرایانه ناچار است درکی نسبی از حرکت، فیزیک و روابط علت و معلولی پیدا کند. برای مثال، مدل باید بداند توپ روی زمین می‌غلتد و یک جسم هنگام برخورد با جسم دیگر چگونه واکنش نشان می‌دهد. تحقیقات نشان داده است که با افزایش مقیاس این مدل‌ها، برخی توانایی‌های ابتدایی استدلال فیزیکی حتی بدون برنامه‌ریزی مستقیم در آنها شکل می‌گیرد.

همین ویژگی باعث شده است پژوهشگران از مدل‌های ویدئویی برای آموزش ربات‌ها استفاده کنند. یک ربات برای انجام کارهایی مانند تا کردن لباس یا چیدن کالا در فروشگاه، تنها به تشخیص اشیا نیاز ندارد؛ بلکه باید بتواند نتیجه حرکت و تعامل خود با آنها را نیز پیش‌بینی کند.

برخی از شرکت‌های پیشرو چینی در حوزه هوش مصنوعی ویدئویی، از جمله شنشو، اکنون در حال حرکت به سمت توسعه مدل‌های جهان و سامانه‌های چندوجهی گسترده‌تر هستند. این روند البته محدود به چین نیست و شرکت آمریکایی Runway AI و شرکت آلمانی Black Forest Labs نیز در همین مسیر حرکت می‌کنند.

گذار از مدل‌های تولید ویدئو به مدل‌های جهان هنوز در مراحل اولیه قرار دارد، اما پس از کنار گذاشته شدن ابزار ویدئویی Sora توسط OpenAI، توسعه‌دهندگان چینی فرصت بیشتری برای پیشتازی در این حوزه پیدا کرده‌اند.

با این حال، چالش‌های مهمی همچنان وجود دارد. آموزش مدل‌های ویدئویی و مدل‌های جهان به حجم بسیار بالایی از داده و توان محاسباتی نیاز دارد. مسائل مربوط به حقوق مالکیت فکری و استفاده از محتوای دارای کپی‌رایت در داده‌های آموزشی نیز یکی از موانع مهم شرکت‌های چینی، به‌ویژه برای گسترش فعالیت آنها در بازارهای خارجی است.

اهمیت این موضوع برای چین زمانی بیشتر می‌شود که پیشرفت این کشور در سخت‌افزار رباتیک نیز در نظر گرفته شود. صدها شرکت چینی اکنون توانایی ساخت بدنه ربات‌های انسان‌نما را دارند، اما چالش اصلی همچنان توسعه «مغز» این ربات‌هاست. داده‌ها، شبیه‌سازی‌ها و قابلیت‌های درک محیط که در جریان توسعه مدل‌های تولید ویدئو ایجاد شده‌اند، اکنون می‌توانند برای ساخت چنین مغزی مورد استفاده قرار گیرند.

از این منظر، رقابت آینده هوش مصنوعی ممکن است تنها حول مدل‌های زبانی و چت‌بات‌ها شکل نگیرد. در حالی که بخش بزرگی از سرمایه‌گذاری و توجه سیاسی در آمریکا بر مدل‌های زبانی متمرکز شده، پیشرفت چین در مدل‌های ویدئویی و مدل‌های جهان می‌تواند در بلندمدت اهمیت بیشتری برای رباتیک، خودروهای خودران و هوش مصنوعی فیزیکی داشته باشد.

اگر مدل‌های تولید ویدئو به بستری برای آموزش ماشین‌هایی تبدیل شوند که قادر به درک و تعامل با دنیای واقعی هستند، برتری فعلی چین در این حوزه دیگر صرفاً تهدیدی برای هالیوود نخواهد بود؛ بلکه می‌تواند بر تعیین رهبران نسل بعدی هوش مصنوعی تأثیرگذار باشد.

منبع: bloomberg

لینک کوتاه : https://techchina.ir/?p=13758

ثبت دیدگاه

قوانین ارسال دیدگاه
  • دیدگاه های ارسال شده توسط شما، پس از تایید توسط تیم مدیریت در وب منتشر خواهد شد.
  • پیام هایی که حاوی تهمت یا افترا باشد منتشر نخواهد شد.
  • پیام هایی که به غیر از زبان فارسی یا غیر مرتبط باشد منتشر نخواهد شد.