هند با عرضه مدل‌های تولید ویدیو و تصاویر در مقایسه با آمریکا، اروپا و چین کندتر پیش رفته است، اما برنامه‌های جدید دولتی و حرکت شرکت‌های نوپا نشان می‌دهد این وضعیت در حال تغییر است. یکی از تازه‌ترین دستاوردها، رونمایی از مدل ویدیویی «Varya» توسط استارتاپ هندی Avataar AI است که با هدف درک بهتر بسترهای محلی — از جمله جشن‌ها، غذاها و پوشش‌های محلی — توسعه یافته و می‌تواند نقطه عطفی در تولید محتوای ویدیویی بومی باشد.

خلاصه‌ای از آنچه Varya را متمایز می‌کند
– منشأ و روش توسعه: Avataar AI مدل Varya را از ابتدا نساخته؛ تیم این استارتاپ نسخه عمومی مدل ویدیویی Wan 2.2 ارائه‌شده توسط علی‌بابا را مبنا قرار داد و با استفاده از روش «تقطیر مدل» (distillation) قابلیت‌های آن را در قالب مدلی سبک‌تر و بهینه شده برای کاربردهای تجاری خود فشرده‌سازی کرد. تقطیر به معنای انتقال «دانش» یک مدل بزرگ به یک مدل کوچکتر است تا سرعت اجرا و هزینه‌ها کاهش یابد.
– عملکرد فنی: Varya در چهار مرحله اجرا می‌شود در حالی که Wan 2.2 به حدود 50 مرحله نیاز دارد؛ نتیجه تولید ویدیو حدود 10 برابر سریع‌تر و با هزینه‌ای بسیار کمتر است. به‌طور مشخص، روی یک GPU انویدیا H200، تولید یک کلیپ پنج ثانیه‌ای با کیفیت 720p توسط Varya در 45 ثانیه انجام می‌شود، مقابل 1,230 ثانیه برای Wan 2.2.
– قیمت‌گذاری: Avataar قیمت سرویس میزبانی‌شده Varya را ₹0.48 (حدود 0.005 دلار آمریکا) برای هر ثانیه اعلام کرده که تا حدود 20 برابر ارزان‌تر از رقبایی مانند Veo، Kling، Luma و Runway است که معمولاً از حدود 0.10 دلار به بالا برای هر ثانیه هزینه می‌گیرند.

دسترسی باز و داده‌های بومی
Avataar AI اعلام کرده که Varya به‌صورت open-weight (وزن مدل و کدهای مرتبط قابل دانلود) از طریق پورتال AIKosh دولت هند منتشر خواهد شد؛ این پورتال مخزن مرکزی مدل‌ها و داده‌های در دسترس عموم است. همراه با مدل، مجموعه‌ای از داده‌های ساختاریافته و متناسب با فرهنگ محلی نیز عرضه می‌شود که توسعه‌دهندگان می‌توانند مدل را میزبانی و سفارشی‌سازی کنند. علاوه بر این، Varya هم‌اکنون از طریق وب‌سایت Avataar با امکان ورودی متن یا تصویر مرجعی در دسترس عموم قرار دارد و شرکت برنامه‌هایی برای ارائه مدل به مشتریان سازمانی و همکاری با ابزارهای ویدیویی دیگر دارد.

زمینه دولتی و انگیزه‌ها
برای تشویق توسعه مدل‌های بومی، دولت هند با برنامه India AI Mission سرمایه‌گذاری‌ای در حدود 1.2 میلیارد دلار را آغاز کرده که در میان اقدامات آن تخصیص محاسبات GPU یارانه‌ای به استارتاپ‌های منتخب است به شرطی که مدل‌های تولیدی خود را به‌صورت عمومی منتشر کنند. Avataar AI یکی از 12 استارتاپ انتخاب‌شده در این برنامه است. سیاست‌گذاران هند می‌خواهند از این مسیر، نه تنها ظرفیت محاسباتی و کیفیت داده‌ها را ارتقا دهند، بلکه اکوسیستم توسعه‌دهندگان را نیز تقویت کنند؛ هدف اعلام‌شده IT وزیر، جذب 200 میلیارد دلار سرمایه در حوزه هوش مصنوعی تا سال 2028 و افزایش بیش از دو برابری ظرفیت GPU در شش ماه است.

اهمیت فرهنگی و کاربردی
یکی از مشکلات مدل‌های تصویر و ویدیو این است که اغلب ظرایف فرهنگی را نادیده می‌گیرند و خروجی‌های کلیشه‌ای یا غیرمنطبق با زمینه محلی تولید می‌کنند. Avataar با استفاده از داده‌های گزینش‌شده تلاش کرده Varya را نسبت به غذاها، پوشش‌ها، معماری و جشن‌های محلی حساس کند. کاهش هزینه و افزایش سرعت تولید ویدیو می‌تواند درهای جدیدی به سوی پذیرش در مقیاس وسیع باز کند؛ از آموزش و خدمات عمومی گرفته تا مشاغل کوچک و متوسط (MSMEs)، سازندگان محتوا و تجارت‌های الکترونیک که در هند بازار «ویدیو-محور» دارند.

پیامدها برای اکوسیستم AI هند
راهکارهایی مانند Varya نشان می‌دهند که هند می‌تواند با تمرکز بر کاربردها و سازگارسازی مدل‌ها برای بازار محلی، جایگاه خود را در اکوسیستم جهانی هوش مصنوعی تقویت کند—بخصوص در شرایطی که توسعه مدل‌های پایه (foundation models) به‌دلیل محدودیت در محاسبات و داده با کندی روبه‌روست. در عین حال انتشار مدل‌ها و داده‌ها به‌صورت باز می‌تواند به رشد اکوسیستم توسعه‌دهندگان، بهبود کیفیت داده‌های محلی و تسهیل نوآوری در محصولات و خدمات منجر شود.

نتیجه
رونمایی Varya نمونه‌ای از تلاش‌های ترکیبی بخش خصوصی و سیاست‌های دولتی برای کم‌هزینه‌تر و بومی‌تر کردن تولید محتوای ویدیویی مبتنی بر هوش مصنوعی در هند است. اگر کاهش هزینه و افزایش دسترسی به ابزارهای قدرتمند ادامه یابد، امکان دارد به‌زودی شاهد موجی از کاربردهای ویدیویی AI باشیم که نیازهای بومی آموزش، تجارت و خدمات عمومی را با هزینه‌ای قابل‌توجه کمتر پوشش دهد.

دستیار صوتی هوشمند پیشرفته

دیدگاه‌ خود را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

اسکرول به بالا