پرش به محتوا
آخرین اخبار
آسیب‌پذیری PostgreSQL امکان اجرای کد روی سرور را فراهم می‌کند گوگل آسیب‌پذیری روز صفر کروم را پس از حملات فعال برطرف کرد فیشینگ گسترده با کاراکترهای نامرئی برای دور زدن فیلترهای ایمیل به‌روزرسانی Windows ۱۱ تنظیمات ماوس را در سیستم‌های غیرانگلیسی بازنشانی می‌کند اختلال گسترده چندین مدل هوش مصنوعی Claude حملات گسترده علیه آسیب‌پذیری بحرانی Elementor Pro آسیب‌پذیری بحرانی سوئیچ‌های Cisco Nexus امکان اجرای کد با دسترسی root را می‌دهد تروجان بانکی StreamRat کنترل گسترده دستگاه‌های اندرویدی را فراهم می‌کند آسیب‌پذیری PostgreSQL امکان اجرای کد روی سرور را فراهم می‌کند گوگل آسیب‌پذیری روز صفر کروم را پس از حملات فعال برطرف کرد فیشینگ گسترده با کاراکترهای نامرئی برای دور زدن فیلترهای ایمیل به‌روزرسانی Windows ۱۱ تنظیمات ماوس را در سیستم‌های غیرانگلیسی بازنشانی می‌کند اختلال گسترده چندین مدل هوش مصنوعی Claude حملات گسترده علیه آسیب‌پذیری بحرانی Elementor Pro آسیب‌پذیری بحرانی سوئیچ‌های Cisco Nexus امکان اجرای کد با دسترسی root را می‌دهد تروجان بانکی StreamRat کنترل گسترده دستگاه‌های اندرویدی را فراهم می‌کند
اخبار

هوش مصنوعی تبدیل متن به ویدیو Vidu معرفی شد؛ رقیب چینی Sora

اردیبهشت ۱۰, ۱۴۰۳ نوشتهٔ nr بدون نظر

کمیته رکن چهارم – Vidu می‌تواند ویدیوهای ۱۶ ثانیه‌ای با وضوح ۱۰۸۰p تولید کند و با Sora از OpenAI رقابت خواهد کرد.

شرکت فناوری چینی ShengShu-AI با همکاری محققان «دانشگاه چینهوا»، از اولین مدل هوش مصنوعی تبدیل متن به ویدیو چین، با نام Vidu رونمایی کرد. این مدل که پیشرفت سریع این کشور درزمینه توسعه هوش مصنوعی را نشان می‌دهد، با Sora از OpenAI رقابت خواهد کرد.

Vidu که در انجمن Zhongguancun پکن معرفی شد، می‌تواند با یک کلیک و دستور متنی ساده، کلیپ ویدیویی ۱۶ ثانیه‌ای با وضوح ۱۰۸۰p تولید کند. طبق توضیحات ارائه‌شده، مدل هوش مصنوعی Vidu براساس یک معماری تبدیل بصری با نام Universal Vision Transformer (U-ViT) ساخته شده است که دو مدل هوش مصنوعی متن به ویدیو Diffusion و Transformer را با یکدیگر ترکیب می‌کند.

هوش مصنوعی تبدیل متن به ویدیو Vidu

Vidu می‌تواند محیط و اجسام دنیا را به‌صورت واقعی شبیه‌سازی کرده و صحنه‌هایی با جزئیات پیچیده و مطابق با قوانین فیزیک، همراه با افکت‌های نور و سایه تولید کند. همچنین این مدل در نمایش حالات چهره نیز در ویدیوهای خود تبحر دارد. علاوه‌براین، Vidu درک خوبی از عناصر چینی دارد و می‌تواند ویدیوهایی از موجودات منحصربه‌فرد مانند پاندای غول‌پیکر و اژدهای چینی تولید کند.

مدل هوش مصنوعی تبدیل متن به ویدیوی چینی Vidu تنها دو ماه پس از انتشار مدل Sora توسط استارتاپ آمریکایی OpenAI که با سروصدای زیادی در سراسر جهان همراه شد، معرفی شده است. «ژو جون»، معاون انستیتوی هوش مصنوعی دانشگاه چینهوا و دانشمند ارشد ShengShu-AI، هنگام معرفی مدل Vidu گفت:

«پس از انتشار Sora، متوجه شدیم که این مدل با نقشه راه فنی ما مطابقت دارد و ما را ترغیب کرد تا تحقیقات خود را با قاطعیت پیش ببریم.»

منبع : دیجیاتو

دیدگاه خود را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *


Type The Red Captcha Characters Below.