صفحه اصلیمرکز اخبار LBank
آخرین اخبار هوش مصنوعی: آواتار جدید HeyGen V به شما امکان می‌دهد صورت خود را در ۱۵ ثانیه شبیه‌سازی کرده و ویدیوهای نامحدود هوش مصنوعی تولید کنید
latest-ai-heygen-avatar-v-clones-faces-in-15-seconds
آخرین اخبار هوش مصنوعی: آواتار جدید HeyGen V به شما امکان می‌دهد صورت خود را در ۱۵ ثانیه شبیه‌سازی کرده و ویدیوهای نامحدود هوش مصنوعی تولید کنید
آواتار V میکروبیان‌های خاص کاربر، هندسه لب، سیلوئت صورت و حرکت طبیعی را از یک کلیپ ۱۵ ثانیه‌ای ضبط می‌کند و سپس آن هویت را در تمام ویدئوهای تولید شده بدون توجه به طول، زاویه، لباس یا صحنه حفظ می‌کند، که مشکل انحراف هویت را که باعث کاهش کیفیت بیشتر آواتارهای هوش مصنوعی پس از چند ثانیه شده بود، حل می‌کند. پس از ایجاد دوقلوی دیجیتال، کاربران یک عکس پایه به عنوان مرجع هویت خود انتخاب می‌کنند، هر لباس یا تنظیمی را از طریق دستورات متنی اعمال می‌کنند و ویدئو را با هماهنگی کامل لب به ۱۷۵ زبان تولید می‌کنند؛ کلونینگ صدا یک مرحله اختیاری جداگانه است که شرکت برای حداکثر واقعی بودن توصیه می‌کند. آواتار V اکنون پایه‌ای است که همه ویژگی‌های دیگر در پلتفرم HeyGen بر اساس آن اجرا می‌شود، با ادغام Seedance 2.0 برای تولید ویدئوی سینمایی و در دسترس در تمام سطوح اشتراک پولی قرار دارد.
2026-04-09 منبع:crypto.news

جدیدترین ابزار ویدیویی هوش مصنوعی که این هفته وایرال شد، آواتار V از HeyGen است که در 8 آوریل با 472,000 بازدید در X معرفی شد. این ابزار یک دوقلوی دیجیتالی فوتورئالیستی از چهره، صدا و حرکات کاربر را از یک ضبط 15 ثانیه‌ای وب‌کم ایجاد می‌کند و سپس ویدیوی نامحدود با کیفیت استودیویی را بدون هیچ تجهیزات حرفه‌ای تولید می‌کند.

خلاصه
  • آواتار V ریزتعبیرات، هندسه لب، نمای صورت و حرکات طبیعی خاص کاربر را از یک کلیپ 15 ثانیه‌ای ثبت می‌کند، سپس این هویت را در هر ویدیوی تولید شده، صرف نظر از طول، زاویه، لباس یا صحنه، حفظ می‌کند و مشکل «شناسه شناوری» (identity drift) را که باعث افت کیفیت اکثر آواتارهای هوش مصنوعی پس از چند ثانیه می‌شود، حل می‌کند.
  • پس از ایجاد دوقلوی دیجیتالی، کاربران یک عکس پایه را به عنوان مرجع هویت خود انتخاب می‌کنند، هر لباس یا صحنه‌ای را از طریق پرامپت‌های متنی اعمال می‌کنند و ویدیو را به 175 زبان با همگام‌سازی کامل لب (lip-sync) تولید می‌کنند؛ شبیه‌سازی صدا یک مرحله اختیاری جداگانه است که شرکت برای حداکثر واقع‌گرایی توصیه می‌کند.
  • آواتار V اکنون پایه و اساس تمام ویژگی‌های دیگر پلتفرم HeyGen است که با Seedance 2.0 برای تولید ویدیوی سینمایی یکپارچه شده است و در تمام سطوح اشتراک پولی در دسترس است.

صفحه رسمی معرفی HeyGen، آواتار V را بر اساس یک باور واحد توصیف می‌کند: خروجی باید به اندازه‌ای خوب باشد که کاربران مایل باشند نام خود را پای آن بگذارند، نه فقط «برای هوش مصنوعی خوب»، بلکه «واقعا خوب». این مدل بر اساس آنچه HeyGen آن را «هویت نهفته با پایه زمانی» (temporally grounded identity embedding) می‌نامد، آموزش دیده است که از کلیپ 15 ثانیه‌ای ساخته شده و حرکات و تغییرات حالت چهره خاصی را که یک فرد را در زمینه‌های مختلف قابل تشخیص می‌سازد، ثبت می‌کند. نماهای باز، فریم‌های میانی و نماهای نزدیک، همگی از یک ضبط ثابت می‌مانند. این فرآیند نیازی به نورپردازی استودیویی و خدمه ندارد؛ یک تلفن یا وب‌کم استاندارد کافی است.

اصل کلیدی طراحی، جداسازی هویت از ظاهر است. کلیپ 15 ثانیه‌ای نحوه حرکت یک فرد را تعریف می‌کند. یک عکس پایه جداگانه ظاهر آن‌ها را تعریف می‌کند. سپس کاربران می‌توانند ظاهر را آزادانه تغییر دهند در حالی که حرکت به طور غیرقابل انکاری متعلق به آن‌ها باقی می‌ماند.

جدیدترین هوش مصنوعی: آواتار V چه مشکلاتی را حل می‌کند که مدل‌های قبلی نتوانستند

اکثر سیستم‌های آواتار هوش مصنوعی برای یک لحظه چشمگیر واحد بهینه شده‌اند: اسکرین‌شات، کلیپ کوتاه، یا دموی کنترل‌شده‌ای که در آن همه چیز به نفع مدل عمل می‌کند. آن‌ها در دو ثانیه واضح به نظر می‌رسند و در بیست ثانیه با انحراف چهره از منبع، دچار فروپاشی می‌شوند. آواتار V به طور خاص برای حفظ این ثبات در تمام مدت زمان یک ویدیو و بدون این انحراف طراحی شده است. HeyGen این را «ثبات هویت» (identity consistency) توصیف می‌کند: همان چهره، همان ریزتعبیرات، همان حضور از فریم اول تا آخر، در یک کلیپ 30 ثانیه‌ای یا یک ماژول 10 دقیقه‌ای.

کاربران واقعاً با آن چه می‌توانند بسازند

گردش کار عملی سه مرحله دارد: ضبط یک ویدیوی 15 ثانیه‌ای، به صورت اختیاری ضبط یک شبیه‌سازی صدای مستقل، سپس انتخاب یک عکس پایه به عنوان مرجع هویت برای هر صحنه‌ای که پس از آن تولید می‌شود. از آن پایه، کاربران پرامپت می‌نویسند تا لباس‌ها، تنظیمات و سبک‌های جدید را تولید کنند، یا از کتابخانه HeyGen استفاده می‌کنند. ویدیوی نهایی می‌تواند به هر یک از 175 زبان با همگام‌سازی لب که به طور خودکار با زبان هدف تطبیق داده شده است، ارائه شود. HeyGen به کاربران توصیه می‌کند که هنگام ضبط بیانگر باشند، زیرا به گفته این شرکت، "انرژی که می‌گذارید، همان انرژی است که دریافت می‌کنید."

چرا این موضوع برای تولید محتوا در مقیاس بزرگ اهمیت دارد

همانطور که crypto.news گزارش داده است، ابزارهای هوش مصنوعی که هزینه و زمان تولید محتوای حرفه‌ای را کاهش می‌دهند، به طور مستقیم تصمیمات مربوط به نیروی انسانی شرکت‌ها را در سال 2026 بازتعریف می‌کنند. همانطور که crypto.news اشاره کرده است، گسترش ابزارهای محتوای هوش مصنوعی یک متغیر کلیدی در نحوه ارزیابی دوام سرمایه‌گذاری زیرساخت‌های هوش مصنوعی توسط سرمایه‌گذاران نهادی است. آواتار V اکنون به طور کامل از طریق برنامه‌های پولی HeyGen در دسترس است، با دسترسی به مجموعه کامل قالب‌ها، ابزارهای ترجمه و استودیو پلتفرم.

رمزارز های محبوب
همین حالا ثبت‌نام کنید، هیچ به‌روزرسانی‌ای را از دست ندهید!