AI بولتی تصویر

ایک portrait اور ایک audio track اپ لوڈ کریں (زیادہ سے زیادہ 35s)، یا اسکرپٹ لکھیں اور آواز منتخب کریں، اور OmniHuman 1.5 تصویر کو synced lips اور قدرتی حرکت کے ساتھ talking video میں بدل دیتا ہے۔ اس میں خود ستارہ بننے کے لیے اپنی تصویر استعمال کریں۔

0 / 2,000
130 cr/s · ≤35s

ایک تصویر سے بولتی ویڈیو تک

ایک تصویر اور ایک اسکرپٹ مل کر جاندار ترجمان بن جاتے ہیں — ہونٹ، تاثرات اور اشارے ہم آہنگ۔ نہ کیمرہ، نہ اسٹوڈیو۔

اصل تصویرOriginal portrait photo of a beauty creator holding a skincare product
اسکرپٹ

Hey everyone! I am so excited to share my new favorite foundation. It blends in seamlessly for a flawless, natural finish, and it actually feels lightweight all day. A little goes a long way, so one bottle lasts for months.

AI اوتار ویڈیو

کوئی بھی تصویر بولوائیں، اپنی اپنی بھی

مکمل AI بولتی تصویر (ڈیجیٹل انسان) جنریٹر: ایک پورٹریٹ اور ایک آڈیو کلپ اپلوڈ کریں، یا اسکرپٹ ٹائپ کریں اور آواز منتخب کریں، اور ہم آہنگ ہونٹوں، قدرتی تاثرات اور اشاروں کے ساتھ زندہ جیسی بولتی ویڈیو حاصل کریں۔ پیش کنندہ بننے کے لیے اپنی تصویر استعمال کریں۔ ByteDance OmniHuman 1.5 سے چلنے والا، نہ کیمرہ، نہ اداکار، نہ اسٹوڈیو درکار۔

ایک فریم شدہ پورٹریٹ تصویر جو اسی عورت کے بولتے AI اوتار میں بدل رہی ہے، ان دونوں کے درمیان آڈیو ویوفارم کے ساتھ

خود اس میں مرکزی کردار بنیں، یا ڈیجیٹل ترجمان بنائیں

نہ فلم بندی، نہ اداکار، نہ گرین اسکرین۔ اپنی ایک صاف تصویر اپلوڈ کریں اور آپ وہ پیش کنندہ بن جاتے ہیں جو آپ کی اسکرپٹ پڑھتا ہے، اپنی آواز میں یا لائبریری کی آواز میں۔ یا کسی ایسے شخص کی تصویر استعمال کریں جس نے آپ کو اجازت دی ہو اور مصنوعات کی وضاحتوں، کورس کے تعارف، اعلامیوں اور اشتہاروں کے لیے دوبارہ قابلِ استعمال ڈیجیٹل میزبان بنائیں۔ دوبارہ شوٹنگ کے بغیر کسی بھی وقت نئے جملے بنائیں۔

AI بولتی تصویر کے لیے دو ان پٹس: ایک اپلوڈ شدہ آڈیو ویوفارم اور آواز منتخب کرنے والے کے ساتھ ایک ٹائپ شدہ اسکرپٹ

دو طریقے: آڈیو اپ لوڈ کریں یا اسکرپٹ ٹائپ کریں۔

پہلے سے ہی صوتی ریکارڈنگ ہے؟ اسے اپ لوڈ کریں اور اوتار اس پر ہونٹ سنک کرتا ہے۔ کوئی آڈیو نہیں؟ ٹیکسٹ موڈ پر جائیں — ٹائپ کریں کہ اوتار کو کیا کہنا چاہیے، بلٹ ان ٹیکسٹ ٹو اسپیچ لائبریری سے آواز کا انتخاب کریں، اور اسکرپٹ کو آپ کے لیے ڈرائیونگ آڈیو میں ترکیب کیا جائے گا۔ تخمینہ شدہ لمبائی اور کریڈٹ لاگت آپ کے پیدا کرنے سے پہلے دکھائے جاتے ہیں۔

قدرتی ہاتھ کے اشاروں کے ساتھ کیمرے سے بات کرتی عورت کی AI بولتی تصویر کا اسٹل

لائف لائک - نہ صرف ایک حرکت پذیر منہ

OmniHuman 1.5 درست ہونٹ سنک کے ساتھ ساتھ سر کی حرکت، کرنسی اور ہاتھ کے اشاروں کو چلانے کے لیے آڈیو کی تال، پراسڈی اور معنی پڑھتا ہے، جبکہ اس شخص کی شناخت اور روشنی کو محفوظ رکھتا ہے۔ نتیجہ متحرک منہ کے ساتھ جامد پورٹریٹ کے بجائے ایک حقیقی پیش کنندہ کی طرح کارکردگی کا مظاہرہ کرتا ہے۔

بیٹھک میں ایک چھوٹی سوشل کلپ پیش کرتا AI بولتی تصویر پیش کنندہ

مارکیٹنگ، تربیت اور سماجی کے لیے بنایا گیا ہے۔

اشتہارات اور لینڈنگ پیجز کے لیے ترجمان کلپس، بیان کردہ اسباق اور تربیت کے لیے آن بورڈنگ، سماجی کے لیے ٹاکنگ ہیڈ پوسٹس، یا اسی پیغام کے کثیر لسانی ورژن۔ ہر نسل کو اس کے ان پٹ کے ساتھ تاریخ میں محفوظ کیا جاتا ہے، لہذا آپ اعادہ کر سکتے ہیں اور تیزی سے تغیرات پیدا کر سکتے ہیں۔

AI بولتی تصویر کے لیے تیار پورٹریٹ

CreateVision AI پر بنائے گئے پریزنٹر انداز کے پورٹریٹس — آڈیو شامل کرتے ہی ان میں سے کوئی بھی بولتا ہوا اوتار ویڈیو چلا سکتا ہے۔

سکن کیئر سیرم پیش کرنے والے بیوٹی تخلیق کار کا AI اوتار
ایک سمارٹ فون پیش کرنے والے ایک ٹیک جائزہ کار کا AI اوتار
کافی کپ کے ساتھ طرز زندگی کے تخلیق کار کا AI اوتار
اسنیکر جائزہ لینے والے کا AI اوتار جوتا پیش کر رہا ہے۔
ہینڈ بیگ کے ساتھ ایک فیشن تخلیق کار کا AI اوتار
سپلیمنٹس پیش کرنے والے فلاح و بہبود کے تخلیق کار کا AI اوتار
پرفیوم کی بوتل کے ساتھ خوبصورتی کے خالق کا AI اوتار
باورچی خانے کے گیجٹ کے ساتھ گھر میں کھانا بنانے والے تخلیق کار کا AI اوتار

اس AI بولتی تصویر جنریٹر کے پیچھے کا ماڈل

اس صفحے پر لپ سنک، چہرے کے تاثرات اور جسمانی حرکت OmniHuman 1.5 چلا رہا ہے۔

AI بولتی تصویر کی تفصیلات

اِن پُٹایک پورٹریٹ تصویر، اور ساتھ یا تو اپ لوڈ کی گئی آڈیو فائل یا لکھا ہوا اسکرپٹ۔
کس کی تصویرآپ کی اپنی، یا کسی ایسے شخص کی جس نے آپ کو اجازت دی ہو۔ تصویر اور آواز دونوں آپ کے استعمال کے لیے جائز ہونی چاہئیں۔
پورٹریٹ کے لیے رہنمائیسامنے کا رخ، اچھی روشنی، پورا چہرہ نظر آتا اور فوکس میں۔ دھوپ کے چشمے اور گہرا سایہ لپ سنک کی درستی کم کر دیتے ہیں۔
آڈیو کی لمبائیفی جنریشن 35 سیکنڈ تک — تقریباً 85 بولے گئے الفاظ۔
آوازوں کی لائبریری10 زبانوں میں 60 بلٹ اِن آوازیں، جنہیں بنانے سے پہلے سنا جا سکتا ہے۔
ماڈلOmniHuman 1.5، جو لپ سنک، چہرے کے تاثرات اور سر و جسم کی فطری حرکت چلاتا ہے۔
لاگتدیگر ویڈیو جنریشن کی طرح فی سیکنڈ آؤٹ پٹ پر بلنگ؛ بنانے سے پہلے دکھا دی جاتی ہے۔
آؤٹ پُٹڈاؤن لوڈ کے قابل کلپ، جو اصل پورٹریٹ اور اسکرپٹ کے ساتھ آپ کی ہسٹری میں محفوظ ہو جاتا ہے۔

اپنی AI بولتی تصویر میں خود مرکزی کردار کیسے بنیں

آپ کی تصویر، آپ کے الفاظ، ایک کلپ۔

  1. 1

    اپنی تصویر اپلوڈ کریں

    صاف، سامنے کی طرف لی گئی تصویر بہترین کام کرتی ہے: فون سیلفی، ہیڈ شاٹ، یا ویڈیو کا ایک فریم۔ بولتی تصویر AI اسی ایک فریم سے آپ کا چہرہ پڑھتی ہے۔

  2. 2

    اپنی آواز شامل کریں

    خود کو ریکارڈ کریں اور آڈیو اپلوڈ کریں، یا اپنی اسکرپٹ ٹائپ کریں اور 60 بلٹ اِن آوازوں میں سے ایک منتخب کریں۔ آڈیو 35 سیکنڈ تک ہو سکتی ہے۔

  3. 3

    بنائیں، پھر خود کو دوبارہ استعمال کریں

    ماڈل ہونٹوں، تاثرات اور قدرتی سر کی حرکت کو آڈیو کے ساتھ ہم آہنگ کرتا ہے۔ وہی تصویر رکھیں اور جب ضرورت ہو نئے جملے بنائیں، دوبارہ شوٹنگ کے بغیر۔

AI بولتی تصویر کے لیے اسکرپٹ کیسے لکھیں

یہاں تصویر کا کوئی پرامپٹ نہیں — کام پورٹریٹ اور آڈیو کرتے ہیں۔ آپ جو لکھتے ہیں وہ اسکرپٹ ہے، اور اسکرپٹ کے فیصلے ہی طے کرتے ہیں کہ نتیجہ فطری لگے گا یا نہیں۔

1

ابتدائی جملہ

کسی چھوٹی بات سے شروع کریں۔ پہلا سیکنڈ ہی وہ جگہ ہے جہاں لپ سنک سب سے زیادہ نظر آتی ہے۔

ہیلو — ایک چھوٹی سی بات۔

2

جملے کی لمبائی

جملے تقریباً 15 الفاظ سے کم رکھیں۔ لمبے جملے غیر فطری وقفے پیدا کرتے ہیں۔

اس سیرم میں دو اجزا ہیں۔ پورا فارمولا بس یہی ہے۔

3

رموزِ اوقاف

کوما اور فُل اسٹاپ سانسوں میں بدل جاتے ہیں۔ انہیں وہیں لگائیں جہاں آپ واقعی رُکیں گے۔

یہ کام کرتا ہے — اور دس سیکنڈ لیتا ہے۔

4

دورانیے کا بجٹ

تقریباً 2.5 الفاظ فی سیکنڈ۔ جتنی لمبی کلپ چاہیے، اُسی حساب سے لکھیں۔

35 سیکنڈ کی کلپ کے لیے ~85 الفاظ

مبہم

ہماری انقلابی پروڈکٹ جدید ترین ٹیکنالوجی بروئے کار لاتی ہے تاکہ اعلیٰ معیار کے متلاشی باذوق صارفین کو بے مثال نتائج فراہم کیے جا سکیں۔

مخصوص

یہی وہ حصہ ہے جس کے بارے میں لوگ ہمیشہ پوچھتے ہیں۔ دو اجزا، کوئی بھرتی نہیں۔ فرق تقریباً ایک ہفتے میں نظر آ جائے گا۔

یہ کیوں کام کرتا ہے

پہلا 19 الفاظ کا ایک ہی مجرد جملہ ہے — اوتار اسے چپٹے، بغیر سانس کے یکساں لہجے میں پڑھتا ہے، کیونکہ رکنے کی کوئی جگہ نہیں۔ دوسرا تین چھوٹے جملے ہیں جن میں زور دینے کے قدرتی مقام ہیں، اور یہی ادائیگی کو انسانی بناتا ہے۔

مبہم

ہیلو اور ہمارے چینل میں خوش آمدید جہاں آج ہم اُن پانچ اہم ترین باتوں پر گفتگو کر رہے ہوں گے جو آپ کو جِلد کی دیکھ بھال کے معمولات کے بارے میں جاننے کی ضرورت ہے۔

مخصوص

جِلد کی دیکھ بھال کے بارے میں پانچ باتیں۔ پہلی وہی ہے جو لوگ غلط کرتے ہیں۔

یہ کیوں کام کرتا ہے

لمبی، بغیر رکے چلنے والی ابتدا پر ہی لپ سنک سب سے زیادہ بہکتی ہے، کیونکہ ماڈل کے پاس ٹھہرنے کے لیے کوئی رموزِ اوقاف نہیں ہوتے۔ ایک مختصر ہُک اسے زور دینے کے صاف مقام دیتا ہے اور توجہ بھی بہتر باندھتا ہے۔

وہ عادتیں جو چھوڑ دینی چاہئیں

  • ایسا پورٹریٹ استعمال کرنا جس میں چہرہ چھوٹا، ترچھا یا جزوی طور پر سائے میں ہو۔ لپ سنک کی درستی کا براہِ راست تعلق اس سے ہے کہ اصل فریم میں منہ کتنا صاف نظر آتا ہے۔
  • آڈیو کی حد سے آگے لکھ جانا۔ جنریشن 35 سیکنڈ آڈیو پر رک جاتی ہے — اس سے لمبا اسکرپٹ کٹ جاتا ہے، اس لیے اسے حصوں میں بانٹیں اور وہی پورٹریٹ دوبارہ استعمال کریں۔
  • بھاری تکنیکی الفاظ۔ اعداد، مخففات اور لمبے پروڈکٹ ناموں پر ہی مصنوعی آواز سب سے زیادہ مصنوعی لگتی ہے۔ انہیں ویسے ہی لکھیں جیسے آپ بول کر کہیں گے۔

AI اوتار ویڈیو جنریٹر سے آگے

بولتے اوتار صرف ایک نتیجہ ہیں۔ امیج اور ویڈیو جنریشن بھی اسی اکاؤنٹ سے چلتی ہے۔

AI اوتار ویڈیو کے بارے میں مفید وسائل

AI بولتی تصویر کی قیمتیں اور مفت کریڈٹس

بولتی تصویر ویڈیوز دیگر ویڈیو آؤٹ پٹ کی طرح فی سیکنڈ بل ہوتی ہیں۔ نئے اکاؤنٹس کو اسے آزمانے کے لیے 200 مفت کریڈٹس ملتے ہیں۔

Free

$0

شروعات کرنے کے لیے بہترین

  • 200 ویلکم کریڈٹس، روزانہ زیادہ سے زیادہ 80
  • Z Image Turbo کے ڈرافٹس 0 credits پر
  • معیاری جنریشن رفتار
  • جنریشن ہسٹری شامل
شروع کریں

Premium

سب سے مقبول
$29/month

سالانہ بل · $240/سال

  • ماہانہ 8,000 کریڈٹس، کوئی یومیہ حد نہیں
  • تمام Premium ماڈلز — GPT Image 2، Nano Banana، Seedream، Seedance، Veo، Kling
  • 5 گنا جنریشن رفتار، ترجیحی قطار
  • AI پرامپٹ بہتری
Premium میں اپ گریڈ کریں

Ultimate

$59/month

سالانہ بل · $468/سال

  • ماہانہ 18,000 کریڈٹس، کوئی یومیہ حد نہیں
  • 4K ریزولوشن تک HD جنریشن
  • ترجیحی سپورٹ
  • سب سے تیز قطار اور نئے ماڈلز تک ابتدائی رسائی
Ultimate میں اپ گریڈ کریں

AI بولتی تصویر — اکثر پوچھے گئے سوالات

1

AI بولتی تصویر کیا ہے؟

AI بولتی تصویر، جسے AI اوتار یا ڈیجیٹل انسان بھی کہا جاتا ہے، ایک شخص کی بنائی گئی بولتی ویڈیو ہے جو ایک تصویر اور ایک آواز سے بنتی ہے۔ فلم بندی کے بجائے، آپ ایک پورٹریٹ اور آڈیو (یا اسکرپٹ + آواز) فراہم کرتے ہیں، اور ماڈل زندہ جیسی بولنے کی کارکردگی کو حرکت دیتا ہے — جسے ڈیجیٹل پیش کنندہ، ترجمان یا راوی کے طور پر استعمال کیا جاتا ہے۔

2

مجھے ایک تخلیق کرنے کی کیا ضرورت ہے؟

ایک واضح، سامنے والی پورٹریٹ تصویر، نیز یا تو ایک آڈیو کلپ (mp3/wav) یا — ٹیکسٹ موڈ میں — وہ اسکرپٹ جسے آپ بولنا چاہتے ہیں اور بلٹ ان لائبریری سے منتخب کردہ آواز۔ بات کرنے والا اوتار ویڈیو بنانے کے لیے یہ کافی ہے۔

3

کیا میں اپنی آواز استعمال کر سکتا ہوں؟

جی ہاں اپنی خود کی آڈیو ریکارڈنگ اپ لوڈ کریں اور اس پر اوتار لپ سنک کرتا ہے۔ اگر آپ کے پاس ریکارڈنگ نہیں ہے تو ٹیکسٹ موڈ پر سوئچ کریں اور اس کے بجائے ٹیکسٹ ٹو اسپیچ لائبریری سے آواز کا انتخاب کریں۔

4

اوتار ویڈیو کتنی لمبی ہو سکتی ہے؟

فی نسل 35 سیکنڈ تک آڈیو۔ طویل اسکرپٹس کے لیے، انہیں متعدد کلپس میں تقسیم کریں۔ آپ کے ٹائپ کرتے وقت تخمینی مدت دکھائی جاتی ہے، اور آپ کو آڈیو کے دوسرے نمبر سے بل دیا جاتا ہے۔

5

میں کس چیز کے لیے AI اوتار استعمال کر سکتا ہوں؟

عام استعمال میں پروڈکٹ کی وضاحت کرنے والے اور اشتہارات، کورس اور آن بورڈنگ بیانیہ، سوشل ٹاکنگ ہیڈ کلپس، اعلانات، اور کسی پیغام کے کثیر لسانی ورژن شامل ہیں — جہاں کہیں بھی آپ کو پیش کنندہ کو فلم کرنے کی ضرورت ہوگی۔

6

کون سا ماڈل AI اوتار کو طاقت دیتا ہے؟

CreateVision AI بائٹ ڈانس کا اومنی ہیومن 1.5 استعمال کرتا ہے، جو آڈیو سے لپ سنک کے علاوہ ہیڈ موشن اور اشاروں کو چلاتا ہے۔ تکنیکی تفصیلات کے لیے OmniHuman 1.5 ماڈل صفحہ دیکھیں۔

7

AI اوتار ویڈیو جنریٹر میں کون سی تصویر سب سے بہتر کام کرتی ہے؟

اچھی روشنی میں سامنے سے لیا گیا پورٹریٹ، جس میں پورا چہرہ نظر آ رہا ہو اور فوکس میں ہو۔ دھوپ کے چشمے، چہرے پر گہرا سایہ، انتہائی زاویے، یا فریم میں بہت چھوٹا چہرہ — یہ سب لپ سنک کی درستگی کم کر دیتے ہیں۔

8

کیا مجھے اپنی آواز ریکارڈ کرنی ہوگی؟

نہیں۔ آپ اسکرپٹ ٹائپ کر کے بلٹ اِن لائبریری سے آواز منتخب کر سکتے ہیں، جس میں 10 زبانوں کی 60 آوازیں موجود ہیں۔ اگر آپ اپنی ریکارڈنگ استعمال کرنا چاہیں تو اسے اپ لوڈ کرنے کی سہولت بھی موجود ہے۔

9

کیا میں خود ویڈیو میں مرکزی کردار بن سکتا ہوں؟

جی ہاں، اور یہ سب سے عام استعمال ہے۔ اپنی تصویر اپلوڈ کریں، پھر یا تو اپنی آواز ریکارڈ کریں یا اسکرپٹ ٹائپ کریں اور لائبریری کی آواز منتخب کریں۔ نتیجہ آپ ہیں، آپ کے الفاظ بولتے ہوئے، کیمرہ سیٹ اپ کے بغیر۔ بہت سے تخلیق کار ایک اچھی تصویر رکھتے ہیں اور ہر ہفتے اس سے نئی کلپس بناتے ہیں۔

10

کیا میں AI بولتی تصویر تجارتی طور پر استعمال کر سکتا ہوں؟

ہاں۔ CreateVision AI کی Terms of Service کے تحت، آپ کی تیار کردہ مواد ذاتی اور تجارتی مقاصد کے لیے استعمال ہو سکتی ہے، جہاں مناسب ہو CreateVision AI کو attribution دیا جائے۔ آپ اس تصویر اور آواز کے حقوق رکھنے کے ذمہ دار ہیں جو آپ اپ لوڈ کرتے ہیں، اور اس پلیٹ فارم کے AI-disclosure قواعد کے بھی ذمہ دار ہیں جہاں آپ شائع کرتے ہیں۔

11

میں پہلے Sora کے ساتھ ویڈیوز میں خود کو ڈالتا تھا۔ کیا یہ بھی وہی چیز ہے؟

مقصد ایک ہے، طریقہ کار مختلف۔ یہاں آپ کی تصویر شناخت ہے اور آپ کا آڈیو یا اسکرپٹ بولی کو چلاتا ہے، اس لیے آؤٹ پٹ ایک talking-head clip ہوتی ہے جس میں lip sync ہوتا ہے، نہ کہ کوئی ایسا منظر جس میں آپ کو ڈال دیا گیا ہو۔ یہ کسی بھی ایک تصویر سے کام کرتا ہے، video enrollment کی ضرورت نہیں، اور کسی دوسری app کے دستیاب رہنے پر منحصر نہیں۔

اپنی پہلی AI بولتی تصویر بنائیں

تخلیق کرنا شروع کریں۔