AI pratende foto

Upload een portretfoto en een audiofragment (maximaal 35 seconden) en OmniHuman 1.5 genereert een sprekende avatarvideo met gesynchroniseerde lippen en natuurlijke bewegingen.

0 / 2,000
130 cr/s · ≤35s

Van één foto naar een pratende video

Eén portret plus een script wordt een levensechte woordvoerder – gesynchroniseerde lippen, expressies en gebaren. Geen camera, geen studio.

Originele afbeeldingOriginal portrait photo of a beauty creator holding a skincare product
Script

Hey everyone! I am so excited to share my new favorite foundation. It blends in seamlessly for a flawless, natural finish, and it actually feels lightweight all day. A little goes a long way, so one bottle lasts for months.

AI-avatarvideo

Verander één foto en een stem in een sprekende AI-avatar.

Een complete AI-avatargenerator (digitale mens): upload een portret en een audiofragment — of typ een script en kies een stem — en ontvang een levensechte sprekende video met gesynchroniseerde lippen, natuurlijke uitdrukkingen en gebaren. Mogelijk gemaakt door ByteDance OmniHuman 1.5, geen camera, acteur of studio nodig.

AI-videostill van een astronaut die door een gloeiende ruimteschipgang loopt

Een digitale woordvoerder, gebaseerd op één enkel portret.

Geen filmopnames, geen acteurs, geen green screen. Upload één duidelijke foto van een persoon en maak er een presentator van die je script voorleest. Creëer een herbruikbare digitale presentator voor productuitleg, cursusintroducties, aankondigingen en advertenties – en genereer op elk moment nieuwe tekst zonder opnieuw te hoeven filmen.

AI-videostill van regen die langs een caféraam loopt met warme bokeh

Er zijn twee manieren om mee te doen: audio uploaden of een script typen.

Heb je al een spraakopname? Upload deze en de avatar synchroniseert met de tekst. Geen audio? Schakel over naar de tekstmodus: typ wat de avatar moet zeggen, kies een stem uit de ingebouwde tekst-naar-spraakbibliotheek en het script wordt automatisch omgezet in de audio. De geschatte lengte en de kosten in credits worden weergegeven voordat je de animatie genereert.

AI-videostill van een danser-silhouet op een rokerig podium onder amberkleurig licht

Levensecht — niet zomaar een bewegende mond

OmniHuman 1.5 leest het ritme, de prosodie en de betekenis van de audio om hoofdbewegingen, houding en handgebaren aan te sturen, samen met nauwkeurige lipsynchronisatie, terwijl de identiteit en belichting van de persoon behouden blijven. Het resultaat is een presentatie die meer lijkt op die van een echte spreker dan op een statisch portret met een geanimeerde mond.

AI-videostill van noorderlicht dat boven een besneeuwde hut wervelt

Ontwikkeld voor marketing, training en sociale media.

Maak videofragmenten met woordvoerders voor advertenties en landingspagina's, gesproken lessen en onboarding voor trainingen, berichten met sprekende hoofden voor sociale media, of meertalige versies van dezelfde boodschap. Elke generatie wordt samen met de input opgeslagen in de geschiedenis, zodat je snel kunt itereren en variaties kunt produceren.

Portretten die klaar zijn voor AI pratende foto

Portretten in presentatorstijl, gegenereerd op CreateVision AI — elk ervan kan een pratende avatarvideo aandrijven zodra je audio toevoegt.

AI-avatar van een beauty-influencer die een huidverzorgingsserum presenteert.
AI-avatar van een techrecensent die een smartphone presenteert
AI-avatar van een lifestyle-creator met een koffiekopje.
AI-avatar van een sneakerrecensent die een schoen presenteert
AI-avatar van een modeontwerpster met een handtas
AI-avatar van een wellness-expert die supplementen presenteert.
AI-avatar van een schoonheidsspecialiste met een parfumflesje.
AI-avatar van een thuiskok met een keukengadget

Het model achter deze AI-avatarvideogenerator

OmniHuman 1.5 stuurt de lipsynchronisatie, mimiek en lichaamsbeweging op deze pagina aan.

Specificaties van de AI Avatar Video Generator

InvoerEén portretfoto plus een geüpload audiobestand of een getypt script.
Richtlijnen voor het portretRecht van voren, goed belicht, hele gezicht zichtbaar en scherp. Zonnebrillen en zware schaduw verlagen de nauwkeurigheid van de lipsync.
AudiolengteTot 35 seconden per generatie — ruwweg 85 gesproken woorden.
Stemmenbibliotheek60 ingebouwde stemmen in 10 talen, met previews voordat je genereert.
ModelOmniHuman 1.5, dat de lipsync, gezichtsuitdrukking en natuurlijke hoofd- en lichaamsbeweging aanstuurt.
KostenPer seconde output afgerekend, net als andere videogeneratie; zichtbaar voordat je genereert.
UitvoerEen clip om te downloaden, opgeslagen in je geschiedenis met het bronportret en het script erbij.

Hoe je AI pratende foto gebruikt

Eén portret, één stemspoor, één clip.

  1. 1

    Upload een portret

    Een scherpe foto recht van voren werkt het best. De AI-avatarvideogenerator leest het gezicht uit dit ene beeld.

  2. 2

    Voeg een stem toe

    Upload een audiobestand, of typ een script en kies uit de ingebouwde stembibliotheek. De audio mag tot 35 seconden duren.

  3. 3

    Genereer de avatarvideo

    Het model synchroniseert lippen, mimiek en natuurlijke hoofdbeweging met het geluid en levert een clip die je kunt downloaden of verlengen.

Hoe je een script schrijft voor de AI Avatar Video Generator

Hier is geen beeldprompt — het portret en de audio doen het werk. Wat jij schrijft is het script, en de keuzes in dat script bepalen of het resultaat er natuurlijk uitziet.

1

Openingszin

Begin met iets korts. In de eerste seconde valt de lipsync het meest op.

Hé — heel even.

2

Zinslengte

Houd zinnen onder de ongeveer 15 woorden. Lange bijzinnen leveren onnatuurlijke pauzes op.

Dit serum heeft twee ingrediënten. Dat is de hele formule.

3

Interpunctie

Komma's en punten worden ademhalingen. Zet ze waar je echt een pauze zou nemen.

Het werkt — en het kost tien seconden.

4

Lengtebudget

Ruwweg 2,5 woorden per seconde. Schrijf naar de cliplengte die je wilt.

~85 woorden voor een clip van 35 seconden

Vaag

Ons revolutionaire product benut baanbrekende technologie om ongeëvenaarde resultaten te leveren aan veeleisende klanten die streven naar excellentie.

Specifiek

Dit is het deel waar mensen altijd naar vragen. Twee ingrediënten, geen vulmiddel. Je ziet het verschil na ongeveer een week.

Waarom het werkt

De eerste is één zin van 19 woorden vol abstracties — de avatar spreekt hem uit in een vlakke, ademloze monotoon, omdat er nergens ruimte is om te pauzeren. De tweede bestaat uit drie korte zinnen met natuurlijke klemtoonpunten, en dat is wat de voordracht menselijk laat klinken.

Vaag

Hallo en welkom op ons kanaal, waar we het vandaag gaan hebben over de vijf belangrijkste dingen die je moet weten over huidverzorgingsroutines.

Specifiek

Vijf dingen over huidverzorging. Nummer één doet bijna iedereen fout.

Waarom het werkt

Lange, aaneengeregen openingen zijn waar de lipsync het meest afdrijft, omdat het model geen leestekens heeft om zich aan vast te houden. Een korte hook geeft het schone klemtoonpunten en houdt de aandacht beter vast.

Gewoontes die je beter kunt loslaten

  • Een portret gebruiken waarop het gezicht klein, schuin of deels in de schaduw staat. De nauwkeurigheid van de lipsync hangt direct samen met hoe duidelijk de mond zichtbaar is in het bronbeeld.
  • Voorbij de audiolimiet schrijven. De generatie stopt bij 35 seconden audio — een langer script wordt afgekapt, dus knip het op in segmenten en gebruik hetzelfde portret opnieuw.
  • Dichtopeengepakt vakjargon. Getallen, afkortingen en lange productnamen zijn precies waar een synthetische stem het meest synthetisch klinkt. Schrijf ze zoals je ze hardop zou zeggen.

Verder dan de AI-avatarvideogenerator

Pratende avatars zijn één uitkomst. Beeld- en videogeneratie draaien vanuit hetzelfde account.

Nuttige bronnen over AI-avatarvideo

AI-avatarvideogenerator: prijzen en gratis dagelijkse credits

Avatarvideo's worden per seconde afgerekend, net als andere video. Gratis accounts krijgen 80 credits per dag om het te proberen.

Gratis

$0

Perfect om mee te beginnen

  • 200 welkomstcredits, maximaal 80/dag
  • Z Image Turbo-schetsen voor 0 credits
  • Standaard generatiesnelheid
  • Generatiegeschiedenis inbegrepen
Aan de slag

Premium

Populairst
$29/month

Jaarlijks gefactureerd · $240/jaar

  • 8.000 credits/maand, geen daglimieten
  • Alle premium modellen — GPT Image 2, Nano Banana, Seedream, Seedance, Veo, Kling
  • 5x generatiesnelheid, voorrangswachtrij
  • AI-promptverbetering
Upgraden naar Premium

Ultimate

$49/month

Jaarlijks gefactureerd · $380/jaar

  • 18.000 credits/maand, geen daglimieten
  • HD-generatie tot 4K-resolutie
  • Prioriteitssupport
  • Snelste wachtrij en vroege toegang tot nieuwe modellen
Upgraden naar Ultimate

AI-avatarvideogenerator — veelgestelde vragen

1

Wat is een AI-avatar (digitale mens)?

Een AI-avatar is een gegenereerde sprekende video van een persoon, gemaakt op basis van één foto en een stem. In plaats van te filmen, lever je een portret en audio (of een script + stem) aan, en het model animeert een levensechte spreekprestatie – te gebruiken als digitale presentator, woordvoerder of verteller.

2

Wat heb ik nodig om er een te maken?

Een duidelijke portretfoto van voren, plus een audiofragment (mp3/wav) of – in tekstmodus – het script dat u wilt laten voorlezen en een stem uit de ingebouwde bibliotheek. Dat is voldoende om een sprekende avatarvideo te maken.

3

Mag ik mijn eigen stem gebruiken?

Ja. Upload je eigen audio-opname en de avatar synchroniseert de lippen ermee. Als je geen opname hebt, schakel dan over naar de tekstmodus en kies een stem uit de tekst-naar-spraakbibliotheek.

4

Hoe lang mag de avatarvideo zijn?

Maximaal 35 seconden audio per generatie. Voor langere scripts kunt u deze opsplitsen in meerdere fragmenten. De geschatte duur wordt weergegeven terwijl u typt en u wordt per seconde audio gefactureerd.

5

Waarvoor kan ik AI-avatars gebruiken?

Het wordt vaak gebruikt voor productuitleg en advertenties, gesproken tekst voor cursussen en introductieprogramma's, video's met een spreker op sociale media, aankondigingen en meertalige versies van berichten – eigenlijk overal waar je normaal gesproken een presentator zou moeten filmen.

6

Welk model vormt de basis van de AI-avatar?

CreateVision AI maakt gebruik van ByteDance's OmniHuman 1.5, dat lipsynchronisatie, hoofdbewegingen en gebaren aanstuurt op basis van audio. Zie de modelpagina van OmniHuman 1.5 voor de technische details.

7

Welke foto werkt het best in een AI-avatarvideogenerator?

Een goed belicht portret recht van voren waarop het hele gezicht zichtbaar en scherp is. Zonnebrillen, harde schaduwen over het gezicht, extreme hoeken of een heel klein gezicht in beeld verlagen allemaal de nauwkeurigheid van de lipsynchronisatie.

8

Moet ik mijn eigen stem opnemen?

Nee. Je kunt een script typen en een stem kiezen uit de ingebouwde bibliotheek, met 60 stemmen in 10 talen. Je eigen opname uploaden kan ook, als je die liever gebruikt.

9

Hoe lang mag een AI-avatarvideo zijn?

Tot 35 seconden audio per generatie. Voor langere presentaties genereer je meerdere segmenten en plak je ze aan elkaar — hetzelfde bronportret houdt de presentator consistent over de clips heen.

Maak je eerste sprekende AI-avatar.

Beginnen met creëren