Googles DeepMind-afdeling afslørede sin anden generation af Veo-videogenerationsmodel i mandags, som kan skabe klip op til to minutter i længden og ved opløsninger, der når 4K-kvalitet – det er seks gange længden og fire gange opløsningen af klip i 20 sekunder/1080p opløsning. Sora kan generere.
Det er selvfølgelig Veo 2’s teoretiske øvre grænser. Modellen er i øjeblikket kun tilgængelig på VideoFX, Googles eksperimentelle videogenereringsplatform, og dens klip er begrænset til otte sekunder og 720p opløsning. VideoFX er også på venteliste, så ikke hvem som helst kan logge på for at prøve Veo 2, selvom virksomheden meddelte, at den vil udvide adgangen i de kommende uger. En talsmand for Google bemærkede også, at Veo 2 vil blive gjort tilgængelig på Vertex AI-platformen, når virksomheden kan skalere modellens muligheder tilstrækkeligt.
Anbefalede videoer
“I løbet af de kommende måneder vil vi fortsætte med at iterere baseret på feedback fra brugere,” fortalte Eli Collins TechCrunch“og [we’ll] ser på at integrere Veo 2s opdaterede funktioner i overbevisende use cases på tværs af Googles økosystem … Vi forventer at dele flere opdateringer næste år.”
I dag annoncerer vi Veo 2: vores state-of-the-art videogenerationsmodel, som producerer realistiske klip af høj kvalitet fra tekst- eller billedprompter.
Vi udgiver også en forbedret version af vores tekst-til-billede-model, Imagen 3 – tilgængelig til brug i ImageFX gennem… pic.twitter.com/h6ejHaMUM4
— Google DeepMind (@GoogleDeepMind) 16. december 2024
Veo 2 har angiveligt en række fordele i forhold til sine forgængere, herunder en bedre forståelse af fysik (tænk bedre væskedynamik og bedre belysnings-/skyggeeffekter) samt kapaciteten til at generere “klarere” videoklip, idet genererede teksturer og billeder er skarpere og mindre tilbøjelig til at blive sløret ved bevægelse. Den nye model tilbyder også forbedrede kamerastyringer, der gør det muligt for brugeren at placere den virtuelle kameralinse med større præcision end før.
Som TechCrunch bemærker, har Veo 2 endnu ikke perfektioneret videogenereringsprocessen, selvom den ser ud til at hallucinere langt mindre end rivaler som Sora, Kling, Movie Gen eller Gen 3 Alpha. “Kohærens og konsekvens er områder for vækst,” sagde Collins. “Veo kan konsekvent overholde en prompt i et par minutter, men [it can’t] overholde komplekse anvisninger over lange horisonter. På samme måde kan karakterkonsistens være en udfordring. Der er også plads til at forbedre i at generere indviklede detaljer, hurtige og komplekse bevægelser og fortsætte med at skubbe grænserne for realisme.”
Google annoncerede også forbedringer til Imagen 3 i mandags, hvilket gør det muligt for den kommercielle billedgenereringsmodel at skabe “lysere, bedre sammensatte” output. Modellen, der er tilgængelig på ImageFX, vil også tilbyde yderligere beskrivende forslag baseret på nøgleord i brugerens prompt, hvor hvert søgeord afføder en rullemenu med relaterede termer.
Støt vores arbejde ❤️
Hvis du kunne lide denne artikel, kan du overveje at give drikkepenge for at hjælpe os med fortsat at udgive kvalitetsindhold.




















