Googles DeepMind-avdelning presenterade sin andra generationens Veo-videogenereringsmodell på måndagen, som kan skapa klipp upp till två minuter långa och med upplösningar som når 4K-kvalitet – det är sex gånger så lång och fyra gånger upplösningen av klippen med 20 sekunder/1080p upplösning. Sora kan generera.
Det är naturligtvis Veo 2:s teoretiska övre gränser. Modellen är för närvarande endast tillgänglig på VideoFX, Googles experimentella videogenereringsplattform, och dess klipp är begränsade till åtta sekunder och 720p-upplösning. VideoFX är också väntelista, så inte vem som helst kan logga in för att prova Veo 2, även om företaget meddelade att det kommer att utöka åtkomsten under de kommande veckorna. En talesperson för Google noterade också att Veo 2 kommer att göras tillgänglig på Vertex AI-plattformen när företaget kan skala modellens kapacitet tillräckligt.
Rekommenderade videor
”Under de kommande månaderna kommer vi att fortsätta att iterera baserat på feedback från användare,” berättade Eli Collins TechCrunch”och [we’ll] se till att integrera Veo 2:s uppdaterade funktioner i övertygande användningsfall över hela Googles ekosystem … Vi förväntar oss att dela med oss av fler uppdateringar nästa år.”
Idag tillkännager vi Veo 2: vår toppmoderna videogenereringsmodell som producerar realistiska klipp av hög kvalitet från text- eller bilduppmaningar.
Vi släpper också en förbättrad version av vår text-till-bild-modell, Imagen 3 – tillgänglig att använda i ImageFX genom… pic.twitter.com/h6ejHaMUM4
— Google DeepMind (@GoogleDeepMind) 16 december 2024
Veo 2 har enligt uppgift ett antal fördelar jämfört med sina föregångare, inklusive en bättre förståelse av fysik (tänk bättre vätskedynamik och bättre belysnings-/skuggeffekter) samt förmågan att generera ”tydligare” videoklipp, genom att genererade texturer och bilder är skarpare och mindre benägen att bli sudd vid rörelse. Den nya modellen erbjuder också förbättrade kamerakontroller, vilket gör att användaren kan placera den virtuella kameralinsen med större precision än tidigare.
Som TechCrunch noterar har Veo 2 ännu inte fulländat videogenereringsprocessen, även om den verkar hallucinera mycket mindre än rivaler som Sora, Kling, Movie Gen eller Gen 3 Alpha. ”Koherens och konsekvens är områden för tillväxt,” sa Collins. ”Veo kan konsekvent följa en uppmaning i ett par minuter, men [it can’t] följa komplexa uppmaningar över långa horisonter. På samma sätt kan karaktärskonsistens vara en utmaning. Det finns också utrymme att förbättra när det gäller att generera intrikata detaljer, snabba och komplexa rörelser och fortsätta att tänja på realismens gränser.”
Google tillkännagav också förbättringar av Imagen 3 på måndagen, vilket gör det möjligt för den kommersiella bildgenereringsmodellen att skapa ”ljusare, bättre sammansatta” utgångar. Modellen, tillgänglig på ImageFX, kommer också att erbjuda ytterligare beskrivande förslag baserat på nyckelord i användarens prompt, med varje nyckelord som skapar en rullgardinsmeny med relaterade termer.
Stöd vårt arbete ❤️
Om du gillade den här artikeln, överväg att lämna dricks för att hjälpa oss fortsätta publicera bra innehåll.



















