Vuoto kahta viikkoa ennen lavaesitystä
Googlen Gemini-sovellukseen ilmestyi 2. toukokuuta merkkijono 'Start with an idea or try a template. Powered by Omni'. X-käyttäjä huomasi rivin sovelluksen videogenerointivälilehdessä, ja Google-vuotoja seuraava TestingCatalog vahvisti löydön. Pian sen jälkeen Reddit-käyttäjä jakoi varhaisen pääsyn Omniksi nimettyyn malliin ja julkaisi siitä demovideoita.
Ajoitus on yhtiölle hankala. Google I/O 2026 alkaa tiistaina 19. toukokuuta ja jatkuu seuraavana päivänä. Pääpuheenvuoro lähetetään klo 20 Suomen aikaa, ja Gemini-päivitykset on listattu agendan keskiöön.
Mitä Omni voisi olla
Vuodon perusteella on kolme uskottavaa tulkintaa. Ensimmäinen: Omni on pelkkä uusi tuotemerkki olemassa olevalle Veo-pohjalle. Toinen: Omni on Geminin pohjalta koulutettu erillinen videomalli, joka kulkee Veon rinnalla. Kolmas: Omni on yhtenäinen malli, joka käsittelee sekä kuvan että videon samassa järjestelmässä.
Sovelluksen metadatassa Omni näkyy Veon laajennoksena, mikä viittaa kolmanteen tulkintaan. Yhtenäinen malli olisi linjassa toimialan suuntauksen kanssa: yksi arkkitehtuuri, joka käsittelee kaikki modaaliteetit. OpenAI:n GPT-perhe ja Anthropicin Claude ovat liikkuneet samaan suuntaan tekstin, kuvan ja äänen yhdistämisessä.
Demoissa loistoa ja kömmähdyksiä
Reddit-käyttäjän jakamissa videoissa Omni näytti vahvuutensa matemaattisessa todistuksessa. Malli säilytti logiikan tarkkuuden pidemmälle kuin aiemmat videomallit, mikä on ollut alan perinteinen kompastuskivi. Realistisuus oli silminnähden askel Veon nykyversiota edellä.
Kömpelyyttä riitti silti. Monimutkaisemmassa illalliskohtauksessa esineitä ilmestyi tyhjästä ilmaan, ja liitu katosi kesken matemaattista esitystä. Puremaliikkeet eivät vastanneet ruoan rakennetta. Yhden objektin fysiikka onnistuu, mutta kun kohtauksessa on monta toimijaa, malli sekoaa.
Käyttörajoituksista paljastui kova luku. Kahden videon generointi kulutti 86 prosenttia käyttäjän Google AI Pro -tilauksen päivärajasta. Lukua Googlen on venytettävä reilusti ennen kuin Omni siirtyy laajempaan jakeluun.
Videomallien asetelma toukokuussa 2026
OpenAI Sora 2: yksittäiset klipit jopa 20 sekuntia, ilman ääntä. Vahvuus motorisessa koherenssissa.
Google Veo 3: kahdeksan sekuntia, mutta synkronoitu puhe, ympäristöäänet ja musiikki samalla ajolla.
Gemini Omni: kesto ja ääniominaisuudet vahvistamatta. Metadatan mukaan rakentuu Veon päälle.



