Koneoppiminen

Nano Banana 2 tekee kuvan neljässä sekunnissa

Googlen uudet Gemini-mallit muuntavat kuvan videoksi ja painavat hinnan sentteihin.

Nelli NelisanomaNelli Nelisanoma
Jaa:
Nano Banana 2 tekee kuvan neljässä sekunnissa
Kuva: The Pancake of Heaven! / CC BY-SA 4.0

Google laski kuvageneroinnin hinnan sentteihin

Google julkaisi kaksi uutta kuvamallia, jotka vievät generatiivisen kuvituksen uuteen hintaluokkaan. Gemini 3.1 Flash Image, jota kehittäjäyhteisö kutsuu lempinimellä Nano Banana 2, tuottaa valmiin kuvan noin neljässä sekunnissa. Rinnalle tuli Omni Flash, joka muuntaa yksittäisen kuvan videoksi ja antaa muokata tulosta keskustelemalla mallin kanssa.

Kevyimmän version hinta on muutamia senttejä kuvalta. Se on tuntuva pudotus siihen, mitä laadukas tekoälykuva on tähän asti maksanut, ja se muuttaa laskelmia kaikilla, jotka tuottavat kuvitusta volyymilla.

Kuvasta videoksi, editointi keskustelemalla

Omni Flashin idea on, että käyttäjän ei tarvitse osata rakentaa monimutkaisia kehotteita. Kuvaa muokataan sanomalla, mitä pitäisi muuttaa: tummenna taivas, vaihda tuotteen väri, siirrä henkilö vasemmalle. Malli pitää kirjaa aiemmista muokkauksista, joten kuvaa voi hioa vaihe vaiheelta kuin oikean suunnittelijan kanssa.

Samalla malli venyttää still-kuvan lyhyeksi videoksi. Yhdestä tuotekuvasta syntyy siis sekunneissa pyörivä esittely tai somekelaan sopiva pätkä ilman erillistä videotuotantoa. Nopeuden ja hinnan yhdistelmä on se, mikä tekee julkaisusta merkittävän: kyse ei ole vain paremmasta laadusta vaan siitä, että tuottaminen käy lähes ilmaiseksi.

Ytimessä

Gemini 3.1 Flash Image (Nano Banana 2) tekee kuvan noin neljässä sekunnissa muutaman sentin hinnalla. Omni Flash muuntaa kuvan videoksi ja sallii keskustelevan editoinnin. Käytännössä kuvituksen tuotantokustannus lähestyy nollaa.

Mitä kustannusromahdus tarkoittaa

Kun yksittäisen kuvan hinta putoaa sentteihin, muuttuu se, mitä kannattaa tehdä. Markkinoinnissa voi kokeilla kymmeniä versioita samasta mainoksesta eri kohderyhmille, tehdä paikallistetut kuvat jokaiselle markkinalle ja vaihtaa visuaalit viikoittain sen sijaan, että sama kuvasarja pyörii kuukausia. Aiemmin tämä kaatui budjettiin, nyt lähinnä aikaan.

Pullonkaula siirtyy tuotannosta ideointiin ja valintaan. Kun kuka tahansa saa aikaan siistin kuvan sekunneissa, arvo ei ole enää siinä että osaa tehdä kuvan, vaan siinä että tietää minkä kuvan kannattaa tehdä. Se nostaa hyvän briefin ja terävän maun arvoa suhteessa tekniseen toteutukseen.

Kilpailu kiristyy

Kuvamalleissa Google haastaa OpenAI:n kuvatyökalut, Adobe Fireflyn, Midjourneyn ja Black Forest Labsin Flux-mallit. Kilpailijat ovat panostaneet laatuun ja tyyliin, mutta Googlen valtti on yhdistelmä: nopeus, sentin hintaluokka ja se, että työkalut ovat suoraan osa Gemini-ympäristöä. Kun kuvan, videon ja editoinnin saa saman mallin kautta, kynnys kokeilla madaltuu.

Hintakilpailu painaa koko alaa. Jos markkinajohtaja tarjoaa kuvia sentteinä, muidenkin on seurattava. Se on hyvä uutinen käyttäjälle ja kova paikka niille, joiden liiketoiminta on nojannut kuvatuotannon hintaan.

Googlen kaksi uutta kuvamallia

Gemini 3.1 Flash Image (Nano Banana 2)

Nopea kuvageneraattori

Kuvan luontiaika
noin 4 sekuntia
Hinta
muutama sentti / kuva
Käyttötapa
still-kuvien generointi

Omni Flash

Kuvasta videoksi

Toiminto
kuva → lyhyt video
Editointi
keskustelemalla
Muistaa muokkaukset
kyllä

Google Blog

Sanasto

Generatiivinen tekoäly
Tekoäly, joka luo uutta sisältöä kuten kuvia, tekstiä tai videota sen sijaan, että vain analysoisi valmista aineistoa.

Suomalaiselle sisällöntuottajalle

Suomalaisille mainostoimistoille ja sisällöntuottajille tämä tarkoittaa, että pieni tiimi voi tuottaa saman visuaalisen määrän kuin aiemmin iso. Yhden hengen toiminimi saa aikaan kampanjan kuvituksen, tuotevideot ja somesisällöt ilman kuvauskalustoa tai kuvapankkitilausta. Se avaa oven pienille toimijoille ja kiristää tahtia isoilla.

Kääntöpuoli koskee ammattikuvaajia, kuvittajia ja kuvapankkeja, joiden työstä osa siirtyy mallin tehtäväksi. Työ ei katoa, mutta se muuttuu: kysyntä siirtyy rutiinikuvituksesta niihin tehtäviin, joissa tarvitaan aitoa näkemystä, oikeaa henkilöä kuvassa tai brändille rakennettua tunnistettavaa tyyliä.

Kun kaikilla on samat työkalut ja sama sentin hinta, tekninen tuotantoetu katoaa. Erottautuminen tulee ideasta ja äänensävystä, ei siitä kuka ehtii tehdä eniten kuvia. Halvasta ja nopeasta seuraa myös samankaltaisuuden riski: jos jokainen syöttää samat kehotteet, verkko täyttyy toistensa näköisistä kuvista. Silloin harkittu, tunnistettava jälki on arvokkaampi kuin koskaan.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  2. 2Datakeskus söisi Lapinlahdella kokonaisen kaupungin sähköt
  3. 3Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  4. 420 vuotta koodaamatta, sitten 5,4 miljoonaa
  5. 5Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.