Nano Banana Pro vs Nano Banana 2: samme prompt, ni billeder, tre reelle forskelle

Nano Banana Pro vs Nano Banana 2: samme prompt, ni billeder, tre reelle forskelle

IndsigterUdgivet på

Nano Banana Pro sammenlignet med Nano Banana 2

Der er ingen mangel på sammenligninger af disse to AI-billedmodeller. Problemet er, at de fleste bare lægger billeder op uden at oplyse betingelserne. Anden prompt, andet format, sommetider endda anden opløsning — og så en dom. Med en konklusion som den kan man ingenting.

Så jeg låste alle variabler: samme prompt, samme format, samme opløsning, kun modellen skifter. Tre scenarier plus et sideeksperiment, ni generationer i alt. Herunder står, hvad der kom ud af det, inklusive de steder hvor begge modeller faldt igennem.

Hvorfor lige netop de to bliver sammenlignet

I modellisten i AI-billedgeneratoren står de side om side, og deres parameterpaneler ligner hinanden næsten træk for træk: prompt, format, opløsning, referencebilleder, 1k / 2k / 4k, ti formater hver. Det første, folk antager, er at Pro simpelthen er den dyre.

Det er ikke to niveauer af samme model. Det ene navn bærer en udgave, det andet et generationsnummer, og de forskelle der betyder noget, ligger ikke i hvem der ser skarpest ud. Kør dem side om side, og du opdager at de to læser samme sætning forskelligt.

Først betingelserne

Alle tre prompts blev skrevet på engelsk i én omgang og ikke rettet bagefter. To billeder per runde, identiske parametre bortset fra modellen:

  • Runderne med fyldt scene og tekst: 16:9, 2k
  • Karakterrunden: 1:1, 2k, samme referencebillede til begge modeller
  • Nano Banana 2 på standard tænkeniveau (undtagen i sideeksperimentet)

Referencebilledet til karakterrunden er et separat genereret castingfoto: grå baggrund, ensartet frontlys, ingen makeup, kamera i øjenhøjde. Et rent udgangsbillede er en forudsætning for at teste karakterkonsistens — med en travl baggrund eller retningsbestemt lys kan du ikke længere afgøre, om modellen drev væk, eller om referencen bare bar for meget støj.

Vil du ikke sende dem af sted én ad gangen, er den slags sammenstillinger nemmere på det generative lærred: forgren én prompt til to knuder og lad resultaterne stå ved siden af hinanden.

Runde 1: en fyldt scene

Prompten beskrev en morgenmadsbod tidligt om morgenen: seks retter, en sælger i hvidt forklæde der rækker en papirspose frem, folk i kø bagved, en stak bambusdampere til venstre, en cykel op ad muren til højre, hængende glødepærer, morgendis. Med vilje meget at holde styr på.

Gadebod genereret af Nano Banana Pro

Nano Banana Pro leverede noget der læses som fotografi. Gennemgående kølig grå, ren dybde, dis og lys der passer sammen, og de fleste af de ønskede elementer er der. Men læsningen af scenen er tilbageholdende: på disken står nogle stålfade, og om det er seks retter eller fire kan man ikke sige. Der er ikke et skilt nogen steder.

Gadebod genereret af Nano Banana 2

Nano Banana 2 gjorde det modsatte og stoppede billedet fuldt: friturestegte dejstænger, dampede boller, dumplings, pandekager, nudler, tofu — seks og flere, tællelige på et øjeblik. På muren hænger et skilt med stedets navn, to mere er synlige længere ned ad gaden, og nogen har klistret en QR-kode til betaling på dørkarmen. Ingen af de ting stod i prompten. Modellen tilføjede dem selv.

På "seks forskellige retter" ligger det andet billede tættere på det jeg bad om. På atmosfære foretrækker jeg det første. Jeg kårer ikke en vinder her, for svaret afhænger af om du vil have stemning eller informationstæthed.

Begge knækkede på samme sted: hænderne. Hos Nano Banana Pro har sælgerens venstre hånd over gryden sammenvoksede fingre. Hos Nano Banana 2 bliver stedet, hvor de to hænder overdrager posen, en udtværing. Fysisk samspil mellem mennesker er stadig den mest skrøbelige del af billedet, og ingen af dem har løst det.

Runde 2: at holde samme ansigt

Denne runde ændrer præcis én ting: sæt personen fra castingfotoet på en gade i skumringen, tilføj varmt sidelys fra lav vinkel, gør skiltene bag hende uskarpe. Prompten bad udtrykkeligt om samme person, samme vinkel, samme beskæring.

Karakterkonsistens: reference, Nano Banana Pro, Nano Banana 2

Reference til venstre, Nano Banana Pro i midten, Nano Banana 2 til højre.

Nano Banana Pro flyttede hende stort set urørt. Brynform, afstand mellem øjnene, næseryggens bredde, læbelinjen, hårgrænsen — selv de løse hårstrå og den sorte top overlevede. Det læses som samme person fotograferet en anden dag.

Nano Banana 2-udgaven er genkendelig som "en der ligner hende", men hun er ændret: bredere ansigt, mere kantet kæbe, grovere hud, flere år ældre, hår der ligger tættere til hovedet. Alene ser det ikke forkert ud. Ved siden af referencen gør det tydeligvis.

Laver du noget hvor én karakter skal vende tilbage fra billede til billede — storyboard, billedbog, plakatserie — så vælger dette ene hul modellen for dig.

Men giv ikke Pro pokalen endnu: prompten bad om samme beskæring, og begge modeller rykkede kameraet nærmere af sig selv. Referencen er et brystbillede, de to resultater kom tilbage som tætte nærbilleder. Ingen af dem lyttede.

Runde 3: tekst inde i billedet

Det var runden hvor jeg ventede kaos. Prompten bad om en håndskrevet cafétavle med præcis OPEN TODAY 7AM - 4PM og nedenunder, mindre, FLAT WHITE 4.50.

Cafétavle genereret af Nano Banana Pro

Nano Banana Pro fik alle tre linjer rigtigt, og kridtstrøget virker troværdigt. Prisen skrev den som 4·50 med punkt i midten, hvilket er en normal måde at skrive en pris i hånden på en tavle — det tæller jeg ikke som fejl.

Cafétavle genereret af Nano Banana 2

Nano Banana 2 fik også alle de ønskede linjer rigtigt, tilføjede så et kaffekop-ikon og en dekorativ krusedulle som ingen havde bedt om — og knækkede på det ene sted hvor den slet ikke skulle skrive noget. Navnet på markisen burde være THE DAILY GRIND; det første ord faldt sammen til noget ulæseligt.

Mønsteret holdt gennem alle tre runder: tekst du udtrykkeligt beder om kommer i dag korrekt ud af begge modeller; fejlene sidder altid i den tekst modellen selv har lagt til. Samme historie i gadescenen: skiltene Nano Banana 2 opdigtede er læsbare, mens den lille prisliste den også opdigtede er det pure volapyk. Skal bogstaverne være til at regne med, så skriv de præcise ord i prompten og lad modellen få så lidt plads til at improvisere som muligt.

En fodnote: af fem resultater fra Nano Banana 2 kom ét tilbage med en hvid kant langs alle fire sider, som måtte beskæres væk. Det skete én gang, så jeg kalder det ikke en defekt — men det er et blik værd, når du genererer i serie.

Hvad Nano Banana 2's "tænkeniveau" egentlig gør

Her adskiller panelerne sig for alvor. Nano Banana 2 har to kontakter mere: billedsøgning og et tænkeniveau der kan sættes til minimal, standard eller høj. Nano Banana Pro tilbyder kun websøgning.

Jeg tog gadebod-prompten og kørte alle tre niveauer én gang hver.

Nano Banana 2's tænkeniveauer: minimal, standard, høj

Fra venstre mod højre: minimal, standard, høj. Kerneelementerne overlever i alle tre — sælger, papirspose, kø, dampere, cykel, intet tabt. Ændringen ligger andetsteds: jo højere niveau, jo mindre tekst opdigter modellen, og jo mere af den er korrekt. Minimal er den mest larmende, med flere plakater hvis småtryk er grød. Høj beholdt kun et lodret skilt og et par rene, læsbare prisskilte, og kompositionen faldt synligt til ro.

Den opfører sig altså mindre som et kvalitetstrin og mere som en knop for hvor omhyggelig modellen er. Prisen er tid: høj tog omkring hundrede sekunder her mod godt tres for standard, næsten halvdelen mere. Én observation, ventetid inkluderet — ikke en benchmark, men retningen er klar.

Hvilken skal man vælge

Efter ni billeder er mine konklusioner mere konkrete end da jeg begyndte:

Skal én karakter vende tilbage, brug Nano Banana Pro. Hullet i konsistensrunden er ikke et spørgsmål om smag, men om resultatet kan bruges.

Vil du have en tæt scene der selv lader detaljerne vokse, brug Nano Banana 2. Dens fantasi om omgivelser er livligere, og skilte, klistermærker og redskaber du aldrig nævnte fylder sig selv ud — praktisk til baggrunde og stemningsbilleder.

Skal billedet have præcis tekst, kan begge bruges, men nagl ordene fast i prompten. Regn ikke med det modellen skriver af egen drift.

Er du i tvivl, så lav prototyper på Nano Banana 2. Den koster lidt mindre per billede og er hurtigere på standard, hvilket passer til at finde prompten; når retningen ligger fast og ansigtet skal holde, så skift til Nano Banana Pro til den endelige version.

Vil du ændre et område i stedet for at tegne alt om, er ingen af dem førstevalget. Brug i stedet AI-billededitoren: du maler området, ændrer kun det og kaster ikke terningerne om hele billedet igen.

En sidste ærlig bemærkning: hver runde kørte kun én gang, uden gentagne stikprøver, og et andet seed kan vende en enkelt iagttagelse. Skal du beslutte dig for et rigtigt projekt, tag dine egne prompts, lås variablerne på samme måde og kør hver af dem et par gange. Vil du springe opsætningen over, er de færdigindstillede konfigurationer i skabelonbiblioteket et fornuftigt udgangspunkt.

Del