Imagen 3 vs Midjourney v7 er den head-to-head, AI Vidia kører, hver gang et DTC-brand vil have nøjagtig produktfotografi i paid social-volumen. AI Vidia er et dansk AI-content-produktionsstudie, der leverer kampagne-klare billeder, videoer og avatarer til brandteams. Det korte svar: Imagen 3 vinder produktions-briefs, fordi den accepterer et referencebillede gennem Vertex AI og holder samme SKU på tværs af hero, lifestyle og detail. Midjourney v7 vinder kreative priser, fordi dens æstetiske range er bredere, men uden ekstern conditioning driver selve produktet fra render til render. På 864 test-renders scorede Imagen 3 4,6 ud af 5 på SKU-konsistens. Midjourney v7 scorede 3,2.
Hvorfor reference-image-fidelity er en omsætningshåndtag
Et DTC-brand på Meta skal bruge 30 til 50 ugentlige konverteringsevents pr. ad set for at forlade learning-fasen. Den grænse betyder mindst 12 friske kreative varianter om ugen pr. prospecting-kampagne. Produktet i de varianter skal ligne produktet på lageret hver gang. Hvis håndtagsformen, glasurfarven eller label-typografien driver, bruger brandet mediebudget på kreativ, der misrepræsenterer SKU'en. Reference-image-conditioning er det, der stopper den drift. AI Vidia målte et fald på markant i produktionsomkostninger for IndianBites på 90 dage, med 2,4x ROAS på vindende cohorts og 142 AI-annoncer leveret på 11 uger. Den billed-model, der kan genbruge ét hero-foto som conditioning-input, er den model, der leverer disse tal uden en art director på hver eneste render.
De fleste marketing-leads undervurderer prisen på inkonsistens. Et nordisk ecommerce-brand, AI Vidia-teamet arbejdede med, leverede 210 assets om måneden til 320 DKK pr. asset. Samme brand havde tidligere betalt fotodagspriser pr. asset for en lille månedlig batch. Omkostningsreduktionen var reel. Det 28% ROAS-løft på 90 dage var større. Begge tal afhang af, at renders lignede produkterne på hylden. En model, der ikke kan ankre til et referencebillede, kan ikke levere det arbejde uden manuel retouchering, hvilket sletter både omkostnings-vindet og hastigheds-vindet i samme bevægelse. Wyzowl 2025 rapporterer, at 30% af virksomheder peger på produktionsomkostninger som den største barriere for video- og billed-marketing. Den barriere er i høj grad en reference-fidelity-barriere, ikke en generations-barriere.
Imagen 3 vs Midjourney v7 på syv ecommerce-kriterier
AI Vidia-teamet scorede begge modeller på syv dimensioner efter at have kørt et låst 12-varianters brief gennem hver pipeline for seks AI Vidia-brands i Q1 2026. Hvert brand leverede fem til femten hero-SKU'er med referencefotografi, brand-palette-tokens og én godkendt baggrundsstil. Hver model renderede 144 billeder pr. brand, i alt matched production batches pr. model i forsøget. Scoringen målte SKU-konsistens, pris pr. billede, batch-hastighed og prompt-token-reproducerbarhed.
| Kriterium | Imagen 3 (Vertex AI) | Midjourney v7 | Dom |
|---|---|---|---|
| Reference-image-conditioning | Native via Vertex AI image-to-image og style references | Ingen first-party-conditioning. Style refs driver mellem sessioner | Imagen 3 |
| SKU-konsistens på 20 renders | 4,6 ud af 5. Samme håndtag, farve, label holder | 3,2 ud af 5. Farve og geometri driver efter 8 renders | Imagen 3 |
| Æstetisk range og stemning | Fotografisk, let bogstavelig. Kræver detaljerede prompts | Editorial, maleri-agtig. Vinder de første tre koncept-renders | Midjourney |
| Pris pr. 1024px-billede | Cirka EUR 0,04 på Vertex AI standard | Cirka EUR 0,07 amortiseret på Pro-plan | Imagen 3 |
| Batch-hastighed, warm pool | 5 til 8 sekunder pr. billede | 40 til 60 sekunder i fast mode | Imagen 3 |
| Tekst på emballage ved 1024px | Læsbar på labels, skarp ved 2048 | Læselig i hero, blød i brødtekst | Imagen 3 |
| Licens til paid media | Kommerciel brug under Google Cloud-vilkår | Kommerciel brug på Pro-plan | Uafgjort |
Imagen 3 vandt seks ud af syv kriterier på produktfotografi til ecommerce. Det største udsving var reference-image-conditioning. Da et beauty-brand i forsøget fodrede et enkelt hero-shot af en flaske ind i Imagen 3 via Vertex AI, holdt flasken sin form, label og pumpe-geometri på 28 ud af 30 renders. Samme prompt i Midjourney v7 med en style reference driftede på hætteform efter den ottende render og på label-typografi på alle renders, der ikke var hero. Æstetisk-range-rækken er den ene række, Midjourney stadig ejer. Til sæson-mood-boards og editorial kampagne-frames leverer Midjourney v7 en brugbar første koncept hurtigere end nogen anden model i AI Vidia-stacken. Produktion tilhører Imagen 3. Discovery tilhører stadig Midjourney.
3-Shot Product Consistency Test
AI Vidia-teamet bruger denne strategiske test til at afgøre, om Imagen 3 eller Midjourney v7 skal eje et brands katalog-arbejde. Testen er den samme for hvert brand. Resultatet er en scoret matrix, køberen godkender på 14 arbejdsdage. Hver AI Vidia Pilot Sprint inkluderer denne test.
- Vælg reference-SKU'en. Vælg ét produkt, der bærer de næste 90 dages mediebudget. Træk det eksisterende hero-foto, brand-palette-tokens og det godkendte emballage-shot. Reference-SKU'en er ankeret. Begge modeller renderer mod præcis denne reference. Testen kører ikke på hypotetiske produkter eller stock-billeder.
- Render hero-shottet. Generér tolv renders af SKU'en som hero-asset, én pr. model, mod en ren studie-baggrund, der matcher brandet. Scor hver render på farve-nøjagtighed, geometri-match og label-læsbarhed. Imagen 3 scorer typisk 4,5 eller højere på hero-renderet. Midjourney v7 lander mellem 3,0 og 3,6 uden ekstern conditioning.
- Render lifestyle-konteksten. Generér tolv renders af samme SKU placeret i en virkelig brugs-scene: køkkenbord, badeværelse, sportstaske, butikshylde. Produktet skal forblive produktet. Scor hver render på, om SKU'en stadig matcher referencen. Imagen 3 holder typisk på alle tolv. Midjourney v7 begynder at drifte omkring render otte.
- Render detail-close-uppen. Generér tolv renders zoomet til den tekstur, label eller finish, der definerer SKU'en. Det er her, tekst-render og materiale-nøjagtighed afgør modellen. Imagen 3 holder stram typografi ved 2048 pixels. Midjourney v7 blødgør teksten og blødgør teksturen.
- Aggregér og commit. Den model, der scorer højest i gennemsnit på tværs af hero, lifestyle og detail-renders, bliver standard-renderer for kataloget de næste 12 uger. Den tabende model bliver i stacken til konceptarbejde, aldrig til katalog-batches. Resultatet af testen er én PDF: scoret matrix, render-samples og lock-in-beslutningen.
