Komplett guide til AI-bildegenerering: Midjourney, DALL-E 3, Stable Diffusion og Firefly sammenlignet med promptteknikker og prisoversikt.

Innhold i artikkelen (8)
  1. Hva er AI-bildegenerering?
  2. Midjourney — bransjestandarden for kunstnerisk kvalitet
  3. DALL-E 3 — OpenAIs brukervennlige løsning
  4. Stable Diffusion — ubegrenset frihet for teknisk kyndige
  5. Adobe Firefly og andre alternativer
  6. Direkte sammenligning av verktøyene
  7. Effektive promptteknikker
  8. Opphavsrett og etikk

Hva er AI-bildegenerering?

AI-bildegenerering bruker dyplæringsmodeller — primært diffusjonsmodeller og GAN-er — til å skape bilder fra tekstbeskrivelser (prompts). Du skriver "en norsk fjord ved solnedgang i oljemaleri-stil", og modellen genererer bildet fra grunnen av på sekunder.

Teknologien er basert på at modellen har lært sammenhenger mellom milliarder av bildetekst-par fra internett. Den "forstår" at fjorder er blå, at oljemaleri har visse teksturer, og kombinerer dette til et unikt bilde. Resultater i 2025 er så gode at de er vanskelige å skille fra profesjonelle fotografier og illustrasjoner.

AI-bildegenerering lar hvem som helst skape profesjonelle visuelle uttrykk fra en tekstbeskrivelse.
AI-bildegenerering lar hvem som helst skape profesjonelle visuelle uttrykk fra en tekstbeskrivelse.

Midjourney — bransjestandarden for kunstnerisk kvalitet

Midjourney v6.1 er konsekvent rated høyest for kunstnerisk bildekvalitet. Selskapet (Midjourney Inc., San Francisco) har en bevisst strategi om å prioritere estetikk og atmosfære fremfor fotorealisme alene. Resultatet er bilder med en karakteristisk "filmatisk" kvalitet.

Tilgang skjer via Midjourney-nettstedet (tidligere kun Discord). Basic plan (~110 kr/mnd) gir ~200 bilder per måned med Fast GPU-prioritet. Standard (~270 kr/mnd) gir ubegrenset Relax-modus og ~900 Fast-bilder månedlig.

  • Styrker: Overlegen kunstnerisk kvalitet, konsistent estetikk, aktiv brukerbase og inspirasjon
  • Svakheter: Ingen gratis prøveperiode lenger, svakt på nøyaktig tekst i bilder
  • Beste brukstilfelle: Markedsmateriell, konseptkjunst, bokillustrasjoner, moodboards
  • Prompt-tips: Legg til "--ar 16:9" for widescreen, "--style raw" for fotorealisme
Annonse

DALL-E 3 — OpenAIs brukervennlige løsning

DALL-E 3 er innebygd i ChatGPT Plus (~230 kr/mnd) og er markedets mest tilgjengelige løsning. Du kan beskrive bildet på norsk i naturlig språk — ingen spesiell prompt-syntaks nødvendig. ChatGPT hjelper til med å omformulere og forbedre prompten automatisk.

Bildekvaliteten er meget god, særlig for fotorealistiske motiver og illustrasjoner. DALL-E 3 er vesentlig bedre enn forgjengerne på å inkludere korrekt tekst i bilder, noe som er avgjørende for plakater og infografikk. API-tilgang koster $0,04–$0,08 per bilde avhengig av oppløsning.

Stable Diffusion — ubegrenset frihet for teknisk kyndige

Stable Diffusion fra Stability AI er åpen kildekode og kan kjøres gratis lokalt på en PC med NVIDIA GPU (minimum RTX 3060 med 12 GB VRAM anbefales). Med AUTOMATIC1111 eller ComfyUI som grensesnitt får du fullstendig kontroll: velg blant tusenvis av spesialtrente modeller (LoRA), juster sampler, steps og CFG-skala.

For web-basert tilgang finnes DreamStudio (Stability AIs offisielle tjeneste) og Civitai. Prisen er ~$10 for 1000 bilder. Den store fordelen utover pris er muligheten til å trene egne modeller og kjøre alt offline — viktig for sensitive forretningsmessige formål.

Adobe Firefly og andre alternativer

Adobe Firefly er trent eksklusivt på lisensiert og royaltyfritt innhold, noe som gjør det til det tryggeste valget for kommersiell bruk. Integrert direkte i Photoshop, Illustrator og Express. Generativ fylling og utvidelse av bilder er særlig kraftfullt for produktfotografering og reklame.

Andre nevneverdige alternativer: Leonardo.Ai (sterk på spillgrafikk og karakterdesign), Ideogram (best på tekst i bilder), og Canva AI (enklest for ikke-designere). For videoer begynner Runway, Sora (OpenAI) og Kling å levere imponerende resultater.

Annonse

Direkte sammenligning av verktøyene

Score (1–5) der 5 er best:

Effektive promptteknikker

En god prompt for AI-bildegenerering inneholder: (1) subjekt og handling, (2) omgivelser og kontekst, (3) stil og referanser, (4) tekniske parametere. Eksempel: "En norsk lakseoppdrettsanlegg i solnedgang, aerial drone-perspektiv, fotorealistisk, Sony A7R IV, 24mm linse, golden hour lighting, 8K".

Negative prompts (hva du ikke vil ha) er like viktig i Stable Diffusion: "blurry, watermark, extra fingers, distorted face, low quality". For Midjourney: bruk "--no" parameteren. Eksperimenter med kunstneriske referanser: "in the style of Edvard Munch" eller "cinematic lighting like Roger Deakins".

Opphavsrett og etikk

Opphavsrettsstatus for AI-genererte bilder er fortsatt uavklart i norsk lov per 2025. EU AI Act (gjeldende fra 2026) krever merking av AI-generert innhold. I mellomtiden: Adobe Firefly er tryggeste valg for kommersiell bruk. Midjourney og DALL-E har brukervilkår som i utgangspunktet gir deg rettigheter til bildene du skaper.

Etisk bruk: unngå å generere bilder av reelle personer uten samtykke, vær transparent med kunder om AI-bruk, og bidra ikke til å undergrave ekte fotografer og illustratørers levebrød ved prisdumping. Bransjeorganisasjoner som Grafill og NFFO arbeider med etiske retningslinjer.

Annonse

Emner

Olav Sie Rotvær
Skrevet avOlav Sie RotværSkribent og utvikler

Olav Sie Rotvær skriver og drifter Norsk Næring. Han er utvikler, ikke journalist, og har ingen fagutdanning innenfor teknologi & innovasjon. Artiklene bygger derfor på primærkilder som oppgis der påstanden gjøres.

Om forfatteren og hvordan artiklene kildebelegges →