Arbetsprovet: huvudbilden till Formarkivet
- Ingångsläge. Uppdragsrutan på guideöversikten och kravet på en vertikal film med plats för information som läggs på efteråt.
- Lärmål. Efter provet kan du dela en bildbeställning i fyra kontrollerbara lager och visa vilken ändring som gav resultatet.
- Det som ändras. Motiv, komposition, ljus och material samt stil — exakt ett lager mellan två försök.
- Leverans. En huvudbild utan inbyggd text och en ordagrant nedskriven stilsvans — den fasta avslutande stilraden — som kan återanvändas i tre klipp.
- Genomförandetid. Cirka 45–75 minuter, utöver eventuell kötid för bildgenereringen.
- Godkänt när. Motivet håller i vertikal beskärning, har lugn yta för rubrik och går att återskapa som en andra bild i samma serie.
En bild du inte kan göra om är ett lyckokast, inte ett resultat. Beställ i fyra lager — motiv, komposition, ljus och material, stil — ändra ett lager i taget och skriv ner den stilsvans som ska vara identisk genom hela serien. Då kan du producera bild nummer två, och någon annan kan producera bild nummer tre.
Vad modellen faktiskt gör
En bildmodell målar inte efter din outtalade avsikt. Den producerar en bild utifrån de styrsignaler som text, referenser och inställningar ger. Därför kan du inte utgå från att just din kanna blir viktigast, att texten får plats i högerkanten eller att antalet stämmer om du inte både beställer och kontrollerar det.
Tre verifieringsregler att arbeta efter. Räkna. Ett angivet antal kan avvika, särskilt vid många föremål — jämför resultatet med beställningen. Läs tecken för tecken. Korrekt text kan förekomma, men varje bokstav, siffra och logotypfragment ska kontrolleras i full storlek och sättas som riktig text i efterhand när innehållet måste vara korrekt. Prova vaga stilord. Om ”minimalistisk” och ”tre emaljerade kannor” konkurrerar visar ett A/B-prov utan stilordet om det var det som trängde undan motivkravet.
Därför är den praktiska frågan inte hur du skriver en vacker prompt, utan hur du skriver en prompt som går att felsöka.
Beställningen i fyra lager
Dela beskrivningen i fyra delar som var för sig går att ändra. Ordningen spelar roll: det konkreta först, det vaga sist.
MOTIV: Tre materialprover på en låg utställningssockel:
vikt mässingsplåt, sprucken gips och fransat linne;
mässingen närmast kameran
KOMPOSITION: Vertikal halvbild, kameran strax ovanför sockeln,
föremålen i nedre halvan, övre tredjedelen lugn och tom
LJUS OCH MATERIAL: Mjukt jämnt sidoljus från vänster, neutral temperatur;
matt gips, borstad mässing, grovt linne
STIL: Dokumentärt utställningsfoto, dämpad grå och vinröd palett
FORMAT: 9:16
INTE MED: Läsbar text, bokstäver, logotyper eller personer
— använd bara raden om verktyget stöder negativa instruktionerDet som inte ska synas hålls utanför motivlagret. Om verktyget stöder en negativ lista kan den stå sist, som i mallen. Om det inte gör det beskriver du i stället det önskade tillståndet positivt: ”övre tredjedelen är en ren, omönstrad vägg” fungerar bättre än att upprepa allt som inte får finnas där.
Serien: det som gör att bilderna hör ihop
En enda bra bild är sällan uppdraget. Uppdraget är oftast åtta bilder till åtta avsnitt, eller tolv produktbilder som ska se ut som samma katalog. Det som håller ihop dem är inte motivet — det ska ju variera — utan allt annat.
Låst genom hela serien
- Stilsvansen, ordagrant, nedskriven på ett ställe.
- Kameraavstånd och kamerahöjd.
- Ljusets riktning och karaktär.
- Paletten och materialen.
- Bildformatet.
Varierar per bild
- Motivet: vad som ligger på bordet den här gången.
- Antalet föremål, när det säger något.
- Var det tomma utrymmet ligger, om layouten kräver det.
Skriv stilsvansen i en fil, inte i minnet. Den ska gå att klistra in oförändrad om ett halvår, av någon annan än du. Det är hela skillnaden mellan en visuell identitet och en samling bilder som råkade bli lika.
Tecken på att stilsvansen är för vag
- Två bilder med samma svans ser ut att komma från olika uppdrag.
- Du behöver välja bland åtta förslag för att hitta ett som ”passar in”.
- Du kan inte förklara för någon annan varför en bild inte passar.
Ändra ett lager i taget
Metoden faller om du ändrar två saker mellan två försök, för då lär du dig ingenting av skillnaden. Spara den första bilden som utgångsläge, ändra exakt ett lager, låt de tre andra stå ordagrant kvar och spara både prompten och resultatet.
Döp filerna efter vad som ändrades. kannor-ljus-motljus.png säger något; bild_final_v3b.png säger inget. Efter tre eller fyra rundor har du en liten katalog över vad varje lager gör i just det verktyget, och den kunskapen följer med till nästa uppdrag.
Sätt ett stopp: om tre ändringar i rad inte närmar sig målet är det nästan alltid motivlagret som är fel, inte ljuset. Gå tillbaka och skriv om vad som ska synas i stället för att fortsätta finjustera stämningen kring ett motiv som aldrig var rätt.
Från första försök till godkänt
Formarkivets första beställning gav rätt tre material, men kompositionen placerade dem mitt i bilden. En rubrik i efterhand skulle täcka mässingsprovet. Det är ett kompositionsfel, så motiv, ljus och stil lämnas orörda.
UTGÅNGSLÄGE: formarkivet-00-centrerad.png FAST STILSVANS: Dokumentärt utställningsfoto, dämpad grå och vinröd palett RUNDA 1 ÄNDRAT LAGER: Komposition FÖRE: Föremålen centrerade EFTER: Föremålen i nedre halvan, övre tredjedelen lugn och tom RESULTAT: Rubriken får plats utan att täcka motivet BEHÅLLS: Ja RUNDA 2 ÄNDRAT LAGER: Ljus och material FÖRE: Mjukt jämnt sidoljus från vänster EFTER: Lågt, strykande sidoljus från vänster RESULTAT: Gips, mässing och linne går att skilja åt i mobilstorlek BEHÅLLS: Ja
Fem kontroller innan publicering
Formarkivets huvudbild är klar först när exakt tre materialprover finns, inga bokstavs- eller logotypfragment syns vid full storlek, rubrikytan överlever 9:16-beskärningen och motivet går att läsa vid cirka 400 pixlars bredd. Gör därefter en andra bild med samma stilsvans och ett nytt motiv. Om de två inte tydligt hör ihop är den första bilden ännu inte en godkänd seriegrund.
Alt-text och bildtext är inte samma sak
Två texter följer med varje publicerad bild och de har olika uppdrag. Alt-texten beskriver motivet för någon som inte ser bilden: ”rakt uppifrån, tre emaljerade kannor på en repig plåtbänk”. Den ska inte innehålla ordet ”bild” och inte upprepa rubriken.
Bildtexten förklarar varför bilden står där den står — vad läsaren ska ta med sig. Den får gärna säga något som inte redan står i brödtexten. Ligger samma bild också som ett kort i en lista ska kortets alt-text vara tom, annars läser skärmläsaren upp samma beskrivning två gånger på samma sida.
Bildens filstorlek hör också hit. En hero-bild som väger flera megabyte är ett prestandaproblem och därmed ett läsarproblem; konvertera till ett modernt format och lägg upp en mindre variant för mobil.
Var metoden slutar räcka
Fyra lager gör bilden reproducerbar. De säger ingenting om du får använda den. Villkoren för kommersiell användning och vad som gäller för material du laddat upp som referens är avtalsfrågor. Märkning är delvis något annat: EU:s AI-förordning har transparensregler som gäller sedan 2 augusti 2026, och de är inte enbart upp till verksamheten att bestämma. Vad som krävs i ditt fall beror på vad bilden föreställer och var den publiceras — det behandlas på AI på svenska, inte här.
Skriv heller aldrig in en namngiven nu levande konstnär eller fotograf som stilreferens. Det är den vanligaste genvägen och den sämsta: den ger dig ett uttryck du inte kan beskriva själv, och den för in en upphovsrättslig fråga i något du tänkte publicera.
Och metoden gör inte en dålig idé bra. Fyra välskrivna lager kring ett motiv som inte säger något ger en tekniskt korrekt bild utan poäng. Bestäm vad bilden ska göra för texten innan du börjar beskriva den.