Ta reda på vilken ingång och modellversion du använder innan du skruvar på vikten. Att lägga en bild i prompten, peka ut den som stilreferens eller använda en särskild person- eller objektreferens är olika beställningar. De binder olika delar av resultatet och har olika viktskalor. Midjourneys karaktärsreferens hör till V6; i V7 ersätts den av omni-referensen. Provet i den här artikeln är tre jämförelser, fem körningar totalt, och visar vilken del just din referens faktiskt bär.
Referensbild är flera beställningar, inte ett reglage
Gränssnittet ser ut som om det fanns ett enda handgrepp: du drar in en bild och drar sedan i en styrka. Dokumentationen till de verktyg som förklarar sig ordentligt beskriver i stället flera åtskilda ingångar, var och en med eget syfte. En bild som ligger i själva prompten fungerar som utgångspunkt för en ny bild. En stilreferens ska bära uttrycket. En särskild person- eller objektreferens ska flytta över just den figuren eller saken till en ny scen. I Midjourney beror namnet på modellversionen: Character Reference med --cref hör till V6, medan Omni Reference med --oref ersätter den i V7. De är alltså inte två samtidiga reglage i V7.
Skillnaden avgör vad du ska klaga på när resultatet är fel. Får du rätt färger men fel komposition har du använt ingången som bär uttryck, och kompositionen måste beställas i texten. Får du rätt komposition men fel stämning har du använt ingången som bär helheten, och då konkurrerar din stilbeskrivning med bilden i stället för att komplettera den. Utan att veta vilken ingång som är aktiv skruvar du på en siffra som styr något annat än det du är missnöjd med.
Namnen skiljer sig mellan verktygen och ändras mellan modellversioner, så börja med att ta reda på vilka ingångar just ditt verktyg och din valda modell har. Kontrollen tar en minut: slå upp verktygets aktuella lista över bildparametrar och läs vilken uppgift varje bildingång har. En äldre dokumentationssida kan beskriva en ingång som den aktiva modellen har ersatt. Den vanligaste fallgropen ser ut så här: du drar in bilden i rutan, tycker att resultatet blev för likt originalet och sänker vikten — när felet i själva verket var att den ingången aldrig var tänkt att bära uttryck.
Vad varje ingång bär — och varför viktskalorna inte går att jämföra
Den ingång som lägger bilden i prompten är den minst precisa, och den missförstås oftast. Ett verktyg som förklarar saken i klartext skriver att det tittar på bildens kärnelement och använder dem som inspirationskälla för en ny och unik bild, samt uttryckligen att referenser används för att vägleda nya skapelser, inte för att kopiera dem exakt. Läser du det som ett löfte om en variant av din bild blir du besviken varje gång.
Stilreferensen är den ingång som brukar löna sig mest i redaktionellt arbete, eftersom den kan hållas identisk genom en hel serie medan motivet varierar. I V6 är karaktärsreferensen smalare och mer bokstavlig: dess viktvärde avgör hur mycket av personen som följer med, från allt som går att ta med ner till i huvudsak ansiktet. I V7 tar omni-referensen över person- och objektreferensen; den flyttar ett bestämt föremål eller en bestämd figur in i en ny scen och blir därför också känslig för att bli överstyrd.
Viktskalorna är inte jämförbara, inte heller när de står på dokumentationssidor för olika modellversioner. Karaktärsvikten i V6 toppar vid hundra, medan stil- och omni-vikten går till tusen. Att värdet hundra betyder ”så mycket som möjligt” i den ena och bara ”standardläge” i de andra är inte en detalj utan en vanlig orsak till att en inställning som fungerade på ett ställe ger obegripliga resultat på ett annat. Exakta namn, intervall och standardvärden står i rutan nedan; håll dem samlade där i stället för utspridda i minnet.
BILDPROMPT
Bildens URL placeras först i prompten.
Dokumentationen: verktyget ser bildens kärnelement och använder
dem som inspiration till en ny och unik bild — inte som en kopia.
--iw styr genomslaget. I V8.1 och V7 är intervallet 0–3 och
standardvärdet 1; i Niji 7 är intervallet 0–2 och standardvärdet 1.
STILREFERENS
--sref <bildens URL>
--sw styrka, 0–1000, standardvärde 100
KARAKTÄRSREFERENS (V6; ersätts av omni-referens i V7)
--cref <bildens URL>
--cw 0–100. Vid --cw 100 tas så mycket som möjligt med,
t.ex. ansikte, hår och kläder. Vid --cw 0 behålls
i huvudsak ansiktet.
OMNI-REFERENS (V7; person eller bestämt motiv i en ny scen)
--oref <bildens URL>
--ow 1–1000, standardvärde 100. Dokumentationen avråder från
värden över 400 om du inte samtidigt kör ett mycket högt
stylize-värde — annars blir resultatet oförutsägbart.Värdena ovan är lästa i leverantörens egen dokumentation den 14 augusti 2026: Image Prompts, Style Reference, Character Reference och Omni Reference. Character Reference-sidan anger uttryckligen att V7 använder Omni Reference i stället. Ett verktyg används här som illustration, inte som rekommendation. Kontrollera motsvarande sidor för det verktyg du faktiskt kör — parameternamn och intervall ändras mellan modellversioner, och en siffra du minns från förra året är inte en källa.
Provet: tre jämförelser som visar vad referensen bär
Det här går att göra i verktygets eget gränssnitt, utan kod, och tar några minuter. Syftet är inte att hitta en bra bild utan att isolera vad referensen bidrar med. Kör det en gång per referens du tänker återanvända, så slipper du gissa i skarpt läge.
Första jämförelsen är kontrollen: samma text, en gång med referensen och en gång utan, med samma frö båda gångerna. Skillnaden mellan de två bilderna ger en praktisk signal om vad referensen bidrar med, men är ingen exakt mätning — en ändrad bildingång kan också ändra hur modellen tolkar hela beställningen. Är skillnaden mindre än du trodde är det sannolikt texten som bär mer av arbetet, och då är det texten du ska förbättra.
Andra jämförelsen skiljer palett från komposition. Byt referensen mot en utjämnad version av samma bild — samma komposition, färgen utslätad mot gråskala eller en enda ton. Följer resultatets färger med förändringen tyder det på att paletten bar mycket. Håller däremot placering och former ihop trots att färgen ändrats tyder det på att kompositionen bar mer. Provet isolerar inte delarna fullständigt, men visar vilken hypotes du ska pröva vidare.
Tredje jämförelsen är viktprovet: kör samma prompt på viktens lägsta och högsta värde och skriv ned vad som faktiskt förändras mellan ytterlägena. Det är den snabbaste vägen till att se vilken del av bilden referensen bär, och det avslöjar också om vikten över huvud taget gör något i din kombination.
REFERENS: [filnamn eller kod på bilden du provar]
INGÅNG: [bildprompt / stil / karaktär / motiv]
TEXT: [samma promptrad i alla körningar, ordagrant]
FRÖ: [samma värde i alla körningar]
JÄMFÖRELSE 1 — bär referensen något alls?
K1 utan referens → [vad som skiljer mot K2]
K2 med referens → [utgångsläge]
JÄMFÖRELSE 2 — palett eller komposition?
K3 utjämnad referens → [följde färgerna med = paletten bar,
höll formerna ihop = kompositionen bar]
JÄMFÖRELSE 3 — vad gör vikten?
K4 vikt = lägsta → [vad försvinner]
K5 vikt = högsta → [vad tar över]
SLUTSATS: referensen bär [komposition / palett / material /
person / motiv] och inte [resten].
SPARAS: referensfil + prompt + vikt + ingång, i samma mapp.Eget referensmaterial som håller över en serie
En referens som bara fungerar på det motiv den gjordes av är ingen referens, det är en kopia. Provet på att du har byggt något återanvändbart är enkelt: applicera referensen på ett motiv den inte var tänkt för. Håller looken har du en referens. Kommer originalets föremål med på köpet har du i praktiken beställt en variant av originalbilden.
Därför ska referensen vara fattig på det du vill variera. Vill du bara ha ytbehandlingen — kornighet, papperston, hur ljuset faller på materialet — beskär bort motivet ur referensen innan du laddar upp den, eller fotografera bara materialet. En referens full av starka former smittar av sig även när du har bett om enbart uttryck, och du märker det först när tredje bilden i serien har fått med sig ett föremål ingen bad om.
Ett vanligt misstag är att ha en enda referens som ska bära allt. Dela i stället upp: en referens för uttrycket, en annan för personen, en tredje för föremålet, om verktyget har separata ingångar för dem. Då kan du byta en av dem utan att de andra rasar, precis som med de fyra lagren i bildbeställningen.
Och spara referensen som en fil, inte som en länk i en chatthistorik. En stilkod eller en uppladdad bild-URL som bara finns i ett samtal är borta den dag samtalet är borta. Referensfilen, promptraden, ingången och viktvärdet hör ihop och ska ligga tillsammans; hur den bokföringen ser ut i praktiken står i artikeln om ordning på genererat material.
Vad referensen inte löser
Den gör inte beskrivningen överflödig. Dokumentationen är tydlig med det: texten är lika viktig för att förmedla hela scenen och de detaljer som ligger utanför det referensbilden visar. En referens säger något om hur, sällan något om vad och nästan aldrig något om var det tomma utrymmet ska ligga. Kortar du ned prompten när du lägger till en referens tar du bort den halva som bar motivet.
Den löser inte heller rättighetsfrågan. Vad du får ladda upp som referens — andras bilder, kollegors foton, material från en kund, bilder på identifierbara personer — och vad du sedan får göra med resultatet är avtals- och regelfrågor, inte promptfrågor. De hör hemma hos den som ansvarar för publiceringen, och behandlas på systersajten: AI och upphovsrätt på jobbet. Sajtens egen regel gäller oavsett: skriv aldrig in en namngiven nu levande konstnär, fotograf eller artist som stilreferens, och ladda inte upp deras verk som referensbild.
Frö och referens löser inte samma problem. Fröet används här bara som ett handgrepp för att hålla en variabel still mellan två körningar i ett gränssnitt — det gör provet läsbart, inte resultatet garanterat. Vad ett frö faktiskt låser och inte låser när man anropar en modell programmatiskt är en egen fråga, och den behandlas på Monkeybase.
Slutligen: ingen av inställningarna överlever en modellversion utan kontroll. Parameternamn, intervall och standardvärden ändras. Har du skrivit ned ingången och viktvärdet tillsammans med referensen är omkalibreringen efter en versionsändring ett kort arbete: du kör provet en gång till och justerar en siffra. Har du inte det börjar du om från början. Arbetsgången för hela bildmomentet finns i guiden om bild, och fler enskilda problem tas upp bland artiklarna.
Du kan säga i en mening vilken ingång din referens använder, vilken del av resultatet den bär och vad den lämnar åt texten. Provets fem körningar är gjorda och nedskrivna, referensfilen ligger sparad tillsammans med prompt, ingång och viktvärde, och samma referens har gett ett användbart resultat på ett motiv den inte gjordes för.