Wij bewaren geen gebruikersgegevens en hebben er geen toegang toe. We schorsen geen accounts tenzij een bevoegde autoriteit handhavingsmaatregelen vereist.
Gids · Beeldprompts

De promptgids voor AI-afbeeldingen

Shannons Beeldmodel leest een prompt als een taalmodel. Dat ene feit verandert alles aan hoe u er een zou moeten schrijven — te beginnen met het laten vallen van de trefwoorden met komma's ertussen.

Bijgewerkt op 5 september 2026Praktische gidsShannon 3 · Beeldgeneratie

Kort samengevat

Schrijf lopend proza in volledige zinnen, geen trefwoordtags. Mik op 30–80 woorden. Zet het in de volgorde waarin het model leest: onderwerp → handeling → stijl → omgeving en belichting → techniek, het belangrijkste eerst. Wees concreet over het onderwerp. Wilt u een foto, schrijf het dan als een foto — noem een camera, een lens en een filmsoort of een lichtbron. Koppel exacte kleuren aan benoemde objecten als color #RRGGBB. Kies een van vijf beeldverhoudingen. En laat de gewoontes uit het SDXL-tijdperk vallen: geen "masterpiece, best quality, 8k", geen (word:1.3)-gewichten en geen negatieve prompt bij tekst-naar-beeld — beschrijf alleen wat u wilt. Bewerken en combineren accepteren wel een negatieve prompt.

De meeste mensen komen binnen met promptgewoontes die ze op SDXL hebben geleerd: een reeks zelfstandige naamwoorden met komma's ertussen, een aanhef met kwaliteitstokens, een paar gewichten tussen haakjes, en een negatieve prompt die net zo lang is als de positieve. Die gewoontes klopten voor die modellen en werken hier averechts. Dit is de korte versie van wat wél werkt — en omdat Shannon de generatieprompt voor u schrijft en hem toont voordat er iets rendert, is het evengoed een gids voor het lezen en corrigeren van wat Shannon voorstelt.

30–80
Streefaantal woorden
5
Beeldverhoudingen
0
Negatieve prompts in T2I
1
Bevestigingskaart eerst

01Waarom proza tags verslaat: het model leest als een taalmodel

De oudere diffusiemodellen waarvoor het meeste promptadvies is geschreven, gebruikten een tekstencoder die zich in de praktijk gedroeg als een zak begrippen: grammatica deed er nauwelijks toe, en de winnende strategie was relevante zelfstandige naamwoorden opstapelen en die met gewichten bijsturen. Tagsoep was de juiste promptvorm voor die encoder.

Shannons Beeldmodel werkt niet zo. Het leest een prompt zoals een taalmodel tekst leest, dus syntaxis draagt betekenis. "Holding an umbrella against her shoulder" is een relatie tussen een persoon, een voorwerp en een lichaamsdeel; "umbrella, shoulder" zijn twee dingen die toevallig aanwezig zijn. Voorzetsels plaatsen dingen. Werkwoorden maken houdingen. Bijzinnen hangen detail aan het juiste zelfstandig naamwoord in plaats van het over de hele afbeelding te laten zweven.

Hier is dezelfde afbeelding op beide manieren gevraagd.

Tagstijl — de oude gewoonte
woman, 30s, tokyo, rain, night, crosswalk, neon signs, umbrella,
wet asphalt, reflections, masterpiece, best quality, 8k, ultra
detailed, (bokeh:1.3), cinematic lighting, photorealistic
27 fragmenten met komma's ertussen. Geen werkwoord, geen relaties, vier dode tokens, en één gewichtssyntaxis die niet wordt verwerkt.
Prozastijl — wat hier werkt
A woman in her early thirties waits at a rain-soaked Tokyo
crosswalk at night, holding a clear vinyl umbrella against her
shoulder and glancing down the street. Neon storefront signs
bleed red and cyan into the wet asphalt at her feet. Shot on
Kodak Portra 400, 85mm f/1.4, shallow depth of field, the
traffic signal behind her thrown out of focus.
61 woorden. Elk element wordt ten opzichte van een ander geplaatst, en de kadrering wordt als camerabeslissing benoemd.

Kijk naar wat de tagversie niet kan uitdrukken. Ze zegt nooit dat de paraplu wordt vastgehouden, dus die kan uiteindelijk op de grond liggen. Ze zegt nooit dat het neon weerspiegeld wordt in het asfalt, alleen dat beide bestaan, dus krijgt u reclameborden en een natte straat zonder optische relatie ertussen. Ze zegt nooit waar de vrouw kijkt, dus haar houding is een muntworp. "Cinematic lighting" is een sfeerlabel, geen lichtbron. En de laatste vijf tokens zijn ruis, gelezen als Engelse woorden over fotografie in plaats van als stuurknoppen.

De prozaversie is niet langer omdat ze bloemrijk is. Ze is langer omdat ze vragen beantwoordt die de tagversie openliet. Dat is de hele truc.

02Hoe lang moet een beeldprompt zijn?

Mik op 30 tot 80 woorden. Ga niet ver voorbij de 100. Dit is de makkelijkste kwaliteitsknop die u hebt, en beide uiteinden van de bandbreedte doen ertoe.

Onder ongeveer 30 woorden zijn compositie, licht en kadrering onbepaald, dus kiest het model wat statistisch het gewoonst is. "Een vrouw in een koffiebar" is een geldige prompt die een vergeetbare afbeelding oplevert, omdat u elke interessante beslissing hebt gedelegeerd.

Boven ruwweg 100 woorden verschijnt een ander soort falen: late zinsdelen concurreren met vroege om dezelfde delen van de afbeelding, en in plaats van detail op te stapelen krijgt u verdunning. De derde belichtingsbeschrijving maakt de eerste ongedaan, en het onderwerp dat u in de eerste acht woorden vastlegde, krijgt met elke zin die u toevoegt relatief minder aandacht. Lange prompts lézen als grondig. Ze renderen niet als grondig.

De discipline: schrijf de prompt die u wilt, en snoei hem daarna terug tot de zinnen die de afbeelding zouden veranderen als u ze weghaalde.

03De volgordediscipline: het belangrijkste eerst

Omdat het model sequentieel leest, is positie nadruk: wat eerst komt verankert de afbeelding, wat laatst komt stelt haar bij. Zet de dingen in de volgorde waarin het model ze nodig heeft:

  1. Onderwerp — wie of wat er op deze afbeelding staat, concreet.
  2. Handeling of houding — wat ze doen, hoe ze staan of zitten.
  3. Stijl of sfeer — foto, olieverf, technische illustratie, en het register ervan.
  4. Omgeving en belichting — waar dit gebeurt en welk licht erop valt.
  5. Techniek — kadrering, lens, scherptediepte, kleurspecificaties.

De meest voorkomende zelfverwonding is beginnen met het technische zinsdeel. Openen met "Cinematic wide shot, anamorphic lens flare, teal and orange grade, of a man reading a newspaper" vertelt het model dat de look het onderwerp is en de man een detail. U krijgt een prachtig, leeg kader met een klein, onduidelijk figuurtje erin.

Techniek eerst — het onderwerp komt te laat
Cinematic wide shot, anamorphic lens flare, teal and orange
color grade, shallow depth of field, golden hour, of a man
reading a newspaper on a park bench.
Onderwerp eerst — dezelfde elementen, juiste volgorde
A man in his sixties in a gray wool overcoat sits on a park
bench reading a folded broadsheet newspaper, one ankle crossed
over his knee. Late golden-hour sun rakes across him from the
left through bare plane trees. Photographed wide on a 35mm
anamorphic lens, shallow depth of field, warm highlights and
cool shadows.

Elk element uit de eerste versie overleeft in de tweede; er is niets weggelaten. Het model weet nu eenvoudigweg waar de afbeelding over gaat voordat het te horen krijgt hoe die moet worden geschoten — en alleen die herordening al verplaatst het onderwerp van bijkomstig naar centraal.

04Wees concreet over het onderwerp

"Een persoon" is geen onderwerp maar een plaatshouder — en het model vult plaatshouders met het gemiddelde van alles wat het heeft gezien, en daar komt precies die gladde, leeftijdsloze, karakterloze look vandaan. Concreetheid kost vijf woorden en levert een specifiek mens op:

VaagConcreet
een persooneen man van in de veertig met een peper-en-zoutbaard en diepe lachrimpels
een vrouween vrouw van eind twintig met een donkere undercut en een afgebroken voortand
een oud gebouween bakstenen pakhuis van vier verdiepingen met overgeschilderde belettering en dichtgetimmerde bovenramen
eteneen kom ramen met een gehalveerd zachtgekookt ei erbovenop, dampend

Let op het patroon: leeftijd of tijdperk, één structureel kenmerk, één onderscheidende onvolkomenheid. Dat derde item is wat een resultaat gefotografeerd laat aanvoelen in plaats van gegenereerd. Een afgebroken tand, een versleten zoom, overgeschilderde belettering — kleine asymmetrieën zijn het sterkste anti-plasticsignaal dat er is, en ze kosten bijna niets van uw woordbudget.

05Fotorealisme: schrijf het verzoek als een foto

Fotorealisme is het standaardregister tenzij u om kunst, illustratie of anime vraagt. Maar het woord "photorealistic" doet weinig werk. Wat een foto oplevert, is het beschrijven van de handeling van het fotograferen: een echte camera, een echte lens en een echte filmsoort of lichtbron.

De reden is eenvoudig. Elke afbeelding met het onderschrift "Kodak Portra 400" is gemaakt met een specifiek proces met een specifieke korrelstructuur, hooglichtafloop en huidweergave, en het benoemen van de filmsoort roept dat allemaal op. "8k ultra detailed" kwam alleen ooit voor in spam van stockfotosites, dus het roept spam van stockfotosites op. Een paar betrouwbare recepten, elk met een duidelijk andere afbeelding van hetzelfde onderwerp:

ReceptWat het u geeft
Kodak Portra 400, 85mm f/1.4, soft window lightWarme, vergevingsgezinde huidtonen; romige scheiding; redactioneel portret
Ilford HP5 pushed to 1600, 35mm, available lightKorrelig zwart-wit, contrastrijk, straatdocumentaire-energie
Digital medium format, 80mm, single softbox at 45°Schone commerciële studiolook, gecontroleerde afval, productkwaliteit
135mm f/2, backlit at golden hour, atmospheric hazeGecomprimeerde achtergrond, randlicht, romantische telelook

Stem de verankering af op het recept — huidtextuur op porieniveau betekent niets in een 24mm-groothoek waarin het gezicht tachtig pixels hoog is — en voeg die dan toe. Verankerend detail is het textuurbewijs dat een lens dit werkelijk heeft vastgelegd. Zichtbare huidporiën en fijne gezichtsbeharing. De weving van een linnen hemd. Stofdeeltjes in een lichtbundel. Een schaafplek op een leren laars. Loshangende haren tegen een lichte achtergrond. Twee of drie zijn genoeg, en ze vormen het verschil tussen een rendering van een mens en een foto van een mens.

06Gelaagde scènes: voorgrond, middengrond, achtergrond

Wanneer een scène diepte heeft, beschrijf de drie vlakken dan apart en op volgorde. Dit is de doeltreffendste techniek voor afbeeldingen die als plekken moeten aanvoelen in plaats van als decor, en vrijwel niemand doet het. Zonder dit krijgt u vlakheid: alles wat de prompt noemt, landt op ongeveer dezelfde afstand en vecht om dezelfde middenband van het kader. Vlakken benoemen geeft het model een dieptebudget om uit te geven.

Drie vlakken, uitdrukkelijk benoemd
In the foreground, a cracked concrete ledge with a half-empty
paper coffee cup and a scattering of cigarette ash, slightly out
of focus. In the midground, a bicycle courier in a yellow rain
jacket wheels her bike across a wet plaza, caught mid-stride. In
the background, a glass office tower dissolves into low fog.
Shot on a 50mm lens at f/2.8, flat overcast light.
70 woorden. Het onscherpe voorgrondelement is wat de diepte verkoopt — het vertelt het model waar de camera staat.

Twee verfijningen. Zet iets op de voorgrond dat bewust onscherp is — echte foto's van diepe scènes hebben er bijna altijd een, en het ontbreken ervan is een veelvoorkomend verraad. En zeg welk vlak het onderwerp inneemt: als de koerier het punt van de afbeelding is, hoort ze in de middengrond, anders vechten de toren en het koffiebekertje met haar om het kader.

07Exacte kleuren: hexcodes, gekoppeld aan objecten

Voor merkwerk, kostuumcontinuïteit, of overal waar "rood" niet specifiek genoeg is, schrijft u de hexcode als color #RRGGBB en koppelt u die aan een benoemd object:

Goed: hex gebonden aan een zelfstandig naamwoord
...wearing a heavy wool peacoat, color #8B0000, over a cream
turtleneck, against a studio backdrop, color #1E3A5F.
Fout: hex zweeft los
...#8B0000, #1E3A5F, dark red and navy color palette, moody...
Niets bindt deze codes aan iets, dus ze werken als een vage tintsuggestie over het hele kader.

Drie vuistregels. Gebruik hex voor de twee of drie kleuren die er werkelijk toe doen en gewone woorden voor de rest — een prompt met zes hexcodes besteedt het grootste deel van zijn budget aan verfstalen. Bind de code aan een object met randen, nooit aan "de belichting" of "de sfeer". En onthoud dat het de kleur van het object opgeeft, niet de uiteindelijke pixelwaarde: een jas van #8B0000 in tegenlicht tijdens het gouden uur rendert warmer dan het staal, precies zoals dat in het echt ook zou gebeuren.

08De beeldverhouding kiezen

Er zijn vijf verhoudingen beschikbaar en de juiste wordt meestal door het onderwerp geïmpliceerd, maar een uitdrukkelijk verzoek van u wint altijd — vraag om een wallpaper en u krijgt tall, ongeacht wat de inhoud suggereert.

VerhoudingHet best voorWaarom
squareStandaard. Losse gecentreerde objecten, iconen, symmetrische composities, socialpostsGeen dominante as, dus niets wordt door de eigen voorkeur van het kader afgesneden
portraitMensen, heel of half figuur; hoge onderwerpen zoals torens, bomen, flessenGeeft een staande figuur ruimte van hoofd tot voet zonder hem te verkleinen
landscapeLandschappen, interieurs, groepen mensen, product-in-contextopnamenHorizontale ruimte zodat de omgeving werkelijk een omgeving kan zijn
wideFilmische kaders, filmstills, banners, headerafbeeldingenDe breedste optie; sterke negatieve ruimte, anamorfisch gevoel
tallPosters, boekomslagen, telefoonachtergronden, verticale socialformatsHoger dan portrait; laat bewust ruimte voor typografie of lucht

Dit verkeerd doen is schadelijker dan het lijkt. Een staande figuur ten voeten uit in een wide-kader levert u geen klein figuurtje in een groot kader op — het levert er meestal een afgesneden op, want het model vult de breedte en het hoofd of de voeten verlaten het kader. Stem het kader af op de dominante as van het onderwerp en de meeste compositieklachten verdwijnen.

Twee gedragingen om te onthouden: bewerken behoudt automatisch de beeldverhouding van de bronafbeelding, dus u kunt niet herkadreren door te bewerken, terwijl combineren u een nieuw canvas laat kiezen — vaak de nettste manier om de vorm te veranderen van iets dat u al hebt.

09Antipatronen: waar u mee moet stoppen

Kwaliteitstokens: "masterpiece, best quality, 8k, ultra detailed"

Dit waren door de gemeenschap ontdekte handvatten voor een specifieke, oudere trainingsverdeling, waarin bepaalde onderschriften samenhingen met bepaalde beeldbronnen. Ze zijn niet overdraagbaar. Hier worden ze gelezen als gewone Engelse woorden, dragen ze niets bij, en vreten ze aan een woordbudget waarvan u al te horen kreeg dat het krap is. De vervanging is zeggen welk detail u wilt: niet "ultra detailed" maar "visible weave in the coat fabric and fine stubble along the jaw" — dezelfde bedoeling, uitgedrukt als iets wat het model kan renderen.

Gewichtssyntaxis: (word:1.3), [word], {{word}}

Wordt niet verwerkt. De haakjes, blokhaken, dubbele punten en cijfers landen als letterlijke tekst en maken het omringende zinsdeel eerder moeilijker leesbaar. Wilt u ergens meer nadruk op leggen, gebruik dan de twee knoppen die wél werken: zet het eerder in de prompt, en geef het meer woorden. "A crimson silk scarf, its fringed ends lifting in the wind" verslaat "(red scarf:1.4)" op elke maatstaf die ertoe doet.

Tegenstrijdige aanwijzingen

Onverenigbare instructies mengen levert geen combinatie op; het levert een instabiel gemiddelde op dat meestal geen van beide bevredigt. De veelplegers:

  • Medium — "photorealistic" plus "watercolor"; "oil painting" plus "shot on 85mm". Kies er één en houd u eraan.
  • Kadrering — "wide establishing shot" plus "extreme close-up on her eyes"; "full body" plus "detailed facial pores".
  • Belichting — "harsh midday sun" plus "soft golden hour glow"; "low key, deep shadows" plus "bright and airy".
  • Tijdperk — "1970s film aesthetic" plus "modern minimalist" plus "cyberpunk".
  • Stijlstapeling — vier kunstenaars of vier genres tegelijk. Twee verwante referenties kunnen werken; vier heffen elkaar op tot generiek.
  • Wildgroei — "rustic, weathered, ancient, timeworn wooden door" is één idee dat vier keer is opgeschreven, en elke herhaling verdunt de rest van de prompt.

10Er is geen negatieve prompt bij tekst-naar-beeld

Dit is het antipatroon dat ervaren gebruikers het hardst treft, want op oudere stacks was de negatieve prompt de halve ambacht.

BewerkingNegatieve promptWat u moet doen
Tekst-naar-beeld (genereren)Niet ondersteundBeschrijf alleen wat u wilt. Schrijf nooit "geen X".
Eén afbeelding bewerkenOndersteundZet ongewenste artefacten daar, houd de instructie positief.
Twee of meer combinerenOndersteundIdem — artefacten in de negatieve, rollen in de positieve.

Voor generatie is de regel absoluut en enigszins contra-intuïtief: "geen tekst, geen watermerk, geen extra vingers" in de prompt schrijven maakt die dingen waarschijnlijker, niet onwaarschijnlijker. Het model leest "geen tekst" als een zin die het begrip tekst bevat; ontkenning is een zwak signaal en het zelfstandig naamwoord een sterk signaal. U hebt feitelijk om tekst gevraagd. Formuleer het in plaats daarvan altijd positief:

In plaats vanSchrijf
geen rommel op de achtergrondeen schone naadloze grijze achtergrond
niet wazigvlijmscherp op de ogen, f/8
geen andere mensenalleen in een lege straat bij dageraad
geen moderne voorwerpeneen keuken uit de jaren dertig met emaillen serviesgoed en een gietijzeren fornuis
geen cartoonstijlshot on Kodak Portra 400, 85mm, natural skin texture

Bij bewerken en combineren bestaat de negatieve prompt wél en zou u die moeten gebruiken — maar voor artefacten, niet voor inhoud. Goed materiaal: watermerk, tekstoverlay, dubbele ledematen, vervormde handen, verscherpingsranden, JPEG-blokjes, naadlijnen langs de rand van een compositie. Slecht materiaal: alles over waar de afbeelding over gaat, want dat hoort in de instructie.

11De prompt lezen die Shannon voor u schrijft

Dit is wat deze gids meteen bruikbaar maakt in plaats van theoretisch. U hoeft de generatieprompt niet zelf te schrijven. U vraagt het in gewone taal, in welke taal dan ook; Shannon herkent dat er om een afbeelding wordt gevraagd, stelt de Engelse generatieprompt op, en toont u die op een bevestigingskaart voordat er iets rendert. Er wordt niets gegenereerd en niets in rekening gebracht tot u bevestigt.

De vaardigheid die dus het meest oplevert, is niet prompts vanaf nul schrijven — het is de prompt op de kaart lezen. Loop dit lijstje langs:

  1. Is het onderwerp concreet? Staat er op de kaart "a person" of "a woman", dan hebt u de grootste beschikbare verbetering gevonden. Geef het een leeftijd, een postuur, een kenmerk.
  2. Staat het onderwerp vooraan? Opent de prompt met een stijl of een camera, vraag dan of het onderwerp voorop mag.
  3. Zit het in de bandbreedte? Onder de 30 woorden: vraag om meer specificiteit over licht en omgeving. Boven de 100: vraag om inkorten.
  4. Is er een lichtbron? Geen sfeerwoord — echt licht: raam, straatlantaarn, flits, bewolkte hemel, softbox.
  5. Zitten er conflicten in? Scan op twee media, twee kadreringen of twee belichtingssituaties in dezelfde prompt.
  6. Zijn er ontkenningen binnengeslopen? Bevat de kaart "without", "no" of "avoid", dan is dat een tekst-naar-beeldprompt die vraagt om precies wat hij noemt.
  7. Past de verhouding bij het onderwerp? Een figuur ten voeten uit in wide is de klassieke mismatch.

Corrigeren gaat in gewone taal: "maak haar begin dertig met een litteken door haar wenkbrauw, schiet het op Portra met 85mm, en gebruik portrait" is een prima instructie. U krijgt een nieuwe kaart en bevestigt die in plaats van de vorige. Er staat geen straf op itereren, want er is nog niets gerenderd.

En Shannon genereert niet ongevraagd. Een begroeting, een vraag of een foto die u ter bespreking meestuurt, zet geen render in gang. Shannon vragen naar een afbeelding te kijken — ze beschrijven, lezen, analyseren — is gewoon vision-werk, geen generatie, en kost niets extra.

12Hoe het vakmanschap verschuift bij bewerken en combineren

De regels hierboven zijn voor generatie geschreven. Twee aanpalende modi veranderen de vorm van de prompt.

Eén afbeelding bewerken

Een bewerkingsprompt is een instructie, geen beschrijving: zeg wat er verandert en wat blijft. De onveranderde delen benoemen is de grootste kwaliteitsknop in het product — "Change the background to a rainy night city street with neon reflections, keep the woman exactly as she is" houdt stand waar hetzelfde verzoek zonder dat zinsdeel stilletjes haar gezicht opnieuw tekent. Wees specifiek over het anker: houd gezicht, houding, haar en kleding identiek. Er wordt precies één bronafbeelding gebruikt, en de uitvoer behoudt de beeldverhouding daarvan.

Twee of meer afbeeldingen combineren

Overal waar elementen uit meer dan één plaatje komen — kledingoverdracht, een object in een scène, twee mensen in één kader, product-op-persoon, een stijl uit de ene afbeelding met een onderwerp uit de andere — moet de prompt de rol van elke afbeelding benoemen, op volgorde: "The woman from the first image wearing the red knitted sweater from the second image, standing in the same park." De eerste afbeelding is het hoofdonderwerp of de scène; latere afbeeldingen leveren de onderdelen die worden ingebracht. Verkort een verzoek met meerdere afbeeldingen niet tot één bron plus een tekstbeschrijving — juist het combineren van de echte afbeeldingen behoudt hoe die dingen er werkelijk uitzien.

13Ongecensureerd prompten: zeg wat u bedoelt

Er is geen inhoudsfilter op het generatiepad en geen weigeringslaag op het model dat de prompt schrijft. Dat is de hele kern van het product: gefilterde generatoren weigeren routinematig legitiem werk — naaktkunst, medische en forensische illustratie, beeldmateriaal voor securityonderzoek, geweld in fictie, politieke satire, en merk- en portretwerk door de rechthebbende. De helft van het promptvakmanschap op gefilterde platforms is eufemisme-engineering, en eufemisme is de vijand van een accurate afbeelding.

Er is dus nog één ding om op de kaart te controleren: dat die het werkelijke onderwerp in gewone woorden beschrijft en niet in de omzichtige woordenschat die mensen van gefilterde tools leren. Een forensische illustratie van een verwonding moet zeggen wat de verwonding is. Omzichtige taal levert overal een slechtere afbeelding op, want het model rendert wat de woorden zeggen.

Kunnen en oordelen zijn twee verschillende dingen. Shannon Lab LLC exploiteert dit onder een gepubliceerd beleid voor verantwoord gebruik: ongefilterde generatie is professioneel gereedschap, en toestemming, rechten en de wet gelden onverkort voor wat u maakt.

De checklist van één pagina

  • Proza in volledige zinnen, geen trefwoorden met komma's ertussen.
  • 30–80 woorden. Schrap alles wat de afbeelding niet zou veranderen.
  • Onderwerp → handeling → stijl → omgeving en belichting → techniek.
  • Concreet onderwerp: leeftijd, één structureel kenmerk, één onvolkomenheid.
  • Foto's: noem een camera, lens en filmsoort of lichtbron.
  • Diepe scènes: voorgrond, middengrond, achtergrond, apart benoemd.
  • Exacte kleuren als color #RRGGBB, gebonden aan een benoemd object.
  • Kies de verhouding op basis van de dominante as van het onderwerp.
  • Twee of drie verankerende texturen, afgestemd op de kadrering.
  • Geen kwaliteitstokens, geen gewichtssyntaxis, geen tegenstrijdige aanwijzingen.
  • Geen ontkenningen bij tekst-naar-beeld. Ontkenningen zijn voor bewerken en combineren, en alleen voor artefacten.

14Waar de API in past

Eén punt van nauwkeurigheid voor lezers die via een zoekopdracht naar een API binnenkomen: beeldgeneratie, beeldbewerking en het combineren van afbeeldingen zitten in de Shannon chat-app, niet in de /v1 API. De API levert tekst en vision — ze kan afbeeldingen die u opstuurt lezen, beschrijven en analyseren via alle drie de dialecten (/v1/chat/completions, /v1/messages, /v1/responses, alle met streaming) — maar ze maakt er geen. Bouwt u een pijplijn die afbeeldingen moet begrijpen, dan is de API-documentatie de plek om te beginnen. Wilt u afbeeldingen maken, dan is dat de chat-app, en alles in deze gids geldt daar. Afbeeldingen renderen op ons eigen GPU-cluster.

15Veelgestelde vragen

Hoe lang moet een prompt voor een AI-afbeelding zijn?

Mik op 30 tot 80 woorden en ga nooit ver voorbij de 100. Onder de 30 woorden laat u compositie, belichting en kadrering aan het toeval over. Voorbij de 100 woorden gaan de latere zinsdelen met de eerdere concurreren en spoelt detail eerder weg dan dat het zich opstapelt.

Moet ik trefwoordtags of volledige zinnen schrijven?

Volledige zinnen. Shannons Beeldmodel leest een prompt zoals een taalmodel tekst leest, dus grammatica draagt informatie. "A woman in her 30s at a rain-soaked Tokyo crosswalk at night" levert een samenhangende scène op; "woman, 30s, Tokyo, rain, night" levert een stapel losse eigenschappen op zonder enige relatie onderling.

Kan ik een negatieve prompt gebruiken bij tekst-naar-beeld?

Nee. Tekst-naar-beeld op Shannon accepteert geen negatieve prompt, dus beschrijf alleen wat u wilt en schrijf nooit "geen X" in de prompt zelf — iets benoemen roept het meestal juist op. Beeldbewerking en het combineren van afbeeldingen ondersteunen wél een negatieve prompt, en dat is de juiste plek voor ongewenste artefacten zoals watermerken, tekstoverlays of dubbele ledematen.

Verbeteren tokens als "masterpiece, best quality, 8k" de afbeelding?

Nee. Dat waren handvatten voor een oudere generatie modellen en ze dragen hier geen informatie — ze worden simpelweg als woorden gelezen, en ze verbruiken een deel van uw budget van 30–80 woorden zonder iets te zeggen. Gewichtssyntaxis als (word:1.3) wordt evenmin verwerkt; die landt als letterlijke tekst. Beschrijf in plaats daarvan het concrete detail dat u wilt.

Hoe krijg ik een exacte kleur?

Schrijf de hexcode als color #RRGGBB en koppel die aan een specifiek benoemd object, bijvoorbeeld "a wool jacket, color #8B0000". Een hexcode die los van een object zweeft, heeft niets om zich aan te binden. Gebruik het voor de twee of drie kleuren die er werkelijk toe doen en beschrijf de rest in woorden.

Kan ik afbeeldingen genereren via de Shannon API?

Nee. Beeldgeneratie, beeldbewerking en het combineren van afbeeldingen gebeuren in de Shannon chat-app. De /v1 API levert tekst en vision — ze kan afbeeldingen die u opstuurt lezen en analyseren, maar ze maakt er geen. Alles in deze gids geldt voor de chat-app.

Probeer het op een echte prompt

Vraag het in welke taal dan ook. Lees de kaart. Pas hem aan. Bevestig daarna.

Open Shannon Chat Meer research

Er rendert niets, en er wordt niets in rekening gebracht, tot u de prompt bevestigt


Verder lezen: Ongecensureerde AI-beeldgeneratie · Ongecensureerde AI-beeldbewerking · Beleid voor verantwoord gebruik · API-documentatie · Alle Shannon research. De richtlijnen hier komen uit onze eigen tests met Shannons Beeldmodel; advies dat voor eerdere diffusiestacks is geschreven, is doorgaans niet overdraagbaar.

Alle onderzoekslinks