
Prompt immagini Gemini: foto, modifica e formati
Un buon prompt per immagini Gemini descrive una scena completa in frasi: soggetto, azione, ambientazione, stile o mezzo, luce, fotocamera o obiettivo e un formato esplicito. Il modello di immagini nativo di Gemini gestisce anche la modifica in conversazione, la combinazione di più immagini, la coerenza all'interno di una chat e la scelta diretta del formato. Qui sotto trovi esempi di prompt in stile fotografico e una libreria di 25 prompt, con ogni capacità del modello verificata sulla documentazione di Google aggiornata al 2026.
Come funziona Gemini con le immagini nel 2026
“Nano Banana” è il soprannome della generazione di immagini nativa di Gemini. Nel 2026 ci sono due livelli da conoscere.
- Nano Banana è il modello di immagini veloce di classe Flash e quello predefinito nell’app Gemini. È il cavallo da lavoro per i volumi: varianti di annunci, post social, iterazioni rapide e concept usa e getta.
- Nano Banana Pro si basa su Gemini 3 Pro, ragiona prima di generare, produce fino al 4K, combina fino a 14 immagini di riferimento e inserisce testo leggibile nell’immagine. Quest’ultima capacità cambia il flusso di lavoro: poster, bozze di packaging e infografiche con etichette non richiedono più un passaggio in Photoshop.
Ci sono tre strade di accesso, e la tecnica di prompt è la stessa per tutte: l’app Gemini per il lavoro manuale, Google AI Studio per confrontare prompt fianco a fianco e la documentazione sulla generazione di immagini dell’API Gemini quando vuoi produrre varianti creative in modo programmatico.
Ogni immagine creata dai modelli di Google porta una filigrana invisibile SynthID che ne indica l’origine generata dall’IA, e Nano Banana Pro sa anche dirti se un’immagine che gli mostri è stata creata con l’IA di Google. I nomi dei modelli cambiano ogni pochi mesi. La struttura di un buon prompt no, ed è per questo che il resto della guida è costruito attorno a quella.
Prompt fotografici Gemini per risultati realistici
Il realismo nasce dal linguaggio fotografico, non dall’aggiungere “realistic, 8K, hyper detailed” in fondo a una frase. Specifica l’attrezzatura, la luce e i vincoli. Il nostro modello fotografico:
Soggetto ed espressione + luogo + obiettivo e diaframma + sorgente di luce e direzione + color grading o pellicola + formato
Se questo vocabolario ti è nuovo, eccolo in breve. Il numero dopo f/ è il diaframma: un valore basso come f/1.4 sfoca lo sfondo, uno alto come f/8 mantiene nitida tutta l’immagine. I millimetri indicano l’obiettivo: un 24mm è abbastanza largo per inquadrare una stanza, un 85mm valorizza un volto. La sensibilità alla luce del sensore (ISO) è un’altra ghiera, e alzarla aggiunge grana alle foto notturne. Un fondale continuo (in inglese “seamless”) è un fondo di carta uniforme senza giunture visibili dietro il soggetto. Non serve scattare foto per usare queste parole, basta sceglierle per descrivere l’immagine che hai in mente. I testi dei prompt restano in inglese, come li usiamo davvero; Gemini li capisce altrettanto bene se li scrivi in italiano.
| Inquadratura | Prompt |
|---|---|
| Ritratto naturale | A candid half-length portrait of a woman in her thirties in a linen shirt, laughing and glancing off-camera, in a cafe with a blurred window behind her. Shot on an 85mm lens at f/1.4, natural side light from the left, warm skin tones, fine film grain, no retouching gloss. Vertical 4:5. |
| Headshot in studio | A tight editorial headshot of a man with close-cropped grey hair against a mid-grey seamless backdrop, direct gaze, slight smile. One large softbox high and to camera-right with a subtle fill card below, 105mm lens at f/5.6, visible skin texture, neutral white balance. Vertical 4:5. |
| Macro di prodotto | A stainless steel watch crown filling the frame, machining marks and micro-scratches visible, single hard key light raking across the metal from the right, black seamless backdrop. Macro lens at f/8, focus stacked, cool neutral white balance. Square 1:1. |
| Paesaggio | A wide basalt coastline under breaking storm clouds at first light, long exposure smoothing the surf into soft white bands. Shot on a 24mm lens at f/11, tripod, graduated exposure, muted cold palette, high tonal separation in the mid-greys. Ultrawide 21:9. |
| Interni | An empty modern office corner at mid-morning, pale oak floor, one linen armchair, tall window casting hard-edged light shapes across the wall. Shot on a 17mm tilt-shift lens at f/8, verticals corrected, natural light only, low-contrast neutral grade. Horizontal 16:9. |
| Cibo | An overhead flat lay of a bowl of ramen on a dark ceramic tile, steam rising, chopsticks resting on the rim, scattered scallion and chili oil beads. Diffused window light from the top left, 50mm lens, natural shadows, no props clutter. Square 1:1. |
| Street | A rain-slicked city crosswalk at night, a single figure with an umbrella mid-stride, neon signage reflected in the puddles. Shot on a 35mm lens at f/2, high ISO grain, mixed tungsten and neon color cast, motion blur only on the background traffic. Horizontal 16:9. |
| App in uso | A person on a commuter train holding a phone at a natural angle, screen glow lighting their face, blurred window landscape streaking past. 35mm lens at f/2.8, available light only, the phone screen left blank grey for a UI composite. Vertical 9:16. |
Quattro errori frequenti e come correggerli:
- Pelle di plastica. Aggiungi “visible skin texture and pores, natural blemishes, no beauty retouching” e indica luce naturale invece di luce da studio.
- Luce impossibile. Indica una sola sorgente di luce e la sua direzione. Più indicazioni in conflitto producono l’effetto di un fotomontaggio.
- Tutto a fuoco. Le foto vere hanno un piano di messa a fuoco. Indica il diaframma e cosa deve essere nitido: “sharp on the eyes, background falling off at f/1.8”.
- Testo sullo sfondo e mani confuse. Scrivi in parole semplici cosa escludere: “no signage text, no visible logos, hands out of frame”. Gemini non ha un campo separato per il prompt negativo, quindi le esclusioni vanno nella frase.
Se queste foto finiscono in annunci social a pagamento o nelle creatività per gli store, collegale alla misurazione prima di aumentare il budget. I nostri articoli sui KPI delle app da monitorare e su Adjust contro AppsFlyer coprono il lato dell’attribuzione nei test creativi.
La formula di prompt che funziona
La guida ai prompt di Google è esplicita su un punto: descrivi la scena in frasi invece di elencare parole chiave scollegate. Il modello legge il significato, non abbina tag.
La formula che usiamo ha sette caselle:
Soggetto + azione + ambientazione + stile o mezzo + luce + fotocamera e composizione + formato
Ecco la stessa idea scritta male e scritta bene:
| Versione | Prompt |
|---|---|
| Elenco di parole chiave debole | coffee cup, desk, nice lighting, 8K, professional |
| Prompt costruito con la formula | A matte ceramic espresso cup resting on a scratched walnut desk beside an open notebook, steam curling into a shaft of low morning light from a window on the left. Editorial product photography, shallow depth of field, warm neutral palette, shot on a 50mm lens at f/1.8, negative space on the right for a headline. Horizontal 16:9. |
Il secondo dà al modello un soggetto, una direzione della luce, un obiettivo, un vincolo di layout e un formato finale. Per questo ottieni un risultato utilizzabile invece di uno generico.
Due abitudini che migliorano subito la percentuale di successo:
- Di’ a cosa serve l’immagine. Frasi come “Leave the upper third empty for a headline” o “product must be fully inside the safe area for a vertical story” vengono rispettate più spesso di quanto ti aspetti.
- Itera nella stessa conversazione. Gemini supporta modifiche su più turni, quindi “keep everything, change the cup to a glass tumbler” mantiene la composizione. Una chat nuova perde l’atmosfera.
25 esempi di prompt per immagini Gemini
Incollali così come sono, poi rifiniscili in conversazione. Sono raggruppati in base al compito che l’immagine deve svolgere.
Concept di brand e storytelling emotivo
Usali quando il prodotto è poco spettacolare ma la promessa no.
| Prompt | Perché funziona |
|---|---|
| A massive ancient stone archway standing perfectly intact in the middle of a swirling misty landscape at sunrise, faint warm glow on the stone. Cinematic, deep focus, volumetric light, muted earth palette. Horizontal 16:9. | Mostra stabilità nel caos senza la solita foto stock della stretta di mano. Per assicurazioni, fintech, sicurezza. |
| A glowing geometric wireframe structure assembling itself mid-air inside an infinite dark void, cool electric blue emission, trailing particles where new edges snap into place. Futuristic digital art, high contrast, 4K. | Si legge come innovazione e sistemi che si costruiscono da soli. Ottimo come immagine principale per un lancio. |
| A person on a windy beach with arms outstretched, dissolving into hundreds of translucent colored ribbons blowing out to sea. Dreamlike, artistic motion blur, pastel palette, soft backlight. Vertical 4:5. | Libertà e liberazione, abbastanza astratta da evitare problemi di casting. |
| A single crystal-clear raindrop resting on the tip of a vibrant green leaf after a storm, water beading on the leaf surface. Hyper-realistic macro photography, high contrast, natural window light, black background. Square 1:1. | Chiarezza e precisione per prodotti minimalisti e studi di design. |
| A tight aerial view at dusk of dozens of small warm window lights glowing through a fog-covered valley, the lights forming an intricate connected pattern. Moody high-angle composition, deep blue and amber palette. Horizontal 16:9. | Community ed effetti di rete. Adatta a telecomunicazioni, marketplace, non profit. |
Visual di prodotto e mockup
| Prompt | Perché funziona |
|---|---|
| A vintage hand-stitched leather camera bag floating weightlessly in a zero-gravity studio, surrounded by perfect spheres of colored liquid, rolled paper maps and instant photos drifting nearby. Diffused white light, hyper-realistic render, seamless light-grey backdrop. Square 1:1. | Lusso e avventura insieme, e gli oggetti sospesi danno margine per il ritaglio. |
| A rugged hiking boot planted on a moss-covered stalagmite deep inside a crystal-lined cavern, a narrow sunbeam cutting through a hole in the ceiling and hitting the boot. Cinematic adventure photography, volumetric god rays, damp textures. Horizontal 16:9. | Mostra la resistenza con l’ambiente, non con il testo. |
| A glass dome shielding a single steaming cup of herbal tea from a downpour of giant iridescent shards, the tea perfectly still. High-speed photography look, macro lens, sharp focus on the rising steam, dark background. Vertical 9:16. | Protezione e calma, perfetta per un annuncio in formato storia. |
| A high-performance electric scooter parked in a field of tall yellow wheat with minimalist solar arrays on the far horizon at golden hour. Analog film grain, wide cinematic framing, warm naturalistic color. Ultrawide 21:9. | Unisce tecnologia sostenibile e nostalgia, con un taglio da banner. |
| A matte black wireless earbud charging case on a sun-drenched Paris cafe table, the whole image rendered in swirling thick impasto brushstrokes in the palette of Vincent van Gogh. Oil on canvas texture, visible knife marks. Square 1:1. | Il cambio di stile rende memorabile un prodotto comune in un feed affollato. |
Illustrazione e cambio di stile
| Prompt | Perché funziona |
|---|---|
| A mesh router rendered as an intricate blue-and-white mid-century modern architectural blueprint, internal components drawn as labelled abstract diagrams. Clean line work, technical illustration style, white background. Horizontal 16:9. | Trasmette rigore ingegneristico per pagine B2B e di infrastruttura. |
| A bustling 16-bit isometric pixel-art city where each building is a piece of software, a spreadsheet tower, a chat-app block, a database vault, with one tiny avatar climbing the tallest one. Retro limited palette, crisp pixel edges. Square 1:1. | Un linguaggio visivo familiare a sviluppatori e gamer. |
| A minimalist reusable steel water bottle depicted as a detailed Ukiyo-e woodblock print, a towering stylized wave behind it and a silhouetted figure holding it in the foreground. Hand-carved texture, indigo and vermilion Edo palette. Vertical 2:3. | Tradizione e sostenibilità senza nemmeno un’icona a foglia. |
| An abstract Bauhaus poster built from circles, triangles and hard rules in primary red, blue and yellow, with one short line of sans-serif copy reading “Function First”. Flat graphic design, high saturation, generous margins. Vertical 4:5. | Mette alla prova la tipografia del modello restando coerente con il brand di prodotti orientati al design. |
Testo nell’immagine, poster e packaging
Sono i prompt per cui Nano Banana Pro vale il suo prezzo.
| Prompt | Perché funziona |
|---|---|
| A minimalist event poster on textured off-white stock, large geometric sans-serif headline reading “GROWTH LOOPS”, subhead “A one-day workshop, 14 March”, small logo lockup bottom left, single flame-orange accent shape. Flat print design, subtle paper grain. Vertical 2:3. | Più righe di testo leggibile e una gerarchia, in un solo passaggio. |
| A matte black supplement pouch standing on a dark stone slab, front label reading “DAILY FOCUS” in clean uppercase with a small ingredient list beneath, soft rim light from behind, faint reflection on the stone. Studio packaging photography. Square 1:1. | Una bozza di packaging da mostrare al cliente prima di pagare il lavoro sulla fustella. |
| A three-step process infographic on a deep navy background, each step a numbered circle with a short label, “Capture”, “Enrich”, “Activate”, connected by a thin flowing line, muted teal and amber accents. Clean vector style, no clutter. Horizontal 16:9. | Diagrammi con etichette vere, il punto debole storico delle immagini IA, ora risolto. |
| A dark UI-style comparison card with two columns headed “Manual” and “Automated”, four short bullet rows in each, checkmarks in the right column, thin dividers, soft glow behind the winning column. Modern product-marketing graphic. Horizontal 16:9. | Grafiche di confronto delle funzioni per le landing page, senza uno strumento di design. |
Creatività per social e annunci
| Prompt | Perché funziona |
|---|---|
| A bold central subject cropped mid-motion so it breaks the top edge of the frame, exaggerated wide-angle perspective, clashing saturated color blocks behind it. Designed for vertical 9:16 with the focal point in the upper third. | Pensata per fermare il pollice in un feed verticale, non ridimensionata dopo. |
| A calm professional scene with a single symbolic object placed left of center, wide clean negative space to the right, muted corporate gradient background, restrained cool palette. Horizontal 16:9. | Un’immagine principale B2B credibile per webinar, report e copertine di white paper. |
| A wide breathable hero composition with a strong subject on the right third and empty soft-gradient space on the left, gentle top-down lighting, modern UI-friendly color temperature. Ultrawide 21:9. | Per i layout della parte alta della pagina, dove testo e modulo hanno bisogno di spazio. |
| One scene split vertically down the middle: left side cluttered, grey and chaotic, right side ordered, bright and spacious, a faint seam running between them. Ultra-wide cinematic composition. Horizontal 16:9. | Prima e dopo in un solo fotogramma, comprensibile anche senza audio. |
Se produci per un account pubblicitario attivo, volume e cadenza contano quanto il design. Esegui il Creative Velocity Audit gratuito per verificare se esce davvero abbastanza creatività nuova ogni settimana perché l’account continui ad apprendere.
Visual di dati e infografiche concettuali
| Prompt | Perché funziona |
|---|---|
| A polished chrome kinetic sculpture shaped as an infinity loop, its surface etched with faintly glowing lines suggesting data flowing through a continuous process. Dramatic studio lighting, highly reflective, dark seamless background. Square 1:1. | Efficienza astratta per prodotti di processi e workflow. |
| An illuminated three-dimensional cityscape built entirely from neon bar graphs and line charts, the tallest towers glowing red and green, one small figure watching from a high ledge. Cyberpunk aesthetic, deep black sky, 4K. | Immagini per analytics e business intelligence (BI) che non sono l’ennesima foto di un portatile con una dashboard. |
| A macro view of a topographical map sculpted from thick flowing pastel oil paint, deep blue valleys and bright gold peaks. Heavy impasto texture, macro lens, subtle bokeh at the frame edges. Horizontal 16:9. | Trasforma una metrica emotiva o esponenziale in un’immagine che viene salvata. |
Modifica delle immagini e formati
La generazione è la metà facile. È nella modifica che Gemini supera il metodo “scrivi il prompt e spera”.
Secondo la documentazione sulla generazione di immagini dell’API Gemini, puoi:
- Caricare una tua foto e modificarla in conversazione. Aggiungi, rimuovi o sostituisci elementi, cambia lo sfondo o lo stile dell’intera immagine in linguaggio naturale, su più turni.
- Combinare più input. Nano Banana Pro accetta fino a 14 immagini di riferimento. È così che inserisci una vera foto di prodotto in una scena generata, invece di sperare che il modello ricrei la confezione.
- Mantenere la coerenza. Nella stessa conversazione l’aspetto di personaggi e prodotti resta stabile tra un turno e l’altro, il che di fatto sostituisce i numeri seed offerti da Midjourney e Stable Diffusion. Chiedi “the same scene, same lighting, swap the product” invece di aprire una nuova chat.
- Scegliere esplicitamente il formato. Nell’app scrivilo nel prompt, nell’API impostalo come parametro. Il flag
--ardi Midjourney non fa parte della sintassi di Gemini.
L’API supporta dieci formati, che corrispondono bene ai canali:
| Formato | Dove si usa |
|---|---|
| 1:1 | Griglia Instagram, icone delle app, miniature |
| 4:5 e 5:4 | Post nel feed e annunci social a pagamento che sfruttano al massimo lo spazio verticale |
| 9:16 | Storie, Reels, TikTok, YouTube Shorts, screenshot per gli app store |
| 16:9 | Header del sito, miniature YouTube, slide di presentazione |
| 21:9 | Banner ultra larghi e fasce principali in alto nella pagina |
| 3:2, 2:3, 3:4, 4:3 | Ritagli in proporzione di stampa, layout editoriali, poster |
Su Nano Banana Pro puoi anche scegliere la risoluzione di uscita, fino al 4K, e questo conta appena il materiale va in stampa o in un’area principale su schermo retina.
Tre prompt di modifica che riusiamo continuamente
- Cambiare un elemento: “Keep the composition, lighting and grade exactly as they are. Replace the ceramic mug with a clear glass tumbler of iced coffee, matching the existing light direction and reflections.”
- Fare spazio al testo: “Extend the canvas to the left and keep the subject where it is, filling the new area with the same out-of-focus background so a headline fits.”
- Inserire il prodotto con una foto reale: “Using the uploaded packshot as the exact product reference, place it on the stone slab in the second reference image. Do not redraw the label.”
Livelli di accesso, limiti e piano necessario
Google limita la generazione di immagini per piano, non per funzione, e adegua i limiti in base alla domanda. Controlla i numeri aggiornati sulla pagina dei piani Google AI prima di legare il calendario di una campagna a una scadenza.
| Livello | Cosa ottieni (dal 2026) |
|---|---|
| Account Gemini gratuito | Generazione di immagini con Nano Banana con un piccolo limite giornaliero (circa 20 immagini al giorno) e accesso limitato al modello Pro. Basta per esplorare, non per chiudere una campagna all’ultimo minuto. |
| Google AI Pro | Limiti giornalieri di immagini molto più alti e un accesso più ampio a Nano Banana Pro. È il livello che serve alla maggior parte dei team marketing. |
| Google AI Ultra | I limiti più alti e l’accesso anticipato ai nuovi modelli di immagini, per la produzione in volume. |
| API Gemini e AI Studio | Generazione di immagini a consumo, con controllo programmatico di formato e risoluzione. Controlla il prezzo attuale per immagine sulla pagina dei prezzi dell’API Gemini. |
Due avvertenze da tenere a mente nella pianificazione: la disponibilità di modelli e funzioni specifici varia in base alla regione e al tipo di account, e Google cambia questa configurazione ogni pochi mesi. Non basare mai una consegna per un cliente su un limite giornaliero che non hai verificato nel prodotto quella stessa settimana.
Domande frequenti: generazione di immagini con Gemini
La generazione di immagini di Gemini è gratuita?
Sì, con dei limiti. Un account Google gratuito può generare immagini nell’app Gemini entro un limite giornaliero moderato (circa 20 immagini al giorno nel 2026), con accesso limitato al modello Pro di qualità superiore. Google AI Pro e Ultra alzano i limiti in modo considerevole. I numeri aggiornati sono sulla pagina dei piani Google AI.
Qual è la migliore struttura di prompt per foto realistiche?
Scrivi il soggetto e cosa sta facendo, poi il luogo, poi obiettivo e diaframma, poi una sorgente di luce con la sua direzione, poi il color grading o la pellicola, e infine il formato. Il lavoro lo fa il linguaggio fotografico, non parole come “8K” o “hyper detailed”.
Posso modificare le mie foto con Gemini?
Sì. Carica l’immagine e descrivi la modifica in parole semplici: sostituire lo sfondo, rimuovere un oggetto, cambiare lo stile, allargare la tela. Le modifiche avvengono su più turni, quindi puoi continuare a rifinire lo stesso materiale mentre il modello mantiene il resto della composizione.
Gemini aggiunge una filigrana alle immagini IA?
Ogni immagine creata dai modelli di Google porta una filigrana invisibile SynthID che la identifica come generata dall’IA, mentre le filigrane visibili dipendono dal piano e dall’interfaccia. Presumi che l’origine sia rilevabile e dichiara il materiale generato con l’IA dove lo richiedono la piattaforma, il contratto con il cliente o la legge locale.
Questi prompt funzionano anche in ChatGPT o Midjourney?
Per lo più sì. La struttura a sette caselle (soggetto, azione, ambientazione, stile, luce, fotocamera, formato) si trasferisce a tutti i principali generatori. Cambia solo la sintassi: Midjourney usa flag come --ar e numeri seed, mentre Gemini e ChatGPT usano entrambi la rifinitura in conversazione. Per una raccolta specifica per ChatGPT, il nostro articolo prompt ChatGPT da copiare per immagini d’effetto copre loghi, ritratti cinematografici, sfumature e mockup di prodotto con GPT Image.
Quale modello usare per immagini con testo?
Nano Banana Pro. Il testo nelle immagini è stato il punto debole cronico di ogni modello di immagini per tutto il 2024 e il 2025, ed è nel livello Pro che Google lo ha risolto. Per poster, etichette di packaging e diagrammi con etichette usa il modello più lento e costoso.
Il quadro generale
Il collo di bottiglia ora è la capacità di descrivere, non l’esecuzione. Se stai pianificando il volume creativo per il 2026, la nostra raccolta di statistiche sul marketing delle app mobili dà il contesto dei canali, e ottimizzazione per i motori di risposta, per i motori generativi e SEO a confronto spiega cosa succede ai contenuti quando le interfacce IA iniziano a decidere chi citare. Se vuoi che questo flusso di produzione funzioni come un sistema, inizia dai servizi di automazione IA. Se gli annunci hanno bisogno di video e foto originali, c’è video e fotografia. Se il problema è se le risposte IA nominino almeno il tuo brand, c’è l’ottimizzazione per i motori generativi.
Salva questa pagina. La aggiorniamo quando Google cambia davvero i suoi modelli di immagini, o quando la pagina risponde alla metà sbagliata della domanda.
Parla con noi