Una donna in abito nero che legge un libro su un divano in velluto rosso scuro in una stanza di biblioteca accogliente e poco illuminata con camino acceso, dipinto floreale e scaffali alti pieni di libri.
Foto diurna di un quartiere suburbano di Los Angeles che mostra un SUV bianco parcheggiato sulla strada davanti a case e palme.
Giovane donna con jeans corti e canottiera bianca appoggiata a un'auto rossa anni '50 in una strada cubana colorata a L'Avana con palazzi popolari pastello.
Una suggestiva vista aerea di una città romana situata in un paesaggio collinare italiano con sentieri di terra asciutta in primo piano, montagne sullo sfondo e l'oceano a sinistra sotto un cielo azzurro limpido.

Parametri Consigliati

samplers

Euler Normal, dpmpp 2m sgm uniform, dpmpp_2s_ancestral, euler, DPM++ SDE, 2M SDE Karras, DPM++ SDE Karras, DPM++ 2M

steps

4 - 40

cfg

2.5 - 7

resolution

1024x1024, 1536x1536

vae

ae.safetensors - unknown

Parametri Consigliati per Alta Risoluzione

upscale

1.5 - null

Suggerimenti

Puoi usare più passaggi per migliorare i dettagli più fini, ma l'output non cambia molto dopo 8 passaggi.

Se vuoi un output più ordinato/pulito, prova a incrementare la scala di guida (CFG).

Menzionare uno stile nel prompt può aiutare il modello a generare risultati migliori.

Prova ad aggiungere l'upscale latent per nodo, e scala il latent di 1.5 per generare immagini ad alta risoluzione.

Evita di usare termini di 'qualità' come 4K, 8K, capolavoro, alta definizione, alta qualità a meno che non sia necessario; può causare immagini troppo elaborate.

Per gli stili fotografici, evita termini come 'vibrante, intenso, brillante, alto contrasto, neon, drammatico' se desideri un aspetto naturale.

L'addestramento è stato fatto con kohya_ss/sd-scripts usando l'ottimizzatore pagedlion8bit.

Congelare i parametri 'time_in', 'vector_in' e modulazione ferma la 'de-distillazione'.

Evita di addestrare blocchi singoli oltre 15; imposta i blocchi da addestrare nella sezione FLUX.

Il learning rate 5e-6 addestra velocemente ma fermati dopo qualche migliaio di passi per evitare la corruzione dei blocchi.

Punti Salienti della Versione

Affinato per 5 settimane sulla mia 4090.

Sponsor del Creatore

Modello disponibile anche su: RunDiffusion e Runware.ai

Un enorme grazie a RunDiffusion per aver sponsorizzato il calcolo che ha reso possibile l'addestramento di questo modello!

Per accesso API, collabora con Runware.ai

PixelWave FLUX.1-schnell 04 - Apache 2.0!

File Safetensor: 💾BF16 💾FP8 💾bnb FP4

File GGUF: 💾Q8_0 🤗Q6_K 💾Q4_K_M

Link a 🤗VAE 🤗T5xxl 🤗CLIP L

Modello disponibile anche su: RunDiffusion e Runware.ai

PixelWave FLUX.1 schnell versione 04 è un affinamento estetico di FLUX.1-schnell. Le immagini usate per il training sono state scelte a mano per garantire un bias verso immagini accattivanti, con colori belli, texture e illuminazione.

  • Allenato sul modello schnell originale, quindi licenza Apache 2.0!

  • Nessun requisito speciale per l'esecuzione. Supporta FLUX LoRAs

  • Euler Normal, 8 passaggi.

Puoi usare più passaggi per migliorare i dettagli più fini, ma l'output non cambia molto dopo 8 passaggi.

Ringraziamenti a RunDiffusion

Un enorme grazie a RunDiffusion (co-creatori di Juggernaut) per aver sponsorizzato il calcolo che ha reso possibile l'addestramento di questo modello! Capire come allenare schnell senza de-distillare il modello ha richiesto molti esperimenti, e poter usare il cloud compute di RunDiffusion ha reso tutto molto più facile.

Per chi ha bisogno di accesso API per questo modello, collaboriamo con Runware.ai

Ho reso la versione FLUX.1-dev 04 esclusiva per RunDiffusion e Runware per ora. Quando rilascerò la versione 05 in futuro, prevedo di rendere pubblici i pesi dev 04.

Grato per il loro supporto nel far uscire questo modello, per favore date loro un'occhiata!

Addestramento

L'addestramento è stato fatto con kohya_ss/sd-scripts. Puoi trovare il mio fork di Kohya qui, che contiene anche modifiche al modulo sd-scripts; assicurati di clonare entrambi.

Usa la scheda fine tuning. Ho trovato i migliori risultati con l'ottimizzatore pagedlion8bit che può anche girare sulla mia GPU 4090 24GB. Altri ottimizzatori facevano fatica ad apprendere qualcosa.

Ho congelato i parametri time_in, vector_in e mod/modulation. Questo ferma la 'de-distillazione'.

Evito di addestrare blocchi singoli oltre 15. Puoi impostare quali blocchi addestrare nella sezione FLUX.

LR 5e-6 addestra velocemente, ma devi fermarti dopo qualche migliaio di passi perché inizia a corrompere i blocchi e rallentare l'apprendimento.

Puoi poi fare un block merge con un checkpoint precedente, sostituendo i blocchi corrotti, e continuare l'addestramento.

Segni di blocchi corrotti: texture a carta su molte immagini, perdita di dettagli sullo sfondo.

Contatti

Per richieste commerciali o di business, contattaci a pixelwave@rundiffusion.com. Licenze per flux fine tune. Progetti di addestramento personalizzati. Sviluppo commerciale AI. Il team può fare tutto!

PixelWave Flux.1-dev 03 raffinato!

File Safetensor: 💾BF16 💾FP8 💾NF4

File GGUF: 💾Q8_0 🤗Q6_K 💾Q4_K_M

Link a 🤗VAE 🤗T5xxl 🤗CLIP L

I file 'diffusers' sono in realtà le versioni GGUF Q8_0 e Q4_K_M. File GGUF disponibili anche su Huggingface.

Ho affinato la versione 03 partendo da FLUX.1-dev per oltre 5 settimane sulla mia 4090. È capace di diversi stili artistici, fotografia e anime. Trucco che ho scoperto per aiutare con LoRAs.

Ho usato dpmpp 2m sgm uniform 30 passi per le immagini di presentazione. Se vuoi un output più ordinato/pulito, prova a incrementare la guida. Anche menzionare uno stile può aiutare, così il modello non deve indovinare.

Consiglio anche di aggiungere l'upscale latent per nodo, e scalare il latent di 1.5, ad es. generare un'immagine 1536x1536 invece di 1024x1024.

PixelWave Flux.1-schnell 03

File Safetensor: 💾FP8 💾NF4

File GGUF: vai su Huggingface

Ho usato dpmpp 2m sgm uniform 8 passi per le immagini di presentazione.

Puoi iniziare con 4 passi, ma ci sono meno errori di anatomia se usi più passi.

PixelWave Flux.1-dev 02

File Safetensor: 💾BF16 💾FP8

File GGUF: 💾Q8_0 🤗Q6_K 💾Q4_K_M

La versione 02 ha notevolmente migliorato immagini nere e scure, e output più affidabili con meno problemi alle mani.

Consiglio dpmpp_2s_ancestral, beta, 14 passi. O euler, simple, 20 passi.

Nodi ComfyUI-GGUF

PixelWave 11 SDXL. Modello a scopo generale affinato. Ottimo per stili artistici e fotografici.

Uso 20 passi, DPM++ SDE, CFG 4 a 6 oppure 40 passi, 2M SDE Karras

Versione accelerata - oltre 5 passi, DPM++ SDE Karras, 2.5 CFG

Consigliato PAG⚡Consiglio scala 1.5, con CFG 3. Link al workflow

🔗Link alla galleria estesa 🖼️

⭐Guida al prompting.⭐ Non è necessario usare termini di 'qualità' come 4K, 8K, capolavoro, alta definizione, alta qualità, ecc. A meno che tu non voglia, consiglio di non usare parole come 'vibrante, intenso, brillante, alto contrasto, neon, drammatico' per stili fotografici se desideri un aspetto più naturale. Questo può far sembrare le immagini 'strapreparate', ma è solo il CLIP che segue il prompt. 🙂 Se invece vuoi foto vibranti e al neon, PixelWave li fornirà!

L'obiettivo della versione 10 era allenare i modelli CLIP, il che migliora l'affidabilità, ti assicura di poter generare una vasta gamma di stili e una migliore capacità di seguire i prompt.

Grazie ai miei amici che hanno aiutato nei test: masslevel, blink, socalguitarist, klinter, wizard whitebeard.

Guida: migliorare le immagini con LM Studio e Mikey Nodes

Guida: aggiungere dettagli alle immagini usando il metodo skip step

Non serve il modello refiner.

Questo modello non è una combinazione di altri modelli.

Ho anche creato Mikey Nodes che contiene molti nodi utili. Puoi installarlo tramite comfy manager.

Precedente
Artify´s Fantastic Flux Landscape Lora - artilands_v1.0
Successivo
Project0* - v4.0 Art_Realism_FP8

Dettagli del Modello

Tipo di modello

Checkpoint

Modello base

Flux.1 D

Versione del modello

FLUX.1-dev 03

Hash del modello

49b429b788

Creatore

Discussione

Per favore log in per lasciare un commento.

Immagini di PixelWave - FLUX.1-dev 03

Una donna in abito nero che legge un libro su un divano in velluto rosso scuro in una stanza di biblioteca accogliente e poco illuminata con camino acceso, dipinto floreale e scaffali alti pieni di libri.
Foto diurna di un quartiere suburbano di Los Angeles che mostra un SUV bianco parcheggiato sulla strada davanti a case e palme.
Giovane donna con jeans corti e canottiera bianca appoggiata a un'auto rossa anni '50 in una strada cubana colorata a L'Avana con palazzi popolari pastello.
Una suggestiva vista aerea di una città romana situata in un paesaggio collinare italiano con sentieri di terra asciutta in primo piano, montagne sullo sfondo e l'oceano a sinistra sotto un cielo azzurro limpido.

Immagini con anime

Un fiore rosso dettagliato con foglie nere e dorate si fonde in uno sfondo astratto cosmico di costellazioni, motivi dorati e neri a vortice con particelle di luce.
Una giovane donna in stile anime in piedi in una strada cittadina illuminata al neon, frammentata da glitch art digitale con tonalità vivaci di rosa e blu.
Il personaggio Toadette in un outfit rosa da arti marziali è in una posizione di combattimento dinamica a piedi nudi su un grande fungo in una foresta di funghi con un'espressione determinata.
Kirishima Touka di Tokyo Ghoul sdraiata sul pavimento con capelli viola e occhi rossi, circondata da vivaci gigli ragno rossi su sfondo bianco con macchie di sangue.
Illustrazione in stile anime di Asuka Langley da Neon Genesis Evangelion con capelli arancioni legati in più ciocche e occhi azzurri, che sorride e siede a terra indossando una tuta rossa parzialmente aperta contro un muro cibernetico grigio crepato.
Ritratto digitale in primo piano di una giovane donna con capelli corti rosa e occhi eterocromi che indossa un elmo futuristico bianco e oro su sfondo rosa uniforme.
Silhouette di una figura solitaria che cammina su un molo bagnato verso un faro luminoso con una grande luna e uno sfondo nebbioso in stile cyberpunk.
Una ragazza angelo con capelli gialli, aureola e grandi ali bianche che suona una chitarra elettrica sotto un cielo notturno stellato con note musicali luminose che fluttuano verso l'alto.
Primo piano di un cyborg invecchiato con metà volto meccanico, occhio blu luminoso, tatuaggio a codice a barre sulla tempia, barba bianca e parti meccaniche arrugginite, su sfondo nero.
Immagine in stile anime di una ragazza con lunghi capelli arcobaleno seduta a gambe incrociate su un tronco muschioso, che accarezza dolcemente un grande lupo bianco che riposa la testa sulle sue ginocchia, circondata da una foresta antica nebbiosa con funghi luminosi.

Immagini con modello base

Scena fotorealistica di personaggi non morti tra zombie e scheletri che camminano attraverso un cimitero spettrale illuminato da jack-o'-lantern luminosi sotto un cielo scuro e minaccioso.

Immagini con arte digitale

Profilo laterale di un cyborg usurato con volto meccanico a metà, occhio che brilla di blu, barba bianca e tubi illuminati su sfondo scuro.
Opera digitale di una figura umanoide d'oro frantumata con occhi luminosi circondata da schegge di vetro rotto e candele accese in un'atmosfera oscura e inquietante.
Disegno digitale di una ragazza accovacciata con fumo rosa fluente sopra la testa, su uno sfondo blu tenue.
Una enorme torre AI a forma di volto umano con griglie di scansione rosse luminose e il testo '6VIDIT9' su uno schermo olografico, che domina una strada piovosa di una città futuristica con sentinelle robotiche e persone che camminano.
Una ragazza robot luminosa con capelli lunghi bianchi e occhi blu, seduta su un pilastro alto in uno sfondo di foresta oscura, con articolazioni danneggiate e armatura strappata illuminate da colori luminescenti.
Schermo di un monitor in un laboratorio informatico oscuro che mostra testo in stile matrix con la scritta 'CIVITAI - Taking the Stable out of Stable Diffusion one update at a time' con codice verde retrò che cade verso il basso.
Albero di susino coperto di neve con fiori rosso vivo che si erge su una scogliera sotto un cielo grigio, reso nello stile di Yoshitaka Amano con illuminazione chiaroscuro drammatica.
Una guerriera futuristica femminile che indossa una tuta gialla texturizzata, in piedi tra due figure umanoidi robotiche bianche in un ambiente minimalista.
Ritratto foto-realistico di una donna con vivaci capelli arancioni acconciati in due chignon e lunghe trecce, occhi azzurri intensi, pittura floreale sul viso e raffinato abito nero e oro.
Arte digitale dai colori vivaci che mostra una ragazza elfa fantasy dai capelli rossi con occhi blu posata dinamicamente su un albero, brandendo un pugnale, circondata da uno scenario forestale vivido e luce solare brillante.

Immagini con fotografia

Una ragazza cyborg futuristica con capelli luminosi bianchi al neon e arti meccanici è seduta a gambe incrociate sul terreno, illuminata da una luce cinematografica con uno sfondo urbano scuro e stellato.
Figura a tutto corpo che indossa una felpa arancione e pantaloni jogger neri con una maschera emoji con faccia annoiata, in piedi di lato in uno spazio aperto minimalista con figure sfocate in movimento intorno.
Una ragazza robot futuristica con pelle metallica e una treccia bionda si trova sulla superficie della luna, tenendo una stella luminosa con la Terra e una grande luna sullo sfondo sotto un cielo stellato.
Uomo con pantaloncini di jeans e canottiera bianca che beve una lattina di birra mentre spinge un tosaerba in un cortile suburbano con recinzione bianca, bandiera americana che sventola e un golden retriever che rincorre una palla.
Ritratto realistico e molto dettagliato di Pikachu a corpo intero con illuminazione cinematica, mostrato a fuoco nitido su uno sfondo scuro.
Bella cameriera bionda con occhi azzurri e capelli corti in un dettagliato abito da cameriera bianco e nero, in piedi vicino a una finestra con vista sulla città di Tokyo.
Ritratto ravvicinato di un'eccezionale Ghiandaia all'alba con piume dettagliate, cresta blu vibrante e occhio acuto con leggero effetto mosso.
Donna bionda con lentiggini e sorriso seduta all'aperto con maglietta bordeaux a scollo a v e microskirt floreale sotto luce naturale
Nonno con capelli grigi e donna con coda di cavallo alta e capelli grigi in una piscina turchese con un cane bianco e un canguro vicino a pareti rosa
Architettura moderna scura e cupa con strutture in cemento a gradini illuminate da un bagliore arancione caldo di notte.

Immagini con arte tradizionale

Una ragazza determinata che indossa un mantello bianco con cappuccio si accovaccia in un vicolo stretto tenendo una spada che illumina il terreno con una luce drammatica, dipinto in uno stile tradizionale.
Una sicura guardia romana femminile che indossa un'armatura da battaglia in bronzo finemente dettagliata, in piedi in una strada cittadina storica durante il giorno.
Dipinto a inchiostro orientale che rappresenta cascate drammatiche che scorrono tra scogliere montuose aspre con atmosfera nebbiosa e calligrafia lieve
Un gatto calico seduto serenamente tra vivaci fiori in stile acquerello giapponese sotto un grande sole rosso con eleganti effetti a inchiostro.
Primo piano di una ragazza con capelli lucenti e pelle chiara, occhi chiusi.
Ragazza anime con capelli lunghi biondi in uniforme scolastica giapponese tradizionale con fiocco blu
Una tigre bianca e una ragazza in abiti tradizionali su uno sfondo di montagna nebbioso. Immagine generata da AI usando stable diffusion.
Una scena drammatica con un samurai solitario in piedi sull'acqua, di fronte a una tradizionale pagoda giapponese in lontananza sotto un cielo tempestoso con nuvole vorticosi e nebbia, generata usando Stable Diffusion.
Immagine generata da AI usando Stable Diffusion di una bellissima donna vestita in abito tradizionale cinese con capelli fluenti, abbigliamento antico dettagliato e uno sfondo orientale sereno con una pagoda e fogliame.