Tponynai3 - v55
Parole Chiave e Tag Correlati
Immagini in evidenza
Prompt Consigliati
score_9,score_8_up,score_7_up
score_9,score_8_up
Prompt Negativi Consigliati
score_4,score_3,score_2,worst quality, bad hands, bad feet
score_3,score_2,ugly,bad feet
Parametri Consigliati
samplers
steps
cfg
clip skip
resolution
other models
Parametri Consigliati per Alta Risoluzione
upscaler
upscale
steps
denoising strength
Suggerimenti
Usa high-fix a risoluzione moderata per i migliori risultati.
Prova style_3 o 4 per migliorare i dettagli degli occhi.
Punti Salienti della Versione
Questa versione è un’ottimizzazione della 5.1, migliorando dettagli degli occhi, ragionevolezza dei piedi, sensibilità ai prompt e congruenza delle sovrapposizioni di arti. Tuttavia il trattamento luci e ombre non ha ancora raggiunto le mie aspettative; nei test uso style_4 che rende l’immagine più scura, forse soluzione temporanea. Ho fatto ulteriori allenamenti perché il training diretto non dava risultati soddisfacenti, sprecando un po’ di tempo. Se avete altri problemi, fatemelo sapere nei commenti!
This version is an optimization to 5.1, optimizing the details of the eyes, the rationality of the feet, the sensitivity to cues, and the rationality of limb overlap. In my tests, the use of style_4 made the picture darker, perhaps a short-term solution, and I used some additional training, because the direct training did not work so well, so I wasted some time. If you have more questions, please be sure to let me know in the comments section!
Sponsor del Creatore
[Non certificato]Tonade sta creando il modello T-ponynai3, ID c-station: Tonade, | Aifadian (afdian.net)
Questo è il canale di sponsorizzazione su Aifadian, se trovate il modello utile e avete la possibilità, potete supportare! Non forzate, grazie di ogni supporto, continueremo a migliorare il modello!
929721518 è il numero del piccolo gruppo QQ personale, per qualsiasi domanda riguardante tpony potete entrare qui a chiedere. Ricordate di segnare c-station哦
Il modello ha già VAE incorporato, non è necessario aggiungere VAE aggiuntivo
The model already has included vae, there is no need to add additional vae
La strategia migliore per generare le immagini è risoluzione moderata con high-fix, invece di usare direttamente la risoluzione alta
La migliore strategia per generare è usare high-fix a risoluzione moderata, piuttosto che direttamente output ad alta risoluzione
[Non certificato]Tonade è l'autore del modello T-ponynai3, ID c-station: Tonade, | Aifadian (afdian.net)
Questo è il canale di sponsorizzazione su Aifadian, se trovate il modello utile e volete supportare, siete i benvenuti! Non forzate, grazie per ogni vostro supporto, continueremo a esplorare come migliorare il modello!
(33) T-ponynai3-v5 - (versione con pesi modificati) | Stable Diffusion Checkpoint | Tusi tusi.cn (tusiart.com) tusiart (versione cinese tensor) link per generazione online
(Poiché il modello può esistere solo sia su Tusi che su Tensor simultaneamente, è meglio usarlo su Tusi. Se ci sono problemi nell’uso, fatemeli sapere)
Versione v5 ha aggiunto 4 nuovi style, che possono essere usati da style_1 a style_4 per affinare i dettagli dell'immagine (teoricamente, ma l’effetto reale è piuttosto mistico)
La versione V5 ha aggiunto 4 nuovi stili, usabili per raffinare i dettagli dell'immagine con style_1 a style_4 (teoricamente così, ma l’effetto è più mistico o minore)
Questo modello supporta perfettamente i modelli lora allenati su ponyv6 come base, e le lora di ani3 e sdxl1.0 sono parzialmente compatibili
This model perfectly supports lora trained with ponyv6 as the base model, and the Lora of ani3 and sdxl1.0 can also be adapted to some extent.
Test di image inpaint basato sulla v4.1 (questa parte era stata trascurata nelle versioni precedenti)
Image inpaint testing based on v4.1 (this is a previously overlooked part)
pony è il dio, compatibilità perfetta. Questo modello supporta le lora di ani e pony
Parole chiave indispensabili e anteprime positive simili a ponydiffusion
positive:(score_9,score_8_up,score_7_up,score_6_up,score_5_up,score_4_up)
OPPURE (score_9,score_8_up,score_7_up)
Negativo opzionale:
negative: (score_4,score_3,score_2,score_1),
È possibile aggiungere parole negative normali nella serie nai, ad esempio:
negative: worst quality, bad hands, bad feet
Spero vi piaccia ᕕ(◠ڼ◠)ᕗ basato su nai3 e ponyv6
Istruzioni di allenamento: v1 ha utilizzato 94 immagini, v2 119, v3 348, v3.5 474, immagini generate da nai3, la lora allenata è integrata nel modello base per il fine tuning, tutti i tag degli artisti supportati da ponyv6 sono supportati, l’uso di più di due tag può causare crash dello sfondo, attualmente rilevati personaggi di Genshin Impact, altri non noti. Non ho testato molto questo modello, ammiro la sua riproduzione dello stile di disegno di nai3. Il modello base è fusione di T-anime-xl, ponyv6 e ani3, non ancora rilasciato.
La scheda grafica usata per l'allenamento è la mia 3090, v1-v3 hanno richiesto rispettivamente 7, 12, 35 e 47 ore
Istruzioni di allenamento: Merge Lora ha utilizzato 94 immagini per v1, 119 per v2, 348 per v3, 474 per v3.5, generate da NAI3 per allenare il modello base fine tuning, Pony supporta tutti i tag artisti di ponyv6, ma nessun tag aggiuntivo da nai3. Usare più di due tag artisti può causare crash dello sfondo. Al momento sono stati trovati personaggi generabili di Genshin Impact. Non conosco altri. Non ho testato molto questo modello. Ammirate la riproduzione dello stile di pittura di NAI3. Il modello base è una fusione di T-anime-xl, ponyv6 e ani3 non ancora rilasciata.
La scheda grafica usata è una 3090 personale, utilizzata per 7, 12, 35 e 47 ore da v1 a v3.5.
v1
Un tentativo interessante
An interesting attempt
v2
Su base v1 il set di allenamento è stato leggermente aumentato, con circa 30 ore di trial ed errore. Lo stile ottenuto ha però ancora un po' di overfitting, come doppio ombelico e capelli disordinati
On the basis of v1, the training set was slightly increased and went through about 30 hours of trial and error, but the trained art style still had some overfitting, such as double navel eyes and messy hair
v3
Gli arti di v3 sono migliori di quelli di v2. Per footfocus, v3 può generare piedi con un impatto visivo maggiore e prospettive più complesse. L'effetto AI nei capelli di v3 è meno marcato perché v2 aveva pochi dati, causando overfitting e doppio ombelico occasionalmente sparito in v3. Nel complesso, un training triplo rispetto a v2 e parametri dimensionali maggiori rendono lo stile più naturale e più performante con prompt lunghi.
The limbs of v3 are better than those of v2. In terms of understanding footfocus, v3 can generate feet with greater visual impact and higher difficulty perspective. The AI feeling of v3's hair is also weaker than that of v2, because v2 has too little training set, so the hair part may be slightly overfitting, and the occasional double navel eyes that appear in v2 are also gone. Overall, three times the size of the v2 training set and a larger dim parameter make the art style fit more natural, and the performance is much stronger than v2 under long prompts.
v3.5
In questa versione i requisiti per le parole qualità non sono così rigidi, si può anche non usare le parole di qualità basate sul punteggio estetico di pony, però nei test qualche volta compaiono blocchi di colore senza senso; basta sostituire le parole di qualità estetica con quelle standard comuni, tipo score_1 e score_2 con worst quality. Ho aggiunto circa 150 immagini per bilanciare e arricchire lo stile, riducendo la pendenza iniziale della curva di apprendimento, rendendo il modello meno overfit e più adattabile a lora e prompt fantasiosi. Complessivamente questa versione è più libera di v3 e rafforza la resa maschile, con colori e stile meno vivaci e appiccicosi.
In this version, the requirements for quality words are not so strict, you can completely not to use the quality words of pony's aesthetic score to plot the picture, and occasionally there will be a situation where the picture generates meaningless color blocks in the test, you only need to replace the quality words of the aesthetic score with 1.5 commonly used quality words, such as score_1, score_2 replace it with worst quality. In this version, I added about 150 more training sets to balance and enrich the art style, and reduced the initial slope of the learning curve, which makes this model less overfitted and can be adapted to more lora and whimsical prompts. Overall, this version is a freer version than the v3 version, and this version is much stronger than the v3 version, and the colors and style of painting under some hints are not so bright and greasy.
v4
Questa versione ha usato 798 immagini per l'allenamento con una 3090 per 90 ore. Rispetto a v3.5, la composizione e la resa di alcune parti, come l’ombra delle dita e sovrapposizioni corporee, sono più accurate. Come prompt ho privilegiato lunghezza media o corta, poiché nessuno vuole scrivere prompt lunghissimi per immagini di qualità. Rimuovendo il prompt qualità basato sul punteggio estetico di pony, la qualità è migliorata molto rispetto a v3.5, con un effetto più piatto e meno tridimensionale, più vicino allo stile anime classico. Il testing sull’effetto del numero di immagini per il fine tuning su ponyv6 è quasi finito. Prossimo passo: lavorare sulle etichette prompt per aggiungere più prompt regolabili nel limitato materiale di allenamento di pony, ad esempio includendo il punteggio estetico, poiché attualmente la logica usa parole di qualità mainstream per coprire i prompt estetici di pony. Continuerò anche ad aggiungere nuovo materiale, come scene e più immagini di piedi (il materiale dei piedi in v4 pare un po’ scarso).
This version used 798 images as training materials and trained for 90 hours using a 3090 graphics card. This version has a more accurate composition and depiction of certain parts in certain prompts compared to v3.5, such as ghosting of fingers and overlapping of some body parts. In terms of prompts, my main training goal is to use medium and slightly shorter prompts, as nobody likes to write a long string of prompts to generate high-quality images, right? After removing the quality prompt of Pony's aesthetic score, the image quality has been significantly improved compared to v3.5, and the resulting quality tends to be more flat rather than three-dimensional, closer to the classic anime style. The testing of the fine-tuning effect of Ponyv6 on the number of images is nearing completion. The next step is to start with the training labels of prompts and try to add more adjustable prompts to Pony's limited number of single training materials (such as adding aesthetic scores, the current training logic still uses mainstream quality words to cover Pony's aesthetic score quality words), and continue to add suitable new training materials, such as scene training materials and more foot training materials (v4's foot training materials seem to be a bit scarce).
v4.1
Mi scuso con gli utenti per aver rilasciato una nuova versione in così poco tempo; richiede molta memoria del computer e buona velocità di rete. O_O
Firstly, I would like to apologize to all users for the release of a new version in such a short period of time, which greatly tests the computer's memory and network speed. O_O
Questa nuova versione è basata sulla versione limb debug di v4: poiché il controllo delle arti di v4 era difficile e la perfezione delle mani non ha raggiunto le mie aspettative, io e il mio amico 木猫猫猫 abbiamo fatto aggiustamenti, ottenendo che le arti di v4.1 soddisfino le mie aspettative. Pubblicherò alcune immagini XY per mostrare il miglioramento di v4.1 rispetto a v4 con gli stessi parametri.
This new version is based on the limb debugging version of v4. Due to the difficulty in controlling the limb effects of v4, the perfection rate of the hands did not meet my testing expectations in the past few days. So my friend 木猫猫猫 and I made some adjustments and improvements to v4, which ultimately made the limbs of v4.1 meet my expectations. I will release several xy graphs to clearly show the improvement of v4.1 compared to v4 under the same parameters.
v5
In questa versione il materiale di allenamento è diminuito: dopo il fallimento di v4, ho iniziato un nuovo progetto per testare un’idea con un consumo di memoria ridotto, allenando quattro diversi stili lora adattati a T-ponynai3, caricando anche il modello originale su civitai. Dopo aver testato l’adattabilità, ho iniziato a inserire questi quattro stili come additivi in T-ponynai3-v5. Sorprendentemente, la qualità delle linee di v5 è migliorata molto, probabilmente per l’uso di materiali molto dettagliati. Ho usato style_1 a style_4 per marcature di questi quattro stili, ma purtroppo non si separano bene o l’effetto è debole, bensì si fondono bene nello stile originale. Pur senza supportare più stili distintamente, il livello dello stile nai3 originale è aumentato. Forse nella prossima versione si potrà fare di più. (Mi piace molto giocare, ed è duro non poter farlo mentre alleno!
The training materials for this version have been reduced. Due to the failure of v4, I launched another project to test my idea from a small perspective of memory usage, which is to train four different art styles of Lora adapted to T-ponynai3. Of course, the original model was also uploaded to Civitai. After testing the adaptability, I started training these four different art styles as additives into T-ponynai3-v5. Surprisingly, The line texture of v5 has improved to a high level, probably because I trained a very delicate material. For the marking of these four art styles, I used the prompt words from style_1 to style_4. Unfortunately, for some reason, these four art styles were not separated or the effect was weak, but rather integrated well into the original art style. Although it did not achieve the goal of supporting multiple art styles, it effectively elevated the texture of the original Nai3 art style to a higher level. Perhaps the next version can try to take it even further. (I really enjoy playing games, and it's too difficult for me to play computer games every time I train.)
Riassunto di alcuni problemi della versione v5.
1, compatibilità Lora, arti, occhi sfocati. Ho usato pesi finali troppo alti che causano overfitting in qualche caso. Questa versione ottimizzata riduce i pesi per migliorare compatibilità arti e lora, con alcune immagini di confronto usando lora allenata su v4.1. Gli occhi sfocati sono dovuti allo stile_1 usato, perché il materiale originale aveva occhi sfocati; si migliora con style_3 o 4.
2, problemi di esposizione luce volumetrica. Non riscontrati durante il testing, forse causati da parametro noise offset che aumenta la sensibilità ai prompt luce, che rendono i risultati più luminosi. Suggerisco di non usare parentesi o numeri per aumentare peso, ma ripetere più volte lo stesso prompt a causa della sensibilità di sdxl, per evitare effetti estremi. Questo parametro serve anche a correggere l’ingiallimento con pochi prompt. Fornisco immagini di confronto.
3, complessità del modello ridotta. Teoricamente e nell’uso, v5 è più pulito e diversificato, e con certi prompt offre resa più precisa. Anche qui immagini di confronto. Il set di allenamento non usa materiali troppo complessi per evitare overfitting e perdita di dettagli.
Obiettivo: ottenere un modello con differenze significative dal precedente, non un clone. I vostri feedback sono preziosi per il trial and error. Nella prossima versione aumenterò materiali per diversi stili per integrarli meglio e separare gli stili, usando prompt specifici per cambiarli, che richiederà nuove tecniche di allenamento. Grazie per i feedback!
Summarize some issues regarding the v5 version.
1, Lora compatibility and issues with limbs and blurred eyes. Lora compatibility is that I used too much final weight for this training, and in some cases, overfitting may occur. This optimized version is the one that reduces the corresponding weight, and the limb collapse rate and compatibility with some Loras should be better. I have run several comparison charts of Loras trained with v4.1 for reference. The problem of blurred eyes should be the reason why I trained style_1. The eyes in the original material used are blurry, and can be improved by using style_3 or 4.
2. Exposure issues with volume light. I did not encounter this issue during testing, and the reason for it should be that I used the noise offset training parameter to increase the sensitivity of the model to light related prompt words, resulting in brighter results when the same weight of light prompt words were used. I suggest trying not to use parentheses and numbers to increase the weight. Due to the sensitivity of sdxl to prompt words, you can try repeating the same prompt words multiple times to avoid extreme results. At the same time, using this parameter is to fix the problem of generating yellow results under a small number of prompt words. I have run several comparison graphs for reference.
3. The problem of reduced model complexity. In theory and in practice. V5 should be a cleaner and more diverse model than the previous version, and with the help of some prompts, it should be able to achieve more accurate performance. Similarly, I ran several comparison charts for comparison. This training set did not use overly complex materials because I believe that overly complex images tend to overfit the results, which inevitably leads to a certain degree of detail loss.
Purpose: I hope to obtain a model that is significantly different from the previous version, rather than releasing a model that is almost identical to the previous version. This feedback from everyone is a great opportunity for trial and error, and I really don't have any trial and error costs on my own. In the next version, I will try to increase the amount of materials for different art styles, so that the art styles of different materials can be well integrated and separated. Using specific prompts to switch art styles may require some new training techniques. Thank you for your feedback!
Dettagli del Modello
Tipo di modello
Modello base
Versione del modello
Hash del modello
Creatore
Discussione
Per favore log in per lasciare un commento.