工具介绍
UI web de diffusion stable
Une interface web pour la diffusion stable, implémentée en utilisant la bibliothèque Gradio. Caractéristiques
Présentation détaillée avec images:
- Modes d'origine txt2img et img2img
- Un clic installer et exécuter le script (mais vous devez toujours installer python et git)
- Surpeinture
- Peinture
- Croquis de couleur
- Matrice rapide
- Diffusion stable à l'échelle supérieure
- Attention, préciser des parties du texte que le modèle devrait accorder plus d'attention à
- un homme dans un "(tuxedo)" - fera plus attention au smoking
- un homme dans un `(tuxedo:1.21)` - syntaxe alternative
- sélectionnez le texte et appuyez sur `Ctrl+Up` ou `Ctrl+Down` (ou `Command+Up` ou `Command+ Down` si vous êtes sur un MacOS) pour ajuster automatiquement l'attention au texte sélectionné (code fourni par un utilisateur anonyme)
- Loopback, exécuter img2img traitement plusieurs fois
- graphique X/Y/Z, une façon de dessiner un graphique 3 dimensions avec différents paramètres
- Inversion textuelle
- avoir autant d'intégrations que vous voulez et utiliser tous les noms que vous aimez pour eux
- utiliser plusieurs embases avec différents nombres de vecteurs par jeton
- fonctionne avec des nombres flottants de demi-précision
- train intégré sur 8 Go (également rapports de 6 Go de travail)
- Onglet Extras avec :
- GFPGAN, réseau neuronal qui corrige les visages
- CodeFormer, outil de restauration du visage comme alternative à GFPGAN
- RealESRGAN, upscaler réseau neuronal
- ESRGAN, réseau neuronal haut de gamme avec beaucoup de modèles tiers
- SwinIR et Swin2SR (voir ici), upscalers réseau neuronal
- LDSR, la diffusion latente haute résolution
- Options de redimensionnement du rapport d'aspect
- Sélection des méthodes d'échantillonnage
- Régler les valeurs de l'échantillonneur eta (multiplicateur de bruit)
- Options de réglage du bruit plus avancées
- Interruption du traitement à tout moment
- Support de carte vidéo de 4 Go (également rapport de 2 Go de travail)
- Graines correctes pour les lots
- Validation de la longueur du jeton en direct
- Paramètres de génération
- les paramètres que vous avez utilisés pour générer des images sont enregistrés avec cette image
- en morceaux PNG pour PNG, en EXIF pour JPEG
- peut faire glisser l'image vers l'onglet info PNG pour restaurer les paramètres de génération et les copier automatiquement dans l'interface utilisateur
- peut être désactivé dans les paramètres
- faire glisser et déposer une image/texte-paramètres vers la boîte à lettres
- Read Generation Parameters Button, charge les paramètres dans la boîte à lettres à l'interface utilisateur
- Page de paramètres
- Exécuter le code python arbitraire de l'interface utilisateur (doit être exécuté avec `--allow-code` pour activer)
- Sourisover conseils pour la plupart des éléments UI
- Possibilité de modifier les valeurs par défaut/mix/max/step pour les éléments d'interface utilisateur via la configuration texte
- Support d'inclinaison, une case à cocher pour créer des images qui peuvent être carrelées comme des textures
- Barre de progression et aperçu de la génération d'images en direct
- Peut utiliser un réseau neuronal séparé pour produire des prévisualisations avec presque aucune exigence VRAM ou calcul
- Invitation négative, un champ de texte supplémentaire qui vous permet de lister ce que vous ne voulez pas voir dans l'image générée
- Styles, un moyen de sauvegarder une partie de l'invite et de les appliquer facilement via le menu déroulant plus tard
- Variations, une façon de générer la même image mais avec de petites différences
- Redimensionnement des semences, une façon de générer la même image mais à une résolution légèrement différente
- Interrogateur CLIP, un bouton qui tente de deviner l'invite d'une image
- L'édition rapide, un moyen de changer la mi-génération, disons de commencer à faire une pastèque et de passer à l'anime fille à mi-chemin
- Traitement par lots, traiter un groupe de fichiers en utilisant img2img
- Img2img Alternative, méthode Euler inversée de contrôle de l'attention croisée
- Highres Fix, une option pratique pour produire des images haute résolution en un clic sans déformations habituelles
- Recharger les points de contrôle à la volée
- Checkpoint Fusion, un onglet qui vous permet de fusionner jusqu'à 3 points de contrôle en un seul
- scripts personnalisés avec de nombreuses extensions de la communauté
- Composable-Diffusion, une façon d'utiliser plusieurs invites à la fois
- invites séparées en utilisant la majuscule `AND`
- prend également en charge les poids pour les invites: `un chat:1.2 ET un chien ET un pingouin:2.2`
- Aucune limite de jeton pour les invites (la diffusion originale stable vous permet d'utiliser jusqu'à 75 jetons)
- Intégration DeepDanbooru, crée des étiquettes de style danbooru pour les invites d'anime
- xformers, augmentation de vitesse majeure pour certaines cartes : (ajouter `--xformers` aux args de ligne de commande)
- via l'extension: onglet Historique: afficher, diriger et supprimer les images facilement dans l'interface utilisateur
- Générer l'option pour toujours
- Onglet formation
- options d'hyperréseaux et d'intégration
- Prétraitement d'images : recadrage, miroir, automatisation en utilisant BLIP ou deepdanbooru (pour anime)
- Clip skip
- Hyperréseaux
- Loras (comme Hypernetwork