工具介绍
UI für stabiles Diffusionsnetz
Eine Web-Schnittstelle für Stable Diffusion, implementiert mit Gradio Library. Merkmale
Detailliertes Feature Showcase mit Bildern:
- Original txt2img und img2img Modi
- Ein Klick installieren und ausführen Skript (aber Sie müssen immer noch Python und Git installieren)
- Übermalen
- Inpainting
- Color Sketch
Prompt Matrix
Stabile Diffusion Upscale
- Achtung, geben Sie Textteile an, denen das Modell mehr Aufmerksamkeit schenken sollte
- ein Mann in einem `((tuxedo))` - wird mehr Aufmerksamkeit auf tuxedo
- ein Mann in einer "(tuxedo:1.21)" - alternativen Syntax
- Text auswählen und `Strg+Up` oder `Strg+Down` (oder `Command+Up` oder `Command+Down`) Down`, wenn Sie sich auf einem MacOS befinden, um automatisch die Aufmerksamkeit auf den ausgewählten Text (Code, der von einem anonymen Benutzer beigetragen wurde) anzupassen
- Loopback, führen Sie img2img Verarbeitung mehrmals aus
- X / Y / Z-Plot, eine Möglichkeit, eine dreidimensionale Darstellung von Bildern mit verschiedenen Parametern zu zeichnen
Textliche Inversion
- so viele Einbettungen haben, wie Sie möchten, und alle Namen verwenden, die Sie für sie mögen
- Verwenden Sie mehrere Einbettungen mit unterschiedlicher Anzahl von Vektoren pro Token
- arbeitet mit Gleitkommazahlen mit halber Präzision
- Zugeinbettungen auf 8 GB (auch Berichte über 6 GB Arbeit)
- Extras Tab mit:
- GFPGAN, neuronales Netzwerk, das Gesichter behebt
- CodeFormer, Gesichtswiederherstellungswerkzeug als Alternative zu GFPGAN
- RealESRGAN, Neuronal Network Upscaler
- ESRGAN, Neural Network Upscaler mit vielen Drittmodellen
- SwinIR und Swin2SR (siehe hier), Neural Network Upscaler
- LDSR, Latent Diffusion Super Resolution Upscaling
- Änderung der Seitenverhältnisoptionen
- Auswahl der Probenahmemethoden
- Sampler-Eta-Werte anpassen (Rauschmultiplikator)
- Fortgeschrittene Optionen für die Geräuscheinstellung
- Unterbrechung der Verarbeitung jederzeit
- 4 GB Videokarten-Unterstützung (auch Berichte über 2 GB Arbeit)
- Korrektes Saatgut für Chargen
Live prompt Token Länge Validierung
- Erzeugungsparameter
- Parameter, die Sie zur Generierung von Bildern verwendet haben, werden mit diesem Bild gespeichert
- in PNG-Stücken für PNG, in EXIF für JPEG
- kann das Bild auf die PNG-Info-Registerkarte ziehen, um die Erzeugungsparameter wiederherzustellen und sie automatisch in die Benutzeroberfläche zu kopieren
- kann in Einstellungen deaktiviert werden
- Drag & Drop ein Bild / Text-Parameter zu promptbox
- Lesen Sie die Schaltfläche "Generierungsparameter", lädt die Parameter in der Eingabeaufforderung zur Benutzeroberfläche
- Einstellungsseite
- Ausführen von beliebigem Python-Code von der Benutzeroberfläche (muss mit `-allow-code` ausgeführt werden, um es zu aktivieren)
- Mouseover Hinweise für die meisten UI-Elemente
- Möglich, Standardwerte/mix/max/step für UI-Elemente über Text Config zu ändern
- Tiling-Unterstützung, eine Checkbox zum Erstellen von Bildern, die wie Texturen gekachelt werden können
- Fortschrittsleiste und Live-Bilderzeugungsvorschau
- Kann ein separates neuronales Netzwerk verwenden, um Vorschauen mit fast keiner VRAM- oder Rechenanforderung zu erstellen
- Negative Eingabeaufforderung, ein zusätzliches Textfeld, mit dem Sie auflisten können, was Sie im erzeugten Bild nicht sehen möchten
- Stile, eine Möglichkeit, einen Teil der Eingabeaufforderung zu speichern und sie später einfach per Dropdown anzuwenden
- Variationen, eine Möglichkeit, das gleiche Bild zu erzeugen, aber mit winzigen Unterschieden
- Seed Resizing, eine Möglichkeit, das gleiche Bild zu erzeugen, aber mit etwas anderer Auflösung
- CLIP Interrogator, ein Button, der versucht, prompt von einem Bild zu erraten
Prompt Editing, ein Weg, um prompt Mitte der Generation zu ändern, sagen, um eine Wassermelone zu machen und wechseln Sie zu Anime-Mädchen Midway
- Batch Processing, Verarbeitung einer Gruppe von Dateien mit img2img
- Img2img Alternative, umgekehrte Euler-Methode der Kreuzaufmerksamkeitskontrolle
- Highres Fix, eine Komfortoption, um hochauflösende Bilder mit einem Klick ohne übliche Verzerrungen zu erzeugen
Reloading Checkpoints on the fly
- Checkpoint Merger, ein Tab, mit dem Sie bis zu 3 Checkpoints zu einem zusammenführen können
- Benutzerdefinierte Skripte mit vielen Erweiterungen aus der Community
Composable-Diffusion, eine Möglichkeit, mehrere Aufforderungen gleichzeitig zu verwenden
- separate Eingabeaufforderungen mit Großbuchstaben "AND"
- unterstützt auch Gewichte für Aufforderungen: `eine Katze :1.2 UND ein Hund UND ein Pinguin :2.2`
- Kein Token-Limit für Eingabeaufforderungen (ursprüngliche stabile Diffusion können Sie bis zu 75 Token verwenden)
- DeepDanbooru-Integration, erstellt danbooru-Style-Tags für Anime-Aufforderungen
- xformers, große Geschwindigkeitserhöhung für ausgewählte Karten: (add `--xformers` to commandline args)
- via extension: History-Tab: Bilder bequem innerhalb der Benutzeroberfläche anzeigen, lenken und löschen
- Für immer Option generieren
- Trainings-Tab
- Hypernetzwerke und Einbettungsoptionen
- Vorverarbeitung von Bildern: Zuschneiden, Spiegeln, Autotagging mit BLIP oder Deepdanbooru (für Anime)
Clip-Skipp
- Hypernetworks
Loras (wie Hypernetwork)