Zurück zum Studium

Lernbegriff

Text-to-image — Diffusion und ComfyUI

Text-to-Image erzeugt einen Bild-Latent aus Textkonditionierung und Zufallsrauschen ohne Eingabebild. Die Lernkarte zeigt die Rolle im Modul „Diffusion und ComfyUI“ und einen sicheren Diagnoseweg.

Diffusion und ComfyUILevel 0–3

Orientierung

Text-to-Image erzeugt einen Bild-Latent aus Textkonditionierung und Zufallsrauschen ohne Eingabebild. Auf dieser Stufe trennst du Zweck, Eingabe und sichtbares Ergebnis. Ordne Text-to-image als Teil des Moduls Diffusion und ComfyUI ein, bevor du Einstellungen oder Dateien veränderst.

Übung

Sicher ausprobieren

Ein Bildworkflow scheitert oder verändert die Vorlage unerwartet. Kontrolliere bei Text-to-image den zuständigen Node, seine typisierten Verbindungen und Parameter im gespeicherten Workflow; führe anschließend denselben Seed mit einer kleinen Testauflösung erneut aus. Öffne eine isolierte Testumgebung und führe „curl -s http://127.0.0.1:8188/system_stats“ aus. Beschreibe die erwartete Ausgabe vorab, ändere keine produktiven Daten und notiere einen sicheren nächsten Diagnoseschritt.

curl -s http://127.0.0.1:8188/system_stats

Quick-Check

Kannst du Zweck, beobachtbaren Zustand und häufigste Fehlerquelle von Text-to-image — Diffusion und ComfyUI jeweils in einem Satz erklären? Welche Ausgabe würdest du zuerst sichern, bevor du etwas änderst, und welcher Test beweist anschließend, dass deine Korrektur wirklich wirksam war?