Fooocus
Kostenloser Mehrwert
KI-Bildwerkzeuge Erstellung von AI-Bild-Illustrationen

Fooocus

Betonung auf benutzerfreundlichen Hinweisen und lokally erstellten Open-Source-KI-Bildwerkzeugen

Tags:

Was ist Fooocus?

Fooocus ist ein kostenloses, open-source-Tool für künstliche Intelligenz-basiertes Zeichnen, das lokal und offline genutzt werden kann. Es basiert auf Stable Diffusion XL und vereinfacht durch die Reduzierung der Parameter sowie automatisierte Optimierungsprozesse die Arbeit – so können die Nutzer sich auf die Prompte sowie den Inhalt der Bilder konzentrieren, anstatt sich zunächst mit komplexen Samplern, Knotenstrukturen und Workflow-Einstellungen auseinandersetzen zu müssen.

Der einzige offizielle Zugang zu Fooocus ist das von lllyasviel gepflegte GitHub-Repo. Mehrere eigenständige Domainnamen im Namen von Fooocus im Internet sind keine offiziellen Seiten und bieten möglicherweise Dienste zur Hosting, Abonnementverwaltung oder zum Download an.

Für Downloads, Installation, Versionshinweise und Sicherheitsmitteilungen gilt der offizielle Repository als Quelle.

Aktueller Wartungszustand

Fooocus befindet sich derzeit in einem Zustand begrenzter Langzeitsupport. Die Entwickler konzentrieren sich hauptsächlich auf die Behebung von Fehlern und entwickeln keine neuen, umfangreichen Funktionen mehr aktiv. Das Projekt ist vollständig um SDXL herum aufgebaut; es gibt derzeit keine Pläne, neue Modellarchitekturen wie Flux zu übernehmen oder zu integrieren.

Das bedeutet nicht, dass die vorhandenen Funktionen nicht genutzt werden können. Nutzer, die eine stabile lokale Erstellung mit SDXL, eine einfache Benutzeroberfläche sowie einen ausgereiften Bildbearbeitungsprozess benötigen, können weiterhin Fooocus wählen.

Für Benutzer, die Flux, die neuesten Video-Modelle oder die Automatisierung komplexer Knoten nutzen möchten, eignen sich ComfyUI, WebUI Forge oder andere kontinuierlich weiterentwickelte Tools besser.

DALL·E-Bildgenerierung und automatische Prompt-Erweiterung

Nachdem der Benutzer eine Anweisung in natürlicher Sprache eingegeben hat, können SDXL-Bilder erzeugt werden. Fooocus kümmert sich automatisch um Aspekte wie Sampling, Auflösung, Laden des Modells sowie Qualitätsparameter und bietet außerdem gängige Einstellungen wie Stil, Bildformat, Anzahl der Bilder, Qualität sowie negative Anweisungen.

Fooocus V2 verwendet das lokale GPT-2-Modell, um die Eingabetexte zu erweitern und visuelle Details zu den kurzen Beschreibungen hinzuzufügen. Dieser Prozess kann offline durchgeführt werden, doch die automatische Erweiterung entspricht nicht notwendigerweise den Vorgaben jeder Marke oder jedem Charakter.

Wenn eine stabile Wiederholung erforderlich ist, sollten die vollständigen Prompts, der Seed, das Modell, LoRA sowie die Versionsinformationen gespeichert werden.

Stilvorlagen und Steuerung von Prompten

Das integrierte Stilsystem ermöglicht es, schnell visuelle Richtungen wie Fotografie, Film, Illustrationen oder Anime anzuwenden. Zudem werden mehrere Prompte, negative Prompte sowie eine Gewichtungssyntax unterstützt. So kann beispielsweise das Gewicht eines bestimmten Konzepts erhöht werden, um die Merkmale des Hauptmotivs stärker hervorzuheben.

Voreingestellte Optionen eignen sich für eine schnelle Erkundung, doch die Kombination mehrerer Stile kann zu Konflikten führen. Charakterkonstanz, genaue Texte, Handdetails sowie komplexe räumliche Beziehungen erfordern weiterhin wiederholte Erstellung, lokale Korrekturen oder die Verwendung von Referenzbildern.

Vergleich der offiziellen Version mit den Voreinstellungen

Version oder VorlageKostenStandardrichtungWartung und Anwendungsgebiete
Offizielle lokale Version von FooocusKostenlosVollständiger lokaler Workflow basierend auf SDXLOffizielle begrenzte langfristige Unterstützung, nur Fehlerbehebung.
Allgemeine VoreinstellungenKostenlosStandardmäßig wird die Richtung JuggernautXL v8 verwendet.Eignet sich für Allround-Fotografie, Konzeptzeichnungen und Illustrationen
Realistische VorlagenKostenlosStandardmäßig wird die Richtung realisticStockPhoto v2.0 verwendet.Geeignet für fotorealistische Personen und realistische Szenen
Anime-VorlagenKostenlosStandardmäßig wird die Richtung von animaPencilXL v5 verwendet.Geeignet für 2D-Charaktere und Anime-Illustrationen
Community-BranchIn der Regel kostenlos oder vom Hosting-Anbieter berechnetMögliche Erweiterung um Steuerfunktionen oder neue ModelleNicht-offizielle Projekte – Aktualisierungen, Sicherheit und Kompatibilität müssen separat überprüft werden.

Fooocus bietet keine offiziellen Cloud-Abonnements, Punktpakete oder Unternehmenspakete an. Die Kosten für die lokale Software betragen null, doch Grafikkarten, Strom, Speicher sowie der Hosting von Drittanbieter-GPUs verursachen Kosten.

Die Gebühren für beliebige Online-Seiten mit demselben Namen stellen keine offiziellen Preise von Fooocus dar.

Bildvarianten und Vergrößerung

Mit den Funktionen „Upscale“ oder „Variation“ in dem Eingabebild kann man aus dem vorhandenen Bild leichte oder starkere Varianten erstellen. Zudem ist eine Vergrößerung um das 1,5- oder 2-fache möglich. Leichte Varianten bleiben der ursprünglichen Abbildung am nächsten, während starke Varianten die Formen und Details erneut interpretieren.

Die Vergrößerung durch KI ist nicht nur eine herkömmliche Interpolation – sie kann Texturen, Gesichtszüge und Schrift wieder aufzeichnen. Ausweise, Produktdetails, Logos sowie Bilder, bei denen eine Pixelgenauigkeit erforderlich ist, sollten nach der Erstellung einzeln überprüft werden.

lokales Neuziehen und Erweiterung des Bildes

Inpaint ermöglicht es den Nutzern, die Bereiche zu übermalen, die geändert werden sollen, und anschließend mithilfe von Anweisungen Objekte zu ersetzen, Gesichter zu reparieren, Kleidung anzupassen oder Unreinheiten zu beseitigen. Outpaint kann das Bildfeld nach oben, unten, links und rechts erweitern, sodass die KI den Inhalt außerhalb des Bildes ergänzen kann.

Fooocus verwendet seinen eigenen Algorithmus zur lokalen Neuzeichnung sowie ein Kontrollmodell. Beim ersten Einsatz der entsprechenden Funktionen wird zusätzlich ein Patch zur lokalen Neuzeichnung von etwa 1,28 GB heruntergeladen; daher sollte man ausreichend Netzwerk- und Speicherplatz einplanen.

Bilder mit komplexen Grenzen, strengen Perspektiven oder kontinuierlichen Strukturen über mehrere Bereiche hinweg erfordern möglicherweise mehrere Maskierungen und nachträgliche Bearbeitung.

Referenzbild für Image Prompt

Der Image Prompt kann als Orientierungshilfe für Komposition, Charaktereigenschaften, Stil oder lokale Strukturen dienen und bietet zudem Kontrollmöglichkeiten im Rahmen von ControlNet. Je höher die Intensität des Referenzbildes ist, desto ähnlicher sind in der Regel die Ergebnisse dem Eingabebild – doch dies kann auch kreative Variationen einschränken oder die Mängel des ursprünglichen Bildes verstärken.

Beim Einsatz von echten Fotos, Markenmaterialien und urheberrechtlich geschützten Charakteren müssen die Nutzer die Rechte an den Porträts, die Markenzeichen sowie die Lizenzen für die Trainingsmodelle überprüfen. Die Erstellungswerkzeuge sichern keine kommerziellen Lizenzen automatisch.

FaceSwap – Gesichtstausch

Die Fooocus-Integration basiert auf FaceSwap im InsightFace-Stil und ermöglicht es, Merkmale eines Referenzgesichts auf das generierte Bild anzuwenden. Es eignet sich für kreative Avatare und Charakterskizzen, doch Seitenansichten, Verdeckungen, besondere Lichtverhältnisse sowie Altersunterschiede können die Ähnlichkeit verringern.

Es ist nicht zulässig, ohne Zustimmung betrügerische Identitätsinhalte zu erstellen. Im Falle von realen Personen, Werbung, Medienveröffentlichungen oder geschäftlichen Zwecken muss eine ausdrückliche Genehmigung eingeholt werden, und die notwendigen Informationen zur KI-Verarbeitung müssen angegeben werden.

Beschreibung aus dem Bild ableiten

Die „Describe“-Funktion kann Bilder analysieren und natursprachliche Beschreibungen oder Anweisungen für das Zeichnen erzeugen, um die Elemente des Bildes besser zu verstehen, ähnliche Ansätze schnell wiederzuerstellen oder weitere Varianten zu erstellen. Das Ergebnis ist eine Zusammenfassung des Bildes durch das Modell – es werden nicht die ursprünglichen Anweisungen des Künstlers sowie die Modelle und Parameter wiedergegeben.

Intelligente Verbesserung

Die Enhance-Funktion kann mithilfe von Techniken zur Objekterkennung und -segmentierung Bereiche dynamisch lokalisieren, um anschließend bestimmte Objekte zu verfeinern oder zu reparieren. Der damit verbundene Prozess nutzt die Fähigkeiten von GroundingDINO und SAM und eignet sich zur Verbesserung von Gesichtern, Händen, Kleidung oder anderen einzelnen Objekten.

Automatische Erkennung kann zu übersehenden, falsch ausgewählten Elementen oder zu Veränderungen der ursprünglichen Eigenschaften führen. Vor der Massenverarbeitung sollten zunächst repräsentative Bilder verwendet werden, um den Umfang der Maskierung sowie die Stärke der Verstärkungshinweise zu testen.

LoRA, Embedding und Modelle

Fooocus unterstützt SDXL-Modelle, LoRA und Embeddings. Es ist außerdem möglich, mehrere Modellverzeichnisse zu konfigurieren sowie kompatible SDXL-Ressourcen von Plattformen wie Civitai zu verwenden. LoRA eignet sich zur Ergänzung von Charakteren, Kleidung, Stilen und Objektkonzepten, während Embeddings häufig zur Steuerung von Prompten oder negativen Konzepten verwendet werden.

Jedes Modell und jede LoRA verfügt über eine eigene Lizenz; eine Open-Source-Lizenz gewährt nicht automatisch das Recht, das Modell kommerziell zu nutzen. Bei der Herunterladung von Drittanbieter-Modellen sollte man auch auf bösartige Dateien, Auslösewörter, die Version des Basismodells sowie die empfohlenen Gewichte achten.

Wildcards und Massenänderungen

Wildcards können Inhalte aus einem Wörterbuch zufällig ersetzen. Die Verarbeitung von Arrays sowie inline LoRA helfen den Nutzern dabei, Kombinationen aus Kleidungsstücken, Farben, Objektiven und Charakteren zu erstellen. Es eignet sich gut zur Inspirationssuche sowie zur Erstellung großer Mengen an Materialien – doch die Anzahl der möglichen Kombinationen steigt schnell an. Deshalb sollte die Größe der Aufgaben begrenzt werden und die erfolgreichen Parameter aufgezeichnet werden.

Anleitung zur Installation von Windows

  1. Gehen Sie über den einzigen offiziellen GitHub-Repository auf die Veröffentlichungsseite und laden Sie die Windows-Archivdatei herunter.
  2. Entpacken Sie die Dateien vollständig in einen Ordner mit kurzer Pfadlänge und ausreichend Speicherplatz.
  3. Führen Sie run.bat aus, um die allgemeinen Voreinstellungen zu aktivieren; verwenden Sie die entsprechenden Startdateien, wenn animierte oder realistische Standardmodelle gewünscht sind.
  4. Beim ersten Start wird das SDXL-Modell automatisch heruntergeladen, und nach Abschluss wird die lokale Benutzeroberfläche im Browser geöffnet.
  5. Prüfen Sie vor der Erstellung das Modell, den Bildformat, die Qualität sowie den Ausgabekatalog und testen Sie zunächst mit einer kleinen Anzahl von Bildern.

Die beim ersten Download bereitgestellten Modelldateien sind groß; Antivirenprogramme, Proxy-Server, Berechtigungen für die Festplatte oder Netzwerkstörungen können dazu führen, dass das Programm nicht gestartet werden kann. Laden Sie keine neu verpackten Programme von unbekannten Webseiten herunter.

Linux, macOS und Docker

Linux kann gemäß den offiziellen Anleitungen mit der Python 3.10-Umgebung genutzt werden, um Abhängigkeiten zu installieren und das System zu starten. Zudem wird auch die Deployment-Methode über Docker unterstützt. Apple Silicon Macs können mit PyTorch MPS betrieben werden – doch dies fällt außerhalb der offiziellen Anleitungen. Die Geschwindigkeit ist in der Regel geringer als bei dedizierten NVIDIA-Grafikkarten.

Bei AMD-Grafikkarten kann in Windows DirectML ausprobiert werden, bei Linux ROCm – beides sind Ansätze mit unsichererer Kompatibilität und Leistung. Ob eine bestimmte Methode funktioniert, hängt von der Grafikkarte, den Treibern, dem Betriebssystem sowie der Version von PyTorch ab.

Referenz für Hardware-Anforderungen

GeräteMindestreferenzkonfigurationErklärung
NVIDIA RTX 20-Serie und neuer4 GB Grafikspeicher, 8 GB Arbeitsspeicher und Swapspace aktiviertDie offiziell empfohlene Richtung: Je größer der Arbeitsspeicher, desto besser geeignet für hohe Auflösungen und viele Bilder.
NVIDIA GTX 10-SerieEs wird in der Regel 8 GB Grafikspeicher empfohlen.Die Geschwindigkeit und Kompatibilität der älteren Architekturen sind begrenzt.
Windows AMDEtwa 8 GB GrafikspeicherBei Tests mit DirectML ist die Geschwindigkeit in der Regel langsamer.
Linux AMDEtwa 8 GB GrafikspeicherIm ROCm-Bereich wurden keine Tests mit gleicher Intensität durchgeführt.
Apple SiliconM1 oder M2 sowie verfügbare gemeinsame SpeicheranlageFunktioniert, aber mit einer geringeren Geschwindigkeit im Vergleich zu herkömmlichen, unabhängigen NVIDIA-Grafikkarten
Nur CPUEtwa 32 GB ArbeitsspeicherMan kann es versuchen – die Erstellungszeit ist jedoch sehr lang.

Die tatsächlichen Anforderungen hängen außerdem von der Auflösung, der Menge der zu verarbeitenden Elemente, der Vergrößerung, ControlNet sowie der Größe des Modells ab. Das System sollte Treiber verwenden, die mit der aktuellen PyTorch-Version kompatibel sind; es werden keine Empfehlungen für ältere Treiberversionen gegeben.

Modellherunterladen und Festplattenspeicher

Die Vorlagen für Allgemeinzwecke, Realismus und Anime laden unterschiedliche SDXL-Modelle herunter. Funktionen wie partielle Neuzeichnung, Vergrößerung, Objekterkennung und Segmentierung laden ebenfalls zusätzliche Dateien nach Bedarf herunter. Für eine vollständige Nutzung sollten Dutzende von GB Speicherplatz reserviert werden, und der Modellordner sollte nicht auf einer Systemfestplatte mit unzureichender Kapazität gespeichert werden.

LAN-Zugriff und Sicherheit

Die Startparameter ermöglichen es der Benutzeroberfläche, lokale Netzwerkadressen abzurufen, oder es kann die Teilen-Funktion von Gradio genutzt werden. Bei beiden Methoden ist in der Regel keine Authentifizierung erforderlich, und sie sollten nicht direkt der Öffentlichkeit zugänglich gemacht werden.

Wenn eine Fernzugriffsmöglichkeit erforderlich ist, sollte die Authentifizierung über auth.json aktiviert werden, in Kombination mit Firewall, Reverse-Proxy, HTTPS und Zugriffssteuerung.

Das Hochladen von Dateien, Modellen und Erweiterungen kann Risiken mit sich bringen. In mehrbenutzerumgebungen sollten Ausgabeverzeichnisse getrennt werden, die Quellen des Hochladens eingeschränkt werden, Abhängigkeiten rechtzeitig aktualisiert werden und es sollte vermieden werden, unter Administratorrechten zu arbeiten.

Open-Source-Lizenz

Der Fooocus-Code wird unter der GPL-3.0-Lizenz bereitgestellt. Bei der Anpassung und Verbreitung des Programms müssen die Anforderungen der GPL bezüglich des Quellcodes und der Lizenz eingehalten werden.

Gewöhnliche von Software erzeugte Bilder werden allein durch die Verwendung von Fooocus nicht automatisch zu GPL-Werken – die Rechte an den Bildern hängen weiterhin von den eingesetzten Materialien, der Lizenz des Modells, der LoRA-Lizenz sowie den lokalen Gesetzen ab.

Fooocus-Anleitung

Erstellung wiederverwendbarer professioneller Workflows

  1. Erstellung einer Liste mit den Markenfarben, Schriftarten, Kompositionselementen sowie verbotenen Elementen;
  2. Getrennt werden der aktuelle Wartungszustand, Bildgenerierung sowie die automatische Erweiterung von Prompten und die Steuerung von Stilvorlagen und Prompten getestet;
  3. Vergleichen Sie Qualität, Geschwindigkeit und Kosten mit derselben Gruppe von Referenzmaterialien;
  4. Komplexe Ränder, Texte sowie Bilder von wichtigen Produkten sollten von Menschen bearbeitet werden.
  5. Einheitliche Benennung, Größe und Prüfungsstatus;
  6. Nach Stichprobenkontrollen erfolgt die Massenverarbeitung und Veröffentlichung;

Für welche Nutzer geeignet?

  • Anfänger im Bereich der KI-Bildgenerierung, die SDXL kostenlos lokal ausführen möchten;
  • Illustratoren und Content-Creater, die keine komplexen Knotengraphen erstellen möchten;
  • Benutzer, die Bildgenerierung, Bildvergrößerung, lokale Übermalung und Bildvergrößerung benötigen;
  • Privatnutzer, die Wert auf den Offline-Verarbeitungsmodus sowie die Privatsphäre ihrer Daten legen;
  • Benutzer, die für die leichte Erstellung mit NVIDIA-Grafikkarten mit mittlerer bis niedriger Speicherkapazität arbeiten;
  • Teams, die schnell Anime-, realistische sowie allgemeine Konzeptzeichnungen erstellen müssen.

Hauptvorteile

  • Kostenlos, open source und kann offline ausgeführt werden;
  • Die Benutzeroberfläche und die Parameter sind einfacher zu bedienen als bei Tools für komplexe Knoten.
  • DALL·E-Bildgenerierung, Varianten, Vergrößerung, Neuziehen und Bildausdehnung in einer einzigen Oberfläche.
  • Es werden automatische Erweiterungen von Prompten, Stilvorlagen sowie verschiedene Kontrollmöglichkeiten für Referenzbilder bereitgestellt;
  • Unterstützung für LoRA, Embedding, FaceSwap und Bildbeschreibungen;
  • Es wird die minimale betriebsfähige Konfiguration für NVIDIA-Geräte mit 4 GB Grafikspeicher bereitgestellt.

Einschränkungen und Hinweise

  • Derzeit findet nur eine begrenzte langfristige Wartung des Projekts statt, wobei der Fokus auf SDXL liegt; neue Architekturen wie Flux werden nicht ursprünglich integriert.
  • Im Vergleich zu ComfyUI ist Fooocus einfacher, bietet aber weniger Möglichkeiten zur Anpassung von Knoten, zur Automatisierung sowie zur Steuerung auf tieferer Ebene.
  • Die erste Herunterladung der Datei ist groß, und die Geschwindigkeit von AMD, Apple Silicon sowie CPUs ist begrenzt.
  • Bei der Erstellung können Probleme mit Übereinstimmungen bei Händen, Texten, Strukturen und Personen auftreten;
  • Die Urheberrechte, Sicherheitsaspekte sowie kommerziellen Lizenzen für Drittanbietermodelle, LoRA, Referenzbilder und echte Personenmaterialien müssen vom Benutzer selbst überprüft werden.

Häufige Fragen

Ist Fooocus kostenlos?

Kostenlos. Die offizielle lokale Software erfordert weder Abonnements noch Punktpakete oder kostenpflichtige Cloud-Dienste – die Nutzer tragen lediglich die Kosten für ihre eigene Hardware, Speicherung und Strom.

Welche ist die offizielle Website von Fooocus?

Die einzige offizielle Quelle ist das von lllyasviel gepflegte GitHub-Repo. Mehrere eigenständige Domainnamen mit demselben Namen wurden von den Offiziellen ausdrücklich als unverwandte Websites bezeichnet.

Unterstützt Fooocus Flux?

Die offizielle Version wird nicht unterstützt. Das Projekt basiert auf SDXL, und derzeit gibt es keine Pläne, eine neue Modellarchitektur zu übernehmen oder zu integrieren.

Kann es mit 4 GB Grafikspeicher laufen?

Die von NVIDIA angegebenen Mindestanforderungen sind 4 GB Grafikspeicher und 8 GB Arbeitsspeicher sowie die Aktivierung des Swappingspeichers. Allerdings führen hohe Auflösungen, viele Bilder sowie komplexe Bearbeitungen zu einer erheblichen Erhöhung der Ressourcenanforderungen.

Kann Fooocus Teile des Bildes neu zeichnen und das Bild vergrößern?

Ja, es wird die lokale Neuzusammenstellung der Masken sowie die Erweiterung des Bildschirms in vier Richtungen unterstützt. Beim ersten Mal wird ein zusätzliches Modellfile für die lokale Neuzusammenstellung heruntergeladen.

Ist Fooocus open source?

Open Source, der Code ist unter der GPL-3.0-Lizenz verfügbar; Modelle, LoRA und Eingabedaten unterliegen weiterhin jeweils eigenen Lizenzbedingungen.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Tools, die dem Fooocus ähneln