Pony Diffusion ist eine schlanke Informationsseite über das gleichnamige offene Text-zu-Bild-Modell und behandelt Pony Diffusion V6 XL sowie Community-Neuigkeiten zu V7. Im Kern bietet die Seite eine Startseite, einen Blog zur Versionsgeschichte und zu den Fortschritten bei V7 sowie eine Playground-Seite, die Hugging Face Spaces von Drittanbietern im Browser lädt, um Bilder zu erzeugen.
Das namensgebende Modell wird getrennt von der Website verbreitet. Die Startseite beschreibt Pony Diffusion als vielseitiges Text-zu-Bild-Diffusionsmodell, das hochwertige, nicht fotorealistische Bilder in verschiedenen Stilen erzeugt. Die Version V6 ist ein SDXL-Finetune, das laut seinen Autoren aus einfachen natürlichsprachlichen Prompts SFW- und NSFW-Bilder von anthropomorphen, tierhaften (feral) und humanoiden Figuren erzeugen kann.
Die Website nennt keinen Betreiber. Laut ihren Nutzungsbedingungen werden Pony Diffusion und zugehörige Dateien von ihren Autoren auf öffentlichen Modell-Plattformen unter eigenen Lizenzen veröffentlicht, und Marken Dritter, einschließlich Modellnamen, gehören ihren Inhabern. Der V7-Artikel derselben Seite ist dagegen in der ersten Person geschrieben und spricht bei der Entwicklung von V7 von „unseren Fortschritten“ und „unserem Datensatz“. Ob die Website von den Modellautoren betrieben wird, mit ihnen verbunden ist oder von ihnen autorisiert wurde, bleibt offen. Modelldateien, Versionsnachrichten und Lizenzbedingungen prüft man daher am besten auf den Veröffentlichungsseiten der Autoren.
Bilder entstehen auf der Website ausschließlich in eingebetteten Demos. Die Playground-Seite kann vier Hugging Face Spaces von Drittanbietern einbetten, zwischen denen man per Tab wechselt.
Jeder Tab zeigt die Oberfläche seines eigenen Space, daher wechseln die verfügbaren Bedienelemente mit dem Tab: Stapelgröße und JSON-Eingabe gibt es in der HD-Demo, nicht aber in der kostenlosen V6-XL-Demo.
Das Modell nutzt Score-Tags wie score_9, damit ein Prompt die gewünschte Ausgabequalität angeben kann. Für Pony Diffusion V6 XL beginnt die Standardvorlage der Autoren mit score_9, score_8_up, score_7_up, score_6_up, score_5_up, score_4_up, gefolgt von einer einfachen Beschreibung und optionalen Tags. Das Modell muss mit clip skip 2 geladen werden, sonst entstehen Flecken in geringer Qualität. Weitere Tags steuern den Inhalt: source_pony, source_furry, source_cartoon und source_anime wählen die Datenquelle, während rating_safe, rating_questionable und rating_explicit die Inhaltseinstufung festlegen. Anime-Stile stehen bei dieser Modellfamilie seit jeher im Fokus, und der V7-Artikel der Website nennt eine breitere Anime-Unterstützung als Ziel für V7.
Pony Realism ist ein Community-Checkpoint, der den Prompt-Stil von Pony Diffusion mit Score-Tags, Clip Skip 2 und Danbooru-Tags beibehält und dabei auf sauberere Beleuchtung, bessere Hauttöne und fotoähnliche Details zielt. Seine Playground-Seite wechselt zwischen zwei Drittanbieter-Demos, und für den Einstieg ist keine lokale GPU-Installation nötig.
Die Startseite gibt an, das Modell sei mit rund 80.000 Pony-Bildern feinabgestimmt worden, nennt aber keine Version. Die Modellseite zu V6 XL zeichnet ein anderes Bild: etwa 2,6 M Bilder, mit einem Verhältnis von ungefähr 1:1 zwischen Anime-, Cartoon-, Furry- und Pony-Daten sowie zwischen den Einstufungen safe, questionable und explicit, wobei etwa die Hälfte der Bilder ausführliche Beschriftungen hat. Da beide Zahlen nicht übereinstimmen und die Startseite die gemeinte Version nicht nennt, sollte man die 80.000 nicht als Spezifikation von V6 XL lesen.
Die Startseite fasst die Nutzung in drei Schritten zusammen:
Gute Pony Diffusion Prompts folgen den eigenen Konventionen des Modells. Für V6 XL empfehlen die Autoren Euler a mit 25 Schritten bei einer Auflösung von 1024px. Der Pony-Realism-Leitfaden der Website schlägt ein etwas anderes Rezept vor: positive Prompts mit score_9, score_8_up, score_7_up beginnen und das Motiv nach BREAK beschreiben, Clip Skip auf 2 lassen, weil falsche Einstellungen oft weich oder unordentlich wirken, und 30 oder mehr Schritte, einen CFG-Wert um 6 bis 7, eine Auflösung über 1024 sowie Sampler wie Euler A oder DPM++ SDE Karras-Varianten ausprobieren.
Im Playground bieten beide V6-Demos Sampler, Guidance Scale und Schrittzahl als Regler an, sodass sich Schritte und Guidance ohne lokale Installation anpassen lassen.
Die Website positioniert das Modell für kreative und unterhaltende Zwecke. Typische Einsätze sind:
Allen Beispielen gemeinsam ist eine in Worten beschriebene Figur oder Szene, die als Standbild entsteht. Arbeitsabläufe für Video oder Fotobearbeitung zeigt die Website nicht.
Die Website passt zu Menschen, die das Modell ausprobieren wollen, bevor sie eine lokale Umgebung einrichten; für kommerzielle oder datenschutzsensible Arbeit eignet sie sich weniger.
Gut geeignet
Weniger geeignet
Die Website läuft im Webbrowser, und die gesamte Bilderzeugung findet in den eingebetteten Demos statt.
Wer Pony Diffusion online ohne Installation ausprobieren will, öffnet den Playground und wählt einen Tab; lokale Werkzeuge geben volle Kontrolle über Gewichte und Einstellungen.
Eine Preisliste gibt es nicht, weil die Website keine kostenpflichtigen Produkte anbietet. Derzeit stehen weder Benutzerkonten noch Bezahlpläne, Guthaben-Wallets oder ein Checkout zur Verfügung, und Modellgewichte werden nicht verkauft.
Die Startseite erklärt außerdem, Pony Diffusion sei frei zugänglich und kostenlos nutzbar, unterliege aber der Lizenz CreativeML OpenRAIL-M. Diese Aussage betrifft das Modell, nicht die Website, und widerspricht dem Lizenztext auf der V6-Modellseite, wie der Abschnitt Einschränkungen erläutert.
Kommerzielle Elemente hat die Website dennoch. Je nach Deployment-Einstellung kann sie eine datenschutzfreundliche Seitenanalyse laden und, sofern IDs hinterlegt sind, Microsoft Clarity oder Google Analytics; Google AdSense wird nur geladen, wenn eine Publisher-ID konfiguriert ist. Außerdem zeigen die Seiten ein Banner für einen anderen KI-Dienst zur Bild- und Videoerzeugung mit einem Button Try for Free.
Der Playground eignet sich für einen ersten Eindruck, doch andere Wege bieten mehr Kontrolle oder ein neueres Modell.
Keiner der vier eingebetteten Spaces wird als V7-Demo beschrieben. Auch V7 bringt Kompromisse: Es unterstützt keine Textgenerierung, und seine Spezial-Tags, einschließlich der Qualitäts-Tags, wirken deutlich schwächer als bei V6, sodass score_9 bei manchen Prompts nicht unbedingt bessere Ergebnisse liefert.
Die meisten Grenzen ergeben sich daraus, dass die Website auf Drittanbieter-Demos angewiesen ist und die Dateien des Modells nicht selbst hostet.
Die Pony Diffusion Lizenz ist die wichtigste offene Frage. Die Startseite sagt, das Modell dürfe kommerziell genutzt werden, sofern man die Lizenz CreativeML OpenRAIL einhält. Die Beschreibung auf der V6-Modellseite sagt etwas anderes: Sie nennt eine modifizierte Fair AI Public License 1.0-SD, verbietet die Inferenz des Modells auf Websites oder in Apps mit jeder Form der Monetarisierung, einschließlich bezahlter Inferenz oder schnellerer Stufen, dehnt diese Regel auf abgeleitete Modelle und Merges aus und gibt an, dass zwei Plattformen eine ausdrückliche Erlaubnis für kommerzielle Inferenz erhalten haben. Dieselbe Modellseite zeigt im Lizenzfeld CreativeML Open RAIL++-M an. Die Seiten widersprechen sich, und die Website klärt den Konflikt nicht auf.
Für V7 erlaubt die Pony License der Autoren die kommerzielle Nutzung des Modells und seiner Ausgaben, außer wenn man einen Inferenzdienst oder eine App anbietet, ein Unternehmen mit mehr als 1M Umsatz führt oder das Modell in professioneller Videoproduktion einsetzt; kommerzielle Nutzer sollen die Autoren kontaktieren. Die Lizenzzusammenfassung nennt keine Währung für die Schwelle von 1M. Diese Einschränkungen gelten nicht bei Nutzung der eigenen kommerziellen APIs der Autoren.
Der Playground ist der Teil der Website, der die meisten Daten an Dritte weitergibt.
Das behauptet die Website nicht, und ihre eigenen Seiten deuten bei der Frage nach den Autoren in unterschiedliche Richtungen. Versionen und Lizenzen sollten Sie auf den Seiten der Autoren prüfen.
Nein. Die Website hat keine Konten, Bezahlpläne, Guthaben oder Checkout, und die Demos laufen auf der Infrastruktur von Drittanbietern.
Das hängt davon ab, welcher Lizenztext gilt: Die Startseite nennt CreativeML OpenRAIL, die Beschreibung des V6-Modells dagegen eine modifizierte Fair AI Public License 1.0-SD. Lesen Sie vor jedem kommerziellen Projekt die Modellseite.
Nicht als aufgeführte Option. Die vier Tabs umfassen zwei V6-Demos, einen Multitask-Generator und eine Pony-Realism-Demo. Basisgewichte für V7 gibt es bei den Autoren für die lokale Nutzung.
Prüfen Sie zuerst clip skip und die Qualitäts-Tags: V6 braucht clip skip 2 und einen Prompt, der mit der Tag-Kette von score_9 bis score_4_up beginnt.
Sie werden von Hugging Face und dem Betreiber des gewählten Space nach deren Richtlinien verarbeitet. Wer das vermeiden möchte, sollte den Playground nicht nutzen.