Models

Gradio Workflows - KI-Pipelines als Drag-and-Drop-Canvas mit REST-API

Gradio HuggingFace workflow AI pipeline ZeroGPU

HuggingFace hat gr.Workflow vorgestellt - eine neue Gradio-Funktion, die KI-Pipelines zum Interface macht. Statt Python-Code mit print-Debugging zu schreiben, beschreibt man seine Schritte als Graph aus typisierten Knoten und erhaelt eine Drag-and-Drop-Canvas, in der jeder Knoten lauffaehig ist und jedes Zwischenergebnis sichtbar bleibt.

Drei Knotentypen

Jeder Workflow besteht aus drei Knotenarten: References (Eingaben), Operators (die eigentlichen Verarbeitungsschritte) und Subjects (Ausgaben). Ein Operator kann eine eigene Python-Funktion sein, ein Modell ueber HuggingFace Inference Providers, ein anderer Gradio Space oder eine Zeile aus einem Hub-Dataset.

Praxisbeispiele

Der Blogpost zeigt mehrere Live-Demos: einen Bildeditor mit Qwen-Image-Edit, eine Media-Studio-Pipeline die FLUX-Bildgenerierung mit Background-Removal und Text-to-Speech verknuepft, parallele Fan-out-Generierung mehrerer Bildvarianten, und einen Dataset-Profiler der vier Analysen gleichzeitig ausfuehrt.

GPU-Modelle und ZeroGPU

Besonders interessant: fn-Knoten koennen mit @spaces.GPU dekoriert werden, woraufhin ZeroGPU automatisch eine GPU fuer den Aufruf allokiert. So lassen sich eigene Modelle direkt im Space auf der GPU ausfuehren, ohne externe Inference-Provider zu benoetigen.

Automatische REST-API

Jeder Workflow ist automatisch auch eine REST-API. Jeder Output-Knoten wird zum Endpoint, der ueber den Gradio-Client oder per curl aufgerufen werden kann. So wird dieselbe Pipeline, die man visuell im Browser zusammenklickt, sofort produktiv nutzbar.

Link: Original bei HuggingFace Blog