
FLUX.2 [max] is the flagship, highest-quality variant of the FLUX.2 family from Black Forest Labs (BFL). It is positioned as a professional-grade text→image generation and image-editing model that focuses on maximal fidelity, prompt adherence, and editing consistency across characters, objects, lighting and color. BFL and partner registries describe FLUX.2 [max] as the top-tier FLUX.2 variant with features for multi-reference editing, grounded generation.
FLUX 2 DEV is the development-friendly version optimized for research, experimentation, and non-commercial applications. It provides developers with powerful image generation capabilities while maintaining a balance between quality and computational efficiency. Perfect for prototyping, academic research, and personal creative projects.
FLUX 2 FLEX is the versatile, adaptable model designed for flexible deployment across various use cases and hardware configurations. It offers scalable performance with adjustable quality settings, making it ideal for applications requiring dynamic resource allocation. This model provides the best balance between quality, speed, and resource efficiency.
FLUX 2 PRO to flagowy komercyjny model z serii FLUX 2, oferujący najnowocześniejsze generowanie obrazów o bezprecedensowej jakości i poziomie szczegółowości. Zaprojektowany do zastosowań profesjonalnych i korporacyjnych, zapewnia znakomitą zgodność z promptami, fotorealistyczne rezultaty oraz wyjątkowe możliwości artystyczne. Ten model reprezentuje ścisłą czołówkę technologii syntezy obrazów opartej na SI.
black-forest-labs/flux-schnell to generatywny model tekst‑do‑obrazu od Black Forest Labs, zaprojektowany z myślą o szybkim próbkowaniu i iteracyjnej eksploracji promptów. Generuje zróżnicowane style i kompozycje na podstawie krótkich promptów, obsługuje negatywne prompty i kontrolę ziarna losowego oraz może tworzyć obrazy w wysokiej rozdzielczości, odpowiednie do makiet produktowych, concept artu i materiałów marketingowych. Typowe zastosowania obejmują interaktywną ideację, generowanie miniatur i banerów oraz zautomatyzowane warianty kreatywne w potokach tworzenia treści. Najważniejsze cechy techniczne obejmują zgodność z biblioteką Diffusers od Hugging Face, elastyczną kontrolę rozdzielczości oraz wydajny sampler dostrojony pod szybkość na powszechnie spotykanych kartach graficznych.
black-forest-labs/flux-pro to generatywny model tekst-na-obraz od Black Forest Labs do syntezy obrazów o wysokiej wierności w różnych stylach i tematach. Przekształca szczegółowe polecenia w spójne kompozycje z kontrolowalnymi atrybutami, takimi jak proporcje obrazu i styl, za pomocą standardowych parametrów generowania. Typowe zastosowania obejmują grafikę koncepcyjną, wizualizację produktów, kreacje marketingowe oraz fotorealistyczne sceny w procesach projektowych. Do najważniejszych aspektów technicznych należą modalność tekst-na-obraz, podążanie za poleceniami w stylu instrukcji oraz integracja z popularnymi łańcuchami narzędzi do generowania obrazów.
black-forest-labs/flux-kontext-pro to wielomodowy model dyfuzyjny do generowania obrazów z uwzględnieniem kontekstu. Syntetyzuje obrazy na podstawie poleceń tekstowych i opcjonalnych obrazów referencyjnych, zachowując wskazówki dotyczące kompozycji i stylu dla osadzonych w kontekście rezultatów. Typowe zastosowania obejmują tworzenie zasobów marki, wizualizacje produktów oraz opracowywanie koncepcji wizualnych z użyciem moodboardów lub przykładowych ujęć. Najważniejsze cechy techniczne to wejścia tekstowe i obrazowe, próbkowanie warunkowane referencjami oraz powtarzalne wyniki dzięki kontroli ziarna.
black-forest-labs/flux-kontext-max to kontekstowo warunkowany model generowania obrazów z linii FLUX, zaprojektowany do tworzenia obrazów na podstawie tekstu z opcjonalnymi wejściami referencyjnymi. Umożliwia syntezę osadzoną w kontekście, zachowanie stylu lub obiektu oraz kontrolowane wariacje sterowane dostarczonym kontekstem wizualnym. Typowe zastosowania obejmują kreacje spójne z marką, makiety produktów, ciągłość postaci oraz ideację opartą na moodboardach. Najważniejsze aspekty techniczne obejmują generowanie oparte na dyfuzji oraz multimodalne warunkowanie z użyciem tekstu i wejść referencyjnych, odpowiednie do przepływów pracy sterowanych referencjami.
black-forest-labs/flux-dev to model tekst-do-obrazu o otwartych wagach od Black Forest Labs, służący do generowania obrazów na podstawie poleceń w języku naturalnym. Generuje fotorealistyczne i stylizowane wyniki ze szczegółowych poleceń i współpracuje z powszechnymi opcjami sterowania w dyfuzyjnych łańcuchach narzędziowych. Typowe zastosowania obejmują grafikę koncepcyjną, wizualizację produktów, materiały marketingowe oraz szybką kreatywną eksplorację w procesach projektowych. Najważniejsze aspekty techniczne obejmują architekturę rectified-flow opartą na transformatorach, integrację z biblioteką Hugging Face Diffusers oraz wdrażanie za pośrednictwem standardowych stosów inferencji GPU.
black-forest-labs/flux-1.1-pro-ultra to dyfuzyjny Transformer text-to-image zaprojektowany do produkcyjnej syntezy obrazów z poleceń w języku naturalnym. Generuje szczegółowe wyniki na podstawie złożonych instrukcji, zapewniając kontrolę nad stylem, kompozycją, proporcjami obrazu, negatywnymi promptami oraz powtarzalnością wyników przy tym samym seedzie. Typowe zastosowania obejmują kreacje marketingowe, wizualizację produktów, grafikę koncepcyjną oraz ideację treści. Najważniejsze aspekty techniczne obejmują dyfuzję opartą na Transformerze, guidance z użyciem enkodera tekstu oraz wdrażanie poprzez popularne interfejsy API inferencji z parametrami scheduler i guidance.
black-forest-labs/flux-1.1-pro to model generowania obrazów na podstawie tekstu od Black Forest Labs, zapewniający kontrolowalne wizualizacje o wysokiej wierności. Interpretuje szczegółowe prompty, aby tworzyć kompozycje w różnych stylach i na różne tematy, z obsługą iteracyjnego dopracowywania oraz wariantów obrazów w typowych procesach dyfuzyjnych. Typowe zastosowania obejmują grafikę koncepcyjną, makiety produktów, grafiki marketingowe oraz eksplorację scen. Najważniejsze cechy techniczne obejmują syntezę obrazów warunkowaną tekstem oraz integrację ze standardowymi łańcuchami narzędzi do wnioskowania używanymi dla modeli dyfuzyjnych.