W skrócie: FLUX to rodzina modeli text-to-image od Black Forest Labs - firmy założonej przez twórców Stable Diffusion. Generuje fotorealistyczne obrazy z opisu, świetnie renderuje tekst na grafice, a dwa z trzech wariantów (schnell i dev) pobierzesz i uruchomisz lokalnie na własnym GPU.
Zanim przejdziemy dalej, jedna rzecz porządkowa. Fraza "flux ai" prowadzi do dwóch różnych produktów. Jest flux.ai - narzędzie do projektowania obwodów drukowanych (PCB) - i jest FLUX, model do generowania obrazów. Ten tekst dotyczy tego drugiego: generatora grafiki od Black Forest Labs, znanego też jako FLUX.1 i FLUX.2.
Co to jest FLUX i kto za nim stoi
FLUX to model text-to-image, czyli taki, który zamienia opis słowny (prompt) na obraz. Stworzyło go Black Forest Labs (BFL) - startup z Freiburga w Niemczech, założony w 2024 roku przez Robina Rombacha, Andreasa Blattmanna i Patricka Essera. Nazwiska warto zapamiętać: to byli badacze Stability AI i współautorzy Stable Diffusion. Innymi słowy, ludzie, którzy współtworzyli otwarty generator obrazów, odeszli i zbudowali jego następcę.
Pod maską FLUX.1 to rectified flow transformer o 12 miliardach parametrów. Nie musisz rozumieć tej nazwy, żeby korzystać z modelu - w praktyce liczy się efekt: FLUX robi bardzo przekonujące zdjęcia, radzi sobie z dłońmi (zmora starszych modeli) i potrafi napisać poprawny tekst na grafice, co przez lata było piętą achillesową generatorów. Ars Technica testując pierwszą wersję zwróciła uwagę właśnie na jakość generowanych dłoni, a jakość promptów postawiła obok DALL-E 3, zaś fotorealizm - obok Midjourney.
Pierwsza wersja wyszła w sierpniu 2024 roku. Od tego czasu rodzina mocno się rozrosła - i to właśnie warianty najczęściej mylą osoby, które dopiero zaczynają.
Warianty FLUX: schnell, dev i pro
Najważniejsze: FLUX.1 nie jest jednym modelem, tylko trzema, różniącymi się licencją, jakością i tym, gdzie możesz je odpalić. Nazwy pochodzą z niemieckiego, bo firma jest niemiecka.
- FLUX.1 [schnell] ("szybki") - najszybszy z trójki, generuje obraz w 1-4 krokach. Wydany na licencji Apache 2.0, czyli w pełni otwarty, także do zastosowań komercyjnych. To najlepszy punkt startu, jeśli chcesz szybko potestować lokalnie.
- FLUX.1 [dev] - model o 12 miliardach parametrów, wydestylowany z wersji pro. Daje wyraźnie lepszą jakość niż schnell, ale ma licencję niekomercyjną (komercyjną wykupisz samodzielnie u BFL). To domyślny wybór do poważnej, lokalnej pracy nad grafiką.
- FLUX.1 [pro] - najwyższa jakość i najlepsze trzymanie się promptu, ale model zamknięty. Nie pobierzesz go - działa wyłącznie przez API (BFL, Replicate, fal.ai). Płacisz za wygenerowany obraz.
Trade-off jest tu czytelny: schnell to szybkość i wolność licencyjna, dev to jakość na własnym sprzęcie, pro to maksymalna jakość, ale w chmurze i za opłatą. Dla większości osób, które chcą pracować lokalnie i za darmo, ścieżka prowadzi przez dev albo schnell.
Do tego doszły rozszerzenia. FLUX.1 Tools (listopad 2024) to zestaw do edycji: Fill do inpaintingu i outpaintingu, Depth i Canny do sterowania kompozycją, Redux do mieszania obrazów. Kolejny kamień milowy to FLUX.1 Kontext (maj 2025) - modele do edycji obrazu w kontekście, gdzie prompt to jednocześnie tekst i obraz wejściowy (wersja Kontext dev dostała otwarte wagi w czerwcu 2025). Latem 2025 pojawił się jeszcze FLUX.1 Krea [dev], dostrojony pod bardziej naturalną estetykę we współpracy z Krea AI.
FLUX.2 - co się zmieniło
W listopadzie 2025 roku Black Forest Labs wypuściło serię FLUX.2 z wariantami Pro, Flex, Dev oraz otwartym Klein (Apache 2.0, "mały" po niemiecku). Zmiana pod maską jest istotna: FLUX.2 stoi na architekturze latent flow matching i korzysta z modelu Mistral-3 (24 miliardy parametrów) jako komponentu rozumiejącego język i obraz. W praktyce oznacza to lepsze przyleganie do promptu, mocniejszy fotorealizm, wierniejszą typografię i sprawniejszą pracę z obrazem referencyjnym.
Logika wariantów została ta sama co w FLUX.1: Klein jest otwarty i darmowy, Dev daje otwarte wagi na licencji niekomercyjnej, a Pro i Flex to zamknięte API. Jeśli więc zrozumiesz podział schnell/dev/pro, w FLUX.2 poruszasz się bez zaskoczeń.
Ile VRAM potrzeba, żeby uruchomić FLUX lokalnie
Konkret: to jest najczęstsze pytanie i najczęstsze źródło rozczarowań. FLUX to duży model. Pełne wagi FLUX.1 dev czy schnell (12 miliardów parametrów) w precyzji fp16 zajmują około 23-24 GB. Oznacza to, że w wersji "bez kompromisów" celujesz w kartę z 24 GB pamięci - w praktyce RTX 4090 albo 3090.
To nie znaczy, że bez karty za kilkanaście tysięcy złotych odbijasz się od ściany. Społeczność szybko przygotowała lżejsze warianty:
- fp8 - wersja skwantyzowana do 8 bitów mieści się orientacyjnie w ~12 GB VRAM. To zakres kart pokroju RTX 4070 Ti czy 3060 12 GB.
- GGUF (Q4 i niżej) - mocno skwantyzowane wagi uruchomisz nawet na 8 GB VRAM. Trade-off: wolniejsza generacja i lekki spadek jakości, ale FLUX rusza.
W praktyce wygląda to tak: masz 24 GB - bierzesz pełne fp16 i nie kombinujesz. Masz 12 GB - schodzisz na fp8. Masz 8 GB - sięgasz po GGUF i uzbrajasz się w cierpliwość. Jeśli lokalny sprzęt nie wyrabia, a chcesz zostać przy własnej infrastrukturze, warto spojrzeć na dedykowane maszyny AI z dużą pulą pamięci - o jednej takiej piszę w tekście o NVIDIA DGX Spark, który sam potrafi zjeść kilka gigabajtów. Dlatego realny sufit jest niższy, niż sugeruje sam rozmiar modelu, i dlatego warianty fp8 oraz GGUF są tak popularne na kartach 8-12 GB.
Jak uruchomić FLUX lokalnie w ComfyUI
Najpopularniejsza droga do lokalnego FLUX prowadzi przez ComfyUI, w którym budujesz proces generacji jak schemat blokowy. Brzmi technicznie, ale do FLUX istnieją gotowe workflowy, które wystarczy wczytać. Alternatywą jest Stable Diffusion WebUI Forge, czyli fork klasycznego AUTOMATIC1111 - jeśli znasz już świat Stable Diffusion, poczujesz się w nim swojsko.
Ścieżka jest w praktyce zawsze podobna:
- Pobierz wagi modelu. Oficjalne repozytoria Black Forest Labs znajdziesz na Hugging Face. Dla dev musisz zaakceptować licencję i zalogować się kontem; schnell pobierzesz bez tych formalności.
- Dołóż komponenty pomocnicze. FLUX potrzebuje enkodera tekstu (T5 oraz CLIP) i pliku VAE. W poradnikach do ComfyUI są one wypisane razem z modelem - pobierasz je raz i odkładasz do właściwych katalogów.
- Wrzuć pliki do folderów ComfyUI. Model do
models/unet, enkodery domodels/clip, VAE domodels/vae. Nazwy folderów bywają różne między wersjami - trzymaj się instrukcji swojego workflow. - Wczytaj workflow FLUX i generuj. Wpisujesz prompt, ustawiasz liczbę kroków (dla schnell wystarczą 4, dev lubi 20-30) i uruchamiasz.
Jeśli dopiero wchodzisz w temat lokalnej generacji obrazów, zacznij od podstaw - opisałem je krok po kroku w przewodniku jak uruchomić Stable Diffusion lokalnie albo fal.ai. To dobry sposób, żeby sprawdzić, czy jakość ci odpowiada, zanim zainwestujesz w sprzęt.
FLUX a Stable Diffusion i inne generatory
To zależy - od tego, co cenisz. FLUX i Stable Diffusion łączy wspólne DNA (ci sami twórcy) i ta sama filozofia otwartości: pobierasz model, trzymasz dane u siebie, nie płacisz abonamentu. Różnica jest w skali i świeżości. FLUX to nowszy, większy model - lepiej renderuje tekst i dłonie, mocniej trzyma się promptu. Ceną jest apetyt na VRAM: Stable Diffusion (zwłaszcza SD 1.5) odpala się na słabszych kartach, FLUX wymaga więcej.
Wobec zamkniętych generatorów jak DALL-E 3 czy Midjourney FLUX ma jeden decydujący atut - kontrolę. Wersje dev i schnell działają offline, bez wysyłania promptów i danych do cudzej chmury, bez limitów subskrypcji i bez cenzury narzuconej przez dostawcę. Dla kogoś, kto pracuje na wrażliwych materiałach albo po prostu nie chce oddawać danych korporacji, to nie jest drobiazg, tylko główny powód, żeby wybrać FLUX. Za tę kontrolę płacisz konfiguracją i sprzętem - chmurowy generator odpalisz w przeglądarce w minutę, lokalny FLUX wymaga karty graficznej i chwili na setup.
Bez owijania: jeśli chcesz najwyższą jakość od ręki i nie przeszkadza ci abonament - zostań przy pro (API) albo Midjourney. Jeśli zależy ci na prywatności, braku opłat za obraz i pełnej kontroli - dev lub schnell na własnym GPU to twój wybór. Warto też pamiętać o licencji: schnell (Apache 2.0) użyjesz komercyjnie bez pytania, dev do celów komercyjnych wymaga licencji od BFL. Same wygenerowane obrazy pozostają twoje - prawa do outputu zachowuje użytkownik.
FAQ
Czym różni się FLUX schnell od dev i pro? Schnell to najszybszy, w pełni otwarty wariant (Apache 2.0) do szybkich testów i użytku komercyjnego. Dev daje wyraźnie lepszą jakość na otwartych wagach, ale z licencją niekomercyjną. Pro to najwyższa jakość, model zamknięty, dostępny tylko przez płatne API. Lokalnie uruchamiasz schnell albo dev.
Ile VRAM potrzeba, żeby uruchomić FLUX lokalnie? Pełne wagi FLUX.1 dev w fp16 zajmują około 23-24 GB, więc komfortowo działają na karcie z 24 GB (RTX 4090, 3090). Wersja fp8 mieści się orientacyjnie w 12 GB, a mocno skwantyzowany format GGUF uruchomisz nawet na 8 GB kosztem szybkości i lekkiego spadku jakości.
Czy FLUX jest darmowy? Warianty schnell i dev pobierzesz za darmo z Hugging Face i uruchomisz lokalnie bez opłat. Schnell wolno używać komercyjnie, dev komercyjnie wymaga licencji od Black Forest Labs. Wariant pro jest płatny i dostępny tylko przez API. Online spotkasz też darmowe warstwy z limitami na stronach zewnętrznych.
FLUX czy Stable Diffusion - co wybrać? FLUX to nowszy i większy model od tych samych twórców - lepiej renderuje tekst, dłonie i szczegóły, ale potrzebuje więcej VRAM. Stable Diffusion, zwłaszcza SD 1.5, odpali się na słabszej karcie. Jeśli masz GPU z 12 GB lub więcej i zależy ci na jakości, wybierz FLUX. Na słabszym sprzęcie zostań przy Stable Diffusion.
Czy FLUX jest lepszy od DALL-E i Midjourney? W testach jakość promptów FLUX stawiano obok DALL-E 3, a fotorealizm obok Midjourney. Przewagą FLUX nie jest jednak sam wynik, tylko otwartość: wersje dev i schnell działają lokalnie, offline, bez abonamentu i bez wysyłania danych do chmury. DALL-E i Midjourney zostają zamkniętymi usługami w przeglądarce.
Czy mogę używać obrazów z FLUX komercyjnie? Tak - prawa do wygenerowanych obrazów zachowuje użytkownik, niezależnie od wariantu. Uwaga jednak na licencję samego modelu: schnell (Apache 2.0) i pro (płatne API) obejmują użytek komercyjny wprost, natomiast komercyjne korzystanie z FLUX.1 dev wymaga wykupienia osobnej licencji u Black Forest Labs.
Interesuje cię lokalne AI szerzej niż sama grafika? Zajrzyj do przewodnika po lokalnych modelach językowych z Ollamą - ta sama filozofia kontroli nad danymi, tylko zamiast obrazów generujesz tekst.