Autor: Jakub Rusinowski · Ostatnia aktualizacja: 15 sierpnia 2026
Odpowiedz na cztery krótkie pytania — albo przeglądaj gotowe zestawy według ceny — i zobacz dokładnie, co kupić do lokalnych LLM: listy części DIY, gotowe mini-PC i laptopy, każdy z listą modeli, które naprawdę uruchomi.
Ujawnienie afiliacyjne: Niektóre odnośniki na tej stronie to linki afiliacyjne — jeśli dokonasz zakupu za ich pośrednictwem, LLM Configurator może otrzymać prowizję bez dodatkowych kosztów dla Ciebie. Jako uczestnik programu Amazon Associates, LLM Configurator zarabia na kwalifikujących się zakupach.
Ceny GPU/RAM w 2026 są zmienne — zawsze sprawdź aktualną ofertę.
Najtańsza cicha, całodobowa maszynka AI: 16GB pamięci zunifikowanej dobrze prowadzi modele 7–8B w obudowie wielkości dłoni, poborze kilku watów w spoczynku.
Budżetowy mini-PC pod Windows/Linux: 32GB pamięci zunifikowanej uruchamia modele 13–14B w cichej, kompaktowej obudowie, która służy też jako zwykły desktop.
Klasyczny wybór wartościowy: 16GB nowej karty z zapasem obsługuje modele coderskie i wizyjne 14B, na nowoczesnej platformie AM5 z latami możliwości rozbudowy.
Co uruchomi: Qwen 3.5 122B (10B active) · Qwen3-Coder 80B/3B active · Qwen 3.6 35B (3B active) — ~18 tok/s
Optimum pamięci zunifikowanej: 256 GB/s Strix Halo nad 128GB prowadzi 70B Q4 w używalnym tempie i mieści gigantyczne modele MoE, których żadna konsumencka karta nie udźwignie — 30–40% taniej niż porównywalny Mac Studio.
Zrównoważony laptop do AI: 24GB pamięci zunifikowanej po cichu prowadzi modele 13–14B na baterii — żaden laptop z dedykowanym GPU w tej cenie nie załaduje modeli tej wielkości.
Najzdolniejszy laptop AI na rynku: 48GB zunifikowane przy 546 GB/s szybko prowadzi modele 32B i mieści 70B Q4 — możliwości, których żaden laptop PC nie dorówna przy żadnym poborze mocy.
Sensowny zestaw startowy z używanym RTX 3060 12GB zamyka się poniżej 500 USD i uruchamia modele 7–8B. Optimum to 1 000–1 300 USD — nowy zestaw z RTX 4060 Ti 16GB albo używany RTX 3090 24GB — pokrywające modele 14–32B. Za ok. 2 400–2 900 USD (RTX 4090 lub dwa RTX 3090) uruchomisz modele klasy 70B w kwantyzacji Q4.
Jak najtaniej uruchomić lokalnie model 70B?
Dwie drogi: zestaw z dwoma używanymi RTX 3090 (ok. 2 900 USD, 48GB wspólnego VRAM, najszybszy) albo mini-PC ze 128GB pamięci zunifikowanej, np. Beelink GTR9 Pro (ok. 1 899 USD) — tańszy i cichy, ale przez przepustowość 256 GB/s około cztery razy wolniejszy.
Mini-PC czy własny składak do lokalnego AI?
DIY wygrywa szybkością za dolara: dedykowane GPU mają 3–7× większą przepustowość pamięci niż konstrukcje zunifikowane. Mini-PC wygrywa pojemnością za dolara, ciszą i wygodą — 128GB Strix Halo pomieści modele 70B+, których żadna konsumencka karta nie udźwignie. DIY do szybkiej interakcji, mini-PC do dużych modeli lub cichego biura.
Czy używany RTX 3090 nadal się opłaca w 2026?
Tak — za ok. 650–750 USD to wciąż najlepszy VRAM za dolara. 24GB mieści modele 32B Q4 w całości w VRAM, a przepustowość 936 GB/s jest blisko RTX 4090. Kupuj u sprzedawcy ze zwrotami i po odbiorze przetestuj pamięć.
Czy Maki nadają się do lokalnych LLM?
Apple Silicon świetnie sprawdza się w cichych, całodobowych konfiguracjach: pamięć zunifikowana pozwala Mac mini M4 Pro czy MacBookowi Pro M4 Max załadować modele, których karta w tej cenie nie pomieści. Tempo generowania jest niższe niż na dedykowanej karcie NVIDIA, a M4 Max kończy się dziś na 96GB — wystarczy na 70B Q4, ale nie na największe modele MoE.