Autor: Jakub Rusinowski · Ostatnia aktualizacja: 21 lipca 2026
Nie wiesz, który model uruchomić? Ten przewodnik przecina szum. Rekomendujemy jeden najlepszy model na poziom VRAM — ten, od którego większość użytkowników powinna zacząć.
Nie wiesz, który model uruchomić? Ten przewodnik przecina szum. Rekomendujemy jeden najlepszy model na poziom VRAM — ten, od którego większość użytkowników powinna zacząć.
Najlepszy wybór: Phi-4 Mini (3.8B, Q4_K_M)
ollama run phi4-miniWicelider: Gemma 3 4B (ollama run gemma3:4b) — lepsza do pisania kreatywnego, 3.5 GB.
Czego oczekiwać: Kompetentny asystent do codziennego czatu, pomocy w kodowaniu i pisania. Nie oczekuj rozumowania na poziomie 70B, ale jak na 4 GB, to imponujące.
Najlepszy wybór: Llama 3.1 8B (Q4_K_M)
ollama run llama3.1:8bWicelider do kodowania: Qwen 2.5 Coder 7B (ollama run qwen2.5-coder:7b) — najlepszy czysto kodujący model 8B.
Wicelider do rozumowania: DeepSeek R1 8B Distill (ollama run deepseek-r1:8b) — rozumowanie zbliżone do GPT-4 w 8B.
Najlepszy wybór: Qwen 3 8B (Q8_0) — uruchom w wyższej jakości, bo masz zapas
ollama run qwen3:8bLub wypróbuj: Gemma 3 12B Q4 (ollama run gemma3:12b) — najlepszy średni model Google.
Najlepszy wybór: Qwen 3 14B (Q4_K_M)
ollama run qwen3:14bWicelider do kodowania: Qwen 2.5 Coder 14B (ollama run qwen2.5-coder:14b)
Najlepszy do długich dokumentów: Mistral Small 3.1 (ollama run mistral-small) — okno kontekstu 128K.
Najlepszy wybór: DeepSeek R1 32B (Q4_K_M)
ollama run deepseek-r1:32bAlternatywa: Qwen 3 32B (ollama run qwen3:32b) — też się mieści, mocniejszy w zadaniach ogólnych.
Najlepszy wybór: Llama 4 Scout (Q4_K_M)
ollama run llama4:scoutDla modeli 70B: Llama 3.3 70B Q4_K_M potrzebuje 42 GB — działa na Apple M2/M4 Ultra (128–192 GB pamięci zunifikowanej) lub zestawach dwóch RTX 4090/5090.
| VRAM | Najlepszy model | Komenda Ollama | Szybkość |
|---|---|---|---|
| 4 GB | Phi-4 Mini | ollama run phi4-mini | ~40 t/s |
| 8 GB | Llama 3.1 8B | ollama run llama3.1:8b | ~70 t/s |
| 12 GB | Qwen 3 8B Q8 | ollama run qwen3:8b | ~80 t/s |
| 16 GB | Qwen 3 14B | ollama run qwen3:14b | ~85 t/s |
| 24 GB | DeepSeek R1 32B | ollama run deepseek-r1:32b | ~50 t/s |
| 32 GB+ | Llama 4 Scout | ollama run llama4:scout | 175 t/s |
→ Sprawdź dokładną zgodność swojego GPU | → Przeglądaj wszystkie modele