Autor: Jakub Rusinowski · Ostatnia aktualizacja: 12 lipca 2026
Są dwa sposoby, by mieć AI na telefonie. Wnioskowanie na urządzeniu uruchamia mały model 1B–4B bezpośrednio na układzie telefonu — w pełni offline, ale z ograniczeniami (zobacz [Uruchamianie LLM-ów na
Są dwa sposoby, by mieć AI na telefonie. Wnioskowanie na urządzeniu uruchamia mały model 1B–4B bezpośrednio na układzie telefonu — w pełni offline, ale z ograniczeniami (zobacz Uruchamianie LLM-ów na telefonie). Wnioskowanie zdalne uruchamia model na Twoim mocnym komputerze i przesyła czat strumieniowo na telefon — dzięki czemu możesz sterować modelem 14B, 32B, a nawet 70B prosto z kieszeni.
Ten poradnik omawia ścieżkę zdalną z użyciem LM Link od LM Studio i aplikacji Locally, a także ręczną alternatywę dla Androida i użytkowników zaawansowanych.
LM Studio dzieli to na dwa elementy:
| Element | Czym jest | Gdzie |
|---|---|---|
| Locally | Aplikacja czatowa | iPhone / iPad (App Store) |
| LM Link | Szyfrowana warstwa dostępu zdalnego | Wbudowana w LM Studio i Locally |
LM Link działa na bazie własnej sieci mesh VPN Tailscale. Oba urządzenia logują się na to samo konto LM Studio, a ta wspólna tożsamość uwierzytelnia połączenie. Serwerów LM Studio dotyka wyłącznie lista wykrytych urządzeń — Twoje rozmowy zostają na Twoim sprzęcie.
> Status (czerwiec 2026): wymaga LM Studio w wersji 0.4.16+. Wczesna lista oczekujących na Preview, wymagająca zgłoszenia, została zniesiona 8 czerwca 2026, więc LM Link jest otwarty dla wszystkich. W okresie Preview jest darmowy; Locally na start działa tylko na iPhone'a i iPada (na razie bez Androida).
Krok 1 — Przygotuj komputer 1. Zaktualizuj LM Studio do wersji 0.4.16+. 2. Zaloguj się na swoje konto LM Studio. 3. Pobierz model do serwowania. W aplikacji naciśnij Cmd/Ctrl + Shift + M, by wyszukać modele, albo skorzystaj z CLI: ``bash lms get lmstudio-community/Qwen2.5-7B-Instruct-GGUF ``
Krok 2 — Włącz LM Link 1. Otwórz stronę LM Link wewnątrz LM Studio. 2. Włącz ją (od kompilacji z 8 czerwca nie trzeba już listy oczekujących).
Krok 3 — Skonfiguruj telefon 1. Zainstaluj Locally z App Store. 2. Zaloguj się na to samo konto LM Studio. 3. Twój komputer pojawi się jako dostępny host — wybierz go.
Krok 4 — Rozmawiaj 1. Wybierz model, który Twój komputer ma załadowany. 2. Wyślij wiadomość. Wnioskowanie działa na komputerze, a odpowiedź płynie strumieniem na telefon przez szyfrowane połączenie.
To cała konfiguracja. Żadnych adresów IP, przekierowań portów ani kodów QR — logowanie na wspólne konto samo nawiązuje sieć mesh.
Locally działa na razie tylko na iOS, ale do wbudowanego serwera LM Studio dotrze każda aplikacja czatowa zgodna z OpenAI.
Krok 1 — Uruchom serwer LM Studio
``bash lms server start --port 1234 ``
http://localhost:1234/v1 z endpointami takimi jak /v1/chat/completions, /v1/models i /v1/embeddings.Krok 2 — Udostępnij je telefonowi
0.0.0.0 zamiast do 127.0.0.1).192.168.1.42).Krok 3 — Skieruj na niego klienta mobilnego
http://<adres-LAN-komputera>:1234/v1, a pole klucza API zostaw puste (albo wpisz dowolny placeholder).Krok 4 (zalecany) — Zabezpiecz dostęp zdalny przez Tailscale
100.x.y.z) zamiast adresu LAN.Serwowanie z komputera całkowicie omija limit pamięci samego telefonu. Jeśli wolisz uruchomić model na urządzeniu, pamiętaj, że iOS ubija aplikację przekraczającą swój budżet pamięci, a pobieranie modelu zatrzymuje się, gdy aplikacja schodzi na drugi plan.
| VRAM / pamięć zunifikowana komputera | Dobry model zdalny | Dlaczego |
|---|---|---|
| 8 GB | Llama 3.1 8B / Qwen2.5 7B (Q4) | Szybko, mieści się z zapasem |
| 12–16 GB | Qwen2.5 14B / Mistral Small (Q4) | Duży skok jakości, wciąż żwawo |
| 24 GB | Qwen 3 32B / DeepSeek R1 32B (Q4) | Rozumowanie klasy desktopowej na telefonie |
| 32 GB+ / duży Mac | Llama 3.3 70B (Q4) | Lokalna inteligencja klasy frontier, zdalnie |
Skorzystaj z analizatora sprzętu, by potwierdzić dopasowanie, i przejrzyj bibliotekę modeli — każda strona modelu ma polecenie lms get do skopiowania jednym kliknięciem oraz skrót do LM Link.
127.0.0.1) jest tym, co Cię chroni. W chwili, gdy przypniesz serwer do 0.0.0.0, każdy w sieci może uderzyć w API — zabezpiecz je na poziomie sieci albo postaw przed nim uwierzytelniające reverse proxy, a do dostępu zdalnego wybieraj Tailscale zamiast przekierowania portów.1234.> Pamiętaj: LM Link działa *zdalnie*, a nie *offline*. Wymaga połączenia między telefonem a hostem. Do prawdziwego AI w trybie samolotowym użyj aplikacji działających na urządzeniu — zobacz Uruchamianie LLM-ów na telefonie.
→ Przeczytaj pogłębiony wpis na blogu | → Porównaj Ollama, LM Studio i Jan | → Skonfiguruj lokalny serwer API