LLaVA Instruct — LLM Wizja Dataset
Visual instruction tuning dataset. Contains 158k unique language-image instruction-following samples to make LLMs 'see'.
Dataset Details
| Provider | Haotian Liu |
| Category | Wizja |
| Size | 158k Samples |
| License | CC-BY-NC 4.0 |
| Downloads | 200k |
| Tags | Vision, Image, Multimodal |
from datasets import load_dataset
ds = load_dataset("liuhaotian/LLaVA-Instruct-150K")
Powiązane zbiory danych
- ShareGPT 52K — Teaching natural multi-turn dialogue (non-commercial)
Najczęstsze pytania
Czy mogę użyć LLaVA Instruct komercyjnie?
Nie w produkcie — LLaVA Instruct jest udostępniony na licencji CC-BY-NC 4.0, która ogranicza użycie do badań i innych celów niekomercyjnych. Do komercyjnego fine-tuningu wybierz zbiór na liberalnej licencji z tej samej kategorii.
Ile danych zawiera LLaVA Instruct i czy potrzebuję wszystkich?
LLaVA Instruct zawiera 158k Samples. Rzadko potrzebujesz całości: do fine-tuningu stylu i formatu wystarcza kilkaset–kilka tysięcy przykładów — załaduj wycinek (np. split="train[:1000]") i zwiększaj skalę tylko, gdy jakość przestaje rosnąć.
Do czego LLaVA Instruct nadaje się najlepiej?
Adding image understanding to an open LLM (the LLaVA recipe). Należy do sekcji „Wizja" naszego centrum zbiorów danych, gdzie znajdziesz alternatywy i zbiory komplementarne.
← Wszystkie zbiory danych | Fine-Tuning Guide