Zbiór danych do wizualnego strojenia instrukcyjnego. Zawiera 158 tys. unikalnych par język–obraz w formacie instrukcji, dzięki którym LLM-y zaczynają „widzieć”.
Dataset Details
Provider
Haotian Liu
Category
Wizja
Size
158k Samples
License
CC-BY-NC 4.0
Downloads
200k
Tags
Vision, Image, Multimodal
from datasets import load_dataset
ds = load_dataset("liuhaotian/LLaVA-Instruct-150K")
Nie w produkcie — LLaVA Instruct jest udostępniony na licencji CC-BY-NC 4.0, która ogranicza użycie do badań i innych celów niekomercyjnych. Do komercyjnego fine-tuningu wybierz zbiór na liberalnej licencji z tej samej kategorii.
Ile danych zawiera LLaVA Instruct i czy potrzebuję wszystkich?
LLaVA Instruct zawiera 158k Samples. Rzadko potrzebujesz całości: do fine-tuningu stylu i formatu wystarcza kilkaset–kilka tysięcy przykładów — załaduj wycinek (np. split="train[:1000]") i zwiększaj skalę tylko, gdy jakość przestaje rosnąć.
Do czego LLaVA Instruct nadaje się najlepiej?
Adding image understanding to an open LLM (the LLaVA recipe). Należy do sekcji „Wizja" naszego centrum zbiorów danych, gdzie znajdziesz alternatywy i zbiory komplementarne.