LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Status
- Niedostępne
- Kontekst
- 32 768 tokenów
- Maks. wyjście
- 4096 tokenów
- Wejście → Wyjście
- Tekst + Obraz + Wideo → Tekst
- Deweloper
- Replicate
- Zaktualizowano
- 25 czerwca 2026
LLaVA-OneVision 72B jest obecnie niedostępny
Obecnie niedostępne: ten model został dezaktywowany.
Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.
Przejdź do alternatywPorównywalne modele
Wszystkie w tej kategorii- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/uruchomienie
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M wej.
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M wej.
Playground
Spróbuj LLaVA-OneVision 72B
Wejście i wyjście
Obecnie niedostępne: ten model został dezaktywowany.
Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy
To uruchomienie
Brak ceny – obecnie niedostępne.
Nowy tutaj?
5 darmowych kredytów (0,05 USD) po zarejestrowaniu się przez Google
Dostępne 24 godzin po rejestracji, do 5 uruchomień dziennie i maksymalnie 2 kredytów na uruchomienie. Inne metody logowania uruchamiają się bez kredytów.
O LLaVA-OneVision 72B
LLaVA-OneVision 72B to model opracowany przez Replicate w kategorii Multimodalne. LLaVA-OneVision 72B nie jest obecnie dostępny w serwisie Railwail. Okno kontekstu zawiera 32 768 tokenów, a jedna odpowiedź może mieć do 4096 tokenów.
Ceny
Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.
API
Brak zweryfikowanego przykładu API
Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.
Specyfikacje
- ID modelu
llava-onevision-72b- Deweloper
- Replicate
- Kategoria
- Multimodalne
- Wejście
- Tekst, Obraz, Wideo
- Wyjście
- Tekst
- Okno kontekstu
- 32 768 tokenów
- Maks. wyjście
- 4096 tokenów
- Wpis w katalogu zaktualizowany
- 25 czerwca 2026
Parametry wejściowe
Dane wejściowe i ustawienia ze schematu wejściowego modelu. Przykład w sekcji API pokazuje, które z nich API akceptuje.
promptwymaganeUser message or question about the image
Typ: TekstDomyślnie: –Dozwolone wartości: do 16 000 znakówtop_pTyp: LiczbaDomyślnie:1Dozwolone wartości: 0 do 1streamTyp: Tak/NieDomyślnie:falseDozwolone wartości: –image_urlOptional image URL to analyze
Typ: TekstDomyślnie: –Dozwolone wartości: –max_tokensTyp: Liczba całkowitaDomyślnie:1024Dozwolone wartości: 1 do 4096temperatureTyp: LiczbaDomyślnie:0.7Dozwolone wartości: 0 do 2system_promptOptional system instruction
Typ: TekstDomyślnie: –Dozwolone wartości: do 8000 znaków
Tagi
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Często zadawane pytania
Co to jest LLaVA-OneVision 72B?
LLaVA-OneVision 72B to model opracowany przez Replicate w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.
Ile kosztuje LLaVA-OneVision 72B w serwisie Railwail?
LLaVA-OneVision 72B nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.
Jakie jest okno kontekstu LLaVA-OneVision 72B?
Okno kontekstu LLaVA-OneVision 72B zawiera 32 768 tokenów. Jedna odpowiedź może mieć do 4096 tokenów.
Jak szybki jest LLaVA-OneVision 72B?
Dla LLaVA-OneVision 72B jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.
Czy LLaVA-OneVision 72B jest lepszy niż BLIP?
To zależy od zadania. LLaVA-OneVision 72B (Replicate) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.
Porównaj LLaVA-OneVision 72B i BLIPCzy LLaVA-OneVision 72B może przetwarzać obrazy?
Tak. LLaVA-OneVision 72B akceptuje obrazy jako wejście oprócz tekstu.
Czy mogę używać LLaVA-OneVision 72B teraz?
Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.
Wszystkie modele przez jedno API
Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.