LLaVA-OneVision 72B

MultimodalneNiedostępne
od ReplicateID modelu: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Status
Niedostępne
Kontekst
32 768 tokenów
Maks. wyjście
4096 tokenów
Wejście → Wyjście
Tekst + Obraz + Wideo → Tekst
Deweloper
Replicate
Zaktualizowano
25 czerwca 2026

LLaVA-OneVision 72B jest obecnie niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.

Przejdź do alternatyw
01

Porównywalne modele

Wszystkie w tej kategorii
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/uruchomienie

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M wej.

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M wej.

02

Playground

Spróbuj LLaVA-OneVision 72B

Wejście i wyjście

Niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy

Spróbuj LLaVA-OneVision 72B

0 / 16 000

Ustawienia zaawansowane (4)

0 / 8000

Wynik
Odpowiedź pojawi się tutaj.

To uruchomienie

Brak ceny – obecnie niedostępne.

Nowy tutaj?

5 darmowych kredytów (0,05 USD) po zarejestrowaniu się przez Google

Dostępne 24 godzin po rejestracji, do 5 uruchomień dziennie i maksymalnie 2 kredytów na uruchomienie. Inne metody logowania uruchamiają się bez kredytów.

03

O LLaVA-OneVision 72B

Krótko mówiącStan na 25 czerwca 2026

LLaVA-OneVision 72B to model opracowany przez Replicate w kategorii Multimodalne. LLaVA-OneVision 72B nie jest obecnie dostępny w serwisie Railwail. Okno kontekstu zawiera 32 768 tokenów, a jedna odpowiedź może mieć do 4096 tokenów.

04

Ceny

Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.

05

API

Wywołaj LLaVA-OneVision 72B za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:

Brak zweryfikowanego przykładu API

Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.

06

Specyfikacje

ID modelu
llava-onevision-72b
Deweloper
Replicate
Kategoria
Multimodalne
Wejście
Tekst, Obraz, Wideo
Wyjście
Tekst
Okno kontekstu
32 768 tokenów
Maks. wyjście
4096 tokenów
Wpis w katalogu zaktualizowany
25 czerwca 2026

Parametry wejściowe

Dane wejściowe i ustawienia ze schematu wejściowego modelu. Przykład w sekcji API pokazuje, które z nich API akceptuje.

  • promptwymagane

    User message or question about the image

    Typ: Tekst
    Domyślnie:
    Dozwolone wartości: do 16 000 znaków
  • top_p
    Typ: Liczba
    Domyślnie: 1
    Dozwolone wartości: 0 do 1
  • stream
    Typ: Tak/Nie
    Domyślnie: false
    Dozwolone wartości:
  • image_url

    Optional image URL to analyze

    Typ: Tekst
    Domyślnie:
    Dozwolone wartości:
  • max_tokens
    Typ: Liczba całkowita
    Domyślnie: 1024
    Dozwolone wartości: 1 do 4096
  • temperature
    Typ: Liczba
    Domyślnie: 0.7
    Dozwolone wartości: 0 do 2
  • system_prompt

    Optional system instruction

    Typ: Tekst
    Domyślnie:
    Dozwolone wartości: do 8000 znaków

Tagi

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Często zadawane pytania

Co to jest LLaVA-OneVision 72B?

LLaVA-OneVision 72B to model opracowany przez Replicate w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.

Ile kosztuje LLaVA-OneVision 72B w serwisie Railwail?

LLaVA-OneVision 72B nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.

Jakie jest okno kontekstu LLaVA-OneVision 72B?

Okno kontekstu LLaVA-OneVision 72B zawiera 32 768 tokenów. Jedna odpowiedź może mieć do 4096 tokenów.

Jak szybki jest LLaVA-OneVision 72B?

Dla LLaVA-OneVision 72B jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy LLaVA-OneVision 72B jest lepszy niż BLIP?

To zależy od zadania. LLaVA-OneVision 72B (Replicate) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj LLaVA-OneVision 72B i BLIP

Czy LLaVA-OneVision 72B może przetwarzać obrazy?

Tak. LLaVA-OneVision 72B akceptuje obrazy jako wejście oprócz tekstu.

Czy mogę używać LLaVA-OneVision 72B teraz?

Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.

Wszystkie modele przez jedno API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.