LLaVA-OneVision 72B

MultimodalNicht verfügbar
von ReplicateModell-ID: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Status
Nicht verfügbar
Kontext
32,768 Token
Max. Ausgabe
4,096 Token
Eingabe → Ausgabe
Text + Bild + Video → Text
Entwickler
Replicate
Aktualisiert
25. Juni 2026

LLaVA-OneVision 72B ist derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Die Angaben auf dieser Seite kannst du weiter nachlesen. Mit einer der verfügbaren Alternativen unten kannst du sofort ein vergleichbares Modell nutzen.

Zu den Alternativen
01

Vergleichbare Modelle

Alle dieser Kategorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ca. $ 0.00030/Lauf

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    $ 6.00/1 Mio. In

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    $ 3.60/1 Mio. In

02

Playground

LLaVA-OneVision 72B ausprobieren

Eingabe & Ergebnis

Derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Der Playground ist deaktiviert. Vergleichbare Modelle findest du in derselben Kategorie: Alternativen ansehen

LLaVA-OneVision 72B ausprobieren

0 / 16'000

Erweiterte Einstellungen (4)

0 / 8'000

Ergebnis
Die Antwort erscheint hier.

Dieser Lauf

Kein Preis – derzeit nicht verfügbar.

Neu hier?

5 Gratis-Credits ($ 0.05) bei Anmeldung mit Google

Nutzbar 24 Stunden nach der Anmeldung, bis zu 5 Läufe pro Tag und höchstens 2 Credits je Lauf. Andere Anmeldearten starten ohne Guthaben.

03

Über LLaVA-OneVision 72B

Kurz gesagtStand: 25. Juni 2026

LLaVA-OneVision 72B ist ein Modell von Replicate aus der Kategorie Multimodal. Über Railwail ist LLaVA-OneVision 72B derzeit nicht verfügbar. Das Kontextfenster umfasst 32,768 Token, eine Antwort bis zu 4,096 Token.

04

Preise

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Für dieses Modell gibt es derzeit keinen Preis, deshalb lässt es sich nicht ausführen.

05

API

Rufe LLaVA-OneVision 72B mit deinem Railwail-API-Schlüssel auf. Diese Modell-ID gehört in die Anfrage:

Kein geprüftes API-Beispiel

Die öffentliche API übergibt ein anderes Eingabeformat, als dieses Modell braucht. Nutze den Playground oben.

06

Spezifikationen

Modell-ID
llava-onevision-72b
Entwickler
Replicate
Kategorie
Multimodal
Eingabe
Text, Bild, Video
Ausgabe
Text
Kontextfenster
32,768 Token
Max. Ausgabe
4,096 Token
Katalogeintrag aktualisiert
25. Juni 2026

Eingabeparameter

Eingaben und Einstellungen laut Eingabeschema des Modells. Welche davon die API annimmt, zeigt das Beispiel im Abschnitt API.

  • promptPflicht

    User message or question about the image

    Typ: Text
    Standard:
    Erlaubte Werte: bis 16,000 Zeichen
  • top_p
    Typ: Zahl
    Standard: 1
    Erlaubte Werte: 0 bis 1
  • stream
    Typ: Ja/Nein
    Standard: false
    Erlaubte Werte:
  • image_url

    Optional image URL to analyze

    Typ: Text
    Standard:
    Erlaubte Werte:
  • max_tokens
    Typ: Ganzzahl
    Standard: 1024
    Erlaubte Werte: 1 bis 4,096
  • temperature
    Typ: Zahl
    Standard: 0.7
    Erlaubte Werte: 0 bis 2
  • system_prompt

    Optional system instruction

    Typ: Text
    Standard:
    Erlaubte Werte: bis 8,000 Zeichen

Schlagwörter

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Häufige Fragen

Was ist LLaVA-OneVision 72B?

LLaVA-OneVision 72B ist ein Modell von Replicate aus der Kategorie Multimodal. Es steht im Railwail-Katalog, lässt sich derzeit aber nicht ausführen.

Was kostet LLaVA-OneVision 72B bei Railwail?

LLaVA-OneVision 72B lässt sich über Railwail derzeit nicht ausführen, deshalb gibt es keinen aktuellen Preis. Verfügbare Alternativen mit Preisen stehen weiter unten auf dieser Seite.

Wie gross ist das Kontextfenster von LLaVA-OneVision 72B?

Das Kontextfenster von LLaVA-OneVision 72B umfasst 32,768 Token. Eine Antwort kann bis zu 4,096 Token lang sein.

Wie schnell ist LLaVA-OneVision 72B?

Für LLaVA-OneVision 72B gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.

Ist LLaVA-OneVision 72B besser als BLIP?

Das hängt von der Aufgabe ab. LLaVA-OneVision 72B (Replicate) und BLIP (Salesforce) sind beide Modelle aus der Kategorie Multimodal. Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.

LLaVA-OneVision 72B und BLIP vergleichen

Kann LLaVA-OneVision 72B Bilder verarbeiten?

Ja. LLaVA-OneVision 72B nimmt neben Text auch Bilder als Eingabe an.

Kann ich LLaVA-OneVision 72B gerade nutzen?

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Die Seite bleibt online; verfügbare Alternativen aus derselben Kategorie stehen weiter unten.

Alle Modelle über eine API

Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = $ 0.01.