LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Status
- Nicht verfügbar
- Kontext
- 32,768 Token
- Max. Ausgabe
- 4,096 Token
- Eingabe → Ausgabe
- Text + Bild + Video → Text
- Entwickler
- Replicate
- Aktualisiert
- 25. Juni 2026
LLaVA-OneVision 72B ist derzeit nicht verfügbar
Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.
Die Angaben auf dieser Seite kannst du weiter nachlesen. Mit einer der verfügbaren Alternativen unten kannst du sofort ein vergleichbares Modell nutzen.
Zu den AlternativenVergleichbare Modelle
Alle dieser Kategorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
ca. $ 0.00030/Lauf
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
$ 6.00/1 Mio. In
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
$ 3.60/1 Mio. In
Playground
LLaVA-OneVision 72B ausprobieren
Eingabe & Ergebnis
Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.
Der Playground ist deaktiviert. Vergleichbare Modelle findest du in derselben Kategorie: Alternativen ansehen
Dieser Lauf
Kein Preis – derzeit nicht verfügbar.
Neu hier?
5 Gratis-Credits ($ 0.05) bei Anmeldung mit Google
Nutzbar 24 Stunden nach der Anmeldung, bis zu 5 Läufe pro Tag und höchstens 2 Credits je Lauf. Andere Anmeldearten starten ohne Guthaben.
Über LLaVA-OneVision 72B
LLaVA-OneVision 72B ist ein Modell von Replicate aus der Kategorie Multimodal. Über Railwail ist LLaVA-OneVision 72B derzeit nicht verfügbar. Das Kontextfenster umfasst 32,768 Token, eine Antwort bis zu 4,096 Token.
Preise
Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Für dieses Modell gibt es derzeit keinen Preis, deshalb lässt es sich nicht ausführen.
API
Kein geprüftes API-Beispiel
Die öffentliche API übergibt ein anderes Eingabeformat, als dieses Modell braucht. Nutze den Playground oben.
Spezifikationen
- Modell-ID
llava-onevision-72b- Entwickler
- Replicate
- Kategorie
- Multimodal
- Eingabe
- Text, Bild, Video
- Ausgabe
- Text
- Kontextfenster
- 32,768 Token
- Max. Ausgabe
- 4,096 Token
- Katalogeintrag aktualisiert
- 25. Juni 2026
Eingabeparameter
Eingaben und Einstellungen laut Eingabeschema des Modells. Welche davon die API annimmt, zeigt das Beispiel im Abschnitt API.
promptPflichtUser message or question about the image
Typ: TextStandard: –Erlaubte Werte: bis 16,000 Zeichentop_pTyp: ZahlStandard:1Erlaubte Werte: 0 bis 1streamTyp: Ja/NeinStandard:falseErlaubte Werte: –image_urlOptional image URL to analyze
Typ: TextStandard: –Erlaubte Werte: –max_tokensTyp: GanzzahlStandard:1024Erlaubte Werte: 1 bis 4,096temperatureTyp: ZahlStandard:0.7Erlaubte Werte: 0 bis 2system_promptOptional system instruction
Typ: TextStandard: –Erlaubte Werte: bis 8,000 Zeichen
Schlagwörter
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Häufige Fragen
Was ist LLaVA-OneVision 72B?
LLaVA-OneVision 72B ist ein Modell von Replicate aus der Kategorie Multimodal. Es steht im Railwail-Katalog, lässt sich derzeit aber nicht ausführen.
Was kostet LLaVA-OneVision 72B bei Railwail?
LLaVA-OneVision 72B lässt sich über Railwail derzeit nicht ausführen, deshalb gibt es keinen aktuellen Preis. Verfügbare Alternativen mit Preisen stehen weiter unten auf dieser Seite.
Wie gross ist das Kontextfenster von LLaVA-OneVision 72B?
Das Kontextfenster von LLaVA-OneVision 72B umfasst 32,768 Token. Eine Antwort kann bis zu 4,096 Token lang sein.
Wie schnell ist LLaVA-OneVision 72B?
Für LLaVA-OneVision 72B gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.
Ist LLaVA-OneVision 72B besser als BLIP?
Das hängt von der Aufgabe ab. LLaVA-OneVision 72B (Replicate) und BLIP (Salesforce) sind beide Modelle aus der Kategorie Multimodal. Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.
LLaVA-OneVision 72B und BLIP vergleichenKann LLaVA-OneVision 72B Bilder verarbeiten?
Ja. LLaVA-OneVision 72B nimmt neben Text auch Bilder als Eingabe an.
Kann ich LLaVA-OneVision 72B gerade nutzen?
Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Die Seite bleibt online; verfügbare Alternativen aus derselben Kategorie stehen weiter unten.
Alle Modelle über eine API
Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = $ 0.01.