LLaVA-OneVision 72B

MultimodalNon disponible
par ReplicateID du modèle: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Statut
Non disponible
Contexte
32.768 tokens
Max. sortie
4.096 tokens
Entrée → Sortie
Texte + Image + Vidéo → Texte
Développeur
Replicate
Mis à jour
25 juin 2026

LLaVA-OneVision 72B n'est actuellement pas disponible

Actuellement indisponible : ce modèle a été désactivé.

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives
01

Modèles comparables

Tous dans cette catégorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $US/exécution

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 $US/1M entrée

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 $US/1M entrée

02

Playground

Essayer LLaVA-OneVision 72B

Entrée & résultat

Actuellement indisponible

Actuellement indisponible : ce modèle a été désactivé.

Le playground est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

Essayer LLaVA-OneVision 72B

0 / 16.000

Paramètres avancés (4)

0 / 8.000

Résultat
La réponse apparaît ici.

Cette exécution

Pas de prix – actuellement indisponible.

Nouveau par ici ?

5 crédits gratuits (0,05 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

03

À propos de LLaVA-OneVision 72B

RésuméAu 25 juin 2026

LLaVA-OneVision 72B est un modèle de Replicate dans la catégorie Multimodal. LLaVA-OneVision 72B n'est actuellement pas disponible sur Railwail. La fenêtre de contexte contient 32.768 tokens, et une réponse peut faire jusqu'à 4.096 tokens.

04

Tarification

Actuellement indisponible : ce modèle a été désactivé. Il n'y a actuellement pas de prix pour ce modèle, il ne peut donc pas être exécuté.

05

API

Appelez LLaVA-OneVision 72B avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modèle
llava-onevision-72b
Développeur
Replicate
Catégorie
Multimodal
Entrée
Texte, Image, Vidéo
Sortie
Texte
Fenêtre de contexte
32.768 tokens
Sortie max.
4.096 tokens
Entrée du catalogue mise à jour
25 juin 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • promptObligatoire

    User message or question about the image

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 16.000 caractères
  • top_p
    Type: Nombre
    Défaut: 1
    Valeurs autorisées: 0 à 1
  • stream
    Type: Oui/Non
    Défaut: false
    Valeurs autorisées: –
  • image_url

    Optional image URL to analyze

    Type: Texte
    Défaut: –
    Valeurs autorisées: –
  • max_tokens
    Type: Nombre entier
    Défaut: 1024
    Valeurs autorisées: 1 à 4.096
  • temperature
    Type: Nombre
    Défaut: 0.7
    Valeurs autorisées: 0 à 2
  • system_prompt

    Optional system instruction

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 8.000 caractères

Étiquettes

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Questions fréquemment posées

Qu'est-ce que LLaVA-OneVision 72B ?

LLaVA-OneVision 72B est un modèle de Replicate dans la catégorie Multimodal. Il est listé sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte LLaVA-OneVision 72B sur Railwail ?

LLaVA-OneVision 72B ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quelle est la fenêtre de contexte de LLaVA-OneVision 72B ?

La fenêtre de contexte de LLaVA-OneVision 72B contient 32.768 tokens. Une réponse peut faire jusqu'à 4.096 tokens.

Quelle est la vitesse de LLaVA-OneVision 72B ?

Il n'y a pas encore assez d'exécutions mesurées de LLaVA-OneVision 72B sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

LLaVA-OneVision 72B est-il meilleur que BLIP ?

Cela dépend de la tâche. LLaVA-OneVision 72B (Replicate) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer LLaVA-OneVision 72B et BLIP

LLaVA-OneVision 72B peut-il traiter des images ?

Oui. LLaVA-OneVision 72B accepte les images en entrée en plus du texte.

Puis-je utiliser LLaVA-OneVision 72B maintenant ?

Actuellement indisponible : ce modèle a été désactivé. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.