LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Statut
- Non disponible
- Contexte
- 32 768 tokens
- Max. sortie
- 4 096 tokens
- Entrée → Sortie
- Texte + Image + Vidéo → Texte
- Développeur
- Replicate
- Mis à jour
- 25 juin 2026
LLaVA-OneVision 72B n'est actuellement pas disponible
Actuellement indisponible : ce modèle a été désactivé.
Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.
Voir les alternativesModèles comparables
Tous dans cette catégorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 $US/exécution
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 $US/1M entrée
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 $US/1M entrée
Playground
Essayer LLaVA-OneVision 72B
Entrée et résultat
Actuellement indisponible : ce modèle a été désactivé.
Le playground est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives
Cette exécution
Pas de prix – actuellement indisponible.
Nouveau par ici ?
5 crédits gratuits (0,05 $US) lors de l'inscription avec Google
Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.
À propos de LLaVA-OneVision 72B
LLaVA-OneVision 72B est un modèle de Replicate dans la catégorie Multimodal. LLaVA-OneVision 72B n'est actuellement pas disponible sur Railwail. La fenêtre de contexte contient 32 768 tokens, et une réponse peut faire jusqu'à 4 096 tokens.
Tarification
Actuellement indisponible : ce modèle a été désactivé. Il n'y a actuellement pas de prix pour ce modèle, il ne peut donc pas être exécuté.
API
Aucun exemple API vérifié
L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.
Spécifications
- ID du modèle
llava-onevision-72b- Développeur
- Replicate
- Catégorie
- Multimodal
- Entrée
- Texte, Image, Vidéo
- Sortie
- Texte
- Fenêtre de contexte
- 32 768 tokens
- Sortie max.
- 4 096 tokens
- Entrée du catalogue mise à jour
- 25 juin 2026
Paramètres d'entrée
Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.
promptObligatoireUser message or question about the image
Type: TexteDéfaut: –Valeurs autorisées: Jusqu'à 16 000 caractèrestop_pType: NombreDéfaut:1Valeurs autorisées: 0 à 1streamType: Oui/NonDéfaut:falseValeurs autorisées: –image_urlOptional image URL to analyze
Type: TexteDéfaut: –Valeurs autorisées: –max_tokensType: Nombre entierDéfaut:1024Valeurs autorisées: 1 à 4 096temperatureType: NombreDéfaut:0.7Valeurs autorisées: 0 à 2system_promptOptional system instruction
Type: TexteDéfaut: –Valeurs autorisées: Jusqu'à 8 000 caractères
Étiquettes
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Questions fréquemment posées
Qu'est-ce que LLaVA-OneVision 72B ?
LLaVA-OneVision 72B est un modèle de Replicate dans la catégorie Multimodal. Il est répertorié sur Railwail mais ne peut pas être exécuté pour le moment.
Combien coûte LLaVA-OneVision 72B sur Railwail ?
LLaVA-OneVision 72B ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.
Quelle est la fenêtre de contexte de LLaVA-OneVision 72B ?
La fenêtre de contexte de LLaVA-OneVision 72B contient 32 768 tokens. Une réponse peut faire jusqu'à 4 096 tokens.
Quelle est la vitesse de LLaVA-OneVision 72B ?
Il n'y a pas encore assez d'exécutions mesurées de LLaVA-OneVision 72B sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.
LLaVA-OneVision 72B est-il meilleur que BLIP ?
Cela dépend de la tâche. LLaVA-OneVision 72B (Replicate) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.
Comparer LLaVA-OneVision 72B et BLIPLLaVA-OneVision 72B peut-il traiter des images ?
Oui. LLaVA-OneVision 72B accepte les images en entrée en plus du texte.
Puis-je utiliser LLaVA-OneVision 72B maintenant ?
Actuellement indisponible : ce modèle a été désactivé. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.
Tous les modèles via une seule API
Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.