Qwen2.5-VL 7B Instruct (HF)

MultimodalNon disponible
par Alibaba (Qwen)ID du modèle: qwen2-5-vl-7b-instruct-hf

Alibaba Qwen2.5-VL 7B via Hugging Face Inference. Open-weights image-text-to-text model with improved OCR, chart and table reading, object grounding and long-document understanding.

Statut
Non disponible
Contexte
32.768 tokens
Max. sortie
4.096 tokens
Entrée → Sortie
Texte + Image → Texte
Développeur
Alibaba (Qwen)
Mis à jour
23 septembre 2026

Qwen2.5-VL 7B Instruct (HF) n'est actuellement pas disponible

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives
01

Modèles comparables

Tous dans cette catégorie
02

Playground

Essayer Qwen2.5-VL 7B Instruct (HF)

Entrée & résultat

Actuellement indisponible

Actuellement indisponible.

Le playground est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

Essayer Qwen2.5-VL 7B Instruct (HF)

0 / 16.000

Résultat
La réponse apparaît ici.

Cette exécution

Pas de prix – actuellement indisponible.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

03

À propos de Qwen2.5-VL 7B Instruct (HF)

RésuméAu 23 septembre 2026

Qwen2.5-VL 7B Instruct (HF) est un modèle de Alibaba (Qwen) dans la catégorie Multimodal. Qwen2.5-VL 7B Instruct (HF) n'est actuellement pas disponible sur Railwail. La fenêtre de contexte contient 32.768 tokens, et une réponse peut faire jusqu'à 4.096 tokens.

Qwen2.5-VL 7B Instruct is the 2.5 generation of Alibaba's vision-language family, accessed through the Hugging Face serverless image-text-to-text pipeline. Compared with Qwen2-VL it improves OCR across languages, chart and table parsing, visual grounding with bounding boxes, and understanding of long documents and longer videos. Suitable for document extraction, UI understanding and image-grounded chat where open weights are required.
04

Tarification

Actuellement indisponible. Il n'y a actuellement pas de prix pour ce modèle, il ne peut donc pas être exécuté.

05

API

Appelez Qwen2.5-VL 7B Instruct (HF) avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modèle
qwen2-5-vl-7b-instruct-hf
Développeur
Alibaba (Qwen)
Catégorie
Multimodal
Entrée
Texte, Image
Sortie
Texte
Fenêtre de contexte
32.768 tokens
Sortie max.
4.096 tokens
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • promptObligatoire

    Question about the image

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 16.000 caractères
  • image_url

    Image URL to analyze

    Type: Texte
    Défaut: –
    Valeurs autorisées: –

Étiquettes

  • huggingface
  • qwen
  • alibaba
  • vision-understanding
  • open-weights
  • ocr
  • grounding
07

Questions fréquemment posées

Qu'est-ce que Qwen2.5-VL 7B Instruct (HF) ?

Qwen2.5-VL 7B Instruct (HF) est un modèle de Alibaba (Qwen) dans la catégorie Multimodal. Il est listé sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte Qwen2.5-VL 7B Instruct (HF) sur Railwail ?

Qwen2.5-VL 7B Instruct (HF) ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quelle est la fenêtre de contexte de Qwen2.5-VL 7B Instruct (HF) ?

La fenêtre de contexte de Qwen2.5-VL 7B Instruct (HF) contient 32.768 tokens. Une réponse peut faire jusqu'à 4.096 tokens.

Quelle est la vitesse de Qwen2.5-VL 7B Instruct (HF) ?

Il n'y a pas encore assez d'exécutions mesurées de Qwen2.5-VL 7B Instruct (HF) sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

Qwen2.5-VL 7B Instruct (HF) est-il meilleur que BLIP ?

Cela dépend de la tâche. Qwen2.5-VL 7B Instruct (HF) (Alibaba (Qwen)) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer Qwen2.5-VL 7B Instruct (HF) et BLIP

Qwen2.5-VL 7B Instruct (HF) peut-il traiter des images ?

Oui. Qwen2.5-VL 7B Instruct (HF) accepte les images en entrée en plus du texte.

Puis-je utiliser Qwen2.5-VL 7B Instruct (HF) maintenant ?

Actuellement indisponible. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.