Gemini 1.5 Pro (vision)

MultimodalRetiréNon disponible
par Google DeepMindID du modèle: gemini-1-5-pro-vision

Google Gemini 1.5 Pro with native multimodal input. Reads images, long PDFs, audio and video in up to a 2M-token context, useful for whole-document and long-video understanding.

Statut
Non disponible
Contexte
2.097.152 tokens
Max. sortie
8.192 tokens
Entrée → Sortie
Texte + Image + Audio + Vidéo → Texte
Développeur
Google DeepMind
Mis à jour
23 septembre 2026

Gemini 1.5 Pro (vision) n'est actuellement pas disponible

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives

Le fournisseur a retiré ce modèle.

01

Modèles comparables

Tous dans cette catégorie
02

Playground

Essayer Gemini 1.5 Pro (vision)

Chat

Actuellement indisponible

Actuellement indisponible.

Le playground est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

Essayer Gemini 1.5 Pro (vision)

Envoyez un message. La réponse arrive complète une fois que le modèle a terminé (sans streaming).

Longueur max. de la réponse (tokens)

Cette exécution

Pas de prix – actuellement indisponible.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

03

À propos de Gemini 1.5 Pro (vision)

RésuméAu 23 septembre 2026

Gemini 1.5 Pro (vision) est un modèle de Google DeepMind dans la catégorie Multimodal. Gemini 1.5 Pro (vision) n'est actuellement pas disponible sur Railwail. La fenêtre de contexte contient 2.097.152 tokens, et une réponse peut faire jusqu'à 8.192 tokens.

Gemini 1.5 Pro accepts text, images, audio and video tokens in a single pass with a context window up to 2M tokens. That lets it ingest entire PDFs, hour-long videos or large image sets and answer questions across them. Common uses: long-document visual QA, video summarization and frame-level analysis, and mixed media extraction. Function calling and JSON output are first-class via the Gemini API.
04

Tarification

Actuellement indisponible. Il n'y a actuellement pas de prix pour ce modèle, il ne peut donc pas être exécuté.

05

API

Appelez Gemini 1.5 Pro (vision) avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Actuellement indisponible

Le modèle n'a pas de prix vérifié ou est désactivé ; les appels API sont refusés.

06

Spécifications

ID du modèle
gemini-1-5-pro-vision
Développeur
Google DeepMind
Catégorie
Multimodal
Entrée
Texte, Image, Audio, Vidéo
Sortie
Texte
Fenêtre de contexte
2.097.152 tokens
Sortie max.
8.192 tokens
Cycle de vie
Retiré
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • promptObligatoire

    Question or instruction about the media

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 32.000 caractères
  • top_p
    Type: Nombre
    Défaut: 0.95
    Valeurs autorisées: 0 à 1
  • stream
    Type: Oui/Non
    Défaut: false
    Valeurs autorisées: –
  • image_url

    Image, PDF or video URL to analyze

    Type: Texte
    Défaut: –
    Valeurs autorisées: –
  • max_tokens
    Type: Nombre entier
    Défaut: 2048
    Valeurs autorisées: 1 à 8.192
  • temperature
    Type: Nombre
    Défaut: 1
    Valeurs autorisées: 0 à 2
  • system_prompt

    Optional system instruction

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 8.000 caractères

Étiquettes

  • google
  • gemini
  • vision
  • multimodal
  • long-context
  • video-understanding
07

Questions fréquemment posées

Qu'est-ce que Gemini 1.5 Pro (vision) ?

Gemini 1.5 Pro (vision) est un modèle de Google DeepMind dans la catégorie Multimodal. Il est listé sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte Gemini 1.5 Pro (vision) sur Railwail ?

Gemini 1.5 Pro (vision) ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quelle est la fenêtre de contexte de Gemini 1.5 Pro (vision) ?

La fenêtre de contexte de Gemini 1.5 Pro (vision) contient 2.097.152 tokens. Une réponse peut faire jusqu'à 8.192 tokens.

Quelle est la vitesse de Gemini 1.5 Pro (vision) ?

Il n'y a pas encore assez d'exécutions mesurées de Gemini 1.5 Pro (vision) sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

Gemini 1.5 Pro (vision) est-il meilleur que BLIP ?

Cela dépend de la tâche. Gemini 1.5 Pro (vision) (Google DeepMind) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer Gemini 1.5 Pro (vision) et BLIP

Gemini 1.5 Pro (vision) peut-il traiter des images ?

Oui. Gemini 1.5 Pro (vision) accepte les images en entrée en plus du texte.

Puis-je utiliser Gemini 1.5 Pro (vision) maintenant ?

Actuellement indisponible. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.