Gemini 1.5 Pro (vision)

MultimodaleRitiratoNon disponibile
di Google DeepMindID modello: gemini-1-5-pro-vision

Google Gemini 1.5 Pro with native multimodal input. Reads images, long PDFs, audio and video in up to a 2M-token context, useful for whole-document and long-video understanding.

Stato
Non disponibile
Contesto
2.097.152 token
Max. output
8192 token
Input → output
Testo + Immagine + Audio + Video → Testo
Sviluppatore
Google DeepMind
Aggiornato
23 settembre 2026

Gemini 1.5 Pro (vision) non è attualmente disponibile

Puoi comunque leggere i dettagli su questa pagina. Scegli una delle alternative disponibili di seguito per eseguire subito un modello comparabile.

Vai alle alternative

Il provider ha ritirato questo modello.

01

Modelli comparabili

Tutti in questa categoria
02

Playground

Prova Gemini 1.5 Pro (vision)

Chat

Attualmente non disponibile

Attualmente non disponibile.

Il playground è disabilitato. Trovi modelli comparabili nella stessa categoria: Visualizza alternative

Prova Gemini 1.5 Pro (vision)

Invia un messaggio. La risposta arriva completa quando il modello ha finito (senza streaming).

Lunghezza massima della risposta (token)

Questa esecuzione

Nessun prezzo – attualmente non disponibile.

Nuovo qui?

10 crediti gratuiti (0,10 USD) quando ti iscrivi con Google

Utilizzabile 24 ore dopo l'iscrizione, fino a 5 esecuzioni al giorno e al massimo 2 crediti per esecuzione. Altri metodi di accesso iniziano senza crediti.

03

Informazioni su Gemini 1.5 Pro (vision)

RiassuntoA partire da 23 settembre 2026

Gemini 1.5 Pro (vision) è un modello di Google DeepMind nella categoria Multimodale. Gemini 1.5 Pro (vision) non è attualmente disponibile su Railwail. La finestra di contesto contiene 2.097.152 token e una risposta può essere lunga fino a 8192 token.

Gemini 1.5 Pro accepts text, images, audio and video tokens in a single pass with a context window up to 2M tokens. That lets it ingest entire PDFs, hour-long videos or large image sets and answer questions across them. Common uses: long-document visual QA, video summarization and frame-level analysis, and mixed media extraction. Function calling and JSON output are first-class via the Gemini API.
04

Prezzi

Attualmente non disponibile. Al momento non c'è un prezzo per questo modello, quindi non può essere eseguito.

05

API

Chiama Gemini 1.5 Pro (vision) con la tua chiave API Railwail. Usa questo ID modello nella richiesta:

Attualmente non disponibile

Il modello non ha un prezzo verificato o è disattivato; le chiamate API vengono rifiutate.

06

Specifiche

ID modello
gemini-1-5-pro-vision
Sviluppatore
Google DeepMind
Categoria
Multimodale
Input
Testo, Immagine, Audio, Video
Output
Testo
Finestra di contesto
2.097.152 token
Output massimo
8192 token
Ciclo di vita
Ritirato
Voce di catalogo aggiornata
23 settembre 2026

Parametri di input

Input e impostazioni dallo schema di input del modello. L'esempio nella sezione API mostra quali di essi l'API accetta.

  • promptObbligatorio

    Question or instruction about the media

    Tipo: Testo
    Predefinito: –
    Valori consentiti: fino a 32.000 caratteri
  • top_p
    Tipo: Numero
    Predefinito: 0.95
    Valori consentiti: 0 a 1
  • stream
    Tipo: Sì/No
    Predefinito: false
    Valori consentiti: –
  • image_url

    Image, PDF or video URL to analyze

    Tipo: Testo
    Predefinito: –
    Valori consentiti: –
  • max_tokens
    Tipo: Numero intero
    Predefinito: 2048
    Valori consentiti: 1 a 8192
  • temperature
    Tipo: Numero
    Predefinito: 1
    Valori consentiti: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Testo
    Predefinito: –
    Valori consentiti: fino a 8000 caratteri

Etichette

  • google
  • gemini
  • vision
  • multimodal
  • long-context
  • video-understanding
07

Domande frequenti

Cos'è Gemini 1.5 Pro (vision)?

Gemini 1.5 Pro (vision) è un modello di Google DeepMind nella categoria Multimodale. È elencato su Railwail ma non può essere eseguito al momento.

Quanto costa Gemini 1.5 Pro (vision) su Railwail?

Gemini 1.5 Pro (vision) non può essere eseguito su Railwail al momento, quindi non c'è un prezzo attuale. Le alternative disponibili con i prezzi sono elencate più in basso in questa pagina.

Qual è la finestra di contesto di Gemini 1.5 Pro (vision)?

La finestra di contesto di Gemini 1.5 Pro (vision) contiene 2.097.152 token. Una risposta può essere lunga fino a 8192 token.

Quanto è veloce Gemini 1.5 Pro (vision)?

Non ci sono ancora abbastanza esecuzioni misurate di Gemini 1.5 Pro (vision) su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.

Gemini 1.5 Pro (vision) è migliore di BLIP?

Dipende dall'attività. Gemini 1.5 Pro (vision) (Google DeepMind) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.

Confronta Gemini 1.5 Pro (vision) e BLIP

Gemini 1.5 Pro (vision) può elaborare immagini?

Sì. Gemini 1.5 Pro (vision) accetta immagini come input oltre al testo.

Posso usare Gemini 1.5 Pro (vision) adesso?

Attualmente non disponibile. La pagina rimane online; le alternative disponibili della stessa categoria sono elencate più in basso.

Tutti i modelli tramite un'API

Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01 USD.