Gemini 1.5 Pro (vision)
gemini-1-5-pro-visionGoogle Gemini 1.5 Pro with native multimodal input. Reads images, long PDFs, audio and video in up to a 2M-token context, useful for whole-document and long-video understanding.
- Stato
- Non disponibile
- Contesto
- 2.097.152 token
- Max. output
- 8192 token
- Input → output
- Testo + Immagine + Audio + Video → Testo
- Sviluppatore
- Google DeepMind
- Aggiornato
- 23 settembre 2026
Gemini 1.5 Pro (vision) non è attualmente disponibile
Puoi comunque leggere i dettagli su questa pagina. Scegli una delle alternative disponibili di seguito per eseguire subito un modello comparabile.
Vai alle alternativeIl provider ha ritirato questo modello.
Modelli comparabili
Tutti in questa categoria- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/esecuzione
Confronta Gemini 1.5 Pro (vision) e BLIP - Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00Â USD/1M in
Confronta Gemini 1.5 Pro (vision) e Claude Opus 4.7 - Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60Â USD/1M in
Confronta Gemini 1.5 Pro (vision) e Claude Sonnet 4.6
Playground
Prova Gemini 1.5 Pro (vision)
Chat
Attualmente non disponibile.
Il playground è disabilitato. Trovi modelli comparabili nella stessa categoria: Visualizza alternative
Questa esecuzione
Nessun prezzo – attualmente non disponibile.
Nuovo qui?
10 crediti gratuiti (0,10Â USD) quando ti iscrivi con Google
Utilizzabile 24 ore dopo l'iscrizione, fino a 5 esecuzioni al giorno e al massimo 2 crediti per esecuzione. Altri metodi di accesso iniziano senza crediti.
Informazioni su Gemini 1.5 Pro (vision)
Gemini 1.5 Pro (vision) è un modello di Google DeepMind nella categoria Multimodale. Gemini 1.5 Pro (vision) non è attualmente disponibile su Railwail. La finestra di contesto contiene 2.097.152 token e una risposta può essere lunga fino a 8192 token.
Prezzi
Attualmente non disponibile. Al momento non c'è un prezzo per questo modello, quindi non può essere eseguito.
API
Attualmente non disponibile
Il modello non ha un prezzo verificato o è disattivato; le chiamate API vengono rifiutate.
Specifiche
- ID modello
gemini-1-5-pro-vision- Sviluppatore
- Google DeepMind
- Categoria
- Multimodale
- Input
- Testo, Immagine, Audio, Video
- Output
- Testo
- Finestra di contesto
- 2.097.152 token
- Output massimo
- 8192 token
- Ciclo di vita
- Ritirato
- Voce di catalogo aggiornata
- 23 settembre 2026
Parametri di input
Input e impostazioni dallo schema di input del modello. L'esempio nella sezione API mostra quali di essi l'API accetta.
promptObbligatorioQuestion or instruction about the media
Tipo: TestoPredefinito: –Valori consentiti: fino a 32.000 caratteritop_pTipo: NumeroPredefinito:0.95Valori consentiti: 0 a 1streamTipo: Sì/NoPredefinito:falseValori consentiti: –image_urlImage, PDF or video URL to analyze
Tipo: TestoPredefinito: –Valori consentiti: –max_tokensTipo: Numero interoPredefinito:2048Valori consentiti: 1 a 8192temperatureTipo: NumeroPredefinito:1Valori consentiti: 0 a 2system_promptOptional system instruction
Tipo: TestoPredefinito: –Valori consentiti: fino a 8000 caratteri
Etichette
- gemini
- vision
- multimodal
- long-context
- video-understanding
Domande frequenti
Cos'è Gemini 1.5 Pro (vision)?
Gemini 1.5 Pro (vision) è un modello di Google DeepMind nella categoria Multimodale. È elencato su Railwail ma non può essere eseguito al momento.
Quanto costa Gemini 1.5 Pro (vision) su Railwail?
Gemini 1.5 Pro (vision) non può essere eseguito su Railwail al momento, quindi non c'è un prezzo attuale. Le alternative disponibili con i prezzi sono elencate più in basso in questa pagina.
Qual è la finestra di contesto di Gemini 1.5 Pro (vision)?
La finestra di contesto di Gemini 1.5 Pro (vision) contiene 2.097.152 token. Una risposta può essere lunga fino a 8192 token.
Quanto è veloce Gemini 1.5 Pro (vision)?
Non ci sono ancora abbastanza esecuzioni misurate di Gemini 1.5 Pro (vision) su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.
Gemini 1.5 Pro (vision) è migliore di BLIP?
Dipende dall'attività . Gemini 1.5 Pro (vision) (Google DeepMind) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.
Confronta Gemini 1.5 Pro (vision) e BLIPGemini 1.5 Pro (vision) può elaborare immagini?
Sì. Gemini 1.5 Pro (vision) accetta immagini come input oltre al testo.
Posso usare Gemini 1.5 Pro (vision) adesso?
Attualmente non disponibile. La pagina rimane online; le alternative disponibili della stessa categoria sono elencate più in basso.
Tutti i modelli tramite un'API
Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01Â USD.