Gemini 1.5 Pro (vision)

MultimodalEingestelltNicht verfügbar
von Google DeepMindModell-ID: gemini-1-5-pro-vision

Google Gemini 1.5 Pro with native multimodal input. Reads images, long PDFs, audio and video in up to a 2M-token context, useful for whole-document and long-video understanding.

Status
Nicht verfügbar
Kontext
2.097.152 Token
Max. Ausgabe
8.192 Token
Eingabe → Ausgabe
Text + Bild + Audio + Video → Text
Entwickler
Google DeepMind
Aktualisiert
23. September 2026

Gemini 1.5 Pro (vision) ist derzeit nicht verfügbar

Die Angaben auf dieser Seite kannst du weiter nachlesen. Mit einer der verfügbaren Alternativen unten kannst du sofort ein vergleichbares Modell nutzen.

Zu den Alternativen

Der Anbieter hat dieses Modell eingestellt.

01

Vergleichbare Modelle

Alle dieser Kategorie
02

Playground

Gemini 1.5 Pro (vision) ausprobieren

Chat

Derzeit nicht verfügbar

Derzeit nicht verfügbar.

Der Playground ist deaktiviert. Vergleichbare Modelle findest du in derselben Kategorie: Alternativen ansehen

Gemini 1.5 Pro (vision) ausprobieren

Schick eine Nachricht. Die Antwort kommt vollständig, sobald das Modell fertig ist (ohne Streaming).

Max. Antwortlänge (Token)

Dieser Lauf

Kein Preis – derzeit nicht verfügbar.

Neu hier?

10 Gratis-Credits (0,10 $) bei Anmeldung mit Google

Nutzbar 24 Stunden nach der Anmeldung, bis zu 5 Läufe pro Tag und höchstens 2 Credits je Lauf. Andere Anmeldearten starten ohne Guthaben.

03

Über Gemini 1.5 Pro (vision)

Kurz gesagtStand: 23. September 2026

Gemini 1.5 Pro (vision) ist ein Modell von Google DeepMind aus der Kategorie Multimodal. Über Railwail ist Gemini 1.5 Pro (vision) derzeit nicht verfügbar. Das Kontextfenster umfasst 2.097.152 Token, eine Antwort bis zu 8.192 Token.

Gemini 1.5 Pro accepts text, images, audio and video tokens in a single pass with a context window up to 2M tokens. That lets it ingest entire PDFs, hour-long videos or large image sets and answer questions across them. Common uses: long-document visual QA, video summarization and frame-level analysis, and mixed media extraction. Function calling and JSON output are first-class via the Gemini API.
04

Preise

Derzeit nicht verfügbar. Für dieses Modell gibt es derzeit keinen Preis, deshalb lässt es sich nicht ausführen.

05

API

Rufe Gemini 1.5 Pro (vision) mit deinem Railwail-API-Schlüssel auf. Diese Modell-ID gehört in die Anfrage:

Derzeit nicht verfügbar

Das Modell hat keinen geprüften Preis oder ist deaktiviert; API-Aufrufe werden abgelehnt.

06

Spezifikationen

Modell-ID
gemini-1-5-pro-vision
Entwickler
Google DeepMind
Kategorie
Multimodal
Eingabe
Text, Bild, Audio, Video
Ausgabe
Text
Kontextfenster
2.097.152 Token
Max. Ausgabe
8.192 Token
Lebenszyklus
Eingestellt
Katalogeintrag aktualisiert
23. September 2026

Eingabeparameter

Eingaben und Einstellungen laut Eingabeschema des Modells. Welche davon die API annimmt, zeigt das Beispiel im Abschnitt API.

  • promptPflicht

    Question or instruction about the media

    Typ: Text
    Standard: –
    Erlaubte Werte: bis 32.000 Zeichen
  • top_p
    Typ: Zahl
    Standard: 0.95
    Erlaubte Werte: 0 bis 1
  • stream
    Typ: Ja/Nein
    Standard: false
    Erlaubte Werte: –
  • image_url

    Image, PDF or video URL to analyze

    Typ: Text
    Standard: –
    Erlaubte Werte: –
  • max_tokens
    Typ: Ganzzahl
    Standard: 2048
    Erlaubte Werte: 1 bis 8.192
  • temperature
    Typ: Zahl
    Standard: 1
    Erlaubte Werte: 0 bis 2
  • system_prompt

    Optional system instruction

    Typ: Text
    Standard: –
    Erlaubte Werte: bis 8.000 Zeichen

Schlagwörter

  • google
  • gemini
  • vision
  • multimodal
  • long-context
  • video-understanding
07

Häufige Fragen

Was ist Gemini 1.5 Pro (vision)?

Gemini 1.5 Pro (vision) ist ein Modell von Google DeepMind aus der Kategorie Multimodal. Es steht im Railwail-Katalog, lässt sich derzeit aber nicht ausführen.

Was kostet Gemini 1.5 Pro (vision) bei Railwail?

Gemini 1.5 Pro (vision) lässt sich über Railwail derzeit nicht ausführen, deshalb gibt es keinen aktuellen Preis. Verfügbare Alternativen mit Preisen stehen weiter unten auf dieser Seite.

Wie groß ist das Kontextfenster von Gemini 1.5 Pro (vision)?

Das Kontextfenster von Gemini 1.5 Pro (vision) umfasst 2.097.152 Token. Eine Antwort kann bis zu 8.192 Token lang sein.

Wie schnell ist Gemini 1.5 Pro (vision)?

Für Gemini 1.5 Pro (vision) gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.

Ist Gemini 1.5 Pro (vision) besser als BLIP?

Das hängt von der Aufgabe ab. Gemini 1.5 Pro (vision) (Google DeepMind) und BLIP (Salesforce) sind beide Modelle aus der Kategorie Multimodal. Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.

Gemini 1.5 Pro (vision) und BLIP vergleichen

Kann Gemini 1.5 Pro (vision) Bilder verarbeiten?

Ja. Gemini 1.5 Pro (vision) nimmt neben Text auch Bilder als Eingabe an.

Kann ich Gemini 1.5 Pro (vision) gerade nutzen?

Derzeit nicht verfügbar. Die Seite bleibt online; verfügbare Alternativen aus derselben Kategorie stehen weiter unten.

Alle Modelle über eine API

Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = 0,01 $.