Gemini 1.5 Flash (vision)

MultimodalUtgåttIkke tilgjengelig
av Google DeepMindModell-ID: gemini-1-5-flash-vision

Google Gemini 1.5 Flash, the fast low-cost multimodal model. 1M-token context, image/audio/video input, good for high-volume captioning, classification and long-video skim tasks.

Status
Ikke tilgjengelig
Kontekst
1 048 576 tokens
Maks. utdata
8 192 tokens
Input → output
Tekst + Bilde + Lyd + Video → Tekst
Utvikler
Google DeepMind
Oppdatert
23. september 2026

Gemini 1.5 Flash (vision) er for øyeblikket utilgjengelig

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer

Leverandøren har faset ut denne modellen.

01

Sammenlignbare modeller

Alle i denne kategorien
02

Playground

Prøv Gemini 1.5 Flash (vision)

Chat

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

Prøv Gemini 1.5 Flash (vision)

Send en melding. Svaret kommer fullstendig når modellen er ferdig (ingen streaming).

Maks. svarslengde (tokens)

Denne kjøringen

Ingen pris – ikke tilgjengelig for øyeblikket.

Ny her?

10 gratis credits (0,10 USD) når du registrerer deg med Google

Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits.

03

Om Gemini 1.5 Flash (vision)

Kort sagtPer 23. september 2026

Gemini 1.5 Flash (vision) er en modell fra Google DeepMind i kategorien Multimodal. Gemini 1.5 Flash (vision) er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 1 048 576 tokens, og ett svar kan være opptil 8 192 tokens langt.

Gemini 1.5 Flash is the latency- and cost-optimized member of the 1.5 family while keeping native multimodal input and a 1M-token context. It handles images, audio and video and is a practical default for high-throughput visual workloads: bulk captioning and tagging, content moderation, screenshot reading for agents, and quick passes over long videos before sending hard cases to a Pro model.
04

Priser

Ikke tilgjengelig for øyeblikket. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

05

API

Ring Gemini 1.5 Flash (vision) med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:

Ikke tilgjengelig for øyeblikket

Modellen har ingen verifisert pris eller er deaktivert; API-kall blir avvist.

06

Spesifikasjoner

Modell-ID
gemini-1-5-flash-vision
Kategori
Multimodal
Inndata
Tekst, Bilde, Lyd, Video
Utdata
Tekst
Kontekstvindu
1 048 576 tokens
Maks. utdata
8 192 tokens
Livssyklus
Utgått
Katalogoppføring oppdatert
23. september 2026

Inndataparametere

Inndataer og innstillinger fra modellens inndataskjema. Eksemplet i API-delen viser hvilke av dem APIen godtar.

  • promptobligatorisk

    Question or instruction about the media

    Type: Tekst
    Standard: –
    Tillatte verdier: opptil 32 000 tegn
  • top_p
    Type: Tall
    Standard: 0.95
    Tillatte verdier: 0 til 1
  • stream
    Type: Ja/Nei
    Standard: false
    Tillatte verdier: –
  • image_url

    Image, PDF or video URL to analyze

    Type: Tekst
    Standard: –
    Tillatte verdier: –
  • max_tokens
    Type: Heltall
    Standard: 2048
    Tillatte verdier: 1 til 8 192
  • temperature
    Type: Tall
    Standard: 1
    Tillatte verdier: 0 til 2
  • system_prompt

    Optional system instruction

    Type: Tekst
    Standard: –
    Tillatte verdier: opptil 8 000 tegn

Merkelapper

  • google
  • gemini
  • vision
  • multimodal
  • cost-efficient
  • long-context
07

Ofte stilte spørsmål

Hva er Gemini 1.5 Flash (vision)?

Gemini 1.5 Flash (vision) er en modell fra Google DeepMind i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster Gemini 1.5 Flash (vision) på Railwail?

Gemini 1.5 Flash (vision) kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvor stort er kontekstvinduet til Gemini 1.5 Flash (vision)?

Kontekstvinduet til Gemini 1.5 Flash (vision) inneholder 1 048 576 tokens. Ett svar kan være opptil 8 192 tokens langt.

Hvor rask er Gemini 1.5 Flash (vision)?

Det finnes ennå ikke nok målte kjøringer av Gemini 1.5 Flash (vision) på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er Gemini 1.5 Flash (vision) bedre enn BLIP?

Det avhenger av oppgaven. Gemini 1.5 Flash (vision) (Google DeepMind) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign Gemini 1.5 Flash (vision) og BLIP

Kan Gemini 1.5 Flash (vision) behandle bilder?

Ja. Gemini 1.5 Flash (vision) godtar bilder som inndata i tillegg til tekst.

Kan jeg bruke Gemini 1.5 Flash (vision) akkurat nå?

Ikke tilgjengelig for øyeblikket. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.