Gemini 1.5 Flash (vision)

MultimodalRetiradoNo disponible
de Google DeepMindID del modelo: gemini-1-5-flash-vision

Google Gemini 1.5 Flash, the fast low-cost multimodal model. 1M-token context, image/audio/video input, good for high-volume captioning, classification and long-video skim tasks.

Estado
No disponible
Contexto
1.048.576 tokens
Salida máxima
8192 tokens
Entrada → Salida
Texto + Imagen + Audio + Vídeo → Texto
Desarrollador
Google DeepMind
Actualizado
23 de septiembre de 2026

Gemini 1.5 Flash (vision) no está disponible actualmente

Puedes seguir leyendo los detalles en esta página. Elige una de las alternativas disponibles abajo para ejecutar un modelo comparable de inmediato.

Ir a alternativas

El proveedor ha retirado este modelo.

01

Modelos comparables

Todos en esta categoría
02

Playground

Probar Gemini 1.5 Flash (vision)

Chat

No disponible actualmente

Actualmente no disponible.

El área de pruebas está desactivada. Puedes encontrar modelos comparables en la misma categoría: Explorar alternativas

Probar Gemini 1.5 Flash (vision)

Envía un mensaje. La respuesta llega completa una vez que el modelo termina (sin streaming).

Longitud máxima de respuesta (tokens)

Esta ejecución

Sin precio – actualmente no disponible.

¿Eres nuevo aquí?

10 créditos gratis (0,10 US$) cuando te registres con Google

Disponible 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos.

03

Acerca de Gemini 1.5 Flash (vision)

ResumenA fecha de 23 de septiembre de 2026

Gemini 1.5 Flash (vision) es un modelo de Google DeepMind en la categoría Multimodal. Gemini 1.5 Flash (vision) no está disponible en Railwail en este momento. La ventana de contexto contiene 1.048.576 tokens, y una respuesta puede tener hasta 8192 tokens.

Gemini 1.5 Flash is the latency- and cost-optimized member of the 1.5 family while keeping native multimodal input and a 1M-token context. It handles images, audio and video and is a practical default for high-throughput visual workloads: bulk captioning and tagging, content moderation, screenshot reading for agents, and quick passes over long videos before sending hard cases to a Pro model.
04

Precios

Actualmente no disponible. No hay precio para este modelo en este momento, por lo que no se puede ejecutar.

05

API

Llama a Gemini 1.5 Flash (vision) con tu clave API de Railwail. Usa este ID de modelo en la solicitud:

Actualmente no disponible

El modelo no tiene un precio verificado o está desactivado; las llamadas a la API se rechazan.

06

Especificaciones

ID del modelo
gemini-1-5-flash-vision
Desarrollador
Google DeepMind
Categoría
Multimodal
Entrada
Texto, Imagen, Audio, Vídeo
Salida
Texto
Ventana de contexto
1.048.576 tokens
Salida máxima
8192 tokens
Ciclo de vida
Retirado
Entrada del catálogo actualizada
23 de septiembre de 2026

Parámetros de entrada

Entradas y configuración del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • promptObligatorio

    Question or instruction about the media

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: Hasta 32.000 caracteres
  • top_p
    Tipo: Número
    Predeterminado: 0.95
    Valores permitidos: 0 a 1
  • stream
    Tipo: Sí/No
    Predeterminado: false
    Valores permitidos: –
  • image_url

    Image, PDF or video URL to analyze

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: –
  • max_tokens
    Tipo: Número entero
    Predeterminado: 2048
    Valores permitidos: 1 a 8192
  • temperature
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: Hasta 8000 caracteres

Etiquetas

  • google
  • gemini
  • vision
  • multimodal
  • cost-efficient
  • long-context
07

Preguntas frecuentes

¿Qué es Gemini 1.5 Flash (vision)?

Gemini 1.5 Flash (vision) es un modelo de Google DeepMind en la categoría Multimodal. Aparece en el catálogo de Railwail pero no se puede ejecutar en este momento.

¿Cuánto cuesta Gemini 1.5 Flash (vision) en Railwail?

Gemini 1.5 Flash (vision) no se puede ejecutar en Railwail en este momento, por lo que no hay precio actual. Las alternativas disponibles con precios se enumeran más abajo en esta página.

¿Cuál es la ventana de contexto de Gemini 1.5 Flash (vision)?

La ventana de contexto de Gemini 1.5 Flash (vision) contiene 1.048.576 tokens. Una respuesta puede tener hasta 8192 tokens.

¿Qué velocidad tiene Gemini 1.5 Flash (vision)?

Aún no hay suficientes ejecuciones medidas de Gemini 1.5 Flash (vision) en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es Gemini 1.5 Flash (vision) mejor que BLIP?

Depende de la tarea. Gemini 1.5 Flash (vision) (Google DeepMind) y BLIP (Salesforce) son ambos modelos en la categoría Multimodal. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar Gemini 1.5 Flash (vision) y BLIP

¿Puede Gemini 1.5 Flash (vision) procesar imágenes?

Sí. Gemini 1.5 Flash (vision) acepta imágenes como entrada además de texto.

¿Puedo usar Gemini 1.5 Flash (vision) ahora mismo?

Actualmente no disponible. La página se mantiene en línea; las alternativas disponibles de la misma categoría se enumeran más abajo.

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra desde créditos prepagados, 1 crédito = 0,01 US$.