Gemini 1.5 Flash (vision)
gemini-1-5-flash-visionGoogle Gemini 1.5 Flash, the fast low-cost multimodal model. 1M-token context, image/audio/video input, good for high-volume captioning, classification and long-video skim tasks.
- Estado
- No disponible
- Contexto
- 1,048,576 tokens
- Salida máxima
- 8,192 tokens
- Entrada → Salida
- Texto + Imagen + Audio + Video → Texto
- Desarrollador
- Google DeepMind
- Actualizado
- 23 de septiembre de 2026
Gemini 1.5 Flash (vision) no está disponible en este momento
Puedes seguir leyendo los detalles en esta página. Elige una de las alternativas disponibles abajo para ejecutar un modelo comparable de inmediato.
Ir a alternativasEl proveedor retiró este modelo.
Modelos comparables
Todos en esta categoría- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ USD 0.00030/ejecución
Comparar Gemini 1.5 Flash (vision) vs. BLIP - Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
USD 6.00/1M entrada
Comparar Gemini 1.5 Flash (vision) vs. Claude Opus 4.7 - Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
USD 3.60/1M entrada
Comparar Gemini 1.5 Flash (vision) vs. Claude Sonnet 4.6
Playground
Probar Gemini 1.5 Flash (vision)
Chat
Actualmente no disponible.
El área de pruebas está desactivada. Encuentra modelos comparables en la misma categoría: Explorar alternativas
Esta ejecución
Sin precio – actualmente no disponible.
¿Nuevo aquí?
10 créditos gratis (USD 0.10) cuando te registras con Google
Utilizable 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos.
Acerca de Gemini 1.5 Flash (vision)
Gemini 1.5 Flash (vision) es un modelo de Google DeepMind en la categoría Multimodal. Gemini 1.5 Flash (vision) no está disponible en Railwail en este momento. La ventana de contexto contiene 1,048,576 tokens, y una respuesta puede tener hasta 8,192 tokens.
Precios
Actualmente no disponible. No hay precio para este modelo en este momento, por lo que no se puede ejecutar.
API
Actualmente no disponible
El modelo no tiene un precio verificado o está desactivado; las llamadas a la API se rechazan.
Especificaciones
- ID del modelo
gemini-1-5-flash-vision- Desarrollador
- Google DeepMind
- Categoría
- Multimodal
- Entrada
- Texto, Imagen, Audio, Video
- Salida
- Texto
- Ventana de contexto
- 1,048,576 tokens
- Salida máxima
- 8,192 tokens
- Ciclo de vida
- Retirado
- Entrada del catálogo actualizada
- 23 de septiembre de 2026
Parámetros de entrada
Entradas y configuraciones del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.
promptrequeridoQuestion or instruction about the media
Tipo: TextoPredeterminado: –Valores permitidos: hasta 32,000 caracterestop_pTipo: NúmeroPredeterminado:0.95Valores permitidos: 0 a 1streamTipo: Sí/NoPredeterminado:falseValores permitidos: –image_urlImage, PDF or video URL to analyze
Tipo: TextoPredeterminado: –Valores permitidos: –max_tokensTipo: Número enteroPredeterminado:2048Valores permitidos: 1 a 8,192temperatureTipo: NúmeroPredeterminado:1Valores permitidos: 0 a 2system_promptOptional system instruction
Tipo: TextoPredeterminado: –Valores permitidos: hasta 8,000 caracteres
Etiquetas
- gemini
- vision
- multimodal
- cost-efficient
- long-context
Preguntas frecuentes
¿Qué es Gemini 1.5 Flash (vision)?
Gemini 1.5 Flash (vision) es un modelo de Google DeepMind en la categoría Multimodal. Está listado en Railwail pero no se puede ejecutar en este momento.
¿Cuánto cuesta Gemini 1.5 Flash (vision) en Railwail?
Gemini 1.5 Flash (vision) no se puede ejecutar en Railwail en este momento, por lo que no hay precio actual. Las alternativas disponibles con precios se enumeran más abajo en esta página.
¿Cuál es la ventana de contexto de Gemini 1.5 Flash (vision)?
La ventana de contexto de Gemini 1.5 Flash (vision) contiene 1,048,576 tokens. Una respuesta puede tener hasta 8,192 tokens.
¿Qué tan rápido es Gemini 1.5 Flash (vision)?
Aún no hay suficientes ejecuciones medidas de Gemini 1.5 Flash (vision) en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.
¿Es Gemini 1.5 Flash (vision) mejor que BLIP?
Eso depende de la tarea. Gemini 1.5 Flash (vision) (Google DeepMind) y BLIP (Salesforce) son ambos modelos en la categoría Multimodal. La página de comparación muestra sus precios y especificaciones lado a lado.
Comparar Gemini 1.5 Flash (vision) y BLIP¿Puede Gemini 1.5 Flash (vision) procesar imágenes?
Sí. Gemini 1.5 Flash (vision) acepta imágenes como entrada además de texto.
¿Puedo usar Gemini 1.5 Flash (vision) ahora mismo?
Actualmente no disponible. La página permanece en línea; las alternativas disponibles de la misma categoría se enumeran más abajo.
Todos los modelos a través de una API
Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.