Phi-3.5 Vision

MultimodalIkke tilgjengelig
av MicrosoftModell-ID: phi-3-5-vision

Microsoft Phi-3.5 Vision Instruct. Small (4.2B) multimodal model with strong document, OCR and multi-image reasoning at low cost.

Status
Ikke tilgjengelig
Kontekst
131 072 tokens
Maks. utdata
4 096 tokens
Input → output
Tekst + Bilde → Tekst
Utvikler
Microsoft
Oppdatert
25. juni 2026

Phi-3.5 Vision er for øyeblikket utilgjengelig

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer
01

Sammenlignbare modeller

Alle i denne kategorien
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/kjøring

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M inn

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M inn

02

Playground

Prøv Phi-3.5 Vision

Ingen innmaskering

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

03

Om Phi-3.5 Vision

Kort sagtPer 25. juni 2026

Phi-3.5 Vision er en modell fra Microsoft i kategorien Multimodal. Phi-3.5 Vision er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 131 072 tokens, og ett svar kan være opptil 4 096 tokens langt.

04

Priser

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

05

API

Ring Phi-3.5 Vision med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:

Ingen verifisert API-eksempel

Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.

06

Spesifikasjoner

Modell-ID
phi-3-5-vision
Utvikler
Microsoft
Kategori
Multimodal
Inndata
Tekst, Bilde
Utdata
Tekst
Kontekstvindu
131 072 tokens
Maks. utdata
4 096 tokens
Katalogoppføring oppdatert
25. juni 2026

Merkelapper

  • replicate
  • multimodal
  • vision-understanding
  • microsoft
  • open-weights
  • small
07

Ofte stilte spørsmål

Hva er Phi-3.5 Vision?

Phi-3.5 Vision er en modell fra Microsoft i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster Phi-3.5 Vision på Railwail?

Phi-3.5 Vision kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvor stort er kontekstvinduet til Phi-3.5 Vision?

Kontekstvinduet til Phi-3.5 Vision inneholder 131 072 tokens. Ett svar kan være opptil 4 096 tokens langt.

Hvor rask er Phi-3.5 Vision?

Det finnes ennå ikke nok målte kjøringer av Phi-3.5 Vision på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er Phi-3.5 Vision bedre enn BLIP?

Det avhenger av oppgaven. Phi-3.5 Vision (Microsoft) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign Phi-3.5 Vision og BLIP

Kan Phi-3.5 Vision behandle bilder?

Ja. Phi-3.5 Vision godtar bilder som inndata i tillegg til tekst.

Kan jeg bruke Phi-3.5 Vision akkurat nå?

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.