Phi-3.5 Vision
phi-3-5-visionMicrosoft Phi-3.5 Vision Instruct. Small (4.2B) multimodal model with strong document, OCR and multi-image reasoning at low cost.
- Status
- Inte tillgÀnglig
- Kontext
- 131Â 072 tokens
- Max. utdata
- 4Â 096 tokens
- Inmatning â utmatning
- Text + Bild â Text
- Utvecklare
- Microsoft
- Uppdaterad
- 25 juni 2026
Phi-3.5 Vision Àr för nÀrvarande otillgÀnglig
Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.
Du kan fortfarande lÀsa detaljerna pÄ denna sida. VÀlj ett av de tillgÀngliga alternativen nedan för att köra en jÀmförbar modell direkt.
GÄ till alternativJÀmförbara modeller
Alla i denna kategori- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
â 0,00030 US$/körning
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00Â US$/1M in
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60Â US$/1M in
Playground
Prova Phi-3.5 Vision
Ingen inmatningsformulÀr
Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.
Lekplatsen Àr inaktiverad. Du hittar jÀmförbara modeller i samma kategori: Visa alternativ
Om Phi-3.5 Vision
Phi-3.5 Vision Àr en modell av Microsoft i kategorin Multimodal. Phi-3.5 Vision Àr för nÀrvarande inte tillgÀnglig pÄ Railwail. Kontextfönstret innehÄller 131 072 tokens, och ett svar kan vara upp till 4 096 tokens lÄngt.
Priser
Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Det finns ingen pris för denna modell för nÀrvarande, sÄ den kan inte köras.
API
Inget verifierat API-exempel
Det offentliga API:et skickar ett annat inmatningsformat Àn vad denna modell behöver. AnvÀnd lekplatsen ovan.
Specifikationer
- Modell-ID
phi-3-5-vision- Utvecklare
- Microsoft
- Kategori
- Multimodal
- Inmatning
- Text, Bild
- Utmatning
- Text
- Kontextfönster
- 131Â 072 tokens
- Max. utmatning
- 4Â 096 tokens
- KataloginlÀgg uppdaterat
- 25 juni 2026
Taggar
- replicate
- multimodal
- vision-understanding
- microsoft
- open-weights
- small
Vanliga frÄgor
Vad Àr Phi-3.5 Vision?
Phi-3.5 Vision Àr en modell av Microsoft i kategorin Multimodal. Den finns i Railwail-katalogen men kan inte köras för nÀrvarande.
Vad kostar Phi-3.5 Vision pÄ Railwail?
Phi-3.5 Vision kan inte köras pÄ Railwail för nÀrvarande, sÄ det finns inget aktuellt pris. TillgÀngliga alternativ med priser visas lÀngre ned pÄ denna sida.
Hur stort Àr kontextfönstret för Phi-3.5 Vision?
Kontextfönstret för Phi-3.5 Vision innehÄller 131 072 tokens. Ett svar kan vara upp till 4 096 tokens lÄngt.
Hur snabb Àr Phi-3.5 Vision?
Det finns Ànnu inte tillrÀckligt mÄnga uppmÀtta körningar av Phi-3.5 Vision pÄ Railwail för att ange en körningstid. Det beror pÄ inmatningen, instÀllningarna och belastningen hos leverantören.
Ăr Phi-3.5 Vision bĂ€ttre Ă€n BLIP?
Det beror pÄ uppgiften. Phi-3.5 Vision (Microsoft) och BLIP (Salesforce) Àr bÄda modeller i kategorin Multimodal. JÀmförelsesidan visar deras priser och specifikationer sida vid sida.
JÀmför Phi-3.5 Vision och BLIPKan Phi-3.5 Vision bearbeta bilder?
Ja. Phi-3.5 Vision accepterar bilder som inmatning utöver text.
Kan jag anvÀnda Phi-3.5 Vision just nu?
Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Sidan förblir online; tillgÀngliga alternativ frÄn samma kategori visas lÀngre ned.
Alla modeller via ett API
En API-nyckel för alla modeller pÄ Railwail. AnvÀndningen debiteras frÄn förbetald kredit, 1 kredit = 0,01 US$.