Phi-3.5 Vision
phi-3-5-visionMicrosoft Phi-3.5 Vision Instruct. Small (4.2B) multimodal model with strong document, OCR and multi-image reasoning at low cost.
- Stato
- Non disponibile
- Contesto
- 131.072 token
- Max. output
- 4096 token
- Input → output
- Testo + Immagine → Testo
- Sviluppatore
- Microsoft
- Aggiornato
- 25 giugno 2026
Phi-3.5 Vision non è attualmente disponibile
Attualmente non disponibile: questo modello è stato disattivato.
Puoi comunque leggere i dettagli su questa pagina. Scegli una delle alternative disponibili di seguito per eseguire subito un modello comparabile.
Vai alle alternativeModelli comparabili
Tutti in questa categoria- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/esecuzione
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00Â USD/1M in
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60Â USD/1M in
Playground
Prova Phi-3.5 Vision
Nessuna maschera di input
Attualmente non disponibile: questo modello è stato disattivato.
Il playground è disabilitato. Trovi modelli comparabili nella stessa categoria: Visualizza alternative
Informazioni su Phi-3.5 Vision
Phi-3.5 Vision è un modello di Microsoft nella categoria Multimodale. Phi-3.5 Vision non è attualmente disponibile su Railwail. La finestra di contesto contiene 131.072 token e una risposta può essere lunga fino a 4096 token.
Prezzi
Attualmente non disponibile: questo modello è stato disattivato. Al momento non c'è un prezzo per questo modello, quindi non può essere eseguito.
API
Nessun esempio API verificato
L'API pubblica passa un formato di input diverso da quello richiesto da questo modello. Usa il playground sopra.
Specifiche
- ID modello
phi-3-5-vision- Sviluppatore
- Microsoft
- Categoria
- Multimodale
- Input
- Testo, Immagine
- Output
- Testo
- Finestra di contesto
- 131.072 token
- Output massimo
- 4096 token
- Voce di catalogo aggiornata
- 25 giugno 2026
Etichette
- replicate
- multimodal
- vision-understanding
- microsoft
- open-weights
- small
Domande frequenti
Cos'è Phi-3.5 Vision?
Phi-3.5 Vision è un modello di Microsoft nella categoria Multimodale. È elencato su Railwail ma non può essere eseguito al momento.
Quanto costa Phi-3.5 Vision su Railwail?
Phi-3.5 Vision non può essere eseguito su Railwail al momento, quindi non c'è un prezzo attuale. Le alternative disponibili con i prezzi sono elencate più in basso in questa pagina.
Qual è la finestra di contesto di Phi-3.5 Vision?
La finestra di contesto di Phi-3.5 Vision contiene 131.072 token. Una risposta può essere lunga fino a 4096 token.
Quanto è veloce Phi-3.5 Vision?
Non ci sono ancora abbastanza esecuzioni misurate di Phi-3.5 Vision su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.
Phi-3.5 Vision è migliore di BLIP?
Dipende dall'attività . Phi-3.5 Vision (Microsoft) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.
Confronta Phi-3.5 Vision e BLIPPhi-3.5 Vision può elaborare immagini?
Sì. Phi-3.5 Vision accetta immagini come input oltre al testo.
Posso usare Phi-3.5 Vision adesso?
Attualmente non disponibile: questo modello è stato disattivato. La pagina rimane online; le alternative disponibili della stessa categoria sono elencate più in basso.
Tutti i modelli tramite un'API
Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01Â USD.