Phi-3.5 Vision
phi-3-5-visionMicrosoft Phi-3.5 Vision Instruct. Small (4.2B) multimodal model with strong document, OCR and multi-image reasoning at low cost.
- Status
- Niedostępne
- Kontekst
- 131 072 tokenów
- Maks. wyjście
- 4096 tokenów
- Wejście → Wyjście
- Tekst + Obraz → Tekst
- Deweloper
- Microsoft
- Zaktualizowano
- 25 czerwca 2026
Phi-3.5 Vision jest obecnie niedostępny
Obecnie niedostępne: ten model został dezaktywowany.
Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.
Przejdź do alternatywPorównywalne modele
Wszystkie w tej kategorii- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/uruchomienie
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M wej.
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M wej.
Playground
Spróbuj Phi-3.5 Vision
Brak formularza wejściowego
Obecnie niedostępne: ten model został dezaktywowany.
Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy
O Phi-3.5 Vision
Phi-3.5 Vision to model opracowany przez Microsoft w kategorii Multimodalne. Phi-3.5 Vision nie jest obecnie dostępny w serwisie Railwail. Okno kontekstu zawiera 131 072 tokenów, a jedna odpowiedź może mieć do 4096 tokenów.
Ceny
Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.
API
Brak zweryfikowanego przykładu API
Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.
Specyfikacje
- ID modelu
phi-3-5-vision- Deweloper
- Microsoft
- Kategoria
- Multimodalne
- Wejście
- Tekst, Obraz
- Wyjście
- Tekst
- Okno kontekstu
- 131 072 tokenów
- Maks. wyjście
- 4096 tokenów
- Wpis w katalogu zaktualizowany
- 25 czerwca 2026
Tagi
- replicate
- multimodal
- vision-understanding
- microsoft
- open-weights
- small
Często zadawane pytania
Co to jest Phi-3.5 Vision?
Phi-3.5 Vision to model opracowany przez Microsoft w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.
Ile kosztuje Phi-3.5 Vision w serwisie Railwail?
Phi-3.5 Vision nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.
Jakie jest okno kontekstu Phi-3.5 Vision?
Okno kontekstu Phi-3.5 Vision zawiera 131 072 tokenów. Jedna odpowiedź może mieć do 4096 tokenów.
Jak szybki jest Phi-3.5 Vision?
Dla Phi-3.5 Vision jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.
Czy Phi-3.5 Vision jest lepszy niż BLIP?
To zależy od zadania. Phi-3.5 Vision (Microsoft) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.
Porównaj Phi-3.5 Vision i BLIPCzy Phi-3.5 Vision może przetwarzać obrazy?
Tak. Phi-3.5 Vision akceptuje obrazy jako wejście oprócz tekstu.
Czy mogę używać Phi-3.5 Vision teraz?
Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.
Wszystkie modele przez jedno API
Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.