Phi-3.5 Vision

MultimodalneNiedostępne
od MicrosoftID modelu: phi-3-5-vision

Microsoft Phi-3.5 Vision Instruct. Small (4.2B) multimodal model with strong document, OCR and multi-image reasoning at low cost.

Status
Niedostępne
Kontekst
131 072 tokenów
Maks. wyjście
4096 tokenów
Wejście → Wyjście
Tekst + Obraz → Tekst
Deweloper
Microsoft
Zaktualizowano
25 czerwca 2026

Phi-3.5 Vision jest obecnie niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.

Przejdź do alternatyw
01

Porównywalne modele

Wszystkie w tej kategorii
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/uruchomienie

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M wej.

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M wej.

02

Playground

Spróbuj Phi-3.5 Vision

Brak formularza wejściowego

Niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy

03

O Phi-3.5 Vision

Krótko mówiącStan na 25 czerwca 2026

Phi-3.5 Vision to model opracowany przez Microsoft w kategorii Multimodalne. Phi-3.5 Vision nie jest obecnie dostępny w serwisie Railwail. Okno kontekstu zawiera 131 072 tokenów, a jedna odpowiedź może mieć do 4096 tokenów.

04

Ceny

Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.

05

API

Wywołaj Phi-3.5 Vision za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:

Brak zweryfikowanego przykładu API

Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.

06

Specyfikacje

ID modelu
phi-3-5-vision
Deweloper
Microsoft
Kategoria
Multimodalne
Wejście
Tekst, Obraz
Wyjście
Tekst
Okno kontekstu
131 072 tokenów
Maks. wyjście
4096 tokenów
Wpis w katalogu zaktualizowany
25 czerwca 2026

Tagi

  • replicate
  • multimodal
  • vision-understanding
  • microsoft
  • open-weights
  • small
07

Często zadawane pytania

Co to jest Phi-3.5 Vision?

Phi-3.5 Vision to model opracowany przez Microsoft w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.

Ile kosztuje Phi-3.5 Vision w serwisie Railwail?

Phi-3.5 Vision nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.

Jakie jest okno kontekstu Phi-3.5 Vision?

Okno kontekstu Phi-3.5 Vision zawiera 131 072 tokenów. Jedna odpowiedź może mieć do 4096 tokenów.

Jak szybki jest Phi-3.5 Vision?

Dla Phi-3.5 Vision jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy Phi-3.5 Vision jest lepszy niż BLIP?

To zależy od zadania. Phi-3.5 Vision (Microsoft) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj Phi-3.5 Vision i BLIP

Czy Phi-3.5 Vision może przetwarzać obrazy?

Tak. Phi-3.5 Vision akceptuje obrazy jako wejście oprócz tekstu.

Czy mogę używać Phi-3.5 Vision teraz?

Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.

Wszystkie modele przez jedno API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.