Phi-3.5 Vision

MultimodalNicht verfügbar
von MicrosoftModell-ID: phi-3-5-vision

Microsoft Phi-3.5 Vision Instruct. Small (4.2B) multimodal model with strong document, OCR and multi-image reasoning at low cost.

Status
Nicht verfügbar
Kontext
131,072 Token
Max. Ausgabe
4,096 Token
Eingabe → Ausgabe
Text + Bild → Text
Entwickler
Microsoft
Aktualisiert
25. Juni 2026

Phi-3.5 Vision ist derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Die Angaben auf dieser Seite kannst du weiter nachlesen. Mit einer der verfügbaren Alternativen unten kannst du sofort ein vergleichbares Modell nutzen.

Zu den Alternativen
01

Vergleichbare Modelle

Alle dieser Kategorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ca. $ 0.00030/Lauf

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    $ 6.00/1 Mio. In

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    $ 3.60/1 Mio. In

02

Playground

Phi-3.5 Vision ausprobieren

Keine Eingabemaske

Derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Der Playground ist deaktiviert. Vergleichbare Modelle findest du in derselben Kategorie: Alternativen ansehen

03

Über Phi-3.5 Vision

Kurz gesagtStand: 25. Juni 2026

Phi-3.5 Vision ist ein Modell von Microsoft aus der Kategorie Multimodal. Über Railwail ist Phi-3.5 Vision derzeit nicht verfügbar. Das Kontextfenster umfasst 131,072 Token, eine Antwort bis zu 4,096 Token.

04

Preise

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Für dieses Modell gibt es derzeit keinen Preis, deshalb lässt es sich nicht ausführen.

05

API

Rufe Phi-3.5 Vision mit deinem Railwail-API-Schlüssel auf. Diese Modell-ID gehört in die Anfrage:

Kein geprüftes API-Beispiel

Die öffentliche API übergibt ein anderes Eingabeformat, als dieses Modell braucht. Nutze den Playground oben.

06

Spezifikationen

Modell-ID
phi-3-5-vision
Entwickler
Microsoft
Kategorie
Multimodal
Eingabe
Text, Bild
Ausgabe
Text
Kontextfenster
131,072 Token
Max. Ausgabe
4,096 Token
Katalogeintrag aktualisiert
25. Juni 2026

Schlagwörter

  • replicate
  • multimodal
  • vision-understanding
  • microsoft
  • open-weights
  • small
07

Häufige Fragen

Was ist Phi-3.5 Vision?

Phi-3.5 Vision ist ein Modell von Microsoft aus der Kategorie Multimodal. Es steht im Railwail-Katalog, lässt sich derzeit aber nicht ausführen.

Was kostet Phi-3.5 Vision bei Railwail?

Phi-3.5 Vision lässt sich über Railwail derzeit nicht ausführen, deshalb gibt es keinen aktuellen Preis. Verfügbare Alternativen mit Preisen stehen weiter unten auf dieser Seite.

Wie gross ist das Kontextfenster von Phi-3.5 Vision?

Das Kontextfenster von Phi-3.5 Vision umfasst 131,072 Token. Eine Antwort kann bis zu 4,096 Token lang sein.

Wie schnell ist Phi-3.5 Vision?

Für Phi-3.5 Vision gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.

Ist Phi-3.5 Vision besser als BLIP?

Das hängt von der Aufgabe ab. Phi-3.5 Vision (Microsoft) und BLIP (Salesforce) sind beide Modelle aus der Kategorie Multimodal. Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.

Phi-3.5 Vision und BLIP vergleichen

Kann Phi-3.5 Vision Bilder verarbeiten?

Ja. Phi-3.5 Vision nimmt neben Text auch Bilder als Eingabe an.

Kann ich Phi-3.5 Vision gerade nutzen?

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Die Seite bleibt online; verfügbare Alternativen aus derselben Kategorie stehen weiter unten.

Alle Modelle über eine API

Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = $ 0.01.