Mask2Former
mask2formerMeta Mask2Former universal image-segmentation transformer. Single architecture for panoptic, instance and semantic segmentation tasks.
- Preis
- ca. 0,0276 $/Lauf
- Eingabe → Ausgabe
- Text + Bild → Text
- Entwickler
- Meta
- Aktualisiert
- 23. September 2026
Playground
Mask2Former ausprobieren
Keine Eingabemaske
Für dieses Modell ist noch keine Eingabemaske hinterlegt
Seine Eingaben sind noch nicht erfasst. Damit kein Lauf an einer falschen Eingabe scheitert, bieten wir hier kein Formular an. Wähle stattdessen ein vergleichbares Modell.
Beispiele
In voller Größe öffnen
EingabeKein Text-Prompt: Das Modell nimmt nur die gezeigte Eingabe.
In voller Größe öffnen
EingabeKein Text-Prompt: Das Modell nimmt nur die gezeigte Eingabe.
In voller Größe öffnen
EingabeKein Text-Prompt: Das Modell nimmt nur die gezeigte Eingabe.
Über Mask2Former
Mask2Former ist ein Modell von Meta aus der Kategorie Multimodal. Über Railwail kostet Mask2Former ca. 0,0276 $ pro Lauf.
Preise
| Typischer Lauf (ca. 102 s auf T4) | 0,0276 $ pro Lauf |
|---|---|
| GPU-Zeit (T4) | 0,00027 $ pro GPU-Sekunde |
- Abgerechnet wird die GPU-Zeit, die der Lauf tatsächlich braucht. Beim Start wird das 3-Fache des typischen Preises vom Guthaben vorgemerkt und danach verrechnet.
- 1 Credit = 0,01 $
Kostenrechner
Preisrechner
Typisch laut Anbieter: ca. 102,2 s
Gesamt
2,76 $
276 Credits
Je Lauf
0,0276 $ · 2,76 Credits
Abgerechnet wird die tatsächliche GPU-Zeit; der Wert ist eine Schätzung.
API
Kein geprüftes API-Beispiel
Die öffentliche API übergibt ein anderes Eingabeformat, als dieses Modell braucht. Nutze den Playground oben.
Spezifikationen
- Modell-ID
mask2former- Entwickler
- Meta
- Kategorie
- Multimodal
- Eingabe
- Text, Bild
- Ausgabe
- Text
- Abrechnung
- Nach Verbrauch (Token bzw. GPU-Zeit)
- Katalogeintrag aktualisiert
- 23. September 2026
Schlagwörter
- replicate
- segmentation
- vision-understanding
- transformer
- meta
Häufige Fragen
Was ist Mask2Former?
Mask2Former ist ein Modell von Meta aus der Kategorie Multimodal.
Was kostet Mask2Former bei Railwail?
Über Railwail kostet Mask2Former ca. 0,0276 $ pro Lauf. Abgerechnet wird, was jede Anfrage tatsächlich verbraucht. Bezahlt wird mit vorab gekauften Credits; 1 Credit entspricht 0,01 $.
Wie schnell ist Mask2Former?
Für Mask2Former gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.
Ist Mask2Former besser als BLIP?
Das hängt von der Aufgabe ab. Mask2Former (Meta) und BLIP (Salesforce) sind beide Modelle aus der Kategorie Multimodal. Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.
Mask2Former und BLIP vergleichenKann Mask2Former Bilder verarbeiten?
Ja. Mask2Former nimmt neben Text auch Bilder als Eingabe an.
Vergleichbare Modelle
Alle dieser Kategorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Alle Modelle über eine API
Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = 0,01 $.