Florence-2 Segmentation

MultimodálníDostupné
od CommunityID modelu: florence-2-segmentation

Microsoft Florence-2 unified vision model with referring expression segmentation. Text-prompted region and mask generation in one model.

Cena
≈ 0,0012 US$/spuštění
Vstup → výstup
Text + Obrázek → Text
Vývojář
Community
Aktualizováno
23. září 2026
01

Playground

Vyzkoušet Florence-2 Segmentation

Žádný formulář vstupu

≈ 0,0012 US$/spuštění

Pro tento model zatím není formulář vstupu

Jeho vstupy nejsou zatím zdokumentovány. Aby se žádné spuštění neprovádělo s chybným vstupem, zde nenabízíme formulář. Místo toho si vyberte srovnatelný model.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Example output 1 from Florence-2 SegmentationOpen full size
    InputInput

    No text prompt: the model only takes the input shown.

  • Example output 2 from Florence-2 SegmentationOpen full size
    InputInput

    No text prompt: the model only takes the input shown.

  • Example output 3 from Florence-2 SegmentationOpen full size
    InputInput

    No text prompt: the model only takes the input shown.

03

O Florence-2 Segmentation

StručněStav: 23. září 2026

Florence-2 Segmentation je model od Community v kategorii Multimodální. Na Railwail stojí Florence-2 Segmentation ≈ 0,0012 US$ za spuštění.

04

Ceny

Ceny v USD. Použití se účtuje z předplacených kreditů.
Typické spuštění (≈ 1 s na L40S)0,0012 US$ za spuštění
GPU čas (L40S)0,00117 US$ za GPU sekundu
  • Účtuje se GPU čas, který spuštění skutečně trvá. Při spuštění je z vašeho zůstatku rezervováno 3× typická cena a později se vypořádá.
  • 1 kredit = 0,01 US$

Kalkulátor nákladů

Kalkulátor cen

s

Typicky podle poskytovatele: přibližně 1 s

Celkem

0,12 US$

12 kreditů

Na spuštění

0,0012 US$ · 0,12 kreditů

Účtuje se skutečný čas GPU; jedná se o odhad.

05

API

Volejte Florence-2 Segmentation s vaším API klíčem Railwail. V požadavku použijte toto ID modelu:
florence-2-segmentationDokumentace APIZískat API klíč

Žádný ověřený příklad API

Veřejné API předává jiný formát vstupu, než tento model potřebuje. Použijte playground výše.

06

Specifikace

ID modelu
florence-2-segmentation
Vývojář
Community
Vstup
Text, Obrázek
Výstup
Text
Fakturace
Podle použití (tokeny nebo GPU čas)
Záznam v katalogu aktualizován
23. září 2026

Štítky

  • replicate
  • segmentation
  • vision-understanding
  • microsoft
  • open-weights
07

Často kladené otázky

Co je Florence-2 Segmentation?

Florence-2 Segmentation je model od Community v kategorii Multimodální.

Kolik stojí Florence-2 Segmentation na Railwail?

Na Railwail stojí Florence-2 Segmentation ≈ 0,0012 US$ za spuštění. Platíte za to, co každý požadavek skutečně spotřebuje. Použití se platí z předplacených kreditů; 1 kredit se rovná 0,01 US$.

Jak rychlý je Florence-2 Segmentation?

Pro Florence-2 Segmentation je na Railwail zatím příliš málo naměřených spuštění na uvedení doby běhu. Závisí na vstupu, nastavení a zátěži u poskytovatele.

Je Florence-2 Segmentation lepší než BLIP?

Záleží na úkolu. Florence-2 Segmentation (Community) a BLIP (Salesforce) jsou oba modely v kategorii Multimodální. Stránka porovnání zobrazuje jejich ceny a specifikace vedle sebe.

Porovnat Florence-2 Segmentation a BLIP

Může Florence-2 Segmentation zpracovávat obrázky?

Ano. Florence-2 Segmentation přijímá obrázky jako vstup kromě textu.

08

Srovnatelné modely

Všechny v této kategorii
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 US$/spuštění

    75 % levnější na jednotku

    Porovnat Florence-2 Segmentation a BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 US$/spuštění

    3 708 % dražší na jednotku

    Porovnat Florence-2 Segmentation a CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 US$/spuštění

    317 % dražší na jednotku

    Porovnat Florence-2 Segmentation a Depth Anything v2

Všechny modely přes jednu API

Jeden API klíč pro všechny modely na Railwail. Použití se účtuje z předplacených kreditů, 1 kredit = 0,01 US$.