Florence-2 Large
florence-2-largeMicrosoft Florence-2 Large. Unified prompt-based vision foundation model for captioning, detection, segmentation and OCR with a single 770M-param backbone.
- Ár
- ≈ 0,0012 USD/futás
- Bemenet → kimenet
- Szöveg + Kép → Szöveg
- Fejlesztő
- Community
- Frissítve
- 2026. szeptember 23.
Playground
Próbáld ki: Florence-2 Large
Bemenet és kimenet
Ez a futtatás
kb. 0,0012 USD · 0,12 kredit
A kezdéskor 0,0036 USD (0,36 kredit) kerül foglalásra; a tényleges GPU-idő alapján történik a számlázás.
Új vagy itt?
10 ingyenes kredit (0,10 USD) Google-fiókkal való regisztrációkor
Használható 24 órával a regisztráció után, naponta legfeljebb 5 futtatás és futtatásonként legfeljebb 2 kredit. Más bejelentkezési módok kreditek nélkül indulnak. Elegendő 27 futtatáshoz.
Examples
Open full size
InputNo text prompt: the model only takes the input shown.
Open full size
InputNo text prompt: the model only takes the input shown.
Open full size
InputNo text prompt: the model only takes the input shown.
A Florence-2 Large névjegye
A Florence-2 Large a Community által fejlesztett modell a Multimodális kategóriában. A Railwail-en a Florence-2 Large ára ≈ 0,0012 USD futásonként.
Árak
| Tipikus futás (≈ 1 s a(z) L40S eszközön) | 0,0012 USD futásonként |
|---|---|
| GPU-idő (L40S) | 0,00117 USD GPU-másodpercenként |
- A futás által ténylegesen igénybevett GPU-idő alapján történik a számlázás. A futás indításakor a tipikus ár 3-szerese kerül foglalásra az egyenlegéből, majd később elszámolásra.
- 1 kredit = 0,01 USD
Költségkalkulátor
Árkalkulátor
A szolgáltató szerint tipikus: kb. 1 mp
Összesen
0,12 USD
12 kredit
Futásonként
0,0012 USD · 0,12 kredit
A tényleges GPU-idő alapján számlázva; ez egy becslés.
API
Nincs ellenőrzött API-példa
A nyilvános API más bemeneti formátumot továbbít, mint amit ez a modell igényel. Használja a fenti Playground-ot.
Specifikációk
- Modell-azonosító
florence-2-large- Fejlesztő
- Community
- Kategória
- Multimodális
- Bemenet
- Szöveg, Kép
- Kimenet
- Szöveg
- Számlázás
- Használat alapján (tokenek vagy GPU-idő)
- Katalógus bejegyzés frissítve
- 2026. szeptember 23.
Bemeneti paraméterek
A modell bemeneti sémájából származó bemenetek és beállítások. Az API szakaszban szereplő példa mutatja, hogy az API melyiket fogadja el.
promptkötelezőUser message or task instruction
Típus: SzövegAlapértelmezett: –Engedélyezett értékek: legfeljebb 4000 karaktertaskTípus: VálasztásAlapértelmezett:captionEngedélyezett értékek: caption, detailed_caption, ocr, object_detection vagy segmentationimage_urlImage URL to analyze
Típus: SzövegAlapértelmezett: –Engedélyezett értékek: –max_tokensTípus: Egész számAlapértelmezett:1024Engedélyezett értékek: 1 és 4096 közötttemperatureTípus: SzámAlapértelmezett:0.7Engedélyezett értékek: 0 és 2 között
Címkék
- replicate
- multimodal
- vision-understanding
- microsoft
- open-weights
Gyakran ismételt kérdések
Mi az a Florence-2 Large?
A Florence-2 Large a Community által fejlesztett modell a Multimodális kategóriában.
Mennyibe kerül a Florence-2 Large a Railwail-on?
A Railwail-en a Florence-2 Large ára ≈ 0,0012 USD futásonként. Az egyes kérések tényleges felhasználásáért kell fizetni. A használatért előre vásárolt kreditek alapján kell fizetni; 1 kredit = 0,01 USD.
Milyen beállításokat támogat a Florence-2 Large?
A bemeneti séma szerint a Florence-2 Large ezeket a paramétereket ismeri: prompt (legfeljebb 4000 karakter), task (caption, detailed_caption, ocr, object_detection vagy segmentation), image_url, max_tokens (1 és 4096 között) és temperature (0 és 2 között).
Milyen gyors a Florence-2 Large?
A Florence-2 Large-nek még nincs elég mért futtatása a Railwail-on ahhoz, hogy futási időt adjunk meg. Ez a bemenettől, a beállításoktól és a szolgáltató terhelésétől függ.
A Florence-2 Large jobb, mint a BLIP?
Ez a feladattól függ. A Florence-2 Large (Community) és a BLIP (Salesforce) egyaránt modellek a Multimodális kategóriában. Az összehasonlítás oldal az árakat és specifikációkat egymás mellett mutatja.
Florence-2 Large és BLIP összehasonlításaA Florence-2 Large képes képeket feldolgozni?
Igen. A Florence-2 Large szöveg mellett képeket is fogad bemenetként.
Hasonló modellek
Ebben a kategóriában az összes- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Összes modell egy API-n keresztül
Egy API-kulcs a Railwail összes modelljéhez. A használat előre feltöltött kreditek alapján kerül felszámításra, 1 kredit = 0,01 USD.