Qwen2-VL 7B Instruct
qwen2-vl-7b-instruct-repAlibaba Qwen2-VL 7B served on Replicate. Open-weights vision-language model that chats about images and video, with dynamic resolution and strong OCR and document QA for its size.
- Ár
- ≈ 0,0024 USD/futás
- Bemenet → kimenet
- Szöveg + Kép + Videó → Szöveg
- Fejlesztő
- Community
- Frissítve
- 2026. szeptember 23.
Playground
Próbáld ki: Qwen2-VL 7B Instruct
Bemenet és kimenet
Ez a futtatás
kb. 0,0024 USD · 0,24 kredit
A kezdéskor 0,0072 USD (0,72 kredit) kerül foglalásra; a tényleges GPU-idő alapján történik a számlázás.
Új vagy itt?
10 ingyenes kredit (0,10 USD) Google-fiókkal való regisztrációkor
Használható 24 órával a regisztráció után, naponta legfeljebb 5 futtatás és futtatásonként legfeljebb 2 kredit. Más bejelentkezési módok kreditek nélkül indulnak. Elegendő 13 futtatáshoz.
Examples
Prompt
Describe this video in detail.
Response
The video features a monkey riding a skateboard in a park. The monkey is wearing roller skates and is seen moving forward on the skateboard, with its arms outstretched for balance. The park is filled with people sitting on benches and walking around, enjoying the sunny day. The monkey appears to be enjoying itself, and the scene is filled with a sense of fun and playfulness. The park is surrounded by trees and greenery, creating a peaceful and relaxing atmosphere. Overall, the video captures a unique and entertaining moment of a monkey enjoying a day out in the park on roller skates.
Prompt
Describe this in detail.
Response
The image shows a half of an avocado on the left side, with a pit visible inside. On the right side, there is a stylized letter "A" in a bold, uppercase font. The avocado and the letter "A" are separated by a white arrow pointing from the avocado to the letter "A," indicating a transformation or relationship between the two. The background is a light beige color.
Prompt
Describe this in detail.
Response
The image depicts a dog, specifically a Golden Retriever, enjoying a slice of watermelon. The dog is positioned on the left side of the frame, with its head lowered towards the watermelon. The watermelon is placed on a wooden table, and the dog appears to be biting into the fruit, indicating it is eating it. The background is blurred, suggesting a natural outdoor setting with greenery. The overall scene conveys a sense of relaxation and enjoyment.
A Qwen2-VL 7B Instruct névjegye
A Qwen2-VL 7B Instruct a Community által fejlesztett modell a Multimodális kategóriában. A Railwail-en a Qwen2-VL 7B Instruct ára ≈ 0,0024 USD futásonként.
Árak
| Tipikus futás (≈ 2 s a(z) L40S eszközön) | 0,0024 USD futásonként |
|---|---|
| GPU-idő (L40S) | 0,00117 USD GPU-másodpercenként |
- A futás által ténylegesen igénybevett GPU-idő alapján történik a számlázás. A futás indításakor a tipikus ár 3-szerese kerül foglalásra az egyenlegéből, majd később elszámolásra.
- 1 kredit = 0,01 USD
Költségkalkulátor
Árkalkulátor
A szolgáltató szerint tipikus: kb. 2,1 mp
Összesen
0,24 USD
24 kredit
Futásonként
0,0024 USD · 0,24 kredit
A tényleges GPU-idő alapján számlázva; ez egy becslés.
API
Nincs ellenőrzött API-példa
A nyilvános API más bemeneti formátumot továbbít, mint amit ez a modell igényel. Használja a fenti Playground-ot.
Specifikációk
- Modell-azonosító
qwen2-vl-7b-instruct-rep- Fejlesztő
- Community
- Kategória
- Multimodális
- Bemenet
- Szöveg, Kép, Videó
- Kimenet
- Szöveg
- Számlázás
- Használat alapján (tokenek vagy GPU-idő)
- Katalógus bejegyzés frissítve
- 2026. szeptember 23.
Bemeneti paraméterek
A modell bemeneti sémájából származó bemenetek és beállítások. Az API szakaszban szereplő példa mutatja, hogy az API melyiket fogadja el.
promptkötelezőQuestion about the image or video
Típus: SzövegAlapértelmezett: –Engedélyezett értékek: legfeljebb 16 000 karakterimage_urlImage or video URL to analyze
Típus: SzövegAlapértelmezett: –Engedélyezett értékek: –max_tokensTípus: Egész számAlapértelmezett:1024Engedélyezett értékek: 1 és 4096 közötttemperatureTípus: SzámAlapértelmezett:0.7Engedélyezett értékek: 0 és 2 között
Címkék
- replicate
- qwen
- alibaba
- vision-understanding
- open-weights
- ocr
Gyakran ismételt kérdések
Mi az a Qwen2-VL 7B Instruct?
A Qwen2-VL 7B Instruct a Community által fejlesztett modell a Multimodális kategóriában.
Mennyibe kerül a Qwen2-VL 7B Instruct a Railwail-on?
A Railwail-en a Qwen2-VL 7B Instruct ára ≈ 0,0024 USD futásonként. Az egyes kérések tényleges felhasználásáért kell fizetni. A használatért előre vásárolt kreditek alapján kell fizetni; 1 kredit = 0,01 USD.
Milyen beállításokat támogat a Qwen2-VL 7B Instruct?
A bemeneti séma szerint a Qwen2-VL 7B Instruct ezeket a paramétereket ismeri: prompt (legfeljebb 16 000 karakter), image_url, max_tokens (1 és 4096 között) és temperature (0 és 2 között).
Milyen gyors a Qwen2-VL 7B Instruct?
A Qwen2-VL 7B Instruct-nek még nincs elég mért futtatása a Railwail-on ahhoz, hogy futási időt adjunk meg. Ez a bemenettől, a beállításoktól és a szolgáltató terhelésétől függ.
A Qwen2-VL 7B Instruct jobb, mint a BLIP?
Ez a feladattól függ. A Qwen2-VL 7B Instruct (Community) és a BLIP (Salesforce) egyaránt modellek a Multimodális kategóriában. Az összehasonlítás oldal az árakat és specifikációkat egymás mellett mutatja.
Qwen2-VL 7B Instruct és BLIP összehasonlításaA Qwen2-VL 7B Instruct képes képeket feldolgozni?
Igen. A Qwen2-VL 7B Instruct szöveg mellett képeket is fogad bemenetként.
Hasonló modellek
Ebben a kategóriában az összes- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
≈ 0,0457 USD/futás
1804 % drágább egységenként
Qwen2-VL 7B Instruct és CLIP Interrogator összehasonlítása - Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
≈ 0,0050 USD/futás
108 % drágább egységenként
Qwen2-VL 7B Instruct és Depth Anything v2 összehasonlítása
Összes modell egy API-n keresztül
Egy API-kulcs a Railwail összes modelljéhez. A használat előre feltöltött kreditek alapján kerül felszámításra, 1 kredit = 0,01 USD.