Llama 3.2 Vision 11B (Ollama)
llama-3-2-vision-11b-ollamaMeta Llama 3.2 11B Vision served via Ollama on Replicate. Open-weights multimodal model for image captioning, document and chart reading, and visual question answering.
- Ár
- ≈ 0,0039 USD/futás
- Bemenet → kimenet
- Szöveg + Kép → Szöveg
- Fejlesztő
- Community
- Frissítve
- 2026. szeptember 23.
Playground
Próbáld ki: Llama 3.2 Vision 11B (Ollama)
Bemenet és kimenet
Ez a futtatás
kb. 0,0039 USD · 0,39 kredit
A kezdéskor 0,0116 USD (1,16 kredit) kerül foglalásra; a tényleges GPU-idő alapján történik a számlázás.
Új vagy itt?
10 ingyenes kredit (0,10 USD) Google-fiókkal való regisztrációkor
Használható 24 órával a regisztráció után, naponta legfeljebb 5 futtatás és futtatásonként legfeljebb 2 kredit. Más bejelentkezési módok kreditek nélkül indulnak. Elegendő 8 futtatáshoz.
Examples
InputPrompt
Where to find this monument? Can you give me other recommendations around the area?
Response
**Wat Phra Kaew (Temple of the Emerald Buddha)** in Bangkok, Thailand. Located within the Grand Palace complex, Wat Phra Kaew is a highly revered and sacred site that houses the iconic Emerald Buddha image. The temple's design incorporates traditional Thai architecture with intricate details and ornate decorations, featuring an imposing spire topped by a golden finial adorned with images of mythical creatures. **Recommendations for Your Visit:** * **Grand Palace**: Explore the sprawling palace grounds, which include several other notable temples and buildings. * **Wat Arun (Temple of Dawn)**: A nearby temple famous for its distinctive spire covered in colorful ceramics and glints of gold. * **Chao Phraya River Cruise**: Take a boat ride along the river to admire the city's skyline and learn about its history. * **Jim Thompson House Museum**: Visit this museum dedicated to Thai art and culture, featuring traditional architecture and beautiful gardens. Wat Phra Kaew is an absolute must-visit attraction when in Bangkok. With these recommendations, you'll have a well-rounded experience of the city's rich cultural heritage.
InputPrompt
How long does it take from invoice date to due date? Be short and concise.
Response
From the invoice date of 11/02/2019 to the due date of 26/02/2019, there is a difference of **15 days**. This calculation was performed by subtracting the invoice date from the due date: 26/02/2019 - 11/02/2019 = 15
InputPrompt
What happens when you take out white cat from this chain?
Response
The white cat is not present in the food web. The correct term for a wild animal would be "wildcat." If we were to remove a wildcat from the ecosystem, it would no longer be able to hunt or prey on other animals. This could have cascading effects throughout the entire ecosystem. *Answer*: Wildcat will lose its source of food and nutrients
A Llama 3.2 Vision 11B (Ollama) névjegye
A Llama 3.2 Vision 11B (Ollama) a Community által fejlesztett modell a Multimodális kategóriában. A Railwail-en a Llama 3.2 Vision 11B (Ollama) ára ≈ 0,0039 USD futásonként.
Árak
| Tipikus futás (≈ 3 s a(z) L40S eszközön) | 0,0039 USD futásonként |
|---|---|
| GPU-idő (L40S) | 0,00117 USD GPU-másodpercenként |
- A futás által ténylegesen igénybevett GPU-idő alapján történik a számlázás. A futás indításakor a tipikus ár 3-szerese kerül foglalásra az egyenlegéből, majd később elszámolásra.
- 1 kredit = 0,01 USD
Költségkalkulátor
Árkalkulátor
A szolgáltató szerint tipikus: kb. 3,3 mp
Összesen
0,39 USD
39 kredit
Futásonként
0,0039 USD · 0,39 kredit
A tényleges GPU-idő alapján számlázva; ez egy becslés.
API
Nincs ellenőrzött API-példa
A nyilvános API más bemeneti formátumot továbbít, mint amit ez a modell igényel. Használja a fenti Playground-ot.
Specifikációk
- Modell-azonosító
llama-3-2-vision-11b-ollama- Fejlesztő
- Community
- Kategória
- Multimodális
- Bemenet
- Szöveg, Kép
- Kimenet
- Szöveg
- Számlázás
- Használat alapján (tokenek vagy GPU-idő)
- Katalógus bejegyzés frissítve
- 2026. szeptember 23.
Bemeneti paraméterek
A modell bemeneti sémájából származó bemenetek és beállítások. Az API szakaszban szereplő példa mutatja, hogy az API melyiket fogadja el.
promptkötelezőQuestion about the image
Típus: SzövegAlapértelmezett: –Engedélyezett értékek: legfeljebb 16 000 karakterimage_urlImage URL to analyze
Típus: SzövegAlapértelmezett: –Engedélyezett értékek: –max_tokensTípus: Egész számAlapértelmezett:1024Engedélyezett értékek: 1 és 4096 közötttemperatureTípus: SzámAlapértelmezett:0.7Engedélyezett értékek: 0 és 2 között
Címkék
- replicate
- meta
- llama
- vision-understanding
- open-weights
- ollama
Gyakran ismételt kérdések
Mi az a Llama 3.2 Vision 11B (Ollama)?
A Llama 3.2 Vision 11B (Ollama) a Community által fejlesztett modell a Multimodális kategóriában.
Mennyibe kerül a Llama 3.2 Vision 11B (Ollama) a Railwail-on?
A Railwail-en a Llama 3.2 Vision 11B (Ollama) ára ≈ 0,0039 USD futásonként. Az egyes kérések tényleges felhasználásáért kell fizetni. A használatért előre vásárolt kreditek alapján kell fizetni; 1 kredit = 0,01 USD.
Milyen beállításokat támogat a Llama 3.2 Vision 11B (Ollama)?
A bemeneti séma szerint a Llama 3.2 Vision 11B (Ollama) ezeket a paramétereket ismeri: prompt (legfeljebb 16 000 karakter), image_url, max_tokens (1 és 4096 között) és temperature (0 és 2 között).
Milyen gyors a Llama 3.2 Vision 11B (Ollama)?
A Llama 3.2 Vision 11B (Ollama)-nek még nincs elég mért futtatása a Railwail-on ahhoz, hogy futási időt adjunk meg. Ez a bemenettől, a beállításoktól és a szolgáltató terhelésétől függ.
A Llama 3.2 Vision 11B (Ollama) jobb, mint a BLIP?
Ez a feladattól függ. A Llama 3.2 Vision 11B (Ollama) (Community) és a BLIP (Salesforce) egyaránt modellek a Multimodális kategóriában. Az összehasonlítás oldal az árakat és specifikációkat egymás mellett mutatja.
Llama 3.2 Vision 11B (Ollama) és BLIP összehasonlításaA Llama 3.2 Vision 11B (Ollama) képes képeket feldolgozni?
Igen. A Llama 3.2 Vision 11B (Ollama) szöveg mellett képeket is fogad bemenetként.
Hasonló modellek
Ebben a kategóriában az összes- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
≈ 0,0457 USD/futás
1072 % drágább egységenként
Llama 3.2 Vision 11B (Ollama) és CLIP Interrogator összehasonlítása - Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
≈ 0,0050 USD/futás
28 % drágább egységenként
Llama 3.2 Vision 11B (Ollama) és Depth Anything v2 összehasonlítása
Összes modell egy API-n keresztül
Egy API-kulcs a Railwail összes modelljéhez. A használat előre feltöltött kreditek alapján kerül felszámításra, 1 kredit = 0,01 USD.