Llama 3.2 Vision 11B (Ollama)
llama-3-2-vision-11b-ollamaMeta Llama 3.2 11B Vision served via Ollama on Replicate. Open-weights multimodal model for image captioning, document and chart reading, and visual question answering.
- Cena
- ≈ 0,0039 US$/spuštění
- Vstup → výstup
- Text + Obrázek → Text
- Vývojář
- Community
- Aktualizováno
- 23. září 2026
Playground
Vyzkoušet Llama 3.2 Vision 11B (Ollama)
Vstup a výstup
Tento běh
přibližně 0,0039 US$ · 0,39 credits
Na začátku se rezervuje 0,0116 US$ (1,16 credits), fakturuje se skutečný čas GPU.
Nový zde?
10 bezplatných credits (0,10 US$) při registraci přes Google
Použitelné 24 hodin po registraci, až 5 běhů za den a maximálně 2 credits za běh. Ostatní způsoby přihlášení začínají bez credits. Stačí na 8 spuštění tohoto modelu.
Examples
InputPrompt
Where to find this monument? Can you give me other recommendations around the area?
Response
**Wat Phra Kaew (Temple of the Emerald Buddha)** in Bangkok, Thailand. Located within the Grand Palace complex, Wat Phra Kaew is a highly revered and sacred site that houses the iconic Emerald Buddha image. The temple's design incorporates traditional Thai architecture with intricate details and ornate decorations, featuring an imposing spire topped by a golden finial adorned with images of mythical creatures. **Recommendations for Your Visit:** * **Grand Palace**: Explore the sprawling palace grounds, which include several other notable temples and buildings. * **Wat Arun (Temple of Dawn)**: A nearby temple famous for its distinctive spire covered in colorful ceramics and glints of gold. * **Chao Phraya River Cruise**: Take a boat ride along the river to admire the city's skyline and learn about its history. * **Jim Thompson House Museum**: Visit this museum dedicated to Thai art and culture, featuring traditional architecture and beautiful gardens. Wat Phra Kaew is an absolute must-visit attraction when in Bangkok. With these recommendations, you'll have a well-rounded experience of the city's rich cultural heritage.
InputPrompt
How long does it take from invoice date to due date? Be short and concise.
Response
From the invoice date of 11/02/2019 to the due date of 26/02/2019, there is a difference of **15 days**. This calculation was performed by subtracting the invoice date from the due date: 26/02/2019 - 11/02/2019 = 15
InputPrompt
What happens when you take out white cat from this chain?
Response
The white cat is not present in the food web. The correct term for a wild animal would be "wildcat." If we were to remove a wildcat from the ecosystem, it would no longer be able to hunt or prey on other animals. This could have cascading effects throughout the entire ecosystem. *Answer*: Wildcat will lose its source of food and nutrients
O Llama 3.2 Vision 11B (Ollama)
Llama 3.2 Vision 11B (Ollama) je model od Community v kategorii Multimodální. Na Railwail stojí Llama 3.2 Vision 11B (Ollama) ≈ 0,0039 US$ za spuštění.
Ceny
| Typické spuštění (≈ 3 s na L40S) | 0,0039 US$ za spuštění |
|---|---|
| GPU čas (L40S) | 0,00117 US$ za GPU sekundu |
- Účtuje se GPU čas, který spuštění skutečně trvá. Při spuštění je z vašeho zůstatku rezervováno 3× typická cena a později se vypořádá.
- 1 kredit = 0,01 US$
Kalkulátor nákladů
Kalkulátor cen
Typicky podle poskytovatele: přibližně 3,3 s
Celkem
0,39 US$
39 kreditů
Na spuštění
0,0039 US$ · 0,39 kreditů
Účtuje se skutečný čas GPU; jedná se o odhad.
API
Žádný ověřený příklad API
Veřejné API předává jiný formát vstupu, než tento model potřebuje. Použijte playground výše.
Specifikace
- ID modelu
llama-3-2-vision-11b-ollama- Vývojář
- Community
- Kategorie
- Multimodální
- Vstup
- Text, Obrázek
- Výstup
- Text
- Fakturace
- Podle použití (tokeny nebo GPU čas)
- Záznam v katalogu aktualizován
- 23. září 2026
Vstupní parametry
Vstupy a nastavení ze vstupního schématu modelu. Příklad v sekci API ukazuje, které z nich API přijímá.
promptpovinnéQuestion about the image
Typ: TextVýchozí: –Povolené hodnoty: až 16 000 znakůimage_urlImage URL to analyze
Typ: TextVýchozí: –Povolené hodnoty: –max_tokensTyp: Celé čísloVýchozí:1024Povolené hodnoty: 1 až 4 096temperatureTyp: ČísloVýchozí:0.7Povolené hodnoty: 0 až 2
Štítky
- replicate
- meta
- llama
- vision-understanding
- open-weights
- ollama
Často kladené otázky
Co je Llama 3.2 Vision 11B (Ollama)?
Llama 3.2 Vision 11B (Ollama) je model od Community v kategorii Multimodální.
Kolik stojí Llama 3.2 Vision 11B (Ollama) na Railwail?
Na Railwail stojí Llama 3.2 Vision 11B (Ollama) ≈ 0,0039 US$ za spuštění. Platíte za to, co každý požadavek skutečně spotřebuje. Použití se platí z předplacených kreditů; 1 kredit se rovná 0,01 US$.
Jaká nastavení Llama 3.2 Vision 11B (Ollama) podporuje?
Podle schématu vstupu Llama 3.2 Vision 11B (Ollama) zná tyto parametry: prompt (až 16 000 znaků), image_url, max_tokens (1 až 4 096) a temperature (0 až 2).
Jak rychlý je Llama 3.2 Vision 11B (Ollama)?
Pro Llama 3.2 Vision 11B (Ollama) je na Railwail zatím příliš málo naměřených spuštění na uvedení doby běhu. Závisí na vstupu, nastavení a zátěži u poskytovatele.
Je Llama 3.2 Vision 11B (Ollama) lepší než BLIP?
Záleží na úkolu. Llama 3.2 Vision 11B (Ollama) (Community) a BLIP (Salesforce) jsou oba modely v kategorii Multimodální. Stránka porovnání zobrazuje jejich ceny a specifikace vedle sebe.
Porovnat Llama 3.2 Vision 11B (Ollama) a BLIPMůže Llama 3.2 Vision 11B (Ollama) zpracovávat obrázky?
Ano. Llama 3.2 Vision 11B (Ollama) přijímá obrázky jako vstup kromě textu.
Srovnatelné modely
Všechny v této kategorii- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
≈ 0,0457 US$/spuštění
1 072 % dražší na jednotku
Porovnat Llama 3.2 Vision 11B (Ollama) a CLIP Interrogator - Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
≈ 0,0050 US$/spuštění
28 % dražší na jednotku
Porovnat Llama 3.2 Vision 11B (Ollama) a Depth Anything v2
Všechny modely přes jednu API
Jeden API klíč pro všechny modely na Railwail. Použití se účtuje z předplacených kreditů, 1 kredit = 0,01 US$.