Llama 3.2 Vision 11B (Ollama)
llama-3-2-vision-11b-ollamaMeta Llama 3.2 11B Vision served via Ollama on Replicate. Open-weights multimodal model for image captioning, document and chart reading, and visual question answering.
- Fiyat
- ≈ $0,0039/çalıştırma
- Giriş → Çıkış
- Metin + Görüntü → Metin
- Geliştirici
- Community
- Güncellendi
- 23 Eylül 2026
Playground
Llama 3.2 Vision 11B (Ollama)'ı deneyin
Giriş & Sonuç
Bu çalıştırma
yaklaşık $0,0039 · 0,39 kredi
Başlangıçta $0,0116 (1,16 kredi) ayrılır; gerçek GPU süresi faturalandırılır.
Yeni misiniz?
Google ile kaydolduğunuzda 10 ücretsiz kredi ($0,10)
Kaydolduktan 24 saat sonra kullanılabilir, günde 5 çalıştırmaya kadar ve çalıştırma başına en fazla 2 kredi. Diğer oturum açma yöntemleri kredi olmadan başlar. Bu model için 8 çalıştırma yeterli.
Examples
InputPrompt
Where to find this monument? Can you give me other recommendations around the area?
Response
**Wat Phra Kaew (Temple of the Emerald Buddha)** in Bangkok, Thailand. Located within the Grand Palace complex, Wat Phra Kaew is a highly revered and sacred site that houses the iconic Emerald Buddha image. The temple's design incorporates traditional Thai architecture with intricate details and ornate decorations, featuring an imposing spire topped by a golden finial adorned with images of mythical creatures. **Recommendations for Your Visit:** * **Grand Palace**: Explore the sprawling palace grounds, which include several other notable temples and buildings. * **Wat Arun (Temple of Dawn)**: A nearby temple famous for its distinctive spire covered in colorful ceramics and glints of gold. * **Chao Phraya River Cruise**: Take a boat ride along the river to admire the city's skyline and learn about its history. * **Jim Thompson House Museum**: Visit this museum dedicated to Thai art and culture, featuring traditional architecture and beautiful gardens. Wat Phra Kaew is an absolute must-visit attraction when in Bangkok. With these recommendations, you'll have a well-rounded experience of the city's rich cultural heritage.
InputPrompt
How long does it take from invoice date to due date? Be short and concise.
Response
From the invoice date of 11/02/2019 to the due date of 26/02/2019, there is a difference of **15 days**. This calculation was performed by subtracting the invoice date from the due date: 26/02/2019 - 11/02/2019 = 15
InputPrompt
What happens when you take out white cat from this chain?
Response
The white cat is not present in the food web. The correct term for a wild animal would be "wildcat." If we were to remove a wildcat from the ecosystem, it would no longer be able to hunt or prey on other animals. This could have cascading effects throughout the entire ecosystem. *Answer*: Wildcat will lose its source of food and nutrients
Llama 3.2 Vision 11B (Ollama) Hakkında
Llama 3.2 Vision 11B (Ollama), Community tarafından Multimodal kategorisinde geliştirilen bir modeldir. Railwail üzerinde Llama 3.2 Vision 11B (Ollama) maliyeti ≈ $0,0039 çalıştırma başına.
Fiyatlandırma
| Tipik çalıştırma (≈ 3 s, L40S üzerinde) | $0,0039 çalıştırma başına |
|---|---|
| GPU Süresi (L40S) | $0,00117 GPU saniyesi başına |
- Çalıştırmanın gerçekten aldığı GPU süresi için faturalandırılır. Çalıştırma başladığında, bakiyenizden tipik fiyatın 3 katı ayrılır ve daha sonra kapatılır.
- 1 kredi = $0,01
Maliyet Hesaplayıcı
Fiyat hesaplayıcı
Sağlayıcıya göre tipik: yaklaşık 3,3 s
Toplam
$0,39
39 kredi
Çalışma başına
$0,0039 · 0,39 kredi
Gerçek GPU süresi faturalandırılır; bu bir tahmindir.
API
Doğrulanmış API örneği yok
Genel API, bu modelin ihtiyaç duyduğundan farklı bir giriş biçimi iletir. Yukarıdaki oyun alanını kullanın.
Özellikler
- Model Kimliği
llama-3-2-vision-11b-ollama- Geliştirici
- Community
- Kategori
- Multimodal
- Giriş
- Metin, Görüntü
- Çıkış
- Metin
- Faturalandırma
- Kullanıma göre (token veya GPU süresi)
- Katalog girişi güncellendi
- 23 Eylül 2026
Giriş Parametreleri
Modelin giriş şemasından giriş ve ayarlar. API bölümündeki örnek, API'nin hangilerini kabul ettiğini gösterir.
promptgerekliQuestion about the image
Tür: MetinVarsayılan: –İzin verilen değerler: en fazla 16.000 karakterimage_urlImage URL to analyze
Tür: MetinVarsayılan: –İzin verilen değerler: –max_tokensTür: Tam sayıVarsayılan:1024İzin verilen değerler: 1 ile 4.096 arasındatemperatureTür: SayıVarsayılan:0.7İzin verilen değerler: 0 ile 2 arasında
Etiketler
- replicate
- meta
- llama
- vision-understanding
- open-weights
- ollama
Sık Sorulan Sorular
Llama 3.2 Vision 11B (Ollama) nedir?
Llama 3.2 Vision 11B (Ollama), Community tarafından Multimodal kategorisinde oluşturulan bir modeldir.
Llama 3.2 Vision 11B (Ollama) Railwail'de ne kadar maliyetlidir?
Railwail üzerinde Llama 3.2 Vision 11B (Ollama) maliyeti ≈ $0,0039 çalıştırma başına. Her istek gerçekten ne kadar kullanırsa o kadar ücretlendirilirsiniz. Kullanım ön ödemeli kredilerden ödenir; 1 kredi $0,01 değerindedir.
Llama 3.2 Vision 11B (Ollama) hangi ayarları destekler?
Giriş şemasına göre Llama 3.2 Vision 11B (Ollama) şu parametreleri bilir: prompt (en fazla 16.000 karakter), image_url, max_tokens (1 ile 4.096 arasında) ve temperature (0 ile 2 arasında).
Llama 3.2 Vision 11B (Ollama) ne kadar hızlıdır?
Railwail'de Llama 3.2 Vision 11B (Ollama) için henüz çalıştırma süresi belirtmek için yeterli ölçülen çalıştırma yoktur. Bu, giriş, ayarlar ve sağlayıcıdaki yüke bağlıdır.
Llama 3.2 Vision 11B (Ollama), BLIP'dan daha iyi midir?
Bu göreve bağlıdır. Llama 3.2 Vision 11B (Ollama) (Community) ve BLIP (Salesforce) her ikisi de Multimodal kategorisinde modellerdir. Karşılaştırma sayfası fiyatlarını ve özelliklerini yan yana gösterir.
Llama 3.2 Vision 11B (Ollama) ve BLIP'ı karşılaştırLlama 3.2 Vision 11B (Ollama) görüntüleri işleyebilir mi?
Evet. Llama 3.2 Vision 11B (Ollama) metne ek olarak giriş olarak görüntüleri kabul eder.
Karşılaştırılabilir modeller
Bu kategorideki tümü- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
≈ $0,0457/çalıştırma
Birim başına 1.072 % daha pahalı
Llama 3.2 Vision 11B (Ollama) ve CLIP Interrogator karşılaştır - Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
≈ $0,0050/çalıştırma
Birim başına 28 % daha pahalı
Llama 3.2 Vision 11B (Ollama) ve Depth Anything v2 karşılaştır
Tüm Modeller Tek Bir API Aracılığıyla
Railwail'deki her model için bir API anahtarı. Kullanım, ön ödemeli kredilerden tahsil edilir, 1 kredi = $0,01.