Llama 3.2 Vision 11B (Ollama)
llama-3-2-vision-11b-ollamaMeta Llama 3.2 11B Vision served via Ollama on Replicate. Open-weights multimodal model for image captioning, document and chart reading, and visual question answering.
- Hinta
- ≈ 0,0039 $/suoritus
- Syöte → tulos
- Teksti + Kuva → Teksti
- Kehittäjä
- Community
- Päivitetty
- 23. syyskuuta 2026
Leikkikenttä
Kokeile Llama 3.2 Vision 11B (Ollama)
Syöte ja tulos
Tämä suoritus
noin 0,0039 $ · 0,39 creditiä
Alussa varataan 0,0116 $ (1,16 creditiä); todellinen GPU-aika laskutetaan.
Uusi täällä?
10 ilmaista creditiä (0,10 $) kun rekisteröidyt Googlella
Käytettävissä 24 tuntia rekisteröinnin jälkeen, enintään 5 suoritusta päivässä ja enintään 2 creditiä suoritusta kohti. Muut kirjautumismenetelmät alkavat ilman creditejä. Riittää 8 suoritukseen tästä mallista.
Examples
InputPrompt
Where to find this monument? Can you give me other recommendations around the area?
Response
**Wat Phra Kaew (Temple of the Emerald Buddha)** in Bangkok, Thailand. Located within the Grand Palace complex, Wat Phra Kaew is a highly revered and sacred site that houses the iconic Emerald Buddha image. The temple's design incorporates traditional Thai architecture with intricate details and ornate decorations, featuring an imposing spire topped by a golden finial adorned with images of mythical creatures. **Recommendations for Your Visit:** * **Grand Palace**: Explore the sprawling palace grounds, which include several other notable temples and buildings. * **Wat Arun (Temple of Dawn)**: A nearby temple famous for its distinctive spire covered in colorful ceramics and glints of gold. * **Chao Phraya River Cruise**: Take a boat ride along the river to admire the city's skyline and learn about its history. * **Jim Thompson House Museum**: Visit this museum dedicated to Thai art and culture, featuring traditional architecture and beautiful gardens. Wat Phra Kaew is an absolute must-visit attraction when in Bangkok. With these recommendations, you'll have a well-rounded experience of the city's rich cultural heritage.
InputPrompt
How long does it take from invoice date to due date? Be short and concise.
Response
From the invoice date of 11/02/2019 to the due date of 26/02/2019, there is a difference of **15 days**. This calculation was performed by subtracting the invoice date from the due date: 26/02/2019 - 11/02/2019 = 15
InputPrompt
What happens when you take out white cat from this chain?
Response
The white cat is not present in the food web. The correct term for a wild animal would be "wildcat." If we were to remove a wildcat from the ecosystem, it would no longer be able to hunt or prey on other animals. This could have cascading effects throughout the entire ecosystem. *Answer*: Wildcat will lose its source of food and nutrients
Tietoja: Llama 3.2 Vision 11B (Ollama)
Llama 3.2 Vision 11B (Ollama) on Community-kehittäjän malli kategoriasta Multimodaali. Railwailissa Llama 3.2 Vision 11B (Ollama) maksaa ≈ 0,0039 $ per suoritus.
Hinnat
| Tyypillinen suoritus (≈ 3 s L40S:lla) | 0,0039 $ per suoritus |
|---|---|
| GPU-aika (L40S) | 0,00117 $ per GPU-sekunti |
- Laskutus perustuu suorituksen todelliseen GPU-aikaan. Kun suoritus alkaa, 3-kertainen tyypillinen hinta varataan saldostasi ja selvitetään jälkikäteen.
- 1 krediitti = 0,01 $
Kustannuslaskin
Hintalaskin
Palveluntarjoajan mukaan tyypillinen: noin 3,3 s
Yhteensä
0,39 $
39 krediittiä
Suoritusta kohti
0,0039 $ · 0,39 krediittiä
Laskutus perustuu todelliseen GPU-aikaan; tämä on arvio.
API
Ei vahvistettua API-esimerkkiä
Julkinen API välittää eri syötemuotoa kuin tämä malli tarvitsee. Käytä yllä olevaa leikkikenttää.
Tekniset tiedot
- Mallin tunnus
llama-3-2-vision-11b-ollama- Kehittäjä
- Community
- Kategoria
- Multimodaali
- Syöte
- Teksti, Kuva
- Tuloste
- Teksti
- Laskutus
- Käytön mukaan (tokeneja tai GPU-aikaa)
- Luettelokirjaus päivitetty
- 23. syyskuuta 2026
Syöteparametrit
Mallin syötökaavion syötteet ja asetukset. API-osion esimerkki näyttää, mitkä niistä API hyväksyy.
promptpakollinenQuestion about the image
Tyyppi: TekstiOletus: –Sallitut arvot: enintään 16 000 merkkiäimage_urlImage URL to analyze
Tyyppi: TekstiOletus: –Sallitut arvot: –max_tokensTyyppi: KokonaislukuOletus:1024Sallitut arvot: 1–4 096temperatureTyyppi: LukuOletus:0.7Sallitut arvot: 0–2
Tunnisteet
- replicate
- meta
- llama
- vision-understanding
- open-weights
- ollama
Usein kysytyt kysymykset
Mikä on Llama 3.2 Vision 11B (Ollama)?
Llama 3.2 Vision 11B (Ollama) on Communityn kehittämä malli Multimodaali-kategoriassa.
Paljonko Llama 3.2 Vision 11B (Ollama) maksaa Railwailissa?
Railwailissa Llama 3.2 Vision 11B (Ollama) maksaa ≈ 0,0039 $ per suoritus. Sinua veloitetaan siitä, mitä kukin pyyntö todella käyttää. Käyttö maksetaan ennakkoon ostettujen krediittien avulla; 1 krediitti vastaa 0,01 $.
Mitä asetuksia Llama 3.2 Vision 11B (Ollama) tukee?
Syötteen rakenteen mukaan Llama 3.2 Vision 11B (Ollama) tuntee nämä parametrit: prompt (enintään 16 000 merkkiä), image_url, max_tokens (1–4 096) ja temperature (0–2).
Kuinka nopea Llama 3.2 Vision 11B (Ollama) on?
Llama 3.2 Vision 11B (Ollama)lla ei ole vielä tarpeeksi mitattuja suorituksia Railwailissa suoritusajan ilmoittamiseksi. Se riippuu syötteestä, asetuksista ja palveluntarjoajan kuormituksesta.
Onko Llama 3.2 Vision 11B (Ollama) parempi kuin BLIP?
Se riippuu tehtävästä. Llama 3.2 Vision 11B (Ollama) (Community) ja BLIP (Salesforce) ovat molemmat malleja Multimodaali-kategoriassa. Vertailussa näkyvät niiden hinnat ja tekniset tiedot rinnakkain.
Vertaa Llama 3.2 Vision 11B (Ollama) ja BLIPVoiko Llama 3.2 Vision 11B (Ollama) käsitellä kuvia?
Kyllä. Llama 3.2 Vision 11B (Ollama) hyväksyy kuvia syötteenä tekstin lisäksi.
Vertailukelpoiset mallit
Kaikki tässä kategoriassa- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
≈ 0,0457 $/suoritus
1 072 % kalliimpi yksikköä kohti
Vertaa Llama 3.2 Vision 11B (Ollama) ja CLIP Interrogator - Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
≈ 0,0050 $/suoritus
28 % kalliimpi yksikköä kohti
Vertaa Llama 3.2 Vision 11B (Ollama) ja Depth Anything v2
Kaikki mallit yhden API:n kautta
Yksi API-avain kaikille Railwailin malleille. Käyttö laskutetaan prepaid-krediiteistä, 1 krediitti = 0,01 $.