Dots OCR

MultimodalTilgængelig
af CommunityModell-ID: dots-ocr

Rednote Hilab Dots OCR. End-to-end document parsing model with layout, text and reading-order prediction in one transformer.

Pris
≈ 0,0132 US$/kørsel
Input → output
Tekst + Billede → Tekst
Udvikler
Community
Opdateret
23. september 2026
01

Playground

Prøv Dots OCR

Ingen inputmaske

≈ 0,0132 US$/kørsel

Ingen inputmaske til denne model endnu

Dens inputs er endnu ikke dokumenteret. For at ingen kørsel mislykkes på grund af forkert input tilbyder vi ikke en formular her. Vælg i stedet en sammenlignelig model.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    Prompt

    grounding_ocr

    Response

    [{"bbox": [448, 513, 528, 535], "category": "Section-header", "text": "### Directions"}, {"bbox": [448, 533, 824, 565], "category": "Text", "text": "For sunscreen use: • apply generously 15 minutes before sun exposure • reapply: • after 80 minutes of swimming or sweating • immediately after towel drying • at least every 2 hours"}, {"bbox": [448, 563, 832, 624], "category": "List-item", "text": "• **Sun Protection Measures.** Spending time in the sun increases your risk of skin cancer and early skin aging. To decrease this risk, regularly use a sunscreen with a Broad Spectrum SPF value of 15 or higher and other sun protection measures including: • limit time in the sun, especially from 10 a.m. - 2 p.m. • wear long-sleeved shirts, pants, hats and sunglasses"}, {"bbox": [448, 622, 640, 638], "category": "List-item", "text": "• children under 6 months of age: Ask a doctor"}]

03

Om Dots OCR

Kort sagtFra 23. september 2026

Dots OCR er en model af Community i kategorien Multimodal. På Railwail koster Dots OCR ≈ 0,0132 US$ pr. kørsel.

04

Priser

Priser i US-dollar. Forbrug debiteres fra forudbetalte credits.
Typisk kørsel (≈ 11 s på L40S)0,0132 US$ pr. kørsel
GPU-tid (L40S)0,00117 US$ pr. GPU-sekund
  • Faktureres efter den GPU-tid, som kørslen faktisk tager. NÃ¥r kørslen starter, reserveres 3× den typiske pris fra din saldo og afregnes efterfølgende.
  • 1 kredit = 0,01 US$

Omkostningsberegner

Prisberegner

s

Typisk ifølge udbyderen: ca. 11,3 s

I alt

1,32 US$

132 credits

Pr. kørsel

0,0132 US$ · 1,32 credits

Fakturering efter faktisk GPU-tid; dette er et estimat.

05

API

Kald Dots OCR med din Railwail API-nøgle. Brug dette model-ID i anmodningen:

Intet bekræftet API-eksempel

Den offentlige API sender et andet inputformat end det, som denne model har brug for. Brug playground ovenfor.

06

Specifikationer

Model-ID
dots-ocr
Udvikler
Community
Kategori
Multimodal
Input
Tekst, Billede
Output
Tekst
Fakturering
Efter forbrug (tokens eller GPU-tid)
Katalogelement opdateret
23. september 2026

Tags

  • replicate
  • ocr
  • vision-understanding
  • open-source
07

Ofte stillede spørgsmål

Hvad er Dots OCR?

Dots OCR er en model fra Community i kategorien Multimodal.

Hvad koster Dots OCR på Railwail?

På Railwail koster Dots OCR ≈ 0,0132 US$ pr. kørsel. Du betaler for det, som hver anmodning faktisk bruger. Forbrug betales fra forudbetalte credits; 1 credit svarer til 0,01 US$.

Hvor hurtig er Dots OCR?

Der er endnu ikke nok målte kørsler af Dots OCR på Railwail til at angive en udførelsestid. Det afhænger af inputtet, indstillingerne og belastningen hos provideren.

Er Dots OCR bedre end BLIP?

Det afhænger af opgaven. Dots OCR (Community) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser deres priser og specifikationer side om side.

Sammenlign Dots OCR og BLIP

Kan Dots OCR behandle billeder?

Ja. Dots OCR accepterer billeder som input ud over tekst.

08

Sammenlignelige modeller

Alle i denne kategori
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 US$/kørsel

    98 % billigere pr. enhed

    Sammenlign Dots OCR og BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 US$/kørsel

    246 % dyrere pr. enhed

    Sammenlign Dots OCR og CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 US$/kørsel

    62 % billigere pr. enhed

    Sammenlign Dots OCR og Depth Anything v2

Alle modeller via én API

En API-nøgle til alle modeller på Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.