Dots OCR

MultimodalDisponible
par CommunityID du modèle: dots-ocr

Rednote Hilab Dots OCR. End-to-end document parsing model with layout, text and reading-order prediction in one transformer.

Prix
≈ 0,0132 $US/exécution
Entrée → Sortie
Texte + Image → Texte
Développeur
Community
Mis à jour
23 septembre 2026
01

Playground

Essayer Dots OCR

Pas de formulaire d'entrée

≈ 0,0132 $US/exécution

Aucun formulaire d'entrée pour ce modèle pour le moment

Ses entrées ne sont pas encore documentées. Pour éviter qu'une exécution échoue sur une entrée incorrecte, nous ne proposons pas de formulaire ici. Choisissez plutôt un modèle comparable.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    Prompt

    grounding_ocr

    Response

    [{"bbox": [448, 513, 528, 535], "category": "Section-header", "text": "### Directions"}, {"bbox": [448, 533, 824, 565], "category": "Text", "text": "For sunscreen use: • apply generously 15 minutes before sun exposure • reapply: • after 80 minutes of swimming or sweating • immediately after towel drying • at least every 2 hours"}, {"bbox": [448, 563, 832, 624], "category": "List-item", "text": "• **Sun Protection Measures.** Spending time in the sun increases your risk of skin cancer and early skin aging. To decrease this risk, regularly use a sunscreen with a Broad Spectrum SPF value of 15 or higher and other sun protection measures including: • limit time in the sun, especially from 10 a.m. - 2 p.m. • wear long-sleeved shirts, pants, hats and sunglasses"}, {"bbox": [448, 622, 640, 638], "category": "List-item", "text": "• children under 6 months of age: Ask a doctor"}]

03

À propos de Dots OCR

RésuméAu 23 septembre 2026

Dots OCR est un modèle de Community dans la catégorie Multimodal. Sur Railwail, Dots OCR coûte ≈ 0,0132 $US par exécution.

04

Tarification

Prix en dollars américains. L'utilisation est facturée à partir de crédits prépayés.
Exécution typique (≈ 11 s sur L40S)0,0132 $US par exécution
Temps GPU (L40S)0,00117 $US par seconde GPU
  • Facturée selon le temps GPU que l'exécution prend réellement. Au démarrage, 3× le prix typique est réservé de votre solde et régularisé ensuite.
  • 1 crédit = 0,01 $US

Calculateur de coûts

Calculatrice de prix

s

Typique selon le fournisseur : environ 11,3 s

Total

1,32 $US

132 crédits

Par exécution

0,0132 $US · 1,32 crédits

Facturé selon le temps GPU réel ; il s'agit d'une estimation.

05

API

Appelez Dots OCR avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modèle
dots-ocr
Développeur
Community
Catégorie
Multimodal
Entrée
Texte, Image
Sortie
Texte
Facturation
À l'usage (tokens ou temps GPU)
Entrée du catalogue mise à jour
23 septembre 2026

Étiquettes

  • replicate
  • ocr
  • vision-understanding
  • open-source
07

Questions fréquemment posées

Qu'est-ce que Dots OCR ?

Dots OCR est un modèle de Community dans la catégorie Multimodal.

Combien coûte Dots OCR sur Railwail ?

Sur Railwail, Dots OCR coûte ≈ 0,0132 $US par exécution. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quelle est la vitesse de Dots OCR ?

Il n'y a pas encore assez d'exécutions mesurées de Dots OCR sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

Dots OCR est-il meilleur que BLIP ?

Cela dépend de la tâche. Dots OCR (Community) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer Dots OCR et BLIP

Dots OCR peut-il traiter des images ?

Oui. Dots OCR accepte les images en entrée en plus du texte.

08

Modèles comparables

Tous dans cette catégorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $US/exécution

    98 % moins cher par unité

    Comparer Dots OCR et BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 $US/exécution

    246 % plus cher par unité

    Comparer Dots OCR et CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 $US/exécution

    62 % moins cher par unité

    Comparer Dots OCR et Depth Anything v2

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.