PaddleOCR v3

MultimodalTilgĂŚngelig
af CommunityModell-ID: paddleocr-v3

Baidu PaddleOCR v3 PP-OCR pipeline. Lightweight detector plus recognizer optimized for production use with 80+ language support.

Pris
≈ 0,0216 US$/kørsel
Input → output
Tekst + Billede → Tekst
Udvikler
Community
Opdateret
23. september 2026
01

Playground

Prøv PaddleOCR v3

Ingen inputmaske

≈ 0,0216 US$/kørsel

Ingen inputmaske til denne model endnu

Dens inputs er endnu ikke dokumenteret. For at ingen kørsel mislykkes pü grund af forkert input tilbyder vi ikke en formular her. VÌlg i stedet en sammenlignelig model.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    No text prompt: the model only takes the input shown.

    Output (JSON, shortened)

    {
      "results": [
        {
          "box": [
            [
              161,
              669
            ],
            [
              418,
              669
            ],
            [
              418,
              732
            ],
            [
              161,
              732
            ]
          ],
          "text": "柔软舒适的",
          "confidence": 0.9974066019058228
        }
      ]
    }
  • InputInput

    No text prompt: the model only takes the input shown.

    Output (JSON, shortened)

    {
      "results": [
        {
          "box": [
            [
              285,
              947
            ],
            [
              1155,
              948
            ],
            [
              1155,
              1000
            ],
            [
              285,
              999
            ]
          ],
          "text": "苟皇帝要在三天后对你家满门抄斩",
          "confidence": 0.9324864745140076
        }
      ]
    }
03

Om PaddleOCR v3

Kort sagtFra 23. september 2026

PaddleOCR v3 er en model af Community i kategorien Multimodal. På Railwail koster PaddleOCR v3 ≈ 0,0216 US$ pr. kørsel.

04

Priser

Priser i US-dollar. Forbrug debiteres fra forudbetalte credits.
Typisk kørsel (≈ 80 s på T4)0,0216 US$ pr. kørsel
GPU-tid (T4)0,00027 US$ pr. GPU-sekund
  • Faktureres efter den GPU-tid, som kørslen faktisk tager. NĂĽr kørslen starter, reserveres 3× den typiske pris fra din saldo og afregnes efterfølgende.
  • 1 kredit = 0,01 US$

Omkostningsberegner

Prisberegner

s

Typisk ifølge udbyderen: ca. 80 s

I alt

2,16 US$

216 credits

Pr. kørsel

0,0216 US$ ¡ 2,16 credits

Fakturering efter faktisk GPU-tid; dette er et estimat.

05

API

Kald PaddleOCR v3 med din Railwail API-nøgle. Brug dette model-ID i anmodningen:

Intet bekrĂŚftet API-eksempel

Den offentlige API sender et andet inputformat end det, som denne model har brug for. Brug playground ovenfor.

06

Specifikationer

Model-ID
paddleocr-v3
Udvikler
Community
Kategori
Multimodal
Input
Tekst, Billede
Output
Tekst
Fakturering
Efter forbrug (tokens eller GPU-tid)
Katalogelement opdateret
23. september 2026

Tags

  • replicate
  • ocr
  • vision-understanding
  • baidu
  • open-source
  • multilingual
07

Ofte stillede spørgsmül

Hvad er PaddleOCR v3?

PaddleOCR v3 er en model fra Community i kategorien Multimodal.

Hvad koster PaddleOCR v3 pĂĽ Railwail?

På Railwail koster PaddleOCR v3 ≈ 0,0216 US$ pr. kørsel. Du betaler for det, som hver anmodning faktisk bruger. Forbrug betales fra forudbetalte credits; 1 credit svarer til 0,01 US$.

Hvor hurtig er PaddleOCR v3?

Der er endnu ikke nok mülte kørsler af PaddleOCR v3 pü Railwail til at angive en udførelsestid. Det afhÌnger af inputtet, indstillingerne og belastningen hos provideren.

Er PaddleOCR v3 bedre end BLIP?

Det afhĂŚnger af opgaven. PaddleOCR v3 (Community) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser deres priser og specifikationer side om side.

Sammenlign PaddleOCR v3 og BLIP

Kan PaddleOCR v3 behandle billeder?

Ja. PaddleOCR v3 accepterer billeder som input ud over tekst.

08

Sammenlignelige modeller

Alle i denne kategori
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 US$/kørsel

    99 % billigere pr. enhed

    Sammenlign PaddleOCR v3 og BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 US$/kørsel

    112 % dyrere pr. enhed

    Sammenlign PaddleOCR v3 og CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 US$/kørsel

    77 % billigere pr. enhed

    Sammenlign PaddleOCR v3 og Depth Anything v2

Alle modeller via ĂŠn API

En API-nøgle til alle modeller pü Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.