LayoutLMv3

MultimodalΜη διαθέσιμο
από MicrosoftΑναγνωριστικό μοντέλου: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Κατάσταση
Μη διαθέσιμο
Είσοδος → Έξοδος
Κείμενο + Εικόνα → Κείμενο
Προγραμματιστής
Microsoft
Ενημερώθηκε
25 Ιουνίου 2026

Το LayoutLMv3 δεν είναι διαθέσιμο αυτή τη στιγμή

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις
01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $/εκτέλεση

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 $/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 $/1M in

02

Playground

Δοκιμάστε LayoutLMv3

Χωρίς φόρμα εισόδου

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

03

Σχετικά με το LayoutLMv3

ΣύντομαΗμερομηνία: 25 Ιουνίου 2026

Το LayoutLMv3 είναι ένα μοντέλο του Microsoft στην κατηγορία Multimodal. Το LayoutLMv3 δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή.

04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το LayoutLMv3 με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Κανένα επαληθευμένο παράδειγμα API

Το δημόσιο API περνά μια διαφορετική μορφή εισόδου από αυτή που χρειάζεται αυτό το μοντέλο. Χρησιμοποιήστε το playground παραπάνω.

06

Προδιαγραφές

ID μοντέλου
layoutlmv3
Ανάπτυξη
Microsoft
Κατηγορία
Multimodal
Είσοδος
Κείμενο, Εικόνα
Έξοδος
Κείμενο
Καταχώρηση καταλόγου ενημερώθηκε
25 Ιουνίου 2026

Ετικέτες

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Συχνές ερωτήσεις

Τι είναι LayoutLMv3;

Το LayoutLMv3 είναι ένα μοντέλο του Microsoft στην κατηγορία Multimodal. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το LayoutLMv3 στο Railwail;

Το LayoutLMv3 δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Πόσο γρήγορο είναι το LayoutLMv3;

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του LayoutLMv3 στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το LayoutLMv3 καλύτερο από το BLIP;

Αυτό εξαρτάται από την εργασία. Το LayoutLMv3 (Microsoft) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση LayoutLMv3 και BLIP

Μπορεί το LayoutLMv3 να επεξεργαστεί εικόνες;

Ναι. Το LayoutLMv3 δέχεται εικόνες ως είσοδο εκτός από κείμενο.

Μπορώ να χρησιμοποιήσω το LayoutLMv3 τώρα;

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.