Qwen 3 235B Instruct

Κείμενο & συνομιλίαΜη διαθέσιμο
από Alibaba / QwenΑναγνωριστικό μοντέλου: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Κατάσταση
Μη διαθέσιμο
Περιεχόμενο
131,072 tokens
Μέγ. έξοδος
16,384 tokens
Είσοδος → Έξοδος
Κείμενο → Κείμενο
Προγραμματιστής
Alibaba / Qwen
Ενημερώθηκε
25 Ιουνίου 2026

Το Qwen 3 235B Instruct δεν είναι διαθέσιμο αυτή τη στιγμή

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις
01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 $/1M in

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 $/1M in

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 $/1M in

02

Playground

Δοκιμάστε Qwen 3 235B Instruct

Συνομιλία

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

Δοκιμάστε Qwen 3 235B Instruct

Στείλτε ένα μήνυμα. Η απάντηση φτάνει πλήρης όταν το μοντέλο τελειώσει (χωρίς streaming).

System prompt
Μέγ. μήκος απάντησης (tokens)

Αυτή η εκτέλεση

Χωρίς τιμή – προς το παρόν μη διαθέσιμο.

Νέος εδώ;

5 δωρεάν πιστωτικές μονάδες (0,05 $) όταν εγγραφείς με Google

Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.

03

Σχετικά με το Qwen 3 235B Instruct

ΣύντομαΗμερομηνία: 25 Ιουνίου 2026

Το Qwen 3 235B Instruct είναι ένα μοντέλο του Alibaba / Qwen στην κατηγορία Κείμενο & συνομιλία. Το Qwen 3 235B Instruct δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 131,072 tokens, και μια απάντηση μπορεί να είναι έως 16,384 tokens.

Φόντο

Σχετικά με Alibaba Cloud (Qwen team)

Ιδρύθηκε 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Επισκεφθείτε Alibaba Cloud (Qwen team)

Αρχιτεκτονική

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Παράμετροι
235B total, 22B active per token
Περιεχόμενο
262,144 tokens

Δυνατότητες

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Εκπαίδευση & άδεια

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Άδεια: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Δοκιμές ασφάλειας: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Γνωστοί περιορισμοί

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το Qwen 3 235B Instruct με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Προς το παρόν μη διαθέσιμο

Το μοντέλο δεν έχει επαληθευμένη τιμή ή είναι απενεργοποιημένο· οι κλήσεις API απορρίπτονται.

06

Προδιαγραφές

ID μοντέλου
qwen-3-235b
Ανάπτυξη
Alibaba / Qwen
Είσοδος
Κείμενο
Έξοδος
Κείμενο
Παράθυρο περιεχομένου
131,072 tokens
Μέγ. έξοδος
16,384 tokens
Μέγεθος μοντέλου
235B total, 22B active per token
Άδεια
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Καταχώρηση καταλόγου ενημερώθηκε
25 Ιουνίου 2026

Παράμετροι εισόδου

Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.

  • promptΥποχρεωτικό

    User message

    Τύπος: Κείμενο
    Προεπιλογή:
    Επιτρεπόμενες τιμές: Έως 16,000 χαρακτήρες
  • top_p
    Τύπος: Αριθμός
    Προεπιλογή: 1
    Επιτρεπόμενες τιμές: 0 έως 1
  • stream
    Τύπος: Ναι/Όχι
    Προεπιλογή: false
    Επιτρεπόμενες τιμές:
  • max_tokens
    Τύπος: Ακέραιος αριθμός
    Προεπιλογή: 2048
    Επιτρεπόμενες τιμές: 1 έως 16,384
  • temperature
    Τύπος: Αριθμός
    Προεπιλογή: 0.7
    Επιτρεπόμενες τιμές: 0 έως 2
  • system_prompt

    Optional system instruction

    Τύπος: Κείμενο
    Προεπιλογή:
    Επιτρεπόμενες τιμές: Έως 8,000 χαρακτήρες

Ετικέτες

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Περιπτώσεις χρήσης

Για τι χρησιμοποιείται

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Συχνές ερωτήσεις

Τι είναι Qwen 3 235B Instruct;

Το Qwen 3 235B Instruct είναι ένα μοντέλο του Alibaba / Qwen στην κατηγορία Κείμενο & συνομιλία. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το Qwen 3 235B Instruct στο Railwail;

Το Qwen 3 235B Instruct δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Ποιο είναι το παράθυρο περιεχομένου του Qwen 3 235B Instruct;

Το παράθυρο περιεχομένου του Qwen 3 235B Instruct περιέχει 131,072 tokens. Μια απάντηση μπορεί να είναι έως 16,384 tokens.

Πόσο γρήγορο είναι το Qwen 3 235B Instruct;

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Qwen 3 235B Instruct στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το Qwen 3 235B Instruct καλύτερο από το Claude Fable 5.1;

Αυτό εξαρτάται από την εργασία. Το Qwen 3 235B Instruct (Alibaba / Qwen) και το Claude Fable 5.1 (Anthropic) είναι και τα δύο μοντέλα στην κατηγορία Κείμενο & συνομιλία. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση Qwen 3 235B Instruct και Claude Fable 5.1

Μπορώ να χρησιμοποιήσω το Qwen 3 235B Instruct τώρα;

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.