Qwen 3 235B Instruct

Text & chattInte tillgÀnglig
av Alibaba / QwenModell-ID: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Status
Inte tillgÀnglig
Kontext
131 072 tokens
Max. utdata
16 384 tokens
Inmatning → utmatning
Text → Text
Utvecklare
Alibaba / Qwen
Uppdaterad
25 juni 2026

Qwen 3 235B Instruct Àr för nÀrvarande otillgÀnglig

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.

Du kan fortfarande lÀsa detaljerna pÄ denna sida. VÀlj ett av de tillgÀngliga alternativen nedan för att köra en jÀmförbar modell direkt.

GĂ„ till alternativ
01

JÀmförbara modeller

Alla i denna kategori
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 US$/1M in

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 US$/1M in

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 US$/1M in

02

Playground

Prova Qwen 3 235B Instruct

Chatt

Inte tillgÀnglig för nÀrvarande

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.

Lekplatsen Àr inaktiverad. Du hittar jÀmförbara modeller i samma kategori: Visa alternativ

Prova Qwen 3 235B Instruct

Skicka ett meddelande. Svaret kommer i sin helhet nÀr modellen Àr klar (ingen streaming).

Systemprompt
Max. svarslÀngd (tokens)

Denna körning

Inget pris – för nĂ€rvarande otillgĂ€ngligt.

Ny hÀr?

5 gratis credits (0,05 US$) nÀr du registrerar dig med Google

AnvÀndbar 24 timmar efter registrering, upp till 5 körningar per dag och högst 2 credits per körning. Andra inloggningsmetoder startar utan credits.

03

Om Qwen 3 235B Instruct

Kort sagtFrÄn och med 25 juni 2026

Qwen 3 235B Instruct Àr en modell av Alibaba / Qwen i kategorin Text & chatt. Qwen 3 235B Instruct Àr för nÀrvarande inte tillgÀnglig pÄ Railwail. Kontextfönstret innehÄller 131 072 tokens, och ett svar kan vara upp till 16 384 tokens lÄngt.

Bakgrund

Om Alibaba Cloud (Qwen team)

Grundat 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Besök Alibaba Cloud (Qwen team)

Arkitektur

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Parameter
235B total, 22B active per token
Kontext
262 144 tokens

Funktioner

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

TrÀning & licens

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Licens: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

SĂ€kerhetstestning: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

KÀnda begrÀnsningar

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Priser

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Det finns ingen pris för denna modell för nÀrvarande, sÄ den kan inte köras.

05

API

Anropa Qwen 3 235B Instruct med din Railwail API-nyckel. AnvÀnd detta modell-ID i begÀran:

För nÀrvarande otillgÀnglig

Modellen har inget verifierat pris eller Àr inaktiverad; API-anrop avvisas.

06

Specifikationer

Modell-ID
qwen-3-235b
Utvecklare
Alibaba / Qwen
Kategori
Text & chatt
Inmatning
Text
Utmatning
Text
Kontextfönster
131 072 tokens
Max. utmatning
16 384 tokens
Modellstorlek
235B total, 22B active per token
Licens
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
KataloginlÀgg uppdaterat
25 juni 2026

Indataparametrar

Inmatningar och instÀllningar frÄn modellens indataschema. Exemplet i API-avsnittet visar vilka som API:et accepterar.

  • promptobligatorisk

    User message

    Typ: Text
    Standard: –
    TillÄtna vÀrden: upp till 16 000 tecken
  • top_p
    Typ: Tal
    Standard: 1
    TillÄtna vÀrden: 0 till 1
  • stream
    Typ: Ja/Nej
    Standard: false
    TillĂ„tna vĂ€rden: –
  • max_tokens
    Typ: Heltal
    Standard: 2048
    TillÄtna vÀrden: 1 till 16 384
  • temperature
    Typ: Tal
    Standard: 0.7
    TillÄtna vÀrden: 0 till 2
  • system_prompt

    Optional system instruction

    Typ: Text
    Standard: –
    TillÄtna vÀrden: upp till 8 000 tecken

Taggar

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

AnvÀndningsfall

Vad det anvÀnds till

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Vanliga frÄgor

Vad Àr Qwen 3 235B Instruct?

Qwen 3 235B Instruct Àr en modell av Alibaba / Qwen i kategorin Text & chatt. Den finns i Railwail-katalogen men kan inte köras för nÀrvarande.

Vad kostar Qwen 3 235B Instruct pÄ Railwail?

Qwen 3 235B Instruct kan inte köras pÄ Railwail för nÀrvarande, sÄ det finns inget aktuellt pris. TillgÀngliga alternativ med priser visas lÀngre ned pÄ denna sida.

Hur stort Àr kontextfönstret för Qwen 3 235B Instruct?

Kontextfönstret för Qwen 3 235B Instruct innehÄller 131 072 tokens. Ett svar kan vara upp till 16 384 tokens lÄngt.

Hur snabb Àr Qwen 3 235B Instruct?

Det finns Ànnu inte tillrÀckligt mÄnga uppmÀtta körningar av Qwen 3 235B Instruct pÄ Railwail för att ange en körningstid. Det beror pÄ inmatningen, instÀllningarna och belastningen hos leverantören.

Är Qwen 3 235B Instruct bĂ€ttre Ă€n Claude Fable 5.1?

Det beror pÄ uppgiften. Qwen 3 235B Instruct (Alibaba / Qwen) och Claude Fable 5.1 (Anthropic) Àr bÄda modeller i kategorin Text & chatt. JÀmförelsesidan visar deras priser och specifikationer sida vid sida.

JÀmför Qwen 3 235B Instruct och Claude Fable 5.1

Kan jag anvÀnda Qwen 3 235B Instruct just nu?

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Sidan förblir online; tillgÀngliga alternativ frÄn samma kategori visas lÀngre ned.

Alla modeller via ett API

En API-nyckel för alla modeller pÄ Railwail. AnvÀndningen debiteras frÄn förbetald kredit, 1 kredit = 0,01 US$.