Qwen 3 235B Instruct

Tekst og chatIkke tilgjengelig
av Alibaba / QwenModell-ID: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Status
Ikke tilgjengelig
Kontekst
131 072 tokens
Maks. utdata
16 384 tokens
Input → output
Tekst → Tekst
Utvikler
Alibaba / Qwen
Oppdatert
25. juni 2026

Qwen 3 235B Instruct er for øyeblikket utilgjengelig

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer
01

Sammenlignbare modeller

Alle i denne kategorien
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 USD/1M inn

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 USD/1M inn

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 USD/1M inn

02

Playground

Prøv Qwen 3 235B Instruct

Chat

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

Prøv Qwen 3 235B Instruct

Send en melding. Svaret kommer fullstendig når modellen er ferdig (ingen streaming).

Systemprompt
Maks. svarslengde (tokens)

Denne kjøringen

Ingen pris – ikke tilgjengelig for øyeblikket.

Ny her?

5 gratis credits (0,05 USD) når du registrerer deg med Google

Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits.

03

Om Qwen 3 235B Instruct

Kort sagtPer 25. juni 2026

Qwen 3 235B Instruct er en modell fra Alibaba / Qwen i kategorien Tekst og chat. Qwen 3 235B Instruct er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 131 072 tokens, og ett svar kan være opptil 16 384 tokens langt.

Bakgrunn

Om Alibaba Cloud (Qwen team)

Grunnlagt 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Besøk Alibaba Cloud (Qwen team)

Arkitektur

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Parametere
235B total, 22B active per token
Kontekst
262 144 tokens

Evner

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Trening og lisens

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Lisens: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Sikkerhetstesting: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Kjente begrensninger

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Priser

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

05

API

Ring Qwen 3 235B Instruct med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:

Ikke tilgjengelig for øyeblikket

Modellen har ingen verifisert pris eller er deaktivert; API-kall blir avvist.

06

Spesifikasjoner

Modell-ID
qwen-3-235b
Utvikler
Alibaba / Qwen
Inndata
Tekst
Utdata
Tekst
Kontekstvindu
131 072 tokens
Maks. utdata
16 384 tokens
Modellstørrelse
235B total, 22B active per token
Lisens
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Katalogoppføring oppdatert
25. juni 2026

Inndataparametere

Inndataer og innstillinger fra modellens inndataskjema. Eksemplet i API-delen viser hvilke av dem APIen godtar.

  • promptobligatorisk

    User message

    Type: Tekst
    Standard:
    Tillatte verdier: opptil 16 000 tegn
  • top_p
    Type: Tall
    Standard: 1
    Tillatte verdier: 0 til 1
  • stream
    Type: Ja/Nei
    Standard: false
    Tillatte verdier:
  • max_tokens
    Type: Heltall
    Standard: 2048
    Tillatte verdier: 1 til 16 384
  • temperature
    Type: Tall
    Standard: 0.7
    Tillatte verdier: 0 til 2
  • system_prompt

    Optional system instruction

    Type: Tekst
    Standard:
    Tillatte verdier: opptil 8 000 tegn

Merkelapper

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Brukstilfeller

Hva det brukes til

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Ofte stilte spørsmål

Hva er Qwen 3 235B Instruct?

Qwen 3 235B Instruct er en modell fra Alibaba / Qwen i kategorien Tekst og chat. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster Qwen 3 235B Instruct på Railwail?

Qwen 3 235B Instruct kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvor stort er kontekstvinduet til Qwen 3 235B Instruct?

Kontekstvinduet til Qwen 3 235B Instruct inneholder 131 072 tokens. Ett svar kan være opptil 16 384 tokens langt.

Hvor rask er Qwen 3 235B Instruct?

Det finnes ennå ikke nok målte kjøringer av Qwen 3 235B Instruct på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er Qwen 3 235B Instruct bedre enn Claude Fable 5.1?

Det avhenger av oppgaven. Qwen 3 235B Instruct (Alibaba / Qwen) og Claude Fable 5.1 (Anthropic) er begge modeller i kategorien Tekst og chat. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign Qwen 3 235B Instruct og Claude Fable 5.1

Kan jeg bruke Qwen 3 235B Instruct akkurat nå?

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.