Qwen 3 235B Instruct

Szöveg és csevegésNem elérhető
Alibaba / Qwen általModell-azonosító: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Állapot
Nem elérhető
Kontextus
131 072 token
Max. kimenet
16 384 token
Bemenet → kimenet
Szöveg → Szöveg
Fejlesztő
Alibaba / Qwen
Frissítve
2026. június 25.

Qwen 3 235B Instruct jelenleg nem elérhető

Jelenleg nem elérhető: ezt a modellt deaktiválták.

Az oldal részleteit továbbra is elolvashatja. Az alábbi elérhető alternatívák közül válasszon egy hasonló modell azonnali futtatásához.

Ugrás az alternatívákhoz
01
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 USD/1M be

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 USD/1M be

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 USD/1M be

02

Playground

Próbáld ki: Qwen 3 235B Instruct

Csevegés

Jelenleg nem elérhető

Jelenleg nem elérhető: ezt a modellt deaktiválták.

A játszótér letiltva van. Hasonló modelleket találsz ugyanabban a kategóriában: Alternatívák megtekintése

Próbáld ki: Qwen 3 235B Instruct

Írjon üzenetet. A válasz teljes egészében megérkezik, amikor a modell kész (nincs streaming).

Rendszer-prompt
Max. válaszlength (tokenek)

Ez a futtatás

Nincs ár – jelenleg nem elérhető.

Új vagy itt?

5 ingyenes kredit (0,05 USD) Google-fiókkal való regisztrációkor

Használható 24 órával a regisztráció után, naponta legfeljebb 5 futtatás és futtatásonként legfeljebb 2 kredit. Más bejelentkezési módok kreditek nélkül indulnak.

03

A Qwen 3 235B Instruct névjegye

Röviden2026. június 25. szerint

A Qwen 3 235B Instruct a Alibaba / Qwen által fejlesztett modell a Szöveg és csevegés kategóriában. A Qwen 3 235B Instruct jelenleg nem érhető el a Railwail-en. A kontextablak 131 072 tokent tartalmaz, egy válasz pedig legfeljebb 16 384 token hosszú lehet.

Háttér

A Alibaba Cloud (Qwen team) névjegye

Alapítva: 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Alibaba Cloud (Qwen team) meglátogatása

Architektúra

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Paraméterek
235B total, 22B active per token
Kontextus
262 144 token

Képességek

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Képzés és licenc

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Licenc: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Biztonsági tesztelés: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Ismert korlátozások

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Árak

Jelenleg nem elérhető: ezt a modellt deaktiválták. Jelenleg nincs ár ehhez a modellhez, ezért nem futtatható.

05

API

Hívja meg a Qwen 3 235B Instruct modellt a Railwail API-kulcsával. Használja ezt a modell-azonosítót a kérésben:

Jelenleg nem elérhető

A modellnek nincs ellenőrzött ára vagy deaktiválva van; az API-hívások visszautasítottak.

06

Specifikációk

Modell-azonosító
qwen-3-235b
Fejlesztő
Alibaba / Qwen
Bemenet
Szöveg
Kimenet
Szöveg
Kontextusablak
131 072 token
Max. kimenet
16 384 token
Modell mérete
235B total, 22B active per token
Licenc
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Katalógus bejegyzés frissítve
2026. június 25.

Bemeneti paraméterek

A modell bemeneti sémájából származó bemenetek és beállítások. Az API szakaszban szereplő példa mutatja, hogy az API melyiket fogadja el.

  • promptkötelező

    User message

    Típus: Szöveg
    Alapértelmezett:
    Engedélyezett értékek: legfeljebb 16 000 karakter
  • top_p
    Típus: Szám
    Alapértelmezett: 1
    Engedélyezett értékek: 0 és 1 között
  • stream
    Típus: Igen/nem
    Alapértelmezett: false
    Engedélyezett értékek:
  • max_tokens
    Típus: Egész szám
    Alapértelmezett: 2048
    Engedélyezett értékek: 1 és 16 384 között
  • temperature
    Típus: Szám
    Alapértelmezett: 0.7
    Engedélyezett értékek: 0 és 2 között
  • system_prompt

    Optional system instruction

    Típus: Szöveg
    Alapértelmezett:
    Engedélyezett értékek: legfeljebb 8000 karakter

Címkék

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Felhasználási esetek

Mire használják

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Gyakran ismételt kérdések

Mi az a Qwen 3 235B Instruct?

A Qwen 3 235B Instruct a Alibaba / Qwen által fejlesztett modell a Szöveg és csevegés kategóriában. A Railwail katalógusában szerepel, de jelenleg nem futtatható.

Mennyibe kerül a Qwen 3 235B Instruct a Railwail-on?

A Qwen 3 235B Instruct jelenleg nem futtatható a Railwail-on, ezért nincs aktuális ár. Az elérhető alternatívák árakkal az oldal alább találhatók.

Mekkora a Qwen 3 235B Instruct kontextablaka?

A Qwen 3 235B Instruct kontextablaka 131 072 tokent tartalmaz. Egy válasz legfeljebb 16 384 token hosszú lehet.

Milyen gyors a Qwen 3 235B Instruct?

A Qwen 3 235B Instruct-nek még nincs elég mért futtatása a Railwail-on ahhoz, hogy futási időt adjunk meg. Ez a bemenettől, a beállításoktól és a szolgáltató terhelésétől függ.

A Qwen 3 235B Instruct jobb, mint a Claude Fable 5.1?

Ez a feladattól függ. A Qwen 3 235B Instruct (Alibaba / Qwen) és a Claude Fable 5.1 (Anthropic) egyaránt modellek a Szöveg és csevegés kategóriában. Az összehasonlítás oldal az árakat és specifikációkat egymás mellett mutatja.

Qwen 3 235B Instruct és Claude Fable 5.1 összehasonlítása

Használhatom a Qwen 3 235B Instruct-t most?

Jelenleg nem elérhető: ezt a modellt deaktiválták. Az oldal online marad; az ugyanabból a kategóriából elérhető alternatívák az oldal alább találhatók.

Összes modell egy API-n keresztül

Egy API-kulcs a Railwail összes modelljéhez. A használat előre feltöltött kreditek alapján kerül felszámításra, 1 kredit = 0,01 USD.