Qwen 3 235B Instruct

Teksti & chatEi saatavilla
kehittäjä: Alibaba / QwenMallin tunnus: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Tila
Ei saatavilla
Konteksti
131 072 tokenia
Enint. tuloste
16 384 tokenia
Syöte → tulos
Teksti → Teksti
Kehittäjä
Alibaba / Qwen
Päivitetty
25. kesäkuuta 2026

Qwen 3 235B Instruct ei ole tällä hetkellä saatavilla

Ei tällä hetkellä saatavilla: tämä malli on poistettu käytöstä.

Voit silti lukea tiedot tältä sivulta. Valitse yksi alla olevista saatavilla olevista vaihtoehdoista suorittaaksesi vertailukelpoisen mallin heti.

Siirry vaihtoehtoihin
01

Vertailukelpoiset mallit

Kaikki tässä kategoriassa
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 $/1M in

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 $/1M in

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 $/1M in

02

Leikkikenttä

Kokeile Qwen 3 235B Instruct

Chat

Ei tällä hetkellä saatavilla

Ei tällä hetkellä saatavilla: tämä malli on poistettu käytöstä.

Leikkikenttä on poistettu käytöstä. Vertailukelpoisia malleja löydät samasta kategoriasta: Selaa vaihtoehtoja

Kokeile Qwen 3 235B Instruct

Lähetä viesti. Vastaus saapuu kokonaisuudessaan, kun malli on valmis (ei suoratoistoa).

Järjestelmäkehote
Enint. vastausten pituus (tokenit)

Tämä suoritus

Ei hintaa – ei tällä hetkellä saatavilla.

Uusi täällä?

5 ilmaista creditiä (0,05 $) kun rekisteröidyt Googlella

Käytettävissä 24 tuntia rekisteröinnin jälkeen, enintään 5 suoritusta päivässä ja enintään 2 creditiä suoritusta kohti. Muut kirjautumismenetelmät alkavat ilman creditejä.

03

Tietoja: Qwen 3 235B Instruct

Lyhyesti25. kesäkuuta 2026 alkaen

Qwen 3 235B Instruct on Alibaba / Qwen-kehittäjän malli kategoriasta Teksti & chat. Qwen 3 235B Instruct ei ole tällä hetkellä saatavilla Railwailissa. Kontekstiikkuna sisältää 131 072 tokenia, ja vastaus voi olla enintään 16 384 tokenia pitkä.

Tausta

Tietoja: Alibaba Cloud (Qwen team)

Perustettu 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Vieraile sivustolla Alibaba Cloud (Qwen team)

Arkkitehtuuri

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Parametrit
235B total, 22B active per token
Konteksti
262 144 tokenia

Ominaisuudet

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Koulutus ja lisenssi

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Lisenssi: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Turvallisuustestit: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Tunnetut rajoitukset

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Hinnat

Ei tällä hetkellä saatavilla: tämä malli on poistettu käytöstä. Tällä hetkellä tälle mallille ei ole hintaa, joten sitä ei voi suorittaa.

05

API

Kutsu Qwen 3 235B Instruct Railwail-API-avaimellasi. Käytä tätä mallin tunnusta pyynnössä:

Tällä hetkellä ei saatavilla

Mallilla ei ole vahvistettua hintaa tai se on poistettu käytöstä; API-kutsut hylätään.

06

Tekniset tiedot

Mallin tunnus
qwen-3-235b
Kehittäjä
Alibaba / Qwen
Kategoria
Teksti & chat
Syöte
Teksti
Tuloste
Teksti
Konteksti-ikkuna
131 072 tokenia
Enimmäistuloste
16 384 tokenia
Mallin koko
235B total, 22B active per token
Lisenssi
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Luettelokirjaus päivitetty
25. kesäkuuta 2026

Syöteparametrit

Mallin syötökaavion syötteet ja asetukset. API-osion esimerkki näyttää, mitkä niistä API hyväksyy.

  • promptpakollinen

    User message

    Tyyppi: Teksti
    Oletus:
    Sallitut arvot: enintään 16 000 merkkiä
  • top_p
    Tyyppi: Luku
    Oletus: 1
    Sallitut arvot: 0–1
  • stream
    Tyyppi: Kyllä/Ei
    Oletus: false
    Sallitut arvot:
  • max_tokens
    Tyyppi: Kokonaisluku
    Oletus: 2048
    Sallitut arvot: 1–16 384
  • temperature
    Tyyppi: Luku
    Oletus: 0.7
    Sallitut arvot: 0–2
  • system_prompt

    Optional system instruction

    Tyyppi: Teksti
    Oletus:
    Sallitut arvot: enintään 8 000 merkkiä

Tunnisteet

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Käyttötapaukset

Mihin sitä käytetään

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Usein kysytyt kysymykset

Mikä on Qwen 3 235B Instruct?

Qwen 3 235B Instruct on Alibaba / Qwenn kehittämä malli Teksti & chat-kategoriassa. Se on listattu Railwailissa, mutta sitä ei voi tällä hetkellä suorittaa.

Paljonko Qwen 3 235B Instruct maksaa Railwailissa?

Qwen 3 235B Instructta ei voi tällä hetkellä suorittaa Railwailissa, joten nykyistä hintaa ei ole. Saatavilla olevat vaihtoehdot hintojen kanssa on lueteltu tämän sivun alempana.

Mikä on Qwen 3 235B Instructn kontekstiikkuna?

Qwen 3 235B Instructn kontekstiikkuna sisältää 131 072 tokenia. Vastaus voi olla enintään 16 384 tokenia pitkä.

Kuinka nopea Qwen 3 235B Instruct on?

Qwen 3 235B Instructlla ei ole vielä tarpeeksi mitattuja suorituksia Railwailissa suoritusajan ilmoittamiseksi. Se riippuu syötteestä, asetuksista ja palveluntarjoajan kuormituksesta.

Onko Qwen 3 235B Instruct parempi kuin Claude Fable 5.1?

Se riippuu tehtävästä. Qwen 3 235B Instruct (Alibaba / Qwen) ja Claude Fable 5.1 (Anthropic) ovat molemmat malleja Teksti & chat-kategoriassa. Vertailussa näkyvät niiden hinnat ja tekniset tiedot rinnakkain.

Vertaa Qwen 3 235B Instruct ja Claude Fable 5.1

Voiko Qwen 3 235B Instructa käyttää juuri nyt?

Ei tällä hetkellä saatavilla: tämä malli on poistettu käytöstä. Sivu pysyy verkossa; saatavilla olevat vaihtoehdot samasta kategoriasta on lueteltu alempana.

Kaikki mallit yhden API:n kautta

Yksi API-avain kaikille Railwailin malleille. Käyttö laskutetaan prepaid-krediiteistä, 1 krediitti = 0,01 $.