Qwen 3 235B Instruct

Texto e chatIndisponível
por Alibaba / QwenID do modelo: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Status
Indisponível
Contexto
131.072 tokens
Saída máxima
16.384 tokens
Entrada → Saída
Texto → Texto
Desenvolvedor
Alibaba / Qwen
Atualizado
25 de junho de 2026

Qwen 3 235B Instruct não está disponível no momento

Atualmente indisponível: este modelo foi desativado.

Você ainda pode ler os detalhes nesta página. Escolha uma das alternativas disponíveis abaixo para executar um modelo comparável imediatamente.

Ir para alternativas
01

Modelos comparáveis

Todos nesta categoria
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    US$ 12,00/1M entrada

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    US$ 6,00/1M entrada

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    US$ 4,80/1M entrada

02

Playground

Experimentar Qwen 3 235B Instruct

Chat

Indisponível no momento

Atualmente indisponível: este modelo foi desativado.

O playground está desativado. Encontre modelos comparáveis na mesma categoria: Ver alternativas

Experimentar Qwen 3 235B Instruct

Envie uma mensagem. A resposta chega completa assim que o modelo termina (sem streaming).

Prompt do sistema
Comprimento máximo da resposta (tokens)

Esta execução

Sem preço – indisponível no momento.

Novo por aqui?

5 créditos grátis (US$ 0,05) ao se inscrever com Google

Utilizável 24 horas após inscrição, até 5 execuções por dia e no máximo 2 créditos por execução. Outros métodos de login começam sem créditos.

03

Sobre Qwen 3 235B Instruct

ResumoA partir de 25 de junho de 2026

Qwen 3 235B Instruct é um modelo de Alibaba / Qwen na categoria Texto e chat. Qwen 3 235B Instruct não está disponível no Railwail no momento. A janela de contexto contém 131.072 tokens, e uma resposta pode ter até 16.384 tokens.

Fundo

Sobre Alibaba Cloud (Qwen team)

Fundado em 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Visite Alibaba Cloud (Qwen team)

Arquitetura

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Parâmetros
235B total, 22B active per token
Contexto
262.144 tokens

Capacidades

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Treinamento & licença

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Licença: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Testes de segurança: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Limitações conhecidas

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Preços

Atualmente indisponível: este modelo foi desativado. Não há preço para este modelo no momento, portanto não pode ser executado.

05

API

Chame Qwen 3 235B Instruct com sua chave de API Railwail. Use este ID de modelo na solicitação:

Indisponível no momento

O modelo não tem preço verificado ou está desativado; chamadas de API são recusadas.

06

Especificações

ID do modelo
qwen-3-235b
Desenvolvedor
Alibaba / Qwen
Categoria
Texto e chat
Entrada
Texto
Saída
Texto
Janela de contexto
131.072 tokens
Saída máx.
16.384 tokens
Tamanho do modelo
235B total, 22B active per token
Licença
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Entrada do catálogo atualizada
25 de junho de 2026

Parâmetros de entrada

Entradas e configurações do esquema de entrada do modelo. O exemplo na seção API mostra quais delas a API aceita.

  • promptobrigatório

    User message

    Tipo: Texto
    Padrão:
    Valores permitidos: até 16.000 caracteres
  • top_p
    Tipo: Número
    Padrão: 1
    Valores permitidos: 0 a 1
  • stream
    Tipo: Sim/Não
    Padrão: false
    Valores permitidos:
  • max_tokens
    Tipo: Número inteiro
    Padrão: 2048
    Valores permitidos: 1 a 16.384
  • temperature
    Tipo: Número
    Padrão: 0.7
    Valores permitidos: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Texto
    Padrão:
    Valores permitidos: até 8.000 caracteres

Etiquetas

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Casos de uso

Para que é utilizado

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Perguntas frequentes

O que é Qwen 3 235B Instruct?

Qwen 3 235B Instruct é um modelo de Alibaba / Qwen na categoria Texto e chat. Está listado no Railwail, mas não pode ser executado no momento.

Quanto custa Qwen 3 235B Instruct no Railwail?

Qwen 3 235B Instruct não pode ser executado no Railwail no momento, portanto não há preço atual. Alternativas disponíveis com preços estão listadas mais abaixo nesta página.

Qual é a janela de contexto de Qwen 3 235B Instruct?

A janela de contexto de Qwen 3 235B Instruct contém 131.072 tokens. Uma resposta pode ter até 16.384 tokens.

Qual é a velocidade de Qwen 3 235B Instruct?

Ainda não há execuções medidas suficientes de Qwen 3 235B Instruct no Railwail para indicar um tempo de execução. Depende da entrada, das configurações e da carga no provedor.

Qwen 3 235B Instruct é melhor que Claude Fable 5.1?

Depende da tarefa. Qwen 3 235B Instruct (Alibaba / Qwen) e Claude Fable 5.1 (Anthropic) são ambos modelos na categoria Texto e chat. A página de comparação mostra seus preços e especificações lado a lado.

Comparar Qwen 3 235B Instruct e Claude Fable 5.1

Posso usar Qwen 3 235B Instruct agora?

Atualmente indisponível: este modelo foi desativado. A página permanece online; alternativas disponíveis da mesma categoria estão listadas mais abaixo.

Todos os modelos através de uma API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.