Qwen 3 235B Instruct

Metin & SohbetMevcut Değil
Alibaba / Qwen tarafındanModel Kimliği: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Durum
Mevcut Değil
Bağlam
131.072 token
Maks. Çıkış
16.384 token
Giriş → Çıkış
Metin → Metin
Geliştirici
Alibaba / Qwen
Güncellendi
25 Haziran 2026

Qwen 3 235B Instruct şu anda kullanılamıyor

Şu anda kullanılamıyor: bu model devre dışı bırakılmıştır.

Bu sayfadaki ayrıntıları yine de okuyabilirsiniz. Hemen karşılaştırılabilir bir modeli çalıştırmak için aşağıdaki mevcut alternatiflerden birini seçin.

Alternatiflere Git
01

Karşılaştırılabilir modeller

Bu kategorideki tümü
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    $12,00/1M giriş

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    $6,00/1M giriş

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    $4,80/1M giriş

02

Playground

Qwen 3 235B Instruct'ı deneyin

Sohbet

Şu anda kullanılamıyor

Şu anda kullanılamıyor: bu model devre dışı bırakılmıştır.

Oyun alanı devre dışıdır. Aynı kategoride karşılaştırılabilir modeller bulabilirsiniz: Alternatifleri görüntüle

Qwen 3 235B Instruct'ı deneyin

Bir mesaj gönderin. Yanıt model işini bitirdikten sonra tamamen gelir (akışsız).

Sistem istemi
Maks. yanıt uzunluğu (token)

Bu çalıştırma

Fiyat yok – şu anda kullanılamıyor.

Yeni misiniz?

Google ile kaydolduğunuzda 5 ücretsiz kredi ($0,05)

Kaydolduktan 24 saat sonra kullanılabilir, günde 5 çalıştırmaya kadar ve çalıştırma başına en fazla 2 kredi. Diğer oturum açma yöntemleri kredi olmadan başlar.

03

Qwen 3 235B Instruct Hakkında

Özet25 Haziran 2026 itibariyle

Qwen 3 235B Instruct, Alibaba / Qwen tarafından Metin & Sohbet kategorisinde geliştirilen bir modeldir. Qwen 3 235B Instruct şu anda Railwail üzerinde kullanılamıyor. Kontekst penceresi 131.072 token içerir ve bir yanıt en fazla 16.384 token uzunluğunda olabilir.

Arka plan

Alibaba Cloud (Qwen team) hakkında

Kuruluş yılı 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Alibaba Cloud (Qwen team) ziyaret edin

Mimari

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Parametreler
235B total, 22B active per token
Bağlam
262.144 token

Yetenekler

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Eğitim ve lisans

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Lisans: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Güvenlik testleri: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Bilinen sınırlamalar

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Fiyatlandırma

Şu anda kullanılamıyor: bu model devre dışı bırakılmıştır. Bu modelin şu anda bir fiyatı yok, bu nedenle çalıştırılamıyor.

05

API

Qwen 3 235B Instruct öğesini Railwail API anahtarınızla çağırın. İstekte bu model kimliğini kullanın:

Şu anda kullanılamıyor

Modelin doğrulanmış bir fiyatı yok veya devre dışı bırakılmıştır; API çağrıları reddedilir.

06

Özellikler

Model Kimliği
qwen-3-235b
Geliştirici
Alibaba / Qwen
Giriş
Metin
Çıkış
Metin
Bağlam penceresi
131.072 token
Maks. çıkış
16.384 token
Model boyutu
235B total, 22B active per token
Lisans
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Katalog girişi güncellendi
25 Haziran 2026

Giriş Parametreleri

Modelin giriş şemasından giriş ve ayarlar. API bölümündeki örnek, API'nin hangilerini kabul ettiğini gösterir.

  • promptgerekli

    User message

    Tür: Metin
    Varsayılan:
    İzin verilen değerler: en fazla 16.000 karakter
  • top_p
    Tür: Sayı
    Varsayılan: 1
    İzin verilen değerler: 0 ile 1 arasında
  • stream
    Tür: Evet/Hayır
    Varsayılan: false
    İzin verilen değerler:
  • max_tokens
    Tür: Tam sayı
    Varsayılan: 2048
    İzin verilen değerler: 1 ile 16.384 arasında
  • temperature
    Tür: Sayı
    Varsayılan: 0.7
    İzin verilen değerler: 0 ile 2 arasında
  • system_prompt

    Optional system instruction

    Tür: Metin
    Varsayılan:
    İzin verilen değerler: en fazla 8.000 karakter

Etiketler

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Kullanım Alanları

Nerelerde Kullanılır

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Sık Sorulan Sorular

Qwen 3 235B Instruct nedir?

Qwen 3 235B Instruct, Alibaba / Qwen tarafından Metin & Sohbet kategorisinde oluşturulan bir modeldir. Railwail'de listelenmiştir ancak şu anda çalıştırılamaz.

Qwen 3 235B Instruct Railwail'de ne kadar maliyetlidir?

Qwen 3 235B Instruct şu anda Railwail'de çalıştırılamaz, bu nedenle mevcut bir fiyat yoktur. Fiyatları olan mevcut alternatifler bu sayfanın aşağısında listelenmiştir.

Qwen 3 235B Instruct'nin kontekst penceresi ne kadardır?

Qwen 3 235B Instruct'nin kontekst penceresi 131.072 token içerir. Bir yanıt en fazla 16.384 token uzunluğunda olabilir.

Qwen 3 235B Instruct ne kadar hızlıdır?

Railwail'de Qwen 3 235B Instruct için henüz çalıştırma süresi belirtmek için yeterli ölçülen çalıştırma yoktur. Bu, giriş, ayarlar ve sağlayıcıdaki yüke bağlıdır.

Qwen 3 235B Instruct, Claude Fable 5.1'dan daha iyi midir?

Bu göreve bağlıdır. Qwen 3 235B Instruct (Alibaba / Qwen) ve Claude Fable 5.1 (Anthropic) her ikisi de Metin & Sohbet kategorisinde modellerdir. Karşılaştırma sayfası fiyatlarını ve özelliklerini yan yana gösterir.

Qwen 3 235B Instruct ve Claude Fable 5.1'ı karşılaştır

Qwen 3 235B Instruct'yi şu anda kullanabilir miyim?

Şu anda kullanılamıyor: bu model devre dışı bırakılmıştır. Sayfa çevrimiçi kalır; aynı kategoriden mevcut alternatifler aşağıda listelenmiştir.

Tüm Modeller Tek Bir API Aracılığıyla

Railwail'deki her model için bir API anahtarı. Kullanım, ön ödemeli kredilerden tahsil edilir, 1 kredi = $0,01.