Qwen 3 235B Instruct

Текст і чатНедоступно
від Alibaba / QwenID моделі: qwen-3-235b

Alibaba's Qwen 3 flagship MoE: 235B total / 22B active. Strong reasoning and tool use, open-weights.

Статус
Недоступно
Контекст
131,072 токенів
Макс. вихід
16,384 токенів
Вхід → вихід
Текст → Текст
Розробник
Alibaba / Qwen
Оновлено
25 червня 2026 р.

Qwen 3 235B Instruct наразі недоступна

Наразі недоступно: цю модель деактивовано.

Ви можете прочитати деталі на цій сторінці. Виберіть одну з доступних альтернатив нижче, щоб одразу запустити порівняну модель.

До альтернатив
01

Порівнювані моделі

Усі в цій категорії
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 USD/1M вх

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 USD/1M вх

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 USD/1M вх

02

Playground

Спробувати Qwen 3 235B Instruct

Чат

Наразі недоступна

Наразі недоступно: цю модель деактивовано.

Playground вимкнено. Порівняльні моделі ви знайдете в тій же категорії: Переглянути альтернативи

Спробувати Qwen 3 235B Instruct

Надішліть повідомлення. Відповідь надійде повністю, коли модель завершить роботу (без потокової передачі).

Системний промпт
Макс. довжина відповіді (токени)

Цей запуск

Без ціни – наразі недоступно.

Новенький?

5 безплатних кредитів (0,05 USD) при реєстрації через Google

Доступно 24 годин після реєстрації, до 5 запусків на день і максимум 2 кредитів за запуск. Інші способи входу стартують без кредитів.

03

Про Qwen 3 235B Instruct

КороткоСтаном на 25 червня 2026 р.

Qwen 3 235B Instruct — це модель від Alibaba / Qwen у категорії Текст і чат. На Railwail Qwen 3 235B Instruct наразі недоступна. Контекстне вікно містить 131,072 токенів, а одна відповідь може бути довжиною до 16,384 токенів.

Фон

Про Alibaba Cloud (Qwen team)

Засновано 2009 · Hangzhou, China

The Qwen team inside Alibaba Cloud has shipped one of the most prolific open-weight model lines in industry, starting with Qwen-7B (Aug 2023, first Chinese open-weight foundation model from a hyperscaler), through Qwen 1.5 (Feb 2024), Qwen2 (Jun 2024), Qwen2.5 (Sep 2024, sizes 0.5B-72B plus Coder/Math/VL), Qwen2.5-Max closed-weight flagship (Jan 2025) and the Qwen3 family in April-May 2025. Qwen3 introduced a uniform 'hybrid thinking' approach across the family, letting developers toggle between fast direct answers and long chain-of-thought reasoning in the same checkpoint. The 235B-A22B MoE flagship anchors the family alongside dense variants from 0.6B to 32B. The team is led by Junyang Lin and has published over a dozen technical reports. Models ship under the Apache 2.0 license starting with Qwen3, a substantial liberalisation over the earlier Tongyi Qianwen LICENSE. Alibaba Cloud, founded in 2009, is the largest cloud provider in China and hosts the Qwen models on its Model Studio service while also distributing weights freely on HuggingFace, ModelScope and GitHub.

Відвідати Alibaba Cloud (Qwen team)

Архітектура

Sparse Mixture-of-Experts Transformer (hybrid thinking)

Qwen3-235B-A22B is the flagship Mixture-of-Experts model of the Qwen3 family, released by Alibaba's Qwen team on 29 April 2025 with weights under Apache 2.0. The architecture is a Sparse MoE Transformer with 235 billion total parameters and 22 billion active per token (128 experts, 8 selected per token), 94 layers, and Grouped Query Attention (64 query heads / 4 KV heads). It supports a 128K native context window extended to 256K via YaRN scaling. The model was pretrained on approximately 36 trillion tokens spanning 119 languages with strong Chinese, English and code coverage, more than doubling the 18T-token corpus used for Qwen2.5. Pretraining was performed in three stages with progressively longer context lengths and improved data filtering. Post-training applied a four-stage pipeline: long-CoT cold start, RL on reasoning tasks, integration of thinking and non-thinking modes via mixed SFT, and a final general-purpose RL stage. The resulting model exposes hybrid thinking, toggled via the chat template, where the same checkpoint can produce either an R1-style chain-of-thought before the answer or a fast direct response. Qwen3-235B leads several open-weight benchmarks including AIME 2025, LiveCodeBench, ArenaHard and BFCL agent-eval as of release.

Параметри
235B total, 22B active per token
Контекст
262,144 токенів

Можливості

  • 235B-parameter MoE with 22B active per token (128 experts, 8 selected)
  • Hybrid thinking mode toggle (CoT or direct answer in one checkpoint)
  • Pretrained on ~36T tokens across 119 languages
  • 256K context window with YaRN scaling
  • Apache 2.0 license, fully commercial
  • Top open-weight scores on AIME 2025, LiveCodeBench, ArenaHard, BFCL
  • Function calling, MCP server support, parallel tool calls
  • Specialised siblings: Qwen3-Coder, Qwen3-Math, Qwen3-VL
  • Compatible with vLLM, SGLang, llama.cpp, Ollama, MLX, HuggingFace
  • Broad multilingual coverage with strong Chinese/English/Japanese/Korean performance
  • Best for: open-weight reasoning, agentic workloads, multilingual chat, on-prem enterprise.

Навчання та ліцензія

Pretrained on approximately 36 trillion tokens covering 119 languages with strong Chinese and English emphasis, code repositories and scientific content. Post-training uses a four-stage pipeline: long-CoT cold start, reasoning RL, mixed SFT integrating thinking/non-thinking modes, and a final general-purpose RL stage.

Ліцензія: Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).

Тестування безпеки: Standard SFT+DPO safety alignment plus general RL safety stage. Filters Chinese politically sensitive topics. Limited third-party safety evaluations published.

Відомі обмеження

  • Filters Chinese political topics
  • Large memory footprint requires multi-GPU inference for FP16
  • Vision requires separate Qwen3-VL checkpoint
  • Knowledge cutoff approximately early 2025
  • Long context >128K degrades on some recall tasks
04

Ціни

Наразі недоступно: цю модель деактивовано. Наразі для цієї моделі немає ціни, тому її не можна запустити.

05

API

Викличте Qwen 3 235B Instruct за допомогою вашого API-ключа Railwail. Використовуйте цей ID моделі в запиті:

Наразі недоступно

Модель не має перевіреної ціни або деактивована; виклики API відхиляються.

06

Характеристики

ID моделі
qwen-3-235b
Розробник
Alibaba / Qwen
Категорія
Текст і чат
Вхідні дані
Текст
Вихідні дані
Текст
Контекстне вікно
131,072 токенів
Макс. вихідні дані
16,384 токенів
Розмір моделі
235B total, 22B active per token
Ліцензія
Apache 2.0. Open weights, fully commercial use permitted including for >100M MAU products (a notable liberalisation versus the earlier Tongyi Qianwen LICENSE).
Запис у каталозі оновлено
25 червня 2026 р.

Вхідні параметри

Вхідні дані та налаштування зі схеми вхідних даних моделі. Приклад у розділі API показує, які з них приймає API.

  • promptобов'язково

    User message

    Тип: Текст
    За замовчуванням:
    Допустимі значення: до 16,000 символів
  • top_p
    Тип: Число
    За замовчуванням: 1
    Допустимі значення: 0 до 1
  • stream
    Тип: Так/Ні
    За замовчуванням: false
    Допустимі значення:
  • max_tokens
    Тип: Ціле число
    За замовчуванням: 2048
    Допустимі значення: 1 до 16,384
  • temperature
    Тип: Число
    За замовчуванням: 0.7
    Допустимі значення: 0 до 2
  • system_prompt

    Optional system instruction

    Тип: Текст
    За замовчуванням:
    Допустимі значення: до 8,000 символів

Теги

  • qwen
  • alibaba
  • moe
  • open-weights
  • flagship
07

Варіанти використання

Для чого це використовується

  • Open-weight reasoning workloads
  • Agentic tool-using applications
  • Multilingual chat across 100+ languages
  • On-prem enterprise deployments
  • Fine-tuning base for vertical models
  • Apache-2.0-required commercial products
08

Часті питання

Що таке Qwen 3 235B Instruct?

Qwen 3 235B Instruct — це модель від Alibaba / Qwen у категорії Текст і чат. Вона внесена до каталогу Railwail, але наразі не може бути запущена.

Скільки коштує Qwen 3 235B Instruct на Railwail?

Qwen 3 235B Instruct наразі не можна запустити на Railwail, тому поточної ціни немає. Доступні альтернативи з цінами наведені далі на цій сторінці.

Яке контекстне вікно у Qwen 3 235B Instruct?

Контекстне вікно Qwen 3 235B Instruct містить 131,072 токенів. Одна відповідь може бути довжиною до 16,384 токенів.

Наскільки швидкий Qwen 3 235B Instruct?

На Railwail поки що недостатньо виміряних запусків Qwen 3 235B Instruct, щоб вказати час виконання. Це залежить від введення, налаштувань та навантаження у постачальника.

Чи Qwen 3 235B Instruct краще за Claude Fable 5.1?

Це залежить від завдання. Qwen 3 235B Instruct (Alibaba / Qwen) і Claude Fable 5.1 (Anthropic) — обидві моделі в категорії Текст і чат. На сторінці порівняння показані їхні ціни та специфікації поруч.

Порівняти Qwen 3 235B Instruct і Claude Fable 5.1

Чи можу я використовувати Qwen 3 235B Instruct прямо зараз?

Наразі недоступно: цю модель деактивовано. Сторінка залишається в мережі; доступні альтернативи з тієї ж категорії наведені далі.

Усі моделі через один API

Один API-ключ для всіх моделей на Railwail. Використання оплачується з попередньо поповнених кредитів, 1 кредит = 0,01 USD.