Microsoft Phi-3.5 MoE Instruct

Κείμενο & συνομιλίαΜη διαθέσιμο
από MicrosoftΑναγνωριστικό μοντέλου: phi-3-5-moe-instruct

Mixture-of-experts Phi-3.5: 42B total / 6.6B active params. 128k context, multilingual.

Κατάσταση
Μη διαθέσιμο
Περιεχόμενο
131,072 tokens
Μέγ. έξοδος
4,096 tokens
Είσοδος → Έξοδος
Κείμενο → Κείμενο
Προγραμματιστής
Microsoft
Ενημερώθηκε
25 Ιουνίου 2026

Το Microsoft Phi-3.5 MoE Instruct δεν είναι διαθέσιμο αυτή τη στιγμή

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις
01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 $/1M in

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 $/1M in

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 $/1M in

02

Playground

Δοκιμάστε Microsoft Phi-3.5 MoE Instruct

Συνομιλία

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

Δοκιμάστε Microsoft Phi-3.5 MoE Instruct

Στείλτε ένα μήνυμα. Η απάντηση φτάνει πλήρης όταν το μοντέλο τελειώσει (χωρίς streaming).

System prompt
Μέγ. μήκος απάντησης (tokens)

Αυτή η εκτέλεση

Χωρίς τιμή – προς το παρόν μη διαθέσιμο.

Νέος εδώ;

5 δωρεάν πιστωτικές μονάδες (0,05 $) όταν εγγραφείς με Google

Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.

03

Σχετικά με το Microsoft Phi-3.5 MoE Instruct

ΣύντομαΗμερομηνία: 25 Ιουνίου 2026

Το Microsoft Phi-3.5 MoE Instruct είναι ένα μοντέλο του Microsoft στην κατηγορία Κείμενο & συνομιλία. Το Microsoft Phi-3.5 MoE Instruct δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 131,072 tokens, και μια απάντηση μπορεί να είναι έως 4,096 tokens.

Φόντο

Σχετικά με Microsoft Research

Ιδρύθηκε 1991 · Redmond, Washington, USA

Microsoft Research's Machine Learning Foundations group — led by Sébastien Bubeck and Ronen Eldan — drove the Phi series of small-but-capable language models. The Phi thesis is that synthetic 'textbook-quality' training data can produce small models that punch far above their weight on reasoning benchmarks. The series began with Phi-1 (1.3B, code, 2023), Phi-1.5 (general reasoning, 2023), Phi-2 (2.7B, 2023), Phi-3 (Mini, Small, Medium dense models, April 2024) and Phi-3.5 (Mini, Vision, MoE, August 2024). Phi-3.5 MoE was Microsoft's first Mixture-of-Experts Phi variant — 16 experts of 3.8B parameters each with top-2 routing. Microsoft Research itself was founded in 1991 and remains one of the largest industrial AI research organisations in the world; Phi is one of its flagship open-weights AI projects.

Επισκεφθείτε Microsoft Research

Αρχιτεκτονική

Mixture-of-Experts Decoder Transformer

Phi-3.5 MoE Instruct is a 16x3.8B Mixture-of-Experts decoder transformer — 16 experts each approximately the size of Phi-3-Mini, with top-2 routing yielding 6.6B active parameters out of 41.9B total. The architecture uses 32 layers, 4,096 hidden size, 32-head grouped-query attention with 8 KV heads, RoPE positional embeddings (theta=10000, extended for 128K context), SwiGLU activations, and a 32,064-token Llama-derived BPE tokeniser. Routing uses a sparse mixer with auxiliary loss for expert balancing. The model was pretrained on 4.9 trillion tokens of heavily curated data, with the Phi recipe emphasising synthetic 'textbook-quality' data generated from larger models — explicitly oversampling reasoning-dense content over breadth. Training used 512 H100 GPUs for 23 days. Post-training is supervised fine-tuning plus Direct Preference Optimisation (DPO) with explicit safety post-training. Released August 2024 under MIT license.

Παράμετροι
41.9B total, 6.6B active per token (16 experts of ~3.8B each, top-2 routing)
Περιεχόμενο
131,072 tokens

Δυνατότητες

  • 16-expert MoE — Microsoft's first MoE Phi variant
  • Only 6.6B active parameters — cheap inference for MoE
  • Punches above weight: matches Mixtral 8x7B (12.9B active) and Llama 3.1 8B on many benchmarks
  • Strong math and reasoning for active-param size (MMLU 78.9, GSM8K 88.7)
  • 128K context window
  • Multilingual support for 22 languages
  • Open weights under permissive MIT license
  • Best for: cost-efficient reasoning, on-device inference (INT4 ~12GB), education and tutoring applications.

Εκπαίδευση & άδεια

Pretrained on 4.9 trillion tokens. The mix is heavily curated and includes filtered web data, synthetic 'textbook-quality' data generated from larger models, code, math and 22-language multilingual sources. Knowledge cutoff October 2023. Training used 512 NVIDIA H100 GPUs for 23 days. Post-training is supervised fine-tuning plus DPO with explicit safety post-training and red-team feedback.

Άδεια: MIT License for the open weights. Commercial use, redistribution and modification permitted without restriction — one of the most permissive licenses among major open-weight LLMs.

Δοκιμές ασφάλειας: Microsoft published a model card and Phi-3 technical report with red-team and safety evaluation. Post-training incorporates safety alignment via DPO on red-team feedback.

Γνωστοί περιορισμοί

  • Total memory ~42B parameters needs ~80GB FP16 — heavier than 6.6B active suggests
  • MoE routing means latency spikes on imbalanced batches
  • Knowledge breadth narrower than larger dense models — Phi trades breadth for reasoning
  • Behind frontier models on coding benchmarks despite strong math
  • Synthetic-data-heavy training can produce 'textbook-like' answers that don't match real-world tone
  • No vision modality (use Phi-3.5-Vision instead)
04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το Microsoft Phi-3.5 MoE Instruct με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Προς το παρόν μη διαθέσιμο

Το μοντέλο δεν έχει επαληθευμένη τιμή ή είναι απενεργοποιημένο· οι κλήσεις API απορρίπτονται.

06

Προδιαγραφές

ID μοντέλου
phi-3-5-moe-instruct
Ανάπτυξη
Microsoft
Είσοδος
Κείμενο
Έξοδος
Κείμενο
Παράθυρο περιεχομένου
131,072 tokens
Μέγ. έξοδος
4,096 tokens
Μέγεθος μοντέλου
41.9B total, 6.6B active per token (16 experts of ~3.8B each, top-2 routing)
Άδεια
MIT License for the open weights. Commercial use, redistribution and modification permitted without restriction — one of the most permissive licenses among major open-weight LLMs.
Καταχώρηση καταλόγου ενημερώθηκε
25 Ιουνίου 2026

Ετικέτες

  • microsoft
  • open-weights
  • moe
  • multilingual
  • pricing-tbd
07

Περιπτώσεις χρήσης

Για τι χρησιμοποιείται

  • Cost-efficient reasoning at MoE-cheap inference
  • On-device / edge AI (INT4 quantisation ~12GB)
  • Multilingual structured tasks across 22 languages
  • Education and tutoring applications
  • Math and code reasoning in resource-constrained settings
  • Self-hosted small-business assistants
08

Συχνές ερωτήσεις

Τι είναι Microsoft Phi-3.5 MoE Instruct;

Το Microsoft Phi-3.5 MoE Instruct είναι ένα μοντέλο του Microsoft στην κατηγορία Κείμενο & συνομιλία. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το Microsoft Phi-3.5 MoE Instruct στο Railwail;

Το Microsoft Phi-3.5 MoE Instruct δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Ποιο είναι το παράθυρο περιεχομένου του Microsoft Phi-3.5 MoE Instruct;

Το παράθυρο περιεχομένου του Microsoft Phi-3.5 MoE Instruct περιέχει 131,072 tokens. Μια απάντηση μπορεί να είναι έως 4,096 tokens.

Πόσο γρήγορο είναι το Microsoft Phi-3.5 MoE Instruct;

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Microsoft Phi-3.5 MoE Instruct στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το Microsoft Phi-3.5 MoE Instruct καλύτερο από το Claude Fable 5.1;

Αυτό εξαρτάται από την εργασία. Το Microsoft Phi-3.5 MoE Instruct (Microsoft) και το Claude Fable 5.1 (Anthropic) είναι και τα δύο μοντέλα στην κατηγορία Κείμενο & συνομιλία. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση Microsoft Phi-3.5 MoE Instruct και Claude Fable 5.1

Μπορώ να χρησιμοποιήσω το Microsoft Phi-3.5 MoE Instruct τώρα;

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.