Nous Hermes 3 405B

Texte et chatNon disponible
par Together AIID du modèle: hermes-3-405b

Full-parameter fine-tune of Llama 3.1 405B by Nous Research. Steerable, uncensored, strong tool use.

Statut
Non disponible
Contexte
131.072 tokens
Max. sortie
4.096 tokens
Entrée → Sortie
Texte → Texte
Développeur
Together AI
Mis à jour
25 juin 2026

Nous Hermes 3 405B n'est actuellement pas disponible

Actuellement indisponible : ce modèle a été désactivé.

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives
01

Modèles comparables

Tous dans cette catégorie
  • Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    12,00 $US/1M entrée

  • The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.

    6,00 $US/1M entrée

  • Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.

    4,80 $US/1M entrée

02

Playground

Essayer Nous Hermes 3 405B

Chat

Actuellement indisponible

Actuellement indisponible : ce modèle a été désactivé.

Le playground est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

Essayer Nous Hermes 3 405B

Envoyez un message. La réponse arrive complète une fois que le modèle a terminé (sans streaming).

Prompt système
Longueur max. de la réponse (tokens)

Cette exécution

Pas de prix – actuellement indisponible.

Nouveau par ici ?

5 crédits gratuits (0,05 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

03

À propos de Nous Hermes 3 405B

RésuméAu 25 juin 2026

Nous Hermes 3 405B est un modèle de Together AI dans la catégorie Texte et chat. Nous Hermes 3 405B n'est actuellement pas disponible sur Railwail. La fenêtre de contexte contient 131.072 tokens, et une réponse peut faire jusqu'à 4.096 tokens.

Arrière-plan

À propos de Nous Research

Fondée 2023 · San Francisco, USA (distributed)

Nous Research is a community-driven open-source AI collective founded in 2023, co-led by Karan 'Teknium' Malhotra, Jeffrey Quesnelle, Bowen Peng and others, with a distributed contributor base of independent researchers. Nous focuses on uncensored, steerable, character-rich fine-tunes of open base models — its Hermes line (Hermes, OpenHermes, Hermes 2, Hermes 2.5, Hermes 3) is the flagship instruction-following family, with Yarn (context-length extension) and Capybara as influential adjacent projects. Hermes 3 405B was released August 2024 in partnership with Lambda Labs (compute) and was the first full-parameter fine-tune of Meta's Llama 3.1 405B base model. Nous raised seed funding from Distributed Global and a16z-affiliated angels in 2024.

Visiter Nous Research

Architecture

Decoder-only Transformer (Llama 3.1 architecture)

Hermes 3 405B is a full-parameter supervised fine-tune (not LoRA) of Meta's Llama 3.1 405B base model. The architecture is unchanged from Llama 3.1: 126 layers, 16,384 hidden size, 128-head grouped-query attention with 8 KV heads, RoPE positional embeddings with the Llama 3 scaling that supports 128K context, SwiGLU activations and the 128,000-token Llama 3 BPE tokeniser. The fine-tune was carried out by Nous Research on approximately 256 NVIDIA H100 GPUs supplied by Lambda Labs, using a curated dataset of around 390M instruction tokens (~2.5M examples) covering role-play, function calling, code, math, RAG, agentic tool use and uncensored creative writing — much of it Nous-curated synthetic from larger models. The model uses a ChatML-style format with native `<tool_call>` JSON-schema tags and `<scratchpad>` chain-of-thought tags. Released August 2024 under the Llama 3.1 Community License.

Paramètres
405B (dense)
Contexte
128.000 tokens

Capacités

  • Full-parameter fine-tune of Llama 3.1 405B (not LoRA)
  • Strong system-prompt steering for persona and rule-set instructions
  • Native ChatML `<tool_call>` JSON-schema tags and `<scratchpad>` reasoning tags
  • 128K context inherited from Llama 3.1
  • Reduced RLHF-style refusals — friendlier for research and creative writing
  • Competitive benchmark scores with Llama 3.1 405B Instruct (MMLU, GPQA, math)
  • Open weights under Llama 3.1 Community License
  • Best for: customisable agents, role-play platforms, function-calling assistants, self-hosted Llama 3.1 alternatives.

Formation & licence

Supervised fine-tuning on ~390M instruction tokens across ~2.5M examples covering role-play, function calling, code, math, RAG, agent traces and creative writing. Large fraction is Nous-curated synthetic data distilled from larger models. The full Hermes 3 dataset card is published alongside the model. No RLHF / no DPO in the 405B variant. Base model knowledge cutoff December 2023.

Licence: Llama 3.1 Community License. Commercial use permitted, but services with >700M monthly active users require a separate Meta license. Meta's Acceptable Use Policy applies to all derivatives.

Tests de sécurité: Nous explicitly trades RLHF-style safety guardrails for steerability and creative latitude. Operators deploying for consumer products are expected to add their own safety layer. No formal third-party red-team report.

Limitations connues

  • Reduced safety guardrails versus Meta's Llama 3.1 405B Instruct
  • Requires ~810GB GPU memory at FP16 (~200GB at INT4) — expensive to self-host
  • No vision modality
  • Slower than smaller open instructs for low-latency chatbot use
  • Llama 3.1 license excludes services with >700M MAU without separate Meta license
  • Knowledge cutoff inherited from Llama 3.1 (December 2023)
04

Tarification

Actuellement indisponible : ce modèle a été désactivé. Il n'y a actuellement pas de prix pour ce modèle, il ne peut donc pas être exécuté.

05

API

Appelez Nous Hermes 3 405B avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Actuellement indisponible

Le modèle n'a pas de prix vérifié ou est désactivé ; les appels API sont refusés.

06

Spécifications

ID du modèle
hermes-3-405b
Développeur
Together AI
Catégorie
Texte et chat
Entrée
Texte
Sortie
Texte
Fenêtre de contexte
131.072 tokens
Sortie max.
4.096 tokens
Taille du modèle
405B (dense)
Licence
Llama 3.1 Community License. Commercial use permitted, but services with >700M monthly active users require a separate Meta license. Meta's Acceptable Use Policy applies to all derivatives.
Entrée du catalogue mise à jour
25 juin 2026

Étiquettes

  • nous
  • open-weights
  • tools
  • roleplay
  • pricing-tbd
07

Cas d'usage

À quoi ça sert

  • Customisable AI agents with persona steering
  • Role-play and interactive narrative platforms
  • Function-calling agents with ChatML tool tags
  • Creative writing and fiction generation
  • Self-hosted alternative to Llama 3.1 405B Instruct
  • Research on instruction-tuning recipes at frontier scale
08

Questions fréquemment posées

Qu'est-ce que Nous Hermes 3 405B ?

Nous Hermes 3 405B est un modèle de Together AI dans la catégorie Texte et chat. Il est listé sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte Nous Hermes 3 405B sur Railwail ?

Nous Hermes 3 405B ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quelle est la fenêtre de contexte de Nous Hermes 3 405B ?

La fenêtre de contexte de Nous Hermes 3 405B contient 131.072 tokens. Une réponse peut faire jusqu'à 4.096 tokens.

Quelle est la vitesse de Nous Hermes 3 405B ?

Il n'y a pas encore assez d'exécutions mesurées de Nous Hermes 3 405B sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

Nous Hermes 3 405B est-il meilleur que Claude Fable 5.1 ?

Cela dépend de la tâche. Nous Hermes 3 405B (Together AI) et Claude Fable 5.1 (Anthropic) sont tous deux des modèles de la catégorie Texte et chat. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer Nous Hermes 3 405B et Claude Fable 5.1

Puis-je utiliser Nous Hermes 3 405B maintenant ?

Actuellement indisponible : ce modèle a été désactivé. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.