NVIDIA: Nemotron 3 Ultra (free)
Snapshot décisionnel depuis le classement global ; le score composite correspond au tableau des modèles du site.
Données mises à jour :
Modèle
3 sources vérifiées
Cotation agrégateur uniquement—pas encore de sync officielle
Étapes suivantes sur AI Hippo
À propos de ce modèle
NVIDIA: Nemotron 3 Ultra (free) occupe la place n°20 de notre classement mondial des modèles. Il est listé comme LLM avec 1.0M ctx et un prix type d’environ $0.00 par 1M tokens. Utilisez Comparer pour des choix côte à côte ou le hub Token pour les tarifs multi-fournisseurs vérifiés du même snapshot.
Vous pouvez aussi explorer plus de modeles de Nvidia et voir plus d'options depuis 🇺🇸 United States .
Capacités et spécifications
- Modalité
- text->text
- Modalités d'entrée
- text
- Paramètres API pris en charge
- include_reasoning, max_tokens, reasoning, reasoning_effort, seed, temperature, tool_choice, tools, top_p
Description catalogue : NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
Prix des tokens par fournisseur
Comparez les prix de tokens de ce modèle entre fournisseurs disponibles.
| Fournisseur | Entrée / 1M tokens | Sortie / 1M tokens | Latence | Statut |
|---|---|---|---|---|
| Fireworks | $0.60 | $2.40 | — | Vérifié · 2026-08-02 |
| OpenRouter | $0 | $0 | — | Vérifié · 2026-08-02 |
| Together | $0.60 | $3.60 | — | Vérifié · 2026-08-02 |
Les prix proviennent du dataset de comparaison des tokens et peuvent changer entre snapshots.
Alternatives
-
Meituan: LongCat 2.0
Comparer maintenant -
DeepSeek V4 Flash Latest
Comparer maintenant -
DeepSeek: DeepSeek V4 Flash 0731
Comparer maintenant
Choisissez un ou deux modèles de plus dans le classement global et utilisez Comparer pour les voir côte à côte.
FAQ
Pourquoi le prix officiel est-il absent ?
Les lignes officielles exigent un prix API direct ou cloud vérifié. Si seuls des agrégateurs listent le modèle, Official affiche — ; les devis vérifiés sont dans le tableau token.
Différence entre contexte et max sortie ?
Le contexte est l'entrée acceptée par requête. Le max de tokens de sortie est le plafond de génération par réponse—souvent bien inférieur à la fenêtre de contexte.
D'où viennent les prix multi-fournisseurs ?
Crawls/sync OpenRouter, Groq, Together, etc., fusionnés dans le jeu de comparaison infrastructure. Les lignes vérifiées affichent la date de capture dans la colonne statut.
Source des données et méthodologie
- Source
- Catalogue OpenRouter, crawls fournisseurs vérifiés et snapshots Hugging Face.
- Metrics
- Fenêtre de contexte, prix mixte 1M tokens, max sortie et champs capacités depuis l'API modèles OpenRouter.
- Update cadence
- Rafraîchissement pipeline quotidien ; les prix peuvent changer entre snapshots.
- Fetched at
- 2026-08-02
- Method
- Le rang composite utilise la pondération contexte × prix du site (pas l'ELO LMSYS Arena).