NVIDIA: Nemotron 3 Ultra (free)
Snapshot de decisão a partir do ranking global; o score composto corresponde ao quadro de modelos do site.
Dados atualizados:
Modelo
3 fontes verificadas
Apenas cotação de agregador—sem sincronização oficial ainda
Próximos passos no AI Hippo
Sobre este modelo
NVIDIA: Nemotron 3 Ultra (free) está na posição #20 do nosso ranking global de modelos. Consta como LLM com 1.0M ctx e preço típico no snapshot de cerca de $0.00 por 1M tokens. Use Comparar para escolhas lado a lado ou o hub Token para preços verificados de vários provedores do mesmo snapshot.
Tambem pode explorar mais modelos de Nvidia e ver mais opcoes de 🇺🇸 United States .
Capacidades e especificações
- Modalidade
- text->text
- Modalidades de entrada
- text
- Parâmetros de API suportados
- include_reasoning, max_tokens, reasoning, reasoning_effort, seed, temperature, tool_choice, tools, top_p
Descrição do catálogo: NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
Preço de token por provedor
Compare os preços de token deste modelo entre provedores disponíveis.
| Provedor | Entrada / 1M tokens | Saída / 1M tokens | Latência | Status |
|---|---|---|---|---|
| Fireworks | $0.60 | $2.40 | — | Verificado · 2026-08-02 |
| OpenRouter | $0 | $0 | — | Verificado · 2026-08-02 |
| Together | $0.60 | $3.60 | — | Verificado · 2026-08-02 |
Os preços vêm do dataset de comparação de tokens e podem mudar entre snapshots.
Alternativas
-
Meituan: LongCat 2.0
Comparar agora -
DeepSeek V4 Flash Latest
Comparar agora -
DeepSeek: DeepSeek V4 Flash 0731
Comparar agora
Escolha mais um ou dois modelos no ranking global e use Comparar para vê-los lado a lado.
FAQ
Por que falta o preço oficial?
Linhas oficiais exigem preço verificado de API direta ou cloud. Se só agregadores listam o modelo, Official mostra —; cotações verificadas aparecem na tabela de tokens.
Diferença entre contexto e máx. saída?
Contexto é a entrada aceita por requisição. Máx. tokens de saída é o teto de geração por resposta—geralmente muito menor que a janela de contexto.
De onde vêm os preços multi-provedor?
De crawls/sync de OpenRouter, Groq, Together e outros, fundidos no dataset de comparação de infraestrutura. Linhas verificadas mostram a data de captura na coluna de status.
Fonte de dados e metodologia
- Source
- Catálogo OpenRouter, crawls de fornecedores verificados e snapshots Hugging Face.
- Metrics
- Janela de contexto, preço misto por 1M tokens, máx. saída e campos de capacidade da API de modelos OpenRouter.
- Update cadence
- Atualização diária do pipeline; preços podem mudar entre snapshots.
- Fetched at
- 2026-08-02
- Method
- Ranking composto usa ponderação contexto × preço no site (não ELO LMSYS Arena).