Pular para o conteúdo
Model Season temporadas de modelos

Nemotron 3 Ultra

nvidia/nemotron-3-ultra-550b-a55b-20260604
NVIDIAEUA/CanadáPesos abertos

modelo mais usado no roteador nos últimos 7 dias, com 3,0% dos tokens. Pico semanal de 5,1% na semana de 17 ago 26, e 32T processados desde 01 jun 26.

Lançamento
04 jun 26
Contexto
256k tokens
Modalidade
texto → texto
Raciocínio
sim
Licença
Pesos abertos
Entrada
US$ 0,625 / 1M
Saída
US$ 3,13 / 1M
Share nos últimos 7 dias
3,0%
8º de 61 · 04 set 26 a 10 set 26
Pico de share semanal
5,1%
semana de 17 ago 26
Tokens acumulados
32T
desde a semana de 01 jun 26
Semanas no top 10
9
de 14 semanas com volume

Share semanal de tokens

Fatia do volume semanal do roteador, desde a primeira semana com volume

0%2%4%6%08 jun22 jun06 jul20 jul03 ago17 ago31 agopico 5,1% em 17 ago 26
Ver os números
SemanaShare
31 ago 263,149%
24 ago 264,713%
17 ago 265,084%
10 ago 262,847%
03 ago 263,486%
27 jul 264,274%
20 jul 264,031%
13 jul 265,011%
06 jul 263,923%
29 jun 262,206%
22 jun 261,530%
15 jun 261,348%
08 jun 261,780%
01 jun 260,823%

Estreou na semana de 01 jun 26 e chegou ao pico de 5,1% 11 semanas depois. Na última semana completa ficou em 3,1%, 62% do pico.

Para que usam este modelo novo

Tarefas em que o modelo está entre os líderes, e a fatia dele em cada uma

Está entre os líderes de 7 das 29 tarefas classificadas. A maior fatia é em varredura de repositório, 8,4% dos tokens da tarefa; na tarefa de maior peso em que aparece, depuração (7,1% do volume classificado), fica com 5,6%.

Foto da janela móvel de 7 dias até 09 set 26. Fatia: tokens do modelo na tarefa sobre os tokens da tarefa. Peso: a tarefa no volume classificado.

Onde rodar

Endpoints do catálogo da fonte, do mais barato ao mais caro na entrada

ProvedorEntradaSaídaContextoQuantizaçãoRetenção zero
DeepInfraUS$ 0,50US$ 2,20256kfp4sim
BaseTenUS$ 0,60US$ 2,40198kfp4sim
BaseTenUS$ 0,60US$ 2,40198kfp4sim
VeniceUS$ 0,625US$ 3,13250kfp8sim

4 endpoints em 3 provedores, com entrada de US$ 0,50 a US$ 0,625 por 1M de tokens. 4 com retenção zero de dados.

Preços em dólar por milhão de tokens, do catálogo de endpoints mais recente arquivado.

Avaliações

Índices da Artificial Analysis e avaliações rodadas pela fonte, com custo por tarefa

Inteligência
23,4
43º de 82
Código
49,3
54º de 111
Agentes
21,7
41º de 86

GPQA Diamond 82,2%

US$ 0,083 por tarefa, 579 tarefas. 57º de 131 avaliados. Mediana dos avaliados: 80,2%, US$ 0,024 por tarefa.

τ-bench verificado, aviação 76,9%

US$ 0,1 por tarefa, 150 tarefas. 14º de 122 avaliados. Mediana dos avaliados: 70,7%, US$ 0,056 por tarefa.

Índices da Artificial Analysis, expostos pelo catálogo; avaliações rodadas pela fonte e arquivadas em 10 set 26. A marca cinza é a mediana dos avaliados.

Contra os maiores da semana

Os cinco maiores proprietários e os cinco maiores de pesos abertos nos últimos 7 dias

ModeloLaboratórioShare 7 diasPreço mistoContextoInteligênciaSemanas no top 10
Proprietários
GPT-5.6 LunaOpenAIOpenAI11,5%US$ 0,451M37,56
Gemini 3.8 FlashGoogleGoogle2,1%US$ 1,501M41,20
Muse Spark 1.3 ContributorMetaMeta1,5%US$ 0,1251M0
Claude Opus 5AnthropicAnthropic1,4%US$ 10,001M50,71
GPT-5.6 SolOpenAIOpenAI1,4%US$ 4,001M47,10
Pesos abertos
Hy4 previewTencentTencent15,5%US$ 1,251M1
DeepSeek V4 Flash 0731DeepSeekDeepSeek10,0%US$ 0,0941,31M34,55
GLM 5.3 FlashZ.ai (GLM)Z.ai (GLM)10,0%US$ 0,2371,31M41,92
MiMo-V2.5XiaomiXiaomi4,2%US$ 0,1751M22,315
DeepSeek V4 Flash 0423DeepSeekDeepSeek3,9%US$ 0,1111M24,819
Nemotron 3 Ultraesta páginaNVIDIANVIDIA3,0%US$ 1,25256k23,49

Share dos últimos 7 dias (04 set 26 a 10 set 26). Preço misto em dólar por milhão de tokens, com 75% de entrada e 25% de saída. Traço é número não publicado, não zero.

O que esta página não diz. Share aqui é fatia do tráfego de um roteador, onde a decisão costuma ser preço por token. Não é participação de mercado, de receita nem de usuários, e não diz qual modelo serve para a sua carga.