NVIDIA Nemotron 3 Nano Omni 30B A3B

shape
shape
shape
shape
shape
shape

Dados verificados em 26/09/2026

Modelo aberto da NVIDIA que entende vídeo, áudio, imagem e texto na mesma sessão e responde em texto: são 31 bilhões de parâmetros no total, com cerca de 3 bilhões ativos por token, 256 mil tokens de contexto e raciocínio ligado por padrão.

Fornecedor
NVIDIA
Família
Nemotron
Modalidade
Texto, Imagem, Áudio, Vídeo
Licença
NVIDIA Open Model Agreement (pesos abertos)
Janela de contexto
262.144 tokens
Parâmetros
31.0 B (ativos: 3.0 B)

Campos verificados

CampoValor conferidoVerificado em
Janela de contexto256 mil tokens26/09/2026
Modalidadesentrada de vídeo, áudio, imagem e texto; saída de texto26/09/2026
Idiomainglês apenas, declarado pelo fornecedor na ficha do modelo26/09/2026
Parâmetros31 bilhões no total (Mamba2-Transformer híbrido) e cerca de 3 bilhões ativos por token26/09/2026
LicençaNVIDIA Open Model Agreement, uso comercial permitido26/09/2026
Requisitos gpumínimo publicado: 1× H100 80GB no BF16 (62 GB de pesos), 1× L40S 48GB no FP8 (33 GB) ou 1× RTX 5090 32GB no NVFP4 (21 GB)26/09/2026
Preconão há preço por token publicado: pesos abertos sob o NVIDIA Open Model Agreement26/09/2026
Data lancamento28/abr/2026, publicado no Hugging Face, no build.nvidia.com e no NGC26/09/2026
Limites de midiavídeo de até cerca de 2 minutos (1 FPS a 1080p) e áudio de até 1 hora por arquivo26/09/2026

Para quem não serve

Não serve para conteúdo em português: a NVIDIA declara suporte apenas a inglês — para um site em PT-BR, isso é limitação de projeto, não detalhe. Não gera imagem nem áudio: as mídias são entrada, a saída é sempre texto. Não serve para contratar por token: não há preço por uso publicado e o modelo roda na sua GPU — a menor configuração publicada é uma RTX 5090 com 32 GB na versão NVFP4. E não serve para vídeo longo: o cartão do modelo trata até cerca de 2 minutos por vídeo, e áudio de até 1 hora.

Fontes