NVIDIA Nemotron 3 Nano Omni 30B A3B
Dados verificados em 26/09/2026
Modelo aberto da NVIDIA que entende vídeo, áudio, imagem e texto na mesma sessão e responde em texto: são 31 bilhões de parâmetros no total, com cerca de 3 bilhões ativos por token, 256 mil tokens de contexto e raciocínio ligado por padrão.
Campos verificados
| Campo | Valor conferido | Verificado em |
|---|---|---|
| Janela de contexto | 256 mil tokens | 26/09/2026 |
| Modalidades | entrada de vídeo, áudio, imagem e texto; saída de texto | 26/09/2026 |
| Idioma | inglês apenas, declarado pelo fornecedor na ficha do modelo | 26/09/2026 |
| Parâmetros | 31 bilhões no total (Mamba2-Transformer híbrido) e cerca de 3 bilhões ativos por token | 26/09/2026 |
| Licença | NVIDIA Open Model Agreement, uso comercial permitido | 26/09/2026 |
| Requisitos gpu | mínimo publicado: 1× H100 80GB no BF16 (62 GB de pesos), 1× L40S 48GB no FP8 (33 GB) ou 1× RTX 5090 32GB no NVFP4 (21 GB) | 26/09/2026 |
| Preco | não há preço por token publicado: pesos abertos sob o NVIDIA Open Model Agreement | 26/09/2026 |
| Data lancamento | 28/abr/2026, publicado no Hugging Face, no build.nvidia.com e no NGC | 26/09/2026 |
| Limites de midia | vídeo de até cerca de 2 minutos (1 FPS a 1080p) e áudio de até 1 hora por arquivo | 26/09/2026 |
Para quem não serve
Não serve para conteúdo em português: a NVIDIA declara suporte apenas a inglês — para um site em PT-BR, isso é limitação de projeto, não detalhe. Não gera imagem nem áudio: as mídias são entrada, a saída é sempre texto. Não serve para contratar por token: não há preço por uso publicado e o modelo roda na sua GPU — a menor configuração publicada é uma RTX 5090 com 32 GB na versão NVFP4. E não serve para vídeo longo: o cartão do modelo trata até cerca de 2 minutos por vídeo, e áudio de até 1 hora.