Inteligencia de modelos de IA

Proveedor · 2026-08-13

NVIDIA

53 modelos canónicos67 entradas en total (incluidos derivados)
ModeloEntrada / 1MSalida / 1MContextoProveedoresEtiquetas
nemotron-3-nano-30b-a3b$0.050$0.200131K12tools · reasoning · open-weights
Nemotron 3.5 Lightning 30B A3B$0.050$0.2001M3tools · json · reasoning · open-weights
nvidia-nemotron-nano-9b-v2$0.060$0.230131K4tools · reasoning · open-weights
nvidia-nemotron-3-nano-omni$0.059$0.237300K4tools · json · reasoning
Nemotron 3 Nano 30B A3B$0.060$0.240262K3tools · reasoning · open-weights
Llama 3.3 Nemotron Super 49B v1$0.150$0.150131K2tools · reasoning · open-weights
Nemotron 3.5 Lightning 30B A3B$0.100$0.250262K4tools · json · reasoning · open-weights
Nemotron 3 Nano Omni$0.130$0.380256K4tools · json · reasoning · vision · open-weights
Nemotron Nano 12B v2 VL$0.200$0.600128K3tools · reasoning · vision · open-weights
Llama 3.3 Nemotron Super 49B v1.5$0.400$0.400131K2tools · reasoning · open-weights
Nemotron 3 Super$0.200$0.800262K11tools · reasoning · open-weights
Llama 3.1 Nemotron Ultra 253B$0.600$1.80128K2tools · reasoning · open-weights
Nemotron 3 Ultra 550B A55B$0.500$2.501M11tools · json · reasoning · open-weights
Active Speaker DetectionDesconocidoDesconocidoUnknown1open-weights
bevformerDesconocidoDesconocido128K1open-weights
BGE M3DesconocidoDesconocido8K1open-weights
Cosmos Reason2 8BDesconocidoDesconocido131K1tools · reasoning · vision · open-weights
cosmos-predict1-5bDesconocidoDesconocidoUnknown1vision · open-weights
cosmos-transfer1-7bDesconocidoDesconocidoUnknown1vision · open-weights
cosmos-transfer2.5-2bDesconocidoDesconocidoUnknown1vision · open-weights
FLUX.1-devDesconocidoDesconocido4K1
FLUX.1-Kontext-devDesconocidoDesconocido41K1vision · open-weights
FLUX.1-schnellDesconocidoDesconocido771open-weights
FLUX.2 Klein 4BDesconocidoDesconocido41K1vision · open-weights
gliner-piiDesconocidoDesconocido128K1open-weights
InklingDesconocidoDesconocido1.05M1tools · reasoning · vision · open-weights
Laguna XS 2.1DesconocidoDesconocido262K1tools · reasoning · open-weights
Llama 3.1 Nemotron 70B InstructDesconocidoDesconocido128K1tools · open-weights
Llama 3.1 Nemotron Nano 8B v1DesconocidoDesconocido131K1tools · reasoning · open-weights
Llama 3.1 Nemotron Nano VL 8B v1DesconocidoDesconocido33K1tools · reasoning · vision · open-weights
llama-3_2-nemoretriever-300m-embed-v1DesconocidoDesconocido33K1open-weights
llama-3.1-nemotron-safety-guard-8b-v3DesconocidoDesconocido128K1open-weights
llama-nemotron-embed-vl-1b-v2DesconocidoDesconocido33K1vision · open-weights
llama-nemotron-rerank-vl-1b-v2DesconocidoDesconocido128K1vision · open-weights
magpie-tts-zeroshotDesconocidoDesconocidoUnknown1open-weights
Nemotron 3 Super (free)DesconocidoDesconocido262K3tools · json · reasoning · open-weights
Nemotron 3 Ultra (free)DesconocidoDesconocido1M3tools · reasoning · open-weights
Nemotron 3.5 Lightning (free)DesconocidoDesconocido1M3tools · reasoning · open-weights
nemotron-3-content-safetyDesconocidoDesconocido128K1open-weights
nemotron-content-safety-reasoning-4bDesconocidoDesconocido128K1reasoning · open-weights
nemotron-mini-4b-instructDesconocidoDesconocido128K1tools · open-weights
nemotron-voicechatDesconocidoDesconocido128K1tools · open-weights
nv-embed-v1DesconocidoDesconocido33K1open-weights
nv-embedcode-7b-v1DesconocidoDesconocido33K1open-weights
rerank-qa-mistral-4bDesconocidoDesconocido128K1open-weights
riva-translate-4b-instruct-v1_1DesconocidoDesconocido128K1open-weights
sarvam-mDesconocidoDesconocido128K1tools · open-weights
sparsedriveDesconocidoDesconocido128K1open-weights
streampetrDesconocidoDesconocido128K1open-weights
studiovoiceDesconocidoDesconocido128K1open-weights
synthetic-video-detectorDesconocidoDesconocidoUnknown1open-weights
usdcodeDesconocidoDesconocido128K1
usdvalidateDesconocidoDesconocidoUnknown1open-weights
ByteDance-Seed/Seed-OSS-36B-InstructderivadoDesconocidoDesconocido262K1tools · json
Gemma 2 2b ItderivadoDesconocidoDesconocido128K1tools · json · open-weights
Gemma 3n E2b ItderivadoDesconocidoDesconocido128K1tools · json · vision · open-weights
Ministral 3 14B Instruct 2512derivadoDesconocidoDesconocido262K1tools · vision · open-weights
Mistral Large 3 675B Instruct 2512derivadoDesconocidoDesconocido262K1tools · json · vision · open-weights
Mistral Medium 3derivadoDesconocidoDesconocido131K1vision
mistral-nemotronderivadoDesconocidoDesconocido128K1tools · open-weights
Mistral: Mixtral 8x7B InstructderivadoDesconocidoDesconocido33K1tools · open-weights
paligemmaderivadoDesconocidoDesconocido128K1vision · open-weights
Phi 4 MultimodalderivadoDesconocidoDesconocido128K1
Phi-4-MiniderivadoDesconocidoDesconocido131K1tools · open-weights
Qwen ImagederivadoDesconocidoDesconocidoUnknown1vision
Qwen Image EditderivadoDesconocidoDesconocidoUnknown1vision
solar-10.7b-instructderivadoDesconocidoDesconocido128K1tools · open-weights

Frequently asked questions

How many AI models does NVIDIA offer?

We track 53 canonical NVIDIA models plus 14 community fine-tunes / derivatives (excluded from the main table). The list is recomputed daily.

Which NVIDIA model is the cheapest?

nemotron-3-nano-30b-a3b is currently the lowest-priced NVIDIA model, at $0.050 per 1M input tokens and $0.200 per 1M output tokens. For the full apples-to-apples list, see /pricing/cheapest-llm-api.

Which NVIDIA model has the largest context window?

Inkling leads at 1.05M tokens. This is the total of prompt + completion.

Which NVIDIA models support tool calling?

Multiple NVIDIA models support tool calling, with nemotron-3-nano-30b-a3b being a popular pick. The capability column in the table above marks every model with NVIDIA tool-calling support.

Which NVIDIA models accept image input?

Nemotron 3 Nano Omni accepts image input. Other vision-capable NVIDIA models are tagged 'vision' in the table above. See /capabilities/vision for a cross-vendor comparison.

What are the best alternatives to NVIDIA?

Depends on the use case. For raw cost savings, look at /pricing/cheapest-llm-api. For agent-oriented workloads, /best/best-ai-model-for-agents. For long-document workflows, /best/best-long-context-llm.

How fresh is this NVIDIA pricing data?

Daily. Our pipeline syncs every morning and rebuilds these pages on data change, so list-price moves and new model releases land within roughly 24 hours.

Última actualización:

Prices in USD per 1M tokens. Unknown means the provider does not publish per-token pricing.

Pricing and capabilities are refreshed daily and reconciled against each provider's official documentation. Always verify critical production decisions with the provider directly.