# NVIDIA AI Model Usage & Rankings | OpenCode Data

> NVIDIA models processed 27T tokens across OpenCode over the past two months, 3.0% of all usage. nemotron-3-ultra was the most-used NVIDIA model.

NVIDIA's Nemotron family brings open weights, training recipes, and accelerated deployment to reasoning, RAG, safety, and multimodal agents.

- Page: https://opencode.ai/data/nvidia
- JSON: https://opencode.ai/data/nvidia.json
- Updated: 2026-10-02T08:39:37.000Z
- Tokens processed: past 2 months: 27T
- Share of all usage: 3.0%

## NVIDIA models

| Model | Tokens: past 2 months | Share of lab usage | Context window | Max output | Release date |
| --- | --- | --- | --- | --- | --- |
| [Nemotron 3.5 Lightning 30B A3B](https://opencode.ai/data/nvidia/nemotron-3-5-lightning.md) | 4.3T | 16% | 262K | 262K | 2026-08-11 |
| [Nemotron 3 Ultra 550B A55B](https://opencode.ai/data/nvidia/nemotron-3-ultra-550b-a55b.md) | - | - | 1M | 128K | 2026-06-04 |
| [Nemotron 3.5 Content Safety](https://opencode.ai/data/nvidia/nemotron-3-5-content-safety.md) | - | - | 128K | 8.2K | 2026-06-04 |
| [Nemotron 3 Nano Omni 30B A3B Reasoning](https://opencode.ai/data/nvidia/nemotron-3-nano-omni-30b-a3b-reasoning.md) | - | - | 256K | 66K | 2026-04-28 |
| [Nemotron 3 Content Safety](https://opencode.ai/data/nvidia/nemotron-3-content-safety.md) | - | - | 128K | 4.1K | 2026-04-16 |
| [Llama Nemotron Rerank VL 1B v2](https://opencode.ai/data/nvidia/llama-nemotron-rerank-vl-1b-v2.md) | - | - | 128K | 4.1K | 2026-03-31 |
| [Nemotron Cascade 2 30B A3B](https://opencode.ai/data/nvidia/nemotron-cascade-2-30b-a3b.md) | - | - | 256K | 33K | 2026-03-24 |
| [Nemotron VoiceChat](https://opencode.ai/data/nvidia/nemotron-voicechat.md) | - | - | 128K | 8.2K | 2026-03-16 |
| [Nemotron 3 Super 120B A12B](https://opencode.ai/data/nvidia/nemotron-3-super-120b-a12b.md) | - | - | 262K | 262K | 2026-03-11 |
| [Llama Nemotron Embed VL 1B v2](https://opencode.ai/data/nvidia/llama-nemotron-embed-vl-1b-v2.md) | - | - | 33K | 2K | 2026-02-10 |
| [Nemotron Content Safety Reasoning 4B](https://opencode.ai/data/nvidia/nemotron-content-safety-reasoning-4b.md) | - | - | 128K | 4.1K | 2026-01-22 |
| [Nemotron 3 Nano 30B A3B](https://opencode.ai/data/nvidia/nemotron-3-nano-30b-a3b.md) | - | - | 262K | 262K | 2025-12-15 |
| [Llama 3.1 Nemotron Safety Guard 8B v3](https://opencode.ai/data/nvidia/llama-3-1-nemotron-safety-guard-8b-v3.md) | - | - | 128K | 4.1K | 2025-10-28 |
| [Nemotron Nano 12B v2 VL](https://opencode.ai/data/nvidia/nemotron-nano-12b-v2-vl.md) | - | - | 128K | 128K | 2025-10-28 |
| [Nemotron Nano 9B v2](https://opencode.ai/data/nvidia/nemotron-nano-9b-v2.md) | - | - | 131K | 131K | 2025-08-18 |
| [Llama 3.3 Nemotron Super 49B v1.5](https://opencode.ai/data/nvidia/llama-3-3-nemotron-super-49b-v1-5.md) | - | - | 131K | 131K | 2025-07-25 |
| [Mistral Nemotron](https://opencode.ai/data/nvidia/mistral-nemotron.md) | - | - | 128K | 8.2K | 2025-06-11 |
| [Llama 3.1 Nemotron 70B Instruct](https://opencode.ai/data/nvidia/llama-3-1-nemotron-70b-instruct.md) | - | - | 128K | 8.2K | 2025-04-15 |
| [Llama 3.1 Nemotron Ultra 253B](https://opencode.ai/data/nvidia/llama-3-1-nemotron-ultra-253b.md) | - | - | 128K | 8.2K | 2025-04-07 |
| [Llama 3.3 Nemotron Super 49B v1](https://opencode.ai/data/nvidia/llama-3-3-nemotron-super-49b-v1.md) | - | - | 131K | 131K | 2025-04-07 |
| [Nemotron Mini 4B Instruct](https://opencode.ai/data/nvidia/nemotron-mini-4b-instruct.md) | - | - | 128K | 8.2K | 2024-08-21 |

## Daily usage: past 2 months

| Date | Tokens | Unique users |
| --- | --- | --- |
| 2026-08-11 | 83B | 5.5K |
| 2026-08-12 | 246B | 17K |
| 2026-08-13 | 177B | 13K |
| 2026-08-14 | 324B | 13K |
| 2026-08-15 | 367B | 12K |
| 2026-08-16 | 420B | 11K |
| 2026-08-17 | 431B | 14K |
| 2026-08-18 | 434B | 13K |
| 2026-08-19 | 587B | 14K |
| 2026-08-20 | 596B | 14K |
| 2026-08-21 | 628B | 24K |
| 2026-08-22 | 641B | 18K |
| 2026-08-23 | 777B | 17K |
| 2026-08-24 | 850B | 21K |
| 2026-08-25 | 759B | 20K |
| 2026-08-26 | 706B | 24K |
| 2026-08-27 | 710B | 26K |
| 2026-08-28 | 609B | 22K |
| 2026-08-29 | 760B | 17K |
| 2026-08-30 | 578B | 20K |
| 2026-08-31 | 508B | 22K |
| 2026-09-01 | 487B | 20K |
| 2026-09-02 | 516B | 19K |
| 2026-09-03 | 506B | 20K |
| 2026-09-04 | 532B | 18K |
| 2026-09-05 | 550B | 16K |
| 2026-09-06 | 512B | 16K |
| 2026-09-07 | 522B | 15K |
| 2026-09-08 | 382B | 13K |
| 2026-09-09 | 403B | 13K |
| 2026-09-10 | 410B | 12K |
| 2026-09-11 | 315B | 11K |
| 2026-09-12 | 498B | 10K |
| 2026-09-13 | 351B | 10K |
| 2026-09-14 | 346B | 11K |
| 2026-09-15 | 394B | 11K |
| 2026-09-16 | 463B | 12K |
| 2026-09-17 | 516B | 9K |
| 2026-09-18 | 618B | 10K |
| 2026-09-19 | 553B | 11K |
| 2026-09-20 | 535B | 8.5K |
| 2026-09-21 | 524B | 8.2K |
| 2026-09-22 | 543B | 8.7K |
| 2026-09-23 | 344B | 8.2K |
| 2026-09-24 | 440B | 7.5K |
| 2026-09-25 | 674B | 7.5K |
| 2026-09-26 | 757B | 6.8K |
| 2026-09-27 | 703B | 6.8K |
| 2026-09-28 | 705B | 8.2K |
| 2026-09-29 | 507B | 8.7K |
| 2026-09-30 | 496B | 8K |
| 2026-10-01 | 558B | 7.6K |
| 2026-10-02 | 179B | 2.9K |

## Methodology

- Updates: Aggregated every hour. Days and weeks use UTC.
- Tokens: Input, output, reasoning, and cached tokens for each request.
- Users and sessions: Approximate counts of distinct users and OpenCode sessions.
- Cost: Session cost is the average cost per OpenCode session. Token prices are list prices from the OpenCode model catalog.
- Retention: The share of a model's users in one week who use it again the next week.
- Citation: Cite OpenCode Data (opencode.ai/data) with the update time shown at the top of the page.
