google/gemma-4-31b by NVIDIA NIM
Free with NVIDIA Developer Program membership. 100+ models. Rate-limited (no daily token cap).
Access
Free API tier
Free limits
~40 RPM
Modality
text
Credit card
Not required
Commercial use
Unclear, verify
Context window
128,000 tokens
Rate limit
40 RPM
Model ID
google/gemma-4-31b
Base URL
https://integrate.api.nvidia.com/v1
Last verified
June 2026
Quickstart
curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Authorization: Bearer $KEY" \
-d '{"model":"google/gemma-4-31b","messages":[{"role":"user","content":"hi"}]}'Frequently asked
Is google/gemma-4-31b free?
Yes. NVIDIA NIM offers it as Free API tier with these limits: ~40 RPM. No credit card is required.
Can I use google/gemma-4-31b commercially?
Commercial terms are not clearly documented. Check the provider's current terms before shipping.
How do I start using google/gemma-4-31b?
Free with NVIDIA Developer Program membership. 100+ models. Rate-limited (no daily token cap).
Building with this model?
We wire free-tier and open-weight models into production stacks: evals against your real inputs, failover, cost caps.
Free monthly update
The monthly free-models update
What is newly free, what got rate-limited, and what to switch to. One email a month. Unsubscribe anytime.
Related free models
- Kimi K2.6 (Ollama Cloud) · Free tier
- GLM 4.6 (Z.ai) · Self-host free
- Gemini 2.5 Flash (Google AI Studio) · Generous · no card
- Qwen3.7 Max (Qwen) · Free tier
- Inference API (Hugging Face) · Rate-limited · 1000s of models
- Gemini 3.5 Flash (Google Gemini) · 15 RPM, 1,500 RPD