nvidia No lender online

deepseek-ai/deepseek-v4.1-flash on Nvidia.

Nvidia serves deepseek-ai/deepseek-v4.1-flash at $0.0350 per million input tokens and $0.290 per million output. Context window: 1.0M tokens. No lender is online for it at the moment. 1 requests in the last 30 days.

Input /Mtok

$0.0350

Output /Mtok

$0.290

Context

1.0M

Lenders online

0

01Overview

Nvidia serves deepseek-ai/deepseek-v4.1-flash at $0.0350 per million input tokens and $0.290 per million output. Context window: 1.0M tokens. No lender is online for it at the moment. 1 requests in the last 30 days.

02Pricing

Per million tokens, in USD. This is the rate you are charged.
Input$0.0350
Output$0.290
Cache read$0.0010

03Capabilities

You can attach an image to a request and ask about it.This model can reason at length before it answers.This model can call tools and functions you define.
Context window1.0M tokens
Maximum output384K tokens
Knowledge cutoff2025-05

06Call it

Any OpenAI- or Anthropic-compatible SDK works. Use this exact model id:

curlTerminal
curl https://aile.sh/v1/chat/completions \
  -H "Authorization: Bearer $AILE_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/deepseek-ai/deepseek-v4.1-flash",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

Quickstart · API reference

07Alternatives

Other providers serve deepseek-ai/deepseek-v4.1-flash too, at their own rates — compare every provider for deepseek-ai/deepseek-v4.1-flash.

Other models from Nvidia:

ModelProviderInput /MtokOutput /MtokStatus
z-ai/glm-5.3-flashnvidia$0.0400$0.500Offline
z-ai/glm-5.3nvidia$1.40$4.40Offline
nvidia/nemotron-3.5-lightning-30b-a3bnvidia——Offline
openai/gpt-oss-20bnvidia$0.0180$0.0900Offline
google/gemma-4-31b-itnvidia$0.0900$0.340Offline
google/diffusiongemma-26b-a4b-itnvidia——Offline
moonshotai/kimi-k3nvidia$1.03$9.04Offline
moonshotai/kimi-k2.6nvidia$0.950$4.00Offline
deepseek-ai/deepseek-v4-flash-0731nvidia$0.0210$0.320Offline
meta/muse-glimmer-30bnvidia$0.300$1.10Offline
poolside/laguna-xs-2.1nvidia$0.1000$0.200Offline
mistralai/mistral-nemotronnvidia——Offline

Similar published rates elsewhere:

ModelProviderInput /MtokOutput /MtokStatus
deepseek/deepseek-v4-flashaimlapi$0.0300$1.28Offline
deepseek-v4-flashainative$0.0300$1.28Offline
deepseek-v4-flashalibaba$0.0300$1.28Offline
deepseek-v4-flashalibaba-cn$0.0300$1.28Offline
deepseek-v4-flashapi-airforce$0.0300$1.28Offline
deepseek-v4-flashcheaperinference$0.0300$1.28Offline