All models

DeepSeek

DeepSeek V4 Flash 0731

open weights

Model id

deepseek/deepseek-v4-flash-0731
Input
$0.08
per M tokens
Output
$0.18
per M tokens
Cache read
$0.016
per M tokens
Context
1,024K
tokens

Provider list price

Pricing

Input$0.08 / M tokens
Output$0.18 / M tokens
Cache read$0.016 / M tokens
RoutingFree

Provider list price. BYOK bills your provider; managed credits draw down at these rates. No markup or request fee. Every request is metered per engineer and joined to shipped work.

Registry 2026-08-19.1 · effective 8/19/2026 · Private rate card. Source withheld.

First request

Run it

Python · OpenAI SDK

from openai import OpenAI

client = OpenAI(base_url="https://api.tokenspend.dev/v1", api_key=os.environ["TOKENSPEND_API_KEY"])
resp = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "hello"}],
)

TypeScript · OpenAI SDK

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.tokenspend.dev/v1", apiKey: process.env.TOKENSPEND_API_KEY });
const resp = await client.chat.completions.create({
  model: "deepseek/deepseek-v4-flash-0731",
  messages: [{ role: "user", content: "hello" }]
});

curl

curl https://api.tokenspend.dev/v1/chat/completions \
  -H "content-type: application/json" \
  -H "Authorization: Bearer $TOKENSPEND_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4-flash-0731","messages":[{"role":"user","content":"hello"}]}'

Claude Code integration

export ANTHROPIC_BASE_URL=https://api.tokenspend.dev
export ANTHROPIC_API_KEY=$TOKENSPEND_API_KEY
export ANTHROPIC_MODEL=deepseek/deepseek-v4-flash-0731

One request shape reaches every model. Claude Code connects as an integration with two environment variables. Request history included; ZDR is one click away.