# AI coding plans vs. API pricing: Claude, Copilot, Cursor, Z.ai and 20+ more compared

> Over 25 AI coding subscriptions — Claude Code, Codex, Copilot, Cursor, Z.ai GLM, Kimi, OpenCode Go and more — converted to tokens per dollar and compared with direct API prices, including automation rules.

- Canonical: https://jedarden.com/data/inference-plans/
- Published: 2026-09-07
- Updated: 2026-09-25
- Last verified: 2026-09-25
- Tags: agents, cost, orchestration

---

Once coding workers can keep themselves busy, inference becomes a purchasing decision. A subscription buys an allowance that expires. An API bills for the work requested. Both can be economical, and both can be wasted.

In [The unit economics of running cattle](/notes/unit-economics-of-cattle/), I argued for measuring cost per completed outcome. This artifact applies that discipline to buying inference: which offers deserve a trial, what their advertised units mean, and where the apparent savings disappear.

**Analysis date: September 25, 2026.** Prices, quotas and routes were rechecked against the providers' own pages that day; the usage measurement below is from September 7.

This is a maintained research artifact. Prices are in USD before tax; individual source checks and usage captures retain their own dates in the dataset. The calculations model billing; they do not establish model quality, sustained throughput, or the cost of a shipped application. The [changelog](#changelog) records substantive revisions. Publication dates, editorial updates, and source-verification dates serve different purposes.

## Measure the workload first

The baseline now comes from an actual local usage scan captured **September 7, 2026 at 14:55 UTC**, using Tokscale 4.15.1. It covers the locally discovered Claude Code, Codex and ZCode histories in one scan, across **871,701 recorded messages**. This is an accumulated history snapshot, not one month of usage or a deduplicated total across every machine. The [aggregate measurement](/data/inference-plans/usage-profile.json) contains the exact counters and derivation; no prompts or session records are included.

<!-- inference:usage:start -->

<div class="inference-record-list inference-usage-list" role="region" aria-label="Measured token composition">
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Fresh input</span><span class="inference-record-metric">2,293,232,314</span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Share of all tokens</dt><dd>2.794%</dd></div><div><dt>Per 1M output</dt><dd>5.985M</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Cache reads</span><span class="inference-record-metric">78,848,276,612</span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Share of all tokens</dt><dd>96.082%</dd></div><div><dt>Per 1M output</dt><dd>205.776M</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Cache writes</span><span class="inference-record-metric">538,768,695</span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Share of all tokens</dt><dd>0.657%</dd></div><div><dt>Per 1M output</dt><dd>1.406M</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Output, including billed reasoning</span><span class="inference-record-metric">383,174,954</span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Share of all tokens</dt><dd>0.467%</dd></div><div><dt>Per 1M output</dt><dd>1.000M</dd></div></dl></div>
</details>
</div>
<p class="inference-total"><strong>82.06B measured tokens; 213.2:1 total input/output; 96.53% of input served from cache.</strong> All input includes fresh input, cache reads and cache writes.</p>

<!-- inference:usage:end -->

Tokscale's model report keeps separately reported reasoning outside its output field. I add that bucket once to obtain billable output; reasoning already included by a client stays inside output. Cache reads and writes are separate from fresh input. This normalization follows the [versioned scanner implementation](https://github.com/junhoyeo/tokscale/blob/v4.15.1/crates/tokscale-core/src/lib.rs#L3804).

These are **measured usage proportions**, transferred into hypothetical purchases below. Another model, tokenizer, provider cache or session pattern can change them. In particular, the high cache-hit rate is not guaranteed on another service. Most processed tokens here are repeated context; maximizing that total alone would reward repetition rather than useful applications.

## What I would trial first

My shortlist from the published economics is **OpenCode Go for routine coding, Z.ai for sustained GLM-5.3 work, and Synthetic when its model selection or additional concurrency justifies a pack**. Keep a capped API balance available for overflow and difficult tasks. These are candidates to measure in the actual harness, not a ranking of coding quality. The September 25 recheck keeps the shortlist but narrows Go's role: OpenRouter's cheapest GLM-5.3 route now undercuts Go's GLM-5.3 allowance, so Go earns its place on MiMo, MiniMax and Flash-class models, and Z.ai remains the GLM-5.3 option.

Fifteen subscriptions were added on September 25, including the native coding products, China-region editions and several credit-based plans. Three of them publish enough to calculate and are worth measuring. **StepFun's Step Plan** states the largest allowance per dollar here: its Credits convert at "approximately $1 ≈ 7M Credits" of list-price usage, with no five-hour or weekly window, so the $29 tier covers about 47B processed Step 3.5 Flash tokens at this mix. Its models have not been benchmarked here. **Command Code** sells $70 of list-price usage for $10 on GOAT, with per-model caps. **GitHub Copilot** joins annual Kilo Pass as a quantifiable way to buy Claude Sonnet 5 below Anthropic's list price, and it also covers Opus 5.5, at 33–50% below list depending on tier. Its credits above the fee are a flex allotment that "may change over time". ChatGPT, Claude, Cursor, Google AI, Devin and SuperGrok publish limits but no convertible allowance. Their rows quote those limits; turning them into token capacity would take a measurement of my own usage, which this revision does not claim.

The key eligibility question is whether the allowance covers the workload. A developer running a supported coding tool, an unattended coding worker, and a finished application serving customers can fall under different rules. An API-shaped endpoint does not establish permission for all three.

Each expanded plan reports **total processed tokens, with output in parentheses**, at the measured mix above. Each example spends the entire allowance on its named model; examples within one plan are alternatives. Weekly quotas are prorated to 30 days and assume full utilization within shorter limits. B means billion and M means million tokens. This is quota capacity, not a measured throughput promise or a model's per-request context window.

<!-- inference:plans:start -->

<div class="inference-plan-comparison" role="region" aria-label="Coding plan comparison">
<div class="inference-plan-comparison-head" aria-hidden="true"><span>Plan</span><span>Monthly price</span><span>Expandable details</span></div>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://opencode.ai/go">OpenCode Go</a></span><span class="inference-plan-price">$10</span><span class="inference-plan-counts">33 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>MiMo V2.6 Flash</li><li>MiniMax M3</li><li>Kimi K3</li><li>DeepSeek V4 Flash</li><li>GLM-5.3</li><li>GPT-5.6 Luna</li><li>GPT 6 Luna</li><li>MiMo V2.6 Pro</li><li>MiMo V2.5</li><li>MiMo V2.5 Pro</li><li>GLM-5.3-Flash</li><li>DeepSeek V4 Pro</li><li>DeepSeek V4.1 Flash</li><li>Grok 4.6</li><li>Grok 4.7</li><li>GLM-5.2</li><li>GLM-5.1</li><li>Kimi K2.7 Code</li><li>Kimi K2.6</li><li>MiniMax M2.7</li><li>MiniMax M2.5</li><li>Qwen 3.8 Max</li><li>Qwen 3.8 Flash</li><li>Qwen 3.7 Max</li><li>Qwen 3.7 Plus</li><li>Qwen 3.6 Plus</li><li>LongCat 2.0</li><li>Muse Spark 1.3 Contributor</li><li>Muse Spark 1.2 Contributor</li><li>DeepSeek V4 Flash Vision Exp</li><li>Hy4 preview</li><li>Hy3</li><li>Space Bunny</li></ul><p class="inference-plan-source"><a href="https://opencode.ai/docs/go/">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>MiMo V2.6 Flash</strong><span>6.80B total <small>(31.73M output)</small></span></li><li><strong>MiniMax M3</strong><span>815.16M total <small>(3.81M output)</small></span></li><li><strong>Kimi K3</strong><span>32.48M total <small>(0.15M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Monthly API allowance per model: $60 for MiMo V2.6 Flash, MiniMax M3, GLM-5.3-Flash, GLM-5.2/5.1, Kimi K2.7 Code/K2.6, Qwen3.7 Plus and LongCat 2.0; $30 for DeepSeek V4 Flash; $15 for Kimi K3, GLM-5.3, GPT 6 Luna and DeepSeek V4 Pro. One shared pool; each model is also capped at 20% per five hours and 50% per week. Coding-agent traffic only.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://z.ai/subscribe">Z.ai Lite / Pro / Max</a></span><span class="inference-plan-price">$18 / $80 / $168</span><span class="inference-plan-counts">2 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>GLM-5.3</li><li>GLM-5.3-Flash</li></ul><p class="inference-plan-source"><a href="https://docs.z.ai/devpack/overview">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Lite, GLM-5.3 off-peak</strong><span>432.12M total <small>(2.02M output)</small></span></li><li><strong>Pro, GLM-5.3 off-peak</strong><span>2.59B total <small>(12.11M output)</small></span></li><li><strong>Max, GLM-5.3 off-peak</strong><span>6.05B total <small>(28.25M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>10k / 60k / 140k credits weekly; model and cache weights apply. Off-peak usage costs half the credits; peak is weekdays 14:00-18:00 UTC+8. Supported coding tools; dynamic concurrency.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://synthetic.new/rate-limits">Synthetic</a></span><span class="inference-plan-price">$30 per pack</span><span class="inference-plan-counts">11 models / variants · 2 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>syn:large:text</li><li>syn:small:text</li><li>syn:large:vision</li><li>syn:small:vision</li><li>openai/gpt-oss-120b</li><li>zai-org/GLM-5.3-Flash</li><li>deepseek-ai/DeepSeek-V4.1-Flash</li><li>moonshotai/Kimi-K3</li><li>Qwen/Qwen3.8-27B</li><li>zai-org/GLM-4.7-Flash</li><li>nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4</li></ul><p class="inference-plan-source"><a href="https://api.synthetic.new/openai/v1/models">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>GLM-5.3-Flash</strong><span>2.24B total <small>(10.45M output)</small></span></li><li><strong>Kimi-K3</strong><span>169.75M total <small>(0.79M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>$24 of its own API credits weekly; 500 weighted requests per five hours; one concurrent request per model per pack. More packs increase each limit.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://camelai.com/pricing">camelStream</a></span><span class="inference-plan-price">$5 per stream</span><span class="inference-plan-counts">4 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>DeepSeek V4.1 Flash</li><li>GLM-5.3-Flash</li><li>GPT-5.6 Luna</li><li>Muse Spark 1.3</li></ul><p class="inference-plan-source"><a href="https://camelai.com/docs/stream/fleet">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Unmetered; throughput unknown</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Unmetered tokens; one generation per stream. Provider selects the model. Published throughput targets are not a service-level agreement; standard terms permit training on submitted content.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://platform.minimax.io/docs/guides/pricing-token-plan">MiniMax Token Plan</a></span><span class="inference-plan-price">$22 / $55 / $132</span><span class="inference-plan-counts">2 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>MiniMax M3</li><li>MiniMax M2.7</li></ul><p class="inference-plan-source"><a href="https://platform.minimax.io/docs/guides/pricing-token-plan">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Not quantifiable from published terms</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Five-hour and weekly windows; text, image and speech share quota, deducted at pay-as-you-go list prices. The provider publishes conflicting token figures and none for current prices, so no API-equivalent is calculated.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://www.kimi.com/membership/pricing">Kimi membership / Code</a></span><span class="inference-plan-price">Plus $19 / Pro $39 / Max $99 / Ultra $199</span><span class="inference-plan-counts">3 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Kimi K3</li><li>kimi-for-coding</li><li>kimi-for-coding-highspeed</li></ul><p class="inference-plan-source"><a href="https://www.kimi.com/code/docs/en/kimi-code/membership.html">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Not quantifiable from published terms</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Agent credits scale 1x / 2x / 5x / 10x by tier and share the membership monthly quota; the base amount is not published. New members have only a rolling five-hour window. Extra usage bills near Open Platform API prices. China-region CNY prices are served only to China-region sessions; the Chinese docs say pricing is unchanged under the new tier names.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://www.alibabacloud.com/help/en/model-studio/coding-plan">Alibaba Cloud Coding Plan</a></span><span class="inference-plan-price">$50</span><span class="inference-plan-counts">10 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>qwen3.7-plus</li><li>qwen3.6-plus</li><li>kimi-k2.5</li><li>glm-5</li><li>MiniMax-M2.5</li><li>qwen3.5-plus</li><li>qwen3-max-2026-01-23</li><li>qwen3-coder-next</li><li>qwen3-coder-plus</li><li>glm-4.7</li></ul><p class="inference-plan-source"><a href="https://www.alibabacloud.com/help/en/model-studio/coding-plan">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Not quantifiable from published terms</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>6k requests per five hours, 45k per week, 90k per month; a task can use 5-30+ model calls. Explicitly excludes automated scripts, application backends and noninteractive use. Limited slots, restocked daily.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://deepseekv4pro.com/pricing">deepseekv4pro.com</a></span><span class="inference-plan-price">Coding $19.90 / Coding Max $49.90 / Agent $49.90 / Coding Pro Max $199</span><span class="inference-plan-counts">5 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>DeepSeek V4.1 Flash</li><li>DeepSeek V4 Pro</li><li>GLM-5.3</li><li>MiniMax M3</li><li>Kimi K3</li></ul><p class="inference-plan-source"><a href="https://deepseekv4pro.com/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Not quantifiable from published terms</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Independent reseller, not affiliated with DeepSeek. Recurring promotional prices and inventory-gated slots. Quotas are published in unweighted &quot;plan tokens&quot;; weighting and upstream plan rules apply.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan</a></span><span class="inference-plan-price">$6 / $16 / $50 / $100</span><span class="inference-plan-counts">2 models / variants · 4 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>MiMo V2.6 Flash</li><li>MiMo V2.6 Pro</li></ul><p class="inference-plan-source"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Lite, V2.6 Flash daytime</strong><span>650.12M total <small>(3.04M output)</small></span></li><li><strong>Standard, V2.6 Flash daytime</strong><span>1.74B total <small>(8.14M output)</small></span></li><li><strong>Pro, V2.6 Flash daytime</strong><span>6.03B total <small>(28.13M output)</small></span></li><li><strong>Max, V2.6 Flash daytime</strong><span>13.00B total <small>(60.71M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>4.1B / 11B / 38B / 82B credits, with model-specific deductions. These are not raw tokens. Programming-tool restrictions apply.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://chutes.ai/pricing">Chutes</a></span><span class="inference-plan-price">$10 / $20</span><span class="inference-plan-counts">14 models / variants · 2 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>google/gemma-4-31B-turbo-TEE</li><li>Qwen/Qwen3.6-27B-TEE</li><li>Qwen/Qwen3.8-27B-TEE</li><li>Qwen/Qwen3.5-397B-A17B-TEE</li><li>zai-org/GLM-5.1-TEE</li><li>deepseek-ai/DeepSeek-V3.2-TEE</li><li>zai-org/GLM-5.2-TEE</li><li>moonshotai/Kimi-K2.6-TEE</li><li>deepseek-ai/DeepSeek-V4-Flash-0731-TEE</li><li>unsloth/Mistral-Nemo-Instruct-2407-TEE</li><li>moonshotai/Kimi-K3-TEE</li><li>Qwen/Qwen3-235B-A22B-Thinking-2507-TEE</li><li>Qwen/Qwen3-32B-TEE</li><li>Nemotron-3-Nano-Omni-30B-TEE</li></ul><p class="inference-plan-source"><a href="https://llm.chutes.ai/v1/models">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Plus, Flash conditional ceiling</strong><span>785.87M total <small>(3.67M output)</small></span></li><li><strong>Pro, Flash conditional ceiling</strong><span>1.57B total <small>(7.34M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Daily quotas; overage is 6% (Plus) or 10% (Pro) below PAYG rates. The February policy caps subscription value at 5x its PAYG rates. Per-tier quotas are not published.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://nano-gpt.com/subscription">NanoGPT</a></span><span class="inference-plan-price">$12</span><span class="inference-plan-counts">296 models / variants · 2 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>GLM 5.3 Flash</li><li>MiniMax M3</li><li>MiMo V2.6 Flash</li><li>MiMo V2.6 Pro</li><li>GLM 5.3</li><li>DeepSeek V4 Pro 0813</li><li>DeepSeek V4.1 Flash</li></ul><p class="inference-plan-source">Showing 7 compared routes from 296 recorded models / variants. <a href="https://nano-gpt.com/api/subscription/v1/models?detailed=true">Browse the complete catalog</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>1× input weight</strong><span>258.35M total <small>(1.21M output)</small></span></li><li><strong>2× input weight</strong><span>129.17M total <small>(0.60M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>60M input-token units weekly, including cached input, with model multipliers; resets Monday 00:00 UTC. Shared or commercial team workloads must use pay-as-you-go.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass</a></span><span class="inference-plan-price">$19 / $49 / $199</span><span class="inference-plan-counts">394 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>DeepSeek: DeepSeek V4.1 Flash</li><li>Z.ai: GLM 5.3 Flash</li><li>MoonshotAI: Kimi K3</li><li>MiniMax: MiniMax M3</li><li>Xiaomi: MiMo-V2.6-Flash</li><li>Xiaomi: MiMo-V2.6-Pro</li><li>Z.ai: GLM 5.3</li><li>DeepSeek: DeepSeek V4 Pro 0813</li><li>Anthropic: Claude Sonnet 5</li></ul><p class="inference-plan-source">Showing 9 compared routes from 394 recorded models / variants. <a href="https://api.kilo.ai/api/gateway/models">Browse the complete catalog</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Starter, Sonnet 5 annual</strong><span>91.59M total <small>(0.43M output)</small></span></li><li><strong>Pro, Sonnet 5 annual</strong><span>236.21M total <small>(1.10M output)</small></span></li><li><strong>Expert, Sonnet 5 annual</strong><span>959.32M total <small>(4.48M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Credits plus welcome/loyalty bonuses; annual billing gives 50% extra monthly credits. Full use yields a 33.3% effective discount. Bonus credits expire monthly; Gateway supported.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://learn.chatgpt.com/docs/pricing">ChatGPT (Codex)</a></span><span class="inference-plan-price">Go $8 / Plus $20 / Pro from $100</span><span class="inference-plan-counts">9 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>GPT-6 Astra</li><li>GPT-6 Sol</li><li>GPT-6 Luna</li><li>GPT-5.6 Sol</li><li>GPT-5.6 Terra</li><li>GPT-5.6 Luna</li><li>GPT-5.5</li><li>GPT-5.4</li><li>GPT-5.4 mini</li></ul><p class="inference-plan-source"><a href="https://learn.chatgpt.com/docs/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>All tiers</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Model-dependent five-hour message allowances, with weekly limits possible; Pro gives 5x or 20x Plus. Extra usage can be bought as ChatGPT credits. Per-token credit rates are published, but the included allowance is not.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://support.claude.com/en/articles/11049741-what-is-the-max-plan">Claude (Claude Code)</a></span><span class="inference-plan-price">Pro $20 / Max 5x $100 / Max 20x $200</span><span class="inference-plan-counts">3 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Claude Fable 5.1</li><li>Claude Opus 5.5</li><li>Claude Sonnet 5</li></ul><p class="inference-plan-source"><a href="https://claude.com/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>All tiers</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Five-hour session limits plus a weekly limit on Max; Max is 5x or 20x Pro, whose allowance is not published. Limits assume ordinary, individual use; developers building products must use API keys.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://cursor.com/help/account-and-billing/pricing.md">Cursor</a></span><span class="inference-plan-price">Pro $20 / Pro+ $60 / Ultra $200</span><span class="inference-plan-counts">13 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Grok 4.7</li><li>Grok 4.6</li><li>Grok 4.5</li><li>Composer 2.5</li><li>Claude Fable 5.1</li><li>Claude Opus 5.5</li><li>Claude Sonnet 5</li><li>Gemini 3.1 Pro</li><li>Gemini 3.8 Flash</li><li>GPT-5.6 Sol</li><li>GPT-5.6 Terra</li><li>GPT-5.6 Luna</li><li>Muse Spark 1.3</li></ul><p class="inference-plan-source"><a href="https://cursor.com/docs/models-and-pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>All tiers</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Two monthly usage pools, one for Cursor's own models and one for third-party models at their API prices. Per-model rates are published; the included dollar amount per plan is not.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot</a></span><span class="inference-plan-price">Pro $10 / Pro+ $39 / Max $100</span><span class="inference-plan-counts">3 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Claude Sonnet 5</li><li>Claude Opus 5.5</li><li>GPT-6 Luna</li></ul><p class="inference-plan-source"><a href="https://docs.github.com/en/copilot/reference/copilot-billing/models-and-pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Pro, Claude Sonnet 5</strong><span>48.21M total <small>(0.23M output)</small></span></li><li><strong>Pro+, Claude Sonnet 5</strong><span>224.97M total <small>(1.05M output)</small></span></li><li><strong>Max, Claude Sonnet 5</strong><span>642.76M total <small>(3.00M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>1,500 / 7,000 / 20,000 monthly AI credits (1 credit = $0.01), spent at per-token model prices. Base credits equal the fee; the rest is a flex allotment that &quot;may change over time.&quot; Chat, CLI and cloud agent draw on it.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://gemini.google/subscriptions/">Google AI Pro / Ultra</a></span><span class="inference-plan-price">Pro $19.99 / Ultra $99.99 (5x) or $199.99 (20x)</span><span class="inference-plan-counts">3 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Gemini CLI (Gemini model family)</li><li>Antigravity agent models</li><li>Jules</li></ul><p class="inference-plan-source"><a href="https://antigravity.google/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Pro: 1,500 CLI requests/day</li><li>Ultra 5x: 2,000 CLI requests/day</li><li>Ultra 20x: 2,000 CLI requests/day</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Gemini CLI: 1,500 (Pro) or 2,000 (Ultra) model requests per user per day. Jules: 100 or 300 tasks per rolling 24 hours. Antigravity: tiered rate limits plus an AI credit pool; no token amounts published.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://devin.ai/pricing">Devin Pro / Max</a></span><span class="inference-plan-price">Pro $20 / Max $200</span><span class="inference-plan-counts">2 models / variants · 2 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>SWE-2</li><li>Frontier and open-source models</li></ul><p class="inference-plan-source"><a href="https://devin.ai/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Pro: SWE-2 free until Oct 10</li><li>Max: weekly quota, size unpublished</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Pro has a daily and weekly usage quota; Max a larger weekly quota with no daily cap. Quota sizes are not published. Extra usage is prepaid on-demand credit at API pricing. SWE-2 is free in Devin Desktop and CLI through October 10, 2026.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://x.ai/pricing">SuperGrok</a></span><span class="inference-plan-price">SuperGrok $30 / Plus $100; Lite and Heavy prices not shown on the pricing page</span><span class="inference-plan-counts">2 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Grok 4.6</li><li>Grok Build</li></ul><p class="inference-plan-source"><a href="https://x.ai/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Limits not quantified</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Tiers: Lite, SuperGrok, Plus and Heavy. Limits are described only as &quot;higher rate limits&quot; and &quot;significantly higher usage across Chat, Imagine, Voice &amp; Build&quot;. No quantities are published.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max</a></span><span class="inference-plan-price">Pro $20 ($200/yr) / Max $100</span><span class="inference-plan-counts">6 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>GLM-5.3</li><li>GLM-5.3-Flash</li><li>Kimi K3</li><li>MiniMax M3</li><li>DeepSeek V4.1 Flash</li><li>DeepSeek V4 Pro</li></ul><p class="inference-plan-source"><a href="https://ollama.com/pricing">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Pro, GLM-5.3</strong><span>188.28M total <small>(0.88M output)</small></span></li><li><strong>Pro, DeepSeek V4.1 Flash off-peak</strong><span>5.52B total <small>(25.80M output)</small></span></li><li><strong>Max, GLM-5.3</strong><span>941.41M total <small>(4.40M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Pro includes $60 and Max $300 of usage credits per month, deducted at the published per-token model prices; no rollover. Concurrency: Pro 3, Max 10 requests. Off-peak rates for DeepSeek apply outside weekday 12:00-18:00 UTC.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://commandcode.ai/pricing">Command Code</a></span><span class="inference-plan-price">Go $1 / GOAT $10 / Pro $20 / Max 10x $100 / Max 20x $200</span><span class="inference-plan-counts">8 models / variants · 4 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>DeepSeek V4 Flash</li><li>GLM-5.2</li><li>Kimi K2.7 Code</li><li>MiMo V2.6 Flash</li><li>Kimi K3</li><li>GLM-5.3</li><li>Claude Sonnet 5</li><li>Claude Opus 5.5</li></ul><p class="inference-plan-source"><a href="https://commandcode.ai/models">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>GOAT, GLM-5.2</strong><span>219.66M total <small>(1.03M output)</small></span></li><li><strong>GOAT, DeepSeek V4 Flash</strong><span>5.52B total <small>(25.80M output)</small></span></li><li><strong>Pro, Claude Sonnet 5</strong><span>64.28M total <small>(0.30M output)</small></span></li><li><strong>Max 10x, Claude Opus 5.5</strong><span>232.47M total <small>(1.09M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Monthly credit pools of $10 / $70 / $80 / $150 / $300 at Command Code's per-model token prices, with per-model caps on GOAT and Pro and separate standard/premium limits on Max. Every plan also caps 5-hour and weekly spend. Payment processing fee extra.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan</a></span><span class="inference-plan-price">Flash Mini $6.99 / Plus $9.99 / Pro $29 / Max $99</span><span class="inference-plan-counts">4 models / variants · 3 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Step 3.5 Flash</li><li>Step 5 Preview</li><li>Step 3.7 Flash</li><li>step-router-v1</li></ul><p class="inference-plan-source"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Flash Mini, Step 3.5 Flash</strong><span>2.37B total <small>(11.09M output)</small></span></li><li><strong>Flash Plus, Step 3.5 Flash</strong><span>9.50B total <small>(44.34M output)</small></span></li><li><strong>Flash Max, Step 5 Preview</strong><span>60.05B total <small>(280.39M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>400M / 1,600M / 8,000M / 40,000M Credits per month, deducted at list price (about 7M Credits per $1). Monthly pool only, no five-hour or weekly window; booster packs available.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">StepFun Step Plan (China)</a></span><span class="inference-plan-price">Flash Mini ¥49 / Plus ¥99 / Pro ¥199 / Max ¥699</span><span class="inference-plan-counts">2 models / variants · 2 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>Step 3.5 Flash</li><li>Step 5 Preview</li></ul><p class="inference-plan-source"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Flash Mini, Step 3.5 Flash</strong><span>2.37B total <small>(11.09M output)</small></span></li><li><strong>Flash Max, Step 3.5 Flash</strong><span>237.42B total <small>(1.11B output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Same Credit pools as the international plan; 1M Credits = ¥1 of list-price usage. USD equivalents use 6.7489 CNY/USD (CFETS, 2026-09-24).</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://bigmodel.cn/glm-coding">GLM Coding Plan (China)</a></span><span class="inference-plan-price">Lite ¥118 / Pro ¥538 / Max ¥1,078</span><span class="inference-plan-counts">2 models / variants · 2 calculations</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>GLM-5.3</li><li>GLM-5.3-Flash</li></ul><p class="inference-plan-source"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li><strong>Lite, GLM-5.3 off-peak</strong><span>432.12M total <small>(2.02M output)</small></span></li><li><strong>Max, GLM-5.3 off-peak</strong><span>6.05B total <small>(28.25M output)</small></span></li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>bigmodel.cn edition of the Z.ai plan: same 10k / 60k / 140k weekly credits and coefficients, priced in CNY (USD at 6.7489, CFETS 2026-09-24). Prices are rendered client-side; figures are the credits-based set in the official site code.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://platform.minimaxi.com/docs/token-plan/intro.md">MiniMax Token Plan (China)</a></span><span class="inference-plan-price">Plus ¥49 / Max ¥119 / Ultra ¥469</span><span class="inference-plan-counts">2 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>MiniMax M3</li><li>MiniMax M2.7</li></ul><p class="inference-plan-source"><a href="https://platform.minimaxi.com/docs/token-plan/intro.md">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>All tiers</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Five-hour and weekly windows; text, image and speech share one quota deducted at pay-as-you-go prices. No token allowance published except an approximate Ultra figure.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://help.aliyun.com/zh/model-studio/coding-plan">Alibaba Bailian Coding Plan (China)</a></span><span class="inference-plan-price">Pro ¥200 (first month ¥39.90)</span><span class="inference-plan-counts">1 model / variant · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>qwen3.7-plus</li></ul><p class="inference-plan-source"><a href="https://help.aliyun.com/zh/model-studio/coding-plan">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>Pro</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>CNY edition of the Alibaba Coding Plan: same request limits and model list. Explicitly excludes automated scripts, backends and noninteractive use; inputs are used for model improvement.</p></div>
</div>
</details>
<details class="inference-plan-row">
<summary class="inference-plan-summary"><span class="inference-plan-name"><a href="https://help.aliyun.com/zh/model-studio/token-plan-personal-overview">Alibaba Bailian Token Plan (China)</a></span><span class="inference-plan-price">Lite ¥39 / Essential ¥79 / Standard ¥139 / Pro ¥499 (limited-time; list ¥60 / ¥120 / ¥180 / ¥600)</span><span class="inference-plan-counts">3 models / variants · 1 calculation</span></summary>
<div class="inference-plan-details">
<div class="inference-plan-model-block"><p class="inference-plan-label">Supported models / catalog</p><ul class="inference-plan-models"><li>qwen3.8-max</li><li>deepseek-v4.1-flash</li><li>glm-5.3</li></ul><p class="inference-plan-source"><a href="https://help.aliyun.com/zh/model-studio/token-plan-personal-overview">Model source</a>.</p></div>
<div class="inference-plan-calculation-block"><p class="inference-plan-label">Estimated processed tokens / 30 days</p><ul class="inference-plan-calculations"><li>All tiers</li></ul></div>
<div class="inference-plan-limit-block"><p class="inference-plan-label">Allowance and practical limit</p><p>Credit-based successor to the Coding Plan: monthly Credit caps, no weekly limit since 2026-09-22. Credits-per-token not published. Beijing region only; interactive tools only, no automation; one per verified identity.</p></div>
</div>
</details>
</div>

<!-- inference:plans:end -->

Several qualifications matter more than another decimal place in the price:

- **Z.ai supports specific coding tools and uses dynamic concurrency limits.** Its published examples include automated development tasks, but that does not establish unrestricted custom-backend access. [Usage policy](https://docs.z.ai/devpack/usage-policy)
- **camelStream's standard terms permit retention and training on prompts and outputs, without an opt-out.** Model choice, queue time and throughput are not guaranteed. It merits a small experiment with suitable non-sensitive work. [Terms](https://camelai.com/stream/terms)
- **Kimi Code's personal benefits differ from production API access.** The membership page alone does not establish a fixed Code token allowance or identical context limits across products. [Code benefits](https://www.kimi.ai/help/kimi-code/benefits)
- **NanoGPT's new subscription terms explicitly exclude building commercial products.** They apply to new users now and existing users from September 14. PAYG permits commercial use. [Terms](https://nano-gpt.com/legal/terms-of-service), [quota accounting](https://nano-gpt.com/help)
- **The DeepSeek reseller needs further clarification.** Its pricing cards and [DeepSeek integration page](https://deepseekv4pro.com/deepseek-token-plan) give different allowances. Its separate [Agent Plan documentation](https://deepseekv4pro.com/coding-plan-integration) describes an upstream Volcengine product. I have not treated either as an official DeepSeek subscription or assigned it a reliable savings multiplier.
- **Chutes' old unlimited-value anecdotes are obsolete.** Its [published revision](https://web.archive.org/web/20260712093051/https://chutes.ai/news/community-announcement-february) caps monthly subscription benefit at five times its own PAYG value and permits shorter rolling limits.

The [capacity CSV](/data/inference-plans/plan-capacity.csv) includes additional models, peak/off-peak variants and all four token buckets. The [catalog snapshot](/data/inference-plans/model-catalogs.json) preserves the large public model lists. Model availability, subscription inclusion and a selectable API alias are distinct; unresolved tier or alias details are marked in the comparison.

## Normalize the subscription costs

The same measured mix makes every quantifiable allowance comparable in token units: **1M billable output tokens requires approximately 213.167M input tokens, for 214.167M total processed tokens**. The input is divided among the fresh, cache-read and cache-write buckets above before applying each provider's prices or credit weights. Dividing a subscription's fee by its advertised credit count would skip that conversion.

```text
output_M = allowance_for_period / deductions_per_1M_output_and_its_input
processed_M = output_M × (1 + measured_input_output_ratio)
cost_per_1M_processed = fee_for_period / processed_M
cost_per_1M_output_with_input = fee_for_period / output_M
```

These are **fully utilized, steady-state 30-day estimates** from the dated September 25 price snapshot. Output costs include the associated input and cache processing; they are not the provider's output-only API rate. Processed-token costs include cache reads, which dominate this workload. Both measures describe the same workload and produce the same cost ordering. Differences in model quality still need an accepted-work benchmark.

<!-- inference:normalized:start -->

<div class="inference-record-list inference-normalized-list" role="region" aria-label="Normalized subscription costs">
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">MiMo V2.6 Flash</span></span><span class="inference-record-metric"><strong>$0.32</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>6.80B</dd></div><div><dt>Output / 30 days</dt><dd>31.73M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00147</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.32</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">83.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">MiniMax M3</span></span><span class="inference-record-metric"><strong>$2.63</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>815.16M</dd></div><div><dt>Output / 30 days</dt><dd>3.81M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01227</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.63</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.minimax.io/docs/guides/pricing-paygo">83.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">Kimi K3</span></span><span class="inference-record-metric"><strong>$65.94</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>32.48M</dd></div><div><dt>Output / 30 days</dt><dd>0.15M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.30788</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$65.94</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.kimi.ai/docs/pricing/chat.md">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">GLM-5.3-Flash</span></span><span class="inference-record-metric"><strong>$2.87</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.24B</dd></div><div><dt>Output / 30 days</dt><dd>10.45M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01340</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.87</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">63.1% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">Kimi-K3</span></span><span class="inference-record-metric"><strong>$37.85</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>169.75M</dd></div><div><dt>Output / 30 days</dt><dd>0.79M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.17673</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$37.85</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.kimi.ai/docs/pricing/chat.md">61.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Lite</a><span class="inference-record-subtitle">MiMo V2.6 Flash daytime</span></span><span class="inference-record-metric"><strong>$1.98</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$6.00</dd></div><div><dt>Processed / 30 days</dt><dd>650.12M</dd></div><div><dt>Output / 30 days</dt><dd>3.04M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00923</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.98</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">4.5% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Standard</a><span class="inference-record-subtitle">MiMo V2.6 Flash daytime</span></span><span class="inference-record-metric"><strong>$1.96</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$16.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.74B</dd></div><div><dt>Output / 30 days</dt><dd>8.14M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00917</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.96</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">3.9% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Pro</a><span class="inference-record-subtitle">MiMo V2.6 Flash daytime</span></span><span class="inference-record-metric"><strong>$1.78</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$50.00</dd></div><div><dt>Processed / 30 days</dt><dd>6.03B</dd></div><div><dt>Output / 30 days</dt><dd>28.13M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00830</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.78</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">6.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Max</a><span class="inference-record-subtitle">MiMo V2.6 Flash daytime</span></span><span class="inference-record-metric"><strong>$1.65</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>13.00B</dd></div><div><dt>Output / 30 days</dt><dd>60.71M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00769</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.65</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">12.9% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://chutes.ai/news/community-announcement-february">Chutes: Plus</a><span class="inference-record-subtitle">DeepSeek V4 Flash · conditional ceiling</span></span><span class="inference-record-metric"><strong>$2.73</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>785.87M</dd></div><div><dt>Output / 30 days</dt><dd>3.67M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01272</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.73</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">17.2% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://chutes.ai/news/community-announcement-february">Chutes: Pro</a><span class="inference-record-subtitle">DeepSeek V4 Flash · conditional ceiling</span></span><span class="inference-record-metric"><strong>$2.73</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.57B</dd></div><div><dt>Output / 30 days</dt><dd>7.34M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01272</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.73</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">17.2% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://nano-gpt.com/help">NanoGPT: Pro</a><span class="inference-record-subtitle">Included model at 1x input weight</span></span><span class="inference-record-metric"><strong>$9.95</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$12.00</dd></div><div><dt>Processed / 30 days</dt><dd>258.35M</dd></div><div><dt>Output / 30 days</dt><dd>1.21M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04645</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$9.95</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://nano-gpt.com/help">NanoGPT: Pro</a><span class="inference-record-subtitle">Included model at 2x input weight</span></span><span class="inference-record-metric"><strong>$19.90</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$12.00</dd></div><div><dt>Processed / 30 days</dt><dd>129.17M</dd></div><div><dt>Output / 30 days</dt><dd>0.60M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.09290</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$19.90</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass: Starter annual billing</a><span class="inference-record-subtitle">Anthropic: Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$44.43</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$19.00</dd></div><div><dt>Processed / 30 days</dt><dd>91.59M</dd></div><div><dt>Output / 30 days</dt><dd>0.43M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.20744</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$44.43</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass: Pro annual billing</a><span class="inference-record-subtitle">Anthropic: Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$44.43</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$49.00</dd></div><div><dt>Processed / 30 days</dt><dd>236.21M</dd></div><div><dt>Output / 30 days</dt><dd>1.10M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.20744</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$44.43</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass: Expert annual billing</a><span class="inference-record-subtitle">Anthropic: Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$44.43</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$199.00</dd></div><div><dt>Processed / 30 days</dt><dd>959.32M</dd></div><div><dt>Output / 30 days</dt><dd>4.48M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.20744</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$44.43</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Pro</a><span class="inference-record-subtitle">Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$44.43</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>48.21M</dd></div><div><dt>Output / 30 days</dt><dd>0.23M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.20744</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$44.43</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Pro+</a><span class="inference-record-subtitle">Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$37.13</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$39.00</dd></div><div><dt>Processed / 30 days</dt><dd>224.97M</dd></div><div><dt>Output / 30 days</dt><dd>1.05M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.17336</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$37.13</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">44.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Max</a><span class="inference-record-subtitle">Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$33.32</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>642.76M</dd></div><div><dt>Output / 30 days</dt><dd>3.00M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.15558</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$33.32</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">50.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Pro</a><span class="inference-record-subtitle">GLM-5.3</span></span><span class="inference-record-metric"><strong>$22.75</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>188.28M</dd></div><div><dt>Output / 30 days</dt><dd>0.88M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.10622</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$22.75</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Max</a><span class="inference-record-subtitle">GLM-5.3</span></span><span class="inference-record-metric"><strong>$22.75</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>941.41M</dd></div><div><dt>Output / 30 days</dt><dd>4.40M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.10622</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$22.75</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Pro</a><span class="inference-record-subtitle">DeepSeek V4.1 Flash off-peak</span></span><span class="inference-record-metric"><strong>$0.78</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>5.52B</dd></div><div><dt>Output / 30 days</dt><dd>25.80M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00362</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.78</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/goat">Command Code: GOAT</a><span class="inference-record-subtitle">GLM-5.2</span></span><span class="inference-record-metric"><strong>$9.75</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>219.66M</dd></div><div><dt>Output / 30 days</dt><dd>1.03M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04552</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$9.75</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/goat">Command Code: GOAT</a><span class="inference-record-subtitle">DeepSeek V4 Flash off-peak</span></span><span class="inference-record-metric"><strong>$0.39</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>5.52B</dd></div><div><dt>Output / 30 days</dt><dd>25.80M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00181</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.39</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">83.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/pro">Command Code: Pro</a><span class="inference-record-subtitle">Claude Sonnet 5</span></span><span class="inference-record-metric"><strong>$66.64</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>64.28M</dd></div><div><dt>Output / 30 days</dt><dd>0.30M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.31116</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$66.64</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">0.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/max">Command Code: Max 10x</a><span class="inference-record-subtitle">Claude Opus 5.5</span></span><span class="inference-record-metric"><strong>$92.12</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>232.47M</dd></div><div><dt>Output / 30 days</dt><dd>1.09M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.43015</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$92.12</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">0.0% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Mini</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.63</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$6.99</dd></div><div><dt>Processed / 30 days</dt><dd>2.37B</dd></div><div><dt>Output / 30 days</dt><dd>11.09M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00294</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.63</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">87.8% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">StepFun Step Plan (China): Flash Mini</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.65</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$7.26</dd></div><div><dt>Processed / 30 days</dt><dd>2.37B</dd></div><div><dt>Output / 30 days</dt><dd>11.09M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00306</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.65</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Plus</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.23</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$9.99</dd></div><div><dt>Processed / 30 days</dt><dd>9.50B</dd></div><div><dt>Output / 30 days</dt><dd>44.34M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00105</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.23</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">95.6% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Max</a><span class="inference-record-subtitle">Step 5 Preview</span></span><span class="inference-record-metric"><strong>$0.35</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$99.00</dd></div><div><dt>Processed / 30 days</dt><dd>60.05B</dd></div><div><dt>Output / 30 days</dt><dd>280.39M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00165</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.35</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">98.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">StepFun Step Plan (China): Flash Max</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.09</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$103.57</dd></div><div><dt>Processed / 30 days</dt><dd>237.42B</dd></div><div><dt>Output / 30 days</dt><dd>1.11B</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00044</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.09</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">GLM Coding Plan (China): Lite</a><span class="inference-record-subtitle">GLM-5.3 (off-peak)</span></span><span class="inference-record-metric"><strong>$8.66</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$17.48</dd></div><div><dt>Processed / 30 days</dt><dd>432.12M</dd></div><div><dt>Output / 30 days</dt><dd>2.02M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04045</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$8.66</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">88.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">GLM Coding Plan (China): Max</a><span class="inference-record-subtitle">GLM-5.3 (off-peak)</span></span><span class="inference-record-metric"><strong>$5.65</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$159.73</dd></div><div><dt>Processed / 30 days</dt><dd>6.05B</dd></div><div><dt>Output / 30 days</dt><dd>28.25M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02640</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$5.65</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">92.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Lite</a><span class="inference-record-subtitle">GLM-5.3 (off-peak)</span></span><span class="inference-record-metric"><strong>$8.92</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$18.00</dd></div><div><dt>Processed / 30 days</dt><dd>432.12M</dd></div><div><dt>Output / 30 days</dt><dd>2.02M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04166</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$8.92</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">86.9% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Pro</a><span class="inference-record-subtitle">GLM-5.3 (off-peak)</span></span><span class="inference-record-metric"><strong>$6.61</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$80.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.59B</dd></div><div><dt>Output / 30 days</dt><dd>12.11M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.03086</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$6.61</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">90.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Max</a><span class="inference-record-subtitle">GLM-5.3 (off-peak)</span></span><span class="inference-record-metric"><strong>$5.95</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$168.00</dd></div><div><dt>Processed / 30 days</dt><dd>6.05B</dd></div><div><dt>Output / 30 days</dt><dd>28.25M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02777</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$5.95</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">91.3% less</a></dd></div></dl></div>
</details>
</div>

<!-- inference:normalized:end -->

The comparison covers the quantifiable examples from the plan overview. Other model allocations and time windows use the same calculation:

<details>
<summary>Show the remaining model and time-of-day calculations</summary>

<!-- inference:normalized-other:start -->

<div class="inference-record-list inference-normalized-list" role="region" aria-label="Additional normalized subscription costs">
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">DeepSeek V4 Flash off-peak</span></span><span class="inference-record-metric"><strong>$0.78</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.76B</dd></div><div><dt>Output / 30 days</dt><dd>12.90M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00362</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.78</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">GLM-5.3</span></span><span class="inference-record-metric"><strong>$45.50</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>47.07M</dd></div><div><dt>Output / 30 days</dt><dd>0.22M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.21245</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$45.50</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">GPT 6 Luna</span></span><span class="inference-record-metric"><strong>$2.22</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>964.14M</dd></div><div><dt>Output / 30 days</dt><dd>4.50M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01037</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.22</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go: Go</a><span class="inference-record-subtitle">GPT-5.6 Luna</span></span><span class="inference-record-metric"><strong>$4.58</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>468.02M</dd></div><div><dt>Output / 30 days</dt><dd>2.19M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02137</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.58</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">gpt-oss-120b</span></span><span class="inference-record-metric"><strong>$1.45</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>4.45B</dd></div><div><dt>Output / 30 days</dt><dd>20.76M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00675</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.45</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">DeepSeek-V4.1-Flash</span></span><span class="inference-record-metric"><strong>$3.44</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.87B</dd></div><div><dt>Output / 30 days</dt><dd>8.71M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01608</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.44</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">48.1% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">Qwen3.8-27B</span></span><span class="inference-record-metric"><strong>$7.01</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>916.11M</dd></div><div><dt>Output / 30 days</dt><dd>4.28M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.03275</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$7.01</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">GLM-4.7-Flash</span></span><span class="inference-record-metric"><strong>$1.56</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>4.11B</dd></div><div><dt>Output / 30 days</dt><dd>19.21M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00729</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.56</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic: One pack</a><span class="inference-record-subtitle">NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4</span></span><span class="inference-record-metric"><strong>$4.54</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$30.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.42B</dd></div><div><dt>Output / 30 days</dt><dd>6.61M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02120</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.54</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Lite</a><span class="inference-record-subtitle">MiMo V2.6 Flash off-peak</span></span><span class="inference-record-metric"><strong>$1.58</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$6.00</dd></div><div><dt>Processed / 30 days</dt><dd>812.66M</dd></div><div><dt>Output / 30 days</dt><dd>3.79M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00738</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.58</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">16.4% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Lite</a><span class="inference-record-subtitle">MiMo V2.6 Pro daytime</span></span><span class="inference-record-metric"><strong>$4.88</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$6.00</dd></div><div><dt>Processed / 30 days</dt><dd>263.55M</dd></div><div><dt>Output / 30 days</dt><dd>1.23M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02277</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.88</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">1.0% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Lite</a><span class="inference-record-subtitle">MiMo V2.6 Pro off-peak</span></span><span class="inference-record-metric"><strong>$3.90</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$6.00</dd></div><div><dt>Processed / 30 days</dt><dd>329.44M</dd></div><div><dt>Output / 30 days</dt><dd>1.54M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01821</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.90</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">19.2% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Standard</a><span class="inference-record-subtitle">MiMo V2.6 Flash off-peak</span></span><span class="inference-record-metric"><strong>$1.57</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$16.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.18B</dd></div><div><dt>Output / 30 days</dt><dd>10.18M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00734</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.57</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">16.9% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Standard</a><span class="inference-record-subtitle">MiMo V2.6 Pro daytime</span></span><span class="inference-record-metric"><strong>$4.85</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$16.00</dd></div><div><dt>Processed / 30 days</dt><dd>707.10M</dd></div><div><dt>Output / 30 days</dt><dd>3.30M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02263</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.85</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">0.4% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Standard</a><span class="inference-record-subtitle">MiMo V2.6 Pro off-peak</span></span><span class="inference-record-metric"><strong>$3.88</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$16.00</dd></div><div><dt>Processed / 30 days</dt><dd>883.87M</dd></div><div><dt>Output / 30 days</dt><dd>4.13M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01810</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.88</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">19.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Pro</a><span class="inference-record-subtitle">MiMo V2.6 Flash off-peak</span></span><span class="inference-record-metric"><strong>$1.42</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$50.00</dd></div><div><dt>Processed / 30 days</dt><dd>7.53B</dd></div><div><dt>Output / 30 days</dt><dd>35.17M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00664</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.42</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">24.8% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Pro</a><span class="inference-record-subtitle">MiMo V2.6 Pro daytime</span></span><span class="inference-record-metric"><strong>$4.38</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$50.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.44B</dd></div><div><dt>Output / 30 days</dt><dd>11.41M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02047</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.38</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">9.2% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Pro</a><span class="inference-record-subtitle">MiMo V2.6 Pro off-peak</span></span><span class="inference-record-metric"><strong>$3.51</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$50.00</dd></div><div><dt>Processed / 30 days</dt><dd>3.05B</dd></div><div><dt>Output / 30 days</dt><dd>14.26M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01638</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.51</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">27.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Max</a><span class="inference-record-subtitle">MiMo V2.6 Flash off-peak</span></span><span class="inference-record-metric"><strong>$1.32</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>16.25B</dd></div><div><dt>Output / 30 days</dt><dd>75.89M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00615</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.32</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">30.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Max</a><span class="inference-record-subtitle">MiMo V2.6 Pro daytime</span></span><span class="inference-record-metric"><strong>$4.06</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>5.27B</dd></div><div><dt>Output / 30 days</dt><dd>24.61M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01897</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.06</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">15.8% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan: Max</a><span class="inference-record-subtitle">MiMo V2.6 Pro off-peak</span></span><span class="inference-record-metric"><strong>$3.25</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>6.59B</dd></div><div><dt>Output / 30 days</dt><dd>30.77M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01518</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.25</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">32.6% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass: Starter annual billing</a><span class="inference-record-subtitle">MiniMax: MiniMax M3</span></span><span class="inference-record-metric"><strong>$10.51</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$19.00</dd></div><div><dt>Processed / 30 days</dt><dd>387.20M</dd></div><div><dt>Output / 30 days</dt><dd>1.81M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04907</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$10.51</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.minimax.io/docs/guides/pricing-paygo">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass: Pro annual billing</a><span class="inference-record-subtitle">MiniMax: MiniMax M3</span></span><span class="inference-record-metric"><strong>$10.51</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$49.00</dd></div><div><dt>Processed / 30 days</dt><dd>998.57M</dd></div><div><dt>Output / 30 days</dt><dd>4.66M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04907</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$10.51</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.minimax.io/docs/guides/pricing-paygo">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass: Expert annual billing</a><span class="inference-record-subtitle">MiniMax: MiniMax M3</span></span><span class="inference-record-metric"><strong>$10.51</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$199.00</dd></div><div><dt>Processed / 30 days</dt><dd>4.06B</dd></div><div><dt>Output / 30 days</dt><dd>18.94M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04907</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$10.51</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.minimax.io/docs/guides/pricing-paygo">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Pro</a><span class="inference-record-subtitle">Claude Opus 5.5</span></span><span class="inference-record-metric"><strong>$61.42</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>34.87M</dd></div><div><dt>Output / 30 days</dt><dd>0.16M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.28677</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$61.42</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Pro</a><span class="inference-record-subtitle">GPT-6 Luna</span></span><span class="inference-record-metric"><strong>$2.22</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>964.14M</dd></div><div><dt>Output / 30 days</dt><dd>4.50M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01037</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.22</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://developers.openai.com/api/docs/pricing">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Pro+</a><span class="inference-record-subtitle">Claude Opus 5.5</span></span><span class="inference-record-metric"><strong>$51.33</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$39.00</dd></div><div><dt>Processed / 30 days</dt><dd>162.73M</dd></div><div><dt>Output / 30 days</dt><dd>0.76M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.23966</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$51.33</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">44.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Pro+</a><span class="inference-record-subtitle">GPT-6 Luna</span></span><span class="inference-record-metric"><strong>$1.86</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$39.00</dd></div><div><dt>Processed / 30 days</dt><dd>4.50B</dd></div><div><dt>Output / 30 days</dt><dd>21.01M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00867</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.86</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://developers.openai.com/api/docs/pricing">44.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Max</a><span class="inference-record-subtitle">Claude Opus 5.5</span></span><span class="inference-record-metric"><strong>$46.06</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>464.95M</dd></div><div><dt>Output / 30 days</dt><dd>2.17M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.21508</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$46.06</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">50.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot: Max</a><span class="inference-record-subtitle">GPT-6 Luna</span></span><span class="inference-record-metric"><strong>$1.67</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>12.86B</dd></div><div><dt>Output / 30 days</dt><dd>60.02M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00778</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.67</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://developers.openai.com/api/docs/pricing">50.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Pro</a><span class="inference-record-subtitle">GLM-5.3-Flash</span></span><span class="inference-record-metric"><strong>$2.59</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.65B</dd></div><div><dt>Output / 30 days</dt><dd>7.71M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01211</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.59</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Max</a><span class="inference-record-subtitle">GLM-5.3-Flash</span></span><span class="inference-record-metric"><strong>$2.59</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>8.26B</dd></div><div><dt>Output / 30 days</dt><dd>38.55M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01211</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.59</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Pro</a><span class="inference-record-subtitle">Kimi K3</span></span><span class="inference-record-metric"><strong>$32.97</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>129.92M</dd></div><div><dt>Output / 30 days</dt><dd>0.61M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.15394</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$32.97</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.kimi.ai/docs/pricing/chat.md">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Max</a><span class="inference-record-subtitle">Kimi K3</span></span><span class="inference-record-metric"><strong>$32.97</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>649.61M</dd></div><div><dt>Output / 30 days</dt><dd>3.03M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.15394</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$32.97</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.kimi.ai/docs/pricing/chat.md">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Pro</a><span class="inference-record-subtitle">MiniMax M3</span></span><span class="inference-record-metric"><strong>$10.51</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>407.58M</dd></div><div><dt>Output / 30 days</dt><dd>1.90M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04907</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$10.51</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.minimax.io/docs/guides/pricing-paygo">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Max</a><span class="inference-record-subtitle">MiniMax M3</span></span><span class="inference-record-metric"><strong>$10.51</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.04B</dd></div><div><dt>Output / 30 days</dt><dd>9.52M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.04907</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$10.51</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.minimax.io/docs/guides/pricing-paygo">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Max</a><span class="inference-record-subtitle">DeepSeek V4.1 Flash off-peak</span></span><span class="inference-record-metric"><strong>$0.78</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>27.62B</dd></div><div><dt>Output / 30 days</dt><dd>128.98M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00362</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.78</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Pro</a><span class="inference-record-subtitle">DeepSeek V4 Pro off-peak</span></span><span class="inference-record-metric"><strong>$3.80</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.13B</dd></div><div><dt>Output / 30 days</dt><dd>5.27M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01772</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.80</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max: Max</a><span class="inference-record-subtitle">DeepSeek V4 Pro off-peak</span></span><span class="inference-record-metric"><strong>$3.80</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>5.64B</dd></div><div><dt>Output / 30 days</dt><dd>26.35M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01772</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.80</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">66.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/go">Command Code: Go</a><span class="inference-record-subtitle">DeepSeek V4 Flash off-peak</span></span><span class="inference-record-metric"><strong>$0.23</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$1.00</dd></div><div><dt>Processed / 30 days</dt><dd>920.77M</dd></div><div><dt>Output / 30 days</dt><dd>4.30M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00109</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.23</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">90.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/goat">Command Code: GOAT</a><span class="inference-record-subtitle">Kimi K2.7 Code</span></span><span class="inference-record-metric"><strong>$8.35</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>256.39M</dd></div><div><dt>Output / 30 days</dt><dd>1.20M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.03900</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$8.35</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/goat">Command Code: GOAT</a><span class="inference-record-subtitle">MiMo V2.6 Flash</span></span><span class="inference-record-metric"><strong>$0.95</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>2.27B</dd></div><div><dt>Output / 30 days</dt><dd>10.58M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00441</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.95</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">50.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/goat">Command Code: GOAT</a><span class="inference-record-subtitle">Kimi K3</span></span><span class="inference-record-metric"><strong>$49.45</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>43.31M</dd></div><div><dt>Output / 30 days</dt><dd>0.20M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.23091</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$49.45</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.kimi.ai/docs/pricing/chat.md">50.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/goat">Command Code: GOAT</a><span class="inference-record-subtitle">GLM-5.3</span></span><span class="inference-record-metric"><strong>$34.12</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$10.00</dd></div><div><dt>Processed / 30 days</dt><dd>62.76M</dd></div><div><dt>Output / 30 days</dt><dd>0.29M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.15934</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$34.12</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">50.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/pro">Command Code: Pro</a><span class="inference-record-subtitle">DeepSeek V4 Flash off-peak</span></span><span class="inference-record-metric"><strong>$0.66</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$20.00</dd></div><div><dt>Processed / 30 days</dt><dd>6.45B</dd></div><div><dt>Output / 30 days</dt><dd>30.10M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00310</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.66</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">71.4% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/max">Command Code: Max 10x</a><span class="inference-record-subtitle">DeepSeek V4 Flash off-peak</span></span><span class="inference-record-metric"><strong>$1.55</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$100.00</dd></div><div><dt>Processed / 30 days</dt><dd>13.81B</dd></div><div><dt>Output / 30 days</dt><dd>64.49M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00724</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.55</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/max">Command Code: Max 20x</a><span class="inference-record-subtitle">DeepSeek V4 Flash off-peak</span></span><span class="inference-record-metric"><strong>$1.55</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$200.00</dd></div><div><dt>Processed / 30 days</dt><dd>27.62B</dd></div><div><dt>Output / 30 days</dt><dd>128.98M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00724</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.55</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://api-docs.deepseek.com/quick_start/pricing/">33.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/docs/plans/max">Command Code: Max 20x</a><span class="inference-record-subtitle">Claude Opus 5.5</span></span><span class="inference-record-metric"><strong>$92.12</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$200.00</dd></div><div><dt>Processed / 30 days</dt><dd>464.95M</dd></div><div><dt>Output / 30 days</dt><dd>2.17M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.43015</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$92.12</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.claude.com/docs/en/about-claude/pricing">0.0% more expensive</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Mini</a><span class="inference-record-subtitle">Step 5 Preview</span></span><span class="inference-record-metric"><strong>$2.49</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$6.99</dd></div><div><dt>Processed / 30 days</dt><dd>600.51M</dd></div><div><dt>Output / 30 days</dt><dd>2.80M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01164</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.49</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">87.8% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Plus</a><span class="inference-record-subtitle">Step 5 Preview</span></span><span class="inference-record-metric"><strong>$0.89</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$9.99</dd></div><div><dt>Processed / 30 days</dt><dd>2.40B</dd></div><div><dt>Output / 30 days</dt><dd>11.22M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00416</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.89</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">95.6% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">StepFun Step Plan (China): Flash Plus</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.33</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$14.67</dd></div><div><dt>Processed / 30 days</dt><dd>9.50B</dd></div><div><dt>Output / 30 days</dt><dd>44.34M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00154</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.33</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Pro</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.13</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$29.00</dd></div><div><dt>Processed / 30 days</dt><dd>47.48B</dd></div><div><dt>Output / 30 days</dt><dd>221.72M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00061</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.13</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">97.5% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Pro</a><span class="inference-record-subtitle">Step 5 Preview</span></span><span class="inference-record-metric"><strong>$0.52</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$29.00</dd></div><div><dt>Processed / 30 days</dt><dd>12.01B</dd></div><div><dt>Output / 30 days</dt><dd>56.08M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00241</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.52</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">97.5% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">StepFun Step Plan (China): Flash Pro</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.13</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$29.49</dd></div><div><dt>Processed / 30 days</dt><dd>47.48B</dd></div><div><dt>Output / 30 days</dt><dd>221.72M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00062</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.13</strong></dd></div><div><dt>Saving vs direct API</dt><dd>Not established</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan: Flash Max</a><span class="inference-record-subtitle">Step 3.5 Flash</span></span><span class="inference-record-metric"><strong>$0.09</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$99.00</dd></div><div><dt>Processed / 30 days</dt><dd>237.42B</dd></div><div><dt>Output / 30 days</dt><dd>1.11B</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00042</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$0.09</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">98.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">GLM Coding Plan (China): Lite</a><span class="inference-record-subtitle">GLM-5.3 (peak)</span></span><span class="inference-record-metric"><strong>$17.33</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$17.48</dd></div><div><dt>Processed / 30 days</dt><dd>216.06M</dd></div><div><dt>Output / 30 days</dt><dd>1.01M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.08090</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$17.33</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">76.6% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">GLM Coding Plan (China): Pro</a><span class="inference-record-subtitle">GLM-5.3 (off-peak)</span></span><span class="inference-record-metric"><strong>$6.59</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$79.72</dd></div><div><dt>Processed / 30 days</dt><dd>2.59B</dd></div><div><dt>Output / 30 days</dt><dd>12.11M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.03075</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$6.59</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">91.1% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">GLM Coding Plan (China): Pro</a><span class="inference-record-subtitle">GLM-5.3 (peak)</span></span><span class="inference-record-metric"><strong>$13.17</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$79.72</dd></div><div><dt>Processed / 30 days</dt><dd>1.30B</dd></div><div><dt>Output / 30 days</dt><dd>6.05M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.06150</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$13.17</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">82.2% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">GLM Coding Plan (China): Max</a><span class="inference-record-subtitle">GLM-5.3 (peak)</span></span><span class="inference-record-metric"><strong>$11.31</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$159.73</dd></div><div><dt>Processed / 30 days</dt><dd>3.02B</dd></div><div><dt>Output / 30 days</dt><dd>14.12M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.05281</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$11.31</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">84.7% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Lite</a><span class="inference-record-subtitle">GLM-5.3 (peak)</span></span><span class="inference-record-metric"><strong>$17.84</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$18.00</dd></div><div><dt>Processed / 30 days</dt><dd>216.06M</dd></div><div><dt>Output / 30 days</dt><dd>1.01M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.08331</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$17.84</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">73.9% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Lite</a><span class="inference-record-subtitle">GLM-5.3-Flash list (off-peak)</span></span><span class="inference-record-metric"><strong>$2.94</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$18.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.31B</dd></div><div><dt>Output / 30 days</dt><dd>6.11M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01375</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.94</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">62.2% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Lite</a><span class="inference-record-subtitle">GLM-5.3-Flash list (peak)</span></span><span class="inference-record-metric"><strong>$5.89</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$18.00</dd></div><div><dt>Processed / 30 days</dt><dd>654.52M</dd></div><div><dt>Output / 30 days</dt><dd>3.06M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02750</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$5.89</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">24.3% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Pro</a><span class="inference-record-subtitle">GLM-5.3 (peak)</span></span><span class="inference-record-metric"><strong>$13.22</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$80.00</dd></div><div><dt>Processed / 30 days</dt><dd>1.30B</dd></div><div><dt>Output / 30 days</dt><dd>6.05M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.06171</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$13.22</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">80.6% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Pro</a><span class="inference-record-subtitle">GLM-5.3-Flash list (off-peak)</span></span><span class="inference-record-metric"><strong>$2.18</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$80.00</dd></div><div><dt>Processed / 30 days</dt><dd>7.85B</dd></div><div><dt>Output / 30 days</dt><dd>36.67M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01019</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$2.18</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">72.0% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Pro</a><span class="inference-record-subtitle">GLM-5.3-Flash list (peak)</span></span><span class="inference-record-metric"><strong>$4.36</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$80.00</dd></div><div><dt>Processed / 30 days</dt><dd>3.93B</dd></div><div><dt>Output / 30 days</dt><dd>18.34M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.02037</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$4.36</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">43.9% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Max</a><span class="inference-record-subtitle">GLM-5.3 (peak)</span></span><span class="inference-record-metric"><strong>$11.89</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$168.00</dd></div><div><dt>Processed / 30 days</dt><dd>3.02B</dd></div><div><dt>Output / 30 days</dt><dd>14.12M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.05554</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$11.89</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">82.6% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Max</a><span class="inference-record-subtitle">GLM-5.3-Flash list (off-peak)</span></span><span class="inference-record-metric"><strong>$1.96</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$168.00</dd></div><div><dt>Processed / 30 days</dt><dd>18.33B</dd></div><div><dt>Output / 30 days</dt><dd>85.57M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.00917</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$1.96</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">74.8% less</a></dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/devpack/overview">Z.ai Lite / Pro / Max: Max</a><span class="inference-record-subtitle">GLM-5.3-Flash list (peak)</span></span><span class="inference-record-metric"><strong>$3.93</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Fee / month</dt><dd>$168.00</dd></div><div><dt>Processed / 30 days</dt><dd>9.16B</dd></div><div><dt>Output / 30 days</dt><dd>42.79M</dd></div><div><dt>$ / 1M processed</dt><dd>$0.01833</dd></div><div><dt>$ / 1M output + its input</dt><dd><strong>$3.93</strong></dd></div><div><dt>Saving vs direct API</dt><dd><a href="https://docs.z.ai/guides/overview/pricing">49.5% less</a></dd></div></dl></div>
</details>
</div>

<!-- inference:normalized-other:end -->

</details>

“Saving vs direct API” compares the same named model against the direct API row below, using ordinary list prices for GLM Flash and off-peak prices for DeepSeek. Serving configurations and cache behavior can differ. “Not established” means this dataset lacks a defensible same-model baseline; it does not mean zero savings. Chutes estimates remain conditional on its published ceiling and model eligibility. Kilo examples assume annual billing with the full monthly bonus consumed before expiry. Alternative model allocations within a subscription cannot be added together.

The [capacity CSV](/data/inference-plans/plan-capacity.csv) contains all four token buckets, both normalized costs, direct API savings and break-even utilization. It also separates a discount against the serving provider's own PAYG rates from a discount against the original model API. Missing or conflicting quotas remain blank; camelStream's unmetered service has no defensible fixed token capacity or normalized cost here. MiniMax, Kimi and the DeepSeek reseller need quota clarification; Alibaba needs tokens per billable request.

At **50% utilization, each subscription's effective cost per token doubles**. Break-even utilization is the fraction of modeled allowance that must replace direct API spending to recover the fee. A figure above 100% means even full utilization is more expensive than that API baseline. Real concurrency, request and reset limits can prevent reaching the modeled allowance.

## Start with the API baseline

The priced workload is **1M billable output tokens plus the measured proportions of fresh input, cache reads and cache writes shown above**. Tokenizers differ, so equal token counts do not mean identical amounts of source code. These are estimates at current prices, not the historical cash cost of the measured sessions.

For prices stated per million tokens:

```text
cost = fresh_input_M × input_price
     + cache_read_M × cache_read_price
     + cache_write_M × cache_creation_price
     + output_M × output_price
     + additional_charges
```

The comparison excludes paid tools, search, additional retries, infrastructure and long-context premiums. Cache creation uses the ordinary input price unless the serving provider specifies a separate full creation rate. Free cache storage or a waived write surcharge does not make the initial input processing free. Kilo's Sonnet 5 example, for instance, uses its explicit cache-creation rate in the capacity calculator.

<!-- inference:api:start -->

<div class="inference-record-list inference-api-list" role="region" aria-label="Direct API prices">
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">MiMo V2.6 Flash</a></span><span class="inference-record-metric"><strong>$1.89</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.14</dd></div><div><dt>Cached / M</dt><dd>$0.0028</dd></div><div><dt>Output / M</dt><dd>$0.28</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$1.89</strong></dd></div><div><dt>$100 processed capacity</dt><dd>11.33B total (52.88M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://api-docs.deepseek.com/quick_start/pricing/">DeepSeek V4.1 Flash off-peak</a></span><span class="inference-record-metric"><strong>$2.33</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.15</dd></div><div><dt>Cached / M</dt><dd>$0.003</dd></div><div><dt>Output / M</dt><dd>$0.60</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$2.33</strong></dd></div><div><dt>$100 processed capacity</dt><dd>9.21B total (42.99M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://developers.openai.com/api/docs/pricing">GPT-6 Luna</a></span><span class="inference-record-metric"><strong>$3.33</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.1</dd></div><div><dt>Cached / M</dt><dd>$0.01</dd></div><div><dt>Output / M</dt><dd>$0.50</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$3.33</strong></dd></div><div><dt>$100 processed capacity</dt><dd>6.43B total (30.01M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/pay-as-you-go">MiMo V2.6 Pro</a></span><span class="inference-record-metric"><strong>$4.83</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.435</dd></div><div><dt>Cached / M</dt><dd>$0.0036</dd></div><div><dt>Output / M</dt><dd>$0.87</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$4.83</strong></dd></div><div><dt>$100 processed capacity</dt><dd>4.44B total (20.72M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">Step 3.5 Flash</a></span><span class="inference-record-metric"><strong>$5.15</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.1</dd></div><div><dt>Cached / M</dt><dd>$0.02</dd></div><div><dt>Output / M</dt><dd>$0.30</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$5.15</strong></dd></div><div><dt>$100 processed capacity</dt><dd>4.15B total (19.40M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/guides/overview/pricing">GLM-5.3-Flash list</a></span><span class="inference-record-metric"><strong>$7.78</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.15</dd></div><div><dt>Cached / M</dt><dd>$0.03</dd></div><div><dt>Output / M</dt><dd>$0.50</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$7.78</strong></dd></div><div><dt>$100 processed capacity</dt><dd>2.75B total (12.85M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://api-docs.deepseek.com/quick_start/pricing/">DeepSeek V4 Pro off-peak</a></span><span class="inference-record-metric"><strong>$11.39</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.66</dd></div><div><dt>Cached / M</dt><dd>$0.022</dd></div><div><dt>Output / M</dt><dd>$1.98</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$11.39</strong></dd></div><div><dt>$100 processed capacity</dt><dd>1.88B total (8.78M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.minimax.io/docs/guides/pricing-paygo">MiniMax M3</a></span><span class="inference-record-metric"><strong>$15.76</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$0.3</dd></div><div><dt>Cached / M</dt><dd>$0.06</dd></div><div><dt>Output / M</dt><dd>$1.20</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$15.76</strong></dd></div><div><dt>$100 processed capacity</dt><dd>1.36B total (6.34M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/guides/pricing/details.md">Step 5 Preview</a></span><span class="inference-record-metric"><strong>$20.38</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$1</dd></div><div><dt>Cached / M</dt><dd>$0.05</dd></div><div><dt>Output / M</dt><dd>$2.70</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$20.38</strong></dd></div><div><dt>$100 processed capacity</dt><dd>1.05B total (4.91M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.claude.com/docs/en/about-claude/pricing">Claude Sonnet 5</a></span><span class="inference-record-metric"><strong>$66.64</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$2</dd></div><div><dt>Cached / M</dt><dd>$0.2</dd></div><div><dt>Output / M</dt><dd>$10.00</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$66.64</strong></dd></div><div><dt>$100 processed capacity</dt><dd>321.38M total (1.50M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.z.ai/guides/overview/pricing">GLM-5.3</a></span><span class="inference-record-metric"><strong>$68.25</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$1.4</dd></div><div><dt>Cached / M</dt><dd>$0.26</dd></div><div><dt>Output / M</dt><dd>$4.40</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$68.25</strong></dd></div><div><dt>$100 processed capacity</dt><dd>313.80M total (1.47M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.bigmodel.cn/cn/guide/start/pricing.md">GLM-5.3 (bigmodel.cn)</a></span><span class="inference-record-metric"><strong>$73.89</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$1.18538</dd></div><div><dt>Cached / M</dt><dd>$0.29634</dd></div><div><dt>Output / M</dt><dd>$4.15</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$73.89</strong></dd></div><div><dt>$100 processed capacity</dt><dd>289.85M total (1.35M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.claude.com/docs/en/about-claude/pricing">Claude Opus 5.5</a></span><span class="inference-record-metric"><strong>$92.12</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$4</dd></div><div><dt>Cached / M</dt><dd>$0.2</dd></div><div><dt>Output / M</dt><dd>$20.00</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$92.12</strong></dd></div><div><dt>$100 processed capacity</dt><dd>232.47M total (1.09M output)</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.kimi.ai/docs/pricing/chat.md">Kimi K3</a></span><span class="inference-record-metric"><strong>$98.91</strong><small> / 1M output</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Input / M</dt><dd>$3</dd></div><div><dt>Cached / M</dt><dd>$0.3</dd></div><div><dt>Output / M</dt><dd>$15.00</dd></div><div><dt>Cost per 1M output + its input</dt><dd><strong>$98.91</strong></dd></div><div><dt>$100 processed capacity</dt><dd>216.54M total (1.01M output)</dd></div></dl></div>
</details>
</div>

<!-- inference:api:end -->

Without cache hits, the same workload costs **$30.12 on MiMo V2.6 Flash**, **$32.58 on off-peak DeepSeek V4.1 Flash**, and **$654.50 on Kimi K3**. A plan that counts cached input at full token weight can lose much of its advantage against an API with inexpensive cache reads. Repeated context also inflates token totals without representing newly generated work.

DeepSeek's listed prices apply outside weekday peak windows of **01:00–04:00 and 06:00–10:00 UTC**, and all day on Chinese public holidays; peak rates double. DeepSeek has retired its V4 Flash model names and now serves them with V4.1 Flash at the V4.1 price. MiniMax M3's listed rate applies through 512K input per request. These timing and context conditions belong in the comparison, not in a footnote to the invoice. [DeepSeek pricing](https://api-docs.deepseek.com/quick_start/pricing/), [MiniMax pricing](https://platform.minimax.io/docs/guides/pricing-paygo)

## Compare with OpenRouter too

OpenRouter narrows some subscription discounts because its alternative providers can undercut the model author's API. The result depends heavily on cached-input pricing. The following snapshot was captured on **September 25, 2026, at 13:49 UTC** from OpenRouter's public model-endpoint API. Each quote keeps one provider's input, cache and output rates together.

The comparison is grouped by **subscription, then model, then tier or time window**. All twenty-seven researched coding subscriptions appear, including those with unknown costs. Models from the saved catalogs remain visible in the index; large unpriced catalogs expand underneath their subscription. Catalog presence, subscription eligibility and model pinning are separate questions, so each group retains those conditions. Native workflow subscriptions are discussed separately below.

The unit-cost fields report **cash cost per 1M output tokens plus 213.167M associated input tokens**, using the measured cache mix. Subscription summaries show the monthly fee, and capacity details show total processed tokens with output in parentheses. Each calculated scenario spends the full allowance on its named model; scenarios within one subscription are alternative allocations. “Not established” means the snapshot lacks a defensible entitlement or calculation; “Not quoted” means no matching OpenRouter route was priced.

OpenRouter figures include its standard card-purchase fee: **5.5%, with a $0.80 minimum**. The reference purchase is $100 of inference credits plus $5.50 in fees, so quoted inference cost is multiplied by 1.055 once. A $10 credit purchase instead incurs an 8% effective fee. Taxes and special billing arrangements are excluded. [OpenRouter fee policy](https://openrouter.ai/blog/insights/governing-team-ai-spend/)

<!-- inference:openrouter:start -->

<div class="inference-subscription-index" role="region" aria-label="OpenRouter and subscription comparison">
<p class="inference-jump-links">Jump to subscription: <a href="#inference-plan-opencode-go">OpenCode Go</a> · <a href="#inference-plan-z-ai-lite-pro-max">Z.ai Lite / Pro / Max</a> · <a href="#inference-plan-synthetic">Synthetic</a> · <a href="#inference-plan-camelstream">camelStream</a> · <a href="#inference-plan-minimax-token-plan">MiniMax Token Plan</a> · <a href="#inference-plan-kimi-membership-code">Kimi membership / Code</a> · <a href="#inference-plan-alibaba-cloud-coding-plan">Alibaba Cloud Coding Plan</a> · <a href="#inference-plan-deepseekv4pro-com">deepseekv4pro.com</a> · <a href="#inference-plan-mimo-token-plan">MiMo Token Plan</a> · <a href="#inference-plan-chutes">Chutes</a> · <a href="#inference-plan-nanogpt">NanoGPT</a> · <a href="#inference-plan-kilo-pass">Kilo Pass</a> · <a href="#inference-plan-chatgpt-codex">ChatGPT (Codex)</a> · <a href="#inference-plan-claude-claude-code">Claude (Claude Code)</a> · <a href="#inference-plan-cursor">Cursor</a> · <a href="#inference-plan-github-copilot">GitHub Copilot</a> · <a href="#inference-plan-google-ai-pro-ultra">Google AI Pro / Ultra</a> · <a href="#inference-plan-devin-pro-max">Devin Pro / Max</a> · <a href="#inference-plan-supergrok">SuperGrok</a> · <a href="#inference-plan-ollama-cloud-pro-max">Ollama Cloud Pro / Max</a> · <a href="#inference-plan-command-code">Command Code</a> · <a href="#inference-plan-stepfun-step-plan">StepFun Step Plan</a> · <a href="#inference-plan-stepfun-step-plan-china">StepFun Step Plan (China)</a> · <a href="#inference-plan-glm-coding-plan-china">GLM Coding Plan (China)</a> · <a href="#inference-plan-minimax-token-plan-china">MiniMax Token Plan (China)</a> · <a href="#inference-plan-alibaba-bailian-coding-plan-china">Alibaba Bailian Coding Plan (China)</a> · <a href="#inference-plan-alibaba-bailian-token-plan-china">Alibaba Bailian Token Plan (China)</a></p>
<details class="inference-subscription-record" id="inference-plan-opencode-go" data-subscription="OpenCode Go">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://opencode.ai/go">OpenCode Go</a><span class="inference-record-subtitle"><a href="https://opencode.ai/docs/go/">33 recorded models / aliases</a></span></span><span class="inference-record-metric">$10 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">One shared allowance. Regional and experimental conditions apply; uncalculated models retain unknown capacity.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="MiMo V2.6 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Flash</span><span class="inference-record-metric">$0.32 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-mimo"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>6.80B (31.73M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.32</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>84.2% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M3</span><span class="inference-record-metric">$2.63 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-m3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>815.16M (3.81M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.63</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>80.3% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K3">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K3</span><span class="inference-record-metric">$65.94 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-k3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>32.48M (0.15M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$65.94</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>9.7% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Flash</span><span class="inference-record-metric">$0.78 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.76B (12.90M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.78</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3</span><span class="inference-record-metric">$45.50 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-glm"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>47.07M (0.22M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$45.50</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>66.8% more expensive</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Luna</span><span class="inference-record-metric">$4.58 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-luna"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>468.02M (2.19M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.58</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT 6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT 6 Luna</span><span class="inference-record-metric">$2.22 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="go-luna6"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>964.14M (4.50M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.22</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiMo V2.6 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Pro</span><span class="inference-record-metric">$5.09 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiMo V2.5">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go; deprecated 2026-10-21</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiMo V2.5 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.5 Pro</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go; deprecated 2026-10-21</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3-Flash</span><span class="inference-record-metric">$2.67 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Pro</span><span class="inference-record-metric">$6.25 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4-pro-0813/endpoints">$6.25</a><span class="inference-fact-note">Baidu, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4.1 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4.1 Flash</span><span class="inference-record-metric">$1.23 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Grok 4.6">
<summary class="inference-record-summary"><span class="inference-record-title">Grok 4.6</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Grok 4.7">
<summary class="inference-record-summary"><span class="inference-record-title">Grok 4.7</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.2">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.2</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.1">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.1</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K2.7 Code">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K2.7 Code</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K2.6">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K2.6</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M2.7">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M2.7</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M2.5">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M2.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen 3.8 Max">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen 3.8 Max</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen 3.8 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen 3.8 Flash</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen 3.7 Max">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen 3.7 Max</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen 3.7 Plus">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen 3.7 Plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen 3.6 Plus">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen 3.6 Plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="LongCat 2.0">
<summary class="inference-record-summary"><span class="inference-record-title">LongCat 2.0</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Muse Spark 1.3 Contributor">
<summary class="inference-record-summary"><span class="inference-record-title">Muse Spark 1.3 Contributor</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Muse Spark 1.2 Contributor">
<summary class="inference-record-summary"><span class="inference-record-title">Muse Spark 1.2 Contributor</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4 Flash Vision Exp">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Flash Vision Exp</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Hy4 preview">
<summary class="inference-record-summary"><span class="inference-record-title">Hy4 preview</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Hy3">
<summary class="inference-record-summary"><span class="inference-record-title">Hy3</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Space Bunny">
<summary class="inference-record-summary"><span class="inference-record-title">Space Bunny</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Go; free for a limited time</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-z-ai-lite-pro-max" data-subscription="Z.ai Lite / Pro / Max">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://z.ai/subscribe">Z.ai Lite / Pro / Max</a><span class="inference-record-subtitle"><a href="https://docs.z.ai/devpack/overview">2 recorded models / aliases</a></span></span><span class="inference-record-metric">$18 / $80 / $168 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Older aliases route to these models. Each row allocates the entire tier allowance to one model and time window.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="GLM-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3</span><span class="inference-record-metric">6 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="zai-lite-glm-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>432.12M (2.02M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$8.92</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>67.3% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-lite-glm-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>216.06M (1.01M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$17.84</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>34.6% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-pro-glm-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.59B (12.11M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$6.61</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>75.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-pro-glm-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.30B (6.05M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$13.22</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>51.5% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-max-glm-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>6.05B (28.25M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$5.95</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>78.2% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-max-glm-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>3.02B (14.12M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$11.89</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>56.4% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3-Flash</span><span class="inference-record-metric">6 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="zai-lite-flash-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.31B (6.11M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.94</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>10.3% more expensive</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-lite-flash-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>654.52M (3.06M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$5.89</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>120.6% more expensive</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-pro-flash-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>7.85B (36.67M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.18</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>18.3% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-pro-flash-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>3.93B (18.34M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.36</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>63.4% more expensive</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-max-flash-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>18.33B (85.57M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.96</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>26.5% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="zai-max-flash-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>9.16B (42.79M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.93</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>47.1% more expensive</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-synthetic" data-subscription="Synthetic">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://synthetic.new/rate-limits">Synthetic</a><span class="inference-record-subtitle"><a href="https://api.synthetic.new/openai/v1/models">11 recorded models / aliases</a></span></span><span class="inference-record-metric">$30 per pack / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">The saved served catalog includes four automatic aliases. Catalog availability alone does not establish subscription eligibility.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="syn:large:text">
<summary class="inference-record-summary"><span class="inference-record-title">syn:large:text</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="syn:small:text">
<summary class="inference-record-summary"><span class="inference-record-title">syn:small:text</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="syn:large:vision">
<summary class="inference-record-summary"><span class="inference-record-title">syn:large:vision</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="syn:small:vision">
<summary class="inference-record-summary"><span class="inference-record-title">syn:small:vision</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:openai/gpt-oss-120b">
<summary class="inference-record-summary"><span class="inference-record-title">openai/gpt-oss-120b</span><span class="inference-record-metric">$1.45 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-gpt-oss-120b"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>4.45B (20.76M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.45</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:zai-org/GLM-5.3-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">zai-org/GLM-5.3-Flash</span><span class="inference-record-metric">$2.87 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-glm-5.3-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.24B (10.45M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.87</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>7.5% more expensive</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:deepseek-ai/DeepSeek-V4.1-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">deepseek-ai/DeepSeek-V4.1-Flash</span><span class="inference-record-metric">$3.44 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-deepseek-v4.1-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.87B (8.71M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.44</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>180.7% more expensive</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:moonshotai/Kimi-K3">
<summary class="inference-record-summary"><span class="inference-record-title">moonshotai/Kimi-K3</span><span class="inference-record-metric">$37.85 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-kimi-k3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>169.75M (0.79M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$37.85</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>48.2% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:Qwen/Qwen3.8-27B">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen/Qwen3.8-27B</span><span class="inference-record-metric">$7.01 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-qwen3.8-27b"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>916.11M (4.28M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$7.01</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:zai-org/GLM-4.7-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">zai-org/GLM-4.7-Flash</span><span class="inference-record-metric">$1.56 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-glm-4.7-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>4.11B (19.21M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.56</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="hf:nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4">
<summary class="inference-record-summary"><span class="inference-record-title">nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4</span><span class="inference-record-metric">$4.54 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="synthetic-nvidia-nemotron-3-super-120b-a12b-nvfp4"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One pack</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.42B (6.61M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.54</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-camelstream" data-subscription="camelStream">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://camelai.com/pricing">camelStream</a><span class="inference-record-subtitle"><a href="https://camelai.com/docs/stream/fleet">4 recorded models / aliases</a></span></span><span class="inference-record-metric">$5 per stream / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Unmetered service has no fixed token entitlement. Named routes are possible automatic choices, not selectable allocations.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="DeepSeek V4.1 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4.1 Flash</span><span class="inference-record-metric">$1.23 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="camel-unmetered"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One stream; automatic routing, no model pinning</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Unmetered; throughput unknown</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3-Flash</span><span class="inference-record-metric">$2.67 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="camel-unmetered"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One stream; automatic routing, no model pinning</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Unmetered; throughput unknown</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Luna</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="camel-unmetered"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One stream; automatic routing, no model pinning</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Unmetered; throughput unknown</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Muse Spark 1.3">
<summary class="inference-record-summary"><span class="inference-record-title">Muse Spark 1.3</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="camel-unmetered"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>One stream; automatic routing, no model pinning</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Unmetered; throughput unknown</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-minimax-token-plan" data-subscription="MiniMax Token Plan">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.minimax.io/docs/guides/pricing-token-plan">MiniMax Token Plan</a><span class="inference-record-subtitle"><a href="https://platform.minimax.io/docs/guides/pricing-token-plan">2 recorded models / aliases</a></span></span><span class="inference-record-metric">$22 / $55 / $132 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Text models only. Image and speech share quota but are outside this token comparison; published numerical allowance is insufficient.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="MiniMax M3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M3</span><span class="inference-record-metric">$13.30 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="minimax-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M2.7">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M2.7</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="minimax-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-kimi-membership-code" data-subscription="Kimi membership / Code">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://www.kimi.com/membership/pricing">Kimi membership / Code</a><span class="inference-record-subtitle"><a href="https://www.kimi.com/code/docs/en/kimi-code/membership.html">3 recorded models / aliases</a></span></span><span class="inference-record-metric">Plus $19 / Pro $39 / Max $99 / Ultra $199 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">No fixed comparable entitlement established. Membership K3 and Code aliases are distinguished; alias costs are not assumed to equal K3.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Kimi K3">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K3</span><span class="inference-record-metric">$73.04 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="kimi-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Plus and above; 1M context on Pro and above</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="kimi-for-coding">
<summary class="inference-record-summary"><span class="inference-record-title">kimi-for-coding</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="kimi-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Code alias; currently K2.8 Preview</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="kimi-for-coding-highspeed">
<summary class="inference-record-summary"><span class="inference-record-title">kimi-for-coding-highspeed</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="kimi-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Code HighSpeed alias; currently K2.7 Code; Pro and above</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-alibaba-cloud-coding-plan" data-subscription="Alibaba Cloud Coding Plan">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://www.alibabacloud.com/help/en/model-studio/coding-plan">Alibaba Cloud Coding Plan</a><span class="inference-record-subtitle"><a href="https://www.alibabacloud.com/help/en/model-studio/coding-plan">10 recorded models / aliases</a></span></span><span class="inference-record-metric">$50 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Request quotas cannot be converted without tokens per billable request. Automated scripts and application backends are excluded.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="qwen3.7-plus">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3.7-plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="qwen3.6-plus">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3.6-plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="kimi-k2.5">
<summary class="inference-record-summary"><span class="inference-record-title">kimi-k2.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="glm-5">
<summary class="inference-record-summary"><span class="inference-record-title">glm-5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax-M2.5">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax-M2.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="qwen3.5-plus">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3.5-plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="qwen3-max-2026-01-23">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3-max-2026-01-23</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="qwen3-coder-next">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3-coder-next</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="qwen3-coder-plus">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3-coder-plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="glm-4.7">
<summary class="inference-record-summary"><span class="inference-record-title">glm-4.7</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-deepseekv4pro-com" data-subscription="deepseekv4pro.com">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://deepseekv4pro.com/pricing">deepseekv4pro.com</a><span class="inference-record-subtitle"><a href="https://deepseekv4pro.com/pricing">5 recorded models / aliases</a></span></span><span class="inference-record-metric">Coding $19.90 / Coding Max $49.90 / Agent $49.90 / Coding Pro Max $199 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Independent reseller; published quotas conflict. Models added by the Agent plan are marked separately.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="DeepSeek V4.1 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4.1 Flash</span><span class="inference-record-metric">$1.23 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="reseller-conflict"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Coding tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Pro</span><span class="inference-record-metric">$6.25 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="reseller-conflict"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Agent plan (as DeepSeek V4)</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4-pro-0813/endpoints">$6.25</a><span class="inference-fact-note">Baidu, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3</span><span class="inference-record-metric">$27.28 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="reseller-conflict"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Agent plan only</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M3</span><span class="inference-record-metric">$13.30 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="reseller-conflict"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Agent plan only</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K3">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K3</span><span class="inference-record-metric">$73.04 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="reseller-conflict"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Agent plan only</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-mimo-token-plan" data-subscription="MiMo Token Plan">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">MiMo Token Plan</a><span class="inference-record-subtitle"><a href="https://mimo.mi.com/docs/en-US/price/token-plan">2 recorded models / aliases</a></span></span><span class="inference-record-metric">$6 / $16 / $50 / $100 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Text models only. Credit pools are shared across models; daytime and off-peak rows are alternative allocations.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="MiMo V2.6 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Flash</span><span class="inference-record-metric">8 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="mimo-lite-v26-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>650.12M (3.04M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.98</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>0.9% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-lite-v26-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>812.66M (3.79M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.58</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>20.7% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-standard-v26-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Standard; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.74B (8.14M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.96</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>1.5% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-standard-v26-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Standard; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.18B (10.18M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.57</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>21.2% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-pro-v26-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>6.03B (28.13M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.78</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>10.9% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-pro-v26-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>7.53B (35.17M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.42</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>28.7% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-max-v26-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>13.00B (60.71M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.65</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>17.4% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-max-v26-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>16.25B (75.89M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.32</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>33.9% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiMo V2.6 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Pro</span><span class="inference-record-metric">8 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="mimo-lite-pro-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>263.55M (1.23M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.88</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>4.2% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-lite-pro-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>329.44M (1.54M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.90</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>23.4% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-standard-pro-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Standard; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>707.10M (3.30M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.85</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>4.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-standard-pro-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Standard; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>883.87M (4.13M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.88</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>23.9% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-pro-pro-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.44B (11.41M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.38</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>13.9% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-pro-pro-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>3.05B (14.26M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.51</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>31.1% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-max-pro-daytime"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; daytime</dd></div><div><dt>Processed / 30 days (output)</dt><dd>5.27B (24.61M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$4.06</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>20.2% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="mimo-max-pro-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>6.59B (30.77M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.25</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>36.2% less</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-chutes" data-subscription="Chutes">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://chutes.ai/pricing">Chutes</a><span class="inference-record-subtitle"><a href="https://llm.chutes.ai/v1/models">14 recorded models / aliases</a></span></span><span class="inference-record-metric">$10 / $20 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Served catalog; exact subscription tier eligibility needs account confirmation. Flash capacity remains a conditional ceiling.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="google/gemma-4-31B-turbo-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">google/gemma-4-31B-turbo-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen/Qwen3.6-27B-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen/Qwen3.6-27B-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen/Qwen3.8-27B-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen/Qwen3.8-27B-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen/Qwen3.5-397B-A17B-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen/Qwen3.5-397B-A17B-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="zai-org/GLM-5.1-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">zai-org/GLM-5.1-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="deepseek-ai/DeepSeek-V3.2-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">deepseek-ai/DeepSeek-V3.2-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="zai-org/GLM-5.2-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">zai-org/GLM-5.2-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="moonshotai/Kimi-K2.6-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">moonshotai/Kimi-K2.6-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="deepseek-ai/DeepSeek-V4-Flash-0731-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">deepseek-ai/DeepSeek-V4-Flash-0731-TEE</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chutes-plus"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pinned V4 Flash 0731 checkpoint; compared with the V4.1 Flash routes DeepSeek now serves at the same list price; conditional ceiling</dd></div><div><dt>Processed / 30 days (output)</dt><dd>785.87M (3.67M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.73</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>122.1% more expensive</dd></div></dl></div><div class="inference-model-scenario" data-offer="chutes-pro"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pinned V4 Flash 0731 checkpoint; compared with the V4.1 Flash routes DeepSeek now serves at the same list price; conditional ceiling</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.57B (7.34M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.73</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>122.1% more expensive</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="unsloth/Mistral-Nemo-Instruct-2407-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">unsloth/Mistral-Nemo-Instruct-2407-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="moonshotai/Kimi-K3-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">moonshotai/Kimi-K3-TEE</span><span class="inference-record-metric">$73.04 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen/Qwen3-235B-A22B-Thinking-2507-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen/Qwen3-235B-A22B-Thinking-2507-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Qwen/Qwen3-32B-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">Qwen/Qwen3-32B-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Nemotron-3-Nano-Omni-30B-TEE">
<summary class="inference-record-summary"><span class="inference-record-title">Nemotron-3-Nano-Omni-30B-TEE</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-nanogpt" data-subscription="NanoGPT">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://nano-gpt.com/subscription">NanoGPT</a><span class="inference-record-subtitle"><a href="https://nano-gpt.com/api/subscription/v1/models?detailed=true">296 recorded models / aliases</a></span></span><span class="inference-record-metric">$12 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Subscription-included model/variant catalog. Per-model multipliers were not captured, so the 1x/2x quota examples cannot be assigned to individual IDs.</p><div class="inference-unassigned"><p class="inference-plan-label">Unassigned quota examples</p><ul><li><strong>Included model at 1x input weight</strong><span>$9.95 / 1M output + input</span></li><li><strong>Included model at 2x input weight</strong><span>$19.90 / 1M output + input</span></li></ul><p>Per-model weights remain unknown.</p></div><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="z-ai/glm-5.3-flash">
<summary class="inference-record-summary"><span class="inference-record-title">GLM 5.3 Flash</span><span class="inference-record-metric">$2.67 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="minimax/minimax-m3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M3</span><span class="inference-record-metric">$13.30 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="xiaomi/mimo-v2.6-flash">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Flash</span><span class="inference-record-metric">$1.99 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="xiaomi/mimo-v2.6-pro">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Pro</span><span class="inference-record-metric">$5.09 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="z-ai/glm-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM 5.3</span><span class="inference-record-metric">$27.28 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="deepseek/deepseek-v4-pro-0813">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Pro 0813</span><span class="inference-record-metric">$6.25 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4-pro-0813/endpoints">$6.25</a><span class="inference-fact-note">Baidu, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="deepseek/deepseek-v4.1-flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4.1 Flash</span><span class="inference-record-metric">$1.23 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div><details class="inference-catalog-disclosure"><summary>Show 289 additional NanoGPT catalog models / variants</summary><p>These IDs have no matched allowance or OpenRouter quote in this snapshot. Catalog coverage: Subscription-included endpoint.</p><ul class="inference-catalog-list"><li>Ternary Bonsai 2 27B</li><li>Clover 1 150B Preview</li><li>Gemma 4 31B Split-Untied</li><li>Muse Spark 1.3 Contributor</li><li>Mercury 2.5 Preview</li><li>Granite 4.2 8B</li><li>DiffusionGemma</li><li>Qwen 3.8 27B Cybersecurity</li><li>Gemma 4 26B A4B Cybersecurity</li><li>GLM 5.3 Flash Cybersecurity</li><li>Nemotron 3.5 Content Safety</li><li>TheDrummer/Artemis v1.1</li><li>GLM 5.3 Flash Uncensored</li><li>Qwen 3.8 27B Uncensored</li><li>Qwen 3.8 27B Queen</li><li>Qwen 3.8 27B Hemingway</li><li>Gemma 4 12B Semancer</li><li>Gemma 4 12B StationKeeper</li><li>Qwen 3.8 27B Fable</li><li>Qwen 3.8 27B Uncensored Thinking</li><li>Qwen 3.8 27B Obliterated</li><li>Qwen 3.8 27B Obliterated Thinking</li><li>Gemma 4 31B MeroMero v2</li><li>Gemma 4 31B MeroMero v2 Thinking</li><li>Gemma 4 26B A4B MeroMero</li><li>Gemma 4 26B A4B MeroMero Thinking</li><li>Gemma 4 26B A4B Musica</li><li>Gemma 4 26B A4B Shadow Siren</li><li>Gemma 4 26B A4B Chimera X</li><li>Gemma 4 26B A4B Luminous Mirror</li><li>Gemma 4 26B A4B Dark Soul</li><li>Gemma 4 26B A4B Moonlight Dusk</li><li>Gemma 4 26B A4B Opus Distill</li><li>Gemma 4 31B Fabled</li><li>Gemma 4 31B DarkIdol</li><li>Gemma 4 31B Garnet</li><li>Gemma 4 31B Novelist</li><li>Gemma 4 31B Isometry</li><li>Gemma 4 31B Gembrain</li><li>Gemma 4 31B Gemsicle</li><li>Ornith 1.5 35B</li><li>Ornith 1.5 35B Thinking</li><li>Qwen3.8 27B</li><li>Qwen3.8 27B Thinking</li><li>Gemma 4 12B Instruct</li><li>Laguna S 2.1</li><li>Laguna S 2.1 Thinking</li><li>Nvidia Nemotron 3.5 Lightning</li><li>Nvidia Nemotron 3.5 Lightning Thinking</li><li>Nvidia Nemotron 3 Ultra 550B</li><li>Nvidia Nemotron 3 Ultra 550B Thinking</li><li>LFM2.5 2.6B</li><li>Muse Glimmer 30B</li><li>Muse Spark 1.2 Contributor</li><li>LongCat 2.0</li><li>LongCat 2.0 Thinking</li><li>Step 3.7 Flash Thinking</li><li>Doubao Seed Character</li><li>NanoGPT Help</li><li>Auto model</li><li>Auto model (Basic)</li><li>Auto model (Standard)</li><li>Auto model (Premium)</li><li>Claw High</li><li>Claw Medium</li><li>Claw Low</li><li>Hermes High</li><li>Hermes Medium</li><li>Hermes Low</li><li>GPT OSS 120B</li><li>GPT OSS 20B</li><li>Amoral Gemma3 27B v2</li><li>Mistral Devstral Small 2505</li><li>Veiled Calla 12B</li><li>Qwen: QvQ Max</li><li>Step 3.5 Flash 2603</li><li>Step 3.5 Flash</li><li>Nex N2.5 Mini</li><li>Nex N2.5 Pro</li><li>Qwen 3 Coder 480B</li><li>Llama 4 Maverick</li><li>Llama 4 Scout</li><li>DeepSeek R1 0528</li><li>Kimi K2 Thinking</li><li>Kimi K2.5</li><li>Kimi K2.5 Thinking</li><li>Kimi K2.6</li><li>Kimi K2.7 Code</li><li>Kimi K2.6 Thinking</li><li>Ministral 3 14B</li><li>Mistral Small 4 119B</li><li>Mistral Small 4 119B Thinking</li><li>Devstral 2 123B</li><li>Hermes 4 Large (Thinking)</li><li>OpenReasoning Nemotron 32B</li><li>DeepSeek R1</li><li>DeepSeek V3/Deepseek Chat</li><li>MiniMax M2.5</li><li>Qwen 3 235b A22B</li><li>Qwen3.5 9B</li><li>Qwen 3 32b</li><li>Qwen 3 14b</li><li>Qwen3 30B A3B</li><li>Qwen3 Coder 30B A3B Instruct</li><li>Qwen 3 235b A22B 2507</li><li>Qwen 3 235b A22B 2507 Thinking</li><li>Qwen3 Next 80B A3B (Instruct)</li><li>Qwen3 Next 80B A3B (Thinking)</li><li>MiniMax M2</li><li>MiniMax M3 Thinking</li><li>MiniMax M2.7</li><li>MiniMax Latest</li><li>MiMo V2.5</li><li>MiMo V2.5 Thinking</li><li>MiMo V2.5 Pro</li><li>MiMo V2.5 Pro Thinking</li><li>MiniMax M2.1</li><li>GLM 4.6</li><li>GLM 4.6 Thinking</li><li>GLM 5</li><li>GLM 5 Thinking</li><li>GLM 5.1</li><li>GLM Latest</li><li>GLM 5.1 Thinking</li><li>GLM 5.2</li><li>GLM 5.2 Thinking</li><li>GLM 5.3 Thinking</li><li>GLM 4.7 Flash</li><li>GLM 4.7 Flash Thinking</li><li>GLM 4.7</li><li>GLM 4.7 Thinking</li><li>GLM 4.6V</li><li>Qwen3 30B A3B Instruct 2507</li><li>Llama 3.3 70b Instruct</li><li>Nvidia Nemotron 70b</li><li>Sao10K Stheno 8b</li><li>Grayline Qwen3 8B</li><li>Hermes 4 Large</li><li>Hermes 3 70B</li><li>Qwen3.8 Flash</li><li>Qwen3.5 122B A10B</li><li>Qwen3.5 122B A10B Thinking</li><li>Qwen3.5 27B</li><li>Qwen3.5 27B Thinking</li><li>Qwen3.5 35B A3B</li><li>Qwen3.5 35B A3B Thinking</li><li>Qwen3.6 35B A3B</li><li>Qwen3.6 35B A3B Thinking</li><li>Qwen3.6 27B</li><li>Qwen3.6 27B Thinking</li><li>DeepSeek V3.2 Exp</li><li>DeepSeek V3.2 Exp Thinking</li><li>DeepSeek V3.2</li><li>DeepSeek V3.2 Thinking</li><li>DeepSeek V4 Flash</li><li>DeepSeek V4 Flash Vision Exp</li><li>DeepSeek V4 Flash 0731</li><li>DeepSeek V4 Flash Latest</li><li>DeepSeek V4 Flash 0731 (Thinking)</li><li>DeepSeek V4 Flash (Thinking)</li><li>DeepSeek V4 Pro 0813 Thinking</li><li>DeepSeek V4 Pro</li><li>DeepSeek Latest</li><li>DeepSeek V4 Pro (Thinking)</li><li>Qwen3.5 397B A17B</li><li>Qwen3.5 397B A17B Thinking</li><li>DeepSeek V4.1 Flash Thinking</li><li>Qwen 2.5 Coder 32b</li><li>Phi 4 Multimodal</li><li>Phi 4 Mini</li><li>The Drummer Cydonia 24B v2</li><li>The Drummer Cydonia 24B v4</li><li>The Drummer Cydonia 24B v4.1</li><li>The Drummer Cydonia 24B v4.3</li><li>The Drummer Magidonia 24B v4.3</li><li>MS3.2 24B Magnum Diamond</li><li>Omega Directive 24B Unslop v2.0</li><li>EVA Llama 3.33 70B</li><li>Steelskull Nevoria 70b</li><li>Steelskull Nevoria R1 70b</li><li>Steelskull Electra R1 70b</li><li>Qwen2 72B Dracarys</li><li>Lumimaid v0.2</li><li>DeepSeek V3/Chat Cheaper</li><li>Llama 3.3 70B Instruct abliterated</li><li>MythoMax 13B</li><li>Qwen2.5 72B</li><li>EVA-Qwen2.5-32B-v0.2</li><li>TheDrummer Skyfall 36B V2</li><li>Qwen 3 8B</li><li>K2-Think</li><li>DeepSeek V3.1</li><li>DeepSeek V3.1 Thinking</li><li>DeepSeek V3.1 Terminus</li><li>DeepSeek V3.1 Terminus (Thinking)</li><li>DeepSeek Chat 0324</li><li>GLM 4.5 (Thinking)</li><li>GLM 4.5</li><li>GLM 4.5 Air</li><li>GLM 4.5 Air (Thinking)</li><li>MN-LooseCannon-12B-v1</li><li>EVA-Qwen2.5-72B-v0.2</li><li>EVA-LLaMA-3.33-70B-v0.1</li><li>Llama 3.1 8b Instruct</li><li>ReMM SLERP 13B</li><li>Mistral Saba</li><li>Neural Daredevil 8B abliterated</li><li>Llama 3 70B abliterated</li><li>Magnum V2 72B</li><li>Mistral Nemo</li><li>DeepSeek Reasoner</li><li>Llama 3.05 Storybreaker Ministral 70b</li><li>Nemotron Tenyxchat Storybreaker 70b</li><li>Mag Mell R1</li><li>Qwerky 72B</li><li>Anubis 70B v1</li><li>Anubis 70B v1.1</li><li>Llama 3.2 3b Instruct</li><li>Llama 3.1 8B (decentralized)</li><li>Llama 3.1 70B Hanami</li><li>Rocinante 12b</li><li>Llama 3.3 70B Euryale</li><li>Llama 3.1 70B Euryale</li><li>Llama 3.3 70B Cu Mai</li><li>UnslopNemo 12b v4</li><li>NemoMix 12B Unleashed</li><li>Mistral Nemo Starcannon 12b v1</li><li>Llama 3.1 70B Celeste v0.1</li><li>DeepSeek R1 Qwen Abliterated</li><li>DeepSeek R1 Llama 70B Abliterated</li><li>Qwen 2.5 32B Abliterated</li><li>Deepseek R1 Cheaper</li><li>Llama 3.3 70B Wayfarer</li><li>Gemma 3 27B IT</li><li>Gemma 3 12B IT</li><li>Gemma 3 4B IT</li><li>Qwen25 VL 72b</li><li>Holo3-35B-A3B</li><li>Holo3-35B-A3B Thinking</li><li>Cogito v1 Preview Qwen 32B</li><li>Llama-xLAM-2 70B fc-r</li><li>Mistral Small 3.1 24B (2503)</li><li>Mistral Small 3.2 24B (2506)</li><li>Nvidia Nemotron Super 49B</li><li>Shisa V2 Llama 3.3 70B</li><li>Shisa V2.1 Llama 3.3 70B</li><li>GLM 4 9B 0414</li><li>GLM 4 32B 0414</li><li>Qwen3.5 27B Blossom V6.4 Derestricted</li><li>Qwen3.5 27B Claude 4.6 Opus Reasoning Distilled Derestricted</li><li>Qwen3.5 27B Claude 4.6 Opus Reasoning Distilled Derestricted Lite</li><li>Gemma 4 31B Agares v1</li><li>Gemma 4 31B Animus V14.1</li><li>Gemma 4 31B AssGuard</li><li>Gemma 4 31B Dark Gemistry</li><li>Gemma 4 31B Gembrain Uncensored Heretic</li><li>Gemma 4 31B Gembrain X Core</li><li>Gemma 4 31B Isometry RP</li><li>Gemma 4 31B Novelist (ArliAI)</li><li>Gemma 4 31B SDFT Heretic RP</li><li>Gemma 4 31B StyleTune</li><li>Qwen3.5 27B BlueStar v3 Derestricted</li><li>Qwen3.5 27B Queen Derestricted</li><li>Gemma 4 31B Claude 4.6 Opus Reasoning Distilled</li><li>Gemma 4 31B Cognitive Unshackled</li><li>Gemma 4 31B DarkIdol (ArliAI)</li><li>Gemma 4 31B Fabled (ArliAI)</li><li>Gemma 4 31B Garnet V2</li><li>Gemma 4 31B K1 v5</li><li>Gemma 4 31B MeroMero</li><li>Gemma 4 31B Queen</li><li>GLM 4.6 Derestricted v5</li><li>Venice Uncensored</li><li>Gemma 4 26B A4B</li><li>Gemma 4 26B A4B Thinking</li><li>Tencent Hy3</li><li>Qwen3 Coder Next</li><li>Ling 3.0 Flash VL</li><li>Ling 3.0 Flash</li><li>Ling 3.0 Flash Thinking</li><li>Gemma 4 31B</li><li>Gemma 4 31B Thinking</li><li>Nvidia Nemotron 3 Nano 30B</li><li>Nvidia Nemotron 3 Super 120B</li><li>Nvidia Nemotron 3 Super 120B Thinking</li><li>Manta Mini 1.0</li><li>Mistral Code Agent Latest</li><li>Synth 2.5 Flash Preview</li><li>Synth 2.5 Pro Preview</li></ul></details></div>
</details>
<details class="inference-subscription-record" id="inference-plan-kilo-pass" data-subscription="Kilo Pass">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://kilo.ai/pricing/kilo-pass">Kilo Pass</a><span class="inference-record-subtitle"><a href="https://api.kilo.ai/api/gateway/models">394 recorded models / aliases</a></span></span><span class="inference-record-metric">$19 / $49 / $199 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Gateway catalog includes free and paid variants. Annual credit bonus is modeled only where provider rates were captured; catalog presence alone does not establish eligibility.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="deepseek/deepseek-v4.1-flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek: DeepSeek V4.1 Flash</span><span class="inference-record-metric">$1.23 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="z-ai/glm-5.3-flash">
<summary class="inference-record-summary"><span class="inference-record-title">Z.ai: GLM 5.3 Flash</span><span class="inference-record-metric">$2.67 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="moonshotai/kimi-k3">
<summary class="inference-record-summary"><span class="inference-record-title">MoonshotAI: Kimi K3</span><span class="inference-record-metric">$73.04 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="minimax/minimax-m3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax: MiniMax M3</span><span class="inference-record-metric">3 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="kilo-starter-m3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Starter annual billing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>387.20M (1.81M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$10.51</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>21.0% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="kilo-pro-m3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro annual billing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>998.57M (4.66M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$10.51</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>21.0% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="kilo-expert-m3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Expert annual billing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>4.06B (18.94M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$10.51</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>21.0% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="xiaomi/mimo-v2.6-flash">
<summary class="inference-record-summary"><span class="inference-record-title">Xiaomi: MiMo-V2.6-Flash</span><span class="inference-record-metric">$1.99 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="xiaomi/mimo-v2.6-pro">
<summary class="inference-record-summary"><span class="inference-record-title">Xiaomi: MiMo-V2.6-Pro</span><span class="inference-record-metric">$5.09 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-pro/endpoints">$5.09</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="z-ai/glm-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">Z.ai: GLM 5.3</span><span class="inference-record-metric">$27.28 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="deepseek/deepseek-v4-pro-0813">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek: DeepSeek V4 Pro 0813</span><span class="inference-record-metric">$6.25 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4-pro-0813/endpoints">$6.25</a><span class="inference-fact-note">Baidu, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="anthropic/claude-sonnet-5">
<summary class="inference-record-summary"><span class="inference-record-title">Anthropic: Claude Sonnet 5</span><span class="inference-record-metric">3 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="kilo-starter-sonnet"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Starter annual billing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>91.59M (0.43M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$44.43</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="kilo-pro-sonnet"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro annual billing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>236.21M (1.10M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$44.43</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="kilo-expert-sonnet"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Expert annual billing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>959.32M (4.48M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$44.43</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div></div>
</details></div><details class="inference-catalog-disclosure"><summary>Show 385 additional Kilo Pass catalog models / variants</summary><p>These IDs have no matched allowance or OpenRouter quote in this snapshot. Catalog coverage: Served catalog; consult plan terms for eligibility.</p><ul class="inference-catalog-list"><li>Auto Efficient</li><li>Auto Free</li><li>Space Bunny Alpha (new)</li><li>Poolside: Laguna S 2.1 (free)</li><li>NVIDIA: Nemotron 3 Ultra (free)</li><li>Dots Studio: Dots3-Note Preview (free)</li><li>Anthropic: Claude Opus 5.5 (new)</li><li>OpenAI: GPT-6 Sol (new)</li><li>Fireworks: Ember-1</li><li>Z.ai: GLM 5.3 Prime</li><li>Qwen: Qwen3.8 Max Prime</li><li>AionLabs: Aion 3.5 Mini</li><li>AionLabs: Aion 3.5</li><li>Upstage: Solar Mini 4</li><li>Cohere: Command A+</li><li>OpenAI: GPT-6 Luna Pro</li><li>OpenAI: GPT-6 Luna</li><li>OpenAI: GPT-6 Sol Pro</li><li>Xiaomi: MiMo-V2.6-Pro-UltraSpeed</li><li>SpaceXAI: Grok 4.7</li><li>Qwen: Qwen3.8 Omni Flash</li><li>PrismML: Ternary Bonsai 2 27B</li><li>Z.ai: GLM 5.3 FlashX</li><li>Pareto</li><li>DeepSeek: DeepSeek Pro Latest</li><li>DeepSeek: DeepSeek Flash Latest</li><li>Inference.net: Schematron V2 Turbo</li><li>Inference.net: Schematron V2 Small</li><li>OpenAI: GPT Astra Latest ($$$$)</li><li>OpenAI: GPT Sol Latest</li><li>OpenAI: GPT Terra Latest</li><li>OpenAI: GPT Luna Latest</li><li>Sakana: Fugu Ultra v2</li><li>Sakana: Fugu Max</li><li>inclusionAI: Ling 3.0 Flash VL</li><li>Inception: Mercury 2.5</li><li>OpenAI: GPT-6 Astra ($$$$)</li><li>OpenAI: GPT-6 Astra Pro ($$$$)</li><li>inclusionAI: Ling 3.0 Flash Sante (free)</li><li>Qwen: Qwen3.8 Max (0902)</li><li>Meta: Muse Spark 1.3 Contributor</li><li>Meta: Muse Spark 1.3</li><li>Google: Gemini 3.8 Flash (50% off)</li><li>Anthropic: Claude Fable 5.1 ($$$$)</li><li>IBM: Granite 4.2 8B</li><li>Tencent: Hy4 preview</li><li>inclusionAI: Ling 3.0 Flash Fin</li><li>inclusionAI: Ling 3.0 Flash Fin (free)</li><li>Z.ai: GLM Flash Latest</li><li>Qwen: Qwen3.8 Flash</li><li>Meta: Muse Spark 1.2 Contributor</li><li>DeepSeek: DeepSeek V4 Flash Vision Exp</li><li>Tencent: Hy-MT2-1.8B</li><li>Tencent: Hy-MT2-30B-A3B</li><li>Z.ai: GLM Latest</li><li>Tencent: Hy-MT2-7B</li><li>Qwen: Qwen3.8 27B</li><li>Qwen: Qwen3.8 27B (free)</li><li>Google: Gemini 3.7 Flash</li><li>ByteDance Seed: Seed 2.1 Turbo</li><li>Qwen: Qwen3.8 2.4T A95B</li><li>ByteDance Seed: Seed-2.0-Code</li><li>SpaceXAI: Grok 4.6</li><li>LiquidAI: LFM2.5-2.6B (free)</li><li>NVIDIA: Nemotron 3.5 Lightning</li><li>NVIDIA: Nemotron 3.5 Lightning (free)</li><li>Sakana: Sakana Namazu</li><li>Upstage: Solar Pro 4</li><li>Meta: Muse Glimmer 30B</li><li>Meta: Muse Spark 1.2</li><li>DeepSeek: DeepSeek V4 Flash Latest</li><li>DeepSeek: DeepSeek V4 Flash 0731</li><li>Thinking Machines: Inkling Small</li><li>Thinking Machines: Inkling Small (free)</li><li>Qwen: Qwen3.7 Flash</li><li>Anthropic: Claude Opus 5</li><li>inclusionAI: Ling 3.0 Flash</li><li>Poolside: Laguna S 2.1</li><li>Google: Gemini 3.6 Flash</li><li>Google: Gemini 3.5 Flash Lite</li><li>Meituan: LongCat 2.0</li><li>Thinking Machines: Inkling</li><li>OpenRouter Auto Router (Beta)</li><li>Meta: Muse Spark 1.1</li><li>Kwaipilot: KAT-Coder-Pro V2.5</li><li>OpenAI: GPT-5.6 Luna Pro</li><li>OpenAI: GPT-5.6 Luna</li><li>OpenAI: GPT-5.6 Terra Pro</li><li>OpenAI: GPT-5.6 Terra</li><li>OpenAI: GPT-5.6 Sol Pro</li><li>OpenAI: GPT-5.6 Sol</li><li>SpaceXAI: Grok 4.5</li><li>xAI: Grok Latest</li><li>AionLabs: Aion-3.0-Mini</li><li>AionLabs: Aion-3.0</li><li>Tencent: Hy3</li><li>Poolside: Laguna XS 2.1</li><li>Poolside: Laguna XS 2.1 (free)</li><li>Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)</li><li>Sakana: Fugu Ultra</li><li>Google: Nano Banana 2 (Gemini 3.1 Flash Image)</li><li>Google: Nano Banana Pro (Gemini 3 Pro Image)</li><li>Cohere: North Mini Code (free)</li><li>Z.ai: GLM 5.2</li><li>Z.ai: GLM 5.2 (free)</li><li>OpenRouter: Fusion</li><li>MoonshotAI: Kimi K2.7 Code</li><li>Anthropic: Claude Fable Latest ($$$$)</li><li>Anthropic: Claude Fable 5 ($$$$)</li><li>NVIDIA: Nemotron 3.5 Content Safety</li><li>NVIDIA: Nemotron 3.5 Content Safety (free)</li><li>NVIDIA: Nemotron 3 Ultra</li><li>Qwen: Qwen3.7 Plus</li><li>StepFun: Step 3.7 Flash</li><li>Anthropic: Claude Opus 4.8</li><li>Qwen: Qwen3.7 Max</li><li>SpaceXAI: Grok Build 0.1</li><li>Google: Gemini 3.5 Flash</li><li>Perceptron: Perceptron Mk1</li><li>Google: Gemini 3.1 Flash Lite</li><li>OpenAI: GPT Chat Latest</li><li>SpaceXAI: Grok 4.3</li><li>Mistral: Mistral Medium 3.5</li><li>NVIDIA: Nemotron 3 Nano Omni (free)</li><li>Anthropic: Claude Haiku Latest</li><li>OpenAI: GPT Mini Latest</li><li>Google: Gemini Pro Latest</li><li>MoonshotAI: Kimi Latest</li><li>Google: Gemini Flash Latest</li><li>Anthropic: Claude Sonnet Latest</li><li>Qwen: Qwen3.5 Plus 2026-04-20</li><li>Qwen: Qwen3.6 Flash</li><li>Qwen: Qwen3.6 35B A3B</li><li>Qwen: Qwen3.6 Max Preview (retires Oct 9)</li><li>Qwen: Qwen3.6 27B</li><li>OpenAI: GPT-5.5 Pro ($$$$)</li><li>OpenAI: GPT-5.5</li><li>DeepSeek: DeepSeek V4 Pro 0423</li><li>DeepSeek: DeepSeek V4 Flash 0423</li><li>Tencent: Hy3 preview</li><li>Xiaomi: MiMo-V2.5-Pro</li><li>Xiaomi: MiMo-V2.5</li><li>OpenAI: GPT-5.4 Image 2</li><li>Anthropic: Claude Opus Latest</li><li>OpenRouter Pareto Code Router</li><li>MoonshotAI: Kimi K2.6</li><li>Anthropic: Claude Opus 4.7</li><li>Z.ai: GLM 5.1</li><li>Google: Gemma 4 26B A4B </li><li>Google: Gemma 4 31B</li><li>Qwen: Qwen3.6 Plus</li><li>Z.ai: GLM 5V Turbo</li><li>Arcee AI: Trinity Large Thinking</li><li>SpaceXAI: Grok 4.20 Multi-Agent</li><li>SpaceXAI: Grok 4.20</li><li>Google: Lyria 3 Pro Preview</li><li>Google: Lyria 3 Clip Preview</li><li>Reka Edge</li><li>MiniMax: MiniMax M2.7</li><li>OpenAI: GPT-5.4 Nano</li><li>OpenAI: GPT-5.4 Mini</li><li>Mistral: Mistral Small 4</li><li>Z.ai: GLM 5 Turbo</li><li>NVIDIA: Nemotron 3 Super</li><li>NVIDIA: Nemotron 3 Super (free)</li><li>ByteDance Seed: Seed-2.0-Lite</li><li>Qwen: Qwen3.5-9B</li><li>OpenAI: GPT-5.4 Pro ($$$$)</li><li>OpenAI: GPT-5.4</li><li>Inception: Mercury 2</li><li>Google: Gemini 3.1 Flash Lite Preview</li><li>ByteDance Seed: Seed-2.0-Mini</li><li>Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)</li><li>Qwen: Qwen3.5-35B-A3B</li><li>Qwen: Qwen3.5-27B</li><li>Qwen: Qwen3.5-122B-A10B</li><li>Qwen: Qwen3.5-Flash</li><li>Google: Gemini 3.1 Pro Preview Custom Tools</li><li>OpenAI: GPT-5.3-Codex</li><li>AionLabs: Aion-2.0</li><li>Google: Gemini 3.1 Pro Preview</li><li>Anthropic: Claude Sonnet 4.6</li><li>Qwen: Qwen3.5 Plus 2026-02-15</li><li>Qwen: Qwen3.5 397B A17B</li><li>MiniMax: MiniMax M2.5</li><li>Z.ai: GLM 5</li><li>Qwen: Qwen3 Max Thinking (retires Oct 9)</li><li>Anthropic: Claude Opus 4.6</li><li>Qwen: Qwen3 Coder Next</li><li>OpenRouter Free Models Router</li><li>StepFun: Step 3.5 Flash</li><li>MoonshotAI: Kimi K2.5</li><li>Upstage: Solar Pro 3</li><li>MiniMax: MiniMax M2-her</li><li>Writer: Palmyra X5</li><li>OpenAI: GPT Audio</li><li>OpenAI: GPT Audio Mini</li><li>Z.ai: GLM 4.7 Flash</li><li>OpenAI: GPT-5.2-Codex</li><li>ByteDance Seed: Seed 1.6 Flash</li><li>ByteDance Seed: Seed 1.6</li><li>MiniMax: MiniMax M2.1 (retires Oct 8)</li><li>Z.ai: GLM 4.7</li><li>Google: Gemini 3 Flash Preview</li><li>NVIDIA: Nemotron 3 Nano 30B A3B</li><li>OpenAI: GPT-5.2 Chat</li><li>OpenAI: GPT-5.2 Pro ($$$$)</li><li>OpenAI: GPT-5.2</li><li>Mistral: Devstral 2 2512</li><li>Relace: Relace Search</li><li>Z.ai: GLM 4.6V</li><li>OpenRouter Body Builder (beta)</li><li>OpenAI: GPT-5.1-Codex-Max</li><li>Amazon: Nova 2 Lite</li><li>Mistral: Ministral 3 14B 2512</li><li>Mistral: Ministral 3 8B 2512</li><li>Mistral: Ministral 3 3B 2512</li><li>Mistral: Mistral Large 3 2512</li><li>DeepSeek: DeepSeek V3.2 (retires Sep 28)</li><li>Anthropic: Claude Opus 4.5</li><li>Google: Nano Banana Pro (Gemini 3 Pro Image Preview)</li><li>OpenAI: GPT-5.1</li><li>OpenAI: GPT-5.1-Codex</li><li>OpenAI: GPT-5.1-Codex-Mini</li><li>MoonshotAI: Kimi K2 Thinking</li><li>Amazon: Nova Premier 1.0</li><li>Perplexity: Sonar Pro Search</li><li>Mistral: Voxtral Small 24B 2507</li><li>OpenAI: gpt-oss-safeguard-20b</li><li>MiniMax: MiniMax M2</li><li>Qwen: Qwen3 VL 32B Instruct (retires Oct 9)</li><li>IBM: Granite 4.0 Micro</li><li>OpenAI: GPT-5 Image Mini</li><li>Anthropic: Claude Haiku 4.5</li><li>Qwen: Qwen3 VL 8B Thinking (retires Oct 9)</li><li>Qwen: Qwen3 VL 8B Instruct (retires Oct 9)</li><li>OpenAI: GPT-5 Image ($$$$)</li><li>Google: Nano Banana (Gemini 2.5 Flash Image)</li><li>Qwen: Qwen3 VL 30B A3B Thinking (retires Oct 9)</li><li>Qwen: Qwen3 VL 30B A3B Instruct</li><li>OpenAI: GPT-5 Pro ($$$$)</li><li>Z.ai: GLM 4.6</li><li>Anthropic: Claude Sonnet 4.5</li><li>DeepSeek: DeepSeek V3.2 Exp (retires Sep 28)</li><li>TheDrummer: Cydonia 24B V4.1</li><li>Relace: Relace Apply 3</li><li>Qwen: Qwen3 VL 235B A22B Thinking (retires Oct 9)</li><li>Qwen: Qwen3 VL 235B A22B Instruct</li><li>Qwen: Qwen3 Max (retires Oct 9)</li><li>Qwen: Qwen3 Coder Plus (retires Oct 9)</li><li>DeepSeek: DeepSeek V3.1 Terminus (retires Sep 28)</li><li>Qwen: Qwen3 Coder Flash</li><li>Qwen: Qwen3 Next 80B A3B Thinking</li><li>Qwen: Qwen3 Next 80B A3B Instruct</li><li>Qwen: Qwen Plus 0728 (retires Oct 9)</li><li>MoonshotAI: Kimi K2 0905</li><li>Qwen: Qwen3 30B A3B Thinking 2507 (retires Oct 9)</li><li>Nous: Hermes 4 405B</li><li>DeepSeek: DeepSeek V3.1</li><li>Mistral: Mistral Medium 3.1</li><li>Z.ai: GLM 4.5V</li><li>OpenAI: GPT-5</li><li>OpenAI: GPT-5 Mini</li><li>OpenAI: GPT-5 Nano</li><li>OpenAI: gpt-oss-120b</li><li>OpenAI: gpt-oss-20b</li><li>Anthropic: Claude Opus 4.1 ($$$$)</li><li>Mistral: Codestral 2508</li><li>Qwen: Qwen3 Coder 30B A3B Instruct</li><li>Qwen: Qwen3 30B A3B Instruct 2507</li><li>Z.ai: GLM 4.5</li><li>Z.ai: GLM 4.5 Air</li><li>Qwen: Qwen3 235B A22B Thinking 2507 (retires Oct 9)</li><li>Qwen: Qwen3 Coder 480B A35B</li><li>ByteDance: UI-TARS 7B </li><li>Google: Gemini 2.5 Flash Lite (retires Oct 20)</li><li>Qwen: Qwen3 235B A22B Instruct 2507</li><li>MoonshotAI: Kimi K2 0711</li><li>Venice: Uncensored</li><li>Tencent: Hunyuan A13B Instruct</li><li>Morph: Morph V3 Large</li><li>Morph: Morph V3 Fast</li><li>Baidu: ERNIE 4.5 VL 424B A47B  (retires Oct 8)</li><li>Mistral: Mistral Small 3.2 24B</li><li>MiniMax: MiniMax M1</li><li>Google: Gemini 2.5 Flash (retires Oct 20)</li><li>Google: Gemini 2.5 Pro (retires Oct 20)</li><li>OpenAI: o3 Pro ($$$$)</li><li>Google: Gemini 2.5 Pro Preview 06-05</li><li>DeepSeek: R1 0528</li><li>Anthropic: Claude Sonnet 4</li><li>Mistral: Mistral Medium 3</li><li>Meta: Llama Guard 4 12B</li><li>Qwen: Qwen3 30B A3B</li><li>Qwen: Qwen3 8B (retires Oct 9)</li><li>Qwen: Qwen3 14B</li><li>Qwen: Qwen3 32B</li><li>Qwen: Qwen3 235B A22B (retires Oct 9)</li><li>OpenAI: o4 Mini High</li><li>OpenAI: o3</li><li>OpenAI: o4 Mini</li><li>OpenAI: GPT-4.1</li><li>OpenAI: GPT-4.1 Mini</li><li>OpenAI: GPT-4.1 Nano</li><li>Meta: Llama 4 Maverick</li><li>Meta: Llama 4 Scout</li><li>DeepSeek: DeepSeek V3 0324</li><li>OpenAI: o1-pro ($$$$)</li><li>Mistral: Mistral Small 3.1 24B</li><li>Google: Gemma 3 4B</li><li>Google: Gemma 3 12B</li><li>Cohere: Command A</li><li>Reka Flash 3</li><li>Google: Gemma 3 27B</li><li>TheDrummer: Skyfall 36B V2</li><li>Perplexity: Sonar Reasoning Pro</li><li>Perplexity: Sonar Pro</li><li>Perplexity: Sonar Deep Research</li><li>Mistral: Saba</li><li>OpenAI: o3 Mini High</li><li>AionLabs: Aion-RP 1.0 (8B)</li><li>Qwen: Qwen2.5 VL 72B Instruct</li><li>Qwen: Qwen-Plus</li><li>OpenAI: o3 Mini</li><li>Mistral: Mistral Small 3</li><li>Perplexity: Sonar</li><li>DeepSeek: R1 Distill Llama 70B (retires Sep 28)</li><li>DeepSeek: R1</li><li>MiniMax: MiniMax-01</li><li>Microsoft: Phi 4</li><li>DeepSeek: DeepSeek V3</li><li>Sao10K: Llama 3.3 Euryale 70B</li><li>OpenAI: o1 ($$$$)</li><li>Cohere: Command R7B (12-2024)</li><li>Meta: Llama 3.3 70B Instruct</li><li>Amazon: Nova Lite 1.0</li><li>Amazon: Nova Micro 1.0</li><li>Amazon: Nova Pro 1.0</li><li>OpenAI: GPT-4o (2024-11-20)</li><li>Mistral Large 2407</li><li>Qwen2.5 Coder 32B Instruct</li><li>TheDrummer: UnslopNemo 12B</li><li>Magnum v4 72B</li><li>Qwen: Qwen2.5 7B Instruct</li><li>Meta: Llama 3.2 1B Instruct</li><li>Meta: Llama 3.2 3B Instruct</li><li>Qwen2.5 72B Instruct</li><li>Cohere: Command R (08-2024)</li><li>Cohere: Command R+ (08-2024)</li><li>Sao10K: Llama 3.1 Euryale 70B v2.2</li><li>Nous: Hermes 3 70B Instruct</li><li>Nous: Hermes 3 405B Instruct</li><li>Sao10K: Llama 3 8B Lunaris</li><li>OpenAI: GPT-4o (2024-08-06)</li><li>Meta: Llama 3.1 70B Instruct</li><li>Meta: Llama 3.1 8B Instruct</li><li>Mistral: Mistral Nemo</li><li>OpenAI: GPT-4o-mini</li><li>OpenAI: GPT-4o-mini (2024-07-18)</li><li>Google: Gemma 2 27B</li><li>OpenAI: GPT-4o</li><li>OpenAI: GPT-4o (2024-05-13)</li><li>Mistral: Mixtral 8x22B Instruct</li><li>WizardLM-2 8x22B</li><li>OpenAI: GPT-4 Turbo ($$$$)</li><li>Anthropic: Claude 3 Haiku</li><li>Mistral Large</li><li>OpenAI: GPT-3.5 Turbo (older v0613)</li><li>OpenRouter Auto Router</li><li>OpenAI: GPT-3.5 Turbo Instruct</li><li>OpenAI: GPT-3.5 Turbo 16k</li><li>Mancer: Weaver (alpha)</li><li>ReMM SLERP 13B</li><li>MythoMax 13B</li><li>OpenAI: GPT-3.5 Turbo</li><li>OpenAI: GPT-4 ($$$$)</li><li>Stealth: Qwen3.6 Plus (50% off)</li><li>Stealth: Claude Opus 4.8 (20% off)</li><li>Stealth: Claude Opus 4.7 (20% off)</li><li>Stealth: Claude Sonnet 4.6 (20% off)</li><li>Stealth: Claude Opus 4.6 (20% off)</li><li>StepFun: Step 3.7 Flash (free)</li><li>Auto Frontier</li><li>Auto Balanced</li><li>Auto Small</li></ul></details></div>
</details>
<details class="inference-subscription-record" id="inference-plan-chatgpt-codex" data-subscription="ChatGPT (Codex)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://learn.chatgpt.com/docs/pricing">ChatGPT (Codex)</a><span class="inference-record-subtitle"><a href="https://learn.chatgpt.com/docs/pricing">9 recorded models / aliases</a></span></span><span class="inference-record-metric">Go $8 / Plus $20 / Pro from $100 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Message estimates per five hours are published per model and tier; they are ranges, not a convertible token allowance. The Pro 20x price is not stated on the Codex pricing page and chatgpt.com/pricing blocks automated retrieval.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="GPT-6 Astra">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-6 Astra</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-6 Sol">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-6 Sol</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-6 Luna</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Sol">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Sol</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Terra">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Terra</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Luna</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.5">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.4">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.4</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.4 mini">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.4 mini</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="chatgpt-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-claude-claude-code" data-subscription="Claude (Claude Code)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://support.claude.com/en/articles/11049741-what-is-the-max-plan">Claude (Claude Code)</a><span class="inference-record-subtitle"><a href="https://claude.com/pricing">3 recorded models / aliases</a></span></span><span class="inference-record-metric">Pro $20 / Max 5x $100 / Max 20x $200 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Tier multiples are published; the base allowance is not, so no token capacity is calculated.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Claude Fable 5.1">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Fable 5.1</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="claude-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Opus 5.5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Opus 5.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="claude-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Sonnet 5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Sonnet 5</span><span class="inference-record-metric">$70.31 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="claude-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-cursor" data-subscription="Cursor">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://cursor.com/help/account-and-billing/pricing.md">Cursor</a><span class="inference-record-subtitle"><a href="https://cursor.com/docs/models-and-pricing">13 recorded models / aliases</a></span></span><span class="inference-record-metric">Pro $20 / Pro+ $60 / Ultra $200 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Per-model rates are published, but the included amount per plan is not, so no token capacity is calculated.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Grok 4.7">
<summary class="inference-record-summary"><span class="inference-record-title">Grok 4.7</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Cursor Models pool</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Grok 4.6">
<summary class="inference-record-summary"><span class="inference-record-title">Grok 4.6</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Cursor Models pool</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Grok 4.5">
<summary class="inference-record-summary"><span class="inference-record-title">Grok 4.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Cursor Models pool</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Composer 2.5">
<summary class="inference-record-summary"><span class="inference-record-title">Composer 2.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Cursor Models pool</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Fable 5.1">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Fable 5.1</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Opus 5.5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Opus 5.5</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Sonnet 5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Sonnet 5</span><span class="inference-record-metric">$70.31 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Gemini 3.1 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">Gemini 3.1 Pro</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Gemini 3.8 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">Gemini 3.8 Flash</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Sol">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Sol</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Terra">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Terra</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-5.6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-5.6 Luna</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Muse Spark 1.3">
<summary class="inference-record-summary"><span class="inference-record-title">Muse Spark 1.3</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cursor-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Other Models pool, at API price</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-github-copilot" data-subscription="GitHub Copilot">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://docs.github.com/en/copilot/concepts/billing/usage-based-billing-for-individuals">GitHub Copilot</a><span class="inference-record-subtitle"><a href="https://docs.github.com/en/copilot/reference/copilot-billing/models-and-pricing">3 recorded models / aliases</a></span></span><span class="inference-record-metric">Pro $10 / Pro+ $39 / Max $100 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Only three models are calculated; every listed model draws on the same credit pool at its own rates. Paid plans get 10% off model costs under auto model selection, which is excluded here.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Claude Sonnet 5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Sonnet 5</span><span class="inference-record-metric">3 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="copilot-pro-sonnet5"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>48.21M (0.23M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$44.43</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="copilot-pro-plus-sonnet5"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro+</dd></div><div><dt>Processed / 30 days (output)</dt><dd>224.97M (1.05M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$37.13</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>47.2% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="copilot-max-sonnet5"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>642.76M (3.00M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$33.32</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>52.6% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Opus 5.5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Opus 5.5</span><span class="inference-record-metric">3 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="copilot-pro-opus55"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>34.87M (0.16M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$61.42</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="copilot-pro-plus-opus55"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro+</dd></div><div><dt>Processed / 30 days (output)</dt><dd>162.73M (0.76M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$51.33</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="copilot-max-opus55"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>464.95M (2.17M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$46.06</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GPT-6 Luna">
<summary class="inference-record-summary"><span class="inference-record-title">GPT-6 Luna</span><span class="inference-record-metric">3 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="copilot-pro-luna6"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>964.14M (4.50M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.22</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="copilot-pro-plus-luna6"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro+</dd></div><div><dt>Processed / 30 days (output)</dt><dd>4.50B (21.01M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.86</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="copilot-max-luna6"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>12.86B (60.02M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.67</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-google-ai-pro-ultra" data-subscription="Google AI Pro / Ultra">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://gemini.google/subscriptions/">Google AI Pro / Ultra</a><span class="inference-record-subtitle"><a href="https://antigravity.google/pricing">3 recorded models / aliases</a></span></span><span class="inference-record-metric">Pro $19.99 / Ultra $99.99 (5x) or $199.99 (20x) / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Request, task and rate-limit allowances only. No tokens-per-request figure is published, so no token capacity is calculated.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Gemini CLI">
<summary class="inference-record-summary"><span class="inference-record-title">Gemini CLI (Gemini model family)</span><span class="inference-record-metric">3 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="google-ai-pro-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Requests per user per day</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="google-ai-ultra-5x-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Requests per user per day</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="google-ai-ultra-20x-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Requests per user per day</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Antigravity">
<summary class="inference-record-summary"><span class="inference-record-title">Antigravity agent models</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro: more generous rate limits; Ultra 5x / 20x: higher and highest rate limits</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Jules">
<summary class="inference-record-summary"><span class="inference-record-title">Jules</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro 100 / Ultra 300 tasks per rolling 24 hours; 15 / 60 concurrent</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-devin-pro-max" data-subscription="Devin Pro / Max">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://devin.ai/pricing">Devin Pro / Max</a><span class="inference-record-subtitle"><a href="https://devin.ai/pricing">2 recorded models / aliases</a></span></span><span class="inference-record-metric">Pro $20 / Max $200 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Quota amounts are not published; the on-demand credit rates are also not published as per-token prices.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="SWE-2">
<summary class="inference-record-summary"><span class="inference-record-title">SWE-2</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="devin-pro-swe2"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Free in Devin Desktop and CLI through 2026-10-10</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Unmetered; throughput unknown</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="devin-max-swe2"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Free in Devin Desktop and CLI through 2026-10-10</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Unmetered; throughput unknown</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Frontier and open models">
<summary class="inference-record-summary"><span class="inference-record-title">Frontier and open-source models</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="devin-pro-quota"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Draws on the plan quota, then on-demand credits</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="devin-max-quota"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Draws on the plan quota, then on-demand credits</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-supergrok" data-subscription="SuperGrok">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://x.ai/pricing">SuperGrok</a><span class="inference-record-subtitle"><a href="https://x.ai/pricing">2 recorded models / aliases</a></span></span><span class="inference-record-metric">SuperGrok $30 / Plus $100; Lite and Heavy prices not shown on the pricing page / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">No numerical usage limits are published for any tier.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Grok 4.6">
<summary class="inference-record-summary"><span class="inference-record-title">Grok 4.6</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="supergrok-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Paid tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Grok Build">
<summary class="inference-record-summary"><span class="inference-record-title">Grok Build</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All plans; usage scales by tier</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-ollama-cloud-pro-max" data-subscription="Ollama Cloud Pro / Max">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://ollama.com/pricing">Ollama Cloud Pro / Max</a><span class="inference-record-subtitle"><a href="https://ollama.com/pricing">6 recorded models / aliases</a></span></span><span class="inference-record-metric">Pro $20 ($200/yr) / Max $100 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Dollar credits at Ollama's own rates; MiniMax M3 is priced at twice MiniMax's list rate.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="GLM-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="ollama-pro-glm"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>188.28M (0.88M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$22.75</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>16.6% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="ollama-max-glm"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>941.41M (4.40M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$22.75</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>16.6% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3-Flash</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="ollama-pro-glm-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.65B (7.71M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.59</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>2.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="ollama-max-glm-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>8.26B (38.55M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.59</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3-flash/endpoints">$2.67</a><span class="inference-fact-note">InferenceNet, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>2.8% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K3">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K3</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="ollama-pro-k3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>129.92M (0.61M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$32.97</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>54.9% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="ollama-max-k3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>649.61M (3.03M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$32.97</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>54.9% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M3</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="ollama-pro-m3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>407.58M (1.90M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$10.51</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>21.0% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="ollama-max-m3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.04B (9.52M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$10.51</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>21.0% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4.1 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4.1 Flash</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="ollama-pro-flash-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rate; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>5.52B (25.80M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.78</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="ollama-max-flash-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rate; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>27.62B (128.98M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.78</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>36.8% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="DeepSeek V4 Pro">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Pro</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="ollama-pro-v4pro-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rate; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.13B (5.27M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.80</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4-pro-0813/endpoints">$6.25</a><span class="inference-fact-note">Baidu, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>39.3% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="ollama-max-v4pro-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rate; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>5.64B (26.35M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$3.80</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4-pro-0813/endpoints">$6.25</a><span class="inference-fact-note">Baidu, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>39.3% less</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-command-code" data-subscription="Command Code">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://commandcode.ai/pricing">Command Code</a><span class="inference-record-subtitle"><a href="https://commandcode.ai/models">8 recorded models / aliases</a></span></span><span class="inference-record-metric">Go $1 / GOAT $10 / Pro $20 / Max 10x $100 / Max 20x $200 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Allowances are alternatives within one pool. Temporary deals (MiniMax M3 2x, Grok 4.7 40% off to Sep 27, DeepSeek V4.1 Flash boost to Sep 28, MiMo V2.5 up to 99% off) are excluded.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="DeepSeek V4 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">DeepSeek V4 Flash</span><span class="inference-record-metric">5 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-go-deepseek-v4-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rates; peak doubles; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>920.77M (4.30M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.23</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>81.0% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="cc-goat-deepseek-v4-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rates; peak doubles; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>5.52B (25.80M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.39</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>68.4% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="cc-pro-deepseek-v4-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rates; peak doubles; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>6.45B (30.10M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.66</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>45.8% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="cc-max10-deepseek-v4-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rates; peak doubles; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>13.81B (64.49M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.55</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>26.4% more expensive</dd></div></dl></div><div class="inference-model-scenario" data-offer="cc-max20-deepseek-v4-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Off-peak rates; peak doubles; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>27.62B (128.98M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$1.55</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/deepseek/deepseek-v4.1-flash/endpoints">$1.23</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>26.4% more expensive</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.2">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.2</span><span class="inference-record-metric">$9.75 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-goat-glm-5.2"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>GOAT</dd></div><div><dt>Processed / 30 days (output)</dt><dd>219.66M (1.03M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$9.75</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K2.7 Code">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K2.7 Code</span><span class="inference-record-metric">$8.35 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-goat-kimi-k2.7-code"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>GOAT</dd></div><div><dt>Processed / 30 days (output)</dt><dd>256.39M (1.20M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$8.35</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiMo V2.6 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">MiMo V2.6 Flash</span><span class="inference-record-metric">$0.95 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-goat-mimo-v2.6-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>GOAT</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.27B (10.58M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.95</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/xiaomi/mimo-v2.6-flash/endpoints">$1.99</a><span class="inference-fact-note">Xiaomi, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>52.6% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Kimi K3">
<summary class="inference-record-summary"><span class="inference-record-title">Kimi K3</span><span class="inference-record-metric">$49.45 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-goat-kimi-k3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>GOAT</dd></div><div><dt>Processed / 30 days (output)</dt><dd>43.31M (0.20M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$49.45</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/moonshotai/kimi-k3/endpoints">$73.04</a><span class="inference-fact-note">Relace, FP4</span></dd></div><div><dt>Subscription saving</dt><dd>32.3% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3</span><span class="inference-record-metric">$34.12 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-goat-glm-5.3"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>GOAT</dd></div><div><dt>Processed / 30 days (output)</dt><dd>62.76M (0.29M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$34.12</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>25.1% more expensive</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Sonnet 5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Sonnet 5</span><span class="inference-record-metric">$66.64 subscription</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-pro-claude-sonnet-5"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro and above; $20 per premium model on Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>64.28M (0.30M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$66.64</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/anthropic/claude-sonnet-5/endpoints">$70.31</a><span class="inference-fact-note">Anthropic</span></dd></div><div><dt>Subscription saving</dt><dd>5.2% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Claude Opus 5.5">
<summary class="inference-record-summary"><span class="inference-record-title">Claude Opus 5.5</span><span class="inference-record-metric">2 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="cc-max10-claude-opus-5.5"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max plans only; premium-model limit</dd></div><div><dt>Processed / 30 days (output)</dt><dd>232.47M (1.09M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$92.12</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="cc-max20-claude-opus-5.5"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max plans only; premium-model limit</dd></div><div><dt>Processed / 30 days (output)</dt><dd>464.95M (2.17M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$92.12</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-stepfun-step-plan" data-subscription="StepFun Step Plan">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">StepFun Step Plan</a><span class="inference-record-subtitle"><a href="https://platform.stepfun.ai/docs/en/step-plan/overview.md">4 recorded models / aliases</a></span></span><span class="inference-record-metric">Flash Mini $6.99 / Plus $9.99 / Pro $29 / Max $99 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">The provider states the USD conversion as approximate. Credits reset monthly and do not roll over.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Step 3.5 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">Step 3.5 Flash</span><span class="inference-record-metric">4 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="stepfun-mini-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Mini</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.37B (11.09M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.63</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-plus-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Plus</dd></div><div><dt>Processed / 30 days (output)</dt><dd>9.50B (44.34M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.23</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-pro-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>47.48B (221.72M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.13</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-max-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>237.42B (1.11B output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.09</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Step 5 Preview">
<summary class="inference-record-summary"><span class="inference-record-title">Step 5 Preview</span><span class="inference-record-metric">4 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="stepfun-mini-step-5-preview"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Mini</dd></div><div><dt>Processed / 30 days (output)</dt><dd>600.51M (2.80M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$2.49</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-plus-step-5-preview"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Plus</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.40B (11.22M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.89</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-pro-step-5-preview"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>12.01B (56.08M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.52</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-max-step-5-preview"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>60.05B (280.39M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.35</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Step 3.7 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">Step 3.7 Flash</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="step-router-v1">
<summary class="inference-record-summary"><span class="inference-record-title">step-router-v1</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Automatic routing</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-stepfun-step-plan-china" data-subscription="StepFun Step Plan (China)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">StepFun Step Plan (China)</a><span class="inference-record-subtitle"><a href="https://platform.stepfun.com/docs/zh/step-plan/overview.md">2 recorded models / aliases</a></span></span><span class="inference-record-metric">Flash Mini ¥49 / Plus ¥99 / Pro ¥199 / Max ¥699 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">China-region edition; CNY prices converted for comparison only.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="Step 3.5 Flash">
<summary class="inference-record-summary"><span class="inference-record-title">Step 3.5 Flash</span><span class="inference-record-metric">4 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="stepfun-cn-mini-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Mini</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.37B (11.09M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.65</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-cn-plus-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Plus</dd></div><div><dt>Processed / 30 days (output)</dt><dd>9.50B (44.34M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.33</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-cn-pro-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>47.48B (221.72M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.13</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div><div class="inference-model-scenario" data-offer="stepfun-cn-max-step-3.5-flash"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Flash Max</dd></div><div><dt>Processed / 30 days (output)</dt><dd>237.42B (1.11B output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$0.09</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="Step 5 Preview">
<summary class="inference-record-summary"><span class="inference-record-title">Step 5 Preview</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-glm-coding-plan-china" data-subscription="GLM Coding Plan (China)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://bigmodel.cn/glm-coding">GLM Coding Plan (China)</a><span class="inference-record-subtitle"><a href="https://docs.bigmodel.cn/cn/coding-plan/overview.md">2 recorded models / aliases</a></span></span><span class="inference-record-metric">Lite ¥118 / Pro ¥538 / Max ¥1,078 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Sep 25 - Oct 7 all-day off-peak promotion excluded.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="GLM-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3</span><span class="inference-record-metric">6 scenarios</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="glm-cn-lite-glm-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>432.12M (2.02M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$8.66</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>68.2% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="glm-cn-lite-glm-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Lite; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>216.06M (1.01M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$17.33</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>36.5% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="glm-cn-pro-glm-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>2.59B (12.11M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$6.59</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>75.9% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="glm-cn-pro-glm-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>1.30B (6.05M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$13.17</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>51.7% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="glm-cn-max-glm-off-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; off-peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>6.05B (28.25M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$5.65</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>79.3% less</dd></div></dl></div><div class="inference-model-scenario" data-offer="glm-cn-max-glm-peak"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Max; peak</dd></div><div><dt>Processed / 30 days (output)</dt><dd>3.02B (14.12M output)</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd><strong>$11.31</strong></dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/z-ai/glm-5.3/endpoints">$27.28</a><span class="inference-fact-note">Morph</span></dd></div><div><dt>Subscription saving</dt><dd>58.5% less</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="GLM-5.3-Flash">
<summary class="inference-record-summary"><span class="inference-record-title">GLM-5.3-Flash</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-minimax-token-plan-china" data-subscription="MiniMax Token Plan (China)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://platform.minimaxi.com/docs/token-plan/intro.md">MiniMax Token Plan (China)</a><span class="inference-record-subtitle"><a href="https://platform.minimaxi.com/docs/token-plan/intro.md">2 recorded models / aliases</a></span></span><span class="inference-record-metric">Plus ¥49 / Max ¥119 / Ultra ¥469 / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">China-region edition.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="MiniMax M3">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M3</span><span class="inference-record-metric">$13.30 OpenRouter</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="minimax-cn-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All listed tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd><a href="https://openrouter.ai/api/v1/models/minimax/minimax-m3/endpoints">$13.30</a><span class="inference-fact-note">GMICloud, FP8</span></dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="MiniMax M2.7">
<summary class="inference-record-summary"><span class="inference-record-title">MiniMax M2.7</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-alibaba-bailian-coding-plan-china" data-subscription="Alibaba Bailian Coding Plan (China)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://help.aliyun.com/zh/model-studio/coding-plan">Alibaba Bailian Coding Plan (China)</a><span class="inference-record-subtitle"><a href="https://help.aliyun.com/zh/model-studio/coding-plan">1 recorded model / alias</a></span></span><span class="inference-record-metric">Pro ¥200 (first month ¥39.90) / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Lite closed to new purchase 2026-03-20; Pro sold in limited daily slots.</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="qwen3.7-plus">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3.7-plus</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="alibaba-cn-requests"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Pro</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
<details class="inference-subscription-record" id="inference-plan-alibaba-bailian-token-plan-china" data-subscription="Alibaba Bailian Token Plan (China)">
<summary class="inference-record-summary"><span class="inference-record-title"><a href="https://help.aliyun.com/zh/model-studio/token-plan-personal-overview">Alibaba Bailian Token Plan (China)</a><span class="inference-record-subtitle"><a href="https://help.aliyun.com/zh/model-studio/token-plan-personal-overview">3 recorded models / aliases</a></span></span><span class="inference-record-metric">Lite ¥39 / Essential ¥79 / Standard ¥139 / Pro ¥499 (limited-time; list ¥60 / ¥120 / ¥180 / ¥600) / month</span></summary>
<div class="inference-record-details"><p class="inference-subscription-note">Team edition seats: ¥150 / ¥550 / ¥1,398 per seat (25k / 100k / 250k Credits).</p><div class="inference-model-record-list"><details class="inference-record inference-model-record" data-model="qwen3.8-max">
<summary class="inference-record-summary"><span class="inference-record-title">qwen3.8-max</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario" data-offer="bailian-token-plan-unknown"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>All personal tiers</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="deepseek-v4.1-flash">
<summary class="inference-record-summary"><span class="inference-record-title">deepseek-v4.1-flash</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>Half Credits 22:00-08:00 (limited time)</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details>
<details class="inference-record inference-model-record" data-model="glm-5.3">
<summary class="inference-record-summary"><span class="inference-record-title">glm-5.3</span><span class="inference-record-metric">Pricing not established</span></summary>
<div class="inference-record-details"><div class="inference-model-scenario"><dl class="inference-facts"><div><dt>Tier / conditions</dt><dd>See plan terms</dd></div><div><dt>Processed / 30 days (output)</dt><dd>Not established</dd></div><div><dt>Subscription $ / 1M output + input</dt><dd>Not established</dd></div><div><dt>OpenRouter $ / 1M output + input</dt><dd>Not quoted</dd></div><div><dt>Subscription saving</dt><dd>Not established</dd></div></dl></div></div>
</details></div></div>
</details>
</div>

<!-- inference:openrouter:end -->

The selected route is the lowest modeled cost in the captured endpoints with status `0`, advertised tool support and explicit cache-read pricing; when two eligible routes cost the same, the model author's route is kept. Nonzero-status routes are excluded from selection. On September 25 every author route was eligible, and for MiMo and Sonnet it was also the cheapest. These are dated quotes, not a promise of availability or default routing. The snapshot records provider tags, context limits, quantization, rate overrides and source URLs in the [price dataset](/data/inference-plans/prices.json).

**Headline input prices can pick the wrong provider.** For DeepSeek V4 Pro, Ionstream quotes $0.2528/M fresh input, below Baidu's $0.3498/M. But its cache-read price is $0.08832/M versus Baidu's $0.01113/M. Including their output rates and the purchase fee, this measured workload costs **$23.21 through Ionstream versus $6.25 through Baidu**. The quote, provider tag and context limit for that example are retained in the dataset. [DeepSeek V4 Pro provider quotes](https://openrouter.ai/deepseek/deepseek-v4-pro-0813/providers)

Reproducing the measured 96.53% input cache-hit rate is an assumption. OpenRouter uses sticky routing to help preserve caches, but fallback can move requests to a different provider. Verify actual billed cache reads in the coding harness. Pinning a provider or quantization changes the available routes; an FP4 quote is not evidence of equal application quality to an FP8 or author-hosted route. Each request must also fit that endpoint's context and pricing tier. [Caching](https://openrouter.ai/docs/guides/best-practices/prompt-caching), [provider routing](https://openrouter.ai/docs/guides/routing/provider-selection)

Z.ai's GLM-5.3-Flash author quote is back at its list price; the half-price promotion ended September 9. DeepSeek comparisons use OpenRouter's V4.1 Flash and Pro `0813` entries; Chutes still serves the pinned V4 Flash `0731` checkpoint, and a subscription's generic alias may not guarantee a specific checkpoint. The author-route DeepSeek quotes are off-peak. Several selected routes are FP4 or do not disclose quantization, including GLM-5.3, GLM-5.3-Flash, Kimi K3 and DeepSeek V4.1 Flash. Sonnet uses standard service and five-minute cache creation. Recheck these conditions before extending the estimates beyond this snapshot.

At full modeled utilization, **OpenCode Go's MiMo allocation buys about 6.33× the tokens per dollar of the selected OpenRouter route**, and its MiniMax M3 allocation about **5.06×**. Z.ai Max's off-peak GLM-5.3 allocation buys about **4.59×**, down from 7.73× on September 7 because a much cheaper GLM-5.3 route appeared. Two subscription allocations now lose to OpenRouter outright: OpenCode Go's GLM-5.3 allowance costs **66.8% more** than the selected route, and a Synthetic pack spent on GLM Flash costs about **7.5% more** than InferenceNet's FP4 route. Chutes Pro's conditional DeepSeek Flash ceiling also remains more expensive than the selected route. These are different serving configurations, so accepted-work testing still decides whether the cheaper tokens help.

OpenRouter is therefore a useful baseline and overflow source. A subscription only beats it when enough relevant allowance is consumed: Go's MiMo allocation breaks even at **15.8% utilization** and Z.ai Max's GLM-5.3 allocation at **21.8%**, while Synthetic's Kimi K3 example needs about **51.8%** against the current selected quote. The [OpenRouter comparison CSV](/data/inference-plans/openrouter-comparison.csv) includes cash-budget token capacity; the [subscription comparison CSV](/data/inference-plans/openrouter-plans.csv) includes savings and break-even utilization for every mapped, quantifiable offer.

## Convert the allowance before comparing it

Z.ai illustrates why a flat subscription cannot be reduced to one universal token price. Credits depend on the selected model, uncached input, cached input, output and time of day. Off-peak model usage consumes half the normal credits.

Applying its [credit formula](https://docs.z.ai/devpack/overview) to the example workload gives these **fully utilized, off-peak, steady-state 30-day equivalents**:

<!-- inference:zai:start -->

<div class="inference-record-list inference-zai-list" role="region" aria-label="Z.ai modeled allowance">
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Lite</span><span class="inference-record-metric"><strong>7.7×</strong><small> API value</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Monthly fee</dt><dd>$18</dd></div><div><dt>GLM-5.3 output + input</dt><dd>2.0M + 430M</dd></div><div><dt>Direct API equivalent</dt><dd>$138</dd></div><div><dt>Value multiple</dt><dd>7.7×</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Pro</span><span class="inference-record-metric"><strong>10.3×</strong><small> API value</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Monthly fee</dt><dd>$80</dd></div><div><dt>GLM-5.3 output + input</dt><dd>12.1M + 2581M</dd></div><div><dt>Direct API equivalent</dt><dd>$826</dd></div><div><dt>Value multiple</dt><dd>10.3×</dd></div></dl></div>
</details>
<details class="inference-record">
<summary class="inference-record-summary"><span class="inference-record-title">Max</span><span class="inference-record-metric"><strong>11.5×</strong><small> API value</small></span></summary>
<div class="inference-record-details"><dl class="inference-facts"><div><dt>Monthly fee</dt><dd>$168</dd></div><div><dt>GLM-5.3 output + input</dt><dd>28.2M + 6021M</dd></div><div><dt>Direct API equivalent</dt><dd>$1,928</dd></div><div><dt>Value multiple</dt><dd>11.5×</dd></div></dl></div>
</details>
</div>

<!-- inference:zai:end -->

The weekly allowance is prorated for comparison; it is not a guaranteed calendar-month entitlement. Five-hour limits, concurrency, tool consumption and uneven demand can reduce realized value. All-peak operation halves the token allowances. The same subscriptions produce approximately **2.6–4.0× ordinary GLM Flash API value** in this scenario, because Flash's direct API is already much cheaper. Z.ai's own documentation describes the monthly quota as roughly 15–30× the fee at API prices; this measured, cache-heavy workload converts to 7.7–11.5× for GLM-5.3. The provider does not state the workload behind its figure. Its subscription page renders prices in the browser, so the $18 / $80 / $168 fees come from the credits-based price set in the official site's own code, consistent with the documentation's "starting at just 18 USD per month". [Plan update notice](https://docs.z.ai/devpack/notice/usage-revision)

OpenCode Go has a different mechanism. Some models receive six times the subscription fee in API allowance; others receive three or one-and-a-half times. Allocating its entire qualifying allowance to MiMo V2.6 Flash supports approximately **31.7M output plus 6.76B input tokens for $10** in this scenario. Allocating it to MiniMax M3 supports approximately **3.8M output plus 811M input**. Those are alternative uses of one pool, still subject to shorter limits. Each model is also capped at 20% of its monthly limit per five hours and 50% per week. [Allowance rules](https://opencode.ai/docs/go/)

MiMo's own plan shows the danger of reading credits as tokens. Each uncached V2.6 Flash input token costs 100 credits; each output token costs 200. V2.6 deducts exactly as V2.5 did, and V2.5 is deprecated on October 21. Its 4.1B-credit Lite plan therefore represents approximately **$5.74 of daytime direct API usage for a $6 fee**, or $7.18 with the off-peak credit discount. Large numbers need units. [Conversion rules](https://mimo.mi.com/docs/en-US/price/token-plan), [API prices](https://mimo.mi.com/docs/en-US/price/pay-as-you-go)

Synthetic's $24 weekly allowance represents about $103 per 30 days **at Synthetic's rates**. Always compare the serving provider's cache prices and model configuration with the original API before calling that a direct-provider discount. [Limits](https://synthetic.new/rate-limits), [model metadata and prices](https://api.synthetic.new/openai/v1/models)

NanoGPT illustrates the effect of counting cache hits at full input weight. At the measured ratio, its 60M weekly input-unit allowance yields approximately **258M total processed tokens, including 1.21M output, per 30 days** on a 1× model. A 2× model halves those estimates. A request-count plan needs another measurement—tokens per billable request—before it can be converted. The local message count is not assumed to equal provider API calls. [NanoGPT quota definitions](https://nano-gpt.com/help)

Utilization is the other half of the arithmetic. A $10 plan containing $60 of relevant API usage breaks even once it replaces more than $10 of API spending. The unused $50 has no value. More packs can buy parallelism, but idle parallelism is still a bill.

## Native coding subscriptions belong in the trial too

Codex through ChatGPT, Claude Code, Cursor, Copilot, Gemini CLI, Devin and Grok Build can be economical when their native workflows produce useful results. Each now has its own row in the comparison above, with the provider's own prices, models and limits. Only Copilot converts to token capacity from published numbers. Its credits are spent at listed per-token model prices. The others publish request counts, message estimates, relative multiples or undisclosed quotas. Those do not establish a cost per token, and the rows leave the capacity as not established rather than borrowing someone else's measurement.

## Temporary offers, kept separate

As checked September 25, 2026:

- **Z.ai** charges all-day usage at the off-peak rate from **September 25 to October 7**. Its GLM-5.3-Flash campaign, extended to **October 7**, gives unlimited Flash use through ZCode and AutoClaw daily 15:00–01:00 UTC and doubled quota through other supported agents in that window. [Plan notice](https://docs.z.ai/devpack/notice/usage-revision), [Flash campaign](https://docs.z.ai/devpack/notice/event-glm-5.3-flash)
- **OpenCode Go** gives DeepSeek V4.1 Flash four times its $15 allowance, $60, until **September 27**, and lists Space Bunny as free for a limited time. [Go usage](https://opencode.ai/go)
- **deepseekv4pro.com** advertises a 2× quota on its Coding tier with no stated end date. [Pricing](https://deepseekv4pro.com/pricing)

These offers can improve a trial; the standing calculations exclude all of them. Z.ai's half-price GLM-5.3-Flash API offer ended September 9 and has been removed from the price data.

## The next analysis should measure accepted work

Run 20–50 representative tasks through the same harness, tests and retry budget. Record input, cache hits, billed output, subscription consumption, cash spend, retries, queue time, review time and whether the change was accepted. Include abandoned attempts in the bill.

The metric is **total inference and retry cost divided by changes that pass tests and review**. Report elapsed time alongside it: a cheap queue can become expensive when it delays everything else. Allocate the full subscription fee across the measured period, including unused quota, rather than claiming the theoretical maximum discount.

That experiment may favor a cheap default with occasional stronger calls. It may favor one reliable model that finishes sooner. This initial research does not establish which outcome the fleet will produce.

## Reproduce and update the comparison

Download the [dated price dataset](/data/inference-plans/prices.json), [measured usage profile](/data/inference-plans/usage-profile.json), [model catalogs](/data/inference-plans/model-catalogs.json), [calculator](/data/inference-plans/calculate.mjs), [API comparison CSV](/data/inference-plans/api-comparison.csv), [plan capacity CSV](/data/inference-plans/plan-capacity.csv), [Z.ai comparison CSV](/data/inference-plans/z-ai-comparison.csv), [OpenRouter quote CSV](/data/inference-plans/openrouter-comparison.csv), and [OpenRouter versus subscriptions CSV](/data/inference-plans/openrouter-plans.csv). The dataset records source URLs and check dates; the artifact's comparisons and CSVs are generated from it.

Put `calculate.mjs` and `prices.json` in the same directory. With Node 22 or newer:

```bash
node calculate.mjs --format api > api.csv
node calculate.mjs --format plans > capacity.csv
node calculate.mjs --format zai > zai.csv
node calculate.mjs --format openrouter > openrouter.csv
node calculate.mjs --format openrouter-plans > openrouter-plans.csv
# Sensitivity scenario; defaults above use the measured profile.
node calculate.mjs --ratio 50 --cache-hit 0.95 --cache-write-share 0.2 --format plans
```

`--cache-write-share` is the fraction of non-cache-read input spent creating caches. It preserves separate write pricing while `--cache-hit` controls reads as a fraction of all input. The calculator does not convert a message count into requests.

For OpenRouter, `--topup-credits 10` models the fee on a $10 inference-credit purchase; `--budget` remains a cash budget. The default amortizes a $100 credit purchase. Ratio overrides reprice the captured provider routes; they do not select a new cheapest provider. Use the recorded endpoint API URLs to refresh route selection for a different workload.

Future revisions can add measured task outcomes, new providers, different cache-hit scenarios and throughput observations without moving this artifact. The page-level verification date advances only after the comparison has been checked as a whole; partial refreshes retain individual source dates. Corrections and changed recommendations belong in the changelog, newest first.

## Changelog

### 2026-09-25 — Every tracked subscription, first-party only

- Added fifteen subscriptions, bringing the comparison to twenty-seven: ChatGPT (Codex), Claude (Claude Code), Cursor, GitHub Copilot, Google AI Pro / Ultra, Devin, SuperGrok, Ollama Cloud, Command Code, StepFun Step Plan (international and China), and China-region editions of the GLM Coding Plan, MiniMax Token Plan, Alibaba Bailian Coding Plan and Alibaba Bailian Token Plan.
- Calculated capacity only where the provider publishes both an allowance and the rates it is spent at: Copilot, Ollama Cloud, Command Code, StepFun and the GLM China edition. Every other new row quotes the provider's own limits and leaves capacity unestablished; no third-party usage measurement was adopted.
- Converted CNY prices at the CFETS central parity of 6.7489 CNY/USD for September 24, recorded in the dataset. Kimi's China-region price list is served only inside China, so it is noted on the existing Kimi row rather than added.
- Recorded two first-party discrepancies with other trackers. Devin's own pricing page ends the SWE-2 unmetered promotion on **October 10**. SuperGrok Lite and Heavy prices are not published on xAI's pricing page, so they are not shown.
- The native-subscription section now points to these rows instead of summarizing them.

### 2026-09-25 — First-party re-verification

- Rechecked every plan, direct API price, OpenRouter route and native subscription against the providers' own pages and APIs, and advanced the page-level verification date. The September 7 usage measurement is unchanged.
- Every adopted value is now first-party evidence: the provider's own published page or API, or my own measurement. An independent third-party dataset was used only to find what to recheck; none of its values are adopted. Where a provider publishes no convertible allowance (MiniMax, Kimi, Alibaba, deepseekv4pro.com), the plan stays unquantified and its note records what the provider does publish.
- MiMo: priced V2.6 Flash and V2.6 Pro, which bill and deduct exactly as V2.5 did; V2.5 is deprecated October 21.
- DeepSeek: the V4 Flash names are retired and billed at V4.1 Flash off-peak rates of $0.15 / $0.003 / $0.60, down from $0.22 / $0.007 / $0.66. OpenCode Go's Flash allocation was recalculated at those rates.
- OpenCode Go: added the GPT 6 Luna allocation and the current per-model limits and catalog (Grok 4.7, MiMo V2.6, DeepSeek V4.1 Flash, MiniMax M2.5, Space Bunny; Omen Alpha removed).
- Synthetic withdrew GLM-5.2 and added DeepSeek V4.1 Flash. Updated the camelStream fleet, Kimi tiers and quota rules, Alibaba's limits, Chutes' overage discounts, the NanoGPT and Kilo catalogs, and deepseekv4pro.com's prices and plan-token quotas.
- Re-captured OpenRouter with the same selection rule, adding an author-route tie-break. Z.ai Max's GLM-5.3 advantage fell from 7.73× to 4.59×, and OpenCode Go's GLM-5.3 and Synthetic's GLM Flash allocations now cost more than the cheapest eligible route. The MiMo cache-price example no longer held and was replaced with a DeepSeek V4 Pro example.
- Removed the expired GLM-5.3-Flash promotional price and rewrote the temporary-offers section.

### 2026-09-07 — Published as a data artifact

- Retired the private Notes draft and published the maintained comparison at `/data/inference-plans/`.
- Kept the report, Markdown twin, calculator, source data and generated CSVs together under one public artifact path.
- This changes the publication surface only; the analysis, measurement and source-verification dates are unchanged.

### 2026-09-07 — Display the analysis date

- Added a prominent analysis date near the top of the artifact, separate from publication, measurement and source-verification dates.

### 2026-09-07 — Index by subscription and model

- Reorganized the OpenRouter comparison into all twelve researched coding subscriptions, then their models, with tier and time-window rows underneath.
- Included the saved model catalogs; large unpriced catalogs expand within the relevant subscription instead of disappearing from the comparison.
- Added token capacity beside each calculated model/tier cost and retained explicit unknowns for missing allowances, rates and model multipliers.
- Preserved the existing measured mix and dated prices; this is a coverage and presentation update, not a source refresh.

### 2026-09-07 — OpenRouter route comparison

- Added nine model comparisons using coherent provider quotes, measured cache composition and the standard credit-purchase fee.
- Added selected provider, quantization, context and status metadata; separated flagged author quotes and current promotional rates.
- Added OpenRouter cash-budget capacity and subscription savings/break-even CSVs, plus a configurable top-up size.
- Found that provider cache pricing can reverse headline-price rankings, and that the selected DeepSeek Flash route undercuts Chutes Pro's modeled ceiling.
- Retained the earlier usage measurement and subscription snapshot; this revision refreshes OpenRouter quotes only.

### 2026-09-07 — Normalize subscription costs

- Converted the measured mix into effective costs per million processed tokens and per million output tokens including associated input for every quantifiable offer.
- Added a main normalization table, expandable model/time-window calculations and matching CSV fields.
- Added explicit same-model direct API savings and break-even utilization, preserving negative savings and unknown comparisons.
- Kept the existing measurement and dated price snapshot; this revision adds arithmetic rather than claiming a new measurement or source refresh.

### 2026-09-07 — Measured usage, supported models and capacity

- Replaced the illustrative 20:1 input/output ratio and 80% cache-hit assumption with a fresh local measurement: 213.2:1 and 96.53% of input from cache.
- Normalized separately reported reasoning into billable output and retained distinct cache-read and cache-write buckets.
- Added model coverage for every plan in the main table, dated catalog snapshots and reproducible token-capacity estimates using serving-provider rates.
- Kept unknown quotas, unmetered service and conditional ceilings explicit; added downloadable usage and capacity data.
- Recalculated API examples. The shortlist remains a set of trial candidates; no accepted-work benchmark has yet been run.

### 2026-09-07 — Initial research draft

- Compared twelve subscription offerings with direct API costs and native coding alternatives.
- Added reproducible API and Z.ai calculations, source-check dates, and explicit workload assumptions.
- Recorded automation restrictions, conflicting reseller documentation and expiring promotions.
- Established the cost-per-accepted-change experiment as the next analysis; no paid performance benchmark has been run for this note.