{
  "count": 115,
  "unit": "USD per 1M tokens",
  "data": [
    {
      "modelId": "glm-4-7-flash",
      "name": "GLM-4.7-Flash",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 0,
      "outputPerMTokens": 0,
      "cachedInputPerMTokens": 0,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-5-flash",
      "name": "GLM-4.5-Flash",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 0,
      "outputPerMTokens": 0,
      "cachedInputPerMTokens": 0,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-7-flash",
      "name": "Qwen3.7-Flash",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.028,
      "outputPerMTokens": 0.11,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-5-flash",
      "name": "Qwen3.5-Flash",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.029,
      "outputPerMTokens": 0.287,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "command-r7b",
      "name": "Command R7B",
      "providerId": "cohere",
      "contextWindow": 128000,
      "inputPerMTokens": 0.0375,
      "outputPerMTokens": 0.15,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.cohere.com/docs/command-r7b",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-nano",
      "name": "GPT-5 nano",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 0.05,
      "outputPerMTokens": 0.4,
      "cachedInputPerMTokens": 0.005,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5-nano",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-5-35b-a3b",
      "name": "Qwen3.5 35B-A3B",
      "providerId": "qwen",
      "contextWindow": 262144,
      "inputPerMTokens": 0.057,
      "outputPerMTokens": 0.459,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "amazon-nova-lite",
      "name": "Amazon Nova Lite",
      "providerId": "amazon",
      "contextWindow": 300000,
      "inputPerMTokens": 0.06,
      "outputPerMTokens": 0.24,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://aws.amazon.com/blogs/machine-learning/demystifying-amazon-bedrock-pricing-for-a-chatbot-assistant/",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-7-flashx",
      "name": "GLM-4.7-FlashX",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 0.07,
      "outputPerMTokens": 0.4,
      "cachedInputPerMTokens": 0.01,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-5-27b",
      "name": "Qwen3.5 27B",
      "providerId": "qwen",
      "contextWindow": 262144,
      "inputPerMTokens": 0.086,
      "outputPerMTokens": 0.688,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-4-1-nano",
      "name": "GPT-4.1 nano",
      "providerId": "openai",
      "contextWindow": 1047576,
      "inputPerMTokens": 0.1,
      "outputPerMTokens": 0.4,
      "cachedInputPerMTokens": 0.025,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-4.1-nano",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-2-5-flash-lite",
      "name": "Gemini 2.5 Flash-Lite",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.1,
      "outputPerMTokens": 0.4,
      "cachedInputPerMTokens": 0.01,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "ministral-3-3b",
      "name": "Ministral 3 3B",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 0.1,
      "outputPerMTokens": 0.1,
      "cachedInputPerMTokens": 0.01,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-32b-0414-128k",
      "name": "GLM-4 32B 0414 128K",
      "providerId": "zai",
      "contextWindow": 131072,
      "inputPerMTokens": 0.1,
      "outputPerMTokens": 0.1,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-8-flash",
      "name": "Qwen3.8-Flash",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.113,
      "outputPerMTokens": 0.382,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-5-plus",
      "name": "Qwen3.5-Plus",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.115,
      "outputPerMTokens": 0.688,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-5-122b-a10b",
      "name": "Qwen3.5 122B-A10B",
      "providerId": "qwen",
      "contextWindow": 262144,
      "inputPerMTokens": 0.115,
      "outputPerMTokens": 0.917,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "deepseek-v4-1-flash",
      "name": "DeepSeek V4.1 Flash",
      "providerId": "deepseek",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.14,
      "outputPerMTokens": 0.28,
      "cachedInputPerMTokens": 0.0028,
      "sourceUrl": "https://api-docs.deepseek.com/quick_start/pricing/",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "mistral-small-4",
      "name": "Mistral Small 4",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 0.15,
      "outputPerMTokens": 0.6,
      "cachedInputPerMTokens": 0.015,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-4o-mini",
      "name": "GPT-4o mini",
      "providerId": "openai",
      "contextWindow": 128000,
      "inputPerMTokens": 0.15,
      "outputPerMTokens": 0.6,
      "cachedInputPerMTokens": 0.075,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-4o-mini",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "command-r",
      "name": "Command R",
      "providerId": "cohere",
      "contextWindow": 128000,
      "inputPerMTokens": 0.15,
      "outputPerMTokens": 0.6,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.cohere.com/docs/command-r",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "ministral-3-8b",
      "name": "Ministral 3 8B",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 0.15,
      "outputPerMTokens": 0.15,
      "cachedInputPerMTokens": 0.015,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-5-3-flash",
      "name": "GLM-5.3-Flash",
      "providerId": "zai",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.15,
      "outputPerMTokens": 0.5,
      "cachedInputPerMTokens": 0.03,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-6-flash",
      "name": "Qwen3.6-Flash",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.165,
      "outputPerMTokens": 0.99,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-5-397b-a17b",
      "name": "Qwen3.5 397B-A17B",
      "providerId": "qwen",
      "contextWindow": 262144,
      "inputPerMTokens": 0.172,
      "outputPerMTokens": 1.032,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-6-luna",
      "name": "GPT-5.6 Luna",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 0.2,
      "outputPerMTokens": 1.2,
      "cachedInputPerMTokens": 0.02,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.6-luna",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-4-nano",
      "name": "GPT-5.4 nano",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 0.2,
      "outputPerMTokens": 1.25,
      "cachedInputPerMTokens": 0.02,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.4-nano",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "ministral-3-14b",
      "name": "Ministral 3 14B",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 0.2,
      "outputPerMTokens": 0.2,
      "cachedInputPerMTokens": 0.02,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-fast-reasoning",
      "name": "Grok 4 Fast Reasoning",
      "providerId": "xai",
      "contextWindow": 2000000,
      "inputPerMTokens": 0.2,
      "outputPerMTokens": 0.5,
      "cachedInputPerMTokens": 0.05,
      "sourceUrl": "https://x.ai/news/grok-4-fast",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-5-air",
      "name": "GLM-4.5-Air",
      "providerId": "zai",
      "contextWindow": 128000,
      "inputPerMTokens": 0.2,
      "outputPerMTokens": 1.1,
      "cachedInputPerMTokens": 0.03,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-mini",
      "name": "GPT-5 mini",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 0.25,
      "outputPerMTokens": 2,
      "cachedInputPerMTokens": 0.025,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5-mini",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-1-flash-lite",
      "name": "Gemini 3.1 Flash-Lite",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.25,
      "outputPerMTokens": 1.5,
      "cachedInputPerMTokens": 0.025,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-7-plus",
      "name": "Qwen3.7-Plus",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.276,
      "outputPerMTokens": 1.101,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-6-plus",
      "name": "Qwen3.6-Plus",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.276,
      "outputPerMTokens": 1.651,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-5-flash-lite",
      "name": "Gemini 3.5 Flash-Lite",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.03,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-2-5-flash",
      "name": "Gemini 2.5 Flash",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.03,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "codestral",
      "name": "Codestral",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 0.9,
      "cachedInputPerMTokens": 0.03,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "solar-pro-4",
      "name": "Solar Pro 4",
      "providerId": "upstage",
      "contextWindow": 512000,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 1.2,
      "cachedInputPerMTokens": 0.06,
      "sourceUrl": "https://console.upstage.ai/docs/models/compare/generative-intelligence",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "minimax-m3",
      "name": "MiniMax M3",
      "providerId": "minimax",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 1.2,
      "cachedInputPerMTokens": 0.06,
      "sourceUrl": "https://platform.minimax.io/subscribe/token-plan?tab=api-enterprise",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "minimax-m2-7",
      "name": "MiniMax M2.7",
      "providerId": "minimax",
      "contextWindow": 204800,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 1.2,
      "cachedInputPerMTokens": 0.06,
      "sourceUrl": "https://platform.minimax.io/docs/api-reference/anthropic-api-compatible-cache",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "minimax-m2-5",
      "name": "MiniMax M2.5",
      "providerId": "minimax",
      "contextWindow": 204800,
      "inputPerMTokens": 0.3,
      "outputPerMTokens": 1.2,
      "cachedInputPerMTokens": 0.03,
      "sourceUrl": "https://platform.minimax.io/docs/api-reference/anthropic-api-compatible-cache",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-4-1-mini",
      "name": "GPT-4.1 mini",
      "providerId": "openai",
      "contextWindow": 1047576,
      "inputPerMTokens": 0.4,
      "outputPerMTokens": 1.6,
      "cachedInputPerMTokens": 0.1,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-4.1-mini",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-8-27b",
      "name": "Qwen3.8 27B",
      "providerId": "qwen",
      "contextWindow": 262144,
      "inputPerMTokens": 0.424,
      "outputPerMTokens": 1.696,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "deepseek-v4-pro",
      "name": "DeepSeek V4 Pro",
      "providerId": "deepseek",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.435,
      "outputPerMTokens": 0.87,
      "cachedInputPerMTokens": 0.003625,
      "sourceUrl": "https://api-docs.deepseek.com/quick_start/pricing/",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "mistral-large-3",
      "name": "Mistral Large 3",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 0.5,
      "outputPerMTokens": 1.5,
      "cachedInputPerMTokens": 0.05,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "dola-seed-2-1-turbo",
      "name": "Dola Seed 2.1 Turbo",
      "providerId": "bytedance",
      "contextWindow": 256000,
      "inputPerMTokens": 0.5,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.1,
      "sourceUrl": "https://www.byteplus.com/en/product/modelark/leaderboard",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "dola-seed-2-0-pro",
      "name": "Dola Seed 2.0 Pro",
      "providerId": "bytedance",
      "contextWindow": 256000,
      "inputPerMTokens": 0.5,
      "outputPerMTokens": 3,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.byteplus.com/en/product/modelark/leaderboard",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-coder-plus",
      "name": "Qwen3-Coder-Plus",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 0.574,
      "outputPerMTokens": 2.294,
      "cachedInputPerMTokens": 0.0574,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-7",
      "name": "GLM-4.7",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 0.6,
      "outputPerMTokens": 2.2,
      "cachedInputPerMTokens": 0.11,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-6",
      "name": "GLM-4.6",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 0.6,
      "outputPerMTokens": 2.2,
      "cachedInputPerMTokens": 0.11,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-5",
      "name": "GLM-4.5",
      "providerId": "zai",
      "contextWindow": 128000,
      "inputPerMTokens": 0.6,
      "outputPerMTokens": 2.2,
      "cachedInputPerMTokens": 0.11,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-8-flash",
      "name": "Gemini 3.8 Flash",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.75,
      "outputPerMTokens": 3.75,
      "cachedInputPerMTokens": 0.075,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-4-mini",
      "name": "GPT-5.4 mini",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 0.75,
      "outputPerMTokens": 4.5,
      "cachedInputPerMTokens": 0.075,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.4-mini",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-7-flash",
      "name": "Gemini 3.7 Flash",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.75,
      "outputPerMTokens": 3.75,
      "cachedInputPerMTokens": 0.075,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-6-flash",
      "name": "Gemini 3.6 Flash",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 0.75,
      "outputPerMTokens": 3.75,
      "cachedInputPerMTokens": 0.075,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "amazon-nova-pro",
      "name": "Amazon Nova Pro",
      "providerId": "amazon",
      "contextWindow": 300000,
      "inputPerMTokens": 0.8,
      "outputPerMTokens": 3.2,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://aws.amazon.com/blogs/machine-learning/demystifying-amazon-bedrock-pricing-for-a-chatbot-assistant/",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-haiku-4-5",
      "name": "Claude Haiku 4.5",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 1,
      "outputPerMTokens": 5,
      "cachedInputPerMTokens": 0.1,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "sonar",
      "name": "Sonar",
      "providerId": "perplexity",
      "contextWindow": 128000,
      "inputPerMTokens": 1,
      "outputPerMTokens": 1,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.perplexity.ai/docs/sonar/models/sonar",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-build-0-1",
      "name": "Grok Build 0.1",
      "providerId": "xai",
      "contextWindow": 256000,
      "inputPerMTokens": 1,
      "outputPerMTokens": 2,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://docs.x.ai/developers/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-5",
      "name": "GLM-5",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 1,
      "outputPerMTokens": 3.2,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-5-airx",
      "name": "GLM-4.5-AirX",
      "providerId": "zai",
      "contextWindow": 128000,
      "inputPerMTokens": 1.1,
      "outputPerMTokens": 4.5,
      "cachedInputPerMTokens": 0.22,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-max",
      "name": "Qwen3-Max",
      "providerId": "qwen",
      "contextWindow": 262144,
      "inputPerMTokens": 1.2,
      "outputPerMTokens": 6,
      "cachedInputPerMTokens": 0.12,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-5-turbo",
      "name": "GLM-5-Turbo",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 1.2,
      "outputPerMTokens": 4,
      "cachedInputPerMTokens": 0.24,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-3",
      "name": "Grok 4.3",
      "providerId": "xai",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://docs.x.ai/developers/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-1",
      "name": "GPT-5.1",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": 0.125,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.1",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5",
      "name": "GPT-5",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": 0.125,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-2-5-pro",
      "name": "Gemini 2.5 Pro",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": 0.125,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-20-reasoning",
      "name": "Grok 4.20 Reasoning",
      "providerId": "xai",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://docs.x.ai/developers/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-20-non-reasoning",
      "name": "Grok 4.20 Non-Reasoning",
      "providerId": "xai",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://docs.x.ai/developers/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-20-multi-agent",
      "name": "Grok 4.20 Multi-Agent",
      "providerId": "xai",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.25,
      "outputPerMTokens": 2.5,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://docs.x.ai/developers/models/grok-4.20-multi-agent-0309",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-5-3",
      "name": "GLM-5.3",
      "providerId": "zai",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.4,
      "outputPerMTokens": 4.4,
      "cachedInputPerMTokens": 0.26,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-5-2",
      "name": "GLM-5.2",
      "providerId": "zai",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.4,
      "outputPerMTokens": 4.4,
      "cachedInputPerMTokens": 0.26,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-5-1",
      "name": "GLM-5.1",
      "providerId": "zai",
      "contextWindow": 200000,
      "inputPerMTokens": 1.4,
      "outputPerMTokens": 4.4,
      "cachedInputPerMTokens": 0.26,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "mistral-medium-3-5",
      "name": "Mistral Medium 3.5",
      "providerId": "mistral",
      "contextWindow": 256000,
      "inputPerMTokens": 1.5,
      "outputPerMTokens": 7.5,
      "cachedInputPerMTokens": 0.15,
      "sourceUrl": "https://docs.mistral.ai/inference/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-5-flash",
      "name": "Gemini 3.5 Flash",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 1.5,
      "outputPerMTokens": 9,
      "cachedInputPerMTokens": 0.15,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-8-max",
      "name": "Qwen3.8-Max",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.65,
      "outputPerMTokens": 4.951,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-8-2-4t-a95b",
      "name": "Qwen3.8 2.4T-A95B",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.65,
      "outputPerMTokens": 4.951,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "qwen3-7-max",
      "name": "Qwen3.7-Max",
      "providerId": "qwen",
      "contextWindow": 1000000,
      "inputPerMTokens": 1.65,
      "outputPerMTokens": 4.951,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://www.alibabacloud.com/help/en/model-studio/model-pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-2",
      "name": "GPT-5.2",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 1.75,
      "outputPerMTokens": 14,
      "cachedInputPerMTokens": 0.175,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.2",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-6-terra",
      "name": "GPT-5.6 Terra",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 12,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.6-terra",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-sonnet-5",
      "name": "Claude Sonnet 5",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gemini-3-1-pro-preview",
      "name": "Gemini 3.1 Pro Preview",
      "providerId": "google",
      "contextWindow": 1048576,
      "inputPerMTokens": 2,
      "outputPerMTokens": 12,
      "cachedInputPerMTokens": 0.2,
      "sourceUrl": "https://ai.google.dev/gemini-api/docs/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-6",
      "name": "Grok 4.6",
      "providerId": "xai",
      "contextWindow": 500000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 6,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://docs.x.ai/developers/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "o3",
      "name": "o3",
      "providerId": "openai",
      "contextWindow": 200000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 8,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://developers.openai.com/api/docs/models/o3",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-4-1",
      "name": "GPT-4.1",
      "providerId": "openai",
      "contextWindow": 1047576,
      "inputPerMTokens": 2,
      "outputPerMTokens": 8,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-4.1",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "grok-4-5",
      "name": "Grok 4.5",
      "providerId": "xai",
      "contextWindow": 500000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 6,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://docs.x.ai/developers/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "sonar-reasoning-pro",
      "name": "Sonar Reasoning Pro",
      "providerId": "perplexity",
      "contextWindow": 128000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 8,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.perplexity.ai/docs/sonar/models/sonar-reasoning-pro",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "sonar-deep-research",
      "name": "Sonar Deep Research",
      "providerId": "perplexity",
      "contextWindow": 128000,
      "inputPerMTokens": 2,
      "outputPerMTokens": 8,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.perplexity.ai/docs/sonar/models/sonar-deep-research",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "glm-4-5-x",
      "name": "GLM-4.5-X",
      "providerId": "zai",
      "contextWindow": 128000,
      "inputPerMTokens": 2.2,
      "outputPerMTokens": 8.9,
      "cachedInputPerMTokens": 0.45,
      "sourceUrl": "https://docs.z.ai/guides/overview/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-4",
      "name": "GPT-5.4",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 2.5,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.25,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.4",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-4o",
      "name": "GPT-4o",
      "providerId": "openai",
      "contextWindow": 128000,
      "inputPerMTokens": 2.5,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": 1.25,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-4o",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "command-a",
      "name": "Command A",
      "providerId": "cohere",
      "contextWindow": 256000,
      "inputPerMTokens": 2.5,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.cohere.com/docs/command-a",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "command-r-plus",
      "name": "Command R+",
      "providerId": "cohere",
      "contextWindow": 128000,
      "inputPerMTokens": 2.5,
      "outputPerMTokens": 10,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.cohere.com/docs/command-r-plus",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-sonnet-4-6",
      "name": "Claude Sonnet 4.6",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://platform.claude.com/docs/en/models/sonnet-4-6/overview",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-sonnet-4-5",
      "name": "Claude Sonnet 4.5",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://www.anthropic.com/news/claude-sonnet-4-5",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-sonnet-4",
      "name": "Claude Sonnet 4",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-sonnet-3-7",
      "name": "Claude 3.7 Sonnet",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://www.anthropic.com/news/claude-3-7-sonnet",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-sonnet-3-5",
      "name": "Claude 3.5 Sonnet",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://www.anthropic.com/news/claude-3-5-sonnet",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "sonar-pro",
      "name": "Sonar Pro",
      "providerId": "perplexity",
      "contextWindow": 200000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://docs.perplexity.ai/docs/sonar/models/sonar-pro",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "kimi-k3",
      "name": "Kimi K3",
      "providerId": "moonshot",
      "contextWindow": 1000000,
      "inputPerMTokens": 3,
      "outputPerMTokens": 15,
      "cachedInputPerMTokens": 0.3,
      "sourceUrl": "https://www.kimi.com/en/blog/kimi-k3",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-6-sol",
      "name": "GPT-5.6 Sol",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 4,
      "outputPerMTokens": 20,
      "cachedInputPerMTokens": 0.4,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.6-sol",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-opus-5",
      "name": "Claude Opus 5",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 5,
      "outputPerMTokens": 25,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-5",
      "name": "GPT-5.5",
      "providerId": "openai",
      "contextWindow": 1000000,
      "inputPerMTokens": 5,
      "outputPerMTokens": 30,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://developers.openai.com/api/docs/models",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-opus-4-8",
      "name": "Claude Opus 4.8",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 5,
      "outputPerMTokens": 25,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://platform.claude.com/docs/en/models/opus-4-8/overview",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-opus-4-7",
      "name": "Claude Opus 4.7",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 5,
      "outputPerMTokens": 25,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://platform.claude.com/docs/en/models/opus-4-7/overview",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-opus-4-6",
      "name": "Claude Opus 4.6",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 5,
      "outputPerMTokens": 25,
      "cachedInputPerMTokens": 0.5,
      "sourceUrl": "https://platform.claude.com/docs/en/models/opus-4-6/overview",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-6-astra",
      "name": "GPT-6 Astra",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 10,
      "outputPerMTokens": 50,
      "cachedInputPerMTokens": 1,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-6-astra",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-fable-5-1",
      "name": "Claude Fable 5.1",
      "providerId": "anthropic",
      "contextWindow": 1000000,
      "inputPerMTokens": 10,
      "outputPerMTokens": 50,
      "cachedInputPerMTokens": 0.25,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-pro",
      "name": "GPT-5 Pro",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 15,
      "outputPerMTokens": 120,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5-pro",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-opus-4-1",
      "name": "Claude Opus 4.1",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 15,
      "outputPerMTokens": 75,
      "cachedInputPerMTokens": 1.5,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "claude-opus-4",
      "name": "Claude Opus 4",
      "providerId": "anthropic",
      "contextWindow": 200000,
      "inputPerMTokens": 15,
      "outputPerMTokens": 75,
      "cachedInputPerMTokens": 1.5,
      "sourceUrl": "https://platform.claude.com/docs/en/about-claude/pricing",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "o3-pro",
      "name": "o3-pro",
      "providerId": "openai",
      "contextWindow": 200000,
      "inputPerMTokens": 20,
      "outputPerMTokens": 80,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://developers.openai.com/api/docs/models/o3-pro",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-2-pro",
      "name": "GPT-5.2 Pro",
      "providerId": "openai",
      "contextWindow": 400000,
      "inputPerMTokens": 21,
      "outputPerMTokens": 168,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.2-pro",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-5-pro",
      "name": "GPT-5.5 Pro",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 30,
      "outputPerMTokens": 180,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.5-pro",
      "updatedAt": "2026-09-16"
    },
    {
      "modelId": "gpt-5-4-pro",
      "name": "GPT-5.4 Pro",
      "providerId": "openai",
      "contextWindow": 1050000,
      "inputPerMTokens": 30,
      "outputPerMTokens": 180,
      "cachedInputPerMTokens": null,
      "sourceUrl": "https://developers.openai.com/api/docs/models/gpt-5.4-pro",
      "updatedAt": "2026-09-16"
    }
  ],
  "meta": {
    "source": "https://llmmetric.com",
    "attribution": "Please cite llmmetric.com. Upstream records remain subject to their source terms.",
    "generatedAt": "2026-09-18T05:14:40.438Z"
  }
}