{"models":[{"id":"qwen3.6-plus","provider":"Alibaba","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":65536,"input_per_1m":0.5,"output_per_1m":3.0,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"qwen3.6-plus from Alibaba, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"qwen3.7-max","provider":"Alibaba","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":65536,"input_per_1m":2.5,"output_per_1m":7.5,"cache_read_per_1m":0.35,"vision":false,"reasoning":true,"tool_call":true,"description":"qwen3.7-max from Alibaba, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"qwen3.7-plus","provider":"Alibaba","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":64000,"input_per_1m":0.32,"output_per_1m":1.28,"cache_read_per_1m":0.12,"vision":true,"reasoning":true,"tool_call":true,"description":"qwen3.7-plus from Alibaba, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"qwen3.8-flash","provider":"Alibaba","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":0.15,"output_per_1m":0.47,"cache_read_per_1m":0.016,"vision":false,"reasoning":true,"tool_call":true,"description":"qwen3.8-flash from Alibaba, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"qwen3.8-max","provider":"Alibaba","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":2.0,"output_per_1m":6.0,"cache_read_per_1m":0.7,"vision":true,"reasoning":true,"tool_call":true,"description":"qwen3.8-max from Alibaba, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Alibaba publishes a discounted cache-read tier for this model. RouterPlex does not pass a separate cache tier through yet, so cached prompt tokens are billed at the standard $2 input rate.","long_context_pricing":null},{"id":"claude-fable-5","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":10.0,"output_per_1m":50.0,"cache_read_per_1m":1.2,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-fable-5 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-haiku-4-5","provider":"Anthropic","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":64000,"input_per_1m":1.0,"output_per_1m":5.0,"cache_read_per_1m":0.08,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-haiku-4-5 from Anthropic, 256K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-opus-4-6","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":5.0,"output_per_1m":25.0,"cache_read_per_1m":0.425,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-opus-4-6 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-opus-4-7","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":5.0,"output_per_1m":25.0,"cache_read_per_1m":0.425,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-opus-4-7 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-opus-4-8","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":5.0,"output_per_1m":25.0,"cache_read_per_1m":0.425,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-opus-4-8 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-opus-5","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":5.0,"output_per_1m":25.0,"cache_read_per_1m":0.425,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-opus-5 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-sonnet-4-6","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":64000,"input_per_1m":3.0,"output_per_1m":15.0,"cache_read_per_1m":0.25,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-sonnet-4-6 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"claude-sonnet-5","provider":"Anthropic","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":2.0,"output_per_1m":10.0,"cache_read_per_1m":0.3,"vision":true,"reasoning":true,"tool_call":true,"description":"claude-sonnet-5 from Anthropic, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Anthropic introductory pricing through August 31, 2026; the published rate becomes $3 input / $15 output per 1M tokens on September 1, 2026.","long_context_pricing":null},{"id":"doubao-seed-2.0-code","provider":"ByteDance","mode":"chat","context":"200K","context_tokens":200000,"max_output_tokens":131072,"input_per_1m":0.67,"output_per_1m":3.36,"cache_read_per_1m":0.085,"vision":true,"reasoning":true,"tool_call":true,"description":"doubao-seed-2.0-code from ByteDance, 200K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"doubao-seed-2.0-pro","provider":"ByteDance","mode":"chat","context":"128K","context_tokens":128000,"max_output_tokens":128000,"input_per_1m":0.67,"output_per_1m":3.36,"cache_read_per_1m":0.085,"vision":true,"reasoning":true,"tool_call":true,"description":"doubao-seed-2.0-pro from ByteDance, 128K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"deepseek-v4-flash","provider":"DeepSeek","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":384000,"input_per_1m":0.09,"output_per_1m":0.18,"cache_read_per_1m":0.035,"vision":false,"reasoning":true,"tool_call":true,"description":"deepseek-v4-flash from DeepSeek, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"deepseek-v4-flash-vision-exp","provider":"DeepSeek","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":384000,"input_per_1m":0.22,"output_per_1m":0.66,"cache_read_per_1m":0.007,"vision":true,"reasoning":true,"tool_call":true,"description":"deepseek-v4-flash-vision-exp from DeepSeek, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"DeepSeek publishes peak and off-peak rates for this model. RouterPlex bills the off-peak rate of $0.22 input / $0.66 output per 1M tokens at all hours; DeepSeek's peak rate (01:00-04:00 and 06:00-10:00 UTC, Monday to Friday) is double that. Experimental vision preview -- the lab may change or withdraw it.","long_context_pricing":null},{"id":"deepseek-v4-pro","provider":"DeepSeek","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":384000,"input_per_1m":0.435,"output_per_1m":0.87,"cache_read_per_1m":0.16,"vision":false,"reasoning":true,"tool_call":true,"description":"deepseek-v4-pro from DeepSeek, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"deepseek-v4.1-flash","provider":"DeepSeek","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":384000,"input_per_1m":0.18,"output_per_1m":0.73,"cache_read_per_1m":0.065,"vision":true,"reasoning":true,"tool_call":true,"description":"deepseek-v4.1-flash from DeepSeek, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"DeepSeek prices this model by time of day: $0.15 input / $0.60 output per 1M tokens off-peak, and double that during peak hours (01:00-04:00 and 06:00-10:00 UTC, Monday to Friday). RouterPlex bills a single flat rate in between -- the time-weighted average of the two -- so you are never billed by the clock and never pay the peak rate for off-peak work.","long_context_pricing":null},{"id":"gemini-2.5-flash","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.3,"output_per_1m":2.5,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-2.5-flash from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gemini-2.5-flash-lite","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.1,"output_per_1m":0.4,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-2.5-flash-lite from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gemini-3-flash","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.5,"output_per_1m":3.0,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3-flash from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gemini-3.1-flash-lite","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.25,"output_per_1m":1.5,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3.1-flash-lite from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gemini-3.1-pro","provider":"Google","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":65536,"input_per_1m":2.0,"output_per_1m":12.0,"cache_read_per_1m":0.3,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3.1-pro from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gemini-3.5-flash","provider":"Google","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":65536,"input_per_1m":1.5,"output_per_1m":9.0,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3.5-flash from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gemini-3.6-flash","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.75,"output_per_1m":3.75,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3.6-flash from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Google introductory pricing through December 31, 2026; the published rate becomes $1.50 input / $7.50 output per 1M tokens on January 1, 2027.","long_context_pricing":null},{"id":"gemini-3.7-flash","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.75,"output_per_1m":3.75,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3.7-flash from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Google introductory pricing through December 31, 2026; the published rate becomes $1.50 input / $7.50 output per 1M tokens on January 1, 2027.","long_context_pricing":null},{"id":"gemini-3.8-flash","provider":"Google","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":65536,"input_per_1m":0.75,"output_per_1m":3.75,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"gemini-3.8-flash from Google, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Google introductory pricing through December 31, 2026; the published rate becomes $1.50 input / $7.50 output per 1M tokens on January 1, 2027.","long_context_pricing":null},{"id":"LongCat-2.0","provider":"LongCat","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":0.3,"output_per_1m":1.2,"cache_read_per_1m":0.11,"vision":false,"reasoning":true,"tool_call":true,"description":"LongCat-2.0 from LongCat, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":"Current official limited-time LongCat API rate; the published regular rate is $0.75 input / $2.95 output per 1M tokens.","long_context_pricing":null},{"id":"muse-spark-1.2-contributor","provider":"Meta","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":131072,"input_per_1m":0.1,"output_per_1m":0.2,"cache_read_per_1m":0.008,"vision":false,"reasoning":true,"tool_call":false,"description":"muse-spark-1.2-contributor from Meta, 1M context, reasoning.","pricing_basis":"vendor_list","pricing_note":"Contributor edition. Meta prices this at $0.10 input / $0.20 output per 1M tokens instead of the standard Muse Spark rate of $1.25 / $4.25, in exchange for the right to use the prompts and completions you send to it to train future Meta models. Do not send confidential, personal, or client-owned material to this model. It is never used as a default or a fallback -- it runs only when you name it explicitly. Tool calling is not supported on RouterPlex, and Meta limits availability to certain regions.","long_context_pricing":null},{"id":"muse-spark-1.3-contributor","provider":"Meta","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":131072,"input_per_1m":0.1,"output_per_1m":0.2,"cache_read_per_1m":0.008,"vision":false,"reasoning":true,"tool_call":false,"description":"muse-spark-1.3-contributor from Meta, 1M context, reasoning.","pricing_basis":"vendor_list","pricing_note":"Contributor edition. Meta prices this at $0.10 input / $0.20 output per 1M tokens instead of the standard Muse Spark rate of $1.25 / $4.25, in exchange for the right to use the prompts and completions you send to it to train future Meta models. Do not send confidential, personal, or client-owned material to this model. It is never used as a default or a fallback -- it runs only when you name it explicitly. Tool calling is not supported on RouterPlex, and Meta limits availability to certain regions.","long_context_pricing":null},{"id":"MiniMax-M2.7","provider":"MiniMax","mode":"chat","context":"196K","context_tokens":196000,"max_output_tokens":131072,"input_per_1m":0.3,"output_per_1m":1.2,"cache_read_per_1m":0.025,"vision":false,"reasoning":true,"tool_call":true,"description":"MiniMax-M2.7 from MiniMax, 196K context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"MiniMax-M2.7-highspeed","provider":"MiniMax","mode":"chat","context":"196K","context_tokens":196000,"max_output_tokens":131072,"input_per_1m":0.6,"output_per_1m":2.4,"cache_read_per_1m":0.05,"vision":false,"reasoning":true,"tool_call":true,"description":"MiniMax-M2.7-highspeed from MiniMax, 196K context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"MiniMax-M3","provider":"MiniMax","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":512000,"input_per_1m":0.3,"output_per_1m":1.2,"cache_read_per_1m":0.03,"vision":true,"reasoning":true,"tool_call":true,"description":"MiniMax-M3 from MiniMax, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"MiniMax-M3-highspeed","provider":"MiniMax","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":512000,"input_per_1m":0.45,"output_per_1m":1.8,"cache_read_per_1m":0.06,"vision":true,"reasoning":true,"tool_call":true,"description":"MiniMax-M3-highspeed from MiniMax, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"kimi-k2.6","provider":"Moonshot","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":262144,"input_per_1m":0.95,"output_per_1m":4.0,"cache_read_per_1m":0.08,"vision":true,"reasoning":true,"tool_call":true,"description":"kimi-k2.6 from Moonshot, 256K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"kimi-k2.7","provider":"Moonshot","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":262144,"input_per_1m":0.95,"output_per_1m":4.0,"cache_read_per_1m":0.225,"vision":true,"reasoning":true,"tool_call":true,"description":"kimi-k2.7 from Moonshot, 256K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"kimi-k3","provider":"Moonshot","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":131072,"input_per_1m":3.0,"output_per_1m":15.0,"cache_read_per_1m":0.7,"vision":true,"reasoning":true,"tool_call":true,"description":"kimi-k3 from Moonshot, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Moonshot prices cache-hit input at $0.30, cache-miss input at $3, and output at $15 per 1M tokens. RouterPlex bills each category at those published rates.","long_context_pricing":null},{"id":"gpt-5.4","provider":"OpenAI","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":128000,"input_per_1m":2.5,"output_per_1m":15.0,"cache_read_per_1m":0.2,"vision":true,"reasoning":true,"tool_call":true,"description":"gpt-5.4 from OpenAI, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gpt-5.5","provider":"OpenAI","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":128000,"input_per_1m":5.0,"output_per_1m":30.0,"cache_read_per_1m":0.4,"vision":true,"reasoning":true,"tool_call":true,"description":"gpt-5.5 from OpenAI, 256K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gpt-5.6-luna","provider":"OpenAI","mode":"chat","context":"258K","context_tokens":258000,"max_output_tokens":128000,"input_per_1m":0.2,"output_per_1m":1.2,"cache_read_per_1m":0.016,"vision":true,"reasoning":true,"tool_call":true,"description":"gpt-5.6-luna from OpenAI, 258K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gpt-5.6-sol","provider":"OpenAI","mode":"chat","context":"258K","context_tokens":258000,"max_output_tokens":128000,"input_per_1m":5.0,"output_per_1m":30.0,"cache_read_per_1m":0.4,"vision":true,"reasoning":true,"tool_call":true,"description":"gpt-5.6-sol from OpenAI, 258K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gpt-5.6-terra","provider":"OpenAI","mode":"chat","context":"258K","context_tokens":258000,"max_output_tokens":128000,"input_per_1m":2.0,"output_per_1m":12.0,"cache_read_per_1m":0.16,"vision":true,"reasoning":true,"tool_call":true,"description":"gpt-5.6-terra from OpenAI, 258K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"gpt-6-astra","provider":"OpenAI","mode":"chat","context":"922K","context_tokens":922000,"max_output_tokens":128000,"input_per_1m":10.0,"output_per_1m":50.0,"cache_read_per_1m":0.8,"vision":true,"reasoning":true,"tool_call":true,"description":"gpt-6-astra from OpenAI, 922K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Base rate applies at or below 272K prompt tokens. Prompts above 272K are billed at $20 input / $75 output per 1M tokens for the whole request. OpenAI publishes a $1 per 1M cached-input rate; RouterPlex bills cached tokens at the full input rate because the upstream does not pass that discount through.","long_context_pricing":{"threshold_tokens":272000,"input_per_1m":20.0,"output_per_1m":75.0,"cache_read_per_1m":1.6}},{"id":"gpt-image-2","provider":"OpenAI","mode":"image_generation","context":"—","context_tokens":null,"max_output_tokens":null,"input_per_1m":5.0,"output_per_1m":30.0,"cache_read_per_1m":null,"vision":true,"reasoning":false,"tool_call":false,"description":"gpt-image-2 image generation from OpenAI on RouterPlex.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"step-3.7-flash","provider":"StepFun","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":256000,"input_per_1m":0.2,"output_per_1m":1.15,"cache_read_per_1m":0.03,"vision":true,"reasoning":true,"tool_call":true,"description":"step-3.7-flash from StepFun, 256K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"hy3","provider":"Tencent Hunyuan","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":64000,"input_per_1m":0.2,"output_per_1m":0.8,"cache_read_per_1m":0.03,"vision":false,"reasoning":true,"tool_call":true,"description":"hy3 from Tencent Hunyuan, 256K context, reasoning, tool calling.","pricing_basis":"public_reference","pricing_note":"Tencent publishes Hy3 as open weights without a first-party hosted API tariff. RouterPlex uses the public market reference of $0.20 input / $0.80 output per 1M tokens.","long_context_pricing":null},{"id":"hy4-preview","provider":"Tencent Hunyuan","mode":"chat","context":"1M","context_tokens":1024000,"max_output_tokens":64000,"input_per_1m":0.834,"output_per_1m":2.501,"cache_read_per_1m":0.042,"vision":false,"reasoning":true,"tool_call":true,"description":"hy4-preview from Tencent Hunyuan, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":"Tencent ships Hy4 as a preview release; the published preview API rate is $0.834 input / $2.501 output per 1M tokens. This model spends heavily on reasoning tokens, so allow a generous max_tokens or replies can come back empty.","long_context_pricing":null},{"id":"mimo-v2.5","provider":"Xiaomi","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":0.11,"output_per_1m":0.28,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"mimo-v2.5 from Xiaomi, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"mimo-v2.5-pro","provider":"Xiaomi","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":0.44,"output_per_1m":0.87,"cache_read_per_1m":null,"vision":false,"reasoning":true,"tool_call":true,"description":"mimo-v2.5-pro from Xiaomi, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"mimo-v2.6-flash","provider":"Xiaomi","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":131072,"input_per_1m":0.14,"output_per_1m":0.28,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"mimo-v2.6-flash from Xiaomi, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"mimo-v2.6-pro","provider":"Xiaomi","mode":"chat","context":"1M","context_tokens":1048576,"max_output_tokens":131072,"input_per_1m":0.435,"output_per_1m":0.87,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"mimo-v2.6-pro from Xiaomi, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"glm-5.1","provider":"Zhipu","mode":"chat","context":"256K","context_tokens":256000,"max_output_tokens":131072,"input_per_1m":1.4,"output_per_1m":4.4,"cache_read_per_1m":null,"vision":false,"reasoning":true,"tool_call":true,"description":"glm-5.1 from Zhipu, 256K context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"glm-5.2","provider":"Zhipu","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":1.4,"output_per_1m":4.4,"cache_read_per_1m":0.225,"vision":false,"reasoning":true,"tool_call":true,"description":"glm-5.2 from Zhipu, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"glm-5.3","provider":"Zhipu","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":1.4,"output_per_1m":4.4,"cache_read_per_1m":0.26,"vision":false,"reasoning":true,"tool_call":true,"description":"glm-5.3 from Zhipu, 1M context, reasoning, tool calling.","pricing_basis":"vendor_list","pricing_note":null,"long_context_pricing":null},{"id":"glm-5.3-flash","provider":"Zhipu","mode":"chat","context":"1M","context_tokens":1000000,"max_output_tokens":131072,"input_per_1m":0.15,"output_per_1m":0.5,"cache_read_per_1m":0.03,"vision":true,"reasoning":true,"tool_call":true,"description":"glm-5.3-flash from Zhipu, 1M context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Z.ai ran a launch promotion at $0.075 input / $0.25 output per 1M tokens through September 9, 2026. RouterPlex bills the standard published list rate of $0.15 input / $0.50 output.","long_context_pricing":null},{"id":"grok-4.5","provider":"xAI","mode":"chat","context":"500K","context_tokens":500000,"max_output_tokens":500000,"input_per_1m":2.0,"output_per_1m":6.0,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"grok-4.5 from xAI, 500K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Base rate applies below 200K prompt tokens. Prompts at or above 200K are billed at $4 input / $12 output per 1M tokens.","long_context_pricing":{"threshold_tokens":200000,"input_per_1m":4.0,"output_per_1m":12.0}},{"id":"grok-4.6","provider":"xAI","mode":"chat","context":"500K","context_tokens":500000,"max_output_tokens":500000,"input_per_1m":2.0,"output_per_1m":6.0,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"grok-4.6 from xAI, 500K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"Base rate applies below 200K prompt tokens. Prompts at or above 200K are billed at $4 input / $12 output per 1M tokens. Cached prompt tokens are billed at the full input rate: our upstream charges more for a cached grok token than a fresh one, so there is no cache discount to pass through on this model.","long_context_pricing":{"threshold_tokens":200000,"input_per_1m":4.0,"output_per_1m":12.0}},{"id":"grok-4.7","provider":"xAI","mode":"chat","context":"500K","context_tokens":500000,"max_output_tokens":500000,"input_per_1m":2.0,"output_per_1m":6.0,"cache_read_per_1m":null,"vision":true,"reasoning":true,"tool_call":true,"description":"grok-4.7 from xAI, 500K context, reasoning, tool calling, vision.","pricing_basis":"vendor_list","pricing_note":"xAI list price. Base rate applies below 200K prompt tokens; prompts at or above 200K are billed at $4 input / $12 output per 1M tokens. Cached prompt tokens are billed at the full input rate for now: RouterPlex does not yet pass xAI's $0.50 cache-read tier through on this model.","long_context_pricing":{"threshold_tokens":200000,"input_per_1m":4.0,"output_per_1m":12.0}}]}