跳到主要内容
Appunvs 模型服务
每日更新的模型目录

Appunvs 模型服务

由 model-gateway 统一提供模型状态、上下文、推理方式与人民币价格。目录只展示已经确认的信息,未知数据不会被当成 0 或免费。

目录更新 2026-08-26 已同步最新目录

模型
31
厂商
9
在售
31
最近更新
2026-08-26
厂商区域
状态
接入方式

31 个模型

大陆

DeepSeek

厂商文档

DeepSeek V4 Pro

deepseek-v4-pro
在售
上下文
1M
输入
空闲 ¥4.5 · 高峰 ¥9 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
输出
空闲 ¥13.5 · 高峰 ¥27 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
接入方式
托管可用自带密钥
推理方式 请求参数开关 · max / xhigh / high / medium / low
查看补充规格
单次最大输出
384k
部署
standard · public · current
缓存读取
空闲 ¥0.15 · 高峰 ¥0.3 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
输入模态
文本
输出模态
文本
端点
chat_completions: 支持 · responses: 支持 · fim: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

DeepSeek V4 Flash

deepseek-v4-flash
在售
上下文
1M
输入
空闲 ¥1.5 · 高峰 ¥3 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
输出
空闲 ¥4.5 · 高峰 ¥9 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
接入方式
托管可用自带密钥
推理方式 请求参数开关 · max / xhigh / high / medium / low
查看补充规格
单次最大输出
384k
部署
standard · public · current
缓存读取
空闲 ¥0.05 · 高峰 ¥0.1 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
输入模态
文本
输出模态
文本
端点
chat_completions: 支持 · responses: 支持 · fim: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

DeepSeek V4 Flash Vision Experimental

deepseek-v4-flash-vision-exp
在售
上下文
1M
输入
空闲 ¥1.5 · 高峰 ¥3 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
输出
空闲 ¥4.5 · 高峰 ¥9 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
接入方式
自带密钥
推理方式 请求参数开关 · max / xhigh / high / medium / low
查看补充规格
单次最大输出
384k
部署
standard · public · current
缓存读取
空闲 ¥0.05 · 高峰 ¥0.1 ¥ / 1M tokens 高峰:周一至周五 09:00–12:00、14:00–18:00(北京时间)
输入模态
文本 · 图像
输出模态
文本
端点
chat_completions: 支持 · responses: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

大陆

Moonshot (Kimi)

厂商文档

Kimi K3

kimi-k3
在售
上下文
1M
输入
¥20 ¥ / 1M tokens
输出
¥100 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭 · max / high / low
查看补充规格
单次最大输出
1M
部署
standard · public · current
缓存读取
¥2 ¥ / 1M tokens
输入模态
文本 · 图像 · 视频
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Kimi K2.7 Code

kimi-k2.7-code
在售
上下文
262k
输入
¥6.5 ¥ / 1M tokens
输出
¥27 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭
查看补充规格
部署
standard · public · current
缓存读取
¥1.3 ¥ / 1M tokens
输入模态
文本 · 图像 · 视频
输出模态
文本
端点
chat_completions: 支持 · batch: 待核实
最近核验
2026-08-26
文档冲突
endpoints.batch.model_support

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Kimi K2.7 Code HighSpeed

kimi-k2.7-code-highspeed
在售
上下文
262k
输入
¥13 ¥ / 1M tokens
输出
¥54 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭
查看补充规格
部署
highspeed · base: kimi-k2.7-code · public · current · ≈180 TPS
缓存读取
¥2.6 ¥ / 1M tokens
输入模态
文本 · 图像 · 视频
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Kimi K2.6

kimi-k2.6
在售
上下文
262k
输入
¥6.5 ¥ / 1M tokens
输出
¥27 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关
查看补充规格
部署
standard · public · current
缓存读取
¥1.1 ¥ / 1M tokens
输入模态
文本 · 图像 · 视频
输出模态
文本
端点
chat_completions: 支持 · batch: 支持
最近核验
2026-08-26
文档冲突
pricing.extras.web_search

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

大陆

智谱 GLM

厂商文档

智谱 GLM-5.3

glm-5.3
在售
上下文
1M
输入
待核实 ¥ / 1M tokens
输出
待核实 ¥ / 1M tokens
接入方式
自带密钥
推理方式 reasoning_effort · 不可关闭 · max / high / low
查看补充规格
单次最大输出
131k
部署
standard · public · current
输入模态
文本
输出模态
文本
端点
chat_completions: 支持 · responses: 支持 · anthropic_messages: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

智谱 GLM-5.2

glm-5.2
在售
上下文
1M
输入
¥8 ¥ / 1M tokens
输出
¥28 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · max / xhigh / high / medium / low / minimal / none
查看补充规格
单次最大输出
131k
部署
standard · public · current
缓存读取
¥2 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

智谱 GLM-5.1

glm-5.1
在售
上下文
200k
输入
¥6 ¥ / 1M tokens >32k ¥8
输出
¥24 ¥ / 1M tokens >32k ¥28
接入方式
托管可用自带密钥
推理方式 请求参数开关
查看补充规格
单次最大输出
131k
部署
standard · public · current
缓存读取
¥1.3 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

智谱 GLM-5-Turbo

glm-5-turbo
在售
上下文
200k
输入
¥5 ¥ / 1M tokens >32k ¥7
输出
¥22 ¥ / 1M tokens >32k ¥26
接入方式
托管可用自带密钥
推理方式 请求参数开关
查看补充规格
单次最大输出
131k
部署
standard · public · current
缓存读取
¥1.2 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

智谱 GLM-4.7

glm-4.7
在售
上下文
200k
输入
¥2 ¥ / 1M tokens >32k ¥4
输出
¥8 ¥ / 1M tokens >32k ¥16
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭
查看补充规格
单次最大输出
131k
部署
standard · public · legacy
缓存读取
¥0.4 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

大陆

MiniMax (海螺)

厂商文档

MiniMax M3

MiniMax-M3
在售
上下文
1M
输入
¥2.1 ¥ / 1M tokens >512k ¥4.2
输出
¥8.4 ¥ / 1M tokens >512k ¥16.8
接入方式
托管可用自带密钥
推理方式 请求参数开关
查看补充规格
部署
standard · public · current
缓存读取
¥0.42 ¥ / 1M tokens
输入模态
文本 · 图像 · 视频
输出模态
文本
端点
chat_completions: 支持 · anthropic_messages: 支持
最近核验
2026-08-26
文档冲突
endpoints.anthropic_messages.models

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

MiniMax M2.7

MiniMax-M2.7
在售
上下文
205k
输入
¥2.1 ¥ / 1M tokens
输出
¥8.4 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭
查看补充规格
部署
standard · public · current · ≈60 TPS
缓存读取
¥0.42 ¥ / 1M tokens
缓存写入
¥2.625 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持 · anthropic_messages: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

MiniMax M2.7 HighSpeed

MiniMax-M2.7-highspeed
在售
上下文
205k
输入
¥4.2 ¥ / 1M tokens
输出
¥16.8 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭
查看补充规格
部署
highspeed · base: MiniMax-M2.7 · public · current · ≈100 TPS
缓存读取
¥0.42 ¥ / 1M tokens
缓存写入
¥2.625 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持 · anthropic_messages: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

MiniMax M2

MiniMax-M2
在售
上下文
205k
输入
¥2.1 ¥ / 1M tokens
输出
¥8.4 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关 · 不可关闭
查看补充规格
部署
standard · public · legacy
缓存读取
¥0.21 ¥ / 1M tokens
缓存写入
¥2.625 ¥ / 1M tokens
输入模态
文本
输出模态
文本
端点
chat_completions: 支持 · anthropic_messages: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

大陆

小米 MiMo

厂商文档

小米 MiMo V2.5 Pro

mimo-v2.5-pro
在售
上下文
1M
输入
¥3 ¥ / 1M tokens
输出
¥6 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关
查看补充规格
单次最大输出
131k
部署
standard · public · current
缓存读取
¥0.025 ¥ / 1M tokens
非 Token 计费
web_search: ¥16 / 1000 次
输入模态
文本
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

小米 MiMo V2.5

mimo-v2.5
在售
上下文
1M
输入
¥1 ¥ / 1M tokens
输出
¥2 ¥ / 1M tokens
接入方式
托管可用自带密钥
推理方式 请求参数开关
查看补充规格
单次最大输出
131k
部署
standard · public · current
缓存读取
¥0.02 ¥ / 1M tokens
非 Token 计费
web_search: ¥16 / 1000 次
输入模态
文本 · 图像 · 音频 · 视频
输出模态
文本
端点
chat_completions: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

海外

OpenAI

厂商文档

GPT-5.5

gpt-5.5
在售
上下文
1.1M
输入
¥36 ¥ / 1M tokens >272k ¥72
输出
¥216 ¥ / 1M tokens >272k ¥324
接入方式
自带密钥
推理方式 reasoning_effort · xhigh / high / medium / low / none
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥3.6 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
responses: 支持 · chat_completions: 支持 · batch: 支持
训练知识截止
2025-12-01 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

GPT-5.6 Sol

gpt-5.6-sol
在售
上下文
1.1M
输入
¥28.8 ¥ / 1M tokens >272k ¥57.6
输出
¥144 ¥ / 1M tokens >272k ¥216
接入方式
自带密钥
推理方式 reasoning_effort · max / xhigh / high / medium / low / none · pro / standard
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥2.88 ¥ / 1M tokens
缓存写入
¥36 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
responses: 支持 · chat_completions: 支持 · batch: 支持
训练知识截止
2026-02-16 模型训练数据覆盖的最晚时间
最近核验
2026-08-26
文档冲突
pricing.standard

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

GPT-5.6 Terra

gpt-5.6-terra
在售
上下文
1.1M
输入
¥14.4 ¥ / 1M tokens >272k ¥28.8
输出
¥86.4 ¥ / 1M tokens >272k ¥129.6
接入方式
自带密钥
推理方式 reasoning_effort · max / xhigh / high / medium / low / none · pro / standard
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥1.44 ¥ / 1M tokens
缓存写入
¥18 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
responses: 支持 · chat_completions: 支持 · batch: 支持
训练知识截止
2026-02-16 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

GPT-5.6 Luna

gpt-5.6-luna
在售
上下文
1.1M
输入
¥1.44 ¥ / 1M tokens >272k ¥2.88
输出
¥8.64 ¥ / 1M tokens >272k ¥12.96
接入方式
自带密钥
推理方式 reasoning_effort · max / xhigh / high / medium / low / none · pro / standard
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥0.144 ¥ / 1M tokens
缓存写入
¥1.8 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
responses: 支持 · chat_completions: 支持 · batch: 支持
训练知识截止
2026-02-16 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

海外

Anthropic Claude

厂商文档

Claude Opus 5

claude-opus-5
在售
上下文
1M
输入
¥36 ¥ / 1M tokens
输出
¥180 ¥ / 1M tokens
接入方式
自带密钥
推理方式 adaptive(恒可用) · max / xhigh / high / medium / low
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥3.6 ¥ / 1M tokens
缓存写入
¥45 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
messages: 支持 · message_batches: 支持
训练知识截止
2026-05 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Claude Sonnet 5

claude-sonnet-5
在售
上下文
1M
输入
¥14.4 ¥ / 1M tokens
输出
¥72 ¥ / 1M tokens
接入方式
自带密钥
推理方式 adaptive(恒可用) · max / xhigh / high / medium / low
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥1.44 ¥ / 1M tokens
缓存写入
¥18 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
messages: 支持 · message_batches: 支持
训练知识截止
2026-01 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Claude Fable 5

claude-fable-5
在售
上下文
1M
输入
¥72 ¥ / 1M tokens
输出
¥360 ¥ / 1M tokens
接入方式
自带密钥
推理方式 adaptive(恒可用) · 不可关闭 · max / xhigh / high / medium / low
查看补充规格
单次最大输出
128k
部署
standard · public · current
缓存读取
¥7.2 ¥ / 1M tokens
缓存写入
¥90 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
messages: 支持 · message_batches: 支持
训练知识截止
2026-01 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Claude Haiku 4.5

claude-haiku-4-5-20251001
在售
上下文
200k
输入
¥7.2 ¥ / 1M tokens
输出
¥36 ¥ / 1M tokens
接入方式
自带密钥
推理方式 extended thinking · 预算 ≥1024
查看补充规格
单次最大输出
64k
部署
standard · public · current
缓存读取
¥0.72 ¥ / 1M tokens
缓存写入
¥9 ¥ / 1M tokens
输入模态
文本 · 图像
输出模态
文本
端点
messages: 支持 · message_batches: 支持
训练知识截止
2025-02 模型训练数据覆盖的最晚时间
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

海外

Google Gemini

厂商文档

Gemini 3.1 Pro (preview)

gemini-3.1-pro-preview
在售
上下文
1M
输入
¥14.4 ¥ / 1M tokens >200k ¥28.8
输出
¥86.4 ¥ / 1M tokens >200k ¥129.6
接入方式
自带密钥
推理方式 thinkingConfig · 不可关闭 · high / medium / low
查看补充规格
单次最大输出
66k
部署
standard · public · current
缓存读取
¥1.44 ¥ / 1M tokens
非 Token 计费
context_cache_storage: ¥32.4 / 1000000 token_hour · context_cache_storage: ¥58.32 / 1000000 token_hour · google_search_grounding: ¥100.8 / 1000 query · google_maps_grounding: ¥100.8 / 1000 query
输入模态
文本 · 图像 · 音频 · 视频 · pdf
输出模态
文本
端点
interactions: 支持 · generate_content: 支持 · batch: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Gemini 3.7 Flash

gemini-3.7-flash
在售
上下文
1M
输入
¥5.4 ¥ / 1M tokens
输出
¥27 ¥ / 1M tokens
接入方式
自带密钥
推理方式 thinkingConfig · 不可关闭 · high / medium / low
查看补充规格
单次最大输出
66k
部署
standard · public · current
缓存读取
¥0.54 ¥ / 1M tokens
非 Token 计费
context_cache_storage: ¥3.6 / 1000000 token_hour · context_cache_storage: ¥7.2 / 1000000 token_hour · google_search_grounding: ¥100.8 / 1000 query · google_maps_grounding: ¥100.8 / 1000 query
输入模态
文本 · 图像 · 音频 · 视频 · pdf
输出模态
文本
端点
interactions: 支持 · generate_content: 支持 · batch: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Gemini 3.6 Flash

gemini-3.6-flash
在售
上下文
1M
输入
¥5.4 ¥ / 1M tokens
输出
¥27 ¥ / 1M tokens
接入方式
自带密钥
推理方式 thinkingConfig · 不可关闭 · high / medium / low / minimal
查看补充规格
单次最大输出
66k
部署
standard · public · current
缓存读取
¥0.54 ¥ / 1M tokens
非 Token 计费
context_cache_storage: ¥3.6 / 1000000 token_hour · context_cache_storage: ¥7.2 / 1000000 token_hour · google_search_grounding: ¥100.8 / 1000 query · google_maps_grounding: ¥100.8 / 1000 query
输入模态
文本 · 图像 · 音频 · 视频 · pdf
输出模态
文本
端点
interactions: 支持 · generate_content: 支持 · batch: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

Gemini 3.5 Flash-Lite

gemini-3.5-flash-lite
在售
上下文
1M
输入
¥2.16 ¥ / 1M tokens
输出
¥18 ¥ / 1M tokens
接入方式
自带密钥
推理方式 thinkingConfig · 不可关闭 · high / medium / low / minimal
查看补充规格
单次最大输出
66k
部署
standard · public · current
缓存读取
¥0.216 ¥ / 1M tokens
非 Token 计费
context_cache_storage: ¥7.2 / 1000000 token_hour · google_search_grounding: ¥100.8 / 1000 query · google_maps_grounding: ¥100.8 / 1000 query
输入模态
文本 · 图像 · 音频 · 视频 · pdf
输出模态
文本
端点
interactions: 支持 · generate_content: 支持 · batch: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。

海外

xAI Grok

厂商文档

Grok 4.6

grok-4.6
在售
上下文
500k
输入
¥14.4 ¥ / 1M tokens >200k ¥28.8
输出
¥43.2 ¥ / 1M tokens >200k ¥86.4
接入方式
自带密钥
推理方式 reasoning_effort · 不可关闭 · xhigh / high / medium / low
查看补充规格
部署
standard · public · current
缓存读取
¥3.6 ¥ / 1M tokens
非 Token 计费
web_search: ¥36 / 1000 次 · x_search: ¥36 / 1000 次 · code_execution: ¥36 / 1000 次
输入模态
文本 · 图像
输出模态
文本
端点
chat_completions: 支持 · responses: 支持
最近核验
2026-08-26

补充规格来自字段级官方 source set;冲突会保留,不会补猜测。