对话上下文 1M深度思考
DeepSeek-V4 系列,1.6万亿参数(激活490亿),旗舰级推理
输入¥6.6
输出¥25.2
元 / 百万 tokens
对话上下文 1M深度思考
DeepSeek-V4 系列预览版,2840亿参数(激活130亿),高性价比,高峰期不加价
输入¥1.3
输出¥2.6
元 / 百万 tokens
对话上下文 1M深度思考
DeepSeek-V4-Flash 官方正式版,取代预览版,智能体能力显著提升
输入¥1.3
输出¥2.6
元 / 百万 tokens
对话上下文 131K深度思考
DeepSeek 正式版,平衡推理与输出效率,适合日常问答与智能体任务
输入¥1.3
输出¥1.95
元 / 百万 tokens
对话上下文 32K深度思考
DeepSeek 自研 MoE 模型,性能对标顶级闭源模型
输入¥2.08
输出¥8.32
元 / 百万 tokens
对话上下文 32K深度思考
深度思考模型,数学/编程/逻辑推理表现突出
输入¥4.16
输出¥16.64
元 / 百万 tokens
对话上下文 8K深度思考
基于 R1 推理数据蒸馏,擅长多步推导和代码生成
输入¥2.08
输出¥6.24
元 / 百万 tokens
对话上下文 196K深度思考
星火旗舰,对标国际顶尖,数学/推理/智能体能力强
输入¥3.9
输出¥3.9
元 / 百万 tokens
对话上下文 262K深度思考
星火30B,面向Agent场景优化,高性价比,输入最长192K
输入¥1.3
输出¥2.6
元 / 百万 tokens
对话上下文 8K深度思考
星火专业级大模型,内容创作与知识处理表现出色
输入¥10.4
输出¥52
元 / 百万 tokens
对话上下文 8K深度思考
星火轻量级模型,低时延,适合移动端快速响应
输入¥2.6
输出¥7.8
元 / 百万 tokens
对话上下文 1M深度思考
智谱旗舰,长程任务能力相比前代显著飞跃
输入¥10.4
输出¥36.4
元 / 百万 tokens
对话上下文 204K深度思考
智谱新一代旗舰,超强代码、超长上下文与智能体能力
输入¥10.4
输出¥36.4
元 / 百万 tokens
对话上下文 204K深度思考
智谱745B MoE 旗舰基座模型,面向复杂系统与长程Agent
输入¥7.8
输出¥28.6
元 / 百万 tokens
对话上下文 202K深度思考
智谱 MoE 旗舰,代理式编码与复杂任务执行能力强
输入¥5.2
输出¥20.8
元 / 百万 tokens
对话上下文 131K深度思考
智谱30B MoE,轻量级SOTA,适合消费级硬件本地部署与编码
输入¥1.3
输出¥1.95
元 / 百万 tokens
对话上下文 262K深度思考
Kimi 编程专属模型,K2 系列第三代代码专项迭代
输入¥8.45
输出¥35.1
元 / 百万 tokens
对话上下文 262K深度思考
Kimi 开源多模态智能体模型,长链路代码与自主执行升级
输入¥8.45
输出¥35.1
元 / 百万 tokens
对话上下文 131K深度思考
Kimi 多模态智能体模型,即时模式与思考模式无缝集成
输入¥5.2
输出¥27.3
元 / 百万 tokens
对话上下文 262K深度思考
Kimi 深度推理思考模型,可多步工具调用解决难题
输入¥5.2
输出¥20.8
元 / 百万 tokens
对话上下文 131K深度思考
Kimi 1T参数 MoE 基础模型,代码与Agent能力超强
输入¥5.2
输出¥20.8
元 / 百万 tokens
对话上下文 131K深度思考
Qwen3.6 350亿参数/30亿激活,智能体编码与思维上下文升级
输入¥1.4
输出¥8.42
元 / 百万 tokens
对话上下文 262K深度思考
Qwen3.5 原生多模态智能体基础模型,极致稀疏 MoE
输入¥1.56
输出¥9.36
元 / 百万 tokens
对话上下文 262K深度思考
专为编码智能体和本地开发设计的开源模型,256K上下文
输入¥3.25
输出¥13
元 / 百万 tokens
对话上下文 262K深度思考
Qwen3-Next 混合注意力架构,超长上下文与高稀疏MoE
输入¥0.78
输出¥3.12
元 / 百万 tokens
对话上下文 65K深度思考
Qwen3 235B MoE,通用能力与多语言长尾覆盖显著提升
输入¥1.56
输出¥15.6
元 / 百万 tokens
对话上下文 32K深度思考
Qwen 旗舰 MoE 模型,推理/指令遵循/工具整合领先
输入¥1.56
输出¥15.6
元 / 百万 tokens
对话上下文 32K深度思考
Qwen 中大型模型,企业级推理与长文档分析
输入¥1.56
输出¥15.6
元 / 百万 tokens
对话上下文 32K深度思考
Qwen3 30B 非思考模式更新版,指令遵循与推理提升
输入¥0.59
输出¥5.85
元 / 百万 tokens
对话上下文 32K深度思考
Qwen MoE 模型,推理与多语言支持全面突破
输入¥0.59
输出¥5.85
元 / 百万 tokens
对话上下文 16K深度思考
Qwen 中大型模型,企业级推理与长文档处理
对话上下文 16K深度思考
Qwen 中大型模型,兼顾效率与长文本处理
输入¥0.65
输出¥6.5
元 / 百万 tokens
对话上下文 16K深度思考
Qwen 轻量级模型,适合快速部署与多轮对话
输入¥0.39
输出¥3.9
元 / 百万 tokens
对话上下文 32K深度思考
Qwen 轻量级模型,中小算力快速部署
输入¥0.39
输出¥3.9
元 / 百万 tokens
对话上下文 32K深度思考
Qwen 20亿参数轻量模型,端侧本地运行
输入¥0.26
输出¥0.52
元 / 百万 tokens
对话上下文 32K深度思考
Qwen2.5 76亿参数,多语言理解与生成能力强
输入¥0.65
输出¥1.3
元 / 百万 tokens
对话上下文 8K深度思考
Qwen2.5-14b 超大规模语言模型
输入¥2.6
输出¥7.8
元 / 百万 tokens
对话上下文 8K深度思考
Qwen2 15亿参数指令模型
输入¥1.3
输出¥2.6
元 / 百万 tokens
对话上下文 8K深度思考
Qwen2 5亿参数指令模型
输入¥2.6
输出¥5.2
元 / 百万 tokens
对话上下文 8K深度思考
Qwen2.5 30亿参数指令模型,支持29+语言
输入¥2.6
输出¥10.4
元 / 百万 tokens
对话上下文 131K深度思考
MiniMax 原生为Agent场景设计的旗舰模型,更快更强更智能
输入¥2.73
输出¥10.92
元 / 百万 tokens
对话上下文 32K深度思考
腾讯多语言翻译模型,快速推理,覆盖端侧到服务器
输入¥0.65
输出¥2.6
元 / 百万 tokens
视觉上下文 32K深度思考
Qwen3 视觉语言模型,Dense/MoE 双架构,支持视频理解与OCR
输入¥2.6
输出¥10.4
元 / 百万 tokens
视觉上下文 8K免费
DeepSeek 高性能 OCR,全模态识别+结构化输出(上游免费)
免费0 元
视觉上下文 32K免费
腾讯混元轻量 OCR 专用视觉语言模型(上游免费)
免费0 元
视觉上下文 32K免费
百度飞桨视觉语言 OCR,对标顶尖VLM(上游免费)
免费0 元
文生图上下文 —免费
阿里通义 12月更新文生图模型,人物真实感与文字渲染突出
免费0 元
文生图上下文 0K免费
开源免费图像生成模型 6B,1秒出图,16GB显存可跑
免费0 元
重排序上下文 32K免费
Qwen3 重排序模型,MTEB-R 领先,支持100+语言
免费0 元
向量上下文 32K免费
Qwen3 文本嵌入模型,MTEB 多语言榜首
免费0 元