供应商

模型类型

模型功能

上下文长度

共60个模型
New
logo

DeepSeek V3.2 Fast

by DeepSeek

文本生成推理模型Tools128k

SophNet独家专研的DeepSeek V3.2 Fast 是 DeepSeek V3.2版本的高TPS极速版,高达100t/s,响应更快!

¥ 8/Mt input| ¥ 24/Mt output
New
logo

DeepSeek V3.2

by DeepSeek

文本生成推理模型128k

一个在高计算效率与卓越推理和代理性能之间取得平衡的模型。

¥ 2/Mt input| ¥ 3/Mt output
New
logo

DeepSeek V3.2 Exp

by DeepSeek

文本生成推理模型163k

引入DeepSeek稀疏注意力(DSA)机制,性能持平,推理效率大幅提升,API调用成本直降50%以上。

¥ 2/Mt input| ¥ 3/Mt output
New
logo

DeepSeek V3.1 Fast

by DeepSeek

文本生成163k

DeepSeek V3.1 Terminus的高性能极速版本,吞吐量高达150t/s,响应速度显著提升,适合需要快速交互的应用场景。

¥ 8/Mt input| ¥ 24/Mt output
New
logo

DeepSeek V3.1

by DeepSeek

文本生成推理模型PrefixToolsJson128k

DeepSeek V3.1 Terminus,混合推理模型,在代码生成、数学推理和创意写作等任务中表现卓越,具备强大的工具使用能力。

¥ 4/Mt input| ¥ 12/Mt output
logo

DeepSeek R1 0528

by DeepSeek

文本生成推理模型PrefixToolsJson128k

通过强化学习训练的推理模型,在编程能力、审美设计和前端页面生成方面表现尤为突出。

¥ 4/Mt input| ¥ 16/Mt output
logo

DeepSeek R1

by DeepSeek

文本生成推理模型Tools128k

首个通过大规模强化学习直接训练的推理模型,无需监督微调,在数学和编程任务中表现优异。

¥ 4/Mt input| ¥ 16/Mt output
logo

DeepSeek V3 Fast

by DeepSeek

文本生成Tools32k

DeepSeek V3 0324的高性能极速版本,响应速度更快,适合技术型应用场景。

¥ 4/Mt input| ¥ 16/Mt output
logo

DeepSeek V3 0324

by DeepSeek

文本生成PrefixToolsJson128k

DeepSeek V3 0324,在15万亿token上预训练的升级版本,指令遵循和代码能力全面提升,性价比优异。

¥ 2/Mt input| ¥ 8/Mt output
logo

MiMo-V2-Flash

by Xiaomi

文本生成推理模型256k

一个混合专家(MoE)语言模型,专为高速推理和代理工作流设计。

¥ 0.7/Mt input| ¥ 2.1/Mt output
New
logo

MiniMax-M2.5

by MiniMax

文本生成代码生成推理模型智能体ToolsJson200k

MiniMax最新旗舰模型,在编程、智能体工具调用、搜索及办公场景中达到SOTA水平,兼具极致速度与超低成本。

¥ 2.4/Mt input| ¥ 9.6/Mt output
logo

MiniMax-M2.1

by MiniMax

文本生成推理模型Tools196k

不止于代码生成,定义“可交付”的AI编程新范式

¥ 2.1/Mt input| ¥ 8.4/Mt output
New
logo

GLM-5

by Z-ai

文本生成推理模型代码生成PrefixToolsJson200k

智谱AI新一代旗舰模型,在编程、推理、多模态及长上下文理解能力上实现质的飞跃,驱动更强大的智能体应用。

¥ 4/Mt input| ¥ 18/Mt output
logo

GLM-4.7

by Z-ai

文本生成推理模型PrefixToolsJson202k

智谱AI最新旗舰模型,编程与推理能力升级,执行复杂任务更强,对话更自然。

¥ 2/Mt input| ¥ 8/Mt output
logo

GLM-4.6

by Z-ai

文本生成推理模型PrefixTools202k

相比GLM-4.5,支持更长上下文,代码和Agent能力全面升级。

¥ 2/Mt input| ¥ 8/Mt output
New
logo

Kimi-K2.5

by Moonshot

文本生成Tools256k

全新视觉理解、代码和 Agent 集群能力。

¥ 4/Mt input| ¥ 21/Mt output
logo

Kimi-K2

by Moonshot

文本生成PrefixTools128k

具备超强代码和Agent能力的MoE基础模型,在编程、数学和代理任务中表现突出。

¥ 4/Mt input| ¥ 16/Mt output
logo

Kimi-K2-Thinking

by Moonshot

文本生成Tools256k

原生掌握「边思考,边使用工具」的能力,更强的 Agent 和推理性能。

¥ 4/Mt input| ¥ 16/Mt output
logo

Kimi-K2-0905

by Moonshot

文本生成PrefixTools256k

1T参数MoE架构,256K超长上下文处理,在通用知识推理和编程任务中展现出领先性能。

¥ 4/Mt input| ¥ 16/Mt output
logo

LongCat-Flash-Chat

by Meituan

文本生成ToolsJson128k

采用创新MoE架构的高效语言模型,动态计算机制显著优化了计算效率和性能表现,Agent能力突出。

¥ 1/Mt input| ¥ 5/Mt output
logo

Seed-OSS-36B-Instruct

by Bytedance

文本生成512k

支持512K超长上下文的开源模型,具备强大的推理能力和丰富的开发者友好功能。

¥ 1.2/Mt input| ¥ 12/Mt output
New
logo

Qwen3.5-397B-A17B

by Tongyi

文本生成代码生成推理模型多模态智能体PrefixToolsJson262k

通义千问全新一代原生多模态开源旗舰模型,397B总参数仅17B激活,性能媲美Gemini 3 Pro,Token价格仅为其1/18。

¥ 1.2/Mt input| ¥ 7.2/Mt output
New
logo

Qwen3-Coder-Next

by Tongyi

文本生成代码生成推理模型PrefixToolsJson200k

通义千问系列下一代代码模型,专为编程场景设计,具备卓越的代码理解、生成、调试与多语言支持能力。

¥ 4/Mt input| ¥ 16/Mt output
logo

Qwen3-Coder

by Tongyi

文本生成Tools256k

专为代码生成优化的MoE模型,特别擅长函数调用、工具使用和基于存储库的长上下文推理。

¥ 6/Mt input| ¥ 24/Mt output
logo

Qwen3-Next-80B-A3B-Instruct

by Tongyi

文本生成Prefix256k

指令调优的高性能模型,响应快速稳定,在推理、代码生成和多语言应用中表现优异。

¥ 1/Mt input| ¥ 4/Mt output
logo

Qwen3-Next-80B-A3B-Thinking

by Tongyi

文本生成推理模型Prefix256k

专为复杂多步骤问题设计的推理优先模型,默认输出结构化思考轨迹,适合数学证明和逻辑规划。

¥ 1/Mt input| ¥ 10/Mt output
logo

Qwen3-30B-A3B-Instruct-2507

by Tongyi

文本生成Tools256k

平衡性能与成本的指令模型,在多语言理解和代理工具使用方面表现突出。

¥ 0.7/Mt input| ¥ 2.8/Mt output
logo

Qwen3-30B-A3B-Thinking-2507

by Tongyi

文本生成推理模型Tools256k

30B参数MoE推理模型,针对需要扩展多步骤思考的复杂任务进行了专门优化。

¥ 0.7/Mt input| ¥ 2.8/Mt output
logo

Qwen3-32B

by Tongyi

文本生成推理模型ToolsJson40k

支持思考与非思考模式无缝切换,在指令遵循、代理工具使用和多语言任务中表现出色。

¥ 2.0/Mt input| ¥ 8.0/Mt output
logo

Qwen3-14B

by Tongyi

文本生成推理模型Tools40k

轻量级但功能全面的模型,在推理、指令遵循和代理能力方面取得突破性进展。

¥ 1/Mt input| ¥ 4/Mt output
logo

Qwen3-235B-A22B-Instruct-2507

by Tongyi

文本生成Tools128k

235B参数MoE指令模型,支持128K超长上下文,在逻辑推理和工具使用方面表现卓越。

¥ 2/Mt input| ¥ 8/Mt output
logo

Qwen3-235B-A22B-Thinking-2507

by Tongyi

文本生成推理模型Tools128k

高性能纯思考推理模型,专为挑战性领域中的高标记输出和复杂逻辑推理而设计。

¥ 2/Mt input| ¥ 20/Mt output
logo

Qwen3-235B-A22B

by Tongyi

文本生成推理模型Tools128k

旗舰级MoE模型,在多语言支持、推理能力和指令遵循方面取得重大突破。

¥ 2/Mt input| ¥ 8/Mt output
logo

QwQ-32B

by Tongyi

文本生成推理模型Tools128k

具备思考和推理能力的中型模型,在困难问题解决上可媲美最先进的推理模型。

¥ 2/Mt input| ¥ 6/Mt output
logo

Qwen2.5-72B-Instruct

by Tongyi

文本生成ToolsJson128k

显著提升知识量和专业领域能力,支持128K长上下文和超8K文本生成。

¥ 4/Mt input| ¥ 12/Mt output
logo

Qwen2.5-32B-Instruct

by Tongyi

文本生成Tools128k

高性能推理模型,在复杂推理、数学计算和代码生成任务上表现突出。

¥ 2/Mt input| ¥ 6/Mt output
logo

Qwen2.5-7B-Instruct

by Tongyi

文本生成Tools128k

经济高效的轻量级模型,在中文任务和基础数学推理上优于同类7B模型。

¥ 0.5/Mt input| ¥ 1/Mt output
logo

DeepSeek-R1-Distill-Qwen-32B

by DeepSeek

文本生成推理模型32k

基于Qwen2.5-32B的知识蒸馏模型,在多个基准测试中创造密集模型新纪录。

¥ 2/Mt input| ¥ 6/Mt output
logo

DeepSeek-R1-Distill-Qwen-7B

by DeepSeek

文本生成推理模型32k

专为高推理速度和低成本优化的蒸馏模型,响应延迟降低40%,适合实时交互。

¥ 0.5/Mt input| ¥ 1/Mt output
logo

Qwen3-VL-235B-A22B-Thinking

by Tongyi

文本生成推理模型图片理解Tools128k

多模态推理专家,在STEM和数学领域表现出色,具备强大的感知和空间理解能力。

¥ 2/Mt input| ¥ 20/Mt output
logo

Qwen3-VL-235B-A22B-Instruct

by Tongyi

文本生成图片理解Tools128k

多模态模型,在VQA、文档解析和多语言OCR等应用中表现优异。

¥ 2/Mt input| ¥ 8/Mt output
logo

Qwen2.5-VL-72B-Instruct

by Tongyi

文本生成图片理解Json128k

专业视觉语言模型,能分析图像中的文本、图表和布局,支持1小时以上长视频理解。

¥ 16/Mt input| ¥ 48/Mt output
logo

Qwen2.5-VL-32B-Instruct

by Tongyi

文本生成图片理解Tools128k

视觉代理模型,能动态指导工具使用,支持计算机和手机操作,精确定位视频片段。

¥ 8/Mt input| ¥ 24/Mt output
logo

Qwen2.5-VL-7B-Instruct

by Tongyi

文本生成图片理解Tools128k

轻量级多模态模型,支持20分钟视频理解和复杂推理,可集成移动设备和机器人。

¥ 0.5/Mt input| ¥ 0.5/Mt output
logo

Qwen2-VL-72B-Instruct

by Tongyi

文本生成图片理解32k

支持多种分辨率和比例图像理解,能进行高质量视频问答、对话和内容创作。

¥ 16/Mt input| ¥ 48/Mt output
logo

Qwen2-VL-7B-Instruct

by Tongyi

文本生成图片理解32k

能分析图像中的文本、图表和布局,理解1小时以上长视频并捕捉关键事件。

¥ 0.5/Mt input| ¥ 0.5/Mt output
New
logo

PaddleOCR-VL-1.5

by Baidu

OCR

实现文档解析模型的“异形框定位”能力,并进一步集成印章识别、文本检测与识别等任务能力

¥0.014/次 input
logo

PaddleOCR-VL-0.9B

by Baidu

OCR

以极低计算开销精准识别文本、手写汉字、表格、公式、图表等复杂元素,支持109种语言。

¥0.014/次 input
logo

DeepSeek-OCR

by DeepSeek

图片理解OCR8k

采用“视觉 - 文本压缩”技术,使用更少的视觉token,识别精度高达 97%。

¥ 0.216/Mt input| ¥ 0.216/Mt output
logo

Paraformer

by Tongyi

语音识别

高精度语音识别模型,支持多种语言和方言,能在嘈杂环境中准确转录语音内容。

¥0.864(stream),1.2(nostream)/小时 input
logo

Cosyvoice

by Tongyi

语音合成

自然流畅的文本转语音服务,提供多种音色和情感表达,支持中英文混合朗读。

¥2/万字符 input
logo

Qwen-Image-Edit-2509

by Tongyi

图像生成

通义千问-图像编辑模型(Qwen-Image-Edit)支持多图输入和多图输出,可精确修改图内文字、增删或移动物体、改变主体动作、迁移图片风格及增强画面细节。

¥0.3/张 output
logo

Z-Image-Turbo

by Tongyi

图像生成

Z-Image 的精简版本,在逼真图像生成、双语文本渲染(英文和中文)以及稳健的指令遵循方面表现出色。

¥0.1/张 output
logo

Qwen-Image

by Tongyi

图像生成

专业级图像生成模型,特别擅长中英文文本渲染和复杂图文混合布局设计,支持多种艺术风格创作。

¥0.25/张 output
logo

Wan2.2-T2V-A14B

by Tongyi

视频生成

采用MoE 架构,具备电影级视觉控制、大幅度运动还原和精准语义遵循等特点。

¥0.63/1080P,0.33/720P,0.13/480P/秒
logo

Wan2.2-I2V-A14B

by Tongyi

视频生成

采用 MoE 架构,引入电影美学控制系统,将静态图像转换为具有电影级质感的动态视频。

¥0.63/1080P,0.33/720P,0.13/480P/秒
logo

BGE-M3

by BBAI

向量模型

支持 100 + 语言与 8192 标记长输入,可实现稠密 / 稀疏 / 多向量检索,跨语种、长文档检索及混合检索重排表现突出。

¥0.05/Mt input
logo

Text-Embeddings

by Sophnet

向量模型

将文本转换为高维向量表示,支持语义相似度计算和检索,适用于搜索引擎和推荐系统。

¥0.5/Mt input
logo

Clip-Embeddings

by Jina

向量模型

将图像和文本转换为统一的高维向量空间,支持跨模态相似度计算,适用于图文检索和内容推荐。

¥0.5/Mt input
logo

Document Parse

by Sophnet

文档解析

智能文档解析服务,能理解和提取各类文档中的关键信息和结构,支持多种格式。

¥0.2/2000字符 output