供应商
模型类型
模型功能
上下文长度
DeepSeek V3.2 Fast
by DeepSeek
SophNet独家专研的DeepSeek V3.2 Fast 是 DeepSeek V3.2版本的高TPS极速版,高达100t/s,响应更快!
DeepSeek V3.2
by DeepSeek
一个在高计算效率与卓越推理和代理性能之间取得平衡的模型。
DeepSeek V3.2 Exp
by DeepSeek
引入DeepSeek稀疏注意力(DSA)机制,性能持平,推理效率大幅提升,API调用成本直降50%以上。
DeepSeek V3.1 Fast
by DeepSeek
DeepSeek V3.1 Terminus的高性能极速版本,吞吐量高达150t/s,响应速度显著提升,适合需要快速交互的应用场景。
DeepSeek V3.1
by DeepSeek
DeepSeek V3.1 Terminus,混合推理模型,在代码生成、数学推理和创意写作等任务中表现卓越,具备强大的工具使用能力。
DeepSeek R1 0528
by DeepSeek
通过强化学习训练的推理模型,在编程能力、审美设计和前端页面生成方面表现尤为突出。
DeepSeek R1
by DeepSeek
首个通过大规模强化学习直接训练的推理模型,无需监督微调,在数学和编程任务中表现优异。
DeepSeek V3 Fast
by DeepSeek
DeepSeek V3 0324的高性能极速版本,响应速度更快,适合技术型应用场景。
DeepSeek V3 0324
by DeepSeek
DeepSeek V3 0324,在15万亿token上预训练的升级版本,指令遵循和代码能力全面提升,性价比优异。
MiMo-V2-Flash
by Xiaomi
一个混合专家(MoE)语言模型,专为高速推理和代理工作流设计。
MiniMax-M2.5
by MiniMax
MiniMax最新旗舰模型,在编程、智能体工具调用、搜索及办公场景中达到SOTA水平,兼具极致速度与超低成本。
MiniMax-M2.1
by MiniMax
不止于代码生成,定义“可交付”的AI编程新范式
GLM-5
by Z-ai
智谱AI新一代旗舰模型,在编程、推理、多模态及长上下文理解能力上实现质的飞跃,驱动更强大的智能体应用。
GLM-4.7
by Z-ai
智谱AI最新旗舰模型,编程与推理能力升级,执行复杂任务更强,对话更自然。
GLM-4.6
by Z-ai
相比GLM-4.5,支持更长上下文,代码和Agent能力全面升级。
Kimi-K2.5
by Moonshot
全新视觉理解、代码和 Agent 集群能力。
Kimi-K2
by Moonshot
具备超强代码和Agent能力的MoE基础模型,在编程、数学和代理任务中表现突出。
Kimi-K2-Thinking
by Moonshot
原生掌握「边思考,边使用工具」的能力,更强的 Agent 和推理性能。
Kimi-K2-0905
by Moonshot
1T参数MoE架构,256K超长上下文处理,在通用知识推理和编程任务中展现出领先性能。
LongCat-Flash-Chat
by Meituan
采用创新MoE架构的高效语言模型,动态计算机制显著优化了计算效率和性能表现,Agent能力突出。
Seed-OSS-36B-Instruct
by Bytedance
支持512K超长上下文的开源模型,具备强大的推理能力和丰富的开发者友好功能。
Qwen3.5-397B-A17B
by Tongyi
通义千问全新一代原生多模态开源旗舰模型,397B总参数仅17B激活,性能媲美Gemini 3 Pro,Token价格仅为其1/18。
Qwen3-Coder-Next
by Tongyi
通义千问系列下一代代码模型,专为编程场景设计,具备卓越的代码理解、生成、调试与多语言支持能力。
Qwen3-Coder
by Tongyi
专为代码生成优化的MoE模型,特别擅长函数调用、工具使用和基于存储库的长上下文推理。
Qwen3-Next-80B-A3B-Instruct
by Tongyi
指令调优的高性能模型,响应快速稳定,在推理、代码生成和多语言应用中表现优异。
Qwen3-Next-80B-A3B-Thinking
by Tongyi
专为复杂多步骤问题设计的推理优先模型,默认输出结构化思考轨迹,适合数学证明和逻辑规划。
Qwen3-30B-A3B-Instruct-2507
by Tongyi
平衡性能与成本的指令模型,在多语言理解和代理工具使用方面表现突出。
Qwen3-30B-A3B-Thinking-2507
by Tongyi
30B参数MoE推理模型,针对需要扩展多步骤思考的复杂任务进行了专门优化。
Qwen3-32B
by Tongyi
支持思考与非思考模式无缝切换,在指令遵循、代理工具使用和多语言任务中表现出色。
Qwen3-14B
by Tongyi
轻量级但功能全面的模型,在推理、指令遵循和代理能力方面取得突破性进展。
Qwen3-235B-A22B-Instruct-2507
by Tongyi
235B参数MoE指令模型,支持128K超长上下文,在逻辑推理和工具使用方面表现卓越。
Qwen3-235B-A22B-Thinking-2507
by Tongyi
高性能纯思考推理模型,专为挑战性领域中的高标记输出和复杂逻辑推理而设计。
Qwen3-235B-A22B
by Tongyi
旗舰级MoE模型,在多语言支持、推理能力和指令遵循方面取得重大突破。
QwQ-32B
by Tongyi
具备思考和推理能力的中型模型,在困难问题解决上可媲美最先进的推理模型。
Qwen2.5-72B-Instruct
by Tongyi
显著提升知识量和专业领域能力,支持128K长上下文和超8K文本生成。
Qwen2.5-32B-Instruct
by Tongyi
高性能推理模型,在复杂推理、数学计算和代码生成任务上表现突出。
Qwen2.5-7B-Instruct
by Tongyi
经济高效的轻量级模型,在中文任务和基础数学推理上优于同类7B模型。
DeepSeek-R1-Distill-Qwen-32B
by DeepSeek
基于Qwen2.5-32B的知识蒸馏模型,在多个基准测试中创造密集模型新纪录。
DeepSeek-R1-Distill-Qwen-7B
by DeepSeek
专为高推理速度和低成本优化的蒸馏模型,响应延迟降低40%,适合实时交互。
Qwen3-VL-235B-A22B-Thinking
by Tongyi
多模态推理专家,在STEM和数学领域表现出色,具备强大的感知和空间理解能力。
Qwen3-VL-235B-A22B-Instruct
by Tongyi
多模态模型,在VQA、文档解析和多语言OCR等应用中表现优异。
Qwen2.5-VL-72B-Instruct
by Tongyi
专业视觉语言模型,能分析图像中的文本、图表和布局,支持1小时以上长视频理解。
Qwen2.5-VL-32B-Instruct
by Tongyi
视觉代理模型,能动态指导工具使用,支持计算机和手机操作,精确定位视频片段。
Qwen2.5-VL-7B-Instruct
by Tongyi
轻量级多模态模型,支持20分钟视频理解和复杂推理,可集成移动设备和机器人。
Qwen2-VL-72B-Instruct
by Tongyi
支持多种分辨率和比例图像理解,能进行高质量视频问答、对话和内容创作。
Qwen2-VL-7B-Instruct
by Tongyi
能分析图像中的文本、图表和布局,理解1小时以上长视频并捕捉关键事件。
PaddleOCR-VL-1.5
by Baidu
实现文档解析模型的“异形框定位”能力,并进一步集成印章识别、文本检测与识别等任务能力
PaddleOCR-VL-0.9B
by Baidu
以极低计算开销精准识别文本、手写汉字、表格、公式、图表等复杂元素,支持109种语言。
DeepSeek-OCR
by DeepSeek
采用“视觉 - 文本压缩”技术,使用更少的视觉token,识别精度高达 97%。
Paraformer
by Tongyi
高精度语音识别模型,支持多种语言和方言,能在嘈杂环境中准确转录语音内容。
Cosyvoice
by Tongyi
自然流畅的文本转语音服务,提供多种音色和情感表达,支持中英文混合朗读。
Qwen-Image-Edit-2509
by Tongyi
通义千问-图像编辑模型(Qwen-Image-Edit)支持多图输入和多图输出,可精确修改图内文字、增删或移动物体、改变主体动作、迁移图片风格及增强画面细节。
Z-Image-Turbo
by Tongyi
Z-Image 的精简版本,在逼真图像生成、双语文本渲染(英文和中文)以及稳健的指令遵循方面表现出色。
Qwen-Image
by Tongyi
专业级图像生成模型,特别擅长中英文文本渲染和复杂图文混合布局设计,支持多种艺术风格创作。
Wan2.2-T2V-A14B
by Tongyi
采用MoE 架构,具备电影级视觉控制、大幅度运动还原和精准语义遵循等特点。
Wan2.2-I2V-A14B
by Tongyi
采用 MoE 架构,引入电影美学控制系统,将静态图像转换为具有电影级质感的动态视频。
BGE-M3
by BBAI
支持 100 + 语言与 8192 标记长输入,可实现稠密 / 稀疏 / 多向量检索,跨语种、长文档检索及混合检索重排表现突出。
Text-Embeddings
by Sophnet
将文本转换为高维向量表示,支持语义相似度计算和检索,适用于搜索引擎和推荐系统。
Clip-Embeddings
by Jina
将图像和文本转换为统一的高维向量空间,支持跨模态相似度计算,适用于图文检索和内容推荐。
Document Parse
by Sophnet
智能文档解析服务,能理解和提取各类文档中的关键信息和结构,支持多种格式。