Skills MCP Model 博客 提交 Skills
登录 注册

大模型 全景图

覆盖 OpenAI、Anthropic、Google、DeepSeek、Meta、阿里、字节等 12 家提供商,56 款旗舰模型。按提供商、类别、类型筛选,一站式模型对比与选型指南。

提供商:
类别:
类型:
OpenAI 8 个模型
GPT-4o
商业闭源 多模态
GPT-4o 是 OpenAI 的旗舰多模态模型,原生支持文本、图像、音频的输入与输出。它在理解视觉内容和语音交互方面表现卓越,平均响应速度比 GPT-4 Turbo 快 2 倍,成本降低 50%。作为 OpenAI 目前最全能的模型,GPT-4o 在 MMLU、HumanEval 等多项基准测试中保持领先地位。
多模态原生支持 128K 超长上下文 极低延迟响应 +1
2024-05 查看详情 →
GPT-4o-mini
商业闭源 文本
GPT-4o-mini 是 OpenAI 最具成本效益的小型模型,旨在以极低价格提供 GPT-4o 级别的核心能力。它支持文本和视觉输入,在 MMLU 上得分 82%,在数学推理和编码任务中超越了同级别的 GPT-3.5 Turbo。适合大规模生产环境中的简单任务处理。
极低成本 128K 上下文 文本+视觉输入 +1
2024-07 查看详情 →
GPT-4.1
商业闭源 文本
GPT-4.1 是 OpenAI 专为开发者打造的新一代模型,在代码生成、指令遵循和长上下文理解方面相比 GPT-4o 有显著提升。它支持高达 100 万 tokens 的上下文窗口,能够处理超长文档和代码库。在前端代码生成、API 调用和结构化输出等任务中表现突出。
100万 tokens 上下文 代码生成能力大幅增强 指令遵循精度提升 +1
2025-04 查看详情 →
o3
商业闭源 推理
o3 是 OpenAI 最强大的推理模型,采用链式思维(Chain-of-Thought)深度推理机制,在数学、编程和科学推理方面达到前所未有的水平。它在 2025 年 IOI 金牌级别的编程竞赛中取得优异成绩,在 GPQA 博士级科学推理基准上超越人类专家。适合需要深度思考的复杂推理任务。
深度链式思考推理 200K tokens 上下文 数学与编程领域顶尖 +1
2025-04 查看详情 →
o4-mini
商业闭源 推理
o4-mini 是 OpenAI 推出的高效推理模型,在保持 o3 核心推理能力的同时大幅降低计算成本。它采用优化的推理架构,在数学、编程和科学任务中表现优异,是 o3 系列的轻量替代方案。适合需要推理能力但预算有限的场景,在性价比上达到了新的平衡。
高效推理架构 200K tokens 上下文 成本优化的链式思维 +1
2025-04 查看详情 →
GPT-4.1
商业闭源 文本
GPT-4.1 是 OpenAI 最新旗舰模型,在编码、指令遵循和长上下文理解方面全面领先。它拥有 100 万 tokens 的超长上下文窗口,在 SWE-bench 编码基准上取得突破性成绩。与 GPT-4o 相比,GPT-4.1 在复杂任务中表现更加稳定和可靠,是企业级 AI 应用的首选模型。
100万 tokens 上下文 编码能力行业领先 指令遵循精准 +1
2025-04 查看详情 →
GPT-4.1-mini
商业闭源 文本
GPT-4.1-mini 是 OpenAI 推出的高效模型,在保持 GPT-4.1 核心能力的同时大幅降低成本和延迟。它同样拥有 100 万 tokens 上下文窗口,在大多数任务中表现接近 GPT-4.1,但价格仅为后者的 1/5。是预算敏感场景和大规模部署的最佳选择。
100万 tokens 上下文 高性价比 低延迟 +1
2025-04 查看详情 →
GPT-4.1-nano
商业闭源 文本
GPT-4.1-nano 是 OpenAI 最快、最经济的模型,专为简单任务和超高吞吐量场景设计。它拥有 100 万 tokens 上下文窗口,在分类、提取、简单问答等任务中表现出色。延迟极低,价格仅为 GPT-4.1 的 1/20,是自动化流水线和大规模数据处理的理想选择。
100万 tokens 上下文 极低延迟 超高吞吐 +1
2025-04 查看详情 →
Anthropic 4 个模型
Claude 4 Sonnet
商业闭源 文本
Claude 4 Sonnet 是 Anthropic 的中高端模型,在智能与效率之间取得最佳平衡。它在编程、写作和复杂分析任务中表现卓越,支持 200K tokens 上下文窗口。Claude 4 Sonnet 在 SWE-bench 编码基准上取得新突破,同时在写作质量和安全性方面保持 Anthropic 一贯的高标准。
200K tokens 上下文 代码生成能力强 写作质量高 +1
2025-05 查看详情 →
Claude 4 Opus
商业闭源 文本
Claude 4 Opus 是 Anthropic 最强大的模型,专为需要深度推理、复杂分析和创意写作的高难度场景设计。它在长文档理解、多步骤推理和跨领域知识整合方面表现卓越。Claude 4 Opus 在 GPQA、MMLU 等学术基准上达到顶尖水平,同时保持了 Anthropic 在安全性和可靠性方面的领先优势。
200K tokens 上下文 深度推理能力强 创意写作与复杂分析 +1
2025-05 查看详情 →
Claude 3.5 Haiku
商业闭源 文本
Claude 3.5 Haiku 是 Anthropic 最快的模型,专为需要低延迟和高吞吐量的场景设计。它在保持较高推理质量的同时,响应速度极快,非常适合实时对话、内容审核和数据处理等场景。在同等速度级别的模型中,Claude 3.5 Haiku 的智能水平居于领先地位。
极低延迟 200K tokens 上下文 高吞吐量 +1
2024-10 查看详情 →
Claude 3.5 Sonnet
商业闭源 文本
Claude 3.5 Sonnet 是 Anthropic 的中端旗舰模型,在智能与速度之间取得最佳平衡。它在编程、创意写作和复杂分析中表现卓越,支持 200K tokens 上下文。在 SWE-bench 编码基准上取得突破性成绩,同时保持了 Anthropic 在安全性和可靠性方面的领先标准。
200K tokens 上下文 编程能力突出 创意写作 +1
2024-06 查看详情 →
Google 4 个模型
Gemini 2.5 Pro
商业闭源 多模态
Gemini 2.5 Pro 是 Google 最先进的思考型模型,能够在回答前进行深度推理。它拥有 100 万 tokens 的超长上下文窗口,原生支持文本、图像、视频、音频和代码的多模态理解。在 LMArena 排行榜上长期位居前列,数学和科学推理能力尤其突出,适合需要复杂推理和跨模态理解的专业场景。
100万 tokens 上下文 原生多模态 链式思考推理 +1
2025-03 查看详情 →
Gemini 2.5 Flash
商业闭源 多模态
Gemini 2.5 Flash 是 Google 的高效思考型模型,在速度与智能之间取得优化平衡。它同样支持 100 万 tokens 上下文和原生多模态,并具备思考推理能力。相比 Pro 版本,Flash 以更低的延迟和成本提供了接近的智能水平,是大多数生产场景的理想选择。
100万 tokens 上下文 思考推理能力 低延迟高吞吐 +1
2025-03 查看详情 →
Gemma 3
开源 多模态
Gemma 3 是 Google 推出的开源轻量级模型系列,基于 Gemini 2.0 技术构建。它提供 1B 到 27B 四种规格,支持文本和视觉多模态输入,拥有 128K tokens 上下文窗口。Gemma 3 在同参数规模模型中性能领先,可运行在单 GPU 甚至手机上,是开源社区进行模型微调和部署的优质选择。
多规格可选 128K 上下文 文本+视觉多模态 +1
2025-03 查看详情 →
Gemini 2.5 Pro (Thinking)
商业闭源 推理
Gemini 2.5 Pro 的思考增强版本,在回答前进行更深入的推理链分析。它特别强化了数学、科学和逻辑推理能力,在需要多步骤推导的复杂问题中表现远超普通版本。支持 100 万 tokens 上下文和原生多模态输入,是 Google 目前最强大的推理模型。
深度思考推理 100万 tokens 上下文 原生多模态 +1
2025-06 查看详情 →
DeepSeek 5 个模型
DeepSeek-V3
开源 文本
DeepSeek-V3 是 DeepSeek 的旗舰 MoE 模型,总参数量达 671B,每次推理仅激活 37B 参数。它采用多头潜在注意力(MLA)和 DeepSeekMoE 架构,训练成本仅 557 万美元,却达到了与 GPT-4o、Claude 3.5 Sonnet 相当的性能水平。在数学和编码任务中表现尤为突出,是开源社区最具影响力的模型之一。
MoE 高效架构 MLA 注意力机制 极低训练成本 +1
2024-12 查看详情 →
DeepSeek-R1
开源 推理
DeepSeek-R1 是 DeepSeek 推出的推理增强模型,也是首个开源的大型推理模型。它通过强化学习训练实现了链式思维推理能力,在数学、编程和科学推理等任务上的表现与 OpenAI o1 不相上下。R1 的完全开源引发全球 AI 社区震动,证明了开源模型在推理能力上可以媲美最先进的商业闭源模型。
链式思维推理 强化学习驱动 完全开源 +1
2025-01 查看详情 →
DeepSeek-Coder-V2
开源 代码
DeepSeek-Coder-V2 是 DeepSeek 专为代码场景打造的开源模型,基于 MoE 架构,在 338 种编程语言上训练。它在 HumanEval、MBPP 等编码基准测试中超越了 GPT-4 Turbo,在代码补全、调试和重构方面表现优异。支持 128K 上下文,可处理大型代码库,是开发者的理想编程助手。
338 种编程语言支持 128K 上下文 代码补全与调试 +1
2024-06 查看详情 →
DeepSeek-V2.5
开源 文本
DeepSeek-V2.5 是 DeepSeek-V2 的重大升级版本,融合了 DeepSeek-Coder-V2 的代码能力和 DeepSeek-V2 的通用能力。它在数学、编程和通用任务上均达到业界领先水平,并支持联网搜索和文件上传等实用功能。V2.5 以极低的部署成本提供了接近 GPT-4o 的性能。
代码+通用能力融合 128K 上下文 联网搜索 +1
2024-09 查看详情 →
DeepSeek-Janus-Pro
开源 多模态
DeepSeek-Janus-Pro 是 DeepSeek 推出的统一多模态理解和生成模型。它采用创新的解耦视觉编码架构,既支持图像理解(描述、问答、OCR),又支持图像生成(文生图)。7B 参数的设计使其可以高效运行,在统一多模态模型中开辟了新的技术路线。
理解+生成统一架构 7B 轻量参数 解耦视觉编码 +1
2025-01 查看详情 →
Meta 4 个模型
Llama 4 Scout
开源 多模态
Llama 4 Scout 是 Meta 推出的轻量级开源多模态模型,采用 MoE 架构,拥有 17B 活跃参数和惊人的 1000 万 tokens 上下文窗口。它原生支持文本和图像理解,可在单张 H100 GPU 上运行。Scout 在长文档处理和代码理解方面表现突出,是开源模型中上下文窗口最长的选择。
1000万 tokens 超长上下文 MoE 架构 单 GPU 可运行 +1
2025-04 查看详情 →
Llama 4 Maverick
开源 多模态
Llama 4 Maverick 是 Meta 的高性能开源多模态模型,同样采用 MoE 架构,拥有 400B 总参数和 17B 活跃参数。它在图像理解、编码和推理领域表现卓越,性能与 GPT-4o 相当。Maverick 拥有 1000 万 tokens 的超长上下文窗口,在长文档分析、代码库理解和多模态对话方面具有显著优势。
1000万 tokens 超长上下文 业界领先的多模态 MoE 高效推理 +1
2025-04 查看详情 →
Llama 3.3
开源 文本
Llama 3.3 是 Meta Llama 3 系列的最终版本,在 70B 参数规模下实现了接近 Llama 3.1 405B 的性能水平。它采用密集架构(非 MoE),在文本生成、代码编写和多语言任务方面表现出色。Llama 3.3 以更低的部署成本提供了高质量的文本生成能力,是开源社区最受欢迎的基座模型之一。
70B 参数高性能 128K 上下文 多语言支持 +1
2024-12 查看详情 →
Llama 3.2
开源 多模态
Llama 3.2 是 Meta 推出的多模态模型系列,首次在 Llama 系列中引入视觉理解能力。它提供 1B、3B 的轻量纯文本模型和 11B、90B 的多模态模型,覆盖从手机到数据中心的全部部署场景。90B 版本在图像理解、文档分析和多模态对话方面表现优异。
多规格覆盖全场景 视觉理解能力 128K 上下文 +1
2024-09 查看详情 →
阿里云 5 个模型
Qwen3
开源 文本
Qwen3 是阿里通义千问团队发布的最新开源模型系列,提供从 0.6B 到 235B 的多种规格。旗舰版 Qwen3-235B 采用 MoE 架构,在编码、数学和通用能力上全面对标 DeepSeek-V3。Qwen3 系列特别强化了思考模式(Thinking Mode),支持工具调用和 Agent 能力,是开源社区最具竞争力的模型系列之一。
多规格覆盖全场景 思考推理模式 128K 上下文 +1
2025-04 查看详情 →
Qwen2.5-Max
商业闭源 文本
Qwen2.5-Max 是阿里云推出的旗舰级商业闭源模型,采用大规模 MoE 架构,在综合能力上对标 GPT-4o 和 Claude 3.5 Sonnet。它在中文理解、知识问答和复杂推理方面表现突出,特别优化了中英文混合场景下的应用体验。通过阿里云百炼平台提供服务,面向企业级客户。
大规模 MoE 架构 128K 上下文 中文能力顶尖 +1
2025-01 查看详情 →
Qwen2.5-VL
开源 多模态
Qwen2.5-VL 是阿里通义千问团队的视觉语言模型,支持图像、视频和文档的深度理解。它能够动态分辨率处理任意尺寸的图片,支持长达数小时的视频分析,并能精准定位图像中的物体坐标。72B 版本在多模态基准测试中达到业界领先水平,是开源视觉语言模型的标杆之一。
动态分辨率视觉理解 长视频分析 物体定位与 OCR +1
2025-01 查看详情 →
Qwen2.5-Coder
开源 代码
Qwen2.5-Coder 是阿里云专为代码场景打造的开源模型系列,在 5.5 万亿 tokens 的代码数据上训练。它在 HumanEval、MBPP、LiveCodeBench 等编码基准上全面领先同规模模型,32B 版本的编码能力甚至超越了 GPT-4o。支持 92 种编程语言,是开源社区最强大的代码模型之一。
92 种编程语言 128K 上下文 多规格可选 +1
2024-11 查看详情 →
Qwen2.5-Math
开源 推理
Qwen2.5-Math 是阿里云专为数学推理打造的开源模型,在英文和中文数学数据上训练。它在 MATH、GSM8K 等数学基准上达到了业界领先水平,72B 版本在竞赛级数学问题上表现尤为突出。支持 CoT 和 TIR(工具集成推理)两种推理模式,是数学教育和研究的理想工具。
数学推理专精 128K 上下文 CoT+TIR 推理 +1
2024-09 查看详情 →
Mistral AI 4 个模型
Mistral Large 2
商业闭源 文本
Mistral Large 2 是 Mistral AI 的旗舰模型,拥有 123B 参数,在代码生成、数学推理和多语言处理方面表现卓越。它支持数十种自然语言和 80 多种编程语言,在 MMLU 上达到 84.0% 的准确率。Mistral Large 2 以相对较小的参数规模实现了接近 GPT-4o 的性能,是欧洲 AI 力量的杰出代表。
123B 参数高效架构 128K 上下文 80+ 编程语言支持 +1
2024-07 查看详情 →
Pixtral Large
开源 多模态
Pixtral Large 是 Mistral AI 的旗舰视觉语言模型,基于 Mistral Large 2 架构,新增了先进的视觉编码器。它在文档理解、图表分析和多模态推理方面表现卓越,支持 128K tokens 上下文和多语言处理。Pixtral Large 在开源视觉语言模型中处于领先地位,可处理复杂的图文混合任务。
124B 参数视觉语言模型 128K 上下文 文档图表分析 +1
2024-11 查看详情 →
Codestral
开源 代码
Codestral 是 Mistral AI 专为代码生成打造的模型,支持 80+ 种编程语言。它在代码补全、调试和重构方面表现优异,在 HumanEval 和 MBPP 等编码基准上达到了同规模模型的最高水平。22B 参数的高效架构使其可以在消费级 GPU 上运行,是开发者的理想编程助手。
80+ 编程语言 代码补全与调试 22B 高效架构 +1
2024-05 查看详情 →
Ministral 8B
开源 文本
Ministral 8B 是 Mistral AI 的边缘端模型,专为本地设备和离线场景设计。它在 8B 参数规模下实现了出色的推理能力和多语言支持,可在笔记本电脑和手机上流畅运行。Ministral 8B 在知识问答、翻译和摘要等任务中表现出色,是边缘 AI 部署的最佳选择之一。
8B 轻量参数 128K 上下文 边缘设备优化 +1
2024-10 查看详情 →

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

完全免费,取消任意时间。我们不会发送垃圾邮件。