Skills MCP Model 博客 提交 Skills

大模型 全景图

覆盖 OpenAI、Anthropic、Google、DeepSeek、Meta、阿里、字节等 22 家提供商,87 款旗舰模型。按提供商、类别、类型筛选,一站式模型对比与选型指南。

提供商:
类别:
类型:
OpenAI 14 个模型
GPT-4.1
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 1M tokens
GPT-4.1はOpenAIが開発者向けに作った次世代モデルで、コード生成、指示追従、長文脈理解においてGPT-4oから大幅に向上しています。最大100万トークンのコンテキストウィンドウをサポートし、非常に長いドキュメントやコードベースを処理できます。フロントエンドコード生成、API呼び出し、構造化出力などのタスクで優れています。
100万 tokens 上下文 代码生成能力大幅增强 指令遵循精度提升 +1
2025-04 查看详情 →
GPT-4.1-mini
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 1M tokens
GPT-4.1-mini は、OpenAI が発表した高効率モデルで、GPT-4.1 のコア機能を維持しつつ、コストとレイテンシを大幅に削減しています。100万トークンのコンテキストウィンドウを備え、ほとんどのタスクで GPT-4.1 に近い性能を発揮しながら、価格はわずか 1/5 です。予算に敏感なシナリオや大規模展開に最適です。
100万 tokens 上下文 高性价比 低延迟 +1
2025-04 查看详情 →
GPT-4.1-nano
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 1M tokens
GPT-4.1-nano は、OpenAI の最速かつ最も経済的なモデルで、単純なタスクと超高スループットのシナリオ向けに設計されています。100万トークンのコンテキストウィンドウを備え、分類、抽出、簡単な Q&A などのタスクで優れた性能を発揮します。レイテンシが非常に低く、価格は GPT-4.1 のわずか 1/20 で、自動化パイプラインや大規模データ処理に最適です。
100万 tokens 上下文 极低延迟 超高吞吐 +1
2025-04 查看详情 →
GPT-4o
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 128K tokens
GPT-4oはOpenAIのフラッグシップマルチモーダルモデルで、テキスト、画像、音声の入出力をネイティブにサポートします。視覚コンテンツの理解と音声対話に優れ、平均応答速度はGPT-4 Turboの2倍、コストは50%削減されます。OpenAIの現在最も多機能なモデルとして、GPT-4oはMMLU、HumanEvalなどの複数のベンチマークでリードしています。
多模态原生支持 128K 超长上下文 极低延迟响应 +1
2024-05 查看详情 →
GPT-4o-mini
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 128K tokens
GPT-4o-miniはOpenAIの最もコスト効率の高い小型モデルで、非常に低価格でGPT-4oレベルのコア機能を提供するように設計されています。テキストと視覚入力をサポートし、MMLUで82%をスコアし、数学的推論とコーディングタスクでGPT-3.5 Turboを上回ります。大規模な本番環境での単純なタスク処理に適しています。
极低成本 128K 上下文 文本+视觉输入 +1
2024-07 查看详情 →
GPT-5
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 200K tokens
GPT-5は、OpenAIが2025年8月に発表したフラッグシップ大規模モデルで、Agent機能とツール呼び出しをネイティブにサポートしています。深い推論、マルチモーダル理解(テキスト/画像/音声/動画)、コード生成を備え、SWE-benchやGPQAなどのベンチマークで記録を更新しました。GPT-5のAgent Plugins仕様は、AIエージェントのプラグインパッケージング標準となっています。
Agent 原生能力 多模态推理 200K 上下文 +1
2025-08 查看详情 →
GPT-5.2 Instant
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
GPT-5.2 Instantは、GPT-5.2シリーズの効率的なバージョンで、速度と品質の最適なバランスを実現しています。GPT-5.2 Proのコア機能を継承し、より低いレイテンシーとコストでサービスを提供し、本番環境や大規模展開に最適です。Agentプラグインとツール呼び出しをサポートしています。
高效推理 200K 上下文 Agent 插件 +1
2025-12 查看详情 →
GPT-5.2 Pro
商用クローズドソース 推理
パラメータ: 未公开 コンテキスト: 200K tokens
GPT-5.2 Proは、OpenAIの最強の推論モデルで、2025年12月にリリースされました。専門的な知識作業(スプレッドシート、プレゼンテーション、複雑なレポート)で最も優れた能力を発揮し、ディープシンキングモードでは多段階の複雑な推論を処理できます。InstantおよびThinkingとともに、GPT-5.2シリーズの3つのバリアントを構成しています。
深度思考推理 专业知识处理 200K 上下文 +1
2025-12 查看详情 →
GPT-5.2 Thinking
商用クローズドソース 推理
パラメータ: 未公开 コンテキスト: 200K tokens
GPT-5.2 Thinkingは、GPT-5.2シリーズの思考強化版で、深い推論を必要とする数学、プログラミング、科学のシナリオ向けに設計されています。GPT-5.2のコア機能を維持しつつ、強化されたチェーン・オブ・ソート推論メカニズムにより、より深い分析を実現し、最もコストパフォーマンスの高い推論モデルです。
增强链式思维 200K 上下文 推理专精 +1
2025-12 查看详情 →
GPT-5.5 Instant
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
GPT-5.5 Instantは、OpenAIが2026年5月に発表したフラッグシップの無料モデルで、誰でもゼロ障壁で利用できます。GPT-5.5のコア機能を維持しつつ、極めて低い推論レイテンシーを実現し、ライティング、プログラミング、分析などあらゆるシナリオをカバーしています。OpenAI史上最も普及したフラッグシップモデルです。
全员免费 旗舰级性能 200K 上下文 +1
2026-05 查看详情 →
GPT-5.6 Sol
商用クローズドソース 推理
パラメータ: 未公开 コンテキスト: 200K tokens
GPT-5.6 Solは、OpenAIの現在の最強フラッグシップ推論モデルで、2026年7月にリリースされました。GPT-5.6シリーズは、Luna(エントリー無料)、Terra(ミッドレンジ)、Sol(フラッグシップ)の3つのティアに分かれています。Solは革新的なスライダーメカニズムによりInstantとThinkingモードを統合し、コーディング、推論、マルチモーダルタスクでSOTAを全面的に更新しました。
Instant/Thinking 统一滑块 200K 上下文 编码能力 SOTA +1
2026-07 查看详情 →
GPT-6 Astra
闭源 多模态
パラメータ: 未公开(约10万颗 GPU 训练) コンテキスト: 1M tokens
GPT-6 Astra は、OpenAI が2026年9月3日にリリースしたフラッグシップモデルで、約10万基のNVIDIA Grace Blackwell NVLink72で学習され、ワークプレイス向け次世代モデルと位置づけられています。高度な推論、コンピュータ操作、ソフトウェアエンジニアリング、サイバーセキュリティ、科学能力を持ち、ブラウザ操作とマルチステップワークフローを100万トークンのコンテキストでサポートします。API価格は入力$10/百万トークン、出力$50/百万トークンで、より高性能なGPT-6 Astra Proも用意されています。
计算机操作与浏览器使用 100万 tokens 上下文 高级推理与多步骤工作流 +1
2026-09 查看详情 →
o3
商用クローズドソース 推理
パラメータ: 未公开 コンテキスト: 200K tokens
o3はOpenAIの最も強力な推論モデルで、チェーン・オブ・ソートの深い推論メカニズムを採用し、数学、プログラミング、科学的推論において前例のないレベルに達しています。2025年のIOI金メダルレベルのプログラミングコンテストで優秀な成績を収め、GPQA博士レベルの科学的推論ベンチマークで人間の専門家を上回りました。深い思考を必要とする複雑な推論タスクに適しています。
深度链式思考推理 200K tokens 上下文 数学与编程领域顶尖 +1
2025-04 查看详情 →
o4-mini
商用クローズドソース 推理
パラメータ: 未公开 コンテキスト: 200K tokens
o4-miniはOpenAIがリリースした効率的な推論モデルで、o3のコア推論能力を維持しながら計算コストを大幅に削減します。最適化された推論アーキテクチャを採用し、数学、プログラミング、科学タスクで優れた性能を発揮し、o3シリーズの軽量な代替品です。推論能力が必要だが予算が限られているシナリオに適しており、コストパフォーマンスの新たなバランスを実現しています。
高效推理架构 200K tokens 上下文 成本优化的链式思维 +1
2025-04 查看详情 →
Anthropic 9 个模型
Claude 3.5 Haiku
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
Claude 3.5 HaikuはAnthropicの最速モデルで、低遅延と高スループットを必要とするシナリオ向けに設計されています。高い推論品質を維持しながら応答速度が非常に速く、リアルタイム会話、コンテンツモデレーション、データ処理などのシナリオに最適です。同じ速度クラスのモデルの中で、Claude 3.5 Haikuは知能レベルでリードしています。
极低延迟 200K tokens 上下文 高吞吐量 +1
2024-10 查看详情 →
Claude 3.5 Sonnet
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
Claude 3.5 Sonnet は、Anthropic の中級フラッグシップモデルで、知能と速度の最適なバランスを実現しています。プログラミング、クリエイティブライティング、複雑な分析で優れた性能を発揮し、200K トークンのコンテキストをサポートします。SWE-bench コーディングベンチマークで画期的な結果を達成し、Anthropic の安全性と信頼性におけるリーディングスタンダードを維持しています。
200K tokens 上下文 编程能力突出 创意写作 +1
2024-06 查看详情 →
Claude 4.5 Sonnet
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
Claude 4.5 Sonnetは、Anthropicが2026年にリリースした最強のコーディングモデルで、SWE-bench Verifiedで約77%の画期的なスコアを達成し、コード生成とリファクタリングの第一選択モデルとなっています。長文書分析、多段階推論、複雑なプログラミングタスクで優れた性能を発揮し、Anthropicの安全性アライメントにおけるリーダーシップを維持しています。
SWE-bench 77% 编码新高 200K 上下文 可连续工作 7 小时 +1
2026-01 查看详情 →
Claude 4 Opus
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
Claude 4 OpusはAnthropicの最も強力なモデルで、深い推論、複雑な分析、創造的なライティングを必要とする高難度のシナリオ向けに設計されています。長文書理解、多段階推論、クロスドメイン知識統合に優れています。Claude 4 OpusはGPQA、MMLUなどの学術ベンチマークでトップレベルに達し、安全性と信頼性におけるAnthropicのリードを維持しています。
200K tokens 上下文 深度推理能力强 创意写作与复杂分析 +1
2025-05 查看详情 →
Claude 4 Sonnet
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
Claude 4 SonnetはAnthropicの中高級モデルで、知性と効率の最良のバランスを実現しています。プログラミング、ライティング、複雑な分析タスクに優れ、200Kトークンのコンテキストウィンドウをサポートします。Claude 4 SonnetはSWE-benchコーディングベンチマークで新たな突破を達成し、ライティング品質と安全性においてAnthropicの一貫した高い基準を維持しています。
200K tokens 上下文 代码生成能力强 写作质量高 +1
2025-05 查看详情 →
Claude Fable 5.1
闭源 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Claude Fable 5.1 は、Anthropic が2026年9月1日にリリースした、コーディングと知識業務に最も先進的なモデルで、長時間のエージェント型コーディング、知識業務、研究能力が全面進化しています。デフォルトの100万トークンのコンテキストウィンドウ、最大128K出力、常時オンの適応的思考を備え、価格は$10/$50(百万トークンあたり)、プロンプトキャッシュ読み取りは$0.25(百万トークンあたり)と低く、長期エージェントタスクに最適です。
100万 tokens 上下文 128K 最大输出 始终开启自适应思考 +1
2026-09 查看详情 →
Claude Mythos 5.1
闭源 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Claude Mythos 5.1 は、2026年9月1日にリリースされ、Claude Fable 5.1 と同じ基盤を共有しつつ最強のコーディング・知識業務能力を持ちますが、異なるセーフガード(サイバーセキュリティ・生命科学の制限を維持)を備えています。Project Glasswing の信頼できるパートナープログラムを通じてのみ提供されます。
1M 上下文 + 128K 输出 与 Fable 5.1 同底座 增强防护机制 +1
2026-09 查看详情 →
Claude Opus 4.8
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 200K tokens
Claude Opus 4.8は、Anthropicが2026年5月にリリースしたフラッグシップモデルで、前バージョンのOpus 4.7からわずか41日後—Claudeフラッグシップシリーズの最短イテレーション記録を樹立しました。コーディング、推論、安全性アライメントを全面的にアップグレードし、その後のClaude Science研究プラットフォームとClaude Mythos 5の技術基盤を築きました。
41天极速迭代 200K 上下文 编码能力大幅增强 +1
2026-05 查看详情 →
Claude Opus 5
商用クローズドソース 文本
パラメータ: 未公开 コンテキスト: 1M tokens
Claude Opus 5は、Anthropicが2026年7月24日にリリースした最強のフラッグシップモデルです。複数のコーディング評価でSOTAを達成し、100万トークンのコンテキストウィンドウ、知識カットオフは2026年5月です。価格はOpus 4.8レベルを維持しつつ性能は2倍になり、現在のClaude Maxのデフォルトモデルです。コード生成、長文分析、複雑な推論で全面的にリードしています。
100万 tokens 上下文 编码 SOTA Effort 档位控制 +1
2026-07 查看详情 →
Google 9 个模型
Gemini 2.5 Flash
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini 2.5 FlashはGoogleの効率的な思考モデルで、速度と知能の最適化されたバランスを実現しています。100万トークンのコンテキストとネイティブなマルチモーダルもサポートし、思考推論能力も備えています。Proバージョンと比較して、Flashはより低い遅延とコストで同等の知能を提供し、ほとんどの本番シナリオに理想的な選択肢です。
100万 tokens 上下文 思考推理能力 低延迟高吞吐 +1
2025-03 查看详情 →
Gemini 2.5 Pro
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini 2.5 ProはGoogleの最も先進的な思考モデルで、回答前に深い推論を行うことができます。100万トークンの超長コンテキストウィンドウを持ち、テキスト、画像、ビデオ、音声、コードのマルチモーダル理解をネイティブにサポートします。LMArenaリーダーボードで長期間上位にあり、数学と科学的推論能力が特に優れており、複雑な推論とクロスモーダル理解を必要とする専門的なシナリオに適しています。
100万 tokens 上下文 原生多模态 链式思考推理 +1
2025-03 查看详情 →
Gemini 2.5 Pro (Thinking)
商用クローズドソース 推理
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini 2.5 Pro の思考強化版は、回答前により深い推論チェーン分析を行います。数学、科学、論理的推論能力が特に強化され、多段階の導出を必要とする複雑な問題で通常版を大幅に上回る性能を発揮します。100万トークンのコンテキストとネイティブなマルチモーダル入力をサポートし、Google の現在最も強力な推論モデルです。
深度思考推理 100万 tokens 上下文 原生多模态 +1
2025-06 查看详情 →
Gemini 3.5 Flash
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini 3.5 Flashは、GoogleがI/O 2026で発表した効率的なマルチモーダルモデルで、速度と知能の新たなブレークスルーを実現しました。Gemini 3 Proのコア機能を継承し、より低いレイテンシーとコストでサービスを提供します。テキスト、画像、動画、音声、コードの全モーダル理解をサポートし、マルチモーダルアプリケーションの大規模展開に最適です。
全模态理解 100万 tokens 上下文 低延迟高吞吐 +1
2026-05 查看详情 →
Gemini 3.7 Flash
闭源 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini 3.7 Flash は、Google が2026年8月13日にリリースしたプログラミング・エージェント主力モデルで、ソフトウェアエンジニアリング、Web開発、Agentic Workflows が大幅に向上しています。2026年12月31日まで初回体験価格で提供されます。
软件工程显著改进 Web 开发与 Agentic Workflows 1M 上下文 +1
2026-08 查看详情 →
Gemini 3.8 Flash
闭源 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini 3.8 Flash は、Google が2026年9月にリリースした最新世代のFlashファミリーで、サイバーセキュリティ向けの Gemini 3.8 Flash Cyber と同時に発表されました。3.x系のコーディング・エージェント能力を継承しています。
新一代 Flash 系列 3.8 Flash Cyber 同步推出 1M 上下文
2026-09 查看详情 →
Gemini 3 Pro
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 2M tokens
Gemini 3 Proは、Googleが2025年11月にリリースした最強のモデルで、200万トークンの超長文脈ウィンドウとネイティブな動画生成機能を備えています。GPT-5.2と正面から競争できる唯一のモデルであり、マルチモーダル理解、コード生成、科学的推論で全面的にリードしています。Gemini 3 Proは、マルチモーダルAIの新段階を示しています。
200万 tokens 超长上下文 原生视频生成 多模态深度理解 +1
2025-11 查看详情 →
Gemini Omni 1.1 Flash
闭源 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Gemini Omni 1.1 Flash は、Google の全モーダル世界モデルシリーズとして2026年8月にリリースされ、エージェント型の動画理解をより高い制御性で提供し、テキスト・画像・動画・音声を統合的に処理します。
全模态世界模型 Agentic 视频理解 1M 上下文
2026-08 查看详情 →
Gemma 3
オープンソース 多模态
パラメータ: 1B / 4B / 12B / 27B コンテキスト: 128K tokens
Gemma 3はGoogleがリリースしたオープンソースの軽量モデルシリーズで、Gemini 2.0テクノロジーに基づいて構築されています。1Bから27Bまでの4つのサイズを提供し、テキストと視覚のマルチモーダル入力をサポートし、128Kトークンのコンテキストウィンドウを持ちます。Gemma 3は同じパラメータ規模のモデルの中で性能がリードし、単一GPUまたはスマートフォンでも実行でき、オープンソースコミュニティでのモデル微調整とデプロイに最適な選択肢です。
多规格可选 128K 上下文 文本+视觉多模态 +1
2025-03 查看详情 →
DeepSeek 9 个模型
DeepSeek-Coder-V2
オープンソース 代码
パラメータ: 236B (21B 激活) コンテキスト: 128K tokens
DeepSeek-Coder-V2はDeepSeekがコードシナリオ向けに特別に設計したオープンソースモデルで、MoEアーキテクチャに基づき、338のプログラミング言語でトレーニングされています。HumanEval、MBPPなどのコーディングベンチマークでGPT-4 Turboを上回り、コード補完、デバッグ、リファクタリングに優れています。128Kコンテキストをサポートし、大規模なコードベースを処理でき、開発者にとって理想的なプログラミングアシスタントです。
338 种编程语言支持 128K 上下文 代码补全与调试 +1
2024-06 查看详情 →
DeepSeek-Janus-Pro
オープンソース 多模态
パラメータ: 7B コンテキスト: 128K tokens
DeepSeek-Janus-Pro は、DeepSeek が発表した統合マルチモーダル理解・生成モデルです。革新的な分離型ビジュアルエンコーディングアーキテクチャを採用し、画像理解(説明、Q&A、OCR)と画像生成(テキストから画像)の両方をサポートします。7B パラメータの設計により効率的に動作し、統合マルチモーダルモデルにおいて新たな技術的アプローチを切り開きました。
理解+生成统一架构 7B 轻量参数 解耦视觉编码 +1
2025-01 查看详情 →
DeepSeek-R1
オープンソース 推理
パラメータ: 671B (37B 激活) コンテキスト: 128K tokens
DeepSeek-R1はDeepSeekがリリースした推論強化モデルで、最初のオープンソースの大規模推論モデルでもあります。強化学習トレーニングを通じてチェーン・オブ・ソート推論能力を実現し、数学、プログラミング、科学的推論などのタスクでOpenAI o1に匹敵する性能を発揮します。R1の完全なオープンソース化は世界中のAIコミュニティに衝撃を与え、オープンソースモデルが推論能力において最先端の商用クローズドソースモデルに匹敵できることを証明しました。
链式思维推理 强化学习驱动 完全开源 +1
2025-01 查看详情 →
DeepSeek-V2.5
オープンソース 文本
パラメータ: 236B (21B 激活) コンテキスト: 128K tokens
DeepSeek-V2.5 は、DeepSeek-V2 の大幅なアップグレード版で、DeepSeek-Coder-V2 のコード能力と DeepSeek-V2 の汎用能力を統合しています。数学、プログラミング、汎用タスクで業界トップレベルの性能を達成し、ウェブ検索やファイルアップロードなどの実用的な機能をサポートします。V2.5 は非常に低い導入コストで GPT-4o に近い性能を提供します。
代码+通用能力融合 128K 上下文 联网搜索 +1
2024-09 查看详情 →
DeepSeek-V3
オープンソース 文本
パラメータ: 671B (37B 激活) コンテキスト: 128K tokens
DeepSeek-V3はDeepSeekのフラッグシップMoEモデルで、総パラメータ数は671B、各推論で37Bのパラメータのみをアクティブにします。マルチヘッド潜在注意(MLA)とDeepSeekMoEアーキテクチャを採用し、トレーニングコストはわずか557万ドルでありながら、GPT-4oやClaude 3.5 Sonnetに匹敵する性能を達成しています。数学とコーディングタスクで特に優れており、オープンソースコミュニティで最も影響力のあるモデルの1つです。
MoE 高效架构 MLA 注意力机制 极低训练成本 +1
2024-12 查看详情 →
DeepSeek-V3.1
オープンソース 文本
パラメータ: 685B (37B 激活) コンテキスト: 160K tokens
DeepSeek-V3.1は、DeepSeekが2025年8月にリリースした大幅なアップグレード版で、「Agent時代への第一歩」と定義されています。ハイブリッド推論アーキテクチャを採用し、1つのモデルで思考モードと非思考モードの両方をサポートし、ツール呼び出しとAgent機能をネイティブに備えています。Agentベンチマークで前世代を大幅に上回り、MITオープンソースライセンスを維持しています。
混合推理架构 思考/非思考模式切换 Agent 原生支持 +1
2025-08 查看详情 →
DeepSeek-V3.2
オープンソース 文本
パラメータ: 685B (37B 激活) コンテキスト: 160K tokens
DeepSeek-V3.2は、DeepSeekの最新フラッグシップモデルで、コーディングと一般的な能力が全面的にアップグレードされています。API価格はわずか$0.14/Mトークンで、「最も安いトップモデル」と呼ばれています。Agent機能、長文脈理解、多言語対話をサポートし、SWE-benchやLMArenaで上位にランクインしています。
极低成本 API Agent 能力强 160K 上下文 +1
2025-12 查看详情 →
DeepSeek-V4.1-Flash
オープンソース 多模态
パラメータ: 552B (输入 8B / 输出 16B 激活) コンテキスト: 1M tokens
DeepSeek-V4.1-Flash は、DeepSeek が2026年9月10日にリリースした新しいアーキテクチャファミリーの最小メンバーです。552BパラメータのMoEモデルで、新しいCausal-Encoder-Decoder(CED)非対称アーキテクチャを採用し、入力側はわずか8B、出力側は16Bのパラメータをアクティブにします。エージェント時代の「入力重・出力軽」の実ワークロード向けに設計されています。100万トークンのコンテキストと最大384Kの出力をサポートし、ネイティブのマルチモーダル視覚理解を備え、KVキャッシュのHBM要件は前世代の1/4です。ベンチマークはフラッグシップのV4 Proを全面的に上回り、API価格はキャッシュヒット時わずか¥0.02/百万トークンで、エージェント時代で最もコストパフォーマンスの高いオープンソースモデルです。
CED 非对称架构(输入 8B / 输出 16B) 100万 tokens 上下文 + 384K 最大输出 原生多模态视觉理解 +1
2026-09 查看详情 →
DeepSeek V4 Flash
オープンソース 文本
パラメータ: 284B (13B 激活) コンテキスト: 1M tokens
DeepSeek V4 Flashは、DeepSeekが2026年7月31日にリリースした最新のオープンソースモデルで、284B総パラメータのMoEアーキテクチャを採用し、推論時には13Bパラメータのみをアクティブにします。100万トークンのコンテキストを持ち、APIキャッシュヒット後の入力コストはわずか¥0.02/百万トークンです。性能はGPT-5に匹敵し、Agent機能はClaude Opus 4.8を上回り、リリース当日にUnslothがローカル実行バージョンを公開しました。このモデルは2026年9月10日のDeepSeek-V4.1-Flashリリースに伴い退役し、既存のAPIリクエストはV4.1-Flashが引き継ぎ、Flash価格で課金されます。
284B MoE 架构 100万 tokens 上下文 385K 最大输出 +1
2026-07 查看详情 →
Meta 7 个模型
Llama 3.2
オープンソース 多模态
パラメータ: 1B / 3B / 11B / 90B コンテキスト: 128K tokens
Llama 3.2 は、Meta が発表したマルチモーダルモデルシリーズで、Llama シリーズで初めて視覚理解機能を導入しました。1B、3B の軽量テキスト専用モデルと、11B、90B のマルチモーダルモデルを提供し、スマートフォンからデータセンターまでのすべての展開シナリオをカバーします。90B バージョンは画像理解、ドキュメント分析、マルチモーダル対話で優れた性能を発揮します。
多规格覆盖全场景 视觉理解能力 128K 上下文 +1
2024-09 查看详情 →
Llama 3.3
オープンソース 文本
パラメータ: 70B コンテキスト: 128K tokens
Llama 3.3はMetaのLlama 3シリーズの最終版で、70Bパラメータ規模でLlama 3.1 405Bに近い性能を達成しています。高密度アーキテクチャ(MoEではない)を採用し、テキスト生成、コード作成、多言語タスクに優れています。Llama 3.3はより低いデプロイコストで高品質なテキスト生成機能を提供し、オープンソースコミュニティで最も人気のあるベースモデルの1つです。
70B 参数高性能 128K 上下文 多语言支持 +1
2024-12 查看详情 →
Llama 4.1
オープンソース 多模态
パラメータ: 未公开 (MoE) コンテキスト: 10M tokens
Llama 4.1は、Metaが2026年にリリースした最新世代のオープンソースマルチモーダルモデルで、Llama 4シリーズのMoEアーキテクチャを継承し、全面的にアップグレードされています。コーディング、数学、視覚理解が大幅に向上し、コンテキストウィンドウは1000万トークンに拡張されました。Llama 4.1はAgentツール呼び出しとコード実行機能を強化し、オープンソースコミュニティで最も競争力のあるモデルの1つです。
1000万 tokens 超长上下文 MoE 架构升级 Agent 工具调用增强 +1
2026-06 查看详情 →
Llama 4 Maverick
オープンソース 多模态
パラメータ: 400B (17B 激活) コンテキスト: 10M tokens
Llama 4 MaverickはMetaの高性能オープンソースマルチモーダルモデルで、同じくMoEアーキテクチャを採用し、400Bの総パラメータと17Bのアクティブパラメータを持ちます。画像理解、コーディング、推論に優れ、性能はGPT-4oに匹敵します。Maverickは1000万トークンの超長コンテキストウィンドウを持ち、長文書分析、コードベース理解、マルチモーダル対話において顕著な利点があります。
1000万 tokens 超长上下文 业界领先的多模态 MoE 高效推理 +1
2025-04 查看详情 →
Llama 4 Scout
オープンソース 多模态
パラメータ: 109B (17B 激活) コンテキスト: 10M tokens
Llama 4 ScoutはMetaの軽量オープンソースマルチモーダルモデルで、MoEアーキテクチャを採用し、17Bのアクティブパラメータと驚異的な1000万トークンのコンテキストウィンドウを持ちます。テキストと画像の理解をネイティブにサポートし、単一のH100 GPUで実行できます。Scoutは長文書処理とコード理解に優れており、オープンソースモデルの中で最長のコンテキストウィンドウを提供します。
1000万 tokens 超长上下文 MoE 架构 单 GPU 可运行 +1
2025-04 查看详情 →
Muse Glimmer
オープンソース 多模态
パラメータ: 未公开(30B 级被引述) コンテキスト: N/A
Muse Glimmer は、Meta のスーパーインテリジェンス研究所が2026年8月10日にオープンソースでリリースしたモデルで、Meta がオープンウェイト路線へ回帰したことを示します。パーソナルスーパーインテリジェンス戦略の基盤モデルとして公開されています。
开源模型权重 Meta 新一代模型
2026-08 查看详情 →
Muse Spark 1.3
闭源 多模态
パラメータ: 未公开 コンテキスト: N/A
Muse Spark 1.3 は、Meta が2026年9月2日にリリースした閉源のMuse Sparkファミリー最新版で、エージェントとプログラミング能力の強化に重点を置き、Meta のパーソナルAIアシスタント Muse を支えています。
智能体任务强化 编程任务强化 Muse 智能体底座
2026-09 查看详情 →
阿里云 9 个模型
Qwen2.5-Coder
オープンソース 代码
パラメータ: 0.5B / 1.5B / 3B / 7B / 14B / 32B コンテキスト: 128K tokens
Qwen2.5-Coder は、Alibaba Cloud がコードシナリオ向けに開発したオープンソースモデルシリーズで、5.5兆トークンのコードデータでトレーニングされています。HumanEval、MBPP、LiveCodeBench などのコーディングベンチマークで同規模モデルを全面的にリードし、32B バージョンのコード能力は GPT-4o をも上回ります。92のプログラミング言語をサポートし、オープンソースコミュニティで最も強力なコードモデルの一つです。
92 种编程语言 128K 上下文 多规格可选 +1
2024-11 查看详情 →
Qwen2.5-Math
オープンソース 推理
パラメータ: 1.5B / 7B / 72B コンテキスト: 128K tokens
Qwen2.5-Math は、Alibaba Cloud が数学推論専用に開発したオープンソースモデルで、英語と中国語の数学データでトレーニングされています。MATH や GSM8K などの数学ベンチマークで業界トップレベルの性能を達成し、72B バージョンは競技レベルの数学問題で特に優れています。CoT と TIR(ツール統合推論)の2つの推論モードをサポートし、数学教育と研究に理想的なツールです。
数学推理专精 128K 上下文 CoT+TIR 推理 +1
2024-09 查看详情 →
Qwen2.5-Max
商用クローズドソース 文本
パラメータ: 未公开(MoE) コンテキスト: 128K tokens
Qwen2.5-MaxはAlibaba Cloudのフラッグシップ商用クローズドソースモデルで、大規模なMoEアーキテクチャを採用し、総合能力でGPT-4oやClaude 3.5 Sonnetに対抗しています。中国語理解、知識Q&A、複雑な推論に優れ、中英混合シナリオでのアプリケーション体験を特に最適化しています。Alibaba Cloud Bailianプラットフォームを通じて提供され、エンタープライズレベルの顧客を対象としています。
大规模 MoE 架构 128K 上下文 中文能力顶尖 +1
2025-01 查看详情 →
Qwen2.5-VL
オープンソース 多模态
パラメータ: 3B / 7B / 72B コンテキスト: 128K tokens
Qwen2.5-VLはAlibabaの通義千問チームによる視覚言語モデルで、画像、ビデオ、ドキュメントの深い理解をサポートします。動的解像度で任意のサイズの画像を処理でき、数時間に及ぶビデオ分析をサポートし、画像内のオブジェクト座標を正確に特定できます。72Bバージョンはマルチモーダルベンチマークで業界をリードするレベルに達しており、オープンソースの視覚言語モデルのベンチマークの1つです。
动态分辨率视觉理解 长视频分析 物体定位与 OCR +1
2025-01 查看详情 →
Qwen3
オープンソース 文本
パラメータ: 0.6B / 1.8B / 4B / 8B / 14B / 32B / 235B コンテキスト: 128K tokens
Qwen3はAlibabaの通義千問チームがリリースした最新のオープンソースモデルシリーズで、0.6Bから235Bまでのさまざまな仕様を提供します。フラッグシップのQwen3-235BはMoEアーキテクチャを採用し、コーディング、数学、一般的な能力でDeepSeek-V3に対抗しています。Qwen3シリーズは特にThinking Modeを強化し、ツール呼び出しとAgent機能をサポートしており、オープンソースコミュニティで最も競争力のあるモデルシリーズの1つです。
多规格覆盖全场景 思考推理模式 128K 上下文 +1
2025-04 查看详情 →
Qwen3.5-Plus
オープンソース 文本
パラメータ: 未公开 (MoE) コンテキスト: 256K tokens
Qwen3.5-Plusは、Alibaba Cloudが2026年2月にオープンソース化した新世代のフラッグシップモデルで、基盤アーキテクチャを全面的に刷新し、世界最強のオープンソースモデルのリストでトップに立ちました。Qwenシリーズの累計ダウンロード数は10億回を突破し、Llamaを抜いてHugging Faceで最もダウンロードされたオープンソースモデルとなっています。コーディング、数学、一般的な能力で全面的にリードし、思考モードとAgentツール呼び出しをサポートしています。
底层架构革新 256K 上下文 思考推理模式 +1
2026-02 查看详情 →
Qwen3.8-27B
オープンソース 多模态
パラメータ: 27B (Dense) コンテキスト: 262K tokens
Qwen3.8-27B は、阿里巴巴が2026年8月14日にApache 2.0でオープンソース化したネイティブマルチモーダルDenseモデルで、262Kのネイティブコンテキスト(YaRNで1Mまで拡張可能)を持ちます。SWE-bench Pro 61.7、LiveCodeBench v6 90.3、GPQA Diamond 89.2、OSWorld-Verified 84.3を達成し、低コストで導入できる性能とコストの黄金バランスを実現しています。
原生多模态 Dense 262K→1M 上下文(YaRN) Apache 2.0 商用 +1
2026-08 查看详情 →
Qwen3.8-Flash
オープンソース 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Qwen3.8-Flash は、通義千問が2026年8月にリリースしたマルチモーダル大規模言語モデルで、百万レベルのコンテキストをネイティブにサポートし、超長文書・コードリポジトリ・複雑な会話を一度に処理します。OpenAI と Anthropic の両 API 規約に対応し、Claude Code、Codex などの開発者ツールにシームレスに接続可能で、コーディング支援・エージェント連携・画像テキスト理解に優れ、推論コストの競争力が高いのが特長です。
多模态理解与生成 百万级上下文 OpenAI/Anthropic 双协议 +1
2026-08 查看详情 →
Qwen3.8-Max
オープンソース 多模态
パラメータ: 2.4T 总参数 / 950B 激活 コンテキスト: 1M tokens
Qwen3.8-Max は、阿里巴巴の通義千問チームが2026年8月にリリースしたオープンフラッグシップで、総パラメータ2.4兆・毎ステップ約950億をアクティブにするスパースMoE、ハイブリッド注意機構、100万トークンのコンテキスト、131K出力を備えます。複雑なエンジニアリング級コーディングと長期的な自律開発に優れ、GPQA Diamond 92.6、PaperBench 93.0、OSWorld 86.1、BabyVision 82.0(CodeArena 世界4位)。価格は入力¥12/百万トークン、出力¥36/百万トークン(キャッシュヒット¥1.5)。
2.4T 稀疏 MoE(950B 激活) 100万 tokens 上下文 混合注意力机制 +1
2026-08 查看详情 →
Mistral AI 4 个模型
Codestral
オープンソース 代码
パラメータ: 22B コンテキスト: 32K tokens
Codestral は、Mistral AI がコード生成専用に開発したモデルで、80以上のプログラミング言語をサポートしています。コード補完、デバッグ、リファクタリングで優れた性能を発揮し、HumanEval や MBPP などのコーディングベンチマークで同規模モデルの最高水準に達しています。22B パラメータの効率的なアーキテクチャにより、コンシューマー向け GPU で実行でき、開発者にとって理想的なプログラミングアシスタントです。
80+ 编程语言 代码补全与调试 22B 高效架构 +1
2024-05 查看详情 →
Ministral 8B
オープンソース 文本
パラメータ: 8B コンテキスト: 128K tokens
Ministral 8B は、Mistral AI のエッジ向けモデルで、ローカルデバイスとオフラインシナリオ向けに設計されています。8B パラメータで優れた推論能力と多言語サポートを実現し、ノートパソコンやスマートフォンでスムーズに動作します。Ministral 8B は知識 Q&A、翻訳、要約などのタスクで優れた性能を発揮し、エッジ AI 展開の最良の選択肢の一つです。
8B 轻量参数 128K 上下文 边缘设备优化 +1
2024-10 查看详情 →
Mistral Large 2
商用クローズドソース 文本
パラメータ: 123B コンテキスト: 128K tokens
Mistral Large 2はMistral AIのフラッグシップモデルで、123Bのパラメータを持ち、コード生成、数学的推論、多言語処理に優れています。数十の自然言語と80以上のプログラミング言語をサポートし、MMLUで84.0%の精度を達成しています。Mistral Large 2は比較的小さいパラメータサイズでGPT-4oに近い性能を達成しており、ヨーロッパのAIの傑出した代表です。
123B 参数高效架构 128K 上下文 80+ 编程语言支持 +1
2024-07 查看详情 →
Pixtral Large
オープンソース 多模态
パラメータ: 124B コンテキスト: 128K tokens
Pixtral Large は、Mistral AI のフラッグシップ視覚言語モデルで、Mistral Large 2 アーキテクチャに基づき、新しい高度なビジョンエンコーダを追加しています。ドキュメント理解、チャート分析、マルチモーダル推論で優れた性能を発揮し、128K トークンのコンテキストと多言語処理をサポートします。Pixtral Large はオープンソースの視覚言語モデルの中でリーダー的存在であり、複雑なテキストと画像の混合タスクを処理できます。
124B 参数视觉语言模型 128K 上下文 文档图表分析 +1
2024-11 查看详情 →
xAI 3 个模型
Grok 3
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 1M tokens
Grok 3はMusk氏のxAIが発表した第3世代の大規模モデルで、20万枚のH100 GPUクラスターでトレーニングされています。数学的推論、科学的Q&A、プログラミングコンテストに優れ、DeepSearchとThink推論モードを備えています。Grok 3は真理の追求とギーク精神を設計理念としており、AIME数学コンテストで93%以上の高得点を獲得し、現在のAIコンテストで最も競争力のあるモデルの1つです。
DeepSearch 深度搜索 Think 推理模式 1M tokens 上下文 +1
2025-02 查看详情 →
Grok 4.2
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: 2M tokens
Grok 4.2は、マスク氏率いるxAIが2026年2月にリリースした最新の大規模モデルです。200万トークンの超長文脈ウィンドウを持ち、超高速推論と超低幻覚をサポートします。数学、科学、プログラミング競技で継続的にリードし、リアルタイム情報取得とDeepSearch機能を備えています。Grok 4.2は前世代の真実を追求する設計理念を継承し、複雑な推論とリアルタイムインタラクションで優れた性能を発揮します。
200万 tokens 超长上下文 超低幻觉 极速推理 +1
2026-02 查看详情 →
Grok 4.6
闭源 多模态
パラメータ: 1.5T 家族 コンテキスト: 1M tokens
Grok 4.6 は、xAI が2026年8月12日にリリースした1.5Tパラメータファミリーのフラッグシップモデルで、長期的なエージェント、コーディング、知識業務、インタラクティブなプロジェクト開発に重点を置いています。総合スコアはGPT-5.6 Solと同等で、MedAgentBenchでは95.9%で世界一、DeepSWE v1.1ではxhigh思考強度で67.0%を達成しました。
长程 Agent 强化 Agentic RL 训练 1.5T 规模家族 +1
2026-08 查看详情 →
智谱 AI 4 个模型
ChatGLM-4-9B
オープンソース 文本
パラメータ: 9B コンテキスト: 128K tokens
ChatGLM-4-9B は、智谱 AI が発表した軽量オープンソースモデルで、9B パラメータで優れた総合能力を実現しています。128K コンテキストと多言語対話をサポートし、Agent ツール呼び出し、コード生成、数学的推論で優れた性能を発揮します。ChatGLM-4-9B はコンシューマー向け GPU で効率的に動作し、開発者に人気の AI アプリケーション開発の選択肢です。
9B 轻量参数 128K 上下文 Agent 工具调用 +1
2024-06 查看详情 →
CogView-4
商用クローズドソース 多模态
パラメータ: 未公开 コンテキスト: N/A
CogView-4 は、智谱 AI の最新世代のテキストから画像へのモデルで、画像品質とテキスト忠実度で大きな進歩を遂げています。中国語と英語のバイリンガルプロンプトをサポートし、単一画像内に鮮明で読みやすい複雑なテキストを生成でき、任意の解像度出力をサポートします。CogView-4 は画像のリアリズム、創造性、プロンプト理解で業界トップレベルに達し、国内で最も強力なテキストから画像へのモデルの一つです。
中英双语提示词 复杂文字生成 任意分辨率输出 +1
2025-04 查看详情 →
GLM-4-Plus
商用クローズドソース 多模态
パラメータ: 未公开(MoE) コンテキスト: 128K tokens
GLM-4-Plus は、智谱 AI が発表したフラッグシップ大規模モデルで、MoE アーキテクチャを採用し、言語理解、コード生成、画像理解などで全面的にアップグレードされています。All-Tools モードをサポートし、検索、コードインタープリタ、描画などのツールを自動的に呼び出せ、強力な Agent 機能を備えています。GLM-4-Plus は中国語タスクで優れた性能を発揮し、国内のエンタープライズ向け AI アプリケーションの重要な選択肢です。
All-Tools 自动调用 128K 上下文 MoE 高效架构 +1
2024-08 查看详情 →
GLM-5.3-Flash
オープンソース 多模态
パラメータ: 320B 总参 / 18B 激活 コンテキスト: 1M tokens
GLM-5.3-Flash は、智譜 AI が2026年8月にリリースした GLM-5 シリーズ初のネイティブマルチモーダルモデルで、総パラメータ320B・アクティブ18B、スパース注意機構と線形注意機構のハイブリッドアーキテクチャを採用し、低コストで GLM-5.2 を超える知能を提供します。1Mコンテキストと128K出力、画像・動画・ファイルのネイティブ入力をサポートし、コード・ブラウザ・GUI間で協調してタスクを実行できます。
GLM-5 首个原生多模态 320B/18B 激活 混合注意力架构 +1
2026-08 查看详情 →
腾讯 2 个模型
Microsoft 2 个模型

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

完全免费,取消任意时间。我们不会发送垃圾邮件。