Skills MCP Model 博客 提交 Skills

AI 开发 教程

系统化的 AI 开发学习路径。从提示词工程到模型微调,从 RAG 到 Agent 开发,覆盖 AI 应用开发全栈知识。共 142 篇教程,18 个分类,入门到高级全覆盖。

找到 17 篇教程

モデル微調整 中級

DeepSeekモデルの評価とベンチマーク

DeepSeekモデルの完全な評価ガイド:MMLU、HumanEval、GSM8K、MT-Benchなどの主要ベンチマークの結果。DeepSeek-V3 vs GPT-4o vs Claude 3.5の包括的な比較、評価コードとモデル選定の推奨事項を含みます。

模型评估 基准测试 MMLU 性能对比
2025-06 22 分钟阅读
阅读教程 →
モデル微調整 上級

DeepSeek データエンジニアリングチュートリアル

データ収集から品質評価まで、大規模モデルのデータエンジニアリングパイプラインを完全に習得します。SFTデータセット構築、RLHF選好データ準備、データクリーニングと重複排除、データ拡張、大規模データ処理などの主要な側面を網羅しています。

数据工程 SFT RLHF 数据清洗
2025-06 23 分钟阅读
阅读教程 →
モデル微調整 上級

DeepSeek モデルアーキテクチャの深掘り解説

DeepSeek-V3のMoEアーキテクチャ、MLAアテンションメカニズム、Multi-Token Predictionなどのコア技術を深く解析します。DeepSeekが極めて低コストでGPT-4oレベルの性能を実現する方法を理解し、アーキテクチャ図とソースコード分析を含みます。

架构解析 MoE MLA 注意力机制
2025-06 28 分钟阅读
阅读教程 →
モデル微調整 上級

DeepSeek ファインチューニング実践チュートリアル

DeepSeekモデルの微調整の完全な実践ガイド:LoRA/QLoRA効率的微調整、全パラメータ微調整、データ準備、トレーニング設定、評価検証。DeepSeek-V3とDeepSeek-R1の微調整ソリューションを網羅し、完全なコードとベストプラクティスを含みます。

模型微调 LoRA QLoRA SFT
2025-06 26 分钟阅读
阅读教程 →
モデル微調整 上級

モデル蒸留実践:大規模モデルで小規模モデルを訓練

知識蒸留により、小規模モデルは大規模モデルの能力に近づきながら、推論コストを大幅に削減できます。この記事では、蒸留の原理、データ生成戦略、トレーニングテクニック、効果評価について深く解説し、DeepSeekを使ってコストパフォーマンスの高い小規模モデルを蒸留する方法を教えます。

知识蒸馏 模型训练 数据生成 成本优化
2026-08 24 分钟阅读
阅读教程 →
モデル微調整 上級

RLHF強化学習による微調整の実践:選好データから報酬モデルまで

RLHFはモデルの出力を人間の選好に合わせます。本記事では、選好データの収集、報酬モデルのトレーニングからPPO強化学習による微調整まで、RLHFの実践的なパイプラインを完全に再現し、データ品質と効果評価に関するエンジニアリング経験を提供します。

RLHF 奖励模型 PPO 偏好对齐
2026-08 26 分钟阅读
阅读教程 →
モデル微調整 中級

QLoRAファインチューニング実践ガイド

全パラメータファインチューニングは高コストですが、QLoRAは4ビット量子化と低ランク適応を使用して、一般の開発者がコンシューマー向けGPUで大規模モデルをファインチューニングできるようにします。この記事では、DeepSeekをベースモデルとして、データ準備からモデルデプロイまでの完全なQLoRAファインチューニングプロセスを丁寧に解説します。

微调 QLoRA 模型训练 DeepSeek
2026-07 25 分钟阅读
阅读教程 →
モデル微調整 中級

ファインチューニングデータセット構築の技術

ファインチューニングの効果の上限は、モデルやアルゴリズムではなくデータ品質によって決まります。この記事では、データソース、品質管理、多様性の確保、データ配分戦略など、高品質なファインチューニングデータセットを構築するための方法論を深く解説します。

微调 数据集 数据质量 数据工程
2026-07 18 分钟阅读
阅读教程 →
モデル微調整 上級

モデル評価とA/Bテスト

ファインチューニング後、モデルの性能を客観的に評価するにはどうすればよいでしょうか?統計的に有意な結論を得るためにA/Bテストをどのように設計すべきでしょうか?この記事では、オフライン評価、オンラインA/Bテスト、統計的有意性の3つの側面から、科学的なモデル評価システムを構築します。

模型评估 A/B测试 统计显著性 实验设计
2026-07 20 分钟阅读
阅读教程 →
モデル微調整 中級

LoRA vs QLoRA vs フルファインチューニングの包括比較

LoRA、QLoRA、フルファインチューニングの3つの手法を、原理、メモリ使用量、トレーニング速度、最終的な性能などの観点から包括的に比較し、正しい技術選定を支援します。

微调 LoRA QLoRA 模型训练
2026-07 22 分钟阅读
阅读教程 →
モデル微調整 中級

指示ファインチューニングデータ構築実践

データ品質はファインチューニングの効果の上限を決定します。この記事では、データソース、クリーニング戦略、品質評価、データ拡張、配分設計など、命令ファインチューニングデータの構築方法を解説します。

指令微调 数据集 数据清洗 数据增强
2026-07 20 分钟阅读
阅读教程 →
モデル微調整 中級

モデル量子化とデプロイ実践

量子化はモデル推論コストを削減するための重要な技術です。この記事では、INT8からINT4までのモデル量子化の原理、ツールチェーン、デプロイ実践を体系的に解説し、コンシューマー向けハードウェアでモデルを効率的に実行できるようにします。

模型量化 INT8 INT4 推理优化
2026-07 22 分钟阅读
阅读教程 →
モデル微調整 上級

DPO選好アライメントトレーニングの詳細解説

DPO(直接選好最適化)は、報酬モデルのトレーニングを必要としないRLHFの簡素化された代替手法です。この記事では、DPOの原理、実装の詳細、トレーニングテクニックを深く解説します。

DPO RLHF 偏好对齐 对齐训练
2026-07 25 分钟阅读
阅读教程 →
モデル微調整 中級

大規模モデルの評価とベンチマーク完全ガイド

大規模モデルの能力を客観的に評価するにはどうすればよいでしょうか?本記事では、MMLU、HumanEval、C-Evalなどの主要なベンチマークテスト、およびLLM-as-Judgeやアリーナランキングなどの評価方法を体系的に解説し、科学的なモデル評価システムの構築を支援します。

模型评估 基准测试 MMLU HumanEval
2025-07 16 分钟阅读
阅读教程 →
モデル微調整 上級

データセット構築と品質評価

データ品質は、ファインチューニング効果の上限を決定します。この記事では、ファインチューニングデータセットの構築方法、データクリーニング戦略、品質評価指標、データ拡張技術を体系的に解説し、高品質なファインチューニングデータセットの構築に役立ちます。

数据集 数据清洗 质量评估
2025-06 17 分钟阅读
阅读教程 →
モデル微調整 中級

QLoRA量子化ファインチューニング実践

QLoRAは、4ビット量子化により、大規模モデルのファインチューニングに必要なメモリを極限まで削減します。この記事では、QLoRAの技術原理、NF4量子化、二重量子化などの主要技術を詳しく解説し、完全な実践コードも提供します。

QLoRA 量化微调 内存优化
2025-05 18 分钟阅读
阅读教程 →
モデル微調整 入門

LoRAファインチューニング完全ガイド

LoRAは、現在最も人気のあるパラメータ効率的なファインチューニング手法です。この記事では、原理から実践まで、環境設定、データセット準備、トレーニングパラメータ設定、モデル評価を含むLoRAファインチューニングの完全なプロセスを包括的に解説します。

LoRA 微调 PEFT
2025-04 16 分钟阅读
阅读教程 →

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

完全免费,取消任意时间。我们不会发送垃圾邮件。