Skills Plugins MCP Prompt Model 博客 我的中心

最新博客文章

9 / 173

AI 开发实战教程,从零到一构建你的 AI 应用。

教程 日期
DeepSeek 模型评估与基准测试 模型微调 进阶 DeepSeek 模型完整评估指南:MMLU、HumanEval、GSM8K、MT-Bench 等主流基准测试结果。DeepSeek-V3 vs GPT-4o vs Claude 3.5 全方位对比,含评测代码和选型建议。 2025-06 ·22 分钟阅读 模型后训练 模型微调 进阶 本书的核心公式是 Agent = LLM + 上下文 + 工具。本章聚焦于优化 LLM 这个“大脑”——先用 Mid-training 补齐目标领域的知识与基础能力,再用 SFT/RL 等后训练方法塑造模型利用上下文和工具的行为。第七章结尾指出,评估体系与仿真环境是后训练的两块基石:评估环境为训练提供练习场,评估指标为… 2026-09 ·85 分钟阅读 QLoRA 微调实战指南 模型微调 进阶 全参数微调成本高昂,QLoRA通过4-bit量化+低秩适配让普通开发者在消费级GPU上就能微调大模型。本文手把手带你完成从数据准备到模型部署的完整QLoRA微调流程,使用DeepSeek模型作为基座。 2026-07 ·25 分钟阅读 微调数据集构建的艺术 模型微调 进阶 微调效果的上限由数据质量决定,而非模型或算法。本文深入讲解微调数据集的构建方法论——从数据来源、质量控制、多样性保障到数据配比策略,帮你构建高质量的微调数据集。 2026-07 ·18 分钟阅读 LoRA vs QLoRA vs Full Fine-tuning 全面对比 模型微调 进阶 全面对比LoRA、QLoRA和全量微调三种方案,从原理、显存、训练速度、最终效果等维度分析,帮你做出正确的技术选型。 2026-07 ·22 分钟阅读 指令微调数据构造实战 模型微调 进阶 数据质量决定微调效果的上限。本文讲解指令微调数据的构造方法,包括数据来源、清洗策略、质量评估、数据增强和配比设计。 2026-07 ·20 分钟阅读 模型量化部署实战 模型微调 进阶 量化是降低模型推理成本的关键技术。本文从INT8到INT4,系统讲解模型量化的原理、工具链和部署实践,让你的模型在消费级硬件上高效运行。 2026-07 ·22 分钟阅读 大模型评估与基准测试全指南 模型微调 进阶 如何客观评价大模型的能力?本文系统讲解 MMLU、HumanEval、C-Eval 等主流基准测试,以及 LLM-as-Judge、竞技场排名等评估方法,帮助你建立科学的模型评估体系。 2025-07 ·16 分钟阅读 QLoRA量化微调实战 模型微调 进阶 QLoRA通过4-bit量化将大模型微调的内存需求降低到极致。本文深入讲解QLoRA的技术原理、NF4量化、双重量化等关键技术,并提供完整的实战代码。 2025-05 ·18 分钟阅读

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。