Skills Plugins MCP Prompt Model 博客 我的中心

最新博客文章

55 / 173

AI 开发实战教程,从零到一构建你的 AI 应用。

教程 日期
DeepSeek 推理加速深度教程 部署与运维 高级 全面掌握 DeepSeek 模型推理加速技术。vLLM、SGLang、TensorRT-LLM、llama.cpp 四大引擎深度对比,从部署到调优,从单卡到分布式,完整的推理加速方案。 2025-06 ·25 分钟阅读 DeepSeek 数据工程教程 模型微调 高级 从数据采集到质量评估,完整掌握大模型数据工程流水线。涵盖 SFT 数据集构建、RLHF 偏好数据准备、数据清洗去重、数据增强、大规模数据处理等核心环节。 2025-06 ·23 分钟阅读 DeepSeek 安全与内容审核 AI应用开发 高级 生产环境安全防护指南:从 Prompt 注入防御到内容审核系统,从越狱检测到红队测试。完整的安全架构设计和 Python 实现代码,确保 AI 应用安全可靠。 2025-06 ·23 分钟阅读 DeepSeek 模型架构深度解析 模型微调 高级 深入解析 DeepSeek-V3 的 MoE 架构、MLA 注意力机制、Multi-Token Prediction 等核心技术。理解 DeepSeek 如何以极低成本实现 GPT-4o 级别的性能,含架构图解和源码分析。 2025-06 ·28 分钟阅读 DeepSeek 微调实战教程 模型微调 高级 DeepSeek 模型微调全流程实战:LoRA/QLoRA 高效微调、全参数微调、数据准备、训练配置、评估验证。覆盖 DeepSeek-V3 和 DeepSeek-R1 的微调方案,含完整代码和最佳实践。 2025-06 ·26 分钟阅读 DeepSeek 企业级应用教程 AI应用开发 高级 DeepSeek 企业级应用架构设计:多租户隔离、权限管理、审计日志、API 网关、成本控制。含企业级 RAG 系统、智能客服、知识库管理等实战方案,面向大型组织的 AI 落地指南。 2025-06 ·26 分钟阅读 DeepSeek 性能调优教程 部署与运维 高级 DeepSeek 性能调优完整指南:GPU 显存优化、批处理策略、量化技术、并发控制、延迟优化。含 profiling 工具使用、性能基准测试和最佳实践,实现吞吐量和延迟的最优平衡。 2025-06 ·25 分钟阅读 DeepSeek-V4.1-Flash 架构深度解析:CED 非对称架构与 KV Cache 压缩革命 模型架构 高级 DeepSeek-V4.1-Flash 以 552B MoE 与全新 Causal-Encoder-Decoder 非对称架构(输入激活 8B、输出激活 16B)重新定义 Agent 时代推理效率。本文拆解 CED 架构原理、KV Cache 压缩四倍的技术路线与成本模型,并用官方基准数据解读它为何全面超越旗舰 V4 Pro。 2026-09 ·38 分钟阅读 1M 上下文与 384K 输出:用 DeepSeek-V4.1-Flash 构建长上下文多模态 Agent Agent 开发 高级 100 万 tokens 上下文能装下整本代码库与完整操作历史,384K 最大输出支撑长文档与大型代码生成。本文用 DeepSeek-V4.1-Flash 搭建一个结合原生视觉理解、多轮工具调用与长上下文记忆的 Agent 系统,并给出成本测算、限流规避与工程避坑清单。 2026-09 ·40 分钟阅读 DeepSeek-V4.1-Flash 本地部署与推理优化实战:从开源权重到高并发服务 模型部署 高级 DeepSeek-V4.1-Flash 权重已在 Hugging Face 开源,本地部署的显存与吞吐账怎么算?本文从 CED 非对称架构的算力分配讲起,覆盖 KV Cache 四倍压缩带来的显存红利、量化与批处理调优、高并发服务架构,并给出国家超算互联网与 2000 GPU 集群两条规模化部署路线,助你用最低成本跑满 V4.1-Flash。 2026-09 ·38 分钟阅读 依赖注入、Effects 与服务模型:DeepSeek Harness 插件为什么可以不写清理代码 Agent开发 高级 深入 dsh 插件内核的三大机制:inject 声明式依赖与就绪时机、ctx.effect 自动追踪与逆序清理、Service 的注册与消费。给出依赖环、可选依赖、服务替换的实战写法与调试手段,解释「无特权内核、所有注册皆可逆」的工程含义。 2026-09 ·30 分钟阅读 在 DeepSeek Harness 里定义工具:参数 schema、审批与工具流水线 Agent开发 高级 用 ctx 注册一个工具并让模型可靠调用:参数 schema 与描述写法、权限与审批接入点、返回值如何回到上下文,以及 dsh 工具流水线的固定顺序。给出从参数校验到错误回传的完整示例,并说明中间件式改写的边界。 2026-09 ·41 分钟阅读 插件配置与 Bundle / Profile 分层:dsh 的生效配置到底从哪来 部署与运维 高级 dsh 的配置是分层叠加的:插件 schema 默认值、Profile、Bundle、用户覆盖与命令行 patch。本文用 dsh --dump-config 定位实际生效值,讲清两层 manifest 的分工、加载顺序与覆盖优先级,并给出多环境配置与团队共享配置的组织方式。 2026-09 ·52 分钟阅读 插件生命周期与热重载:Fiber 状态机、嵌套插件与 dispose 停稳 Agent开发 高级 插件从加载到卸载经历了什么:Fiber 状态机的状态流转、嵌套插件的父子关系与隔离、重载时旧实例如何停稳,以及 dispose 必须覆盖哪些资源。给出热重载期间状态竞态的排查方法与一个可复现的最小示例。 2026-09 ·42 分钟阅读 作用域隔离与事件系统:DeepSeek Harness 插件之间怎么不打架 Agent开发 高级 讲清 dsh 的作用域(scope)语义与事件总线:哪些注册会被自动隔离、跨插件通信该走服务还是事件、事件命名与 payload 约定、监听器泄漏与重复注册的排查方法,并给出用 scope 做测试替身与灰度替换的实践写法。 2026-09 ·31 分钟阅读 能力缝合(Capability Seams)与自建能力:让 DeepSeek Harness 长出新器官 Agent开发 高级 Seam 是 dsh 扩展能力的标准切口:定义者、提供者、消费者三角色如何协作,如何用三层事件把能力插进 Agent 循环,以及自建一个能力要交付哪些东西。给出从接口设计到替换默认实现、再到运行时验证的完整路径。 2026-09 ·44 分钟阅读 LLM 适配器与 StreamChunk:把任意模型接进 DeepSeek Harness 的流式协议 DeepSeek API 高级 写一个 LLM 适配器需要实现的最小接口、StreamChunk 的字段语义与分块顺序、推理过程与工具调用如何在同一流里表达,以及增量渲染与中断重试的处理方式。给出接入 OpenAI 兼容端点与自定义模型路由的示例与坑位清单。 2026-09 ·58 分钟阅读 DeepSeek Harness 沙箱与审批机制:把危险操作关进笼子 AI 安全 高级 dsh 如何判断一次操作能不能执行:沙箱决策与审批流程的两段式设计、只读/工作区写入/完全访问三档权限的落地差异、审批请求携带的上下文与超时处理,以及插件开发者必须遵守的安全约定与常见漏洞模式。 2026-09 ·46 分钟阅读 发布 DSH 插件 + 防御性编程 + 事故复盘:把插件做成可信赖的资产 部署与运维 高级 插件的三种分发方式与版本约定、发布前必须过的检查项;结果报告、dispose 停稳、凭据擦除、链接删除、回调隔离五个防御性模式;以及 dsh 仓库那条「每个 bug 都写复盘」的工程纪律,怎么用在你自己的插件与团队里。 2026-09 ·39 分钟阅读 对话前缀续写:让 AI 完美接上你的半句话 DeepSeek API 高级 DeepSeek V4 的对话前缀续写(Chat Prefix Completion)Beta 功能让模型从指定的开头继续生成。本文详解使用场景、API 调用、与 FIM 的对比和实际应用案例。 2026-08 ·12 分钟阅读 多 Agent 协作模式实战:从编排到自治 Agent开发 高级 单 Agent 能力有限,多 Agent 协作是解锁复杂任务的关键。本文从实战出发,对比 Supervisor、GroupChat、Sequential 等主流协作模式,并给出可运行的代码实现。 2026-08 ·25 分钟阅读 模型蒸馏实战:用大模型训练小模型 模型微调 高级 知识蒸馏让小模型逼近大模型能力,同时大幅降低推理成本。本文深入讲解蒸馏原理、数据生成策略、训练技巧与效果评估,教你用 DeepSeek 蒸馏出高性价比小模型。 2026-08 ·24 分钟阅读 大模型推理性能优化:vLLM 与 Continuous Batching 部署与运维 高级 模型上线后吞吐与延迟是核心指标。本文深入剖析 vLLM 的 PagedAttention、Continuous Batching 原理,并给出从基准测试、参数调优到生产部署的完整优化路线。 2026-08 ·23 分钟阅读 AI Agent 红队测试与安全评估体系 AI 安全 高级 Agent 能调用工具就有被利用的风险。本文系统讲解 Agent 红队测试方法论,覆盖提示注入、越权工具调用、供应链污染等攻击面,以及配套的自动化评估与防御体系。 2026-08 ·26 分钟阅读 多模态 Agent 实战:视觉理解驱动自动化操作 多模态开发 高级 当 Agent 能「看懂」屏幕和图像,自动化的边界被大幅拓宽。本文讲解多模态 Agent 的架构设计、截图理解、UI 元素定位与动作执行的完整实现,附可运行代码。 2026-08 ·24 分钟阅读 RLHF 强化微调实战:从偏好数据到奖励模型 模型微调 高级 RLHF 让模型输出与人类偏好对齐。本文从偏好数据采集、奖励模型训练到 PPO 强化微调,完整复现一条 RLHF 实战链路,并给出数据质量与效果评估的工程经验。 2026-08 ·26 分钟阅读 Agent 状态机与容错编排:构建可靠的智能体 Agent开发 高级 真实业务中 Agent 会失败:工具超时、上下文溢出、循环死锁。本文用有限状态机建模 Agent 生命周期,并讲解超时熔断、重试补偿、会话恢复等容错编排的完整实现。 2026-08 ·25 分钟阅读 DeepSeek-R1 推理模型原理与思维链工程化实践 模型推理 高级 DeepSeek-R1 通过强化学习让模型学会长思维链推理。本文从 R1 训练三阶段讲起,深入 CoT 提示策略、输出格式约束、温度与采样调优,并给出思维链工程化的成本控制与评测体系,助你生产级落地推理能力。 2026-08 ·38 分钟阅读 大规模向量检索系统设计:从 HNSW 到分布式索引 检索系统 高级 千万级向量、毫秒级召回如何做到?本文从 HNSW 图索引原理讲起,覆盖 IVF-PQ 量化、内存与 SSD 分层、分片与副本、级联检索与缓存,给出完整架构选型对比与压测方法,打造可横向扩展的向量检索底座。 2026-08 ·40 分钟阅读 Agent 记忆系统设计:短期、长期与工具记忆 Agent开发 高级 记忆是 Agent 智能的底座。本文按工作记忆、情景记忆、语义记忆与工具记忆四层建模,讲解压缩、检索、写入与遗忘策略,并用 DeepSeek API 实现一个带向量记忆与反思机制的完整 Agent 记忆子系统。 2026-08 ·36 分钟阅读 多 Agent 协作:用技能链构建 AI 团队 Agent开发 高级 单个 AI 的能力有限,但多个 AI 角色协作可以解决复杂问题。本文讲解如何用技能链编排多个 Agent,构建规划者→执行者→审核者的协作团队。 2026-07 ·20 分钟阅读 实战:构建你的第一个 Agent Loop 应用 Agent开发 高级 从理论到实践,手把手教你用 DeepSeek API 构建一个完整的 Agent Loop 应用。包含需求分析、任务规划、逐步执行、结果验证的完整流程。 2026-07 ·22 分钟阅读 Chain-of-Thought 深度解析 提示词工程 高级 Chain-of-Thought(CoT)不只是「加一句Let's think step by step」。本文从认知科学、信息论和工程实践三个维度深度解析CoT的工作机制、变体策略和前沿进展,带你真正理解AI推理的本质。 2026-07 ·20 分钟阅读 提示词安全与注入防护 提示词工程 高级 提示词注入是AI应用面临的首要安全威胁。攻击者可以通过精心构造的输入绕过系统指令、窃取敏感信息、诱导恶意行为。本文深入讲解提示词注入的攻击向量、检测方法和防护策略,帮你构建安全的AI应用。 2026-07 ·17 分钟阅读 RAG 评估与质量度量体系 RAG检索增强 高级 没有度量就没有改进。RAG系统的质量评估涉及检索质量、生成质量和端到端质量三个层面。本文系统讲解Recall@k、MRR、Faithfulness、RAGAS等核心评估指标和框架,帮你建立科学的RAG质量度量体系。 2026-07 ·22 分钟阅读 Agentic RAG:让 AI 自主检索 RAG检索增强 高级 传统RAG是被动的——用户问什么,系统检索什么。Agentic RAG让AI拥有自主决策能力,能够主动判断是否需要检索、检索什么、如何整合多次检索结果。本文深入解析Agentic RAG的架构设计和实现路径。 2026-07 ·25 分钟阅读 AI 驱动的数据分析管线 AI应用开发 高级 传统数据分析依赖大量人工编码,AI驱动的数据分析管线则让自然语言成为数据查询的接口。本文构建一个完整的NL2SQL+自动可视化+洞察生成的数据分析管线,让任何人都能用自然语言探索数据。 2026-07 ·25 分钟阅读 AI 应用的监控与可观测性 部署与运维 高级 AI应用的可观测性远比传统应用复杂——需要监控LLM调用延迟、Token消耗、幻觉率、用户满意度等多维指标。本文构建一个完整的AI应用监控体系,涵盖指标采集、告警配置、成本追踪和质量监控。 2026-07 ·20 分钟阅读 模型评估与 A/B 测试 模型微调 高级 微调完成后,如何客观评估模型效果?A/B测试如何设计才能得到统计显著的结论?本文从离线评估、在线A/B测试和统计显著性三个维度,建立科学的模型效果评估体系。 2026-07 ·20 分钟阅读 Agent 记忆系统设计 Agent开发 高级 记忆是Agent从一次性工具走向长期智能伙伴的关键。本文深入剖析Agent记忆系统架构设计,涵盖短期/长期记忆、RAG增强记忆和混合检索策略。 2026-07 ·22 分钟阅读 ReAct Agent 深入实现 Agent开发 高级 ReAct(推理+行动)是Agent开发中最经典的范式之一。本文从原理到实现,深入讲解如何构建生产级ReAct Agent,包括提示词工程、工具管理和错误恢复。 2026-07 ·25 分钟阅读 多 Agent 通信协议设计 Agent开发 高级 当多个AI Agent需要协同工作时,通信协议是连接它们的关键纽带。本文深入探讨多Agent通信协议的设计原则、消息格式、路由策略和一致性保证。 2026-07 ·23 分钟阅读 DPO 偏好对齐训练详解 模型微调 高级 DPO(Direct Preference Optimization)是RLHF的简化替代方案,无需训练奖励模型。本文深入讲解DPO的原理、实现细节和训练技巧。 2026-07 ·25 分钟阅读 图谱增强 RAG (GraphRAG) 实战 RAG检索增强 高级 传统RAG只检索文本片段,GraphRAG在此基础上引入知识图谱,实现多跳推理和关系感知的检索。本文从零讲解GraphRAG的构建与实战。 2026-07 ·25 分钟阅读 GPU 集群管理与调度 部署与运维 高级 管理数十张GPU的集群需要专业的调度策略。本文讲解GPU资源管理、任务优先级调度、显存碎片整理和多租户隔离的实践经验。 2026-07 ·23 分钟阅读 企业级 AI 中间件架构设计 AI应用开发 高级 当企业需要统一管理数十个AI服务时,中间件层至关重要。本文讲解AI网关、限流、负载均衡、模型路由和监控的完整架构设计。 2026-07 ·25 分钟阅读 大模型安全与对齐技术 AI应用开发 高级 AI 安全性是生产部署的底线要求。本文深入讲解 RLHF、DPO、Constitutional AI 等对齐技术,以及内容审核、Prompt 注入防御等安全实践,帮助你构建安全可靠的 AI 应用。 2025-07 ·18 分钟阅读 GPU 加速推理优化深度指南 部署与运维 高级 GPU 推理优化是降低大模型部署成本的关键。本文深入讲解 FlashAttention、量化推理、TensorRT 加速、连续批处理等核心技术,帮助你最大化 GPU 利用率。 2025-07 ·19 分钟阅读 Prompt 注入防御与安全加固 提示词工程 高级 Prompt 注入是大模型应用面临的头号安全威胁。本文深入分析各类注入攻击的原理,并提供系统化的防御策略,包括输入过滤、输出校验、沙箱隔离和权限控制。 2025-07 ·17 分钟阅读 高级RAG:多跳检索与自查询 RAG检索增强 高级 基础RAG无法处理需要跨文档推理的复杂问题。本文深入讲解多跳检索、自查询检索和上下文压缩等高级RAG技术,帮助你将RAG系统提升到生产级水平。 2025-06 ·20 分钟阅读 多Agent协作:构建AI团队 Agent开发 高级 单个Agent的能力有限,多Agent协作可以解决更复杂的问题。本文讲解多Agent系统的设计模式、通信机制和实际应用案例,教你构建能够协同工作的AI团队。 2025-06 ·20 分钟阅读 数据集构建与质量评估 模型微调 高级 数据质量决定了微调效果的上限。本文系统讲解微调数据集的构建方法、数据清洗策略、质量评估指标以及数据增强技术,帮助你构建高质量的微调数据集。 2025-06 ·17 分钟阅读 大模型API服务化最佳实践 部署与运维 高级 将大模型能力API化是企业级应用的关键环节。本文从架构设计、限流策略、缓存优化、安全防护等维度,系统讲解大模型API服务化的最佳实践。 2025-06 ·20 分钟阅读 AI应用性能优化与成本控制 AI应用开发 高级 AI应用的性能和成本直接影响产品体验和商业可行性。本文从提示词优化、缓存策略、模型选择、架构设计等维度,系统讲解AI应用性能优化和成本控制的方法。 2025-06 ·16 分钟阅读 结构化输出与JSON模式实战 提示词工程 高级 在生产环境中,AI的非结构化输出难以直接使用。本文深入讲解如何让大模型输出结构化数据,包括JSON Schema约束、Pydantic集成和结构化输出的最佳实践。 2025-05 ·14 分钟阅读

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。