Skills Plugins MCP Prompt Model 博客 我的中心

最新博客文章

8 / 173

AI 开发实战教程,从零到一构建你的 AI 应用。

教程 日期
DeepSeek 部署与运维教程 部署与运维 进阶 DeepSeek 模型部署全流程:vLLM 部署配置、负载均衡、自动扩缩容、监控告警、成本优化。含 Docker、Kubernetes 部署方案和云平台部署指南,覆盖单机到集群的全场景。 2025-06 ·24 分钟阅读 AI 应用可观测性:日志、监控与告警实战 部署与运维 进阶 生产环境的 AI 应用需要完善的可观测性体系。本文详解 Token 用量监控、API 延迟追踪、错误率告警、成本分析仪表板和日志最佳实践,帮助你构建可靠的 AI 服务。 2026-08 ·14 分钟阅读 DeepSeek 模型本地部署完全指南 部署与运维 进阶 云端API虽好,但很多场景需要本地部署——数据安全、低延迟、离线使用。本文全面讲解DeepSeek模型的本地部署方案,涵盖Ollama、vLLM、llama.cpp等主流工具,从硬件选型到性能调优全覆盖。 2026-07 ·25 分钟阅读 AI API 成本优化实战 部署与运维 进阶 AI API的token费用看似便宜,但规模化后成本可能失控。本文从提示词压缩、语义缓存、模型路由、批处理等维度出发,系统讲解AI API成本优化的实战策略,帮你的月度账单降低50%-80%。 2026-07 ·17 分钟阅读 AI 服务容器化最佳实践 部署与运维 进阶 将AI模型服务容器化是生产部署的第一步。本文讲解Docker镜像优化、GPU支持、健康检查和Kubernetes部署的完整方案。 2026-07 ·22 分钟阅读 CI/CD 流水线中的 AI 测试 部署与运维 进阶 将AI模型测试集成到CI/CD流水线是持续交付高质量AI服务的关键。本文讲解自动评估、回归测试、性能基准和部署门禁的完整方案。 2026-07 ·20 分钟阅读 大模型推理加速技术全景 部署与运维 进阶 推理速度直接决定用户体验。本文系统讲解 KV Cache、Speculative Decoding、模型量化、算子融合等推理加速技术,帮助你从原理到实践全面掌握大模型推理优化。 2025-07 ·17 分钟阅读 vLLM高性能推理部署 部署与运维 进阶 vLLM是当前最先进的开源大模型推理引擎。本文深入讲解vLLM的PagedAttention原理、生产环境配置、性能调优策略和监控方案,帮助你构建高吞吐量的推理服务。 2025-05 ·18 分钟阅读

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。