关于
魔都水滴
AI Infrastructure Engineer
这里记录我在 AI Agent、Cloud Platform、Self-hosting 和 Engineering 方向上的长期实践。
我更关心一套系统能不能真正运行起来、稳定下来,并且在出现问题时能够被定位和修复。因此,博客内容主要来自真实环境中的部署、迁移、排障、自动化和复盘,而不是只整理一份“看起来能用”的教程。
我长期关注什么
- AI Agent:Coding Agent、MCP、共享记忆、模型网关和 Agent 工作流
- Self-hosting:Docker、NAS、Proxmox VE、家庭实验室和网络基础设施
- Engineering:Linux、Java、Go、数据库、性能、可观测性和线上事故
- Cloud Platform:服务部署、自动化、权限、Token 管理和生产环境实践
这些方向并不是彼此孤立的。我的兴趣是把 AI 能力放进真实的工程系统里:有数据、有权限、有监控,也有明确的失败边界和回滚方式。
文章会写什么
我通常会尽量保留:
- 起因和背景:问题在什么环境里出现,原本的目标是什么。
- 验证过程:实际执行了哪些命令、观察到什么现象,以及哪些尝试没有奏效。
- 根因和修复:为什么会出问题,最终改变了什么。
- 验收方式:如何证明服务恢复、配置生效或部署真的上线。
如果文章涉及线上环境、机器或内部系统,会对敏感信息做脱敏处理。
推荐阅读路径
- 第一次来:从 Start Here 了解完整主题地图。
- 想看最新实践:浏览归档。
- 想按技术检索:浏览标签。
- 想看代码和自动化:访问 GitHub。
其他入口
这个博客会继续以中文为主,并在值得长期参考的文章上补充英文版本。欢迎通过文章底部的评论区交流,也欢迎指出实践中的遗漏和错误。