容器化已经普及,但生产环境的细节做不好容易踩坑。\n\n实践要点:\n\n1. 多阶段构建减小镜像体积,降低攻击面。把编译和运行环境分开,最终镜像只包含运行时依赖,能减少 80% 以上的镜像体积,同时减少潜在漏洞。\n\n2. 健康检查配置要合理,异常容器能优雅重启。readinessProbe 和 livenessProbe 要分开配置,初始延迟、超时时间、检测间隔都要根据应用启动时间仔细调整。\n\n3. 资源限制必须设置,避免单个容器耗尽节点资源。CPU 和内存的 requests、limits 都要明确设置,否则节点压力大时容器会被无差别驱逐或出现 OOM 连锁反应。\n\n4. 日志输出到 stdout,配合集中收集系统。直接写文件的日志会随着容器销毁丢失,且难以跨节点聚合。stdout + JSON 格式日志 + Loki/ELK 是更现代的方案。\n\n你们的容器化部署有哪些踩坑经历?