DNS最佳实践 避免IPVS缺陷导致的DNS概率性解析超时问题 当集群使用IPVS作为kubeproxy负载均衡模式时,您可能会在CoreDNS缩容或重启时遇到DNS概率性解析超时的问题。 您可以通过以下任意方式降低IPVS缺陷的影响: 使用节点DNS缓存NodeLocal DNSCache。 修改kubeproxy中IPVS UDP会话保持的超时时间。 使用节点DNS缓存NodeLocal DNSCache 在云容器引擎集群中部署NodeLocal DNSCache可以提升服务发现的稳定性和性能,NodeLocal DNSCache通过在集群节点上作为DaemonSet运行DNS缓存代理来提高集群DNS性能。 使用合适的CoreDNS版本 CoreDNS对Kubernetes版本实现了较好的向后兼容,建议您保持CoreDNS版本为较新的稳定版本。云容器引擎插件市场中提供了CoreDNS的安装、升级、配置能力,您可以关注插件市场中插件状态,若CoreDNS组件显示可升级,请尽快选择业务低峰期进行升级。 CoreDNS v1.7.0以下的版本存在风险隐患,包括且不仅限于以下: CoreDNS与APIServer连通性异常(例如APIServer重启、APIServer迁移、网络抖动)时,CoreDNS会因错误日志写入失败导致容器重启。 启动CoreDNS时会占用额外内存,默认采用的Memory Limit在较大规模集群下可能触发OOM(OutOfMemory)问题,严重时可能导致CoreDNS Pod反复重启无法自动恢复。 CoreDNS存在若干可能影响Headless Service域名、集群外部域名解析的问题。
来自: