Temporary failure in name resolution - DNS引发的问题和思考

问题描述

由于公司业务需要,将之前部署在阿里云上的Spring Boot应用迁移到了华为云的VPC上,之前在阿里云上应用基本上都是10秒内启动且看不到任何告警信息,迁移之后,不仅启动速度变慢到2到3分钟,且时常能在日志中看到Temporary failure in name resolution的告警信息。

以下是当前正在使用的服务器环境
  • 服务器: 华为云VPC
  • 操作系统:CentOS 7
  • JDK版本: 1.8.0_151
  • SpringBoot版本: 1.5.8.Rlease
  • 容器: Embedded Tomcat 8.5.23

一开始对这个问题,是忽略的,由于本身应用属于内部开发阶段,且每天更新和部署不是那么频繁等等因素,一直迟迟没有想去解决这个问题。不过最近因为临近项目上线,提交也比较多,而且因为应用拆分和前后端分离的问题,本地调试比较麻烦,所以开始着手解决这个问题。

问题调查

  1. 首先看到这个异常,确实第一感觉是域名解析出的问题,于是考虑是不是Tomcat的域名解析服务出的问题,修改了EmbeddedTomcat的配置



    修改之后测试发现问题依旧,去官网查了资料



    其实Tomcat 8以后默认这个配置就是关闭的,这样看来自然就不是问题的根源了。
  2. 重新梳理了一下思路,Spring Boot的初始化肯定是先于Tomcat的,所以应该是Spring Boot的初始化过程中出现了阻塞导致应用启动过慢的问题。(不过要说明的是,知道此时并不确信是因为域名解析导致的阻塞,因为Spring Boot在启动过程中并没有抛出任何异常)

先做了个测试,启动Spring Boot应用的同时检查53端口,此时应用处于假死状态,应用和远程的DNS服务器正在通信,基本可以断定是因为调用了Jdk的InetAddress类的方法导致的问题。



于是通过jstack定位当前阻塞的代码




问题已经显而易见,Spring Boot在初始化的时候,执行了InetAddress的getLocalHost方法导致程序阻塞而影响了应用的启动时间。
SpringApplication

LoggingApplicationListener

LoggingSystemProperties

ApplicationPid

VMManagementImpl

又查看了一下当前服务器的DNS配置



可以看到DNS服务器的地址是公网的DNS地址,VPC访问不到导致取主机名的方法发生阻塞,因此导致应用启动时间非常长

问题解决

跟最初推测的差不多,确实是域名解析的问题,不过意外的是在Spring Boot初始化的时候获取VMID的时候会获取当前服务器的主机名。于是在/etc/resolve.conf中添加了本地主机的解析记录并删除无法访问的公网DNS配置,现在应用的启动已经和本地一样了

问题反思

虽然最开始就定位了问题是DNS,不过发生问题的根源一直没有确定,也不想只是简单的把DNS配置修改来立刻解决问题,毕竟希望究本溯源,不希望被表面的问题所迷惑。
于是又查看了JDK的源码,发现InetAddress#getLocalHost是个本地方法


InetAddress

Inet4AddressImpl

本地方法也难不倒我们,下载了openjdk的源码找到对应的C源码




这个方法来自于jvm.cpp里面的方法


虽然对C表示不熟,不过基本能看出来是调用系统库的API来获取的主机名,顺便也查询了一下是说这个系统库本身设计的就不好,属于同步调用,在网络不通的情况下会导致严重的超时问题。

同时不免想对华为云吐槽几句,服务器装个图形界面版的CentOS就不说了,起码给个内网的DNS服务器啊,完全是没有经过任何配置优化的操作系统,期待更进一步的改进。

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 156,907评论 4 360
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 66,546评论 1 289
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 106,705评论 0 238
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 43,624评论 0 203
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 51,940评论 3 285
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 40,371评论 1 210
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 31,672评论 2 310
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 30,396评论 0 195
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 34,069评论 1 238
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 30,350评论 2 242
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 31,876评论 1 256
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 28,243评论 2 251
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 32,847评论 3 231
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 26,004评论 0 8
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 26,755评论 0 192
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 35,378评论 2 269
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 35,266评论 2 259