【问题描述】

在应用端,偶尔看到有如下报错:

  1. Authentication to host 'xxxx' for user 'yyyy' using method 'mysql_native_password' failed with message: Reading from the stream has failed.

表现特征:

    1.只有用Connector/NET 出现这个问题, 用JDBC驱动没有类似问题。

    2.多台应用服务器,只有一台报这个错,因此可以排除服务器端的问题。

    3.问题非常随机,重启一下服务器/IIS,就能临时解决问题。

    4.有一些场景应用服务器CPU并不是很高,也会偶尔抛出这个错来。

客户端是Windows机器, 驱动是MySQL Connector ADO.NET Driver for MySQL (Connector/NET) ,使用的版本是6.9.9,是比较新的版本。

【问题分析】

我们在应用服务器端和数据库端抓包。两边抓到的包是一致的。可以排除网络问题。下面是抓到的包,以及时间点:

编号 绝对时间 相对时间(秒) 源头 目的 网络包内容
  1     12:58:47     9.07     应用服务器     数据库服务器     ......S.  
  2     12:58:47     9.07     数据库服务器     应用服务器      …A..S.   
  3     12:58:47     9:07     应用服务器     数据库服务器     …A….   
  4     12:58:47     9:07     数据库服务器     应用服务器      …AP…   
  5     12:58:47     9.27     应用服务器     数据库服务器     …A….   
  6     12:58:57     19.12     数据库服务器     应用服务器      …A…F   
  7     12:58:57     19.12     应用服务器     数据库服务器     …A….   
  8     12:59:10     32.00     应用服务器     数据库服务器     …AP…   
  9     12:59:10     32.00     数据库服务器     应用服务器      …..R..   

从上述网络包的交互来看, 前面三个包是TCP的三次握手协议。问题出在第六个包,数据库服务器向应用服务器发送了一个Finish包,来终止数据库的连接。数据库发送Finish包,是由于数据库端发现连接超时而发送的。 这是由服务器端的Connect_timeout这个变量来控制。原因在于应用端超过10秒未向数据库服务器端发送网络包。从网络包交互的情况来看,第五个包和第六个包的时间间隔刚好是10秒。

对比正常的数据库连接和上面异常的数据库连接。 应用服务器发送第5个包到数据库端后, 应该紧接着发送下面的网络包到数据库端的。这个包主要是发送账号,驱动版本,操作系统信息等到数据库服务器端。【下面是部分的正常的网络包截图】。在出现异常报错的场景,客户端是延迟发送这个包的。在Frame 8才发送的。而此时连接已经被Finish了,在Frame 9,数据库端发送了一个Reset包到应用服务器,彻底中断连接。

我们现在具体分析,为何客户端发送账号,驱动版本,操作系统信息到数据库端这么慢。这部分的代码在Connector/NET MySQLAuthenticationPlugin.cs文件中。 我们修改这部分代码,进行时间埋点,来进一步定位问题。下面是根据时间埋点,打印出来的跟踪信息。

从跟踪的Trace来看,有30秒左右的操作延时。返回MySQLDefs::OSDetails的时候。这部分代码如下:

  1. [DisplayName("_os_details")]
  2. public string OSDetails
  3. {
  4. get
  5. {
  6. string os = string.Empty;
  7. try
  8. {
  9. var searcher = new System.Management.ManagementObjectSearcher("SELECT * FROM Win32_OperatingSystem");
  10. var collection = searcher.Get();
  11. foreach (var mgtObj in collection)
  12. {
  13. os = mgtObj.GetPropertyValue("Caption").ToString();
  14. break;
  15. }
  16. }
  17. catch (Exception ex) { System.Diagnostics.Debug.WriteLine(ex.ToString()); }
  18. return os;
  19. }
  20. }

这段代码是通过WMI查询,来获得Caption信息。也就是操作系统的版本信息。由于是WMI调用,所以依赖的关系比较多。

【问题验证】

我们把这段代码抽出来。下面是一段简短的Repro代码:

  1. static void Main(string[] args)
  2. {
  3. Stopwatch watch = new Stopwatch();
  4. while (true)
  5. {
  6. watch.Restart();
  7. var searcher = new System.Management.ManagementObjectSearcher("SELECT * FROM Win32_OperatingSystem");
  8. var collection = searcher.Get();
  9. foreach (var mgtObj in collection)
  10. {
  11. string os = mgtObj.GetPropertyValue("Caption").ToString();
  12. }
  13. watch.Stop();
  14. Console.WriteLine(watch.ElapsedMilliseconds);
  15. if (watch.ElapsedMilliseconds >= 1000)
  16. {
  17. Console.WriteLine("-------------");
  18. File.AppendAllText("abc.txt", DateTime.Now.ToString("yyyy-MM-dd HH:mm:ss.fff") +","+ watch.ElapsedMilliseconds + "\r\n");
  19. }
  20. }
  21. }

在有问题的应用服务器上,我们运行上述代码,确实可以发现WMI查询有超时:下面这些点是我们抓到的超过30秒的点:

  1. 2017-11-21 17:19:30.208 33638
  2. 2017-11-21 17:20:09.193 33199
  3. 2017-11-21 17:20:53.086 33201
  4. 2017-11-21 17:27:05.114 32976
  5. 2017-11-21 17:28:19.178 33635
  6. 2017-11-21 17:30:07.130 65977
  7. 2017-11-21 17:30:49.051 40478
  8. 2017-11-21 17:31:15.126 26072
  9. 2017-11-21 17:38:16.048 66671
  10. 2017-11-21 17:38:49.204 33152
  11. 2017-11-21 17:39:53.161 33828
  12. 2017-11-21 17:40:38.121 33549
  13. 2017-11-21 17:47:09.179 33775
  14. 2017-11-21 17:47:57.174 33164

【解决思路】

WMI查询慢,可能是由于多种原因所致。如操作系统CPU高,或者查询本身有死锁。这个问题有待于进一步分析。但看代码,我们知道做这个WMI查询,只是为了获得操作系统的信息。这个信息完全可以缓存起来。而不必要每次连接的时候,去进行WMI查询。

此处确定该错误的根本原因在于MySQL的C# connector中对操作系统信息的获取时间过久,导致触发服务器的连接超时。注释掉该部分(可能导致长时间的操作),进行进一步的验证,再无任何的超时错误出现。

  1. public string OSDetails
  2. {
  3. get
  4. {
  5. dbglog.dolog("MysqlDefs::OSDetails1");
  6. string os = string.Empty;
  7. /*try
  8. {
  9. var searcher = new System.Management.ManagementObjectSearcher("SELECT * FROM Win32_OperatingSystem");
  10. var collection = searcher.Get();
  11. foreach (var mgtObj in collection)
  12. {
  13. os = mgtObj.GetPropertyValue("Caption").ToString();
  14. dbglog.dolog(String.Format("MysqlDefs::OSDetails::foreach{0}", os.ToString()));
  15. break;
  16. }
  17. }
  18. catch (Exception ex) { System.Diagnostics.Debug.WriteLine(ex.ToString()); }*/
  19. dbglog.dolog("MysqlDefs::OSDetails2");
  20. return os;
  21. }
  22. }

关于MySQL连接抛出Authentication Failed错误分析的更多相关文章

  1. 关于mysql连接抛出10038错误问题

    今天用Navicat Premium连接windows server 2003 mysql的时候, 抛出10038问题, 这种问题之前在rhel也出现过一次, 就是防火墙不允许连接kill掉了这个请求 ...

  2. JDBC获取连接抛出java.sql.SQLException: The server time zone...

    今天尝试数据库,代码确实没问题就是给了给这个东西 java.sql.SQLException: The server time zone value '�й���׼ʱ��' is unrecogniz ...

  3. 关于Django数据库mysql连接错误问题Connection to api@localhost failed. [08001] Could not create connection to d

    Connection to api@localhost failed. [08001] Could not create connection to d 错误类型 django连接mysql数据库错误 ...

  4. HttpClient连接池抛出大量ConnectionPoolTimeoutException: Timeout waiting for connection异常排查

    转自: http://blog.csdn.net/shootyou/article/details/6615051 今天解决了一个HttpClient的异常,汗啊,一个HttpClient使用稍有不慎 ...

  5. MongoDB3.4安装配置以及与Robomongo1.1的连接——解决Authentication Failed导致的不能连接问题

    本文环境:win10(64)+MongoDB(3.4.5)+Robomongo(1.1) 目录: MongoDB的安装 MongoDB的配置 Robomongo的安装以及与MongoDB的连接 一些新 ...

  6. JMS之——ActiveMQ时抛出的错误Could not connect to broker URL-使用线程池解决高并发连接

    转载请注明出处:http://blog.csdn.net/l1028386804/article/details/69046395 解决使用activemq时抛出的异常:javax.j ms.JMSE ...

  7. Git客户端执行命令报错: fatal: Authentication failed for'xxxxx.git',但是又不弹出窗口重新输入用户名和密码的解决办法

    1.Git版本:Git-2.17.0 2.引起git报错的原因 在变更远程仓库路径的的时候,弹出过一个窗口输入用户名和密码,但是输错了,之后执行任何拉取和更新的命令都会报如下的错: fatal: Au ...

  8. Python--day41--事件和信号量之模拟连接数据库并在连接三次后抛出连接超时异常

    #事件被创建的时候#False状态 #wait()阻塞#True状态 #wait() 非阻塞#clear 设置状态为False#set 设置状态为True #数据库 --- 文件夹#文件夹里有好多ex ...

  9. 用navicat进行身份验证连接出现cannot connect to Mongodb authentication failed

    用navicat进行身份验证连接出现cannot connect to Mongodb authentication failed. 解决办法: 1.打开mongoDB连接 win+r --cmd-- ...

随机推荐

  1. UI设计规范:单选按钮 vs 复选框,没那么简单

    无论是网页设计,还是移动app设计,都经常用到单选按钮和复选框这两个组件.这两个组件看似意义明确,很好区分,但在实际设计中却很容易用错,带来不好的用户体验. 本文中我通过列举几个典型的错误用法,帮助设 ...

  2. 第二篇博客 wordcount

    1.首先 附上Github项目地址:https://github.com/June1104/WordCount 2.psp表格 PSP2.1表格 PSP2.1 PSP阶段 预估耗时 (分钟) 实际耗时 ...

  3. 2018.09.22 ZJOI2005午餐(贪心+01背包)

    描述 上午的训练结束了,THU ACM小组集体去吃午餐,他们一行N人来到了著名的十食堂.这里有两个打饭的窗口,每个窗口同一时刻只能给一个人打饭.由于每个人的口味(以及胃口)不同,所以他们要吃的菜各有不 ...

  4. 2018.07.22 codeforces750E(线段树维护状态转移)

    传送门 给出一个数字字串,给出若干个询问,询问在字串的一段区间保证出现2017" role="presentation" style="position: re ...

  5. nvarchar,varchar 区别

        char    char是定长的,也就是当你输入的字符小于你指定的数目时,char(8),你输入的字符小于8时,它会再后面补空值.当你输入的字符大于指定的数时,它会截取超出的字符.   nva ...

  6. Android中Activity启动过程探究

    首先追溯到Activity的启动,随便启动一个自己写的demo项目,使用DDMS进行debug标记,然后在Debug中把主线程暂停,可以看到调用栈.如下图所示: 于是我们先看android.app.A ...

  7. matlab练习程序(生成希尔伯特曲线)

    能够使用这样一条线遍历图像中所有的像素,不过这里没有这样做,而只是生成了这样一条曲线. 程序中h,w是最终图像的高和宽,n为希尔伯特曲线阶数. 这里如果n等于log2(h)或log2(w),则图像就全 ...

  8. hdu 4952 暴力

    http://acm.hdu.edu.cn/showproblem.php?pid=4952 给定x,k,i从1到k,每次a[i]要是i的倍数,并且a[i]大于等于a[i-1],x为a0 递推到下一个 ...

  9. EBS Archiving and Purging: You Know you need to

    A number of trends in the IT industry have contributed to the increasing size of ERP application dat ...

  10. matlab 降维工具箱

    Matlab Toolbox for Dimensionality Reduction   降维方法包括: Principal Component Analysis (PCA) • Probabili ...