mysql authentication_MySQL Authentication Failed问题分析与解决对策

news/2024/7/7 12:41:30

原标题:MySQL Authentication Failed问题分析与解决对策

作者介绍

姜宇祥,2012年加入携程,10年数据库核心代码开发经验,相关开发涉及达梦、MySQL数据库。现致力于携程MySQL的底层研发,为特殊问题定位和处理提供技术支持。

另感谢姜贤富、俞榕刚两位参与者对本文撰写提供的帮助。

问题描述

在应用端,偶尔看到有如下报错:Authentication to host 'xxxx' for user 'yyyy' using method 'mysql_native_password' failed with message: Reading from the stream has failed.

表现特征:

只有用Connector/NET 出现这个问题, 用JDBC驱动没有类似问题。

多台应用服务器,只有一台报这个错。因此可以排除服务器端的问题。

问题非常随机。重启一下服务器/IIS,就能临时解决问题。

有一些场景应用服务器CPU并不是很高,也会偶尔抛出这个错来。

客户端是Windows机器, 驱动是MySQL Connector ADO.NET Driver for MySQL (Connector/NET) ,使用的版本是6.9.9是比较新的版本。

问题分析

我们在应用服务器端和数据库端抓包。两边抓到的包是一致的。可以排除网络包丢失问题。下面是抓到的包,以及时间点:

0563509a098099a3bf235ce312b51fc0.png

从上述网络包的交互来看, 前面三个包是TCP的三次握手协议。问题出在第六个包,数据库服务器向应用服务器发送了一个Finish包,来终止数据库的连接。数据库发送Finish包,是由于数据库端发现连接超时而发送的。 这是由服务器端的Connect_timeout这个变量来控制。原因在于应用端超过10秒未向数据库服务器端发送网络包。从网络包交互的情况来看,第五个包和第六个包的时间间隔刚好是10秒。

对比正常的数据库连接和上面异常的数据库连接。 应用服务器发送第5个包到数据库端后, 应该紧接着发送下面的网络包到数据库端的。这个包主要是发送账号,驱动版本,操作系统信息等到数据库服务器端。【下面是部分的正常的网络包截图】。在出现异常报错的场景,客户端是延迟发送这个包的。在Frame 8才发送的。而此时连接已经被Finish了,在Frame 9,数据库端发送了一个Reset包到应用服务器,彻底中断连接。

610717b9e4545db3e40403f6c20b60b8.png

我们现在具体分析,为何客户端发送账号,驱动版本,操作系统信息到数据库端这么慢。这部分的代码在Connector/NET的MySQLAuthenticationPlugin.cs文件中。 我们修改这部分代码,进行时间埋点,来进一步定位问题。下面是根据时间埋点,打印出来的跟踪信息。

60fc2f9f97606c6f1d27d9d908dc1a77.png

从跟踪的Trace来看,有30秒左右的操作延时,全部时间集中在获取Mysqldefs:: OSDetails的属性。这部分代码如下:

4122ec24a4aab3dd6cebde7b63979c91.png

这段代码是通过WMI查询,来获得Caption信息。也就是操作系统的版本信息。由于是WMI调用,所以依赖的关系比较多且与操作系统的状态相关。

问题验证

为了验证是否为WMI偶发且频繁的延时导致生产环境的某些机器出现通讯异常,我们把这段代码抽出来。下面是一段简短的重现代码:

ec2da2bc4dd622b94bda5117a87e0325.png

在有问题的应用服务器上,我们运行上述代码,确实可以发现WMI查询有超时。下面这些日志信息是我们抓到的查询超过30秒的WMI信息查询操作。由此完全确认是该操作导致MySQL authentication failed错误。

2017-11-21 17:19:30.208, 33638

2017-11-21 17:20:09.193, 33199

2017-11-21 17:20:53.086, 33201

2017-11-21 17:27:05.114, 32976

2017-11-21 17:28:19.178, 33635

2017-11-21 17:30:07.130, 65977

2017-11-21 17:30:49.051, 40478

2017-11-21 17:31:15.126, 26072

2017-11-21 17:38:16.048, 66671

2017-11-21 17:38:49.204, 33152

2017-11-21 17:39:53.161, 33828

2017-11-21 17:40:38.121, 33549

2017-11-21 17:47:09.179, 33775

2017-11-21 17:47:57.174, 33164

解决思路

WMI查询慢,可能是由于多种原因所致。如操作系统CPU高,或者查询本身有死锁。这个问题有待于进一步分析。但看代码,我们知道做这个WMI查询,只是为了获得操作系统的信息。这个信息完全可以缓存起来。而不必要每次连接的时候,去进行WMI查询。

此处确定该错误的根本原因在于MySQL的C# connector中对操作系统信息的获取时间过久,导致触发服务器的连接超时。注释掉该部分可能导致长时间的操作,在问题机器上进行进一步的验证,再无任何的超时错误出现。

0ebbcbd494c0b866b0a5deb39cee4d94.png

由于应用端的系统信息相对来说是静态信息,因此Connector/Net可以通过环境变量获取这些信息,绕过WMI调用查询。这样每次进行连接时,可避免出现查询超时的问题,并且能够提高Connector/Net的效率。返回搜狐,查看更多

责任编辑:


http://www.niftyadmin.cn/n/3661260.html

相关文章

[领域]javascript hacking guide 第7部分

2007年02月07日 10:39:00 通过一段时间的源代码阅读和ECMA262规范的理解,我对javascript的原型链已经有了更新层次的理解。原来的那幅图仍然是正确的,只是还缺少了一些内容。例如:对象是分层次的,最外层的对象就是global对象&…

mysql如何加大精确度_如何通过MySQL中的除法提高精度?

为了提高除法的精度,请使用MySQL CAST()。让我们首先创建一个表-mysql> create table DemoTable1823(Value int);使用插入命令在表中插入一些记录-mysql> insert into DemoTable1823 values(1);mysql> insert into DemoTable1823 values(2);mysql> inse…

delphi 调试控件代码_第二十九篇:使用SOUI的SMCListView控件

列表控件是客户端应用最常用的控件之一。列表控件通常只负责显示数据,最多通知一下APP列表行的选中状态变化。现在的UI经常要求程序猿在列表控件里不光显示内容,还要能和用户交互,显示动画等等,传统的列表控件对于这样的需求基本是…

[领域]javascript hacking guide part 6

2007年02月06日 21:22:00 书接上回,我们说到global对象的初始创建已经完成了。那,你肯定会问了,为什么说是初始创建,而不是完整的创建呢?要回答这个问题,还要从ECMA262说起:在ECMA262&#xff0…

[领域]javascript hacking guide 第5部分

2007年02月06日 11:49:00 map是JSObject的一个重要属性,存放一个对象的所有的属性的入口。要想了解map,就需要打开jsobj.h文件,看里面的定义。struct JSObject {JSObjectMap *map;jsval *slots;};很自然的,我们还要找到JSObjectMa…

arcgis分隔图层重复出文件_ArcGIS实用制图技巧 | 处理好这些细节才能让图更专业...

地理信息系统(Geographic Information System或 Geo-Information system,GIS)有时又称为“地学信息系统”。它是一种特定的十分重要的空间信息系统。它是在计算机硬、软件系统支持下,对整个或部分地球表层(包括大气层)空间中的有关地理分布数…

postman是做什么的_Postman +Newman+Jenkins+钉钉实现持续集成的接口自动化

一、为什么选用postman工具做接口自动化测试postman调试工具无论对于开发和测试小白,还是技术大牛来说应该都耳熟能详,在过去的几年里大家对这款工具应用最广的用途是把当作接口调试的测试工具,它能发送几乎所有类型的HTTP请求,操…

基于DSL的组织机构模型 之一:预告

2007年05月31日 21:07:00 最近我对组织机构领域模型的ruby实现很是着迷。本来,已经知道今天下午要考IBM SOA Test 665,可是我昨天下午就已经开始开小差了,昨天晚上更是在几张白纸上写写画画的,搞到凌晨2点才算完,早晨起…