MySQL制作具有千万条测试数据的测试库的方法-巨人网络通讯

MySQL制作具有千万条测试数据的测试库的方法

有时候需要制造一些测试的数据，以mysql官方给的测试库为基础，插入十万，百万或者千万条数据。利用一些函数和存储过程来完成。

官方给的测试库地址：https://github.com/datacharmer/test_db

导入官方的数据库，做了一些简化，留下了部门表，员工表和雇佣表三张表，去掉了外键关联。因为是测试数据，日期的对应关系不具备准确性。

必要的函数

生成随机字符串

RAND()：生成0~1之间的随机数

FLOOR：向下整数（FlOOR(1.2)=1）

CEILING 向上取整（CEILING(1.2)=2）

substring：截取字符串

concat：字符串连接

CREATE DEFINER=`root`@`localhost` FUNCTION `rand_string`(n INT) RETURNS varchar(255) CHARSET latin1
BEGIN
	DECLARE chars_str 	varchar(100) DEFAULT 'ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz';
  DECLARE return_str 	varchar(255) DEFAULT '';
  DECLARE i INT DEFAULT 0;
  WHILE i  n DO
    SET return_str = concat(return_str,substring(chars_str , FLOOR(1 + RAND()*62 ),1));
    SET i = i +1;
  END WHILE;
  RETURN return_str;
END

查看自定义的所有函数

show function status

测试使用：

select rand_string(5);

生成随机年月日字符串

生成一个指定时间段内的随机日期

SELECT
	date(
	from_unixtime( unix_timestamp( '2000-01-01' ) + floor( rand() * ( unix_timestamp( '2020-12-31' ) - unix_timestamp( '2000-01-01' ) + 1 ) ) ));

函数：生成指定时间段内的随机日期

CREATE DEFINER=`root`@`localhost` FUNCTION `rand_date_string`(startDate varchar(255),endDate varchar(255)) RETURNS varchar(255) CHARSET latin1
BEGIN
  DECLARE return_str varchar(255) DEFAULT '';
	
	 SET return_str =date(
		from_unixtime( unix_timestamp( startDate ) 
				+ floor( rand() * ( unix_timestamp( endDate ) - unix_timestamp( startDate ) + 1 ) ) 
			)
	 );
  
  RETURN return_str;
END

测试使用：

select rand_date_string('2000-01-01','2020-12-31');
//结果
2001-09-10

存储过程生成数据

给每个部门插入一百万员工，那么员工表就有九百万的数据。

CREATE DEFINER=`root`@`localhost` PROCEDURE `data`()
BEGIN
	
	DECLARE i INT DEFAULT 1;
	DECLARE j INT DEFAULT 0;
	DECLARE id INT DEFAULT 0;
	WHILE i  10 DO
			WHILE j  1000000 DO
				insert into employees_m (emp_no,birth_date,first_name,last_name,gender,hire_date) VALUES(
					id,rand_date_string('1970-01-01','1997-01-01'),rand_string(5),rand_string(5),'M',NOW());
				
				insert into dept_emp_m (emp_no,dept_no,from_date,to_date) values(
					 id,concat('d00',i),rand_date_string('1990-01-01','2020-12-31'),'2020-12-31');
					 
			SET j=j+1;  
			SET id=id+1;  
			END WHILE;
	SET j = 0;
	SET i=i+1;   
	END WHILE;

END

插入九百万条数据大概用时：4868s

上面的方式插入数据会很慢，可以将数据插入到内存表，就是将表的存储引擎修改为MEMORY这样就会使用内存去存储数据，会比直接插入到INNODB引擎的表中快很多，只不过就是没有持久化，但是速度贼快，插入一千万条数据大概需要时间: 1227.89s

附录

修改表存储引擎

ALTER TABLE dept_emp_m ENGINE=MEMORY;

调整内存表的大小，修改配置文件

[mysqld]
max_heap_table_size = 2048M
tmp_table_size = 2048M

以上就是MySQL制作具有千万条测试数据的测试库的方法的详细内容，更多关于MySQL 千万条测试数据的资料请关注脚本之家其它相关文章！

您可能感兴趣的文章:

MySQL循环插入千万级数据
MySQL 千万级数据量如何快速分页
MySQL 快速删除大量数据（千万级别）的几种实践方案详解
MySQL千万级大数据SQL查询优化知识点总结
MySql 快速插入千万级大数据的方法示例
MySQL如何快速的创建千万级测试数据
MySQL分表实现上百万上千万记录分布存储的批量查询设计模式详解
MySQL 百万级分页优化(Mysql千万级快速分页)
mysql千万级数据大表该如何优化?
Mysql limit 优化，百万至千万级快速分页复合索引的引用并应用于轻量级框架

上一篇：Mysql普通索引与唯一索引的选择详析
下一篇：浅析MySQL - MVCC

MySQL制作具有千万条测试数据的测试库的方法

有时候需要制造一些测试的数据，以mysql官方给的测试库为基础，插入十万，百万或者千万条数据。利用一些函数和存储过程来完成。官方给的测试库地址：https://github.com/datacharmer/teMySQL,制作,具有,千,万条,...

阜阳银盛电销卡（银盛电话卡）

本文目录一览：1、银盛pos机的投诉电话?2、银盛支付是正规的吗3、为什么银盛支付po...

机器学习语音识别

2.销售难找，离职率居高不下【机器学习语音识别】除此之外还有一些O2O服务类通知等...

话机世界卡怎么激活开卡

首先关注卡邦官方微信账号：卡邦然后按照以下步骤操作：...

昆山三网电销线路在哪可以办理,电话系统-放心省心

昆山三网电销线路在哪可以办理,电话系统在电销机器人拨打之后，我们通过查看通话记...

2014年外包展望

IDC日前发布了美国以及世界范围内BPO行业发展预测2013-1017，该报告指出在2017年，全球...

贵州电销机器人如何做（贵州电销机器人如何做

本文目录一览：1、如何用智能电销机器人进行电销?2、电话机器人的操作方法，怎么...

400电话是干嘛用的，什么是正规的400电话

400电话是干嘛用的，什么是正规的400电话400电话代理商为你解答。国内移动400是为集团...

400开头的电话在哪里办理，400开头的电话是那里

400开头的电话在哪里办理，400开头的电话是那里400电话代理商为你解答。在运营商办理...

上半年山东省服务外包实现同比翻番增长

大众网济南7月21日讯（记者韦国骞）今天上午，记者在山东省商务厅了解到，1-6月份...

海拉尔销售外包公司电话（海拉尔劳务公司）

今天给各位分享海拉尔销售外包公司电话的知识，其中也会对海拉尔劳务公司进行解释...

进行https证书申请安装和tomcat https证书安装的方法

对于https证书，想必大家已经非常熟悉了，这是一种可以保护网站安全的证书，以http...

无锡专业外呼线路价格,电话销售系统-创新服务

无锡专业外呼线路价格,电话销售系统括任务名称、呼叫号码、话音流程、接收技能组、...

甘肃房产ai电话机器人价格-热门

甘肃房产ai电话机器人价格对于企业来说，电销系统的场景是电话呼出，其本质是呼出...

骚扰电话投诉多工信部约谈迪信通

近日，工信部约谈知名虚拟运营商企业，重拳整治骚扰电话频发现象。连续三个季度骚...

400电话代理利润大吗400电话靠谱代理商

在网上搜索之下，往往也就能发现有很多个400电话的代理商，那么这种代理商也都是一...

MySQL制作具有千万条测试数据的测试库的方法

全 部 栏 目

全部栏目