网站首页 > 技术文章 正文
Oracle 和 MySQL 的 JDBC 到底有多慢?
经常听人说,数据库的IO性能不佳,但说归说,并没有感性认识。我们现在就来实际测试一下,常用的Oracle和MySQL的JDBC读取性能如何。
之所以测试JDBC,是因为大部分应用是JAVA写的,也就只能用JDBC来访问数据。这里仅测试用JDBC读出数据,并产生成Java的记录对象(毕竟到了这一步才能在应用中使用),不作任何计算。
1. 数据来源
使用TPCH生成的数据,选用其中的customer表来做测试,数据记录为3000万行,8个字段。它生成的原始文本文件名为customer.tbl,文件大小为4.9G。利用数据库提供的数据导入工具将此文件数据导入到Oracle和MySQL的数据表中。
2. 测试环境
在一台Intel服务器上完成测试,2个Intel2670 CPU,主频2.6G,共16核,内存64G。数据库表数据及文本文件均存储在同一块SSD硬盘上。
所有测试均在服务器本机上完成,没有消耗网络传输时间。
3. 数据库读数测试
通过Oracle提供的JDBC接口,用SQL语句执行数据读取。
Java写起来麻烦,用SPL脚本执行测试:
MySQL的测试代码类似,不再赘述。
测试结果(时间单位:秒)
第二次可能由于操作系统有了硬盘缓存,所以更快。因为我们主要是为了测试JDBC的读取时间,所以就以第二次为准,减少数据库本身从硬盘读数的影响。每秒读出行数也是按第二次时间来计算的,也就是说,Oracle每秒能读出10万行多数据,MySQL大概接近8万行。当然这个值和表的字段数及类型都有关(customer表有8个字段),只是一种参考。
4. 文本文件对比
只从上面的数据量还没有太多感性认识,我们再读一下文本文件来对比。办法是一样的,从文件中读出数据,并解析出记录,不作任何计算。
编写如下SPL脚本执行测试:
测试结果是42秒!
这意味着,读取文本要比读取Oracle快281/42=6.69倍,比MySQL要快381/42=9.07倍!
我们知道,文本解析是个非常麻烦的事情,但即使这样,从文本文件读取数据还是远远快于从数据库中读数。Oracle和MySQL的IO实在是太慢了!
5. 二进制方式
我们进一步再看使用二进制方式的存储格式的读取性能,并和文本比对。
为了对比明显,这次换一个更大的表,用TPCH中的orders表,有3亿行数据,9个字段。
文本读取的代码和上面类似,读取时间测试为438秒。
然后,我们将这个文本文件转换成SPL组表,再写代码测试:
测试结果是164秒,大概仅仅是文本读取的三分之一。
这是情理之中的事情,因为二进制数据不再需要解析,可以直接产生对象,计算量少了很多,因而要更快。
需要说明的是,组表文件虽然采用列存格式,但在这里读出了所有列,并没有比文本少取任何内容,没有占列存的便宜。事实上,因为读所有列,使用列存还会吃点亏,如果采用SPL集文件(一种行存格式)还会更快。
6. 并行提速
从文件中取数还很容易实现并行,文本和组表都容易写出并行程序。还是用上面的orders表为例来测试,使用4线程取数。
文本取数代码:
组表取数代码:
用SPL很容易实现数据分段和并行计算。
测试结果为:
文本 119秒
组表 43秒
与串行相比,接近了线性提升,将CPU的多核充分利用起来了。
数据库中的数据则不容易简单地实施分段并行,需要用WHERE条件去拼,结果很难说清到底是并行不力还是WHERE执行损失太多,测试结果的参考意义就打折扣了,这里就不再做了。
7. 结论
数据库(Oracle和MySQL)的JDBC性能非常非常差!比文本文件还要差5倍以上。而采用二进制数据时,会比文本再提高3倍的读取性能。也就是说,合理格式的二进制文件会比数据库有15倍以上的优势。再考虑到并行因素,比数据库快出几十上百倍也是完全可能的。
在关注性能且数据量较大时,千万不要把数据读出数据库计算!
如果实在需要读出后再计算(有时SQL很难写出复杂的过程计算),就不要再用数据库存储了(大数据都是历史,基本也不再改了,可以事先读出),用文本都比数据库强,用二进制当然更好(推荐使用SPL组表,哈哈)。切不要把时间浪费在读数这种非计算任务上了。
- 上一篇: 大数据:百万级数据处理技巧篇(二)
- 下一篇: 自主创新理论的新一代国产数据库,性能远超Oracle
猜你喜欢
- 2024-11-06 从 TPCH 测试学习性能优化技巧之 Q6
- 2024-11-06 Oracle_57、自定义函数经典案例2 Oracle_57
- 2024-11-06 自主创新理论的新一代国产数据库,性能远超Oracle
- 2024-11-06 大数据:百万级数据处理技巧篇(二)
- 2024-11-06 4月数据库流行度排行榜 MySQL能否追上Oracle
- 2024-11-06 大数据与关系型数据库的关系 大数据 关系型数据库
- 2024-11-06 一个简单的例子,告诉你数据库和大数据的关系
- 2024-11-06 大数据 oracle 大数据技术
你 发表评论:
欢迎- 617℃几个Oracle空值处理函数 oracle处理null值的函数
- 611℃Oracle分析函数之Lag和Lead()使用
- 599℃0497-如何将Kerberos的CDH6.1从Oracle JDK 1.8迁移至OpenJDK 1.8
- 596℃Oracle数据库的单、多行函数 oracle执行多个sql语句
- 591℃Oracle 12c PDB迁移(一) oracle迁移到oceanbase
- 583℃【数据统计分析】详解Oracle分组函数之CUBE
- 573℃最佳实践 | 提效 47 倍,制造业生产 Oracle 迁移替换
- 560℃Oracle有哪些常见的函数? oracle中常用的函数
- 最近发表
- 标签列表
-
- 前端设计模式 (75)
- 前端性能优化 (51)
- 前端模板 (66)
- 前端跨域 (52)
- 前端缓存 (63)
- 前端aes加密 (58)
- 前端脚手架 (56)
- 前端md5加密 (54)
- 前端路由 (61)
- 前端数组 (73)
- 前端js面试题 (50)
- 前端定时器 (59)
- 前端获取当前时间 (50)
- Oracle RAC (76)
- oracle恢复 (77)
- oracle 删除表 (52)
- oracle 用户名 (80)
- oracle 工具 (55)
- oracle 内存 (55)
- oracle 导出表 (62)
- oracle约束 (54)
- oracle 中文 (51)
- oracle链接 (54)
- oracle的函数 (58)
- 前端调试 (52)
本文暂时没有评论,来添加一个吧(●'◡'●)