百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术教程 > 正文

Oracle 的 JDBC 写入有多慢?(jdbc:oracle:thin)

mhr18 2024-10-13 03:01 18 浏览 0 评论

在《Oracle 和 MySQL 的 JDBC 到底有多慢》中我们测试过 Oracle的JDBC读出性能,现在再来测试一下写入情况。

1.数据来源

使用TPCH生成的数据,选用其中的part表来做测试,数据记录为2000万行,9个字段。它生成的原始文本文件名为part.tbl,文件大小为2.4G。

测试时先将文本读入内存形成内存对象,然后再写入,文本读入的时间不计在内。

2.测试环境

CPU 2个Intel3014 ,主频1.7G,共12核,内存64G。

所有测试均在本机上完成,没有消耗网络传输时间。

3.JDBC写入测试

通过Oracle提供的JDBC接口,用SQL语句执行数据写入。

Java写起来麻烦,用SPL脚本执行测试:

测试结果(时间单位:秒)

2000万行记录用了一个小时写入。

每秒写入行数和表的字段数及类型都有关(part表有9个字段),只是一种参考。

4.文本文件对比

我们再看把同样规模的数据写成文本文件需要多长时间。

编写如下SPL脚本执行测试:

测试结果是72秒!

这意味着,存成文本文件要比用JDBC写入Oracle快3631/72=50.4倍!

通常,我们把数据写入数据库是为了做进一步计算的,而文本文件却没有计算能力,即使写入速度更快一般也没什么实际意义。不过,在集算器的支持下,可以让结构化文本也拥有和SQL类似的计算能力(可参考【SPL 结构化文本计算】)。这样,把数据写成文本文件,既有较快的写入速度,也不会丧失计算能力。在需要后续计算的场合时,性能会大大优于写入数据库。

5.sqlldr导入数据

Oracle提供了从命令行导入数据的程序工具sqlldr,可以将文本文件数据直接导入到数据表里,会比使用SQL的INSERT语句要快得多。上面我们测试了生成文本文件的速度还不错,如果先将要写入的数据(与本例不同,实际应用中可能是从各种数据源中计算后得到)写入到一个临时txt文件中,然后用sqlldr将其导入,即使多了一步生成临时文件,整个过程仍很可能比用INSERT要更快。

sqlldr需要一个控制文件来指定数据如何导入,编写part.ctl文件如下:

LOAD DATA APPEND INTO TABLE PART

( P_PARTKEY terminated by '|',

P_NAME terminated by '|',

P_MFGR terminated by '|',

P_BRAND terminated by '|',

P_TYPE terminated by '|',

P_SIZE terminated by '|',

P_CONTAINER terminated by '|',

P_RETAILPRICE terminated by '|',

P_COMMENT terminated by '|')

编写如下SPL脚本执行测试:

测试结果是154秒!

这意味着,存成临时文本文件再用sqlldr导入要比直接JDBC写入快3631/154=23.6倍!

如果有大量数据需要写入数据库,那么建议采用先生成临时文件的办法。

6.生成SPL集文件对比

我们知道,文本的解析较为复杂,在后续计算时性能不是很好,而且数据类型不严格,还有可能出错。所以,如果能生成二进制文件的话(有了集算器就可以让这些文件都拥有类似SQL的计算能力),对于后续计算的就会有较大的优势。

我们再看将数据存为SPL集文件的性能。

编写生成SPL集文件的脚本如下:

测试结果是76秒,和生成文本的速度差不多,但之后的计算性能将会大大优于文本文件,也不会有数据类型不严格的问题。

我们再简单测试一下集文件和文本文件的读入性能。

文本文件读入:

集文件读入:

测试结果文件文件读入是42秒,集文件读入是20秒!这可以确认使用二进制数据做后续计算的性能优势要大得多。

7.结论

数据库的JDBC写入性能非常非常差!

如果要写入的数据量不大(比如在几十万条以内),那么还可以忍受。若是数据量比较大,首先我们要分析一下数据是否必须要写入数据库?如果入库是为了进一步计算,那么可以不用入库了,存成文本文件都可以,用二进制文件当然更好(推荐使用SPL集文件,哈哈)。

如果有大量的数据必须要写入数据库,那么由前面的测试可知,推荐采用先将数据存为临时文本文件,再用数据库的导入数据工具将其导入,速度可以比JDBC快很多倍!

本文是以Oracle做测试,其它数据库大致也是类似,读者可以自行研究。

相关推荐

一文读懂Prometheus架构监控(prometheus监控哪些指标)

介绍Prometheus是一个系统监控和警报工具包。它是用Go编写的,由Soundcloud构建,并于2016年作为继Kubernetes之后的第二个托管项目加入云原生计算基金会(C...

Spring Boot 3.x 新特性详解:从基础到高级实战

1.SpringBoot3.x简介与核心特性1.1SpringBoot3.x新特性概览SpringBoot3.x是建立在SpringFramework6.0基础上的重大版...

「技术分享」猪八戒基于Quartz分布式调度平台实践

点击原文:【技术分享】猪八戒基于Quartz分布式调度平台实践点击关注“八戒技术团队”,阅读更多技术干货1.背景介绍1.1业务场景调度任务是我们日常开发中非常经典的一个场景,我们时常会需要用到一些不...

14. 常用框架与工具(使用的框架)

本章深入解析Go生态中的核心开发框架与工具链,结合性能调优与工程化实践,提供高效开发方案。14.1Web框架(Gin,Echo)14.1.1Gin高性能实践//中间件链优化router:=...

SpringBoot整合MyBatis-Plus:从入门到精通

一、MyBatis-Plus基础介绍1.1MyBatis-Plus核心概念MyBatis-Plus(简称MP)是一个MyBatis的增强工具,在MyBatis的基础上只做增强不做改变,为简化开发、提...

Seata源码—5.全局事务的创建与返回处理

大纲1.Seata开启分布式事务的流程总结2.Seata生成全局事务ID的雪花算法源码3.生成xid以及对全局事务会话进行持久化的源码4.全局事务会话数据持久化的实现源码5.SeataServer创...

Java开发200+个学习知识路线-史上最全(框架篇)

1.Spring框架深入SpringIOC容器:BeanFactory与ApplicationContextBean生命周期:实例化、属性填充、初始化、销毁依赖注入方式:构造器注入、Setter注...

OpenResty 入门指南:从基础到动态路由实战

一、引言1.1OpenResty简介OpenResty是一款基于Nginx的高性能Web平台,通过集成Lua脚本和丰富的模块,将Nginx从静态反向代理转变为可动态编程的应用平台...

你还在为 Spring Boot3 分布式锁实现发愁?一文教你轻松搞定!

作为互联网大厂后端开发人员,在项目开发过程中,你有没有遇到过这样的问题:多个服务实例同时访问共享资源,导致数据不一致、业务逻辑混乱?没错,这就是分布式环境下常见的并发问题,而分布式锁就是解决这类问题的...

近2万字详解JAVA NIO2文件操作,过瘾

原创:小姐姐味道(微信公众号ID:xjjdog),欢迎分享,转载请保留出处。从classpath中读取过文件的人,都知道需要写一些读取流的方法,很是繁琐。最近使用IDEA在打出.这个符号的时候,一行代...

学习MVC之租房网站(十二)-缓存和静态页面

在上一篇<学习MVC之租房网站(十一)-定时任务和云存储>学习了Quartz的使用、发邮件,并将通过UEditor上传的图片保存到云存储。在项目的最后,再学习优化网站性能的一些技术:缓存和...

Linux系统下运行c++程序(linux怎么运行c++文件)

引言为什么要在Linux下写程序?需要更多关于Linux下c++开发的资料请后台私信【架构】获取分享资料包括:C/C++,Linux,Nginx,ZeroMQ,MySQL,Redis,fastdf...

2022正确的java学习顺序(文末送java福利)

对于刚学习java的人来说,可能最大的问题是不知道学习方向,每天学了什么第二天就忘了,而课堂的讲解也是很片面的。今天我结合我的学习路线为大家讲解下最基础的学习路线,真心希望能帮到迷茫的小伙伴。(有很多...

一个 3 年 Java 程序员 5 家大厂的面试总结(已拿Offer)

前言15年毕业到现在也近三年了,最近面试了阿里集团(菜鸟网络,蚂蚁金服),网易,滴滴,点我达,最终收到点我达,网易offer,蚂蚁金服二面挂掉,菜鸟网络一个月了还在流程中...最终有幸去了网易。但是要...

多商户商城系统开发全流程解析(多商户商城源码免费下载)

在数字化商业浪潮中,多商户商城系统成为众多企业拓展电商业务的关键选择。这类系统允许众多商家在同一平台销售商品,不仅丰富了商品种类,还为消费者带来更多样的购物体验。不过,开发一个多商户商城系统是个复杂的...

取消回复欢迎 发表评论: