文章詳情頁

python - 請問如何可以優化提升pandas的read_sql的速度呢？

瀏覽：227日期：2022-06-27 16:28:52

問題描述

小弟的需求需要在多個數據庫之間查詢數據并關聯，所以小弟選擇了使用pandas，通過read_sql讀取數據至dataframe加工后直接生成目標數據。但是目前遭遇了一個問題：read_sql的速度非常慢，例如，在oracle庫中讀取37W數據量（22個字段）的表至dataframe耗時需要4分半。代碼如下：

import pandas as pdimport sqlalchemy as sqlora_engine=sql.create_engine(’oracle://test01:test01@test01db’)ora_df1=pd.read_sql(’select * from target_table1’,ora_engine)

耗時4分32秒

甚至小弟使用另外一個簡單粗暴的方法都會比read_sql快很多。代碼如下：

import pandas as pdimport sqlalchemy as sqlora_engine=sql.create_engine(’oracle://test01:test01@test01db’)conn=ora_engine.raw_connection()cursor=conn.cursor()queryset=cursor.execute(’select * from target_table1’)columns=[for i[0] in queryset.description]df_data=queryset.fetchall()ora_df1=pd.DataFrame()ora_df1.columns=columnsora_df1.append(df_data)

耗時1分31秒

這里想請教一下各位大大，有什么方法可以優化提升pandas的read_sql的速度，非常感謝大家~

問題解答

回答1：

試試read_sql_tablehttp://pandas.pydata.org/pandas-docs/stable/generated/pandas.read_sql_table.html#pandas.read_sql_table

Python 編程

上一條：python - 使用pyhive 能夠執行source 語句嗎下一條：Python從URL中提取域名

相關文章：

1. node.js - mongodb查找子對象的名稱為某個值的對象的方法2. docker 17.03 怎么配置 registry mirror ?3. docker 下面創建的IMAGE 他們的 ID 一樣？這個是怎么回事？？？？4. 前端 - @media query 使用出現的問題？5. html5 - datatables 加載不出來數據。6. 運行python程序時出現“應用程序發生異常”的內存錯誤？7. 測試自動化html元素選擇器元素ID或DataAttribute [關閉]8. javascript - QQ第三方登錄的問題9. 利用IPMI遠程安裝centos報錯！10. spring-mvc - spring-session-redis HttpSessionListener失效

排行榜

					
					html5 - datatables 加載不出來數據。
運行python程序時出現“應用程序發生異常”的內存錯誤？
javascript - QQ第三方登錄的問題
node.js - mongodb查找子對象的名稱為某個值的對象的方法
前端 - @media query 使用出現的問題？
測試自動化html元素選擇器元素ID或DataAttribute [關閉]
docker 17.03 怎么配置 registry mirror ?
docker  下面創建的IMAGE 他們的 ID 一樣？這個是怎么回事？？？？
java - Spring boot 讀取 放在 jar 包外的，log4j 配置文件，系統有創建日志文件，不寫入日志信息。
spring-mvc - spring-session-redis HttpSessionListener失效
javascript - 在 model里定義的 引用表模型時，model為undefined。
				

熱門標簽

午夜剧场伦理_日本一道高清_国产又黄又硬_91黄色网战_女同久久另类69精品国产_妹妹的朋友在线

python - 請問如何可以優化提升pandas的read_sql的速度呢？