如何将CSV文件数据导入PostgreSQL表

如何编写从CSV文件导入数据并填充表的存储过程?

当前回答

如果你没有权限使用COPY(在db服务器上工作)，你可以使用\ COPY(在db客户端上工作)。以Bozhidar Batsov为例:

创建你的表:

CREATE TABLE zip_codes
(ZIP char(5), LATITUDE double precision, LONGITUDE double precision,
CITY varchar, STATE char(2), COUNTY varchar, ZIP_CLASS varchar);

将数据从CSV文件复制到表中:

\copy zip_codes FROM '/path/to/csv/ZIP_CODES.txt' DELIMITER ',' CSV

注意那个\拷贝…必须用一行写，不带下划线;最后!

你也可以指定要读取的列:

\copy zip_codes(ZIP,CITY,STATE) FROM '/path/to/csv/ZIP_CODES.txt' DELIMITER ',' CSV

参见COPY的文档:

不要将COPY与psql指令\ COPY混淆。\copy调用copy FROM STDIN或copy TO STDOUT，然后在psql客户端可访问的文件中获取/存储数据。因此，当使用\copy时，文件的可访问性和访问权限取决于客户端而不是服务器。

并注意:

对于标识列，COPY FROM命令将始终写入输入数据中提供的列值，就像INSERT选项覆盖SYSTEM VALUE一样。

2015-06-20 07:26:33

其他回答

您还可以使用pgfutter，或者更好的pgcsv。

这些工具根据CSV标题为您创建表列。

pgfutter有很多bug，我推荐pgcsv。

下面是如何使用pgcsv:

sudo pip install pgcsv
pgcsv --db 'postgresql://localhost/postgres?user=postgres&password=...' my_table my_file.csv

2019-11-10 21:26:34

你有3个选项来导入CSV文件到PostgreSQL: 首先，通过命令行使用COPY命令。

其次，使用pgAdmin工具的导入/导出。

第三，使用像Skyvia这样的云解决方案，从在线位置(如FTP源)或云存储(如谷歌驱动器)获取CSV文件。

你可以从这里查看解释所有这些的文章。

2022-01-02 16:03:39

您还可以使用pgAdmin，它提供了一个GUI来执行导入。这在这个SO线程中显示。使用pgAdmin的优点是它也适用于远程数据库。

不过，与前面的解决方案非常相似，您需要在数据库中已经有表。每个人都有自己的解决方案，但我通常在Excel中打开CSV文件，复制标题，在不同的工作表上粘贴特殊的换位，在下一列上放置相应的数据类型，然后将其复制并粘贴到文本编辑器中，并使用适当的SQL表创建查询，如下所示:

CREATE TABLE my_table (
    /* Paste data from Excel here for example ... */
    col_1 bigint,
    col_2 bigint,
    /* ... */
    col_n bigint
)

2014-11-03 19:49:20

如果文件不是很大，可以使用Pandas库。

在Pandas数据框架上使用iter时要小心。我这样做是为了证明这种可能性。当从数据帧复制到SQL表时，也可以考虑使用pd.Dataframe.to_sql()函数。

假设你已经创建了你想要的表，你可以:

import psycopg2
import pandas as pd
data=pd.read_csv(r'path\to\file.csv', delimiter=' ')

#prepare your data and keep only relevant columns

data.drop(['col2', 'col4','col5'], axis=1, inplace=True)
data.dropna(inplace=True)
print(data.iloc[:3])


conn=psycopg2.connect("dbname=db user=postgres password=password")
cur=conn.cursor()

for index,row in data.iterrows():
      cur.execute('''insert into table (col1,col3,col6)
    VALUES (%s,%s,%s)''', (row['col1'], row['col3'], row['col6'])

cur.close()
conn.commit()

conn.close()
print('\n db connection closed.')

2021-02-11 15:23:38

COPY table_name FROM 'path/to/data.csv' DELIMITER ',' CSV HEADER;

2016-11-16 19:06:49

如何将CSV文件数据导入PostgreSQL表

推荐文章

最新文章

标签