手把手教你用Python替代Mapinfo更快查找两张表中距离最近的点

一、前言

大家好,我是崔艳飞。工作中有时需要把A表中的经纬度点,从B表中匹配一个最近的点出来,用Mapinfo也可以实现,但处理速度慢,特别是数据量大时根本处理不动,此时用Python就能轻松实现,还能显示处理进度,详细如下。

二、项目目标

用Python实现两张表间最近点的计算。

三、项目准备

软件:PyCharm

需要的库:pandas, xlrd,os

四、项目分析

1)如何选择并读取要处理的Excel文件?

利用os、xlrd,选择要读取处理的Excel文件。

2)如何计算两个经纬度点的距离?

利用pandas库读取两张表的内容,再定义函数计算两个经纬度点的距离。

3)如何循环计算并保存最近一个点的数据?

利用For循环,对两张表的内容进行循环读取,通过If判断保留最近的距离点数据。

4)如何保存结果?

利用to_excel保存,得到最近点的数据。

五、项目实现

1、第一步导入需要的库

1import pandas as pd 2import xlrd 3import os

2、第二步选择并读取要处理的Excel文件

1path="D:/a/" 2 #获取文件夹下所有EXCEL3 bb = path + 'result.xlsx' 4 writer = pd.ExcelWriter(bb,engine='openpyxl') 5 xlsx_names = [x for x in os.listdir(path) if x.endswith(".xlsx")] 6 # 获取第一个EXCEL7 xlsx_names1 = xlsx_names[0] 8 aa = path + xlsx_names1 9 #打开第一个EXCEL 10 first_file_fh=xlrd.open_workbook(aa) 11 # 获取SHEET12 first_file_sheet=first_file_fh.sheets()

3、第三步循环计算并保存最近一个点的数据

1for i in range(h1): 2 w1=df1.loc[i,'纬度'] 3 j1 = df1.loc[i,'经度'] 4 d1 = df1.loc[i, :] 5 d0=10000000000000000000000000.0000 6 print("原小区第%d个。" %(i+1)) 7 test_dict = {'距离': [d0]} 8 d3 = pd.DataFrame(test_dict) 9 10 for l in range(h2): 11 w2=df2.loc[l, '纬度'] 12 j2=df2.loc[l,'经度'] 13 d=haversine(j1, w1, j2, w2) 14 if d<d0: 15 d0=d 16 d2 = df2.loc[l, :] 17 test_dict = {'距离': [d0]} 18 d3 = pd.DataFrame(test_dict) 19 else:continue

4、第四步保存计算后的文件

1resultdata1.to_excel(excel_writer=writer, sheet_name='原小区', encoding="utf-8", index=False) 2 resultdata2.to_excel(excel_writer=writer, sheet_name='最近小区', encoding="utf-8", index=False) 3 resultdata3.to_excel(excel_writer=writer, sheet_name='距离', encoding="utf-8", index=False) 4 writer.save() 5 writer.close()

六、效果展示

1、处理前数据:

2、处理进度显示:

3、处理结果:

七、总结

本文介绍了如何利用Python计算两个经纬度点间的距离,并在两张表间进行最近点计算,这本来是Mapinfo的分内之事,但数据量大时就处理不动了,Python处理速度快,还能对数据进行预处理,正是由于可以自己优化代码,可以无限提高运行速度,比如数据切块处理,有兴趣的同学可以进一步研究下。

最后需要本文项目代码的小伙伴,请在公众号后台回复“经纬度”关键字进行获取,如果在运行过程中有遇到任何问题,请随时留言或者加小编好友,小编看到会帮助大家解决bug噢!

-------------------********************************** End **********-------------**-----********-**********************************

往期精彩文章推荐:

欢迎各位大佬点击链接加入群聊【helloworld开发者社区】:https://jq.qq.com/?_wv=1027&k=mBlk6nzX进群交流IT技术热点。

本文转自 https://mp.weixin.qq.com/s/bTnO13la_4GjiHk1-5bWHQ,如有侵权,请联系删除。

点赞
收藏

评论区

加载中...

相关推荐

MySQL:[Err] 1292 - Incorrect datetime value: ‘0000-00-00 00:00:00‘ for column ‘CREATE_TIME‘ at row 1

文章目录问题用navicat导入数据时,报错:原因这是因为当前的MySQL不支持datetime为0的情况。解决修改sql\mode:sql\mode:SQLMode定义了MySQL应支持的SQL语法、数据校验等,这样可以更容易地在不同的环境中使用MySQL。全局s

Oracle 分组与拼接字符串同时使用

SELECTT.,ROWNUMIDFROM(SELECTT.EMPLID,T.NAME,T.BU,T.REALDEPART,T.FORMATDATE,SUM(T.S0)S0,MAX(UPDATETIME)CREATETIME,LISTAGG(TOCHAR(

MySQL部分从库上面因为大量的临时表tmp_table造成慢查询

背景描述Time:20190124T00:08:14.70572408:00User@Host:@Id:Schema:sentrymetaLast_errno:0Killed:0Query_time:0.315758Lock_

皕杰报表之UUID

​在我们用皕杰报表工具设计填报报表时,如何在新增行里自动增加id呢?能新增整数排序id吗?目前可以在新增行里自动增加id,但只能用uuid函数增加UUID编码,不能新增整数排序id。uuid函数说明:获取一个UUID,可以在填报表中用来创建数据ID语法:uuid()或uuid(sep)参数说明:sep布尔值,生成的uuid中是否包含分隔符'',缺省为

手把手教你用Python实现Excel中的Vlookup功能

一、前言大家好,我是崔艳飞。工作中经常会遇到,需要把两张Excel或Csv数据表通过关键字段进行关联,匹配对应数据的情况,Excel虽有Vlookup函数可以处理,但数据量大时容易计算机无响应,可能出现数据丢失,处理速度较慢是软肋,而Python只需几行代码就能轻松实现,且处理速度快,详细如下。二、项目目标用Python实现两张Excel或Csv表数据关

2020年前端实用代码段,为你的工作保驾护航

有空的时候,自己总结了几个代码段,在开发中也经常使用,谢谢。1、使用解构获取json数据let jsonData  id: 1,status: "OK",data: 'a', 'b';let  id, status, data: number   jsonData;console.log(id, status, number )