Python最近邻坐标

nplen = 1000000 # WGS84 lat/long point = [51.349,-0.19] # This contains WGS84 lat/long points = np.ndarray.tolist(np.column_stack( [np.round(np.random.randn(nplen)+51,5), np.round(np.random.randn(nplen),5)]))

def proj_list(points, inproj = Proj(init='epsg:4326'), outproj = Proj(init='epsg:27700')): """ Projected geo coordinates""" return [list(transform(inproj,outproj,x,y)) for y,x in points] proj_points = proj_list(points) proj_point = proj_list([point])[0]

from math import * def haversine(origin, destination): """ Find distance between a pair of lat/lng coordinates """ lat1, lon1, lat2, lon2 = map(radians, [origin[0],origin[1],destination[0],destination[1]]) dlon = lon2 - lon1 dlat = lat2 - lat1 a = sin(dlat / 2) ** 2 + cos(lat1) * cos(lat2) * sin(dlon / 2) ** 2 c = 2 * asin(sqrt(a)) r = 6371000 # Metres return (c * r) def closest_math_unproj(points,point): """ Haversine on unprojected """ return (min((haversine(point,pt),pt[0],pt[1]) for pt in points)) def closest_math_proj(points,point): """ Simple angle since projected""" return (min((hypot(x2-point[1],y2-point[0]),y2,x2) for y2,x2 in points))

1条回答

网友

1楼 · 发布于 2024-10-01 17:35:31

问题1

k-d树明显效率低下的原因很简单：您同时测量k-d树的构造和查询。这不是您应该或者应该如何使用k-d树：您应该只构造一次。如果只测量查询，所花费的时间将减少到几十毫秒（而使用暴力方法则为几秒钟）。在

问题2

这将取决于所使用的实际数据和所使用的投影的空间分布。基于k-d树的实现在平衡构建的树方面的效率，可能会有细微的差别。如果只查询单个点，那么结果将是确定性的，并且无论如何都不受点分布的影响。在

对于您使用的示例数据（具有强烈的中心对称性）和地图投影（Transverese Mercator），差异应该可以忽略不计。在

问题3

从技术上讲，你的问题的答案是微不足道的：使用哈弗辛公式进行地理距离测量既更准确，也更慢。准确性和速度之间的权衡是否得到保证很大程度上取决于您的用例和数据的空间分布（显然，主要取决于空间范围）。在

如果点的空间范围在较小的区域一侧，那么使用适当的投影和简单的欧几里德距离度量可能对您的用例足够精确，并且比使用Haversine公式更快。在

问题1

问题2

问题3

相关问题更多 >

编程相关推荐

热门问题

热门文章