Ardışık sıralar arasındaki mesafeyi gruba göre hesapla [kopya]
Sabah öğle akşam
Aşağıdaki tekne verilerine sahibim:
set.seed(123)
df <- data.frame(
fac = as.factor(c("A", "A", "A", "A",
"B", "B", "B",
"C", "C", "C", "C", "C")),
lat = runif(12, min = 45, max = 47),
lon = runif(12, min = -6, max = -5 ))
Verileri faktör değişkenine göre gruplandırıyorum fac
.
library(dplyr)
df_grouped <- df %>%
group_by(fac) %>%
summarise(first_lon = first(lon),
last_lon = last(lon),
first_lat = first(lat),
last_lat = last(lat))
Çokgenler oluşturmak için ilk ve son enlemleri ( lat
) ve boylamları ( lon
) kullanıyorum
Çokgen boyunca mesafeyi tahmin etmek için ilk ve son enlemleri ( lat
) ve boylamları ( lon
) da kullanıyorum.
library(geosphere)
df_grouped %>%
mutate(distance_m = distHaversine(matrix(c(first_lon, first_lat), ncol = 2),
matrix(c(last_lon, last_lat), ncol = 2)))
Bu, teknenin poligon içinde mümkün olan en uzun mesafe boyunca düz bir çizgide gittiğini varsaysa da.
Bu her zaman doğru değildir, bazen biraz sallanır:
Yapmak istediğim şey, bir grupla her sıra arasındaki mesafeyi hesaplayarak teknenin kat ettiği gerçek mesafedir.
Veya başka bir deyişle:
Örneğin fac == "C"
, tekne , gruplama içindeki her bir veri noktası arasındaki mesafeden hesaplanan x
, kat edilmiş metreye sahip olacaktır x
.
Yanıtlar
Deneyin :
df %>% group_by(fac) %>%
mutate(lat_prev = lag(lat,1), lon_prev = lag(lon,1) ) %>%
mutate(dist = distHaversine(matrix(c(lon_prev, lat_prev), ncol = 2),
matrix(c(lon, lat), ncol = 2))) %>%
summarize(dist = sum(dist,na.rm=T))
# A tibble: 3 x 2
fac dist
<fct> <dbl>
1 A 93708.
2 B 219742.
3 C 347578.
Henrik'in önerdiği gibi çok daha iyi:
df %>% group_by(fac) %>%
summarize(dist = distHaversine(cbind(lon, lat))) %>%
summarize(dist = sum(dist,na.rm=T))
dplyr::lag
Bir önceki satırdan değeri çeker. Daha sonra, mesafe hesaplamaları yapmak için bu değerleri ikinci bir mutasyon adımına aktarabilirsiniz (bunlar muhtemelen istediğiniz özel hesaplamalar değildir, ancak genel tekniği gösterir):
library(dplyr)
df %>%
group_by(fac) %>%
mutate(lag_lat = lag(lat), lag_lon = lag(lon)) %>%
mutate(dist_lat = lat - lag_lat, dist_lon = lon - lag_lon)
lag
Satırların sırasına duyarlı olduğunu unutmayın . Zamansal sırada olduklarından emin olun.