GPS轨迹数据集免费下载资源整理_大西洋飓风数据下载-程序员宅基地

技术标签: bigData  大数据学习  gps  

本文主要是整理了GPS轨迹数据集免费资源库,从这些库中能够免费下载到GPS数据,同时还整理出了这些数据的格式,数据集的简单描述等等。如果你发现更好的相关数据资源,欢迎共享

注意: 部分数据集在“翻-墙”之后才可以下载,比如微软的T-drive数据集,它被保存在OneDrive上面。各位自备“梯-子”吧

1. GeoLife GPS Trajectories

该GPS轨迹数据集出自微软研究GeoLift项目。从2007年四月到2012年八月收集了182个用户的轨迹数据。这些数据包含了一系列以时间为序的点,每一个点包含经纬度、海拔等信息。包含了17621个轨迹,总距离120多万公里,总时间48000多小时。这些数据不仅仅记录了用户在家和在工作地点的位置轨迹,还记录了大范围的户外活动轨迹,比如购物、旅游、远足、骑自行车。

这个数据集可以用来进行用户活动相似度估算,移动模型挖掘,用户活动推荐,基于位置的社交网络,位置隐私,位置推荐。

时间:2007年4月~2012年8月
数据大小:大概300M.
下载地址:https://www.microsoft.com/en-us/download/details.aspx?id=52367
数据格式:

一个文件夹存储一个用户的GPS日志,这些日志文件都被转换成了plt格式。为了避免时间区间问题,统一使用了GMT格式的时间表示。其他具体格式为:

Line 1…6 are useless in this dataset, andcan be ignored. Points are described in following lines, one for each line.
Field 1: Latitude in decimal degrees.
Field 2: Longitude in decimal degrees.
Field 3: All set to 0 for this dataset.
Field 4: Altitude in feet (-777 if notvalid).
Field 5: Date - number of days (withfractional part) that have passed since 12/30/1899.
Field 6: Date as a string.
Field 7: Time as a string.
Note that field 5 and field 6&7represent the same date/time in this dataset. You may use either of them.

Example:
39.906631,116.385564,0,492,40097.5864583333,2009-10-11,14:04:30
39.906554,116.385625,0,492,40097.5865162037,2009-10-11,14:04:35

交通方式数据集格式:

可能的交通方式有:walk,bike, bus, car, subway, train, airplane, boat, run and motorcycle,再次强调,虽然大多数数据是在中国产生的,但是,还是把时间或者日期都统一以GMT的时间形式表示。

例如:

Start Time End Time Transportation Mode

2008/04/02 11:24:21 2008/04/02 11:50:45bus

具体说明在下载的文件压缩包中!

  • 使用到该数据的论文有:

Q. Li, Y. Zheng, X. Xie, Y. Chen, W. Liu, and M. Ma. 2008.Mining user similarity based on location history. In Proceedings of the 16thAnnual ACM International Conference on Advances in Geographic InformationSystems. ACM, 34.

Z. Chen, H. T. Shen, X. Zhou, Y. Zheng, and X. Xie. 2010.Searching trajectories by locations—An efficient study. In Proceedings of the29th ACM SIGMOD International Conference on Management of Data. ACM,255–266.

[1] Yu Zheng, Lizhu Zhang, Xing Xie, Wei-Ying Ma. Mininginteresting locations and travel sequences from GPS trajectories. InProceedings of International conference on World Wild Web (WWW 2009), MadridSpain. ACM Press: 791-800.

[2] Yu Zheng, Quannan Li, Yukun Chen, Xing Xie, Wei-Ying Ma.Understanding Mobility Based on GPS Data. In Proceedings of ACM conference onUbiquitous Computing (UbiComp 2008), Seoul, Korea. ACM Press: 312-321.

[3] Yu Zheng, Xing Xie, Wei-Ying Ma, GeoLife: ACollaborative Social Networking Service among User, location and trajectory.Invited paper, in IEEE Data Engineering Bulletin. 33, 2, 2010, pp. 32-40.

2.T-Drive Taxi Trajectories

这个数据来自微软T-Drive项目,包含在2008年北京一万多俩出租车一周的轨迹数据。这个数据集包含了1500万个坐标点,轨迹的总距离达到900多万公里。

  • 时间:2008年

  •    数据大小:80M左右。
    
  •    数据集下载地址:
    

https://www.microsoft.com/en-us/research/publication/t-drive-trajectory-data-sample/

  • 数据详细说明:

https://www.microsoft.com/en-us/research/wp-content/uploads/2016/02/User_guide_T-drive.pdf

另外为各位备份到百度云下面了: https://pan.baidu.com/s/1mTxei4K8hHVGREhwwKl85g

  • 数据格式:

Here is a piece ofsample in a file:

1,2008-02-0215:36:08,116.51172,39.92123
1,2008-02-0215:46:08,116.51135,39.93883
1,2008-02-0215:46:08,116.51135,39.93883
1,2008-02-0215:56:08,116.51627,39.91034
1,2008-02-0216:06:08,116.47186,39.91248
1,2008-02-0216:16:08,116.47217,39.92498
1,2008-02-02 16:26:08,116.47179,39.90718
1,2008-02-0216:36:08,116.45617,39.90531
1,2008-02-0217:00:24,116.47191,39.90577
1,2008-02-0217:10:24,116.50661,39.9145
1,2008-02-0220:30:34,116.49625,39.9146

每一个字段的所代表的意思是:

taxi id, date time,longitude, latitude

  • 使用到该数据集的论文有:

J. Yuan, Y. Zheng, and X. Xie. 2012. Discovering regions ofdifferent functions in a city using human mobility and POIs. In Proceedings ofthe 18th ACM SIGKDD International Conference on Knowledge Discovery and DataMining. ACM, 186–194.

J. Yuan, Y. Zheng, C. Zhang, W. Xie, X. Xie, G. Sun, and Y.Huang. 2010a. T-Drive: Driving directions based on taxi trajectories. InProceedings of the 18th Annual ACM International Conference on Advances inGeographic Information Systems. ACM, 99–108.

J. Yuan, Y. Zheng, X. Xie, and G. Sun. 2011a. Driving withknowledge from the physical world. In Proceedings of the 17th ACM SIGKDDInternational Conference on Knowledge Discovery and Data Mining. ACM, 316–324.

J. Yuan, Y. Zheng, X. Xie, and G. Sun. 2013a. T-Drive:Enhancing driving directions with taxi drivers’

intelligence. IEEE Transaction on Knowledge and DataEngineering 25, 1 (2013), 220–232.

N. J. Yuan, Y. Zheng, L. Zhang, and X. Xie. 2013b. T-Finder:A recommender system for finding passengers and vacant taxis. IEEE Transactionon Knowledge and Data Engineering 25, 10 (2013), 2390–2403.

N. J. Yuan, Y. Zheng, X. Xie, Y. Wang, K. Zheng, and H.Xiong. 2015. Discovering urban functional zones using latent activitytrajectories. IEEE Transactions on Knowledge and Data Engineering 27, 3 (2015),1041–4347.

S. Ma, Y. Zheng, and O. Wolfson. 2013. T-Share: Alarge-scale dynamic taxi ridesharing service. In Proceedings of the 29th IEEEInternational Conference on Data Engineering. IEEE, 410–421.

S. Ma, Y. Zheng, and O. Wolfson. 2015. Real-time city-scaletaxi ridesharing. IEEE Transactions on Knowledge and Data Engineering 99.DOI:http://doi.ieeecomputersociety.org/10.1109/TKDE.2014.2334313

Jing Yuan, Yu Zheng, Xing Xie, and Guangzhong Sun. Drivingwith knowledge from the physical world. In The 17th ACM SIGKDD internationalconference on Knowledge Discovery and Data mining, KDD’11, New York, NY, USA,2011. ACM.

Jing Yuan, Yu Zheng, Chengyang Zhang, Wenlei Xie, Xing Xie, Guangzhong Sun, and
Yan Huang. T-drive: driving directions based on taxi trajectories. In
Proceedings of the 18th SIGSPATIAL International Conference on Advances in
Geographic Information Systems, GIS ’10, pages 99-108, New York, NY, USA,2010.
ACM.

3. GPS Trajectories with transportationmode labels

这个数据集是微软亚洲研究院Geolift项目用到的GPS轨迹数据集的一部分。这个数据集代表按时间顺序排序的点集,每一个点所包含的信息有经纬度、高度、速度和当前朝向等等。这些轨迹数据是由不同的GPS设备收集的,这些设备的数据收集频率是不一样的。95%的轨迹是密集的,比如每2~5秒或者每5~10米一个点。

轨迹数据文件被转换成了.plt格式,每一个轨迹还有一个单独文件存储的交通方式标签文件,比如开车、坐公交车、骑自行车、步行。

  • 时间:2008年
  • 数据集大小:大概80M。
  • 下载地址:

https://www.microsoft.com/en-us/research/publication/gps-trajectories-with-transportation-mode-labels/

  • 数据格式:

交通方式数据格式:

Date    Start Time       End Time        Transportationmodes
2008/3/1          11:07:00          11:40:00          walk
2008/3/1          11:44:00          12:07:00          bus
2008/3/1          12:07:00          13:30:00          walk
2008/3/1          13:30:00          13:55:00          car
2008/3/1          13:55:00          14:16:00          walk

Plt格式文件数据的格式:

39.977685,116.3276249,1,0,39539.1428935185,2008/04/01,03:25:46
39.9777233,116.3276216,0,0,39539.1429050926,2008/04/01,03:25:47
39.9778499,116.3276266,0,0,39539.1429398148,2008/04/01,03:25:50
39.9779866,116.3276249,0,0,39539.142974537,2008/04/01,03:25:53
39.97812,116.3276133,0,0,39539.1430092593,2008/04/01,03:25:56
第一个字段:纬度(十进制)
第二个字段:纬度(十进制)
第三个字段:0表示正常,1表示在轨迹中断
第四个字段:海拔高度(英尺),-777表示无效
第五个字段:日期—注意下面的日期格式,如果是空白的,就会使用一个预设的日期。
第六个字段:日期字符串
第七个字段:时间字符串

需要注意的是:
这里写图片描述

具体请查看官方说明:

https://www.microsoft.com/en-us/research/wp-content/uploads/2016/02/User20Guide-with20labels.pdf

  • 使用到该数据集的论文:

Y. Zheng, Q. Li, Y. Chen, and X. Xie. 2008a. Understandingmobility based on GPS data. In Proceedings of the 11th International Conferenceon Ubiquitous Computing. ACM, 312–321.

Y. Zheng, L. Liu, L. Wang, and X. Xie. 2008b. Learningtransportation mode from raw GPS data for geographic application on the Web. InProceedings of the 17th International Conference on World Wide Web.ACM,247–256.

[1] Yu Zheng, Like Liu, Longhao Wang, Xing Xie. LearningTransportation Modes from Raw GPS Data for Geographic Application on the Web,In Proceedings of International conference on World Wild Web (WWW 2008), Beijing,China. ACM Press: 247-256

[2] Yu Zheng, Quannan Li, Yukun Chen, Xing Xie. Understanding Mobility Based on
GPS Data. In Proceedings of ACM conference on Ubiquitous Computing (UbiComp
2008), Seoul, Korea. ACM Press: 312–321.

[3] Yu Zheng, Yukun Chen, Quannan Li, Xing Xie, Wei-Ying Ma.Understanding transportation modes based on GPS data for Web applications. ACMTransaction on the Web. Volume 4, Issue 1, January, 2010. pp. 1-36.

4. 社交网络签到数据集:

这是一个基于社交网络的网站的用户签到的数据集,来自斯坦福大学网站。好友网络不是直接相连接的,这些数据是通过网站的公共接口获取的,包含了196591个节点和950327个边。从2009年2月到2010年10月总共收集了6442890个签到记录。

  • 数据集大小:用户签到的时间和位置的文件有101M, 好友网络数据:6.1M.
  • 数据格式:
user latitude [location id] 
196514 2010-07-24T13:45:06Z 53.3648119 -2.2723465833 145064 
196514 2010-07-24T13:44:58Z 53.360511233 -2.2763690171275991 
196514 2010-07-24T13:44:46Z 53.3653895945 -2.2754087046376497 
196514 2010-07-24T13:44:38Z 53.3663709833 -2.270076433398503 
196514 2010-07-24T13:44:26Z 53.3674087524 -2.27838134771043431 
196514 2010-07-24T13:44:08Z 53.3675663377 -2.278631763881734 

这个也是上面同一家网站所产生的数据,也是基于社交网络数据,大约300M, 详情和下载网址为;http://www.yongliu.org/datasets

  • 使用到该数据集的论文有:

E. Cho, S. A. Myers, J. Leskovec. Friendship and Mobility: Friendship and Mobility: User Movement in Location-BasedSocial Networks ACM SIGKDD International Conference on KnowledgeDiscovery and Data Mining (KDD), 2011.

  • 使用了check-in类型数据集的论文有:

L. Wei, Y. Zheng, and W. Peng. 2012. Constructing popularroutes from uncertain trajectories. In Proceedings of the 18th ACM SIGKDD InternationalConference on Knowledge Discovery and Data Mining. ACM, 195–203.

J. Bao, Y. Zheng, and M. F. Mokbel. 2012. Location-based andpreference-aware recommendation using sparse geo-social networking data. InProceedings of the 20th ACM SIGSPATIAL International Conference on Advances inGeographic Information Systems. ACM, 199–208.

2013年Foursquare的数据集(150M):

5. 这个是国家飓风中心的数据

(1)大西洋飓风数据库,时间为1851到2015年之间,这个数据集在2016年7月6日提供,包含了1956年到1960年修订之后的。这个数据集叫HURDAT2, 之前那个HURDAT被替换了。

这个数据集用逗号分隔的文本,六小时信息的位置,最大的风,中央的压力,和(从2004开始)所有已知的热带气旋和热带气旋的大小。

这里写图片描述

(2)1949-2015年东北部和北部太平洋中心飓风数据库,大概3.2兆。

6. 其他数据

时空数据,网络数据, 数据流, 神经图像数据,生物信息学(基因表达)数据集http://dm.uestc.edu.cn/resource/

Natural Earth :http://www.naturalearthdata.com/

Machine Learning Repository: http://archive.ics.uci.edu/ml/

Google Trends Datastore: http://googletrends.github.io/data/

Open Data Network: https://www.opendatanetwork.com/

2017-02-27

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/liangyihuai/article/details/58335510

智能推荐

ReactOS 0.4.11 发布,Windows 系统的开源替代方案-程序员宅基地

文章浏览阅读328次。开发四年只会写业务代码,分布式高并发都不会还做程序员? ReactOS 团队发布了 ReactOS0.4.11 版本..._reactos停止支持

本体(ontology)学习之我见——Jena规则编写——中文显示与owl:inverseOf推理结果不全_ontology 推理-程序员宅基地

文章浏览阅读4k次。Jena 推理规则 中文显示 owl:inverseOf 逆关系 逆属性_ontology 推理

ARP断网攻击(详细教程)_arp断网攻击教程-程序员宅基地

文章浏览阅读9.1k次,点赞5次,收藏47次。实现原理ARP攻击仅能在局域网进行,无法对外网进行攻击。ARP攻击就是通过伪造IP地址和MAC地址实现ARP欺骗,能够在网络中产生大量的ARP通信量使网络阻塞,攻击者只要持续不断的发出伪造的ARP响应包就能更改目标主机ARP缓存中的IP-MAC条目,造成网络中断或中间人攻击。准备工作Kali Linux 镜像 , VMWare WORKSTATIONKail Linux 官网下载地址安装虚拟机安装教程执行攻击1. 查看本机ip和MAC地址IP:192.168.1.105 MAC地址_arp断网攻击教程

Odoo2021最新实用教程之——Odoo Studio 在线开发工具实战入门指导-程序员宅基地

文章浏览阅读4.7k次。Odoo Studio 作为Odoo企业版中的核心模块,能让odoo使用者通过此设计器快速、高效地构建新模块以及方便地进行已有功能地调整。但目前缺乏与Odoo Studio有关的中文指导资料,本文通过文字与视频结合的方式讲解Odoo Studio的实战操作,希望帮助有需要的朋友快速掌握这个工具。即使你最终可能不用企业版,但通过odoo企业版在线试用提供的这个在线开发工具也能帮助你对odoo的原理更快的了解。 Odoo的在线开发工具是Odoo企业版提供的强力设计工具,本实战..._odoo studio

五个好用的网络协议分析工具_network packet analyzer-程序员宅基地

文章浏览阅读4.7k次。Network Packet Analyzer,是一种网络分析程序,可以帮助网络管理员捕获、交互式浏览网络中传输的数据包和分析数据包信息等。这里给出了5个最好的网络数据包分析工具,具体如下:  1. Wireshark  相信大家都很熟悉,就不多介绍了。Wireshark网络嗅探器是最受欢迎的免费网络嗅探器之一,它能够在Unix系统和Win系统下运行。  下载:http://www_network packet analyzer

三极管的开关功能_三极管作为高侧开关-程序员宅基地

文章浏览阅读1.9w次,点赞2次,收藏8次。自己以前也发过一篇博客,上面表明了两种电路,但是没有这个全,现在推荐给大家很好的理解三极管的开关功能,下面以8个实例图片,生动的阐述三极管作为开关的功能。期待大家回复讨论分析各个电路。1、低边开关2、高边开关3、基极电阻4、非门电路5、与门6、或门7、H桥8、振荡器..._三极管作为高侧开关

随便推点

Blazor WebAssembly+Duende.IdentityServer+EF Core认证授权企业级实战_blazor identity ef 权限-程序员宅基地

文章浏览阅读2.9k次,点赞3次,收藏8次。本文将从0开始介绍如何搭建一个适用于Blazor WASM应用的且基于OpenID和OAuth2.0的认证授权服务。我们会从创建空白项目一步一步开始,让大家了解到整个搭建流程,没有直接使用微软给定的认证模板或者IdentityServer的UI模板。- 前端使用的是Blazor WebAssembly最新版本(基于 .net 5.0),主要我认为相对于Blazor Server来说,这个才是Web的未来。而且可以充分开会客户机的性能。- 认证服务使用的Duende.IdentityServer_blazor identity ef 权限

用AutoIt自动安装和卸载程序_autoit v3自动卸载软件脚本-程序员宅基地

文章浏览阅读4.6k次。由于代码每天都会更新,编译组每天晚上会针对当天的代码编译出一个新的Build(除非编译不通过),而测试组第二天早上都会安装前一天晚上编译出的Build进行测试。  一直以为测试组每天都手动地重复着这些枯燥无味的卸载、安装工作,直到同组的一个同事告诉我,测试组每天的卸载和安装工作都是通过脚本自动实现的,无需人为干预。  原来他们使用了一款叫做AutoIt的工具。个人以为,要实现这种自动化的功能,要么..._autoit v3自动卸载软件脚本

Vue框架整理:全局组件、局部组件、特殊组件创建方法_vue 特殊组件-程序员宅基地

文章浏览阅读5.2k次,点赞2次,收藏3次。vue的组件也是需要注册后才可以使用的,注册有全局注册和局部注册两种;全局组件注册后,任何vue实例都可以用:<div id="v1"> <first-component></first-component></div&a_vue 特殊组件

lat_mem_rd 内存延迟测试工具原理,lmbench编译时llseek链接不到问题解决-程序员宅基地

文章浏览阅读5.6k次。命令介绍:LAT_MEM_RD(8) manual page是lmbench中的一个工具,它的主要作用是测试内存访问的延迟。命令使用方法:lat_mem_rdsize_in_megabytesstride [stride stride...]如: lat_mem_rd 128 64 1024即: size是128MB,stride分别为64Byte 1024Byte,如果不指定stride,默认值是512,可以指定多个stride,一个命令进行多次测试。..._lat_mem_rd

类似液体loading效果-程序员宅基地

文章浏览阅读173次。直接上代码,有注释index.html<!doctype html><html lang="zh-CN"><head> <meta charset="UTF-8"> <meta name="viewport" content="width=device-width, user-scalable=no, initial-scale=1.0, maximum-scale=1.0, minimum-scale=1.0

vxworks之符号表_vxworks sym-程序员宅基地

文章浏览阅读5.7k次。符号表初始化 符号表用于建立符号名称、类型和值之间的关系。其中,名称为null结尾的任意字符串;类型为标识各种符号的整数;值为一个字符指针。符号表主要用来作为目标模块加载的基础,但在需要名称和值关联的任何时候都看使用。 运行系统中一般存在两个符号表结构sysSymTbl和statSymTbl。sysSymTbl为目标机的系统符号表,通过程序或tShel_vxworks sym

推荐文章

热门文章

相关标签