本文作者列出了 20 种被广泛认可的免费数据源,其中信息涵盖天文地理、政法医经等,可以说是很全面了。不过数据源中的大部分数据集都采集的美国信息,也有少部分是关于其他国家或全球的,大家尽可从中筛选自己需要的数据集。

20个安全可靠的免费数据源,各领域数据任你挑

我们都喜欢免费的东西,对吧?实际上,虽然网络上充斥着各种免费信息,但这些信息有时是错误或具有误导性的。但以下这 20 个是被广泛认为相当可信的免费数据源。

Google Dataset Search

地址:https://toolbox.google.com/datasetsearch

20个安全可靠的免费数据源,各领域数据任你挑

它可以让你搜索到已经根据 schema.org 标准进行正确标记的可用数据集。虽然这可以被视为一站式数据集商店,包括像来自 NASA 和 ProPublica 等来源的数据,但对于一些特定目标来说,其它数据集可能更好用。

你可以看到所有搜索结果,每个结果包括:

数据集名称 最近更新时间 数据集简介

其中一些结果可以让你获得更多信息,例如数据集中可用的格式。

Google Trends

地址:https://trends.google.com/trends/explore

20个安全可靠的免费数据源,各领域数据任你挑

使用此工具,你可以搜索关键字并查看有关它们的各种信息,包括:

按照时间的搜索热度 按照地区的搜索热度 相关主题 相关搜索

你可以选择不同的选项,包括要查看的国家(或全球),将其缩小到各个类别,或将搜索范围限制在所有网站、图片、新闻、购物或 YouTube 上。

你还可以将搜索结果与另一主题进行对比。

U.S. Census Bureau

地址:https://www.census.gov/

20个安全可靠的免费数据源,各领域数据任你挑

你可以从这个数据集中获得与人口、经济和地理相关的信息,也可以按主题或搜索进行浏览。

如果你需要统计内容,这会是一个很好用的工具。它们有一些很好的可视化效果,你也可以将其嵌入到内容中。

EU Open Data Portal

地址:http://data.europa.eu/euodp/en/data/

20个安全可靠的免费数据源,各领域数据任你挑

该数据集中的可用数据包括:

地理 金融 统计学 选举结果 法案 有关犯罪、交通、健康、环境和科学研究的信息

这是一个既可搜索又可浏览的平台。

美国 Data.gov

地址:https://www.data.gov/

20个安全可靠的免费数据源,各领域数据任你挑

作为美国政府开放数据的主页,该网站允许访问联邦、州、地方和部落政府提供的各种主题信息。

英国 Data.gov

地址:https://data.gov.uk/

20个安全可靠的免费数据源,各领域数据任你挑

与美国的 Data.gov 类似,该网站允许访问各种主题的数据。这些数据由中央政府、地方当局和公共机构提供。

Health Data

地址:https://healthdata.gov/

20个安全可靠的免费数据源,各领域数据任你挑

该网站可搜索的主题包括医疗设备、环境卫生、药物滥用、精神健康等等。

The World Factbook

地址:https://www.cia.gov/library/publications/the-world-factbook/

20个安全可靠的免费数据源,各领域数据任你挑

该数据集包含 267 个国家和地区的信息,这是一个数据宝库,每周更新一次有关全球的信息。

你可以选择要查看的国家,然后点击你喜欢的任何主题(如经济或交通)。该网站是可检索的。它还有一个关于世界领导人和一个关于 CIA Maps 的专栏。

Altmetric

地址:https://www.altmetric.com/top100/2018/

20个安全可靠的免费数据源,各领域数据任你挑

Altmetric 有些数据是需要付费的,但它们还提供每年发布的具热度的前 100 篇文章,这非常有用。

最新的是 2018 年的数据,可以往前搜索到 2013 年的数据。他们还提供一些免费工具。

Open Corporates

地址:https://opencorporates.com/

20个安全可靠的免费数据源,各领域数据任你挑

Open Corporates 是全球大的公司开放数据集,可让你访问超过 1 亿家公司的信息。

你可以按公司或高级职员进行搜索,并在需要的时候限制你的搜索范围。

National Center for Environmental Information

地址:https://www.ncdc.noaa.gov/data-access

20个安全可靠的免费数据源,各领域数据任你挑

这个数据集涵盖地球物理学、大气和海洋数据。他们目前是世界上大的气候和天气信息提供商。

他们还提供了旧工具的链接,这些工具目前可能在网站上不可使用,但可用于其他地方。

Reddit

地址:https://www.reddit.com/r/datasets

20个安全可靠的免费数据源,各领域数据任你挑

虽然你需要注册,但它是免费的。你可以搜索数据集并查找提供信息和请求信息的人。

总的来说,Reddit 也是一个寻找信息并了解行业趋势的好地方。

Kaggle 数据集

地址:https://www.kaggle.com/datasets

20个安全可靠的免费数据源,各领域数据任你挑

Kaggle 目前有将近 16,000 个数据集。你可以找到从运动队球员统计到洛杉矶停车引语任何范畴的数据。

NASA 的 Earth Data

地址:https://earthdata.nasa.gov/?_fsi=BqJ6IiI5

20个安全可靠的免费数据源,各领域数据任你挑

地球观测系统数据和信息系统包含了美国宇航局的地球观测数据,其中包含如 NC 地表温度和碳通量等信息。

Pew Internet

地址:https://www.pewinternet.org/datasets/?_fsi=BqJ6IiI5

20个安全可靠的免费数据源,各领域数据任你挑

如果你需要的是社会学数据,这是一个很好的数据源。

你还可以通过浏览找到一些有趣的文章。虽然需要注册才能查看和下载数据集,但它也是免费的。

Centers for Disease Control and Prevention

地址:https://www.cdc.gov/datastatistics/index.html

20个安全可靠的免费数据源,各领域数据任你挑

该网站包括各种健康主题,可让你访问大量可浏览和可搜索的数据。甚至可以通过各种与主题相关的网站创建自己过滤的数据集。

Bureau of Labor Statistics

地址:https://www.bls.gov/data/

20个安全可靠的免费数据源,各领域数据任你挑

你可以在这里找到有关美国劳动力市场活跃度、工作条件和价格变化的数据。

Five Thirty Eight

地址:https://data.fivethirtyeight.com/

20个安全可靠的免费数据源,各领域数据任你挑

这个网站有关于政治、体育、科学、健康、经济和文化方面的数据。

Group Lens

地址:https://grouplens.org/datasets/

20个安全可靠的免费数据源,各领域数据任你挑

Group Lens 上有几个可用的数据集,这些数据集对特定的项目很有用。一些数据集已有十多年的历史。你可以在这里得到很多关于书籍和电影的信息。

GitHub 上的 BuzzFeed News

地址:https://www.searchenginejournal.com/twitter-is-still-verifying-users-despite-pausing-the-application-process/303589/

20个安全可靠的免费数据源,各领域数据任你挑

这个网站给你提供了来自 Buzzfeed 的数据。如果你想了解 2016 年至 2018 年期间的假新闻,那么这个就是你的最佳选择。

【凡本网注明来源非中国IDC圈的作品,均转载自其它媒体,目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责。】

关注中国IDC圈官方微信:idc-quan 我们将定期推送IDC产业最新资讯

查看心情排行你看到此篇文章的感受是:


  • 支持

  • 高兴

  • 震惊

  • 愤怒

  • 无聊

  • 无奈

  • 谎言

  • 枪稿

  • 不解

  • 标题党
2023-08-24 09:38:00
大数据资讯 关注县域数据能力建设,抢占产数业务发展先机
2023年《数字中国建设整体布局规划》正式发布,数据能力已成为我国区域发展的底座和创新引擎。 <详情>
2023-03-30 11:15:07
云资讯 分布式时代已至,数据如何更有价值?
无论是连通各大集群内大型超大型数据中心,还是连接边缘侧小型、边缘数据中心,分布式云计算都已成为这张算力网络最重要的支撑。在此背景下,云计算步入分布式时代。 <详情>
2023-03-01 19:27:00
市场情报 FlagOpen大模型技术开源体系,开启大模型时代“新Linux”生态
大数据+大算力+强算法=大模型”是当前人工智能发展的主要技术路径。语言大模型ChatGPT成为现象级应用,人工智能进入普及应用的新时期。 <详情>
2023-01-09 09:36:46
大数据资讯 我国互联网广告数据匿名实施服务正式上线
《指南》形成的“技术保障、评估规制、过程控制”的互信制衡机制,适用于各类互联网广告业务,包括广告投放、程序化交易、广告监测等应用场景下的数据匿名化处理。 <详情>
2022-12-30 10:10:19
大数据资讯 中国移动磐维数据库正式发布
未来,随着数据库功能和稳定性等进一步增强,磐维数据库将在中国移动内外部的广泛应用中积累更多复杂业务场景实践经验,进一步提升数据库产品的核心技术能力,助力数智化转 <详情>