结合ESA和OceanColor下载OLCI数据(解决需要下载大量Offline数据的问题)

本文主要是介绍结合ESA和OceanColor下载OLCI数据(解决需要下载大量Offline数据的问题),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录

1.前言
2.oceancolor上的OLCI数据链接
3.从ESA上下载OLCI的快视图
4.根据快视图的名称从oceancolor下载OLCI数据

建了一个QQ群,大家可以在里边聊聊水色遥感数据下载和数据处理方面的事情:1087024529

1.前言

Sentinel-3卫星搭载的OLCI传感器,作为MERIS传感器的继承者,因其较好的数据质量,受到了广泛的关注。通常情况下,下载Sentinel数据的官方地址是:https://scihub.copernicus.eu/dhus/#/home。经常使用该网站的小伙伴会知道,ESA有个LTA政策,对该政策的简单理解就是一年前的数据被标记为offline,不能立刻下载。点击offline数据的下载按钮,去激活该数据,然后等待大约半个小时即可下载,但一个用户半个小时只能激活一景数据(千万不要重复点击)。当需要下载大量历史数据时变得十分不便(大批offline数据,半小时激活一景,这得到什么时候)。
其实在oceancolor上(https://oceandata.sci.gsfc.nasa.gov/)也有OLCI的L1级数据,且不存在offline数据的问题,但是在oceancolor上根据研究区域和研究时间选择OLCI数据十分不便。
那么是否有可能结合两个网站,实现快速批量下载OLCI的offline数据呢?答案是肯定的。

2.oceancolor上的OLCI数据链接

我们先观察ocean color上的OLCI数据的下载链接:

https://oceandata.sci.gsfc.nasa.gov/sentinel/getfile/S3A_OL_1_EFR____20190105T063307_20190105T063607_20190106T095636_0180_040_034_3780_LN1_O_NT_002.zip

通过观察可以发现,ocean color上的OLCI数据下载链接,除了最后的数据文件名不一样,其他地方一模一样。那现在思路就清晰了,只要在ESA上,检索出来所要数据的文件名,然后根据文件名就可以构建出OLCI的下载链接。构建出数据的下载链接后,将下载链接放入IDM就可以愉快下载了。

3.从ESA上下载OLCI的快视图

在ESA上可以方便地根据研究区域、时间范围等条件检索需要的OLCI数据。检索到数据之后,能够通过爬虫获取到数据的下载链接(当然直接在页面上粘贴复制数据下载链接和数据的文件名也是可以的)。

对于OLCI数据,并不提供云筛选功能,所以需要通过数据的快视图来判断该数据是否值得下载,而在网页上一景一景点开看快视图查看非常麻烦,不如把检索到的快视图全部下载下来,然后进行筛选,根据筛选后的快视图文件名,得到需要的OLCI数据文件名。
这里举一个例子:
1.我随便检索了某个区域,某段时间的OLCI数据
在这里插入图片描述
2.点开一景影像的快视图,把鼠标光标放在快视图上,浏览器的左下角会出现快视图的下载链接(标记2):
在这里插入图片描述
图中标记1是该数据的下载链接,通过对比标记1和标记2可以发现,快视图的下载链接比数据的下载链接多了:/Products(‘Quicklook’)

https://scihub.copernicus.eu/dhus/odata/v1/Products('6a6b1d14-e8f6-4770-859b-819e13c9616d')/$value
https://scihub.copernicus.eu/dhus/odata/v1/Products('6a6b1d14-e8f6-4770-859b-819e13c9616d')/Products('Quicklook')/$value

而我之前做过爬取检索到的数据链接,稍加就可以使用。下面描述具体步骤。

3.将检索到数据的网页保存下来,最好在红框处点击右键另存网页(如果检索的数据很多,最好调整每页数据数到最大):
在这里插入图片描述
在弹出另存网页对话框时,切记将保存类型选为:网页,完成在这里插入图片描述
4.打开保存网页的HTML可以发现,数据的下载链接在一个class属性为list-link selectable的div标签下的a标签中。通过这些信息我们就可以找到数据的下载链接,并且构建出快视图的下载链接,代码如下(最后的快视图链接保存为一个txt文件):

from bs4 import BeautifulSoup
import time
import os
webPage=['F:/MyCSDN/ESA+oceancolor/Page1.html']                    #构建保存文件的路径列表,保存多个网页也可以使用该方案
outFileName='F:/MyCSDN/ESA+oceancolor/quickLookLink.txt'nodeattrs={"class" :"list-link selectable"}  with open(outFileName,'w+') as ofn:for wp in webPage:with open(wp,'rb') as f:ss=f.read()soup=BeautifulSoup(ss,'html.parser') divfind=soup.find_all('div',attrs=nodeattrs)dataLinkList=[]for df in divfind:link=df.find('a').stringid=link.split('\'')[1]qklink="https://scihub.copernicus.eu/dhus/odata/v1/Products('"+id+"')/Products('Quicklook')/$value"#print(qklink)ofn.writelines(qklink+'\n')

保存的结果:
在这里插入图片描述

5.将这些链接导入IDM中,就可以批量进行下载。下载的结果如图所示,可以看到,下载的快视图中包括了数据的文件名。
在这里插入图片描述

4.根据快视图的名称从oceancolor下载OLCI数据

1.根据上一步下载到的快视图文件名(这里可以通过快视图判断影像质量,做一个筛选,把不用的数据删除掉。想不想筛选都随你),构建oceancolor上的OLCI数据下载链接。

import os
qkFileDir='F:/MyCSDN/ESA+oceancolor/QucikLook/'
fileList=os.listdir(qkFileDir)
OLCILink='F:/MyCSDN/ESA+oceancolor/olcilink.txt'
with open(OLCILink,'w') as ol:for fl in fileList:fileName=fl[:-7]dataLink='https://oceandata.sci.gsfc.nasa.gov/sentinel/getfile/'+fileName+'.zip'ol.writelines(dataLink+'\n')

生成的文件结果:
在这里插入图片描述
然后就可以将数据下载链接加入IDM进行批量下载了。

2.将数据加入到IDM之前,需要对IDM进行配置,在(通过菜单栏:下载->选项->站点管理)站点管理器中,加入你的账号名和密码。注意服务器路径写入urs.earthdata.nasa.gov,而不是oceancolor.gsfc.nasa.gov

在这里插入图片描述

这篇关于结合ESA和OceanColor下载OLCI数据(解决需要下载大量Offline数据的问题)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/273480

相关文章

Java中注解与元数据示例详解

《Java中注解与元数据示例详解》Java注解和元数据是编程中重要的概念,用于描述程序元素的属性和用途,:本文主要介绍Java中注解与元数据的相关资料,文中通过代码介绍的非常详细,需要的朋友可以参... 目录一、引言二、元数据的概念2.1 定义2.2 作用三、Java 注解的基础3.1 注解的定义3.2 内

将sqlserver数据迁移到mysql的详细步骤记录

《将sqlserver数据迁移到mysql的详细步骤记录》:本文主要介绍将SQLServer数据迁移到MySQL的步骤,包括导出数据、转换数据格式和导入数据,通过示例和工具说明,帮助大家顺利完成... 目录前言一、导出SQL Server 数据二、转换数据格式为mysql兼容格式三、导入数据到MySQL数据

C++中使用vector存储并遍历数据的基本步骤

《C++中使用vector存储并遍历数据的基本步骤》C++标准模板库(STL)提供了多种容器类型,包括顺序容器、关联容器、无序关联容器和容器适配器,每种容器都有其特定的用途和特性,:本文主要介绍C... 目录(1)容器及简要描述‌php顺序容器‌‌关联容器‌‌无序关联容器‌(基于哈希表):‌容器适配器‌:(

C#提取PDF表单数据的实现流程

《C#提取PDF表单数据的实现流程》PDF表单是一种常见的数据收集工具,广泛应用于调查问卷、业务合同等场景,凭借出色的跨平台兼容性和标准化特点,PDF表单在各行各业中得到了广泛应用,本文将探讨如何使用... 目录引言使用工具C# 提取多个PDF表单域的数据C# 提取特定PDF表单域的数据引言PDF表单是一

Java循环创建对象内存溢出的解决方法

《Java循环创建对象内存溢出的解决方法》在Java中,如果在循环中不当地创建大量对象而不及时释放内存,很容易导致内存溢出(OutOfMemoryError),所以本文给大家介绍了Java循环创建对象... 目录问题1. 解决方案2. 示例代码2.1 原始版本(可能导致内存溢出)2.2 修改后的版本问题在

一文详解Python中数据清洗与处理的常用方法

《一文详解Python中数据清洗与处理的常用方法》在数据处理与分析过程中,缺失值、重复值、异常值等问题是常见的挑战,本文总结了多种数据清洗与处理方法,文中的示例代码简洁易懂,有需要的小伙伴可以参考下... 目录缺失值处理重复值处理异常值处理数据类型转换文本清洗数据分组统计数据分箱数据标准化在数据处理与分析过

大数据小内存排序问题如何巧妙解决

《大数据小内存排序问题如何巧妙解决》文章介绍了大数据小内存排序的三种方法:数据库排序、分治法和位图法,数据库排序简单但速度慢,对设备要求高;分治法高效但实现复杂;位图法可读性差,但存储空间受限... 目录三种方法:方法概要数据库排序(http://www.chinasem.cn对数据库设备要求较高)分治法(常

Vue项目中Element UI组件未注册的问题原因及解决方法

《Vue项目中ElementUI组件未注册的问题原因及解决方法》在Vue项目中使用ElementUI组件库时,开发者可能会遇到一些常见问题,例如组件未正确注册导致的警告或错误,本文将详细探讨这些问题... 目录引言一、问题背景1.1 错误信息分析1.2 问题原因二、解决方法2.1 全局引入 Element

linux报错INFO:task xxxxxx:634 blocked for more than 120 seconds.三种解决方式

《linux报错INFO:taskxxxxxx:634blockedformorethan120seconds.三种解决方式》文章描述了一个Linux最小系统运行时出现的“hung_ta... 目录1.问题描述2.解决办法2.1 缩小文件系统缓存大小2.2 修改系统IO调度策略2.3 取消120秒时间限制3

Python将大量遥感数据的值缩放指定倍数的方法(推荐)

《Python将大量遥感数据的值缩放指定倍数的方法(推荐)》本文介绍基于Python中的gdal模块,批量读取大量多波段遥感影像文件,分别对各波段数据加以数值处理,并将所得处理后数据保存为新的遥感影像... 本文介绍基于python中的gdal模块,批量读取大量多波段遥感影像文件,分别对各波段数据加以数值处