【小笔记】用tsai库实现Rocket家族算法

2024-01-17 08:44

本文主要是介绍【小笔记】用tsai库实现Rocket家族算法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

2024.1.16
Rocket家族算法是用于时间序列分类的强baseline(性能比较参考【小笔记】时序数据分类算法最新小结),Rocket/MiniRocket/MultiRocket官方都有开源实现,相比较而言,用tsai来实现有三个好处:1是快速跑通模型;2是更简洁优雅;3是掌握一个框架能举一反三。
在这里插入图片描述

1.tsai简介

项目:https://github.com/timeseriesAI/tsai
在这里插入图片描述

简介:
用于处理时间序列的工具库,包含TCN、Rockert等众多时间序列处理算法
请添加图片描述
安装:

pip install tsai

2.Rocket:最优雅的实现

这个例子是基于UCR的Beef数据集,运行时,会自动下载数据集到项目的data路径下

from tsai.all import *
from sklearn.linear_model import RidgeClassifierCV
from dsets_build import get_my_dsetsdevice = 'cuda' if torch.cuda.is_available() else 'cpu'
print(device)# 加载UCR数据集
X, y, splits = get_UCR_data('Beef', return_split=False, on_disk=True, verbose=True)
tfms  = [None, [Categorize()]]
batch_tfms = [TSStandardize(by_sample=True)]
dsets = TSDatasets(X, y, tfms=tfms, splits=splits)# 标准示例
dls = TSDataLoaders.from_dsets(dsets.train, dsets.valid, bs=768, drop_last=False, shuffle_train=False,device=device,batch_tfms=[TSStandardize(by_sample=True)])
model = create_model(ROCKET, dls=dls)
# model = model.to(device)print("构造特征...")
X_train, y_train = create_rocket_features(dls.train, model, verbose=False)
X_valid, y_valid = create_rocket_features(dls.valid, model, verbose=False)
print(X_train.shape, X_valid.shape)print("基于特征开始训练...")
ridge = RidgeClassifierCV(alphas=np.logspace(-8, 8, 17))
ridge.fit(X_train, y_train)
print(f'alpha: {ridge.alpha_:.2E}  train: {ridge.score(X_train, y_train):.5f}  valid: {ridge.score(X_valid, y_valid):.5f}')

3.MiniRocket:(比Rocket更快)

待补充

4.MultiRocket:(比MiniRocket更强)

待补充

5.Hydra-MultiRocket:(Rocket家最强王者)

待补充

6.用自己的数据集训练模型

上面的例子都是用的UCR数据集,若要用自己的数据集进行训练怎么解决?
官方教程:
tsai-main\tutorial_nbs路径下的00c_Time_Series_data_preparation.ipynb
在这里插入图片描述
我总结了一下,基于单变量时间序列构建数据集就是下面这样:
dsets_build.py

from tsai.all import *
import numpy as np
import pandas as pddef get_my_dsets():# 导入数据集train_data, valid_data, test_data = [[], []], [[], []], [[], []]radio_train, radio_valid, radio_test = 0.6, 0.2, 0.2# !这是我的读取读取例子,读者需要进行替换----------------------------------path = "train.csc"data = pd.read_csv(path)	train_data[0] = data['x'].tolist()train_data[1] = data['y'].tolist()# -----------------------------------------------------------------------# 将数据转换为np.array即可,剩下的都是通用了X_2d, y = np.array(train_data[0]), np.array(train_data[1])print(X_2d.shape, y.shape)    # (4000, 4096) (4000,)splits = get_splits(y, valid_size=0.2, stratify=True, random_state=23, shuffle=True, show_plot=False)print(splits)tfms = [None, [Categorize()]]dsets = TSDatasets(X_2d, y, tfms=tfms, splits=splits, inplace=True)print(dsets)return dsets

将数据集转换为tsai的dsets后,就可以直接用于训练模型了。

from tsai.all import *
from sklearn.linear_model import RidgeClassifierCV
from dsets_build import get_my_dsetsdevice = 'cuda' if torch.cuda.is_available() else 'cpu'
print(device)# 加载UCR数据集
# X, y, splits = get_UCR_data('Beef', return_split=False, on_disk=True, verbose=True)
# tfms  = [None, [Categorize()]]
# batch_tfms = [TSStandardize(by_sample=True)]
# dsets = TSDatasets(X, y, tfms=tfms, splits=splits)# 加载自定义的数据集
dsets = get_my_dsets()         # 和Rockert例子只有这里的区别# 标准示例
dls = TSDataLoaders.from_dsets(dsets.train, dsets.valid, bs=768, drop_last=False, shuffle_train=False,device=device,batch_tfms=[TSStandardize(by_sample=True)])
model = create_model(ROCKET, dls=dls)
# model = model.to(device)print("构造rocket特征...")
X_train, y_train = create_rocket_features(dls.train, model, verbose=False)
X_valid, y_valid = create_rocket_features(dls.valid, model, verbose=False)
print(X_train.shape, X_valid.shape)print("基于特征开始训练...")
ridge = RidgeClassifierCV(alphas=np.logspace(-8, 8, 17))
ridge.fit(X_train, y_train)
print(f'alpha: {ridge.alpha_:.2E}  train: {ridge.score(X_train, y_train):.5f}  valid: {ridge.score(X_valid, y_valid):.5f}')

这篇关于【小笔记】用tsai库实现Rocket家族算法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/615478

相关文章

Python实现AVIF图片与其他图片格式间的批量转换

《Python实现AVIF图片与其他图片格式间的批量转换》这篇文章主要为大家详细介绍了如何使用Pillow库实现AVIF与其他格式的相互转换,即将AVIF转换为常见的格式,比如JPG或PNG,需要的小... 目录环境配置1.将单个 AVIF 图片转换为 JPG 和 PNG2.批量转换目录下所有 AVIF 图

Pydantic中model_validator的实现

《Pydantic中model_validator的实现》本文主要介绍了Pydantic中model_validator的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价... 目录引言基础知识创建 Pydantic 模型使用 model_validator 装饰器高级用法mo

AJAX请求上传下载进度监控实现方式

《AJAX请求上传下载进度监控实现方式》在日常Web开发中,AJAX(AsynchronousJavaScriptandXML)被广泛用于异步请求数据,而无需刷新整个页面,:本文主要介绍AJAX请... 目录1. 前言2. 基于XMLHttpRequest的进度监控2.1 基础版文件上传监控2.2 增强版多

Redis分片集群的实现

《Redis分片集群的实现》Redis分片集群是一种将Redis数据库分散到多个节点上的方式,以提供更高的性能和可伸缩性,本文主要介绍了Redis分片集群的实现,具有一定的参考价值,感兴趣的可以了解一... 目录1. Redis Cluster的核心概念哈希槽(Hash Slots)主从复制与故障转移2.

springboot+dubbo实现时间轮算法

《springboot+dubbo实现时间轮算法》时间轮是一种高效利用线程资源进行批量化调度的算法,本文主要介绍了springboot+dubbo实现时间轮算法,文中通过示例代码介绍的非常详细,对大家... 目录前言一、参数说明二、具体实现1、HashedwheelTimer2、createWheel3、n

使用Python实现一键隐藏屏幕并锁定输入

《使用Python实现一键隐藏屏幕并锁定输入》本文主要介绍了使用Python编写一个一键隐藏屏幕并锁定输入的黑科技程序,能够在指定热键触发后立即遮挡屏幕,并禁止一切键盘鼠标输入,这样就再也不用担心自己... 目录1. 概述2. 功能亮点3.代码实现4.使用方法5. 展示效果6. 代码优化与拓展7. 总结1.

Mybatis 传参与排序模糊查询功能实现

《Mybatis传参与排序模糊查询功能实现》:本文主要介绍Mybatis传参与排序模糊查询功能实现,本文通过实例代码给大家介绍的非常详细,感兴趣的朋友跟随小编一起看看吧... 目录一、#{ }和${ }传参的区别二、排序三、like查询四、数据库连接池五、mysql 开发企业规范一、#{ }和${ }传参的

Docker镜像修改hosts及dockerfile修改hosts文件的实现方式

《Docker镜像修改hosts及dockerfile修改hosts文件的实现方式》:本文主要介绍Docker镜像修改hosts及dockerfile修改hosts文件的实现方式,具有很好的参考价... 目录docker镜像修改hosts及dockerfile修改hosts文件准备 dockerfile 文

基于SpringBoot+Mybatis实现Mysql分表

《基于SpringBoot+Mybatis实现Mysql分表》这篇文章主要为大家详细介绍了基于SpringBoot+Mybatis实现Mysql分表的相关知识,文中的示例代码讲解详细,感兴趣的小伙伴可... 目录基本思路定义注解创建ThreadLocal创建拦截器业务处理基本思路1.根据创建时间字段按年进

SpringBoot3实现Gzip压缩优化的技术指南

《SpringBoot3实现Gzip压缩优化的技术指南》随着Web应用的用户量和数据量增加,网络带宽和页面加载速度逐渐成为瓶颈,为了减少数据传输量,提高用户体验,我们可以使用Gzip压缩HTTP响应,... 目录1、简述2、配置2.1 添加依赖2.2 配置 Gzip 压缩3、服务端应用4、前端应用4.1 N