CBLUEbenchmark代码跑通

2024-03-27 05:12

本文主要是介绍CBLUEbenchmark代码跑通,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

CBLUEbenchmark 跑通

github源地址
1.配置

  • 数据下载
    新建文件夹CLBUEDatasets,将数据放在该文件夹下
  • 模型下载到github源地址中选择一个模型来下载:
    在这里插入图片描述
    将下载好的模型放在一个专门放模型的文件夹下,我这里是bert
    文件如下所示放置:
    在这里插入图片描述
    2.训练模型(以CMeEE任务为例):
    首先更改examples\run_ee.sh文件
#!/usr/bin/env bashDATA_DIR="../CBLUEDatasets"TASK_NAME="ee"
MODEL_TYPE="bert"
MODEL_DIR="../bert/"#这里是模型存放路径
MODEL_NAME="chinese_wwm_ext_pytorch"#需要使用的模型
OUTPUT_DIR="../data/output"#输出结果地址
RESULT_OUTPUT_DIR="../data/result_output"MAX_LENGTH=128echo "Start running"if [ $# == 0 ]; thenpython ../baselines/run_classifier.py \#这里记得baselines前面加上../--data_dir=${DATA_DIR} \--model_type=${MODEL_TYPE} \--model_dir=${MODEL_DIR} \--model_name=${MODEL_NAME} \--task_name=${TASK_NAME} \--output_dir=${OUTPUT_DIR} \--result_output_dir=${RESULT_OUTPUT_DIR} \--do_train \--max_length=${MAX_LENGTH} \--train_batch_size=16 \--eval_batch_size=16 \--learning_rate=3e-5 \--epochs=5 \--warmup_proportion=0.1 \--earlystop_patience=100 \--max_grad_norm=0.0 \--logging_steps=200 \--save_steps=200 \--seed=2021
elif [ $1 == "predict" ]; thenpython ../baselines/run_classifier.py \#这里也记得加上--data_dir=${DATA_DIR} \--model_type=${MODEL_TYPE} \--model_name=${MODEL_NAME} \--model_dir=${MODEL_DIR} \--task_name=${TASK_NAME} \--output_dir=${OUTPUT_DIR} \--result_output_dir=${RESULT_OUTPUT_DIR} \--do_predict \--max_length=${MAX_LENGTH} \--eval_batch_size=32 \--seed=2021
fi

然后直接执行bash run_ee.sh 对模型进行训练
中间保存的一些数据放在data/output下,运行结束后会有:
在这里插入图片描述

3.预测模型
执行

bash run_ee.sh predict

预测结果会放在data/result_output下:
在这里插入图片描述

4.检查格式是否正确
将原任务的test.json重命名为test_raw.json和测试结果放在format_checker文件夹下:
在这里插入图片描述
然后执行

python format_checker_CMeEE.py CMeEE_test_raw.json CMeEE_test.json

格式正确会:
在这里插入图片描述

这篇关于CBLUEbenchmark代码跑通的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/851039

相关文章

利用Python调试串口的示例代码

《利用Python调试串口的示例代码》在嵌入式开发、物联网设备调试过程中,串口通信是最基础的调试手段本文将带你用Python+ttkbootstrap打造一款高颜值、多功能的串口调试助手,需要的可以了... 目录概述:为什么需要专业的串口调试工具项目架构设计1.1 技术栈选型1.2 关键类说明1.3 线程模

Python Transformers库(NLP处理库)案例代码讲解

《PythonTransformers库(NLP处理库)案例代码讲解》本文介绍transformers库的全面讲解,包含基础知识、高级用法、案例代码及学习路径,内容经过组织,适合不同阶段的学习者,对... 目录一、基础知识1. Transformers 库简介2. 安装与环境配置3. 快速上手示例二、核心模

Java的栈与队列实现代码解析

《Java的栈与队列实现代码解析》栈是常见的线性数据结构,栈的特点是以先进后出的形式,后进先出,先进后出,分为栈底和栈顶,栈应用于内存的分配,表达式求值,存储临时的数据和方法的调用等,本文给大家介绍J... 目录栈的概念(Stack)栈的实现代码队列(Queue)模拟实现队列(双链表实现)循环队列(循环数组

使用Java将DOCX文档解析为Markdown文档的代码实现

《使用Java将DOCX文档解析为Markdown文档的代码实现》在现代文档处理中,Markdown(MD)因其简洁的语法和良好的可读性,逐渐成为开发者、技术写作者和内容创作者的首选格式,然而,许多文... 目录引言1. 工具和库介绍2. 安装依赖库3. 使用Apache POI解析DOCX文档4. 将解析

C++使用printf语句实现进制转换的示例代码

《C++使用printf语句实现进制转换的示例代码》在C语言中,printf函数可以直接实现部分进制转换功能,通过格式说明符(formatspecifier)快速输出不同进制的数值,下面给大家分享C+... 目录一、printf 原生支持的进制转换1. 十进制、八进制、十六进制转换2. 显示进制前缀3. 指

使用Python实现全能手机虚拟键盘的示例代码

《使用Python实现全能手机虚拟键盘的示例代码》在数字化办公时代,你是否遇到过这样的场景:会议室投影电脑突然键盘失灵、躺在沙发上想远程控制书房电脑、或者需要给长辈远程协助操作?今天我要分享的Pyth... 目录一、项目概述:不止于键盘的远程控制方案1.1 创新价值1.2 技术栈全景二、需求实现步骤一、需求

Java中Date、LocalDate、LocalDateTime、LocalTime、时间戳之间的相互转换代码

《Java中Date、LocalDate、LocalDateTime、LocalTime、时间戳之间的相互转换代码》:本文主要介绍Java中日期时间转换的多种方法,包括将Date转换为LocalD... 目录一、Date转LocalDateTime二、Date转LocalDate三、LocalDateTim

jupyter代码块没有运行图标的解决方案

《jupyter代码块没有运行图标的解决方案》:本文主要介绍jupyter代码块没有运行图标的解决方案,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录jupyter代码块没有运行图标的解决1.找到Jupyter notebook的系统配置文件2.这时候一般会搜索到

Python通过模块化开发优化代码的技巧分享

《Python通过模块化开发优化代码的技巧分享》模块化开发就是把代码拆成一个个“零件”,该封装封装,该拆分拆分,下面小编就来和大家简单聊聊python如何用模块化开发进行代码优化吧... 目录什么是模块化开发如何拆分代码改进版:拆分成模块让模块更强大:使用 __init__.py你一定会遇到的问题模www.

springboot循环依赖问题案例代码及解决办法

《springboot循环依赖问题案例代码及解决办法》在SpringBoot中,如果两个或多个Bean之间存在循环依赖(即BeanA依赖BeanB,而BeanB又依赖BeanA),会导致Spring的... 目录1. 什么是循环依赖?2. 循环依赖的场景案例3. 解决循环依赖的常见方法方法 1:使用 @La