CBLUEbenchmark代码跑通

2024-03-27 05:12

本文主要是介绍CBLUEbenchmark代码跑通,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

CBLUEbenchmark 跑通

github源地址
1.配置

  • 数据下载
    新建文件夹CLBUEDatasets,将数据放在该文件夹下
  • 模型下载到github源地址中选择一个模型来下载:
    在这里插入图片描述
    将下载好的模型放在一个专门放模型的文件夹下,我这里是bert
    文件如下所示放置:
    在这里插入图片描述
    2.训练模型(以CMeEE任务为例):
    首先更改examples\run_ee.sh文件
#!/usr/bin/env bashDATA_DIR="../CBLUEDatasets"TASK_NAME="ee"
MODEL_TYPE="bert"
MODEL_DIR="../bert/"#这里是模型存放路径
MODEL_NAME="chinese_wwm_ext_pytorch"#需要使用的模型
OUTPUT_DIR="../data/output"#输出结果地址
RESULT_OUTPUT_DIR="../data/result_output"MAX_LENGTH=128echo "Start running"if [ $# == 0 ]; thenpython ../baselines/run_classifier.py \#这里记得baselines前面加上../--data_dir=${DATA_DIR} \--model_type=${MODEL_TYPE} \--model_dir=${MODEL_DIR} \--model_name=${MODEL_NAME} \--task_name=${TASK_NAME} \--output_dir=${OUTPUT_DIR} \--result_output_dir=${RESULT_OUTPUT_DIR} \--do_train \--max_length=${MAX_LENGTH} \--train_batch_size=16 \--eval_batch_size=16 \--learning_rate=3e-5 \--epochs=5 \--warmup_proportion=0.1 \--earlystop_patience=100 \--max_grad_norm=0.0 \--logging_steps=200 \--save_steps=200 \--seed=2021
elif [ $1 == "predict" ]; thenpython ../baselines/run_classifier.py \#这里也记得加上--data_dir=${DATA_DIR} \--model_type=${MODEL_TYPE} \--model_name=${MODEL_NAME} \--model_dir=${MODEL_DIR} \--task_name=${TASK_NAME} \--output_dir=${OUTPUT_DIR} \--result_output_dir=${RESULT_OUTPUT_DIR} \--do_predict \--max_length=${MAX_LENGTH} \--eval_batch_size=32 \--seed=2021
fi

然后直接执行bash run_ee.sh 对模型进行训练
中间保存的一些数据放在data/output下,运行结束后会有:
在这里插入图片描述

3.预测模型
执行

bash run_ee.sh predict

预测结果会放在data/result_output下:
在这里插入图片描述

4.检查格式是否正确
将原任务的test.json重命名为test_raw.json和测试结果放在format_checker文件夹下:
在这里插入图片描述
然后执行

python format_checker_CMeEE.py CMeEE_test_raw.json CMeEE_test.json

格式正确会:
在这里插入图片描述

这篇关于CBLUEbenchmark代码跑通的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/851039

相关文章

Python使用Tenacity一行代码实现自动重试详解

《Python使用Tenacity一行代码实现自动重试详解》tenacity是一个专为Python设计的通用重试库,它的核心理念就是用简单、清晰的方式,为任何可能失败的操作添加重试能力,下面我们就来看... 目录一切始于一个简单的 API 调用Tenacity 入门:一行代码实现优雅重试精细控制:让重试按我

Python实现MQTT通信的示例代码

《Python实现MQTT通信的示例代码》本文主要介绍了Python实现MQTT通信的示例代码,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录1. 安装paho-mqtt库‌2. 搭建MQTT代理服务器(Broker)‌‌3. pytho

MySQL进行数据库审计的详细步骤和示例代码

《MySQL进行数据库审计的详细步骤和示例代码》数据库审计通过触发器、内置功能及第三方工具记录和监控数据库活动,确保安全、完整与合规,Java代码实现自动化日志记录,整合分析系统提升监控效率,本文给大... 目录一、数据库审计的基本概念二、使用触发器进行数据库审计1. 创建审计表2. 创建触发器三、Java

Java中调用数据库存储过程的示例代码

《Java中调用数据库存储过程的示例代码》本文介绍Java通过JDBC调用数据库存储过程的方法,涵盖参数类型、执行步骤及数据库差异,需注意异常处理与资源管理,以优化性能并实现复杂业务逻辑,感兴趣的朋友... 目录一、存储过程概述二、Java调用存储过程的基本javascript步骤三、Java调用存储过程示

Visual Studio 2022 编译C++20代码的图文步骤

《VisualStudio2022编译C++20代码的图文步骤》在VisualStudio中启用C++20import功能,需设置语言标准为ISOC++20,开启扫描源查找模块依赖及实验性标... 默认创建Visual Studio桌面控制台项目代码包含C++20的import方法。右键项目的属性:

MySQL数据库的内嵌函数和联合查询实例代码

《MySQL数据库的内嵌函数和联合查询实例代码》联合查询是一种将多个查询结果组合在一起的方法,通常使用UNION、UNIONALL、INTERSECT和EXCEPT关键字,下面:本文主要介绍MyS... 目录一.数据库的内嵌函数1.1聚合函数COUNT([DISTINCT] expr)SUM([DISTIN

Java实现自定义table宽高的示例代码

《Java实现自定义table宽高的示例代码》在桌面应用、管理系统乃至报表工具中,表格(JTable)作为最常用的数据展示组件,不仅承载对数据的增删改查,还需要配合布局与视觉需求,而JavaSwing... 目录一、项目背景详细介绍二、项目需求详细介绍三、相关技术详细介绍四、实现思路详细介绍五、完整实现代码

Go语言代码格式化的技巧分享

《Go语言代码格式化的技巧分享》在Go语言的开发过程中,代码格式化是一个看似细微却至关重要的环节,良好的代码格式化不仅能提升代码的可读性,还能促进团队协作,减少因代码风格差异引发的问题,Go在代码格式... 目录一、Go 语言代码格式化的重要性二、Go 语言代码格式化工具:gofmt 与 go fmt(一)

HTML5实现的移动端购物车自动结算功能示例代码

《HTML5实现的移动端购物车自动结算功能示例代码》本文介绍HTML5实现移动端购物车自动结算,通过WebStorage、事件监听、DOM操作等技术,确保实时更新与数据同步,优化性能及无障碍性,提升用... 目录1. 移动端购物车自动结算概述2. 数据存储与状态保存机制2.1 浏览器端的数据存储方式2.1.

基于 HTML5 Canvas 实现图片旋转与下载功能(完整代码展示)

《基于HTML5Canvas实现图片旋转与下载功能(完整代码展示)》本文将深入剖析一段基于HTML5Canvas的代码,该代码实现了图片的旋转(90度和180度)以及旋转后图片的下载... 目录一、引言二、html 结构分析三、css 样式分析四、JavaScript 功能实现一、引言在 Web 开发中,