2024年3月调研学习文档资料汇总

2024-04-03 12:44

本文主要是介绍2024年3月调研学习文档资料汇总,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

近期学习文档

1、chatGLM实践:https://zhuanlan.zhihu.com/p/622686205?utm_id=0
chatGLM模型结构与核心代码解读:
https://blog.csdn.net/weixin_42878111/article/details/134017313
2、图文分类:https://huggingface.co/docs/transformers/model_doc/chinese_clip
(图像相似检测、零样本分类、图文特征抽取见git代码)
ChineseClip代码,预训练、图文特征抽取、零样本图像分类(支持文到图、图到文检索的top-k召回结果,详见readme):
https://github.com/OFA-Sys/Chinese-CLIP/tree/master?tab=readme-ov-file#API%E5%BF%AB%E9%80%9F%E4%B8%8A%E6%89%8B

3、多卡训练:https://blog.csdn.net/qq_51392112/article/details/129737803
4、图像质量打分模型(图像质量打分模型,训练语料只质量由高到低写到train.txt中):
https://github.com/zheng-yuwei/RankIQA.PyTorch/?tab=readme-ov-file
5、图文相似匹配:https://huggingface.co/OFA-Sys/chinese-clip-rn50
6、句子文本向量表示:https://huggingface.co/shibing624/text2vec-base-chinese
bert4vec:一个基于预训练的句向量生成工具:
https://github.com/zejunwang1/bert4vec/tree/main?tab=readme-ov-file

7、中文文本摘要:
https://huggingface.co/IDEA-CCNL/Randeng-Pegasus-523M-Summary-Chinese
rouge安装:pip install rouge

8、bert系列人物集成(分类+阅读理解):
https://github.com/CLUEbenchmark/CLUE/tree/master
9、fasttext模型训练代码:(意图打标服务用的这个脚本)
https://github.com/649453932/Chinese-Text-Classification-Pytorch
fasttext模型训练脚本:(游戏信息分类服务在用)
https://github.com/Tencent/NeuralNLP-NeuralClassifier?tab=readme-ov-file

10、bert和lert模型区别:https://zhuanlan.zhihu.com/p/664200148?utm_id=0
11、大模型图生文,模型太大,每个模型需要28G,下载耗时严重;运行需要28G及以上的显存资源,并且只能在V100及以上的机器上才能运行:
https://huggingface.co/THUDM/CogVLM/tree/main
12、ChatGLM3-6B中文纠错LoRA模型:
https://huggingface.co/shibing624/chatglm3-6b-csc-chinese-lora
13、中文拼写纠错和中文语法纠错:
https://github.com/shibing624/pycorrector/tree/master

调研评价:字粒度纠错还凑合,词粒度纠错效果差,在难样本面前就是个傻子,Macbert整体文本纠错base效果要强于其他模型

MacBert4csc模型介绍:
https://github.com/shibing624/pycorrector/blob/master/examples/macbert/README.md

14、最新的中文大模型chatGLM3:https://huggingface.co/THUDM/chatglm3-6b
15、天池数据集,需要登陆下载:https://tianchi.aliyun.com/dataset/138195
16、头条,中文文本分类数据集:https://huggingface.co/datasets/fourteenBDr/toutiao
17、数据可视化:https://www.gradio.app/guides/quickstart
gradio官方文档:https://www.gradio.app/docs/image
18、腾讯预训练平台:https://github.com/Tencent/TencentPretrain/tree/main

这篇关于2024年3月调研学习文档资料汇总的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/872957

相关文章

Oracle数据库使用 listagg去重删除重复数据的方法汇总

《Oracle数据库使用listagg去重删除重复数据的方法汇总》文章介绍了在Oracle数据库中使用LISTAGG和XMLAGG函数进行字符串聚合并去重的方法,包括去重聚合、使用XML解析和CLO... 目录案例表第一种:使用wm_concat() + distinct去重聚合第二种:使用listagg,

Java 枚举的常用技巧汇总

《Java枚举的常用技巧汇总》在Java中,枚举类型是一种特殊的数据类型,允许定义一组固定的常量,默认情况下,toString方法返回枚举常量的名称,本文提供了一个完整的代码示例,展示了如何在Jav... 目录一、枚举的基本概念1. 什么是枚举?2. 基本枚举示例3. 枚举的优势二、枚举的高级用法1. 枚举

Python基于火山引擎豆包大模型搭建QQ机器人详细教程(2024年最新)

《Python基于火山引擎豆包大模型搭建QQ机器人详细教程(2024年最新)》:本文主要介绍Python基于火山引擎豆包大模型搭建QQ机器人详细的相关资料,包括开通模型、配置APIKEY鉴权和SD... 目录豆包大模型概述开通模型付费安装 SDK 环境配置 API KEY 鉴权Ark 模型接口Prompt

HarmonyOS学习(七)——UI(五)常用布局总结

自适应布局 1.1、线性布局(LinearLayout) 通过线性容器Row和Column实现线性布局。Column容器内的子组件按照垂直方向排列,Row组件中的子组件按照水平方向排列。 属性说明space通过space参数设置主轴上子组件的间距,达到各子组件在排列上的等间距效果alignItems设置子组件在交叉轴上的对齐方式,且在各类尺寸屏幕上表现一致,其中交叉轴为垂直时,取值为Vert

Ilya-AI分享的他在OpenAI学习到的15个提示工程技巧

Ilya(不是本人,claude AI)在社交媒体上分享了他在OpenAI学习到的15个Prompt撰写技巧。 以下是详细的内容: 提示精确化:在编写提示时,力求表达清晰准确。清楚地阐述任务需求和概念定义至关重要。例:不用"分析文本",而用"判断这段话的情感倾向:积极、消极还是中性"。 快速迭代:善于快速连续调整提示。熟练的提示工程师能够灵活地进行多轮优化。例:从"总结文章"到"用

【前端学习】AntV G6-08 深入图形与图形分组、自定义节点、节点动画(下)

【课程链接】 AntV G6:深入图形与图形分组、自定义节点、节点动画(下)_哔哩哔哩_bilibili 本章十吾老师讲解了一个复杂的自定义节点中,应该怎样去计算和绘制图形,如何给一个图形制作不间断的动画,以及在鼠标事件之后产生动画。(有点难,需要好好理解) <!DOCTYPE html><html><head><meta charset="UTF-8"><title>06

学习hash总结

2014/1/29/   最近刚开始学hash,名字很陌生,但是hash的思想却很熟悉,以前早就做过此类的题,但是不知道这就是hash思想而已,说白了hash就是一个映射,往往灵活利用数组的下标来实现算法,hash的作用:1、判重;2、统计次数;

2024年流动式起重机司机证模拟考试题库及流动式起重机司机理论考试试题

题库来源:安全生产模拟考试一点通公众号小程序 2024年流动式起重机司机证模拟考试题库及流动式起重机司机理论考试试题是由安全生产模拟考试一点通提供,流动式起重机司机证模拟考试题库是根据流动式起重机司机最新版教材,流动式起重机司机大纲整理而成(含2024年流动式起重机司机证模拟考试题库及流动式起重机司机理论考试试题参考答案和部分工种参考解析),掌握本资料和学校方法,考试容易。流动式起重机司机考试技

【专题】2024飞行汽车技术全景报告合集PDF分享(附原数据表)

原文链接: https://tecdat.cn/?p=37628 6月16日,小鹏汇天旅航者X2在北京大兴国际机场临空经济区完成首飞,这也是小鹏汇天的产品在京津冀地区进行的首次飞行。小鹏汇天方面还表示,公司准备量产,并计划今年四季度开启预售小鹏汇天分体式飞行汽车,探索分体式飞行汽车城际通勤。阅读原文,获取专题报告合集全文,解锁文末271份飞行汽车相关行业研究报告。 据悉,业内人士对飞行汽车行业

高效录音转文字:2024年四大工具精选!

在快节奏的工作生活中,能够快速将录音转换成文字是一项非常实用的能力。特别是在需要记录会议纪要、讲座内容或者是采访素材的时候,一款优秀的在线录音转文字工具能派上大用场。以下推荐几个好用的录音转文字工具! 365在线转文字 直达链接:https://www.pdf365.cn/ 365在线转文字是一款提供在线录音转文字服务的工具,它以其高效、便捷的特点受到用户的青睐。用户无需下载安装任何软件,只