讯飞星火模型-语音转文字实现

2024-06-13 05:44

本文主要是介绍讯飞星火模型-语音转文字实现,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录

项目结构

准备音频

接口Demo

准备代码(完整修改后)

测试提取中文文字代码

结果

下载链接:


这是上周打算试试,提取视频文字之后,制作视频字幕,从而想用大模型来实现,基本的demo可以在讯飞对应官网找到,之后就是api对接即可

项目结构

准备音频

接口Demo

示例demo请点击 这里 下载。

准备代码(完整修改后)

Ifasrdemo.java

package cn.xfyun;import cn.hutool.json.JSONUtil;
import cn.xfyun.sign.LfasrSignature;
import cn.xfyun.utils.HttpUtil;
import com.google.gson.Gson;
import org.apache.commons.lang.StringEscapeUtils;import java.io.*;
import java.net.URISyntaxException;
import java.nio.charset.StandardCharsets;
import java.nio.file.Files;
import java.nio.file.Paths;
import java.security.SignatureException;
import java.util.HashMap;public class Ifasrdemo {private static final String HOST = "https://raasr.xfyun.cn";private static String AUDIO_FILE_PATH;private static final String appid = "xxxxx";private static final String keySecret = "xxxxxxxx";private static final Gson gson = new Gson();static {try {AUDIO_FILE_PATH = Ifasrdemo.class.getResource("/").toURI().getPath() + "/audio/合成音频.wav";} catch (URISyntaxException e) {e.printStackTrace();}}public static void main(String[] args) throws Exception {String result = upload();String jsonStr = StringEscapeUtils.unescapeJavaScript(result);String orderId = String.valueOf(JSONUtil.getByPath(JSONUtil.parse(jsonStr), "content.orderId"));getResult(orderId);}private static String upload() throws SignatureException, FileNotFoundException {HashMap<String, Object> map = new HashMap<>(16);File audio = new File(AUDIO_FILE_PATH);String fileName = audio.getName();long fileSize = audio.length();map.put("appId", appid);map.put("fileSize", fileSize);map.put("fileName", fileName);map.put("duration", "200");LfasrSignature lfasrSignature = new LfasrSignature(appid, keySecret);map.put("signa", lfasrSignature.getSigna());map.put("ts", lfasrSignature.getTs());String paramString = HttpUtil.parseMapToPathParam(map);System.out.println("upload paramString:" + paramString);String url = HOST + "/v2/api/upload" + "?" + paramString;System.out.println("upload_url:" + url);String response = HttpUtil.iflyrecUpload(url, new FileInputStream(audio));System.out.println("upload response:" + response);return response;}private static String getResult(String orderId) throws SignatureException, InterruptedException, IOException {HashMap<String, Object> map = new HashMap<>(16);map.put("orderId", orderId);LfasrSignature lfasrSignature = new LfasrSignature(appid, keySecret);map.put("signa", lfasrSignature.getSigna());map.put("ts", lfasrSignature.getTs());map.put("appId", appid);map.put("resultType", "transfer,predict");String paramString = HttpUtil.parseMapToPathParam(map);String url = HOST + "/v2/api/getResult" + "?" + paramString;System.out.println("\nget_result_url:" + url);while (true) {String response = HttpUtil.iflyrecGet(url);JsonParse jsonParse = gson.fromJson(response, JsonParse.class);if (jsonParse.content.orderInfo.status == 4 || jsonParse.content.orderInfo.status == -1) {System.out.println("订单完成:" + response);write(response);return response;} else {System.out.println("进行中...,状态为:" + jsonParse.content.orderInfo.status);//建议使用回调的方式查询结果,查询接口有请求频率限制Thread.sleep(7000);}}}public static void write(String resp) throws IOException {// 使用 try-with-resources 确保资源被正确关闭try (BufferedWriter bw = new BufferedWriter(new OutputStreamWriter(new FileOutputStream("src/main/resources/output/test.txt"), "UTF-8"))) {String ss = resp;// 用 UTF-8 写入bw.write(ss);System.out.println("写入txt成功");} catch (IOException e) {e.printStackTrace();}}class JsonParse {Content content;}class Content {OrderInfo orderInfo;}class OrderInfo {Integer status;}
}

测试提取中文文字代码

ChineseTextExtractor.java

package cn.xfyun;import java.io.*;
import java.util.regex.Matcher;
import java.util.regex.Pattern;public class ChineseTextExtractor {public static void main(String[] args) {String inputFilePath = "src/main/resources/output/test.txt"; // 输入文件路径String outputFilePath = "src/main/resources/output/out.txt"; // 输出文件路径extractAndWriteChineseText(inputFilePath, outputFilePath);}public static void extractAndWriteChineseText(String inputFilePath, String outputFilePath) {Pattern pattern = Pattern.compile("[\\u4e00-\\u9fa5]+"); // 中文字符的正则表达式try (BufferedReader br = new BufferedReader(new FileReader(inputFilePath));BufferedWriter bw = new BufferedWriter(new FileWriter(outputFilePath))) {String line;while ((line = br.readLine()) != null) {Matcher matcher = pattern.matcher(line);while (matcher.find()) {bw.write(matcher.group()); // 写入匹配的中文字符bw.newLine(); // 每个匹配项后面添加一个新行}}System.out.println("中文字符提取完成,已写入 " + outputFilePath);} catch (IOException e) {e.printStackTrace();}}
}

结果

这样就实现了文字的提取,但是我还是不满足,我想要的效果是直接做出字幕的效果,我只需要导入这个字幕文件就可以了,于是我发现了下面的这个神器

下载链接:

下载客户端-33字幕

真正意义上实现免费算力制作字幕,十分良心!

看图

看看那几天转换的效果,主要是需要在自己下载一个模型即可,460多M的模型就可以适用很多场景

如果实现人声伴奏分离:推荐这两个网站!

不免费:https://www.yinziai.com/personal

新用户注册就可以用,着急的话可以试试,效果也很好

免费:Vocal Remover and Isolation [AI]

再看看这个歌词字幕

 是的,我最后要的就是这样的效果

@ky 最后吐槽一下,自己最近心肝十分易上火,动不动就生气,昨晚跟女朋友打游戏,还对她发火……,而且明明是自己的问题,简单点处理不就好了吗,事后十分后悔,所以今天早上被人制裁了,用伞把我胳膊上的皮给戳破了,像被蛇咬了一样吗,还有我们这学校真的多蛇,大小操场都能看到,就到期末了,需要赶紧复习了!

这篇关于讯飞星火模型-语音转文字实现的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1056436

相关文章

golang版本升级如何实现

《golang版本升级如何实现》:本文主要介绍golang版本升级如何实现问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录golanwww.chinasem.cng版本升级linux上golang版本升级删除golang旧版本安装golang最新版本总结gola

SpringBoot中SM2公钥加密、私钥解密的实现示例详解

《SpringBoot中SM2公钥加密、私钥解密的实现示例详解》本文介绍了如何在SpringBoot项目中实现SM2公钥加密和私钥解密的功能,通过使用Hutool库和BouncyCastle依赖,简化... 目录一、前言1、加密信息(示例)2、加密结果(示例)二、实现代码1、yml文件配置2、创建SM2工具

Mysql实现范围分区表(新增、删除、重组、查看)

《Mysql实现范围分区表(新增、删除、重组、查看)》MySQL分区表的四种类型(范围、哈希、列表、键值),主要介绍了范围分区的创建、查询、添加、删除及重组织操作,具有一定的参考价值,感兴趣的可以了解... 目录一、mysql分区表分类二、范围分区(Range Partitioning1、新建分区表:2、分

MySQL 定时新增分区的实现示例

《MySQL定时新增分区的实现示例》本文主要介绍了通过存储过程和定时任务实现MySQL分区的自动创建,解决大数据量下手动维护的繁琐问题,具有一定的参考价值,感兴趣的可以了解一下... mysql创建好分区之后,有时候会需要自动创建分区。比如,一些表数据量非常大,有些数据是热点数据,按照日期分区MululbU

MySQL中查找重复值的实现

《MySQL中查找重复值的实现》查找重复值是一项常见需求,比如在数据清理、数据分析、数据质量检查等场景下,我们常常需要找出表中某列或多列的重复值,具有一定的参考价值,感兴趣的可以了解一下... 目录技术背景实现步骤方法一:使用GROUP BY和HAVING子句方法二:仅返回重复值方法三:返回完整记录方法四:

IDEA中新建/切换Git分支的实现步骤

《IDEA中新建/切换Git分支的实现步骤》本文主要介绍了IDEA中新建/切换Git分支的实现步骤,通过菜单创建新分支并选择是否切换,创建后在Git详情或右键Checkout中切换分支,感兴趣的可以了... 前提:项目已被Git托管1、点击上方栏Git->NewBrancjsh...2、输入新的分支的

Python实现对阿里云OSS对象存储的操作详解

《Python实现对阿里云OSS对象存储的操作详解》这篇文章主要为大家详细介绍了Python实现对阿里云OSS对象存储的操作相关知识,包括连接,上传,下载,列举等功能,感兴趣的小伙伴可以了解下... 目录一、直接使用代码二、详细使用1. 环境准备2. 初始化配置3. bucket配置创建4. 文件上传到os

关于集合与数组转换实现方法

《关于集合与数组转换实现方法》:本文主要介绍关于集合与数组转换实现方法,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录1、Arrays.asList()1.1、方法作用1.2、内部实现1.3、修改元素的影响1.4、注意事项2、list.toArray()2.1、方

使用Python实现可恢复式多线程下载器

《使用Python实现可恢复式多线程下载器》在数字时代,大文件下载已成为日常操作,本文将手把手教你用Python打造专业级下载器,实现断点续传,多线程加速,速度限制等功能,感兴趣的小伙伴可以了解下... 目录一、智能续传:从崩溃边缘抢救进度二、多线程加速:榨干网络带宽三、速度控制:做网络的好邻居四、终端交互

java实现docker镜像上传到harbor仓库的方式

《java实现docker镜像上传到harbor仓库的方式》:本文主要介绍java实现docker镜像上传到harbor仓库的方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地... 目录1. 前 言2. 编写工具类2.1 引入依赖包2.2 使用当前服务器的docker环境推送镜像2.2