首页 » 软件开发 » 【真人语音】讯飞星火个人声音训练及导出下载工具V0.2.exe(设计设计院自己的真人设计师)

【真人语音】讯飞星火个人声音训练及导出下载工具V0.2.exe(设计设计院自己的真人设计师)

乖囧猫 2024-07-24 20:38:22 0

扫一扫用手机浏览

文章目录 [+]

很早之前在Github上也看到过真人人声训练的开源代码,尝试过一番之后,也是以失败告终;就在前几个月歌手语音的训练、个人真人声音的训练又火了一波,新的开源代码

这不,随着国内擅长声音处理的讯飞大模型融合了真人声音训练,

【项目实现】

https://xinghuo.xfyun.cn/desk

首先,需要用讯飞的大模型训练自己的声音,右上角点击创建发音人,这个时候需要录制10段个人语音,云端训练大概需要5~10分钟,训练好之后的界面同上图,可以选择发音人(真人人声)。

【真人语音】讯飞星火个人声音训练及导出下载工具V0.2.exe(设计设计院自己的真人设计师) 软件开发
(图片来自网络侵删)

然后,就可以将自己的文本投喂给大模型,可以是问题,也可以是自己已经写好的文本,具体例子:

用户:请润色下面文本,并拟定1个吸睛的标题。

文本:

土木工程现在房地产大环境下不是太热门,其实大学的专业作为对于每个人来讲(个人观点),本身就是将来对于自己的一个谋生的手段,这个专业大家最多的印象最多的就是提桶跑路吧,但是每个专业都有每个专业的好处与坏处,这个专业门槛低,就业前期工作收入比较高,就业方向比较多,造价,施工、设计,监理等,适合善于交际的人。
坏处大家都应该知道,环境相对别的专业较差,有时候面对的班组劳务的教育水平不是很高,人际关系不好后期发展受限等。

星火大模型回答的文本,就出出现一个语音按钮,点击该按钮就可以听到你的真人发音。
但是,该大模型已经禁止浏览使用开发模式,生成的TTS音频无法通过插件工具实现音频导出。

解决方案:通过声卡复制类软件,实现在朗读语音时,对声卡数据进行复制,进而实现音频导出。

请重新输出以下文本:土木工程现在房地产大环境下不是太热门,其实大学的专业作为对于每个人来讲(个人观点),本身就是将来对于自己的一个谋生的手段,这个专业大家最多的印象最多的就是提桶跑路吧,但是每个专业都有每个专业的好处与坏处,这个专业门槛低,就业前期工作收入比较高,就业方向比较多,造价,施工、设计,监理等,适合善于交际的人。

作为一个准程序员,这种方案可以解决问题,但总是差强人意。

于是,在想,能不能通过fiddler分析转换接口,形成API或者封装成一个工具?说干就干,刚好西安周末下雨,宅在家里,对其进行分析,最终封装成一个exe。

使用该工具,需要下载fiddler,获取ID和cookies。

上图,点击①链接,在②处复制header即可获取到cookie,在③处可以获取到ID(tts)。

接下来就可以用剪映工具制作视频(真人原声),从此告别千篇一律的机器声。

【工具下载】

https://intumu.com/article/202

【应用拓展】

真人人声+MD数字人?可以衍生出很多Ideas,感兴趣的小伙伴也可以加

学Python并不难,会敲键盘就能学!

【扩展操作】

第1步,借助天工AI搜索(tiangong.cn),直接手机短信验证就可以使用,该大模型已经接入互联网,注意提问方式。
细心的筒子已经发现,该回答可能已经包含了逼乎的优质答案。
举个例子:

设计院作为一种专业设计机构,在技术发展和社会变革的进程中,AI的出现无疑对其职能和工作方式产生了一定的影响。
从不同的角度来看,可以得出以下结论:

辅助设计工具角度:AI在设计过程中可以作为一种辅助工具,提供更高效、精确的设计方案,例如自动生成设计草图、优化设计布局、预测设计风格趋势等。
这使得设计师能够更加专注于创造性的思考和决策,提高整体设计效率和质量。
2

可替代性角度:虽然AI在某些设计领域已经取得了一定的成就,但目前AI在感知、理解和创造性思维等方面仍存在局限性,难以完全替代设计师。
设计师的专业知识、审美能力、情感共鸣等人类特质仍然是无法被AI所取代的重要优势。
23

创新驱动角度:设计院作为创新的源头和推动者,需要不断引领和适应时代的发展潮流。
AI作为一种前沿技术,可以为设计院注入新的思维和工具,推动设计过程中的技术创新和设计方法的更新。
同时,设计院也需要拥抱AI,不断学习和掌握AI技术,以更好地应对未来的设计需求和挑战。
2

可能的协作模式角度:AI和人类设计师可以形成一种合作共生的模式,人类设计师依托AI技术进行设计创造,而AI作为设计创意的辅助和扩展,提供更多样的设计选项和创意启发。
这种协作模式可以将人机优势进行有机结合,创造出更具创新性和人性化的设计成果。
2

市场需求角度:随着AI技术的不断发展和应用,一些低端和重复性的设计任务可能会逐渐被AI所取代,设计师需要转向更加高级和创造性的设计方向。
同时,人们对于个性化、定制化设计的需求也在不断增加,这为设计师提供了更多的发展空间和机会。
4

知识产权保护角度:在AI的设计过程中,对于涉及专利、版权等知识产权的问题,需要加强相关的法律和制度保护,以确保设计活动的公平性和正当性。
AI与设计师之间应遵守知识产权的法律法规,保护设计成果的合法权益。
2

教育培训角度:随着AI的发展应用,设计院需要不断更新教育培训内容和方法,加强对设计师的技术和人文素养的培养,使其具备与AI技术协作的能力和思维方式。
同时,设计院也需要与高校、科研机构等合作,推动相关学科的交叉融合,培养具备跨学科综合素养的设计人才。
3

社会认知角度:设计院的发展与社会对于AI的认知和接受程度密切相关。
加强对于人工智能技术的普及和宣传,提高公众对AI的理解与信任,有助于推动设计院与AI的良好合作与发展。
2

倫理責任角度:面对AI技术在设计领域的广泛应用,设计师和设计院应当重视伦理责任的问题,确保设计过程中的公正、公平和人类价值的尊重。
避免AI技术的滥用和伦理风险,提倡科技与人文的有机结合,实现设计的社会效益最大化。
23

发展前景角度:综上所述,AI对设计院的影响是不可忽视的,但目前并不存在AI能够完全取代设计院的可能。
设计院在与AI技术的结合中应以智能化、创新化为方向,不断适应时代的发展,提高设计效率和质量,为社会经济建设提供更加优秀的设计方案。
23

综合以上观点可以得出结论:设计院将与AI形成合作共生关系,利用AI技术提升设计效率和质量;设计师的专业知识、审美能力和创造性思维仍然是无法被AI所替代的重要优势;设计院需要适应和引领AI技术的发展趋势,重视伦理责任,推动设计创新和社会效益的最大化。

第2步,借助讯飞星火大模型的真人人声训练,可以避免千篇一律的机器人声音,这个时候需要借助工具,将你自己的声音导出。

第3步,借助必剪工具,图文成片,必剪可以根据文案生成对应的素材,字幕,背景音乐等。
这个时候,我们需要删除字幕、背景音乐,只保留视频素材。

第4步,加载第2步生成的真人人声,再借助必剪工具的智能字幕根据真人人身匹配文案,这个时候可能出现原有视频素材长度大于真人人声,直接剪掉多余部分即可。
最后,换上自己喜欢的背景音乐,加上封面,Over,发布在各大视频平台,慢慢积攒用户。

相关文章

语言中的借用,文化交融的桥梁

自古以来,人类社会的交流与发展离不开语言的传播。在漫长的历史长河中,各民族、各地区之间的文化相互碰撞、交融,产生了许多独特的语言现...

软件开发 2025-01-01 阅读1 评论0

机顶盒协议,守护数字生活的新卫士

随着科技的飞速发展,数字家庭逐渐走进千家万户。在这个时代,机顶盒成为了连接我们与丰富多彩的数字世界的重要桥梁。而机顶盒协议,作为保...

软件开发 2025-01-01 阅读1 评论0

语言基础在现代社会的重要性及方法步骤

语言是人类沟通的桥梁,是社会发展的基础。语言基础作为语言学习的基石,对于个人、社会乃至国家的发展具有重要意义。本文将从语言基础在现...

软件开发 2025-01-01 阅读2 评论0

粤语电影,传承文化,点亮时代之光

粤语电影,作为中国电影产业的一朵奇葩,以其独特的地域特色、丰富的文化内涵和鲜明的艺术风格,赢得了广大观众的喜爱。本文将从粤语电影的...

软件开发 2025-01-01 阅读3 评论0

苹果游戏语言,塑造未来娱乐体验的基石

随着科技的飞速发展,游戏产业逐渐成为全球娱乐市场的重要支柱。在我国,游戏产业更是蓬勃发展,吸引了无数玩家和投资者的目光。而在这其中...

软件开发 2025-01-01 阅读1 评论0