首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 大模型应用发展的方向|代理 Agent 的兴起及其未来(上)
· 划重点!全网最全AI数字人工具合集!
· 大模型推理能力增强方法总结
· 惊艳推荐!8款好用又免费的文本转语音TTS工具
· Kimichat炒股:7个提示词案例
· LLM每周速递!大模型最前沿:多模态RAG、RAG加速、大模型Agent、模型微调/对齐
· 字节开源项目MimicTalk:快速打造逼真3D Talking Face的利器
· 我们需要的不是智能体,而是工作流(5000字保姆式教学)
· 神奇的 OuteTTS - 0.1 - 350M:用几秒钟音频克隆声音的黑科技!
· 开源!数字人资源大集合!
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
开源
从声纹模型到语
音
合成:
音
频处理 AI 技术前沿 | 开源专题 No.45
该项目还提供了其他功能: · MusicGen:一种最新技术实现的可控文本到
音
乐
模型。
AudioCraft
音频
工具
FFmpeg之父新作——
音
频压缩工具 TSAC
我们看下官网给出流行歌曲的例子进行分析,首先听起来整体上是比较接近的,但是经过压缩后还原的
音
频,伴奏和人声混在了一起,没有一轨一轨清晰的感觉,有点像混
音
没有做好。
TSAC
音频工具
开源
阿里巴巴语
音
实验室发布开源语
音
处理框架ClearerVoice-Studio,支持语
音
增强、分离、目标说话人提取
虽然
音
频技术日新月异,但许多现有方案在复杂场景中仍难以提供稳定且高质量的
音
频体验。
ClearerVoice-Studio
语音
开源
开源语
音
大语言模型来了!阿里基于Qwen-Chat提出Qwen-Audio!
作为一种重要模态,语
音
提供了超越文本的多样且复杂的信号,如人声中的情感、语调和意图,自然声
音
中的火车汽笛、钟声和雷声,以及
音
乐
中的旋律。
大模型
语音
字正腔圆,万国同
音
,coqui-ai TTS跨语种语
音
克隆,钢铁侠讲16国语言
按照固有的思维方式,如果想要语
音
克隆首先得有克隆对象具体的语言语
音
样本,换句话说,克隆对象必须说过某一种语言的话才行,但现在,coqui-ai TTS V2.0版本做到了,真正的跨语种无需训练的语
音
克隆技术
coqui-ai
TTS
语音
大模型
“实时”语
音
翻译!AI语
音
具有“情绪”!最强开源AI大模型来了
你想把一段语
音
转成文字,或者把一段文字转成语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
开源
语
音
、视频转文字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的语
音
识别模型,它是一种通用的语
音
识别模型,可以用于语
音
识别、语
音
翻译和语言识别等任务。
人工智能
大模型
wisper
数字人
数字人之声
音
克隆:无样本,1分钟样本完美克隆声
音
,开源
零样本文本到语
音
(TTS): 输入 5 秒的声
音
样本,即刻体验文本到语
音
转换。
数字人
声音克隆
GPT-SoVITS
语
音
克隆又又又又又升级了
之前在前面的文章中有介绍,克隆你的声
音
,只需要你三秒的录
音
,声
音
克隆又进化了!
Meta
语音生成
开源
clone-voice:一键克隆声
音
,开源AI技术让声
音
创作更便捷、更个性化
声码器的作用是将模型生成的语
音
特征还原为可听的声
音
信号,通过这一步骤,最终生成与原始声
音
高度相似的克隆语
音
,实现声
音
克隆的效果。
clone-voice
声音克隆
开源
十大开源语
音
识别项目
这项技术在多个领域有着广泛的应用,包括但不限于语
音
助手、语
音
搜索、自动转写以及语
音
命令识别。
语音识别
开源项目
OpenAI
OpenAI大动作:Whisper large-v3重塑语
音
识别技术
这款最新的自动语
音
识别模型不仅在多语言识别方面取得了显著进步,而且还将很快在OpenAI的API中得到支持。
Whisper
语音识别
实时语
音
克隆
项目简介 这份内容介绍了实时语
音
克隆的技术实现,作者通过将说话者验证技术转移到多说话人文本到语
音
合成(SV2TTS)来实现语
音
克隆。
语音
克隆
视频
厉害了,匹诺曹Pinokio!所有AI工具,一键安装,全部免费!整合AI绘画、AI视频、AI语
音
...
涵盖了 AI 绘画、AI 视频、AI
音
乐
、AI 数字人等各个领域 今天给大家推荐一款AI神器,匹诺曹Pinokio!
AI绘画
AI视频
AI音乐
AI拟声: 5秒内克隆您的声
音
个性化语
音
助手:使用MockingBird,你可以创建自己的个性化语
音
助手。
声音克隆
开源
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100