首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 大模型应用发展的方向|代理 Agent 的兴起及其未来(上)
· 划重点!全网最全AI数字人工具合集!
· 大模型推理能力增强方法总结
· 惊艳推荐!8款好用又免费的文本转语音TTS工具
· Kimichat炒股:7个提示词案例
· LLM每周速递!大模型最前沿:多模态RAG、RAG加速、大模型Agent、模型微调/对齐
· 字节开源项目MimicTalk:快速打造逼真3D Talking Face的利器
· 我们需要的不是智能体,而是工作流(5000字保姆式教学)
· 神奇的 OuteTTS - 0.1 - 350M:用几秒钟音频克隆声音的黑科技!
· 开源!数字人资源大集合!
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
关于AI声
音
生
成的一切(
语
音
+
音
乐+嘴型)
其实声
音
生
成也有很多革命性的工具,例如高质量的声
音
识别、
文
字转成人声、人声克隆、
音
乐
生
成,已经能组成完整工作流了,其中一些工具甚至已经打包好了,只要下载解压就能用!
声音
视频
栩栩如
生
,
音
色克隆,Bert-vits2
文
字转
语
音
打造鬼畜视频实践
BERT的核心思想是通过在大规模
文
本
语
料上进行无监督预训练,学习到通用的
语
言表示,然后将这些表示用于下游任务的微调。
Bert-vits
语音
工具
AI
文
本转
语
音
工具(TTS):MeloTTS
今天给大家介绍一个效果不错的开源
文
本转
语
音
工具:MeloTTS MeloTTS是一个可以把
文
字转换成声
音
的工具,它支持英
语
、西班牙
语
、法
语
、中
文
、日
语
和韩
语
等多种
语
言。
MeloTTS
语音工具
OpenAI
【
语
音
识别】OpenAI
语
音
力作Whisper
这么多的标注数据使得我们可以直接在 有监督
语
音
识别任务上预训练Whisper,从标注
音
频转录数据中直接习得
语
音
到
文
本的映射。
语音转文字
whisper
开源
语
音
、视频转
文
字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的
语
音
识别模型,它是一种通用的
语
音
识别模型,可以用于
语
音
识别、
语
音
翻译和
语
言识别等任务。
人工智能
大模型
wisper
【进阶】-
文
生
图术
语
解释
黑话# 缩写/术
语
解释 oneshot 一张图
文生图
视频
Wunjo AI: 合成和克隆英
语
/俄
语
/中
文
语
音
,实时
语
音
识别,深度换脸和唇动合成,通过
文
本提示更改视频,分割和修饰
主要特征
语
音
合成:轻松将
文
本转换为类似人类的
语
音
。
AI语音克隆
实时语音识别
Python
Whisper对于中
文
语
音
识别与转写中
文
文
本优化的实践(Python3.10)
阿里的FunAsr对Whisper中
文
领域的转写能力造成了一定的挑战,但实际上,Whisper的使用者完全可以针对中
文
的
语
音
做一些优化的措施,换句话说,Whisper的“默认”形态可能在中
文
领域斗不过
Whisper
语音优化
OpenAI
基于 OpenAI Whisper 模型的实时
语
音
转
文
字工具
· WhisperLive 是一款专注于
音
频处理和创作的开源软件,使用 OpenAI Whisper 模型将
语
音
输入转换为
文
本输出,可以用于转录麦克风的实时
音
频输入和预先录制的
音
频
文
件,为艺术家和
音
乐制作人提供了一个强大的平台
WhisperLive
音频
开源软件
开源
网易(TTS)EmotiVoice:开源
语
音
合成,支持2000多
音
色
你是否曾经想过,如果你能用自己喜欢的声
音
来朗读任何
文
本,那该多好?
EmotiVoice
语音合成
字正腔圆,万国同
音
,coqui-ai TTS跨
语
种
语
音
克隆,钢铁侠讲16国
语
言
本次我们基于coqui-ai TTS的2.0版本来让钢铁侠托尼斯塔克先
生
开口讲16国
语
言。
coqui-ai
TTS
语音
AI+
音
乐|对话 Suno CEO:破圈的
音
乐
生
成产品是如何诞
生
的?
用户可以通过简单的
文
本提示进行创作,
生
成多种
音
乐风格的高质量
音
乐和
语
音
。。
suno
音乐
工具
惊艳推荐!8款好用又免费的
文
本转
语
音
TTS工具
在早期,TTS技术主要依赖于预录制的声
音
样本,通过组合这些样本来
生
成
语
音
。
TTS
Maker
语音
开源
阿里巴巴
语
音
实验室发布开源
语
音
处理框架ClearerVoice-Studio,支持
语
音
增强、分离、目标说话人提取
.01 概述 在日常
生
活和工作中,你是否常因嘈杂的环境、重叠的对话或
音
视频信号的混杂而感到沟通困难?
ClearerVoice-Studio
语音
大模型
“实时”
语
音
翻译!AI
语
音
具有“情绪”!最强开源AI大模型来了
你想把一段
语
音
转成
文
字,或者把一段
文
字转成
语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100