首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 国内外开源大语言模型一览表
· AI必备Prompt技巧《提问的艺术——让AI导出高质量答案》
· 硬核解读Stable Diffusion(系列一)
· 掌握这10个AI 工具用1小时完成别人1周的工作
· 7.1k Star!RAGFlow:最新开源OCR+深度文档理解的RAG引擎、大海捞针测试、降低幻觉、服务化API集成进业务!
· 如何下载及使用通义千问7B开源大模型
· 惊艳推荐!8款好用又免费的文本转语音TTS工具
· 使用python调用comfyui-api,实现出图自由
· Stable Diffusion生成美女正向词和反向词示例
· 比 Roop 和 Reactor 更像!IP Adapter 新模型为任何人做写真
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
开源
生成式
AI
领域拓展!MetaAI开源AudioCraft:一个支持AudioGen、MusicGen等模型的
音
频生成开发框架
音
乐
可能是最具挑战性的
音
频类型,因为它由局部和长程模式组成,从一系列
音
符到具有多种
乐
器的全局
音
乐
结构。
开源模型
开源
阿里巴巴语
音
实验室发布开源语
音
处理框架ClearerVoice-Studio,支持语
音
增强、分离、目标说话人提取
虽然
音
频技术日新月异,但许多现有方案在复杂场景中仍难以提供稳定且高质量的
音
频体验。
ClearerVoice-Studio
语音
开源
开源语
音
大语言模型来了!阿里基于Qwen-Chat提出Qwen-Audio!
作为一种重要模态,语
音
提供了超越文本的多样且复杂的信号,如人声中的情感、语调和意图,自然声
音
中的火车汽笛、钟声和雷声,以及
音
乐
中的旋律。
大模型
语音
数字人
数字人之声
音
克隆:无样本,1分钟样本完美克隆声
音
,开源
零样本文本到语
音
(TTS): 输入 5 秒的声
音
样本,即刻体验文本到语
音
转换。
数字人
声音克隆
GPT-SoVITS
开源
语
音
、视频转文字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的语
音
识别模型,它是一种通用的语
音
识别模型,可以用于语
音
识别、语
音
翻译和语言识别等任务。
人工智能
大模型
wisper
「语
音
识别的未来已来」——探索Distil-Whisper,轻量级
AI
的强大力量
在
AI
技术的浪潮中,一款新型的语
音
识别模型Distil-Whisper以其独特的魅力和强大的性能脱颖而出。
Distil-Whisper
语音识别
语
音
克隆又又又又又升级了
之前在前面的文章中有介绍,克隆你的声
音
,只需要你三秒的录
音
,声
音
克隆又进化了!
Meta
语音生成
开源
十大开源语
音
识别项目
这项技术在多个领域有着广泛的应用,包括但不限于语
音
助手、语
音
搜索、自动转写以及语
音
命令识别。
语音识别
开源项目
OpenAI
OpenAI大动作:Whisper large-v3重塑语
音
识别技术
这款最新的自动语
音
识别模型不仅在多语言识别方面取得了显著进步,而且还将很快在OpenAI的API中得到支持。
Whisper
语音识别
实时语
音
克隆
项目简介 这份内容介绍了实时语
音
克隆的技术实现,作者通过将说话者验证技术转移到多说话人文本到语
音
合成(SV2TTS)来实现语
音
克隆。
语音
克隆
视频
AI
视频新技能!这套流程教你打造视频人物和声
音
完美同步!
目前,在
AI
生成视频这个环节,已经发展的越来越快,各种技术也越来越成熟,从文字直接生成视频已经可以快速实现下面这样有复杂场景的视频,再结合更完善的故事脚本、对话,更复杂的视频效果都是可以畅想的。
AI视频
工具
TTS它又来了!OpenVoice:一款借鉴于TTS实现的强大的
AI
语
音
克隆工具!
各种
AI
工具也层出不穷,其中 语
音
克隆技术 也是尤为引人瞩目的产品之一。
tts
文本转语音
GLM-4-Voice 9B——实时多语言语
音
对话
AI
——几分钟内即可在本地安装
如何设置 GLM-4-Voice 9B 以实现无缝的实时语
音
交互,支持英语和中文,并探索其独特的架构、低延迟响应和可定制的声
音
属性。
GLM-4-Voice
9B
语音
安装
视频
Prompt | 抖
音
视频脚本
复制脚本并访问 https://beta.elevenlabs.io/speech-synthesis 以生成文本转语
音
。
prompt
解读wav2lip:探究语
音
驱动唇部动作的技术原理!
具体来说,wav2lip的训练流程如下:首先,提取
音
频特征,将
音
频特征与人脸图像进行配对,形成一个
音
频-图像对,然后训练专家
音
频和口型同步判别器。
wav2lip
语音
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100
Ai助理
Hello 👏🏻
我是 Ai助理,关于ai的问题你可以问我
北京天气怎么样啊
明天北京的天气预报还没更新,请您稍等一下,我帮您查一下。明天北京的天气预报还没更新,请您稍等一下,我帮您查一下。
表头
表头
表头
表头
表头
表头
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
内容
试着问问
How can I get access to post?How can I get
How can I get access to post?How can I get