首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 使用这个工具后,我将 RAG 的准确性和召回率都提高了两倍!
· 硬核解读Stable Diffusion(系列三)
· 大模型狂飙两年后,“六小龙”开始做减法
· ChatGPT写论文指令全集
· 微软研究团队:Sora核心技术及未来机会研究报告-中英对照版
· AI绘画:InstantID Win11本地安装记录!
· 这个数字人开源项目太牛了,非常全面的项目解决方案(含源码)
· 你要牢记的四个常用AI提示词框架:ICIO、CRISPE、BROKE、RASCEF,有助于获取更加稳定和高质量的内容
· 通俗解读大模型微调(Fine Tuning)
· RAG检索增强技术在知识库智能检索场景下的应用实践
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
AI绘画Stable-Diffusion风格化实战
在社交软件和短
视
频
平台上,我们时常能看到各种特色鲜明的
视
觉效果,比如卡通化的图片和中国风的
视
频
剪辑。
Stable-Diffusion
文生图
开源
F5-TTS:上海交大开源超逼真声
音
克隆TTS,告别ElevenLabs,以后就用它了!实测真的很牛
音
频
克隆的开源项目很多,但是每次项目里要用的时候,总还是惦记着11labs的api。
F5-TTS
音频克隆
开源
十大开源语
音
识别项目
这项技术在多个领域有着广泛的应用,包括但不限于语
音
助手、语
音
搜索、自动转写以及语
音
命令识别。
语音识别
开源项目
开源
SD3 正式开源 Sora同源架构
2月16日伴随着OpenAI世界大模型Sora的发布,stability_ai也发布了其最新的模型Stablediffusion3,如果说一个是
音
视
频
方向
SD3
绘画
了解Kimi必看的26个问题 | Kimi系列文(二)
了解到,目前的GenAI有文本类、
视
频
类、绘图类、
音
频
类、编程类、PPT、数字人、AI搜索等形式。
Kimi
大语言模型
字正腔圆,万国同
音
,coqui-ai TTS跨语种语
音
克隆,钢铁侠讲16国语言
按照固有的思维方式,如果想要语
音
克隆首先得有克隆对象具体的语言语
音
样本,换句话说,克隆对象必须说过某一种语言的话才行,但现在,coqui-ai TTS V2.0版本做到了,真正的跨语种无需训练的语
音
克隆技术
coqui-ai
TTS
语音
Sora
Stablediffusion3论文下载-确定了Stablediffusion3与Sora的架构是一致的
2月16日伴随着OpenAI世界大模型Sora的发布,stability_ai也发布了其最新的模型Stablediffusion3,如果说一个是
音
视
频
方向
SD
论文
语
音
克隆又又又又又升级了
早在今年6月,Meta曾经推出过VoiceBox,能直接从文本生成高质量语
音
,不需要任何
音
频
样本作为训练数据,可能是基于对
音
频
Deepfake的担忧,一向秉承开源的Meta并未向工作开放VoiceBox
Meta
语音生成
ComfyUI
教会AI画汉字(ComfyUI篇)
最近,央
视
公开了一些由ai生成的图片与
视
频
,其中有几张图片非常有趣,成功吸引到了我, 那便是这几张由ai与文字相结合的图片,这种奇妙的效果令我十分好奇,于是我便开始找寻相关的插件来达成类似的效果
comfyui
文生图
OpenAI
OpenAI大动作:Whisper large-v3重塑语
音
识别技术
这款最新的自动语
音
识别模型不仅在多语言识别方面取得了显著进步,而且还将很快在OpenAI的API中得到支持。
Whisper
语音识别
教程
Suno
音
乐新手指南(手把手完整版教程)
为方便更多
音
乐爱好者使用AI创作
音
乐,中国AIGC产业联盟(AIGCxChina)发起了Suno爱好者社群并编写了以下指南。
suno
歌曲
教程
人工智能
AI产品经理
视
角:如何构建人工智能产品
虽然它们都提供了令人兴奋的研究
视
角,但现实生活中的产品需要将数据、模型和人机交互结合到一个连贯的系统中。
大模型
产品经理
AI拟声: 5秒内克隆您的声
音
音
频
剪辑和制作:对于
音
频
制作人员来说,MockingBird也是一个强大的工具。
声音克隆
开源
Stable Diffusion
Stable Diffusion 快速创作角色三
视
图
天分享分享如何通过 Stable Diffusion 快速创造出角色三
视
图。
SD
三视图
文生图
实时语
音
克隆
项目简介 这份内容介绍了实时语
音
克隆的技术实现,作者通过将说话者验证技术转移到多说话人文本到语
音
合成(SV2TTS)来实现语
音
克隆。
语音
克隆
<
...
3
4
5
6
7
8
9
10
11
12
...
>
1
2
4
5
6
7
8
9
100