首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 国产视频制作之光-可灵:提示词大全整理
· SD入门教程六:ControlNet基础入门
· 大语言模型的拐杖——RLHF基于人类反馈的强化学习
· 【万字长文】LLaMA, ChatGLM, BLOOM的参数高效微调实践
· Stable Diffusion使用Roop插件一键换脸教程
· 10秒换脸,一张图片够了!SD Roop插件教程
· 九个让你成为GPT提示高手的提示词框架
· 大规模中文开源数据集发布!2TB、几十亿条可商用的中文数据集书生·万卷 1.0开源~中文大模型能力可能要更上一层楼了!
· AI绘画:stable difussion SD插件之 无限抽卡神器 dynamic prompts(动态提示词)
· 会“追问”的Agent,大模型知识库另类实践
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
OpenAI
马斯
克
怒告OpenAI案解密:Ilya看到了什么?125万亿参数Q*细节曝光,53页PDF全网疯转
刚刚,Sam Altman罕见地发
声
了,连发两条推文。
OpenAI
大模型
解读wav2lip:探究语
音
驱动唇部动作的技术原理!
具体来说,wav2lip的训练流程如下:首先,提取
音
频特征,将
音
频特征与人脸图像进行配对,形成一个
音
频-图像对,然后训练专家
音
频和口型同步判别器。
wav2lip
语音
腾讯
AI助手App“腾讯元宝”已上线应用商店
腾讯混元文生图大模型支持中英文双语输入及理解,无论是中文的古诗词、民间俚语,还是英文的文学作品、科技文章,都能得到精准的理解和生动的呈现 腾讯元宝还允许用户创建个人智能体,用户可以在创建过程中让AI自动生成智能体相关信息,并支持
克
隆
声
音
腾讯元宝
「语
音
转换新速度」— 探秘Whisper JAX的70倍速提升
在AI的众多分支中,语
音
识别技术的突破性进展尤为引人瞩目。
Whisper
语音识别
开源
GPT-4o实时语
音
方案提供商Livekit开源voice agent:轻松处理
音
视频流
轻松访问 LiveKit WebRTC 会话并处理或生成
音
频、视频和数据流。
voice
agent
开源
音视频
教程
用so-vits-svc-4.1进行
音
色转换的极简教程!
其实歌
声
转换不仅仅适用于歌
声
,普通讲话也可以,只是歌唱的
音
调基本能覆盖到低、中、高全域
声
音
类型,而正常说话可能无法做到全域覆盖,但是如果在录制
声
音
的时候能够做到覆盖多种
音
调类型,也可以实现
声
音
转换。
so-vits-svc
音色转换
教程
OpenAI
基于 OpenAI Whisper 模型的实时语
音
转文字工具
· WhisperLive 是一款专注于
音
频处理和创作的开源软件,使用 OpenAI Whisper 模型将语
音
输入转换为文本输出,可以用于转录麦
克
风的实时
音
频输入和预先录制的
音
频文件,为艺术家和
音
乐制作人提供了一个强大的平台
WhisperLive
音频
开源软件
RAG
RAG 2.0来了,它能成为生产落地的福
音
吗?
RAG 2.0方法就是
克
服这样的局部优化办法,通过将预训练、微调和对齐所有组件形成一个统一系统,通过反向传播同时优化语言模型和检索器,以最大化系统性能。
RAG
大模型
人工智能
6个AI
音
乐软件推荐,让你学会人工智能AI作曲
在当下的应用中,AI已经可以影响
音
乐制作过程的各个方面,包括
音
乐生成、
音
频掌握等。
训练
音乐
开源
【开源项目】Flow Matching 语
音
合成
CFM是一种新技术,已被证明可以改进扩散模型,Meta的Voicebox模型将CFM引入语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
开源
开源免费离线语
音
识别神器whisper如何安装
whisper介绍 Open AI在2022年9月21日开源了号称其英文语
音
辨识能力已达到人类水准的Whisper神经网络,且它亦支持其它98种语言的自动语
音
辨识。
wisper
翻译
免费
开发语
音
产品时设计唤醒词和命令词的技巧
命令词中字的
音
节较长且相邻汉字的
声
韵母区分度越大越好; 3.
语音产品
唤醒词
命令词
开源
9.4k Star!MemGPT:伯
克
利大学最新开源、将LLM作为操作系统、无限上下文记忆、服务化部署自定义Agent
加州大学伯
克
利分校的研究人员发明了这个技术,灵感来自于电脑操作系统怎样管理内存的。
MemGPT
大语言模型
打造
音
乐传奇:Suno推出
音
乐生成模型Suno V3,让每个人都能成为作曲家
,以下是歌词: 在远方的天际线,火光划破宁静夜, 硝烟弥漫,战鼓
声
,撕裂和平的幻灭。
suno
歌曲
音乐
懒人福
音
!用AI生成会议纪要,让你的工作更高效!
**环境适应性**:AI系统可以在各种噪
声
环境下工作,不受会议室环境的影响。
会议纪要
AI工具
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100