首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 读取大脑重建高清视频,Stable Diffusion还能这么用
· AI绘画 | Midjourney高质量肖像提示词的写法(附50+肖像提示词prompt)
· 百度智能云的Prompt模板
· stable diffusion API 调用,超级详细代码示例和说明
· 你要牢记的四个常用AI提示词框架:ICIO、CRISPE、BROKE、RASCEF,有助于获取更加稳定和高质量的内容
· 产品运营全流程SOP
· 测评了8个国产AI大模型,差点崩溃……
· 阿里AI黑科技大揭秘:从通义千问到FaceChain,让图片和视频焕发新生!
· 产品经理必会的3大流程:业务流程、功能流程、页面流程(附案例)
· 国产视频制作之光-可灵:提示词大全整理
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
心理
MindChat心理
大
模
型
模
型
介绍 心理
大
模
型
——漫谈(MindChat)期望从心理咨询、心理评估、心理诊断、心理治疗四个维度帮助人们纾解心理压力与解决心理困惑, 提高心理健康水平.
心理大模型
深入探秘:百川7B
大
模
型
的训练代码解析,揭秘巨无霸
语
言
模
型
背后的奥秘
之前几期讲了
大
模
型
的一些部署相关,非常基础,感兴趣的同学可以参考下: 手把手教你部署和理解
大
模
型
,超详细步骤,包教包会!
大模型
百
模
大
战,谁是
大
模
型
的裁判员?
定义了树-邻接
语
法(TAG)的阿拉文德·乔西(Aravind Joshi)教授,曾提出过“如果没有基准来评估
模
型
,就像不造望远镜的天文学家想看星星。”
大模型
解读wav2lip:探究
语
音
驱动唇部动作的技术原理!
二、 本文方法介绍 wav2lip
模
型
的训练分为两个阶段,第一阶段是专家
音
频和口
型
同步判别器预训练;第二阶段是GAN网络训练。
wav2lip
语音
开源
网易有道强力开源中英双
语
语
音
克隆
torchaudio pip install numpy numba scipy transformers==4.26.1 soundfile yacs g2p_en jieba pypinyin 准备
模
型
文件
语音
开源
开源
【开源项目】Flow Matching
语
音
合成
CFM是一种新技术,已被证明可以改进扩散
模
型
,Meta的Voicebox
模
型
将CFM引入
语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
从零开始学习
大
模
型
-第二章-
大
模
型
学习路线
随着技术的进步,
大
模
型
如OpenAI的GPT-4和Sora、Google的BERT和Gemini等已经展现出了惊人的能力-从理解和生成自然
语
言到创造逼真的图像及视频。
大模型
学习
大
语
言
模
型
的拐杖——RLHF基于人类反馈的强化学习
这些
模
型
使用
大
规
模
的神经网络,可以生成自然
语
言文本,例如对话和文章。
大模型
训练
LLM
一文汇总
大
语
言
模
型
LLM所有prompt提示词框架的论文出处
能够让
大
模
型
推理结果变得更好的基础优化手段已经非常多了,这里梳理了常见的提示技术手段和对应的论文: - Zero-shot(零样本提示):https://arxiv.org/abs/2109.01652
prompt
提示词
Prompt
大
语
言
模
型
定制化应用的三种方式:Prompt engineering、Fine tuning、Pre-trainning的区别
在实现
大
语
言
模
型
的定制化应用中,的确有几种常用的方式:Prompt Engineering(提示工程)、Fine-tuning(微调)和Pre-training(预训练)。
大模型
「
语
音
转换新速度」— 探秘Whisper JAX的70倍速提升
在AI的众多分支中,
语
音
识别技术的突破性进展尤为引人瞩目。
Whisper
语音识别
开源
【TTS
语
音
克隆开源最强王者】5款爆火开源
模
型
(Fish、F5、GPT、CosyVoice、MaskGCT)效果对比,等你来评!
MaskGCT
模
型
介绍
大
型
文本到
语
音
(TTS)系统通常被分为自回归和非自回归系统。
语音克隆
开源模型
开源
开源免费离线
语
音
识别神器whisper如何安装
Whisper系统所提供的自动
语
音
辨识(Automatic Speech Recognition,ASR)
模
型
是被训练来运行
语
音
辨识与翻译任务的,它们能将各种
语
言的
语
音
变成文本,也能将这些文本翻译成英文
wisper
翻译
免费
「
语
音
识别的未来已来」——探索Distil-Whisper,轻量级AI的强
大
力量
在AI技术的浪潮中,一款新
型
的
语
音
识别
模
型
Distil-Whisper以其独特的魅力和强
大
的性能脱颖而出。
Distil-Whisper
语音识别
RVC和SVC声
音
模
型
难找?推荐这个网站
本篇文章介绍:1, 声
音
数据集训练到
模
型
的过程 2 ,SVC和RVC声
音
模
型
网站推荐 一、声
音
数据集训练到
模
型
的过程 AI声
音
模
型
训练是通过分析
大
量
音
频数据来学习声
音
特性,生成与目标声
音
相似的新
音
频
声音克隆
数字人
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100