首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 第一性原理以及第一性原理是怎么帮马斯克成为首富的
· 爆火的“哄哄模拟器”,它是如何炼成的?Prompt泄漏了
· 从第一性原理看大模型Agent技术
· ComfyUI官方使用手册【官网直译+关键补充】
· 芯片拼接技术:英伟达新核弹,站在苹果的肩膀上
· AI声音克隆 | 最全最简教程(权威版)
· Github上Star数最多的大模型应用基础服务:Dify 深度解读
· 生成式AI与大语言模型的区别
· 自己电脑上跑大语言模型(LLM)要多少内存?
· 深入解析 Mistral AI 的 Mixtral 8x7B 开源MoE大模型
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
大
语
言
模
型
的拐杖——RLHF基于人类反馈的强化学习
这些
模
型
使用
大
规
模
的神经网络,可以生成自然
语
言文本,例如对话和文章。
大模型
训练
心理
MindChat心理
大
模
型
模
型
介绍 心理
大
模
型
——漫谈(MindChat)期望从心理咨询、心理评估、心理诊断、心理治疗四个维度帮助人们纾解心理压力与解决心理困惑, 提高心理健康水平.
心理大模型
开源
网易有道强力开源中英双
语
语
音
克隆
torchaudio pip install numpy numba scipy transformers==4.26.1 soundfile yacs g2p_en jieba pypinyin 准备
模
型
文件
语音
开源
开源
【开源项目】Flow Matching
语
音
合成
CFM是一种新技术,已被证明可以改进扩散
模
型
,Meta的Voicebox
模
型
将CFM引入
语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
「
语
音
转换新速度」— 探秘Whisper JAX的70倍速提升
在AI的众多分支中,
语
音
识别技术的突破性进展尤为引人瞩目。
Whisper
语音识别
百
模
大
战,谁是
大
模
型
的裁判员?
定义了树-邻接
语
法(TAG)的阿拉文德·乔西(Aravind Joshi)教授,曾提出过“如果没有基准来评估
模
型
,就像不造望远镜的天文学家想看星星。”
大模型
LLM
一文汇总
大
语
言
模
型
LLM所有prompt提示词框架的论文出处
能够让
大
模
型
推理结果变得更好的基础优化手段已经非常多了,这里梳理了常见的提示技术手段和对应的论文: - Zero-shot(零样本提示):https://arxiv.org/abs/2109.01652
prompt
提示词
Prompt
大
语
言
模
型
定制化应用的三种方式:Prompt engineering、Fine tuning、Pre-trainning的区别
在实现
大
语
言
模
型
的定制化应用中,的确有几种常用的方式:Prompt Engineering(提示工程)、Fine-tuning(微调)和Pre-training(预训练)。
大模型
解读wav2lip:探究
语
音
驱动唇部动作的技术原理!
二、 本文方法介绍 wav2lip
模
型
的训练分为两个阶段,第一阶段是专家
音
频和口
型
同步判别器预训练;第二阶段是GAN网络训练。
wav2lip
语音
开源
开源免费离线
语
音
识别神器whisper如何安装
Whisper系统所提供的自动
语
音
辨识(Automatic Speech Recognition,ASR)
模
型
是被训练来运行
语
音
辨识与翻译任务的,它们能将各种
语
言的
语
音
变成文本,也能将这些文本翻译成英文
wisper
翻译
免费
RVC和SVC声
音
模
型
难找?推荐这个网站
本篇文章介绍:1, 声
音
数据集训练到
模
型
的过程 2 ,SVC和RVC声
音
模
型
网站推荐 一、声
音
数据集训练到
模
型
的过程 AI声
音
模
型
训练是通过分析
大
量
音
频数据来学习声
音
特性,生成与目标声
音
相似的新
音
频
声音克隆
数字人
如何避免
大
语
言
模
型
绕过知识库乱答的情况?LlamaIndex 原理与应用简介
LlamaIndex 介绍 LlamaIndex(也称为 GPT Index)是一个用户友好的接口,它将外部数据连接到
大
型
语
言
模
型
(Large Language Models)。
大语言模型
「
语
音
识别的未来已来」——探索Distil-Whisper,轻量级AI的强
大
力量
在AI技术的浪潮中,一款新
型
的
语
音
识别
模
型
Distil-Whisper以其独特的魅力和强
大
的性能脱颖而出。
Distil-Whisper
语音识别
开源
有道开源的国产
语
音
库EmotiVoice爆火了!具有情绪控制功能的
语
音
合成引擎!
前不久小圈为
大
家介绍过 Coqui 文本转
语
音
(Text-to-Speech,TTS)
模
型
,相比较市面上原有的开源TTS
模
型
,Coqui 有其独特的优势,也受到了广
大
科技互联网爱好者的青睐
EmotiVoice
语音库
国内厂商
语
音
识别与Whisper评测:现状与概况对比
一、
语
音
识别现状 二、评测意义与预期成果 三、评测方案 四、评测结果 一、
语
音
识别现状 得益于近年来深度学习技术的快速发展,人工智能的主要分支(图像、
语
音
、自然
语
言处理等)都相继进入了
大
规
模
落地应用阶段
语音识别
Faster-Whisper
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100