首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 国产视频制作之光-可灵:提示词大全整理
· SD入门教程六:ControlNet基础入门
· 大语言模型的拐杖——RLHF基于人类反馈的强化学习
· 【万字长文】LLaMA, ChatGLM, BLOOM的参数高效微调实践
· Stable Diffusion使用Roop插件一键换脸教程
· 10秒换脸,一张图片够了!SD Roop插件教程
· 九个让你成为GPT提示高手的提示词框架
· 大规模中文开源数据集发布!2TB、几十亿条可商用的中文数据集书生·万卷 1.0开源~中文大模型能力可能要更上一层楼了!
· AI绘画:stable difussion SD插件之 无限抽卡神器 dynamic prompts(动态提示词)
· 会“追问”的Agent,大模型知识库另类实践
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
OpenAI
两天star量破千:OpenAI的Whisper被蒸馏后,语
音
识别数倍加速
懂技术的小伙伴也可以寻找其他替代方案,比如语
音
转文字模型 Whisper、文字翻译 GPT、
声
音
克
隆
+ 生成
音
频 so-vits-svc、生成符合
音
频的嘴型视频 GeneFace++dengdeng。
语音
HeyGen
阿里
《嬛嬛朕emo啦》但马斯
克
!阿里这项技术开放试玩
等了7分多钟,刚从北京闪现闪离的马斯
克
,他终于夸我是个人才: ,时长00:03 好了,别骂诈骗,我全都招!
音频
阿里
ComfyUI
ComfyUI初学者指南
ComfyUI 管理器 要安装此自定义节点,请转到PowerShell (Windows) 或终端(Mac) 应用程序中的自定义节点文件夹: cd ComfyUI/custom_nodes 并将节点
克
隆
到本地存储
文生图
comfyui
数字人
数字人直播哪家强?百度、硅基、风平与闪剪四大AI数字人横向评测!
另外的一个要点是
声
音
,选用一款适合的AI
声
音
或用真人语
音
驱动,才能让嘴型准确度达到更好的水平。
数字人
数字分身
数字人
数字人起飞!字节Loopy对口型功能在即梦上线 可根据语境匹配表情和情绪
这个让数字人
声
音
完美匹配画面还匹配表情和情绪的对口型项目已经正式在即梦上线了。
Loopy
视频
开源
语
音
、视频转文字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的语
音
识别模型,它是一种通用的语
音
识别模型,可以用于语
音
识别、语
音
翻译和语言识别等任务。
人工智能
大模型
wisper
大模型
最强开源大模型Llama 3,在扎
克
伯格设想中其实是这样的
视频中,扎
克
伯格不仅聊到了Llama 3模型,还聊到了AI技术创新、元宇宙、开源问题等,可谓干货十足。
Llama
3
大语言模型
AI
音
乐热潮下,“神曲工作室”率先失业
都说今年五一档最难抢票,但这个票,许多乐迷指的是演唱会门票:凤凰传奇、邓紫棋、陈奕迅……越是
声
线特殊、现场力爆棚、感染力强,越是一票难求…… 与此同时,很多
音
乐人却高兴不起来,suno、天工、ACE
音乐
音频
Insanely Fast Whisper:超快的Whisper语
音
识别脚本
项目简介 这篇内容介绍了OpenAI的Whisper Large v2语
音
转录模型的超快速能力。
音频
Whisper
OpenAI
OpenAI大动作:Whisper large-v3重塑语
音
识别技术
这款最新的自动语
音
识别模型不仅在多语言识别方面取得了显著进步,而且还将很快在OpenAI的API中得到支持。
Whisper
语音识别
教程
Suno
音
乐新手指南(手把手完整版教程)
在标记歌曲部分时,尝试一个简短的风格描述和一个名词——应该被听到的乐器或
声
音
。
suno
歌曲
教程
数字人
AI虚拟主播数字人技术实现Wav2Lip
本文主要实现图片说话(如下图的蒙娜丽莎)、视频融合语
音
(这里的核心都是人物口型与
音
频中的语
音
唇形同步)。
数字人
视频
国内厂商语
音
识别与Whisper评测:现状与概况对比
语
音
识别技术不仅可以应用于智能助手、语
音
控制、自动化客服等领域,还有望为残障人士提供更便捷的沟通工具。
语音识别
Faster-Whisper
数字人
划重点!全网最全AI数字人工具合集!
· 选择语
音
:输入文字或录制语
音
,让数字人“说出”你想让他/她表达的内容。
AI
数字人
视频
Prompt | 抖
音
视频脚本
复制脚本并访问 https://beta.elevenlabs.io/speech-synthesis 以生成文本转语
音
。
prompt
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100