首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 国内厂商语音识别与Whisper评测:现状与概况对比
· 玩一玩阿里通义千问开源版,Win11 RTX3060本地安装记录
· 超详细的 Stable Diffusion ComfyUI 基础教程(一):安装与常用插件
· 【爆肝整理】500+ AI 最佳提示词
· 40个prompt,让你成为麦肯锡高手
· 超级干货,自学stable diffusion,看完这篇就够了
· 学会这招,一个头像变100种风格!
· SD入门教程三:采样器及参数调整
· 7.1k Star!RAGFlow:最新开源OCR+深度文档理解的RAG引擎、大海捞针测试、降低幻觉、服务化API集成进业务!
· Coze、Dify、FastGPT:哪款智能体平台最强?深度对比分析!
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
懒人福
音
!用AI生成会议纪要,让你的工作更高效!
**环境适应性**:AI系统可以在各种噪
声
环境下工作,不受会议室环境的影响。
会议纪要
AI工具
数字人
一款构建AI数字人项目开源了!自动实现
音
视频同步!
本周GitHub项目圈选: 主要包含
音
视频同步、多代理框架、3D对象模型、适用于开发者的演示文档构建工具、网页程序打包、自构建CRUD应用等热点项目。
AI数字人
音视频同步
Stable Diffusion
stable diffusion最全18种controlnet模型,详细教程讲解。
等到年底的时候做一个最全面的视频和文字讲解,现在还是在等等,目前AI领域热度确实是在持续降温,但是呢,深入了解AI的人都知道,AI的发展不是想人一样需要很长时间的积累,有时候可能就是一个算法的突破,就能应用到文字,图像
声
音
等
Stable
Diffusion
文生图
controlnet
大模型
惊了,ChatGLM、Vicuna 等热门大模型丝滑 input,跟所有的下载上传说拜拜
public/datasets 公共教程 「公共教程」模版汇聚超过 100 个经典及流行教程,用户只需点击「
克
隆
下载
VividTalk:用一张照片和一段
音
频让人物栩栩如生地说话
最新的突破来自VividTalk项目,这是一个能够将单张照片和一段
音
频结合起来,创造出仿佛真人在说话的视频的技术。
VividTalk
视频
数字人
数字人直播哪家强?中国数字人平台分析大全
这类软件被许多公司和个人所需,尤其是那些从事抖
音
、快手和视频号等平台的公司,它们需要高质量的数字人技术来提升内容创作和用户互动体验。
数字分身
数字人
Python
Whisper对于中文语
音
识别与转写中文文本优化的实践(Python3.10)
阿里的FunAsr对Whisper中文领域的转写能力造成了一定的挑战,但实际上,Whisper的使用者完全可以针对中文的语
音
做一些优化的措施,换句话说,Whisper的“默认”形态可能在中文领域斗不过
Whisper
语音优化
人工智能
2023年人工智能行业总结
而变
声
模型vits和文本转语
音
TTS的发展,也让GPT有了耳朵和嘴巴。
人工智能
AGI
思考总结
DeepMusic发布“和弦派”2.0:重塑AI
音
乐创作范式,赋予创作者全方位掌控
4月29日,国内领先的人工智能
音
乐服务商DeepMusic,发布了自主研发的AI
音
乐工作站——“和弦派”2.0正式版。
和弦派
DeepMusic
音乐创作
开源
OpenAI 开源语
音
识别 Whisper 的使用体验怎么样?
关于Buzz Buzz 是一款基于 OpenAI 开源 Whisper 自动语
音
识别模型的软件工具,能够将
音
频或视频中的语
音
自动识别为带有时间戳的文本字幕。
生成式AI
开源
从 GPT-4o 到 LiveKit:实时语
音
交互的开源实现
今天我们来聊聊OpenAI 发布会提到的实时对话语
音
技术。
GPT-4o
语音交互
开源
生成式AI领域拓展!MetaAI开源AudioCraft:一个支持AudioGen、MusicGen等模型的
音
频生成开发框架
音
乐可能是最具挑战性的
音
频类型,因为它由局部和长程模式组成,从一系列
音
符到具有多种乐器的全局
音
乐结构。
开源模型
开源
OpenAI真的开源了!这波「实时语
音
」操作,让万物开口说话,我爱了
以前,智能玩具里只能播放预设的程序和
声
音
,顶多就是进行一两轮简单提问,你可以理解成是“单向输出”,现在有了这个 openAI 的实时语
音
软件开发包,就变成了“双向交互”,能和你进行实时的语
音
对话。
OpenAI
嵌入式实时语音
SDK
人工智能
【AI科技大创意】2024年人工智能10大趋势
人工智能最终将在来年解锁语
音
优先的应用程序,特别是在伴侣和生产力类别中。
人工智能
趋势
智谱AI静悄悄的上线了一大波新模型,过年了,真的
原创 数字生命卡兹
克
数字生命卡兹
克
2024年08月29日 21:56 北京 智谱今天下午在KDD 2024上面,悄咪咪的上线了一堆的超级更新。
智谱AI
大模型
<
...
3
4
5
6
7
8
9
10
11
12
...
>
1
2
4
5
6
7
8
9
100