首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 国内厂商语音识别与Whisper评测:现状与概况对比
· 玩一玩阿里通义千问开源版,Win11 RTX3060本地安装记录
· 超详细的 Stable Diffusion ComfyUI 基础教程(一):安装与常用插件
· 【爆肝整理】500+ AI 最佳提示词
· 40个prompt,让你成为麦肯锡高手
· 超级干货,自学stable diffusion,看完这篇就够了
· 学会这招,一个头像变100种风格!
· SD入门教程三:采样器及参数调整
· 7.1k Star!RAGFlow:最新开源OCR+深度文档理解的RAG引擎、大海捞针测试、降低幻觉、服务化API集成进业务!
· Coze、Dify、FastGPT:哪款智能体平台最强?深度对比分析!
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
人工智能
6个AI
音
乐软件推荐,让你学会人工智能AI作曲
在当下的应用中,AI已经可以影响
音
乐制作过程的各个方面,包括
音
乐生成、
音
频掌握等。
训练
音乐
腾讯
AI助手App“腾讯元宝”已上线应用商店
腾讯混元文生图大模型支持中英文双语输入及理解,无论是中文的古诗词、民间俚语,还是英文的文学作品、科技文章,都能得到精准的理解和生动的呈现 腾讯元宝还允许用户创建个人智能体,用户可以在创建过程中让AI自动生成智能体相关信息,并支持
克
隆
声
音
腾讯元宝
开源
GPT-4o实时语
音
方案提供商Livekit开源voice agent:轻松处理
音
视频流
轻松访问 LiveKit WebRTC 会话并处理或生成
音
频、视频和数据流。
voice
agent
开源
音视频
开源
开源免费离线语
音
识别神器whisper如何安装
whisper介绍 Open AI在2022年9月21日开源了号称其英文语
音
辨识能力已达到人类水准的Whisper神经网络,且它亦支持其它98种语言的自动语
音
辨识。
wisper
翻译
免费
开源
【开源项目】Flow Matching 语
音
合成
CFM是一种新技术,已被证明可以改进扩散模型,Meta的Voicebox模型将CFM引入语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
打造
音
乐传奇:Suno推出
音
乐生成模型Suno V3,让每个人都能成为作曲家
,以下是歌词: 在远方的天际线,火光划破宁静夜, 硝烟弥漫,战鼓
声
,撕裂和平的幻灭。
suno
歌曲
音乐
开源
有感情的语
音
合成开源模型:ChatTTS安装使用详解
ChatTTS是一个为对话场景设计的语
音
生成模型,专门用于大型语言模型(LLM)助手的对话任务、对话语
音
和视频介绍等应用。
ChatTTS
语音合成
开源
有道开源的国产语
音
库EmotiVoice爆火了!具有情绪控制功能的语
音
合成引擎!
接下面让我们看看这款国产语
音
库为何如何迅速的火遍大江南北的🔥!
EmotiVoice
语音库
Stable Diffusion
小白设计师福
音
:Stable Diffusion 16款插件测评,好用不?推荐吗?
#65039;⭐️⭐️ 能做什么:Ultimate SD Upscale 是一款强大的图像超分辨率工具,可用于将低分辨率图像提升到高分辨率、减少噪
声
和模糊
SD
插件
文生图
Agent
深度好文,Agent盛行前传
第六是模仿能力(imitation),它和概括能力相似的点是它们同属基础能力,好的模仿能力能够促进语言、知识和运动技能的提升,“元能力”(参考“元认知”,我来给它起了个名字),行为
克
隆
和观察式学习是习得模仿能力的两种途径
Agent
大模型
开源
9.4k Star!MemGPT:伯
克
利大学最新开源、将LLM作为操作系统、无限上下文记忆、服务化部署自定义Agent
加州大学伯
克
利分校的研究人员发明了这个技术,灵感来自于电脑操作系统怎样管理内存的。
MemGPT
大语言模型
开发语
音
产品时设计唤醒词和命令词的技巧
命令词中字的
音
节较长且相邻汉字的
声
韵母区分度越大越好; 3.
语音产品
唤醒词
命令词
被高估的Pika,被低估的多模态AI
例如,在医疗领域可以通过结合图像、录
音
和病历文本,提供更准确的诊断和治疗方案;在交通领域,结合图像和传感器数据,带来更智能、更安全的自动驾驶体验;在教育领域,将文本、
声
音
、视频相结合,呈现更具互动性的教育内容
大模型
多模态
Stable Diffusion
SD入门教程一:Stable Diffusion 基础(技术篇)
),顾名思义,它就是能预测出随机图里包含什么噪
音
的模型。
Stable
Diffusion
文生图
大模型
大模型RAG检索增强问答如何评估:噪
声
、拒答、反事实、信息整合四大能力评测任务探索
为此,噪
声
鲁棒性测试根据所需的噪
声
比,将外部文档包含一定数量噪
声
文档的实例包含在内。
大模型
RAG检索增强
<
...
2
3
4
5
6
7
8
9
10
11
...
>
1
2
4
5
6
7
8
9
100