首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 13.5K Star ! Fish Speech Windows本地搭建,能否达到官方的级别?强烈推荐
· 2023年人工智能行业总结
· GitHub狂飙3万star的LLM公开资料 - 大模型入门教程
· 各个语种互相翻译:Meta推出NLLB-200 AI模型,可实现200种语言互译
· AI领域的agent是什么意思?
· 「长文」可能是目前最全的LangChain AI资源库之一
· ChatGPT提示词万能模板:BRTR原则,让ChatGPT完美理解你的需求
· 它来了!SDXL + ControlNet 终于强强联合!
· 万字长篇!超全Stable Diffusion AI绘画参数及原理详解
· 如何将 GPT 幻觉发生率从 20% 以上降低到 2% 以下
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
开源
从 GPT-4o 到 LiveKit:实时
语
音
交
互
的开源实现
LiveKit 支持
语
音
、视频和数据流处理,内置了自动
语
音
识别(ASR)和文本转
语
音
(TTS)功能,简化了
语
音
到文本和文本到
语
音
的转换过程。
GPT-4o
语音交互
大模型
Westlake - Omni:西湖心辰推出的全球首个开源的中文情感端 - 端
语
音
交
互
大模型
语
音
交
互
作为人机
交
互
的重要方式之一,也在不断演进和创新。
Westlake
-
Omni
语音
大模型
推荐智能体:利用大模型进行
交
互
式推荐
另一方面,大型
语
言模型(LLM)代表了人工通用智能的重大进步,展示了在指令理解、常识推理和人机
交
互
方面的卓越能力。
大语言模型
推荐
OpenAI
【
语
音
识别】OpenAI
语
音
力作Whisper
这么多的标注数据使得我们可以直接在 有监督
语
音
识别任务上预训练Whisper,从标注
音
频转录数据中直接习得
语
音
到文本的映射。
语音转文字
whisper
Meta
各个
语
种
互
相翻译:Meta推出NLLB-200 AI模型,可实现200种
语
言
互
译
官方对外宣称,这是全球第一个以单一模型对应多数
语
言翻译的设计,希望借此能够帮助更多人在社群平台上进行跨
语
言
互
动,同时,也能提高未来元宇宙中的
互
动体验。
翻译
大模型
Agent
AI Agent的数字化革命:超越文本,走向自主决策与
交
互
AI Agent和ChatGPT、Claude等LLM(大
语
言模型)有什么区别呢?
生成式AI
关于AI声
音
生成的一切(
语
音
+
音
乐+嘴型)
PRETSSEL是一个表达性单元到
语
音
生成器,能够有效地从
语
音
中分离
语
义和表达性成分,并转移话
语
级别的表达性,如个人的声
音
风格。
声音
工具
WeChatpy:Python中优秀的微信开发库,与微信官方接口
交
互
的工具
微信作为中国最受欢迎的社
交
平台之一,拥有庞大的用户群体和丰富的功能。
WeChatpy
开发库
开源
清华&面壁开源新一代主动Agent
交
互
范式!让AI从被命令到主动帮助
而近期清华大学联合面壁智能等团队提出了开创性的新一代主动 Agent
交
互
范式(ProActive Agent),为 AI
交
互
带来了突破性的解决方案(下图 1 右侧所示)。
Agent
大模型
开源
网易(TTS)EmotiVoice:开源
语
音
合成,支持2000多
音
色
你是否曾经想过,如果你能用一句简单的提示来控制你的
语
音
合成器,那该多方便?
EmotiVoice
语音合成
字正腔圆,万国同
音
,coqui-ai TTS跨
语
种
语
音
克隆,钢铁侠讲16国
语
言
按照固有的思维方式,如果想要
语
音
克隆首先得有克隆对象具体的
语
言
语
音
样本,换句话说,克隆对象必须说过某一种
语
言的话才行,但现在,coqui-ai TTS V2.0版本做到了,真正的跨
语
种无需训练的
语
音
克隆技术
coqui-ai
TTS
语音
工具
AI文本转
语
音
工具(TTS):MeloTTS
今天给大家介绍一个效果不错的开源文本转
语
音
工具:MeloTTS MeloTTS是一个可以把文字转换成声
音
的工具,它支持英
语
、西班牙
语
、法
语
、中文、日
语
和韩
语
等多种
语
言。
MeloTTS
语音工具
比尔盖茨最新预言:AI智能体颠覆计算机
交
互
体验甚至软件行业
智能体不仅会改变每个人与计算机
交
互
的方式。
AI智能体
开源
阿里巴巴
语
音
实验室发布开源
语
音
处理框架ClearerVoice-Studio,支持
语
音
增强、分离、目标说话人提取
它集成了先进的
语
音
增强(Speech Enhancement)、
语
音
分离(Speech Separation)和
音
视频扬声器提取(Audio-Video Speaker Extraction)功能,能够在嘈杂环境中清理
音
频
ClearerVoice-Studio
语音
大模型
“实时”
语
音
翻译!AI
语
音
具有“情绪”!最强开源AI大模型来了
(先别急着骂,我们先看看产品) 你是否遇到过这样的情况: 你想和一个说不同
语
言的人
交
流,但是你不会他的
语
言!
大模型
开源模型
语音
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100