首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 最强国产开源多模态大模型MiniCPM-V:可识别图片、视频,还可在端侧部署
· Kimi+扣子Coze,我零门槛制作了一个好用的智能体Agent | 智能体开发
· 13.5K Star ! Fish Speech Windows本地搭建,能否达到官方的级别?强烈推荐
· 【Stable Diffusion操作升级】Stable Diffusion 常用模型下载与说明
· 包阅AI-免费AI阅读翻译神器!
· 字节跳动最强AI工具 “豆包” ,近1000款应用!一句话自动生成图文,堪比ChatGPT?
· 大模型评测新思路:弱智吧精华问题大全
· 精通结构化提示词:如何精确操控指令的作用域与优先级
· 小白设计师福音:Stable Diffusion 16款插件测评,好用不?推荐吗?
· LangChain手册(Python版)11模块:提示模板
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
开源
OpenAI真的开源了!这波「实时语音」操作,让万物开口说话,我爱了
但现在回想起来,那只麋鹿的“能说会道”,其实正是 OpenAI 今天才正式揭晓的“谜底”——他们开源了一个叫做
嵌
入
式实时语音 SDK 的东西!
OpenAI
嵌入式实时语音
SDK
OCR
Windrecorder:连续记录屏幕内容,通过OCR
技
术
识别记录内容
推荐放在空间富足的分区中),通过终端命令 git clone https://github.com/Antonoko/Windrecorder 下载该工具; 可以打开想要安装的文件夹,在路径栏输
入
cmd
Windrecorder
录屏
Sora
OpenAI Sora视频生成模型
技
术
报告中英全文+总结+影响分析
•
技
术
细节写得比较泛(防止别人模仿)大概就是用视觉块编码(visual patch)的方式,把不同格式的视频统一编码成了用transformer架构能够训练的embeding,然后引
入
类似diffusion
sora
openai
视频生成
微调
四种微调
技
术
详解:SFT 监督微调、LoRA 微调、P-tuning v2、Freeze 监督微调方法
当谈到人工智能大语言模型的微调
技
术
时,我们进
入
了一个令人兴奋的领域。
大模型
换脸
技
术
爆炸!AI一图换脸新王者,Instant ID保姆级安装与使用测评
在SD中有很多人物换脸的新
技
术
,比如像之前的Roop还有ReActor,它们都可以实现仅凭一张图进行人物换脸,后来又出现了EasyPhoto,可以通过快速炼制的小模型来对人物进行模仿。
Instant
ID
文生图
教程
SD
入
门教程六:ControlNet基础
入
门
图片,这张图片会作为 Conditioning 和最开始的 prompt 一起再输
入
到 Stable Diffusion 模型中,从而影响模型生成的图片。
ControlNet
文生图
人工智能
人工智能大语言模型微调
技
术
:SFT 、LoRA 、Freeze 监督微调方法
人工智能大语言模型微调
技
术
:SFT 监督微调、LoRA 微调方法、P-tuning v2 微调方法、Freeze 监督微调方法 1.SFT 监督微调 1.1 SFT 监督微调基本概念 SFT(Supervised
大模型
微调
开源
从声纹模型到语音合成:音频处理 AI
技
术
前沿 | 开源专题 No.45
该项目还提供了其他功能: · MusicGen:一种最新
技
术
实现的可控文本到音乐模型。
AudioCraft
音频
大模型
AI Agent:大模型与场景间的价值之桥,但不适合当纯
技
术
看
一类则是连续的,和周围环境的变化镶
嵌
在一起的的场景。
大模型
万物皆可接
入
DeepSeek,44家接
入
R1的国产平台超详细大盘点
技
术
本身再牛,不能落地都是纸上谈兵。
deepseek
大模型
微调
大语言模型综述<演进,
技
术
路线,区别,微调,实践,潜在问题与讨论>
使用RoPE embeddings:使用的不是绝对或相对位置
嵌
入
,而是RoPE,是因为 RoPE
嵌
入
在长文本上具有更好的性能 , 采用Shared Input-Output Embeddings
大模型
【进阶】-文生图
术
语解释
CUDA# 配合 CUDA
技
术
,显卡可以模拟成一颗 PhysX 物理加速芯片。
文生图
Sora
微软研究团队:Sora核心
技
术
及未来机会研究报告-中英对照版
3.2.3 视频压缩
技
术
图 8: ViT
技
术
将一幅图像分割成多个固定大小的块,对每个块进行线性
嵌
入
,并加
入
位置信息,然后将这些向量序列输
入
标准的 Transformer
sora
论文
开源
clone-voice:一键克隆声音,开源AI
技
术
让声音创作更便捷、更个性化
在当今科
技
飞速发展的时代,声音克隆
技
术
作为人工智能领域的一项重要成果,正逐渐走进我们的生活。
clone-voice
声音克隆
TypeChat
入
门指南
传统模式下,创建自然语言模型界面是一项复杂的任务,通常依赖复杂的决策树来确定意图并收集行动所需的输
入
。
TypeChat
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100