扩散模型 技术
扩散模型是一类通过逐步去噪从随机噪声中生成数据的生成式模型。
大模型 · 万物互联 · 人工智能的结构化知识库。人人可阅读、可贡献、可追溯。
扩散模型是一类通过逐步去噪从随机噪声中生成数据的生成式模型。
AIGC 指利用人工智能自动生成文本、图像、音频、视频等内容的生产方式。
Whisper 是 OpenAI 开源的鲁棒多语种语音识别与翻译任务模型。
Midjourney 是专注于高质量艺术化图像生成的商业化 AI 工具。
Sora 是 OpenAI 发布的文生视频大模型,可生成长达一分钟的高保真视频。
文生视频是指根据文本提示自动生成连续视频片段的人工智能生成技术。
DALL·E 是 OpenAI 开发的由文本描述生成图像的生成式模型系列。
Stable Diffusion 是基于潜在扩散的开放文生图模型,可由文本生成高质量图像。
CLIP 是 OpenAI 提出的通过图文对比学习将图像与文本映射到统一语义空间的模型。
多模态大模型指能够同时理解与生成文本、图像、音频等多种模态信息的人工智能模型。
混合专家模型通过路由网络在每次推理中仅激活部分专家子网络以提升参数效率。
思维链是一种通过让模型逐步推理来提升复杂任务表现的提示技术。
上下文学习指大语言模型无需更新参数,仅凭提示中的示例即可完成新任务的能力。
RLHF 是利用人类偏好反馈训练奖励模型并用强化学习优化语言模型的对齐方法。
指令微调是在预训练模型上使用(指令, 回答)数据继续训练,以增强遵循指令能力的方法。