Menu

  • Home
  • Trending
  • Recommended
  • Latest

分类目录

  • AI 工具
  • AI新势力
  • XiaoHu.AI 学院
    • AI 教程
    • AI 课程
  • XiaoHu.AI日报
  • 开源项目案例库
    • AI 论文
    • AI 资源
    • AI 项目
XiaoHu.AI学院
  • Home
  • AI 工具
  • XiaoHu.AI 学院
    • AI 教程
    • AI 课程
  • XiaoHu.AI日报
  • 开源项目案例库
    • AI 论文
    • AI 资源
    • AI 项目
  • 加入会员
  • →社群
No Result
View All Result
  • Login
XiaoHu.AI学院
No Result
View All Result
Home 开源项目案例库 AI 论文

Stable Diffusion 3论文:一种新的多模态扩散变换器(MMDiT)架构

by 小互
2024年3月6日
in AI 论文
0 0
0
Stable Diffusion 3论文:一种新的多模态扩散变换器(MMDiT)架构
0
SHARES
76
VIEWS
Share on FacebookShare on Twitter

Stability AI发布了关于Stable Diffusion 3(SD3)的研究论文,揭示了这一最新模型的技术细节。SD3在诸如DALL·E 3、Midjourney v6、Ideogram v1等先进的文本到图像生成系统中,在字体渲染和命令遵循方面根据人类偏好评估取得了更好的表现。SD3引入了一种新的多模态扩散变换器(MMDiT)架构,使用独立的权重集处理图像和语言表示,比以前的版本在文本理解和拼写能力上有所提高。

Support authors and subscribe to content

This is premium stuff. Subscribe to read the entire article.

Login if you have purchased

加入会员

加入会员查看更多会员内容和教程。
超过1000+的会员内容,每天更新。
开通会员

Related Posts

Meta AI提出了一种新的语言模型架构“Large Concept Model (LCM)  让模型更像人类思考
XiaoHu.AI日报

Meta AI提出了一种新的语言模型架构“Large Concept Model (LCM) 让模型更像人类思考

2024年12月25日
483
阿里巴巴推出QVQ-72B 一个基于Qwen2-VL-72B的新型多模态推理模型
XiaoHu.AI日报

阿里巴巴推出QVQ-72B 一个基于Qwen2-VL-72B的新型多模态推理模型

2024年12月25日
337
Fireworks AI新功能 能够将图像或PDF等非文本内容转化为LLM可理解的结构化文本
AI 工具

Fireworks AI新功能 能够将图像或PDF等非文本内容转化为LLM可理解的结构化文本

2024年12月24日
449
Hume AI推出全能文本与语音引擎 OCTAVE 根据文本实时生成特定人格特质的声音
XiaoHu.AI日报

Hume AI推出全能文本与语音引擎 OCTAVE 根据文本实时生成特定人格特质的声音

2024年12月24日
278
Anthropic 公布了一种全新的 AI 越狱技术 可以轻松破解所有前沿模型
AI 论文

Anthropic 公布了一种全新的 AI 越狱技术 可以轻松破解所有前沿模型

2024年12月23日
616
INFP:基于音频驱动的双人对话中的互动头像生成  能自动区分谁在说话,谁在听
AI 项目

INFP:基于音频驱动的双人对话中的互动头像生成 能自动区分谁在说话,谁在听

2024年12月22日
428

Recommendeds

SuperCraft:通过无限工作流画布 将草图直接转换成真实产品图像 并自动生成3D渲染

SuperCraft:通过无限工作流画布 将草图直接转换成真实产品图像 并自动生成3D渲染

1.3k VIEWS
2024年8月26日
使用 PoSE 将 Llama 8B模型的上下文长度从8k扩展到64k

使用 PoSE 将 Llama 8B模型的上下文长度从8k扩展到64k

75 VIEWS
2024年4月27日
MeloTTS:支持中英混合发音 的多语言文本到语音(TTS)库

MeloTTS:支持中英混合发音 的多语言文本到语音(TTS)库

333 VIEWS
2024年2月27日
Fashion-VDM:通过给定的服装图像和人物视频 生成一段虚拟试穿视频

Fashion-VDM:通过给定的服装图像和人物视频 生成一段虚拟试穿视频

427 VIEWS
2024年11月13日
教程:教您如何轻松将任意视频一键合成到任意背景上 附工作流下载

教程:教您如何轻松将任意视频一键合成到任意背景上 附工作流下载

587 VIEWS
2024年8月19日

Meta将在Ray-Ban眼镜中加入快速识别任何物体的AI功能

184 VIEWS
2024年4月1日
PicMenu:利用AI可视化你的菜单 你只需拍一下菜单 即可将你的菜名生成对应的图片

PicMenu:利用AI可视化你的菜单 你只需拍一下菜单 即可将你的菜名生成对应的图片

346 VIEWS
2024年11月25日
科学家研究出一种新方法 只需涂抹特殊溶液 就能使活体动物的组织变得透明

科学家研究出一种新方法 只需涂抹特殊溶液 就能使活体动物的组织变得透明

125 VIEWS
2024年9月6日

2023-12-21 18:02:32 Twitter

5 VIEWS
2024年3月6日
Linly-Dubbing:一个开源的多语言AI配音和视频翻译工具

Linly-Dubbing:一个开源的多语言AI配音和视频翻译工具

594 VIEWS
2024年8月16日

Copyright (c) 2024 by Xiaohu.AI.

  • About
  • Contact

Welcome Back!

Login to your account below

Forgotten Password?

Retrieve your password

Please enter your username or email address to reset your password.

Log In

Add New Playlist

No Result
View All Result
  • Home
  • AI 工具
  • XiaoHu.AI 学院
    • AI 教程
    • AI 课程
  • XiaoHu.AI日报
  • 开源项目案例库
    • AI 论文
    • AI 资源
    • AI 项目
  • 加入会员
  • →社群
  • Login

© 2024 Xiaohu.AI

Are you sure want to unlock this post?
Unlock left : 0
Are you sure want to cancel subscription?
转到手机版