Name: OpenDiT
Brand: OpenDiT
Availability: InStock

OpenDiT是一个开源项目，提供了一个基于Colossal-AI的Diffusion Transformer(DiT)的高性能实现，专为增强DiT应用（包括文本到视频生成和文本到图像生成）的训练和推理效率而设计。OpenDiT通过以下技术提升性能：在GPU上高达80%的加速和50%的内存减少；包括FlashAttention、Fused AdaLN和Fused layernorm核心优化；包括ZeRO、Gemini和DDP的混合并行方法，还有对ema模型进行分片进一步降低内存成本；FastSeq：一种新颖的序列并行方法，特别适用于DiT等工作负载，其中激活大小较大但参数大小较小；单节点序列并行可以节省高达48%的通信成本；突破单个GPU的内存限制，减少整体训练和推理时间；通过少量代码修改获得巨大性能改进；用户无需了解分布式训练的实现细节；完整的文本到图像和文本到视频生成流程；研究人员和工程师可以轻松使用和调整我们的流程到实际应用中，无需修改并行部分；在ImageNet上进行文本到图像训练并发布检查点。

OpenDiT

产品详情

主要功能

适用人群

快速访问

所属分类

相关推荐

ComfyUI-PyramidFlowWrapper

ComfyUI LLM Party

x-flux-comfyui

ComfyUI-GGUF

x-flux

Alpha-VLLM

ComfyUI-Sub-Nodes

MG-LLaVA

AsyncDiff

ComfyUI-Hallo

ComfyUI-LuminaWrapper

EVE

ComfyUI Ollama

JavaVision

llava-llama-3-8b-v1_1

MiniGemini