Research

Our research team is dedicated to building a general world model that unifies the digital and physical worlds, empowering human creativity and productivity.

Research

Introducing Vidu S1: Real-Time Interactive Video Generation

Read Paper
Research

Motubrain: An Advanced World Action Model for Robot Control

Read Paper
Research

Motus: A Unified Latent Action World Model

Read Paper
Open Source

TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times

Read Paper
Research

SLA: Beyond Sparsity in Diffusion Transformers via Fine-Tunable Sparse-Linear Attention

Read Paper
Research

Vidar: Embodied Video Diffusion Model for Generalist Manipulation

Read Paper
Research

SageAttention: Accurate 8-Bit Attention for Plug-and-play Inference Acceleration

Read Paper
Research

Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models

Read Paper
Research

One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale

Read Paper
Research

All are Worth Words: A ViT Backbone for Diffusion Models

Read Paper
Research

Analytic-DPM: an Analytic Estimate of the Optimal Reverse Variance in Diffusion Probabilistic Models

Read Paper