Paper Reading

Triple-column logic annotations · paper-logic-reading skill

Title Updated
ChordEdit — One-Step Low-Energy Transport for Image Editing 2026-07-15
CogVideoX — Text-to-Video Diffusion Models with An Expert Transformer 2026-07-15
ControlNet — Adding Conditional Control to Text-to-Image Diffusion Models 2026-07-15
DDPM — Denoising Diffusion Probabilistic Models 2026-07-15
FancyVideo — Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance 2026-07-15
FM — Flow Matching for Generative Modeling 2026-07-15
InnoAds-Composer — Efficient Condition Composition for E-Commerce Poster Generation 2026-07-15
Lay2Story — Extending Diffusion Transformers for Layout-Togglable Story Generation 2026-07-15
MoFu — Scale-Aware Modulation and Fourier Fusion for Multi-Subject Video Generation 2026-07-15
PixArt-α — Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis 2026-07-15
PixArt-δ — Fast and Controllable Image Generation with Latent Consistency Models 2026-07-15
Qihoo-T2X — An Efficient Proxy-Tokenized Diffusion Transformer for Text-to-Any-Task 2026-07-15
Qwen-Image-Agent — Bridging the Context Gap in Real-World Image Generation 2026-07-15
RelaCtrl — Relevance-Guided Efficient Control for Diffusion Transformers 2026-07-15
Stable Diffusion / LDM — High-Resolution Image Synthesis with Latent Diffusion Models 2026-07-15
SD 3 — Scaling Rectified Flow Transformers for High-Resolution Image Synthesis 2026-07-15
U-StyDiT — Ultra-high Quality Artistic Style Transfer Using Diffusion Transformers 2026-07-15
Wan — Open and Advanced Large-Scale Video Generative Models (Wan2.1) 2026-07-15
WISA — World Simulator Assistant for Physics-Aware Text-to-Video Generation 2026-07-15
Your browser is out-of-date!

Update your browser to view this website correctly. Update my browser now

×