Han-Bit Kang's picture

61 21

Han-Bit Kang

hbkang

·

AI & ML interests

ML

Recent Activity

updated a collection 5 days ago

full-body-generation

upvoted a paper 6 days ago

Pippo: High-Resolution Multi-View Humans from a Single Image

updated a collection 6 days ago

full-body-generation

View all activity

Organizations

None yet

hbkang's activity

upvoted a paper 6 days ago

Pippo: High-Resolution Multi-View Humans from a Single Image

Paper • 2502.07785 • Published 7 days ago • 9

upvoted a paper 9 days ago

ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features

Paper • 2502.04320 • Published 12 days ago • 33

upvoted a paper 12 days ago

LayerTracer: Cognitive-Aligned Layered SVG Synthesis via Diffusion Transformer

Paper • 2502.01105 • Published 15 days ago • 18

upvoted a paper 14 days ago

OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models

Paper • 2502.01061 • Published 15 days ago • 178

upvoted 7 papers about 1 month ago

SynthLight: Portrait Relighting with Diffusion Model by Learning to Re-render Synthetic Faces

Paper • 2501.09756 • Published Jan 16 • 19

Tensor Product Attention Is All You Need

Paper • 2501.06425 • Published Jan 11 • 84

MangaNinja: Line Art Colorization with Precise Reference Following

Paper • 2501.08332 • Published Jan 14 • 57

Infecting Generative AI With Viruses

Paper • 2501.05542 • Published Jan 9 • 13

The GAN is dead; long live the GAN! A Modern GAN Baseline

Paper • 2501.05441 • Published Jan 9 • 88

LLaVA-Mini: Efficient Image and Video Large Multimodal Models with One Vision Token

Paper • 2501.03895 • Published Jan 7 • 49

2.5 Years in Class: A Multimodal Textbook for Vision-Language Pretraining

Paper • 2501.00958 • Published Jan 1 • 99

upvoted a paper about 2 months ago

PERSE: Personalized 3D Generative Avatars from A Single Portrait

Paper • 2412.21206 • Published Dec 30, 2024 • 18

upvoted 5 papers 2 months ago

Byte Latent Transformer: Patches Scale Better Than Tokens

Paper • 2412.09871 • Published Dec 13, 2024 • 92

Wonderland: Navigating 3D Scenes from a Single Image

Paper • 2412.12091 • Published Dec 16, 2024 • 16

ColorFlow: Retrieval-Augmented Image Sequence Colorization

Paper • 2412.11815 • Published Dec 16, 2024 • 26

APOLLO: SGD-like Memory, AdamW-level Performance

Paper • 2412.05270 • Published Dec 6, 2024 • 38

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation

Paper • 2412.04448 • Published Dec 5, 2024 • 10

upvoted 3 papers 3 months ago

Differential Transformer

Paper • 2410.05258 • Published Oct 7, 2024 • 171

BLIP3-KALE: Knowledge Augmented Large-Scale Dense Captions

Paper • 2411.07461 • Published Nov 12, 2024 • 22

Acoustic Volume Rendering for Neural Impulse Response Fields

Paper • 2411.06307 • Published Nov 9, 2024 • 5