Han-Bit Kang

hbkang

AI & ML interests

Recent Activity

updated a collection 7 days ago

cool-papers

upvoted a paper 7 days ago

Byte Latent Transformer: Patches Scale Better Than Tokens

updated a collection 7 days ago

artistic rendering

View all activity

Organizations

None yet

hbkang's activity

upvoted 3 papers 7 days ago

upvoted a paper 14 days ago

APOLLO: SGD-like Memory, AdamW-level Performance

Paper • 2412.05270 • Published 18 days ago • 38

upvoted a paper 16 days ago

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation

Paper • 2412.04448 • Published 19 days ago • 9

upvoted 3 papers about 1 month ago

Differential Transformer

Paper • 2410.05258 • Published Oct 7 • 168

BLIP3-KALE: Knowledge Augmented Large-Scale Dense Captions

Paper • 2411.07461 • Published Nov 12 • 21

Acoustic Volume Rendering for Neural Impulse Response Fields

Paper • 2411.06307 • Published Nov 9 • 5

upvoted a paper about 2 months ago

Learning Video Representations without Natural Videos

Paper • 2410.24213 • Published Oct 31 • 15

upvoted 2 papers 2 months ago

DAWN: Dynamic Frame Avatar with Non-autoregressive Diffusion Framework for Talking Head Video Generation

Paper • 2410.13726 • Published Oct 17 • 10

Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis

Paper • 2410.08261 • Published Oct 10 • 49

upvoted a paper 3 months ago

FAN: Fourier Analysis Networks

Paper • 2410.02675 • Published Oct 3 • 24

upvoted 3 papers 4 months ago

Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation

Paper • 2409.04410 • Published Sep 6 • 23

The VoxCeleb Speaker Recognition Challenge: A Retrospective

Paper • 2408.14886 • Published Aug 27 • 9

CSGO: Content-Style Composition in Text-to-Image Generation

Paper • 2408.16766 • Published Aug 29 • 17

upvoted a paper 6 months ago

Grokfast: Accelerated Grokking by Amplifying Slow Gradients

Paper • 2405.20233 • Published May 30 • 6

upvoted a paper 8 months ago

COCONut: Modernizing COCO Segmentation

Paper • 2404.08639 • Published Apr 12 • 27

upvoted a paper 10 months ago

EMO: Emote Portrait Alive - Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions

Paper • 2402.17485 • Published Feb 27 • 190

upvoted 2 papers 11 months ago

LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation

Paper • 2402.05054 • Published Feb 7 • 25

YOLO-World: Real-Time Open-Vocabulary Object Detection

Paper • 2401.17270 • Published Jan 30 • 35