arxivcs.CLcs.CVcs.LG2026-07-14
Text2Sign: A Single-GPU Diffusion Baseline for Text-to-Sign Language Video Generation
Sign language is a primary communication channel for millions of Deaf and hard-of-hearing people, yet text-to-signer video generation remains costly because video diffusion models are expensive to train and evaluate. This paper presents Text2Sign, a text-conditioned diffusion mod…