arxivcs.CV2026-07-11
CoSAG: Compact Semantic Anchor Gaussians via Training-Free Rate-Distortion Coding
Yuang Jia, Jinlong Wang, Junhong Lin, Ruiting Dai, Wei Gao
Open-vocabulary 3D scene understanding is commonly achieved by embedding 2D vision-language features such as CLIP into a 3D Gaussian Splatting scene, turning it into a text-queryable semantic field. However, attaching a high-dimensional feature to each of millions of Gaussians in…