Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026VASC: Value-Aware Sparse Attention with Cross-Layer Memory for Efficient 3D Reconstruction Junyi Wu, Fanqing Kong, Leyang Chen, Shaoqiu Zhang, Yulun Zhang tl;dr: value contrast guides block selection; cross-layer memory tracks unserved demand arxiv.org/abs/2610.01013 000
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026tl;dr: order-invariant querying->align embedding space of the queries and the global context 000
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026ARROW: Arbitrary Reconstruction and Tracking of 4D Observations in the Wild @ifradlin.bsky.social, Christian Schmidt, Jens Piekenbrinck, @karimknaebel.bsky.social, Gonzalo Martin Garcia, Bastian Leibe arxiv.org/abs/2610.01314 100
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026EvenSplat: Coupled 2D-3D Decomposition for Gaussian Splatting under Exposure and Illumination Variation Tongyu Wu, Jacob Edwards, Ziteng Cui, Caigui Jiang, Cheng Wang tl;dr: image-space decomposition optimized together with the Gaussian representation arxiv.org/abs/2610.01876 010
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026CLoSeR: Closing the Loop for Long-Context Streaming Reconstruction Moyang Li, Zihan Zhu, Wei Zhang, @marcpollefeys.bsky.social, @danielbarath.bsky.social tl;dr: LoGeR + loop closure arxiv.org/abs/2610.01927 011
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026tl;dr: physicalsemantic reasoning + world modeling + action prediction 000
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026UniWAM: Unified World-Action Model Jiayi Chen, Wenxuan Song, Jingbo Wang, Shuai Zhou, Xicheng Gong, Zehua Fan, Ziyang Zhou, Junwu E, Haodong Yan, Fuhao Li, Qize Yu, Xu Huang, Pengwei Wang, Wen Chen, Shunbo Zhou, Haoang Li arxiv.org/abs/2610.02054 100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026Ziren Gong, Guo Chen, Yongjia Li, Yihua Shao, Fabio Tosi, Stefano Mattoccia, @mattpoggi.bsky.social, Hao Tang, Fei Ma, Shuyan Li, Ziyang Yan, Nicu Sebe, Ling Shao, Jianfei Cai, Qi Tian, Ming-Hsuan Yang 000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026Reconstructing the Dynamic World: A Representation-Centric View of 4D Scene Reconstruction tl;dr: survey arxiv.org/abs/2609.39960 100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026tl;dr: chordal initialization->arbitrary matrix Lie groups; Kronecker reduction + Nested-Dissection-based gauge-fixing + back-substitution 000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026FAST-Sync: Fast Group Synchronization for any Matrix Lie Group Shane Holmes, Yiran Luo, Firat Taxpulat, David M. Rosen, @fdellaert.bsky.social arxiv.org/abs/2609.38594 100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026LBDU-VIO: Learned Bias Dynamics and Uncertainty for Visual-Inertial Odometry with Unreliable Vision Qizhi Guo, Junning Lyu, Defu Lin, Shaoming He tl;dr: ODE model->continuous time bias dynamics; IMU uncertainty model->measurement noise covariance arxiv.org/abs/2609.39125 000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026Efficient Multi-Modal Planning with Reward-Guided Preference Optimization for Autonomous Driving Chenglin Chen, Lujia Wang, Xinhu Zheng, Jun Ma, Haoang Li tl;dr: sparse anchors + an offset module to refine trajectories arxiv.org/abs/2609.38862 000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026tl;dr: augment action-only WAM with a causal semantic expert built on V-JEPA 2.1 000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026CSWAM: Better Causal Semantic Representations for Out-of-Distribution Generalization in World Action Models Tianbin Liu, Jian Zhu, Taiyi Su, Jianjun Zhang, Chong Ma, Zitai Huang, Weiyi Lu, Yi Xu arxiv.org/abs/2609.18462 100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026Discrete Forcing: Infusing Discrete Guidance into Continuous Denoising for Few-Step Action Experts Jingbo Wang, Wenxuan Song, Wenhao Yu, Han Zhao, Xi Wang, Jiayi Chen, Donglin Wang, Yan Wang, Haoang Li tl;dr: in title arxiv.org/abs/2609.39526 000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026A QCQP-Representable IMU Pre-Integration Factor for Certifiable State Estimation Utkarsh Rai, Zhexin Xu, Bang-Shien Chen, David Rosen tl;dr: Cayley map->IMU pre-integration factor in quadratic formulation; redundant constraint in rotation/wedge/translation arxiv.org/abs/2609.38048 000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026Pow3R-SLAM: Real-Time RGB-D SLAM with 3D Reconstruction Priors Christopher Kolios, Ishaan Mehta, Sasa Janjic, Yeganeh Bahoo, Sajad Saeedi tl;dr: MASt3R-SLAM + depth prior arxiv.org/abs/2609.38054 000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026tl;dr: treat synchronized camera observations as geometrically related projections of one physical world 000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026MVG-WAM: Multiple View Geometry-Aware World-Action Modeling for Robotic Manipulation Wenbo Chen, Tianfu Li, Haoxuan Xu, Zhihao Cao, Zhenghan Chen, Zhengming Zhu, Zizhou Luo, Guosheng Yang, Yuan Liu, Lujia Wang, Wen Chen, Haoang Li arxiv.org/abs/2609.37793 100
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026tl;dr: optimal transport of the quaternion flows using smooth spherical linear interpolation->unit-quaternion constraint 010
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026QuacamFM: Quaternion-Constrained Flow Matching for Camera Pose Estimation Bao-Long Tran, Cuong Le, Tahereh Dehdarirad, Fredrik Viksten, Per-Erik Forssén arxiv.org/abs/2609.32455 120
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026From Feed-Forward to Flow: Unifying Reconstruction and Generation Is Easier Than You Think Haoru Wang, Qianfan Shen, Kai Ye, Wenzheng Chen, Baoquan Chen tl;dr: shared clean-target predictor->feed-forward reconstruction and conditional generation arxiv.org/abs/2609.32761 010
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026Many Eyes, One World: Feed-Forward 3D Reconstruction from Mixed Cameras Qiaoge Li, Yifan Zhan, Haijun Yang, Haiyang Liu, Yiyi Cai, Chenchi Luo tl;dr: perspective, fisheye and full-panorama images in a single forward pass arxiv.org/abs/2609.35658 021
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026tl;dr: replace iterative future imagination with a single-step predictive latent for efficient future-aware action prediction 000
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026SLIP-VLA: Single-Step Latent Imagination for Policy Learning in Vision-Language-Action Models Tianfu Li, Haoxuan Xu, Wenbo Chen, Haitian Li, Changchuan Yang, Xinhu Zheng, Jun Ma, Yuan Liu, Lujia Wang, Haoang Li arxiv.org/abs/2609.33575 100
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026Light Field Primitive for Novel View Synthesis Liang Chen, Jiahui Ning, Xun Jiang, Xing Xu, Jimmy Ren, Fenglei Fan, Heng Tao Shen tl;dr: scene->primitives defined in two-plane parameterization arxiv.org/abs/2609.31198 000
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026VkVIO: Cross-platform GPU Acceleration for Visual-Inertial Odometry with Vulkan Ole Hoffmann, Mateo de Mayo, @dcremers.bsky.social tl;dr: Basalt->Vulkan arxiv.org/abs/2609.30459 000
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026tl;dr: representation complexity scales with unique physical geometry rather than frame count 000
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations Ayush Jain, Sreeharsha Paruchuri, Ishita Gupta, Fan Zhang, Tanner Schmidt, Jakob Engel, Katerina Fragkiadaki, Adam W. Harley arxiv.org/abs/2609.30222 100
Zhenjun Zhao @ericzzj.bsky.social · 24/09/2026DAVIO: Dense Monocular-Inertial SLAM with Feed-Forward Initialization and Pose-Conditioned Mapping Jaafar Mahmoud, Arthur Movsesyan, Mikhail Iumanov, Sergey Kolyubin tl;dr: DAv3 + OpenVINS arxiv.org/abs/2609.27702 000
Zhenjun Zhao @ericzzj.bsky.social · 24/09/2026Kairos: Grounded Forecasting of Presence and Directional Flow in 4D Scene Graphs Iacopo Catalano, Julio A. Placed, @jcivera.bsky.social, Jorge Peña Queralta tl;dr: 3DSG->predictive directional-flow memory->4DSG arxiv.org/abs/2609.27467 000
Zhenjun Zhao @ericzzj.bsky.social · 23/09/2026Dual Covariance Gaussian Splatting SLAM: Decoupling Rendering and Registration for Robust Real-Time Tracking Edward Beng Wai Tan, Siew-Kei Lam tl;dr: each Gaussian has tracking/mapping covariances shared with mean arxiv.org/abs/2609.25746 010
Zhenjun Zhao @ericzzj.bsky.social · 23/09/2026NaCR: Visual Localization via NeRF-aided Camera Ray Regression Yesheng Zhang, Xiang Dai, Xu Zhao, Chongyang Zhang tl;dr: NeRF + CRR arxiv.org/abs/2609.25907 000
Zhenjun Zhao @ericzzj.bsky.social · 23/09/2026MatcherCompass: A Deployment-Aware Benchmark to Guide Image Matcher Selection in the Wild Hyunwoo Kim, @giseopkim.bsky.social tl;dr: in title arxiv.org/abs/2609.25688 000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026RegVGGT: Sustainable Visual Geometry Grounding for Streaming via Regulated Memory Hongbo Mao, Junjun Jiang, Youyu Chen, Jiaxin Zhang, Zhemeng Dong, Xianming Liu tl;dr: retain at most 1% tokens per frame to update the context memory arxiv.org/abs/2609.23286 000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026tl;dr: cross-resolution depth refine + DINO-guided view-consistent learning + diffusion-based iterative Gaussian refinement 000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026D3GS: Depth, DINO, and RGB Diffusion Co-Guided 3D Gaussian Splatting for Sparse-View Reconstruction Yunqi Gao, Zhanfeng Liao, Hanzhang Tu, Zhaoqi Su, Guoqing Zheng, Songtao Wang, Hongwen Zhang, Zhou Xue, Leyuan Liu, Yebin Liu arxiv.org/abs/2609.22941 110
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026VGGT-Prime: Compute-Adaptive Mixture-of-Heads for Efficient Visual Geometry Transformers Abteen Arab, Guile Wu, Chengjie Huang, Dongfeng Bai tl;dr: router->three computation modes for each global-attention head->mean pooling/surrogate attention/softmax attention arxiv.org/abs/2609.23733 000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026Elevator-VIGS: Separating Elevator Motion from Robot Motion in Visual-Inertial Gaussian Splatting SLAM Rui Zhou, Zihan Zhu, Wei Zhang, Zizhou Luo, Norbert Haala, @marcpollefeys.bsky.social tl;dr: VIGS-SLAM->elevator rides arxiv.org/abs/2609.23491 000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026BayesianGS-SLAM: Uncertainty-Aware Neural Rendering SLAM via Probabilistic Formulation Kyeongsu Kang, Seongbo Ha, Sibaek Lee, Hyeonwoo Yu tl;dr: sensor-noise uncertainty + opacity-induced map-representation uncertainty->mapping, tracking, keyframe selection arxiv.org/abs/2609.24140 010
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026A Topological Representation with Object-Path Graphs for Open-Vocabulary Instance Navigation Linwei Zheng, Daojie Peng, Bingtao Wang, Haoang Li, Jun Ma tl;dr: object graph->semantic reasoning; path graph->spatial traversal arxiv.org/abs/2609.24189 000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026tl;dr: ranslation-invariant VP consistency residual + line epipolar residual + line-normal projection residual 000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026Robust Structureless Monocular Visual Inertial Initialization Exploiting Line Features and Vanishing Points Junwan Choi, Woongrae Jo, Dong-Uk Seo, Jinwoo Jeon, Hyun Myung arxiv.org/abs/2609.21186 100
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026tl;dr: cross-window attention at key layers; register tokens->cross-attention->camera tokens 000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026Think Locally, Refine Globally for Memory-Efficient 3D Reconstruction Jingke Zhou, Chenhang Ma, Zhizhou Zhong, Mingkai Liu, Zhuang Zhou, Yicheng ji, Binghua Su, Bo Cai, Xianliang Huang arxiv.org/abs/2609.21437 100
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026VoxelTTO: Voxel-Aligned Feed-Forward 3D Gaussian Splatting with Test-Time Optimization Yibin Zhao, Yihan Pan, Yangwen Li, Jun Nan, Jianjun Yi tl;dr: in title arxiv.org/abs/2609.21498 000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026Info3R: Information-Adaptive Test-Time Training for 3D Reconstruction Sunghyun Baek, Hanna Bae, Minchan Kwon, Junmo Kim tl;dr: each frame’s importance->adjust earning rate; cumulative learning rate + prediction confidence->state reset arxiv.org/abs/2609.21938 000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026SFVO: Decoupled Confidence-Guided Stereo-Flow Visual Odometry with Bidirectional PnP Kai Zhang, Guoyang Zhao, Jun Ma tl;dr: disparity and optical flow are converted into forward and backward 3D–2D constraints arxiv.org/abs/2609.21754 000
Zhenjun Zhao @ericzzj.bsky.social · 18/09/2026tl;dr: distil geometric priors through LoRA adaptation; hybrid-weight sparse ray-field optimization 000