Sign in

Zhenjun Zhao

@ericzzj.bsky.social
1.4K followers 554 following 1.9K posts

ericzzj1989.github.io Postdoc@UniZar | PhD@CUHK | 3D vision, SLAM, Image matching (github.com/ericzzj1989/Awesome-Glob…)

PostsRepliesMedia
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
VASC: Value-Aware Sparse Attention with Cross-Layer Memory for Efficient 3D Reconstruction Junyi Wu, Fanqing Kong, Leyang Chen, Shaoqiu Zhang, Yulun Zhang tl;dr: value contrast guides block selection; cross-layer memory tracks unserved demand arxiv.org/abs/2610.01013
000
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
tl;dr: order-invariant querying->align embedding space of the queries and the global context
000
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
ARROW: Arbitrary Reconstruction and Tracking of 4D Observations in the Wild @ifradlin.bsky.social, Christian Schmidt, Jens Piekenbrinck, @karimknaebel.bsky.social, Gonzalo Martin Garcia, Bastian Leibe arxiv.org/abs/2610.01314
100
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
EvenSplat: Coupled 2D-3D Decomposition for Gaussian Splatting under Exposure and Illumination Variation Tongyu Wu, Jacob Edwards, Ziteng Cui, Caigui Jiang, Cheng Wang tl;dr: image-space decomposition optimized together with the Gaussian representation arxiv.org/abs/2610.01876
010
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
CLoSeR: Closing the Loop for Long-Context Streaming Reconstruction Moyang Li, Zihan Zhu, Wei Zhang, @marcpollefeys.bsky.social, @danielbarath.bsky.social tl;dr: LoGeR + loop closure arxiv.org/abs/2610.01927
011
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
tl;dr: physicalsemantic reasoning + world modeling + action prediction
000
Zhenjun Zhao @ericzzj.bsky.social · 02/10/2026
UniWAM: Unified World-Action Model Jiayi Chen, Wenxuan Song, Jingbo Wang, Shuai Zhou, Xicheng Gong, Zehua Fan, Ziyang Zhou, Junwu E, Haodong Yan, Fuhao Li, Qize Yu, Xu Huang, Pengwei Wang, Wen Chen, Shunbo Zhou, Haoang Li arxiv.org/abs/2610.02054
100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
Ziren Gong, Guo Chen, Yongjia Li, Yihua Shao, Fabio Tosi, Stefano Mattoccia, @mattpoggi.bsky.social, Hao Tang, Fei Ma, Shuyan Li, Ziyang Yan, Nicu Sebe, Ling Shao, Jianfei Cai, Qi Tian, Ming-Hsuan Yang
000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
Reconstructing the Dynamic World: A Representation-Centric View of 4D Scene Reconstruction tl;dr: survey arxiv.org/abs/2609.39960
100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
tl;dr: chordal initialization->arbitrary matrix Lie groups; Kronecker reduction + Nested-Dissection-based gauge-fixing + back-substitution
000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
FAST-Sync: Fast Group Synchronization for any Matrix Lie Group Shane Holmes, Yiran Luo, Firat Taxpulat, David M. Rosen, @fdellaert.bsky.social arxiv.org/abs/2609.38594
100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
LBDU-VIO: Learned Bias Dynamics and Uncertainty for Visual-Inertial Odometry with Unreliable Vision Qizhi Guo, Junning Lyu, Defu Lin, Shaoming He tl;dr: ODE model->continuous time bias dynamics; IMU uncertainty model->measurement noise covariance arxiv.org/abs/2609.39125
000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
Efficient Multi-Modal Planning with Reward-Guided Preference Optimization for Autonomous Driving Chenglin Chen, Lujia Wang, Xinhu Zheng, Jun Ma, Haoang Li tl;dr: sparse anchors + an offset module to refine trajectories arxiv.org/abs/2609.38862
000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
tl;dr: augment action-only WAM with a causal semantic expert built on V-JEPA 2.1
000
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
CSWAM: Better Causal Semantic Representations for Out-of-Distribution Generalization in World Action Models Tianbin Liu, Jian Zhu, Taiyi Su, Jianjun Zhang, Chong Ma, Zitai Huang, Weiyi Lu, Yi Xu arxiv.org/abs/2609.18462
100
Zhenjun Zhao @ericzzj.bsky.social · 01/10/2026
Discrete Forcing: Infusing Discrete Guidance into Continuous Denoising for Few-Step Action Experts Jingbo Wang, Wenxuan Song, Wenhao Yu, Han Zhao, Xi Wang, Jiayi Chen, Donglin Wang, Yan Wang, Haoang Li tl;dr: in title arxiv.org/abs/2609.39526
000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026
A QCQP-Representable IMU Pre-Integration Factor for Certifiable State Estimation Utkarsh Rai, Zhexin Xu, Bang-Shien Chen, David Rosen tl;dr: Cayley map->IMU pre-integration factor in quadratic formulation; redundant constraint in rotation/wedge/translation arxiv.org/abs/2609.38048
000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026
Pow3R-SLAM: Real-Time RGB-D SLAM with 3D Reconstruction Priors Christopher Kolios, Ishaan Mehta, Sasa Janjic, Yeganeh Bahoo, Sajad Saeedi tl;dr: MASt3R-SLAM + depth prior arxiv.org/abs/2609.38054
000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026
tl;dr: treat synchronized camera observations as geometrically related projections of one physical world
000
Zhenjun Zhao @ericzzj.bsky.social · 30/09/2026
MVG-WAM: Multiple View Geometry-Aware World-Action Modeling for Robotic Manipulation Wenbo Chen, Tianfu Li, Haoxuan Xu, Zhihao Cao, Zhenghan Chen, Zhengming Zhu, Zizhou Luo, Guosheng Yang, Yuan Liu, Lujia Wang, Wen Chen, Haoang Li arxiv.org/abs/2609.37793
100
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026
tl;dr: optimal transport of the quaternion flows using smooth spherical linear interpolation->unit-quaternion constraint
010
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026
QuacamFM: Quaternion-Constrained Flow Matching for Camera Pose Estimation Bao-Long Tran, Cuong Le, Tahereh Dehdarirad, Fredrik Viksten, Per-Erik Forssén arxiv.org/abs/2609.32455
120
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026
From Feed-Forward to Flow: Unifying Reconstruction and Generation Is Easier Than You Think Haoru Wang, Qianfan Shen, Kai Ye, Wenzheng Chen, Baoquan Chen tl;dr: shared clean-target predictor->feed-forward reconstruction and conditional generation arxiv.org/abs/2609.32761
010
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026
Many Eyes, One World: Feed-Forward 3D Reconstruction from Mixed Cameras Qiaoge Li, Yifan Zhan, Haijun Yang, Haiyang Liu, Yiyi Cai, Chenchi Luo tl;dr: perspective, fisheye and full-panorama images in a single forward pass arxiv.org/abs/2609.35658
021
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026
tl;dr: replace iterative future imagination with a single-step predictive latent for efficient future-aware action prediction
000
Zhenjun Zhao @ericzzj.bsky.social · 29/09/2026
SLIP-VLA: Single-Step Latent Imagination for Policy Learning in Vision-Language-Action Models Tianfu Li, Haoxuan Xu, Wenbo Chen, Haitian Li, Changchuan Yang, Xinhu Zheng, Jun Ma, Yuan Liu, Lujia Wang, Haoang Li arxiv.org/abs/2609.33575
100
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026
Light Field Primitive for Novel View Synthesis Liang Chen, Jiahui Ning, Xun Jiang, Xing Xu, Jimmy Ren, Fenglei Fan, Heng Tao Shen tl;dr: scene->primitives defined in two-plane parameterization arxiv.org/abs/2609.31198
000
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026
VkVIO: Cross-platform GPU Acceleration for Visual-Inertial Odometry with Vulkan Ole Hoffmann, Mateo de Mayo, @dcremers.bsky.social tl;dr: Basalt->Vulkan arxiv.org/abs/2609.30459
000
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026
tl;dr: representation complexity scales with unique physical geometry rather than frame count
000
Zhenjun Zhao @ericzzj.bsky.social · 28/09/2026
TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations Ayush Jain, Sreeharsha Paruchuri, Ishita Gupta, Fan Zhang, Tanner Schmidt, Jakob Engel, Katerina Fragkiadaki, Adam W. Harley arxiv.org/abs/2609.30222
100
Zhenjun Zhao @ericzzj.bsky.social · 24/09/2026
DAVIO: Dense Monocular-Inertial SLAM with Feed-Forward Initialization and Pose-Conditioned Mapping Jaafar Mahmoud, Arthur Movsesyan, Mikhail Iumanov, Sergey Kolyubin tl;dr: DAv3 + OpenVINS arxiv.org/abs/2609.27702
000
Zhenjun Zhao @ericzzj.bsky.social · 24/09/2026
Kairos: Grounded Forecasting of Presence and Directional Flow in 4D Scene Graphs Iacopo Catalano, Julio A. Placed, @jcivera.bsky.social, Jorge Peña Queralta tl;dr: 3DSG->predictive directional-flow memory->4DSG arxiv.org/abs/2609.27467
000
Zhenjun Zhao @ericzzj.bsky.social · 23/09/2026
Dual Covariance Gaussian Splatting SLAM: Decoupling Rendering and Registration for Robust Real-Time Tracking Edward Beng Wai Tan, Siew-Kei Lam tl;dr: each Gaussian has tracking/mapping covariances shared with mean arxiv.org/abs/2609.25746
010
Zhenjun Zhao @ericzzj.bsky.social · 23/09/2026
NaCR: Visual Localization via NeRF-aided Camera Ray Regression Yesheng Zhang, Xiang Dai, Xu Zhao, Chongyang Zhang tl;dr: NeRF + CRR arxiv.org/abs/2609.25907
000
Zhenjun Zhao @ericzzj.bsky.social · 23/09/2026
MatcherCompass: A Deployment-Aware Benchmark to Guide Image Matcher Selection in the Wild Hyunwoo Kim, @giseopkim.bsky.social tl;dr: in title arxiv.org/abs/2609.25688
000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
RegVGGT: Sustainable Visual Geometry Grounding for Streaming via Regulated Memory Hongbo Mao, Junjun Jiang, Youyu Chen, Jiaxin Zhang, Zhemeng Dong, Xianming Liu tl;dr: retain at most 1% tokens per frame to update the context memory arxiv.org/abs/2609.23286
000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
tl;dr: cross-resolution depth refine + DINO-guided view-consistent learning + diffusion-based iterative Gaussian refinement
000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
D3GS: Depth, DINO, and RGB Diffusion Co-Guided 3D Gaussian Splatting for Sparse-View Reconstruction Yunqi Gao, Zhanfeng Liao, Hanzhang Tu, Zhaoqi Su, Guoqing Zheng, Songtao Wang, Hongwen Zhang, Zhou Xue, Leyuan Liu, Yebin Liu arxiv.org/abs/2609.22941
110
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
VGGT-Prime: Compute-Adaptive Mixture-of-Heads for Efficient Visual Geometry Transformers Abteen Arab, Guile Wu, Chengjie Huang, Dongfeng Bai tl;dr: router->three computation modes for each global-attention head->mean pooling/surrogate attention/softmax attention arxiv.org/abs/2609.23733
000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
Elevator-VIGS: Separating Elevator Motion from Robot Motion in Visual-Inertial Gaussian Splatting SLAM Rui Zhou, Zihan Zhu, Wei Zhang, Zizhou Luo, Norbert Haala, @marcpollefeys.bsky.social tl;dr: VIGS-SLAM->elevator rides arxiv.org/abs/2609.23491
000
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
BayesianGS-SLAM: Uncertainty-Aware Neural Rendering SLAM via Probabilistic Formulation Kyeongsu Kang, Seongbo Ha, Sibaek Lee, Hyeonwoo Yu tl;dr: sensor-noise uncertainty + opacity-induced map-representation uncertainty->mapping, tracking, keyframe selection arxiv.org/abs/2609.24140
010
Zhenjun Zhao @ericzzj.bsky.social · 22/09/2026
A Topological Representation with Object-Path Graphs for Open-Vocabulary Instance Navigation Linwei Zheng, Daojie Peng, Bingtao Wang, Haoang Li, Jun Ma tl;dr: object graph->semantic reasoning; path graph->spatial traversal arxiv.org/abs/2609.24189
000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
tl;dr: ranslation-invariant VP consistency residual + line epipolar residual + line-normal projection residual
000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
Robust Structureless Monocular Visual Inertial Initialization Exploiting Line Features and Vanishing Points Junwan Choi, Woongrae Jo, Dong-Uk Seo, Jinwoo Jeon, Hyun Myung arxiv.org/abs/2609.21186
100
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
tl;dr: cross-window attention at key layers; register tokens->cross-attention->camera tokens
000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
Think Locally, Refine Globally for Memory-Efficient 3D Reconstruction Jingke Zhou, Chenhang Ma, Zhizhou Zhong, Mingkai Liu, Zhuang Zhou, Yicheng ji, Binghua Su, Bo Cai, Xianliang Huang arxiv.org/abs/2609.21437
100
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
VoxelTTO: Voxel-Aligned Feed-Forward 3D Gaussian Splatting with Test-Time Optimization Yibin Zhao, Yihan Pan, Yangwen Li, Jun Nan, Jianjun Yi tl;dr: in title arxiv.org/abs/2609.21498
000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
Info3R: Information-Adaptive Test-Time Training for 3D Reconstruction Sunghyun Baek, Hanna Bae, Minchan Kwon, Junmo Kim tl;dr: each frame’s importance->adjust earning rate; cumulative learning rate + prediction confidence->state reset arxiv.org/abs/2609.21938
000
Zhenjun Zhao @ericzzj.bsky.social · 21/09/2026
SFVO: Decoupled Confidence-Guided Stereo-Flow Visual Odometry with Bidirectional PnP Kai Zhang, Guoyang Zhao, Jun Ma tl;dr: disparity and optical flow are converted into forward and backward 3D–2D constraints arxiv.org/abs/2609.21754
000
Zhenjun Zhao @ericzzj.bsky.social · 18/09/2026
tl;dr: distil geometric priors through LoRA adaptation; hybrid-weight sparse ray-field optimization
000