Dual-Consistency Model Inversion for Non-Exemplar Class Incremental Learning Zihuan Qiu, Yi Xu, Fanman Meng, Hongliang Li, Linfeng Xu, Qingbo Wu PDF ↗
Dual-Enhanced Coreset Selection with Class-wise Collaboration for Online Blurry Class Incremental Learning Yutian Luo, Shiqi Zhao, Haoran Wu, Zhiwu Lu PDF ↗
Dual-Scale Transformer for Large-Scale Single-Pixel Imaging Gang Qu, Ping Wang, Xin Yuan arXiv ↗ PDF ↗
Dual-View Visual Contextualization for Web Navigation Jihyung Kil, Chan Hee Song, Boyuan Zheng, Xiang Deng, Yu Su, Wei-Lun Chao arXiv ↗ PDF ↗
DualAD: Disentangling the Dynamic and Static World for End-to-End Driving Simon Doll, Niklas Hanselmann, Lukas Schneider, Richard Schulz, Marius Cordts, Markus Enzweiler, Hendrik P. A. Lensch PDF ↗
DyBluRF: Dynamic Neural Radiance Fields from Blurry Monocular Video Huiqiang Sun, Xingyi Li, Liao Shen, Xinyi Ye, Ke Xian, Zhiguo Cao arXiv ↗ PDF ↗
DynVideo-E: Harnessing Dynamic NeRF for Large-Scale Motion- and View-Change Human-Centric Video Editing Jia-Wei Liu, Yan-Pei Cao, Jay Zhangjie Wu, Weijia Mao, Yuchao Gu, Rui Zhao, Jussi Keppo, Ying Shan, Mike Zheng Shou PDF ↗
Dynamic Adapter Meets Prompt Tuning: Parameter-Efficient Transfer Learning for Point Cloud Analysis Xin Zhou, Dingkang Liang, Wei Xu, Xingkui Zhu, Yihan Xu, Zhikang Zou, Xiang Bai arXiv ↗ PDF ↗
Dynamic Graph Representation with Knowledge-aware Attention for Histopathology Whole Slide Image Analysis Jiawen Li, Yuxuan Chen, Hongbo Chu, Qiehe Sun, Tian Guan, Anjia Han, Yonghong He arXiv ↗ PDF ↗
Dynamic Inertial Poser (DynaIP): Part-Based Motion Dynamics Learning for Enhanced Human Pose Estimation with Sparse Inertial Sensors Yu Zhang, Songpengcheng Xia, Lei Chu, Jiarui Yang, Qi Wu, Ling Pei arXiv ↗ PDF ↗
Dynamic Prompt Optimizing for Text-to-Image Generation Wenyi Mo, Tianyu Zhang, Yalong Bai, Bing Su, Ji-Rong Wen, Qing Yang arXiv ↗ PDF ↗
Dynamic Support Information Mining for Category-Agnostic Pose Estimation Pengfei Ren, Yuanyuan Gao, Haifeng Sun, Qi Qi, Jingyu Wang, Jianxin Liao PDF ↗
Dysen-VDM: Empowering Dynamics-aware Text-to-Video Diffusion with LLMs Hao Fei, Shengqiong Wu, Wei Ji, Hanwang Zhang, Tat-Seng Chua PDF ↗
E-GPS: Explainable Geometry Problem Solving via Top-Down Solver and Bottom-Up Generator Wenjun Wu, Lingling Zhang, Jun Liu, Xi Tang, Yaxian Wang, Shaowei Wang, Qianying Wang PDF ↗
EASE-DETR: Easing the Competition among Object Queries Yulu Gao, Yifan Sun, Xudong Ding, Chuyang Zhao, Si Liu PDF ↗
ECLIPSE: A Resource-Efficient Text-to-Image Prior for Image Generations Maitreya Patel, Changhoon Kim, Sheng Cheng, Chitta Baral, Yezhou Yang arXiv ↗ PDF ↗
ECLIPSE: Efficient Continual Learning in Panoptic Segmentation with Visual Prompt Tuning Beomyoung Kim, Joonsang Yu, Sung Ju Hwang arXiv ↗ PDF ↗
ECoDepth: Effective Conditioning of Diffusion Models for Monocular Depth Estimation Suraj Patni, Aradhye Agarwal, Chetan Arora arXiv ↗ PDF ↗
EFHQ: Multi-purpose ExtremePose-Face-HQ dataset Trung Tuan Dao, Duc Hong Vu, Cuong Pham, Anh Tran arXiv ↗ PDF ↗
EFormer: Enhanced Transformer towards Semantic-Contour Features of Foreground for Portraits Matting Zitao Wang, Qiguang Miao, Yue Xi, Peipei Zhao arXiv ↗ PDF ↗
EGTR: Extracting Graph from Transformer for Scene Graph Generation Jinbae Im, JeongYeon Nam, Nokyung Park, Hyungmin Lee, Seunghyun Park arXiv ↗ PDF ↗
EMAGE: Towards Unified Holistic Co-Speech Gesture Generation via Expressive Masked Audio Gesture Modeling Haiyang Liu, Zihao Zhu, Giorgio Becherini, Yichen Peng, Mingyang Su, You Zhou, Xuefei Zhe, Naoya Iwamoto, Bo Zheng, Michael J. Black arXiv ↗ PDF ↗
EMCAD: Efficient Multi-scale Convolutional Attention Decoding for Medical Image Segmentation Md Mostafijur Rahman, Mustafa Munir, Radu Marculescu arXiv ↗ PDF ↗
EMOPortraits: Emotion-enhanced Multimodal One-shot Head Avatars Nikita Drobyshev, Antoni Bigata Casademunt, Konstantinos Vougioukas, Zoe Landgraf, Stavros Petridis, Maja Pantic arXiv ↗ PDF ↗
ERMVP: Communication-Efficient and Collaboration-Robust Multi-Vehicle Perception in Challenging Environments Jingyu Zhang, Kun Yang, Yilei Wang, Hanqi Wang, Peng Sun, Liang Song PDF ↗
ES3: Evolving Self-Supervised Learning of Robust Audio-Visual Speech Representations Yuanhang Zhang, Shuang Yang, Shiguang Shan, Xilin Chen PDF ↗
ESCAPE: Encoding Super-keypoints for Category-Agnostic Pose Estimation Khoi Duc Nguyen, Chen Li, Gim Hee Lee PDF ↗
ESR-NeRF: Emissive Source Reconstruction Using LDR Multi-view Images Jinseo Jeong, Junseo Koo, Qimeng Zhang, Gunhee Kim PDF ↗
EVCap: Retrieval-Augmented Image Captioning with External Visual-Name Memory for Open-World Comprehension Jiaxuan Li, Duc Minh Vo, Akihiro Sugimoto, Hideki Nakayama arXiv ↗ PDF ↗
EVS-assisted Joint Deblurring Rolling-Shutter Correction and Video Frame Interpolation through Sensor Inverse Modeling Rui Jiang, Fangwen Tu, Yixuan Long, Aabhaas Vaish, Bowen Zhou, Qinyi Wang, Wei Zhang, Yuntan Fang, Luis Eduardo Garcia Capel, Bo Mu, Tiejun Dai, Andreas Suess PDF ↗
Each Test Image Deserves A Specific Prompt: Continual Test-Time Adaptation for 2D Medical Image Segmentation Ziyang Chen, Yongsheng Pan, Yiwen Ye, Mengkang Lu, Yong Xia arXiv ↗ PDF ↗
EarthLoc: Astronaut Photography Localization by Indexing Earth from Space Gabriele Berton, Alex Stoken, Barbara Caputo, Carlo Masone arXiv ↗ PDF ↗
EasyDrag: Efficient Point-based Manipulation on Diffusion Models Xingzhong Hou, Boxiao Liu, Yi Zhang, Jihao Liu, Yu Liu, Haihang You PDF ↗
Eclipse: Disambiguating Illumination and Materials using Unintended Shadows Dor Verbin, Ben Mildenhall, Peter Hedman, Jonathan T. Barron, Todd Zickler, Pratul P. Srinivasan arXiv ↗ PDF ↗
Edge-Aware 3D Instance Segmentation Network with Intelligent Semantic Prior Wonseok Roh, Hwanhee Jung, Giljoo Nam, Jinseop Yeom, Hyunje Park, Sang Ho Yoon, Sangpil Kim PDF ↗
Edit One for All: Interactive Batch Image Editing Thao Nguyen, Utkarsh Ojha, Yuheng Li, Haotian Liu, Yong Jae Lee arXiv ↗ PDF ↗
EditGuard: Versatile Image Watermarking for Tamper Localization and Copyright Protection Xuanyu Zhang, Runyi Li, Jiwen Yu, Youmin Xu, Weiqi Li, Jian Zhang arXiv ↗ PDF ↗
Effective Video Mirror Detection with Inconsistent Motion Cues Alex Warren, Ke Xu, Jiaying Lin, Gary K.L. Tam, Rynson W.H. Lau PDF ↗
Efficient 3D Implicit Head Avatar with Mesh-anchored Hash Table Blendshapes Ziqian Bai, Feitong Tan, Sean Fanello, Rohit Pandey, Mingsong Dou, Shichen Liu, Ping Tan, Yinda Zhang arXiv ↗ PDF ↗
Efficient Dataset Distillation via Minimax Diffusion Jianyang Gu, Saeed Vahidian, Vyacheslav Kungurtsev, Haonan Wang, Wei Jiang, Yang You, Yiran Chen arXiv ↗ PDF ↗
Efficient Detection of Long Consistent Cycles and its Application to Distributed Synchronization Shaohan Li, Yunpeng Shi, Gilad Lerman PDF ↗
Efficient Hyperparameter Optimization with Adaptive Fidelity Identification Jiantong Jiang, Zeyi Wen, Atif Mansoor, Ajmal Mian PDF ↗
Efficient Meshflow and Optical Flow Estimation from Event Cameras Xinglong Luo, Ao Luo, Zhengning Wang, Chunyu Lin, Bing Zeng, Shuaicheng Liu PDF ↗
Efficient Model Stealing Defense with Noise Transition Matrix Dong-Dong Wu, Chilin Fu, Weichang Wu, Wenwen Xia, Xiaolu Zhang, Jun Zhou, Min-Ling Zhang PDF ↗
Efficient Multi-scale Network with Learnable Discrete Wavelet Transform for Blind Motion Deblurring Xin Gao, Tianheng Qiu, Xinyu Zhang, Hanlin Bai, Kang Liu, Xuan Huang, Hu Wei, Guoying Zhang, Huaping Liu arXiv ↗ PDF ↗
Efficient Multitask Dense Predictor via Binarization Yuzhang Shang, Dan Xu, Gaowen Liu, Ramana Rao Kompella, Yan Yan arXiv ↗ PDF ↗
Efficient Privacy-Preserving Visual Localization Using 3D Ray Clouds Heejoon Moon, Chunghwan Lee, Je Hyeong Hong PDF ↗
Efficient Stitchable Task Adaptation Haoyu He, Zizheng Pan, Jing Liu, Jianfei Cai, Bohan Zhuang arXiv ↗ PDF ↗
Efficient Test-Time Adaptation of Vision-Language Models Adilbek Karmanov, Dayan Guan, Shijian Lu, Abdulmotaleb El Saddik, Eric Xing arXiv ↗ PDF ↗
Efficient Vision-Language Pre-training by Cluster Masking Zihao Wei, Zixuan Pan, Andrew Owens arXiv ↗ PDF ↗
Efficient and Effective Weakly-Supervised Action Segmentation via Action-Transition-Aware Boundary Alignment Angchi Xu, Wei-Shi Zheng arXiv ↗ PDF ↗
EfficientDreamer: High-Fidelity and Robust 3D Creation via Orthogonal-view Diffusion Priors Zhipeng Hu, Minda Zhao, Chaoyi Zhao, Xinyue Liang, Lincheng Li, Zeng Zhao, Changjie Fan, Xiaowei Zhou, Xin Yu arXiv ↗ PDF ↗
Efficiently Assemble Normalization Layers and Regularization for Federated Domain Generalization Khiem Le, Long Ho, Cuong Do, Danh Le-Phuoc, Kok-Seng Wong arXiv ↗ PDF ↗
Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives Kristen Grauman, Andrew Westbury, Lorenzo Torresani, Kris Kitani, Jitendra Malik, Triantafyllos Afouras, Kumar Ashutosh, Vijay Baiyya, Siddhant Bansal, Bikram Boote, Eugene Byrne, Zach Chavis, Joya Chen, Feng Cheng, Fu-Jen Chu, Sean Crane, Avijit Dasgupta, Jing Dong, Maria Escobar, Cristhian Forigua, Abrham Gebreselasie, Sanjay Haresh, Jing Huang, Md Mohaiminul Islam, Suyog Jain, Rawal Khirodkar, Devansh Kukreja, Kevin J Liang, Jia-Wei Liu, Sagnik Majumder, Yongsen Mao, Miguel Martin, Effrosyni Mavroudi, Tushar Nagarajan, Francesco Ragusa, Santhosh Kumar Ramakrishnan, Luigi Seminara, Arjun Somayazulu, Yale Song, Shan Su, Zihui Xue, Edward Zhang, Jinxu Zhang, Angela Castillo, Changan Chen, Xinzhu Fu, Ryosuke Furuta, Cristina Gonzalez, Prince Gupta, Jiabo Hu, Yifei Huang, Yiming Huang, Weslie Khoo, Anush Kumar, Robert Kuo, Sach Lakhavani, Miao Liu, Mi Luo, Zhengyi Luo, Brighid Meredith, Austin Miller, Oluwatumininu Oguntola, Xiaqing Pan, Penny Peng, Shraman Pramanick, Merey Ramazanova, Fiona Ryan, Wei Shan, Kiran Somasundaram, Chenan Song, Audrey Southerland, Masatoshi Tateno, Huiyu Wang, Yuchen Wang, Takuma Yagi, Mingfei Yan, Xitong Yang, Zecheng Yu, Shengxin Cindy Zha, Chen Zhao, Ziwei Zhao, Zhifan Zhu, Jeff Zhuo, Pablo Arbelaez, Gedas Bertasius, Dima Damen, Jakob Engel, Giovanni Maria Farinella, Antonino Furnari, Bernard Ghanem, Judy Hoffman, C.V. Jawahar, Richard Newcombe, Hyun Soo Park, James M. Rehg, Yoichi Sato, Manolis Savva, Jianbo Shi, Mike Zheng Shou, Michael Wray PDF ↗
EgoExoLearn: A Dataset for Bridging Asynchronous Ego- and Exo-centric View of Procedural Activities in Real World Yifei Huang, Guo Chen, Jilan Xu, Mingfang Zhang, Lijin Yang, Baoqi Pei, Hongjie Zhang, Lu Dong, Yali Wang, Limin Wang, Yu Qiao PDF ↗
EgoGen: An Egocentric Synthetic Data Generator Gen Li, Kaifeng Zhao, Siwei Zhang, Xiaozhong Lyu, Mihai Dusmanu, Yan Zhang, Marc Pollefeys, Siyu Tang arXiv ↗ PDF ↗
Egocentric Whole-Body Motion Capture with FisheyeViT and Diffusion-Based Motion Refinement Jian Wang, Zhe Cao, Diogo Luvizon, Lingjie Liu, Kripasindhu Sarkar, Danhang Tang, Thabo Beeler, Christian Theobalt arXiv ↗ PDF ↗
ElasticDiffusion: Training-free Arbitrary Size Image Generation through Global-Local Content Separation Moayed Haji-Ali, Guha Balakrishnan, Vicente Ordonez arXiv ↗ PDF ↗
Elite360D: Towards Efficient 360 Depth Estimation via Semantic- and Distance-Aware Bi-Projection Fusion Hao Ai, Lin Wang PDF ↗
Embodied Multi-Modal Agent trained by an LLM from a Parallel TextWorld Yijun Yang, Tianyi Zhou, Kanxue Li, Dapeng Tao, Lusong Li, Li Shen, Xiaodong He, Jing Jiang, Yuhui Shi arXiv ↗ PDF ↗
EmbodiedScan: A Holistic Multi-Modal 3D Perception Suite Towards Embodied AI Tai Wang, Xiaohan Mao, Chenming Zhu, Runsen Xu, Ruiyuan Lyu, Peisen Li, Xiao Chen, Wenwei Zhang, Kai Chen, Tianfan Xue, Xihui Liu, Cewu Lu, Dahua Lin, Jiangmiao Pang arXiv ↗ PDF ↗
Embracing Unimodal Aleatoric Uncertainty for Robust Multimodal Fusion Zixian Gao, Xun Jiang, Xing Xu, Fumin Shen, Yujie Li, Heng Tao Shen PDF ↗
Emergent Open-Vocabulary Semantic Segmentation from Off-the-shelf Vision-Language Models Jiayun Luo, Siddhesh Khandelwal, Leonid Sigal, Boyang Li arXiv ↗ PDF ↗
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models Jingyuan Yang, Jiawei Feng, Hui Huang arXiv ↗ PDF ↗
EmoVIT: Revolutionizing Emotion Insights with Visual Instruction Tuning Hongxia Xie, Chu-Jun Peng, Yu-Wen Tseng, Hung-Jen Chen, Chan-Feng Hsu, Hong-Han Shuai, Wen-Huang Cheng arXiv ↗ PDF ↗
Emotional Speech-driven 3D Body Animation via Disentangled Latent Diffusion Kiran Chhatre, Radek Dan??ek, Nikos Athanasiou, Giorgio Becherini, Christopher Peters, Michael J. Black, Timo Bolkart PDF ↗
Empowering Resampling Operation for Ultra-High-Definition Image Enhancement with Model-Aware Guidance Wei Yu, Jie Huang, Bing Li, Kaiwen Zheng, Qi Zhu, Man Zhou, Feng Zhao PDF ↗
En3D: An Enhanced Generative Model for Sculpting 3D Humans from 2D Synthetic Data Yifang Men, Biwen Lei, Yuan Yao, Miaomiao Cui, Zhouhui Lian, Xuansong Xie arXiv ↗ PDF ↗
End-to-End Spatio-Temporal Action Localisation with Video Transformers Alexey A. Gritsenko, Xuehan Xiong, Josip Djolonga, Mostafa Dehghani, Chen Sun, Mario Lucic, Cordelia Schmid, Anurag Arnab arXiv ↗ PDF ↗
End-to-End Temporal Action Detection with 1B Parameters Across 1000 Frames Shuming Liu, Chen-Lin Zhang, Chen Zhao, Bernard Ghanem arXiv ↗ PDF ↗
Endow SAM with Keen Eyes: Temporal-spatial Prompt Learning for Video Camouflaged Object Detection Wenjun Hui, Zhenfeng Zhu, Shuai Zheng, Yao Zhao PDF ↗
Enhance Image Classification via Inter-Class Image Mixup with Diffusion Model Zhicai Wang, Longhui Wei, Tan Wang, Heyu Chen, Yanbin Hao, Xiang Wang, Xiangnan He, Qi Tian arXiv ↗ PDF ↗
Enhanced Motion-Text Alignment for Image-to-Video Transfer Learning Wei Zhang, Chaoqun Wan, Tongliang Liu, Xinmei Tian, Xu Shen, Jieping Ye PDF ↗
Enhancing 3D Fidelity of Text-to-3D using Cross-View Correspondences Seungwook Kim, Kejie Li, Xueqing Deng, Yichun Shi, Minsu Cho, Peng Wang arXiv ↗ PDF ↗
Enhancing 3D Object Detection with 2D Detection-Guided Query Anchors Haoxuanye Ji, Pengpeng Liang, Erkang Cheng arXiv ↗ PDF ↗
Enhancing Intrinsic Features for Debiasing via Investigating Class-Discerning Common Attributes in Bias-Contrastive Pair Jeonghoon Park, Chaeyeon Chung, Jaegul Choo arXiv ↗ PDF ↗
Enhancing Multimodal Cooperation via Sample-level Modality Valuation Yake Wei, Ruoxuan Feng, Zihe Wang, Di Hu PDF ↗
Enhancing Post-training Quantization Calibration through Contrastive Learning Yuzhang Shang, Gaowen Liu, Ramana Rao Kompella, Yan Yan PDF ↗
Enhancing Quality of Compressed Images by Mitigating Enhancement Bias Towards Compression Domain Qunliang Xing, Mai Xu, Shengxi Li, Xin Deng, Meisong Zheng, Huaida Liu, Ying Chen arXiv ↗ PDF ↗
Enhancing Visual Continual Learning with Language-Guided Supervision Bolin Ni, Hongbo Zhao, Chenghao Zhang, Ke Hu, Gaofeng Meng, Zhaoxiang Zhang, Shiming Xiang arXiv ↗ PDF ↗
Enhancing Visual Document Understanding with Contrastive Learning in Large Visual-Language Models Xin Li, Yunfei Wu, Xinghua Jiang, Zhihao Guo, Mingming Gong, Haoyu Cao, Yinsong Liu, Deqiang Jiang, Xing Sun arXiv ↗ PDF ↗
Enhancing the Power of OOD Detection via Sample-Aware Model Selection Feng Xue, Zi He, Yuan Zhang, Chuanlong Xie, Zhenguo Li, Falong Tan PDF ↗
Ensemble Diversity Facilitates Adversarial Transferability Bowen Tang, Zheng Wang, Yi Bin, Qi Dou, Yang Yang, Heng Tao Shen PDF ↗
Entangled View-Epipolar Information Aggregation for Generalizable Neural Radiance Fields Zhiyuan Min, Yawei Luo, Wei Yang, Yuesong Wang, Yi Yang arXiv ↗ PDF ↗
Entity-NeRF: Detecting and Removing Moving Entities in Urban Scenes Takashi Otonari, Satoshi Ikehata, Kiyoharu Aizawa PDF ↗
EpiDiff: Enhancing Multi-View Synthesis via Localized Epipolar-Constrained Diffusion Zehuan Huang, Hao Wen, Junting Dong, Yaohui Wang, Yangguang Li, Xinyuan Chen, Yan-Pei Cao, Ding Liang, Yu Qiao, Bo Dai, Lu Sheng arXiv ↗ PDF ↗
Epistemic Uncertainty Quantification For Pre-Trained Neural Networks Hanjing Wang, Qiang Ji arXiv ↗ PDF ↗
Equivariant Multi-Modality Image Fusion Zixiang Zhao, Haowen Bai, Jiangshe Zhang, Yulun Zhang, Kai Zhang, Shuang Xu, Dongdong Chen, Radu Timofte, Luc Van Gool arXiv ↗ PDF ↗
Equivariant Plug-and-Play Image Reconstruction Matthieu Terris, Thomas Moreau, Nelly Pustelnik, Julian Tachella arXiv ↗ PDF ↗
Error Detection in Egocentric Procedural Task Videos Shih-Po Lee, Zijia Lu, Zekun Zhang, Minh Hoai, Ehsan Elhamifar PDF ↗
EscherNet: A Generative Model for Scalable View Synthesis Xin Kong, Shikun Liu, Xiaoyang Lyu, Marwan Taher, Xiaojuan Qi, Andrew J. Davison arXiv ↗ PDF ↗
Estimating Extreme 3D Image Rotations using Cascaded Attention Shay Dekel, Yosi Keller, Martin Cadik PDF ↗
Estimating Noisy Class Posterior with Part-level Labels for Noisy Label Learning Rui Zhao, Bin Shi, Jianfei Ruan, Tianze Pan, Bo Dong arXiv ↗ PDF ↗
EvDiG: Event-guided Direct and Global Components Separation Xinyu Zhou, Peiqi Duan, Boyu Li, Chu Zhou, Chao Xu, Boxin Shi PDF ↗
EvalCrafter: Benchmarking and Evaluating Large Video Generation Models Yaofang Liu, Xiaodong Cun, Xuebo Liu, Xintao Wang, Yong Zhang, Haoxin Chen, Yang Liu, Tieyong Zeng, Raymond Chan, Ying Shan arXiv ↗ PDF ↗
Evaluating Transferability in Retrieval Tasks: An Approach Using MMD and Kernel Methods Mengyu Dai, Amir Hossein Raffiee, Aashish Jain, Joshua Correa PDF ↗
Event Stream-based Visual Object Tracking: A High-Resolution Benchmark Dataset and A Novel Baseline Xiao Wang, Shiao Wang, Chuanming Tang, Lin Zhu, Bo Jiang, Yonghong Tian, Jin Tang arXiv ↗ PDF ↗
Event-assisted Low-Light Video Object Segmentation Hebei Li, Jin Wang, Jiahui Yuan, Yue Li, Wenming Weng, Yansong Peng, Yueyi Zhang, Zhiwei Xiong, Xiaoyan Sun arXiv ↗ PDF ↗
Event-based Visible and Infrared Fusion via Multi-task Collaboration Mengyue Geng, Lin Zhu, Lizhi Wang, Wei Zhang, Ruiqin Xiong, Yonghong Tian PDF ↗
EventDance: Unsupervised Source-free Cross-modal Adaptation for Event-based Object Recognition Xu Zheng, Lin Wang arXiv ↗ PDF ↗
EventEgo3D: 3D Human Motion Capture from Egocentric Event Streams Christen Millerdurai, Hiroyasu Akada, Jian Wang, Diogo Luvizon, Christian Theobalt, Vladislav Golyanik arXiv ↗ PDF ↗
Evidential Active Recognition: Intelligent and Prudent Open-World Embodied Perception Lei Fan, Mingfu Liang, Yunxuan Li, Gang Hua, Ying Wu arXiv ↗ PDF ↗
ExMap: Leveraging Explainability Heatmaps for Unsupervised Group Robustness to Spurious Correlations Rwiddhi Chakraborty, Adrian Sletten, Michael C. Kampffmeyer arXiv ↗ PDF ↗
Exact Fusion via Feature Distribution Matching for Few-shot Image Generation Yingbo Zhou, Yutong Ye, Pengyu Zhang, Xian Wei, Mingsong Chen PDF ↗
Expandable Subspace Ensemble for Pre-Trained Model-Based Class-Incremental Learning Da-Wei Zhou, Hai-Long Sun, Han-Jia Ye, De-Chuan Zhan arXiv ↗ PDF ↗
Explaining CLIP's Performance Disparities on Data from Blind/Low Vision Users Daniela Massiceti, Camilla Longden, Agnieszka Slowik, Samuel Wills, Martin Grayson, Cecily Morrison PDF ↗
Explaining the Implicit Neural Canvas: Connecting Pixels to Neurons by Tracing their Contributions Namitha Padmanabhan, Matthew Gwilliam, Pulkit Kumar, Shishira R Maiya, Max Ehrlich, Abhinav Shrivastava arXiv ↗ PDF ↗
Exploiting Diffusion Prior for Generalizable Dense Prediction Hsin-Ying Lee, Hung-Yu Tseng, Ming-Hsuan Yang arXiv ↗ PDF ↗
Exploiting Inter-sample and Inter-feature Relations in Dataset Distillation Wenxiao Deng, Wenbin Li, Tianyu Ding, Lei Wang, Hongguang Zhang, Kuihua Huang, Jing Huo, Yang Gao arXiv ↗ PDF ↗
Exploiting Style Latent Flows for Generalizing Deepfake Video Detection Jongwook Choi, Taehoon Kim, Yonghyun Jeong, Seungryul Baek, Jongwon Choi arXiv ↗ PDF ↗
Exploring Efficient Asymmetric Blind-Spots for Self-Supervised Denoising in Real-World Scenarios Shiyan Chen, Jiyuan Zhang, Zhaofei Yu, Tiejun Huang arXiv ↗ PDF ↗
Exploring Pose-Aware Human-Object Interaction via Hybrid Learning Eastman Z Y Wu, Yali Li, Yuan Wang, Shengjin Wang PDF ↗
Exploring Region-Word Alignment in Built-in Detector for Open-Vocabulary Object Detection Heng Zhang, Qiuyu Zhao, Linyu Zheng, Hao Zeng, Zhiwei Ge, Tianhao Li, Sulong Xu PDF ↗
Exploring Regional Clues in CLIP for Zero-Shot Semantic Segmentation Yi Zhang, Meng-Hao Guo, Miao Wang, Shi-Min Hu PDF ↗
Exploring Vision Transformers for 3D Human Motion-Language Models with Motion Patches Qing Yu, Mikihiro Tanaka, Kent Fujiwara arXiv ↗ PDF ↗
Exploring the Potential of Large Foundation Models for Open-Vocabulary HOI Detection Ting Lei, Shaofeng Yin, Yang Liu arXiv ↗ PDF ↗
ExtDM: Distribution Extrapolation Diffusion Model for Video Prediction Zhicheng Zhang, Junyao Hu, Wentao Cheng, Danda Paudel, Jufeng Yang PDF ↗
Extend Your Own Correspondences: Unsupervised Distant Point Cloud Registration by Progressive Distance Extension Quan Liu, Hongzi Zhu, Zhenxi Wang, Yunsong Zhou, Shan Chang, Minyi Guo arXiv ↗ PDF ↗
ExtraNeRF: Visibility-Aware View Extrapolation of Neural Radiance Fields with Diffusion Models Meng-Li Shih, Wei-Chiu Ma, Lorenzo Boyice, Aleksander Holynski, Forrester Cole, Brian Curless, Janne Kontkanen PDF ↗
Eyes Wide Shut? Exploring the Visual Shortcomings of Multimodal LLMs Shengbang Tong, Zhuang Liu, Yuexiang Zhai, Yi Ma, Yann LeCun, Saining Xie arXiv ↗ PDF ↗
FACT: Frame-Action Cross-Attention Temporal Modeling for Efficient Action Segmentation Zijia Lu, Ehsan Elhamifar PDF ↗
FC-GNN: Recovering Reliable and Accurate Correspondences from Interferences Haobo Xu, Jun Zhou, Hua Yang, Renjie Pan, Cunyan Li PDF ↗
FCS: Feature Calibration and Separation for Non-Exemplar Class Incremental Learning Qiwei Li, Yuxin Peng, Jiahuan Zhou PDF ↗
FFF: Fixing Flawed Foundations in Contrastive Pre-Training Results in Very Strong Vision-Language Models Adrian Bulat, Yassine Ouali, Georgios Tzimiropoulos arXiv ↗ PDF ↗
FINER: Flexible Spectral-bias Tuning in Implicit NEural Representation by Variable-periodic Activation Functions Zhen Liu, Hao Zhu, Qi Zhang, Jingde Fu, Weibing Deng, Zhan Ma, Yanwen Guo, Xun Cao arXiv ↗ PDF ↗
FISBe: A Real-World Benchmark Dataset for Instance Segmentation of Long-Range Thin Filamentous Structures Lisa Mais, Peter Hirsch, Claire Managan, Ramya Kandarpa, Josef Lorenz Rumberger, Annika Reinke, Lena Maier-Hein, Gudrun Ihrke, Dagmar Kainmueller arXiv ↗ PDF ↗
FLHetBench: Benchmarking Device and State Heterogeneity in Federated Learning Junyuan Zhang, Shuang Zeng, Miao Zhang, Runxi Wang, Feifei Wang, Yuyin Zhou, Paul Pu Liang, Liangqiong Qu PDF ↗
FMA-Net: Flow-Guided Dynamic Filtering and Iterative Feature Refinement with Multi-Attention for Joint Video Super-Resolution and Deblurring Geunhyuk Youk, Jihyong Oh, Munchurl Kim PDF ↗
FREE: Faster and Better Data-Free Meta-Learning Yongxian Wei, Zixuan Hu, Zhenyi Wang, Li Shen, Chun Yuan, Dacheng Tao arXiv ↗ PDF ↗
FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation Shuai Yang, Yifan Zhou, Ziwei Liu, Chen Change Loy arXiv ↗ PDF ↗
FSC: Few-point Shape Completion Xianzu Wu, Xianfeng Wu, Tianyu Luan, Yajing Bai, Zhongyuan Lai, Junsong Yuan arXiv ↗ PDF ↗
FSRT: Facial Scene Representation Transformer for Face Reenactment from Factorized Appearance Head-pose and Facial Expression Features Andre Rochow, Max Schwarz, Sven Behnke arXiv ↗ PDF ↗
Face2Diffusion for Fast and Editable Face Personalization Kaede Shiohara, Toshihiko Yamasaki arXiv ↗ PDF ↗
FaceChain-ImagineID: Freely Crafting High-Fidelity Diverse Talking Faces from Disentangled Audio Chao Xu, Yang Liu, Jiazheng Xing, Weida Wang, Mingze Sun, Jun Dan, Tianxin Huang, Siyuan Li, Zhi-Qi Cheng, Ying Tai, Baigui Sun PDF ↗
FaceChain-SuDe: Building Derived Class to Inherit Category Attributes for One-shot Subject-Driven Generation Pengchong Qiao, Lei Shang, Chang Liu, Baigui Sun, Xiangyang Ji, Jie Chen PDF ↗
FaceCom: Towards High-fidelity 3D Facial Shape Completion via Optimization and Inpainting Guidance Yinglong Li, Hongyu Wu, Xiaogang Wang, Qingzhao Qin, Yijiao Zhao, Yong Wang, Aimin Hao PDF ↗
FaceLift: Semi-supervised 3D Facial Landmark Localization David Ferman, Pablo Garrido, Gaurav Bharaj arXiv ↗ PDF ↗
FaceTalk: Audio-Driven Motion Diffusion for Neural Parametric Head Models Shivangi Aneja, Justus Thies, Angela Dai, Matthias Nießner arXiv ↗ PDF ↗
Faces that Speak: Jointly Synthesising Talking Face and Speech from Text Youngjoon Jang, Ji-Hoon Kim, Junseok Ahn, Doyeop Kwak, Hong-Sun Yang, Yoon-Cheol Ju, Il-Hwan Kim, Byeong-Yeol Kim, Joon Son Chung arXiv ↗ PDF ↗
Facial Identity Anonymization via Intrinsic and Extrinsic Attention Distraction Zhenzhong Kuang, Xiaochen Yang, Yingjie Shen, Chao Hu, Jun Yu PDF ↗
Fair Federated Learning under Domain Skew with Local Consistency and Domain Diversity Yuhang Chen, Wenke Huang, Mang Ye arXiv ↗ PDF ↗
FairCLIP: Harnessing Fairness in Vision-Language Learning Yan Luo, Min Shi, Muhammad Osama Khan, Muhammad Muneeb Afzal, Hao Huang, Shuaihang Yuan, Yu Tian, Luo Song, Ava Kouhana, Tobias Elze, Yi Fang, Mengyu Wang arXiv ↗ PDF ↗
FairDeDup: Detecting and Mitigating Vision-Language Fairness Disparities in Semantic Dataset Deduplication Eric Slyman, Stefan Lee, Scott Cohen, Kushal Kafle arXiv ↗ PDF ↗
FairRAG: Fair Human Generation via Fair Retrieval Augmentation Robik Shrestha, Yang Zou, Qiuyu Chen, Zhiheng Li, Yusheng Xie, Siqi Deng arXiv ↗ PDF ↗
Fairy: Fast Parallelized Instruction-Guided Video-to-Video Synthesis Bichen Wu, Ching-Yao Chuang, Xiaoyan Wang, Yichen Jia, Kapil Krishnakumar, Tong Xiao, Feng Liang, Licheng Yu, Peter Vajda arXiv ↗ PDF ↗
FakeInversion: Learning to Detect Images from Unseen Text-to-Image Models by Inverting Stable Diffusion George Cazenavette, Avneesh Sud, Thomas Leung, Ben Usman PDF ↗
Fast Adaptation for Human Pose Estimation via Meta-Optimization Shengxiang Hu, Huaijiang Sun, Bin Li, Dong Wei, Weiqing Li, Jianfeng Lu PDF ↗
FastMAC: Stochastic Spectral Sampling of Correspondence Graph Yifei Zhang, Hao Zhao, Hongyang Li, Siheng Chen arXiv ↗ PDF ↗
Feature Re-Embedding: Towards Foundation Model-Level Performance in Computational Pathology Wenhao Tang, Fengtao Zhou, Sheng Huang, Xiang Zhu, Yi Zhang, Bo Liu PDF ↗
FedAS: Bridging Inconsistency in Personalized Federated Learning Xiyuan Yang, Wenke Huang, Mang Ye PDF ↗
FedHCA2: Towards Hetero-Client Federated Multi-Task Learning Yuxiang Lu, Suizhi Huang, Yuwen Yang, Shalayiding Sirejiding, Yue Ding, Hongtao Lu PDF ↗
FedMef: Towards Memory-efficient Federated Dynamic Pruning Hong Huang, Weiming Zhuang, Chen Chen, Lingjuan Lyu arXiv ↗ PDF ↗
FedSOL: Stabilized Orthogonal Learning with Proximal Restrictions in Federated Learning Gihun Lee, Minchan Jeong, Sangmook Kim, Jaehoon Oh, Se-Young Yun arXiv ↗ PDF ↗
FedSelect: Personalized Federated Learning with Customized Selection of Parameters for Fine-Tuning Rishub Tamirisa, Chulin Xie, Wenxuan Bao, Andy Zhou, Ron Arel, Aviv Shamsian arXiv ↗ PDF ↗
FedUV: Uniformity and Variance for Heterogeneous Federated Learning Ha Min Son, Moon-Hyun Kim, Tai-Myoung Chung, Chao Huang, Xin Liu arXiv ↗ PDF ↗
Federated Generalized Category Discovery Nan Pu, Wenjing Li, Xingyuan Ji, Yalan Qin, Nicu Sebe, Zhun Zhong PDF ↗
Few-shot Learner Parameterization by Diffusion Time-steps Zhongqi Yue, Pan Zhou, Richang Hong, Hanwang Zhang, Qianru Sun arXiv ↗ PDF ↗
Finding Lottery Tickets in Vision Models via Data-driven Spectral Foresight Pruning Leonardo Iurada, Marco Ciccone, Tatiana Tommasi PDF ↗
Fine-Grained Bipartite Concept Factorization for Clustering Chong Peng, Pengfei Zhang, Yongyong Chen, Zhao Kang, Chenglizhao Chen, Qiang Cheng PDF ↗
Fine-grained Prototypical Voting with Heterogeneous Mixup for Semi-supervised 2D-3D Cross-modal Retrieval Fan Zhang, Xian-Sheng Hua, Chong Chen, Xiao Luo PDF ↗
FineParser: A Fine-grained Spatio-temporal Action Parser for Human-centric Action Quality Assessment Jinglin Xu, Sibo Yin, Guohao Zhao, Zishuo Wang, Yuxin Peng arXiv ↗ PDF ↗
FineSports: A Multi-person Hierarchical Sports Video Dataset for Fine-grained Action Understanding Jinglin Xu, Guohao Zhao, Sibo Yin, Wenhao Zhou, Yuxin Peng PDF ↗
Finsler-Laplace-Beltrami Operators with Application to Shape Analysis Simon Weber, Thomas Dagès, Maolin Gao, Daniel Cremers PDF ↗
FlashAvatar: High-fidelity Head Avatar with Efficient Gaussian Embedding Jun Xiang, Xuan Gao, Yudong Guo, Juyong Zhang arXiv ↗ PDF ↗
FlashEval: Towards Fast and Accurate Evaluation of Text-to-image Diffusion Generative Models Lin Zhao, Tianchen Zhao, Zinan Lin, Xuefei Ning, Guohao Dai, Huazhong Yang, Yu Wang arXiv ↗ PDF ↗
Flatten Long-Range Loss Landscapes for Cross-Domain Few-Shot Learning Yixiong Zou, Yicong Liu, Yiman Hu, Yuhua Li, Ruixuan Li arXiv ↗ PDF ↗
Flattening the Parent Bias: Hierarchical Semantic Segmentation in the Poincare Ball Simon Weber, Bar?? Zöngür, Nikita Araslanov, Daniel Cremers PDF ↗
Flexible Biometrics Recognition: Bridging the Multimodality Gap through Attention Alignment and Prompt Tuning Leslie Ching Ow Tiong, Dick Sigmund, Chen-Hui Chan, Andrew Beng Jin Teoh PDF ↗
Flexible Depth Completion for Sparse and Varying Point Densities Jinhyung Park, Yu-Jhe Li, Kris Kitani PDF ↗
Florence-2: Advancing a Unified Representation for a Variety of Vision Tasks Bin Xiao, Haiping Wu, Weijian Xu, Xiyang Dai, Houdong Hu, Yumao Lu, Michael Zeng, Ce Liu, Lu Yuan PDF ↗
Flow-Guided Online Stereo Rectification for Wide Baseline Stereo Anush Kumar, Fahim Mannan, Omid Hosseini Jafari, Shile Li, Felix Heide PDF ↗
FlowIE: Efficient Image Enhancement via Rectified Flow Yixuan Zhu, Wenliang Zhao, Ao Li, Yansong Tang, Jie Zhou, Jiwen Lu PDF ↗
FlowTrack: Revisiting Optical Flow for Long-Range Dense Tracking Seokju Cho, Jiahui Huang, Seungryong Kim, Joon-Young Lee PDF ↗
FlowVQTalker: High-Quality Emotional Talking Face Generation through Normalizing Flow and Quantization Shuai Tan, Bin Ji, Ye Pan arXiv ↗ PDF ↗
FlowerFormer: Empowering Neural Architecture Encoding using a Flow-aware Graph Transformer Dongyeong Hwang, Hyunju Kim, Sunwoo Kim, Kijung Shin arXiv ↗ PDF ↗
FocSAM: Delving Deeply into Focused Objects in Segmenting Anything You Huang, Zongyu Lan, Liujuan Cao, Xianming Lin, Shengchuan Zhang, Guannan Jiang, Rongrong Ji arXiv ↗ PDF ↗
Focus on Hiders: Exploring Hidden Threats for Enhancing Adversarial Training Qian Li, Yuxiao Hu, Yinpeng Dong, Dongxiao Zhang, Yuntian Chen arXiv ↗ PDF ↗
Focus on Your Instruction: Fine-grained and Multi-instruction Image Editing by Attention Modulation Qin Guo, Tianwei Lin arXiv ↗ PDF ↗
FocusMAE: Gallbladder Cancer Detection from Ultrasound Videos with Focused Masked Autoencoders Soumen Basu, Mayuna Gupta, Chetan Madan, Pankaj Gupta, Chetan Arora arXiv ↗ PDF ↗
Fooling Polarization-Based Vision using Locally Controllable Polarizing Projection Zhuoxiao Li, Zhihang Zhong, Shohei Nobuhara, Ko Nishino, Yinqiang Zheng arXiv ↗ PDF ↗
Forecasting of 3D Whole-body Human Poses with Grasping Objects Haitao Yan, Qiongjie Cui, Jiexin Xie, Shijie Guo PDF ↗
Forgery-aware Adaptive Transformer for Generalizable Synthetic Image Detection Huan Liu, Zichang Tan, Chuangchuang Tan, Yunchao Wei, Jingdong Wang, Yao Zhao arXiv ↗ PDF ↗
Fourier Priors-Guided Diffusion for Zero-Shot Joint Low-Light Enhancement and Deblurring Xiaoqian Lv, Shengping Zhang, Chenyang Wang, Yichen Zheng, Bineng Zhong, Chongyi Li, Liqiang Nie PDF ↗
Fourier-basis Functions to Bridge Augmentation Gap: Rethinking Frequency Augmentation in Image Classification Puru Vaish, Shunxin Wang, Nicola Strisciuglio arXiv ↗ PDF ↗
FreGS: 3D Gaussian Splatting with Progressive Frequency Regularization Jiahui Zhang, Fangneng Zhan, Muyu Xu, Shijian Lu, Eric Xing arXiv ↗ PDF ↗
Free3D: Consistent Novel View Synthesis without 3D Representation Chuanxia Zheng, Andrea Vedaldi arXiv ↗ PDF ↗
FreeControl: Training-Free Spatial Control of Any Text-to-Image Diffusion Model with Any Condition Sicheng Mo, Fangzhou Mu, Kuan Heng Lin, Yanli Liu, Bochen Guan, Yin Li, Bolei Zhou arXiv ↗ PDF ↗
FreeCustom: Tuning-Free Customized Image Generation for Multi-Concept Composition Ganggui Ding, Canyu Zhao, Wen Wang, Zhen Yang, Zide Liu, Hao Chen, Chunhua Shen arXiv ↗ PDF ↗
FreeDrag: Feature Dragging for Reliable Point-based Image Editing Pengyang Ling, Lin Chen, Pan Zhang, Huaian Chen, Yi Jin, Jinjin Zheng arXiv ↗ PDF ↗
FreeKD: Knowledge Distillation via Semantic Frequency Prompt Yuan Zhang, Tao Huang, Jiaming Liu, Tao Jiang, Kuan Cheng, Shanghang Zhang arXiv ↗ PDF ↗
FreeMan: Towards Benchmarking 3D Human Pose Estimation under Real-World Conditions Jiong Wang, Fengyu Yang, Bingliang Li, Wenbo Gou, Danqi Yan, Ailing Zeng, Yijun Gao, Junle Wang, Yanqing Jing, Ruimao Zhang arXiv ↗ PDF ↗