Cross-Domain Few-Shot Segmentation via Iterative Support-Query Correspondence Mining Jiahao Nie, Yun Xing, Gongjie Zhang, Pei Yan, Aoran Xiao, Yap-Peng Tan, Alex C. Kot, Shijian Lu arXiv ↗ PDF ↗
Cross-view and Cross-pose Completion for 3D Human Understanding Matthieu Armando, Salma Galaaoui, Fabien Baradel, Thomas Lucas, Vincent Leroy, Romain Brégier, Philippe Weinzaepfel, Grégory Rogez arXiv ↗ PDF ↗
CrossKD: Cross-Head Knowledge Distillation for Object Detection Jiabao Wang, Yuming Chen, Zhaohui Zheng, Xiang Li, Ming-Ming Cheng, Qibin Hou arXiv ↗ PDF ↗
CrossMAE: Cross-Modality Masked Autoencoders for Region-Aware Audio-Visual Pre-Training Yuxin Guo, Siyang Sun, Shuailei Ma, Kecheng Zheng, Xiaoyi Bao, Shijie Ma, Wei Zou, Yun Zheng PDF ↗
CrowdDiff: Multi-hypothesis Crowd Density Estimation using Diffusion Models Yasiru Ranasinghe, Nithin Gopalakrishnan Nair, Wele Gedara Chaminda Bandara, Vishal M. Patel arXiv ↗ PDF ↗
CuVLER: Enhanced Unsupervised Object Discoveries through Exhaustive Self-Supervised Transformers Shahaf Arica, Or Rubin, Sapir Gershov, Shlomi Laufer arXiv ↗ PDF ↗
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation Qiyuan Dai, Sibei Yang arXiv ↗ PDF ↗
CurveCloudNet: Processing Point Clouds with 1D Structure Colton Stearns, Alex Fu, Jiateng Liu, Jeong Joon Park, Davis Rempe, Despoina Paschalidou, Leonidas J. Guibas arXiv ↗ PDF ↗
CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head Generation Xi Liu, Ying Guo, Cheng Zhen, Tong Li, Yingying Ao, Pengfei Yan arXiv ↗ PDF ↗
Customization Assistant for Text-to-Image Generation Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, Tong Sun arXiv ↗ PDF ↗
Customize your NeRF: Adaptive Source Driven 3D Scene Editing via Local-Global Iterative Training Runze He, Shaofei Huang, Xuecheng Nie, Tianrui Hui, Luoqi Liu, Jiao Dai, Jizhong Han, Guanbin Li, Si Liu arXiv ↗ PDF ↗
CyberDemo: Augmenting Simulated Human Demonstration for Real-World Dexterous Manipulation Jun Wang, Yuzhe Qin, Kaiming Kuang, Yigit Korkmaz, Akhilan Gurumoorthy, Hao Su, Xiaolong Wang arXiv ↗ PDF ↗
CycleINR: Cycle Implicit Neural Representation for Arbitrary-Scale Volumetric Super-Resolution of Medical Data Wei Fang, Yuxing Tang, Heng Guo, Mingze Yuan, Tony C. W. Mok, Ke Yan, Jiawen Yao, Xin Chen, Zaiyi Liu, Le Lu, Ling Zhang, Minfeng Xu arXiv ↗ PDF ↗
Cyclic Learning for Binaural Audio Generation and Localization Zhaojian Li, Bin Zhao, Yuan Yuan PDF ↗
D3T: Distinctive Dual-Domain Teacher Zigzagging Across RGB-Thermal Gap for Domain-Adaptive Object Detection Dinh Phat Do, Taehoon Kim, Jaemin Na, Jiwon Kim, Keonho Lee, Kyunghwan Cho, Wonjun Hwang arXiv ↗ PDF ↗
D3still: Decoupled Differential Distillation for Asymmetric Image Retrieval Yi Xie, Yihong Lin, Wenjie Cai, Xuemiao Xu, Huaidong Zhang, Yong Du, Shengfeng He PDF ↗
DAP: A Dynamic Adversarial Patch for Evading Person Detectors Amira Guesmi, Ruitian Ding, Muhammad Abdullah Hanif, Ihsen Alouani, Muhammad Shafique arXiv ↗ PDF ↗
DART: Implicit Doppler Tomography for Radar Novel View Synthesis Tianshu Huang, John Miller, Akarsh Prabhakara, Tao Jin, Tarana Laroia, Zico Kolter, Anthony Rowe arXiv ↗ PDF ↗
DAVE - A Detect-and-Verify Paradigm for Low-Shot Counting Jer Pelhan, Alan Lukeži?, Vitjan Zavrtanik, Matej Kristan PDF ↗
DETRs Beat YOLOs on Real-time Object Detection Yian Zhao, Wenyu Lv, Shangliang Xu, Jinman Wei, Guanzhong Wang, Qingqing Dang, Yi Liu, Jie Chen arXiv ↗ PDF ↗
DGC-GNN: Leveraging Geometry and Color Cues for Visual Descriptor-Free 2D-3D Matching Shuzhe Wang, Juho Kannala, Daniel Barath PDF ↗
DIBS: Enhancing Dense Video Captioning with Unlabeled Videos via Pseudo Boundary Enrichment and Online Refinement Hao Wu, Huabin Liu, Yu Qiao, Xiao Sun arXiv ↗ PDF ↗
DIEM: Decomposition-Integration Enhancing Multimodal Insights Xinyi Jiang, Guoming Wang, Junhao Guo, Juncheng Li, Wenqiao Zhang, Rongxing Lu, Siliang Tang PDF ↗
DIMAT: Decentralized Iterative Merging-And-Training for Deep Learning Models Nastaran Saadati, Minh Pham, Nasla Saleem, Joshua R. Waite, Aditya Balu, Zhanong Jiang, Chinmay Hegde, Soumik Sarkar arXiv ↗ PDF ↗
DIOD: Self-Distillation Meets Object Discovery Sandra Kara, Hejer Ammar, Julien Denize, Florian Chabot, Quoc-Cuong Pham PDF ↗
DIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data Qihao Liu, Yi Zhang, Song Bai, Adam Kortylewski, Alan Yuille PDF ↗
DITTO: Dual and Integrated Latent Topologies for Implicit 3D Reconstruction Jaehyeok Shim, Kyungdon Joo arXiv ↗ PDF ↗
DL3DV-10K: A Large-Scale Scene Dataset for Deep Learning-based 3D Vision Lu Ling, Yichen Sheng, Zhi Tu, Wentian Zhao, Cheng Xin, Kun Wan, Lantao Yu, Qianyu Guo, Zixun Yu, Yawen Lu, Xuanmao Li, Xingpeng Sun, Rohan Ashok, Aniruddha Mukherjee, Hao Kang, Xiangrui Kong, Gang Hua, Tianyi Zhang, Bedrich Benes, Aniket Bera PDF ↗
DMR: Decomposed Multi-Modality Representations for Frames and Events Fusion in Visual Reinforcement Learning Haoran Xu, Peixi Peng, Guang Tan, Yuan Li, Xinhai Xu, Yonghong Tian PDF ↗
DNGaussian: Optimizing Sparse-View 3D Gaussian Radiance Fields with Global-Local Depth Normalization Jiahe Li, Jiawei Zhang, Xiao Bai, Jin Zheng, Xin Ning, Jun Zhou, Lin Gu arXiv ↗ PDF ↗
DPHMs: Diffusion Parametric Head Models for Depth-based Tracking Jiapeng Tang, Angela Dai, Yinyu Nie, Lev Markhasin, Justus Thies, Matthias Nießner arXiv ↗ PDF ↗
DPMesh: Exploiting Diffusion Prior for Occluded Human Mesh Recovery Yixuan Zhu, Ao Li, Yansong Tang, Wenliang Zhao, Jie Zhou, Jiwen Lu arXiv ↗ PDF ↗
DREAM: Diffusion Rectification and Estimation-Adaptive Models Jinxin Zhou, Tianyu Ding, Tianyi Chen, Jiachen Jiang, Ilya Zharkov, Zhihui Zhu, Luming Liang arXiv ↗ PDF ↗
DRESS: Instructing Large Vision-Language Models to Align and Interact with Humans via Natural Language Feedback Yangyi Chen, Karan Sikka, Michael Cogswell, Heng Ji, Ajay Divakaran arXiv ↗ PDF ↗
DS-NeRV: Implicit Neural Video Representation with Decomposed Static and Dynamic Codes Hao Yan, Zhihui Ke, Xiaobo Zhou, Tie Qiu, Xidong Shi, Dadong Jiang PDF ↗
DSGG: Dense Relation Transformer for an End-to-end Scene Graph Generation Zeeshan Hayder, Xuming He arXiv ↗ PDF ↗
DSL-FIQA: Assessing Facial Image Quality via Dual-Set Degradation Learning and Landmark-Guided Transformer Wei-Ting Chen, Gurunandan Krishnan, Qiang Gao, Sy-Yen Kuo, Sizhou Ma, Jian Wang PDF ↗
DUDF: Differentiable Unsigned Distance Fields with Hyperbolic Scaling Miguel Fainstein, Viviana Siless, Emmanuel Iarussi arXiv ↗ PDF ↗
DUSt3R: Geometric 3D Vision Made Easy Shuzhe Wang, Vincent Leroy, Yohann Cabon, Boris Chidlovskii, Jerome Revaud arXiv ↗ PDF ↗
DVMNet: Computing Relative Pose for Unseen Objects Beyond Hypotheses Chen Zhao, Tong Zhang, Zheng Dang, Mathieu Salzmann arXiv ↗ PDF ↗
DYSON: Dynamic Feature Space Self-Organization for Online Task-Free Class Incremental Learning Yuhang He, Yingjie Chen, Yuhan Jin, Songlin Dong, Xing Wei, Yihong Gong PDF ↗
D^4: Dataset Distillation via Disentangled Diffusion Model Duo Su, Junjie Hou, Weizhi Gao, Yingjie Tian, Bowen Tang PDF ↗
DaReNeRF: Direction-aware Representation for Dynamic Scenes Ange Lou, Benjamin Planche, Zhongpai Gao, Yamin Li, Tianyu Luan, Hao Ding, Terrence Chen, Jack Noble, Ziyan Wu arXiv ↗ PDF ↗
DanceCamera3D: 3D Camera Movement Synthesis with Music and Dance Zixuan Wang, Jia Jia, Shikun Sun, Haozhe Wu, Rong Han, Zhenyu Li, Di Tang, Jiaqing Zhou, Jiebo Luo arXiv ↗ PDF ↗
Dancing with Still Images: Video Distillation via Static-Dynamic Disentanglement Ziyu Wang, Yue Xu, Cewu Lu, Yong-Lu Li arXiv ↗ PDF ↗
Data Poisoning based Backdoor Attacks to Contrastive Learning Jinghuai Zhang, Hongbin Liu, Jinyuan Jia, Neil Zhenqiang Gong arXiv ↗ PDF ↗
Data Valuation and Detections in Federated Learning Wenqian Li, Shuran Fu, Fengrui Zhang, Yan Pang arXiv ↗ PDF ↗
Data-Efficient Unsupervised Interpolation Without Any Intermediate Frame for 4D Medical Images JungEun Kim, Hangyul Yoon, Geondo Park, Kyungsu Kim, Eunho Yang arXiv ↗ PDF ↗
Day-Night Cross-domain Vehicle Re-identification Hongchao Li, Jingong Chen, Aihua Zheng, Yong Wu, Yonglong Luo PDF ↗
De-Diffusion Makes Text a Strong Cross-Modal Interface Chen Wei, Chenxi Liu, Siyuan Qiao, Zhishuai Zhang, Alan Yuille, Jiahui Yu arXiv ↗ PDF ↗
De-confounded Data-free Knowledge Distillation for Handling Distribution Shifts Yuzheng Wang, Dingkang Yang, Zhaoyu Chen, Yang Liu, Siao Liu, Wenqiang Zhang, Lihua Zhang, Lizhe Qi arXiv ↗ PDF ↗
DeCoTR: Enhancing Depth Completion with 2D and 3D Attentions Yunxiao Shi, Manish Kumar Singh, Hong Cai, Fatih Porikli arXiv ↗ PDF ↗
DeIL: Direct-and-Inverse CLIP for Open-World Few-Shot Learning Shuai Shao, Yu Bai, Yan Wang, Baodi Liu, Yicong Zhou PDF ↗
DeMatch: Deep Decomposition of Motion Field for Two-View Correspondence Learning Shihua Zhang, Zizhuo Li, Yuan Gao, Jiayi Ma PDF ↗
Decentralized Directed Collaboration for Personalized Federated Learning Yingqi Liu, Yifan Shi, Qinglun Li, Baoyuan Wu, Xueqian Wang, Li Shen arXiv ↗ PDF ↗
Decompose-and-Compose: A Compositional Approach to Mitigating Spurious Correlation Fahimeh Hosseini Noohdani, Parsa Hosseini, Aryan Yazdan Parast, Hamidreza Yaghoubi Araghi, Mahdieh Soleymani Baghshah PDF ↗
Decomposing Disease Descriptions for Enhanced Pathology Detection: A Multi-Aspect Vision-Language Pre-training Framework Vu Minh Hieu Phan, Yutong Xie, Yuankai Qi, Lingqiao Liu, Liyang Liu, Bowen Zhang, Zhibin Liao, Qi Wu, Minh-Son To, Johan W. Verjans arXiv ↗ PDF ↗
DeconfuseTrack: Dealing with Confusion for Multi-Object Tracking Cheng Huang, Shoudong Han, Mengyu He, Wenbo Zheng, Yuhao Wei arXiv ↗ PDF ↗
Decoupled Pseudo-labeling for Semi-Supervised Monocular 3D Object Detection Jiacheng Zhang, Jiaming Li, Xiangru Lin, Wei Zhang, Xiao Tan, Junyu Han, Errui Ding, Jingdong Wang, Guanbin Li arXiv ↗ PDF ↗
Decoupling Static and Hierarchical Motion Perception for Referring Video Segmentation Shuting He, Henghui Ding arXiv ↗ PDF ↗
Deep Equilibrium Diffusion Restoration with Parallel Sampling Jiezhang Cao, Yue Shi, Kai Zhang, Yulun Zhang, Radu Timofte, Luc Van Gool arXiv ↗ PDF ↗
Deep Generative Model based Rate-Distortion for Image Downscaling Assessment Yuanbang Liang, Bhavesh Garg, Paul Rosin, Yipeng Qin arXiv ↗ PDF ↗
Deep Imbalanced Regression via Hierarchical Classification Adjustment Haipeng Xiong, Angela Yao arXiv ↗ PDF ↗
Deep Single Image Camera Calibration by Heatmap Regression to Recover Fisheye Images Under Manhattan World Assumption Nobuhiko Wakai, Satoshi Sato, Yasunori Ishii, Takayoshi Yamashita PDF ↗
Deep Video Inverse Tone Mapping Based on Temporal Clues Yuyao Ye, Ning Zhang, Yang Zhao, Hongbin Cao, Ronggang Wang PDF ↗
Deep-TROJ: An Inference Stage Trojan Insertion Algorithm through Efficient Weight Replacement Attack Sabbir Ahmed, Ranyang Zhou, Shaahin Angizi, Adnan Siraj Rakin PDF ↗
DeepCache: Accelerating Diffusion Models for Free Xinyin Ma, Gongfan Fang, Xinchao Wang arXiv ↗ PDF ↗
Defense Against Adversarial Attacks on No-Reference Image Quality Models with Gradient Norm Regularization Yujia Liu, Chenxi Yang, Dingquan Li, Jianhao Ding, Tingting Jiang arXiv ↗ PDF ↗
Defense without Forgetting: Continual Adversarial Defense with Anisotropic & Isotropic Pseudo Replay Yuhang Zhou, Zhongyun Hua arXiv ↗ PDF ↗
Deformable 3D Gaussians for High-Fidelity Monocular Dynamic Scene Reconstruction Ziyi Yang, Xinyu Gao, Wen Zhou, Shaohui Jiao, Yuqing Zhang, Xiaogang Jin arXiv ↗ PDF ↗
Deformable One-shot Face Stylization via DINO Semantic Guidance Yang Zhou, Zichong Chen, Hui Huang arXiv ↗ PDF ↗
Degrees of Freedom Matter: Inferring Dynamics from Point Trajectories Yan Zhang, Sergey Prokudin, Marko Mihajlovic, Qianli Ma, Siyu Tang PDF ↗
DeiT-LT: Distillation Strikes Back for Vision Transformer Training on Long-Tailed Datasets Harsh Rangwani, Pradipto Mondal, Mayank Mishra, Ashish Ramayee Asokan, R. Venkatesh Babu arXiv ↗ PDF ↗
Delving into the Trajectory Long-tail Distribution for Muti-object Tracking Sijia Chen, En Yu, Jinyang Li, Wenbing Tao arXiv ↗ PDF ↗
DemoCaricature: Democratising Caricature Generation with a Rough Sketch Dar-Yen Chen, Ayan Kumar Bhunia, Subhadeep Koley, Aneeshan Sain, Pinaki Nath Chowdhury, Yi-Zhe Song arXiv ↗ PDF ↗
DemoFusion: Democratising High-Resolution Image Generation With No $$$ Ruoyi Du, Dongliang Chang, Timothy Hospedales, Yi-Zhe Song, Zhanyu Ma arXiv ↗ PDF ↗
Denoising Point Clouds in Latent Space via Graph Convolution and Invertible Neural Network Aihua Mao, Biao Yan, Zijing Ma, Ying He PDF ↗
Dense Vision Transformer Compression with Few Samples Hanxiao Zhang, Yifan Zhou, Guo-Hua Wang arXiv ↗ PDF ↗
Density-Adaptive Model Based on Motif Matrix for Multi-Agent Trajectory Prediction Di Wen, Haoran Xu, Zhaocheng He, Zhe Wu, Guang Tan, Peixi Peng PDF ↗
Density-Guided Semi-Supervised 3D Semantic Segmentation with Dual-Space Hardness Sampling Jianan Li, Qiulei Dong PDF ↗
Density-guided Translator Boosts Synthetic-to-Real Unsupervised Domain Adaptive Segmentation of 3D Point Clouds Zhimin Yuan, Wankang Zeng, Yanfei Su, Weiquan Liu, Ming Cheng, Yulan Guo, Cheng Wang arXiv ↗ PDF ↗
Depth Anything: Unleashing the Power of Large-Scale Unlabeled Data Lihe Yang, Bingyi Kang, Zilong Huang, Xiaogang Xu, Jiashi Feng, Hengshuang Zhao arXiv ↗ PDF ↗
Depth Information Assisted Collaborative Mutual Promotion Network for Single Image Dehazing Yafei Zhang, Shen Zhou, Huafeng Li arXiv ↗ PDF ↗
Depth Prompting for Sensor-Agnostic Depth Estimation Jin-Hwi Park, Chanhwi Jeong, Junoh Lee, Hae-Gon Jeon arXiv ↗ PDF ↗
Depth-Aware Concealed Crop Detection in Dense Agricultural Scenes Liqiong Wang, Jinyu Yang, Yanfu Zhang, Fangyi Wang, Feng Zheng PDF ↗
Depth-aware Test-Time Training for Zero-shot Video Object Segmentation Weihuang Liu, Xi Shen, Haolun Li, Xiuli Bi, Bo Liu, Chi-Man Pun, Xiaodong Cun arXiv ↗ PDF ↗
Describing Differences in Image Sets with Natural Language Lisa Dunlap, Yuhui Zhang, Xiaohan Wang, Ruiqi Zhong, Trevor Darrell, Jacob Steinhardt, Joseph E. Gonzalez, Serena Yeung-Levy arXiv ↗ PDF ↗
Descriptor and Word Soups: Overcoming the Parameter Efficiency Accuracy Tradeoff for Out-of-Distribution Few-shot Learning Christopher Liao, Theodoros Tsiligkaridis, Brian Kulis arXiv ↗ PDF ↗
Desigen: A Pipeline for Controllable Design Template Generation Haohan Weng, Danqing Huang, Yu Qiao, Zheng Hu, Chin-Yew Lin, Tong Zhang, C. L. Philip Chen arXiv ↗ PDF ↗
Design2Cloth: 3D Cloth Generation from 2D Masks Jiali Zheng, Rolandos Alexandros Potamias, Stefanos Zafeiriou arXiv ↗ PDF ↗
DetCLIPv3: Towards Versatile Generative Open-vocabulary Object Detection Lewei Yao, Renjie Pi, Jianhua Han, Xiaodan Liang, Hang Xu, Wei Zhang, Zhenguo Li, Dan Xu arXiv ↗ PDF ↗
DetDiffusion: Synergizing Generative and Perceptive Models for Enhanced Data Generation and Perception Yibo Wang, Ruiyuan Gao, Kai Chen, Kaiqiang Zhou, Yingjie Cai, Lanqing Hong, Zhenguo Li, Lihui Jiang, Dit-Yan Yeung, Qiang Xu, Kai Zhang arXiv ↗ PDF ↗
Detector-Free Structure from Motion Xingyi He, Jiaming Sun, Yifan Wang, Sida Peng, Qixing Huang, Hujun Bao, Xiaowei Zhou arXiv ↗ PDF ↗
Device-Wise Federated Network Pruning Shangqian Gao, Junyi Li, Zeyu Zhang, Yanfu Zhang, Weidong Cai, Heng Huang PDF ↗
Dexterous Grasp Transformer Guo-Hao Xu, Yi-Lin Wei, Dian Zheng, Xiao-Ming Wu, Wei-Shi Zheng arXiv ↗ PDF ↗
DiG-IN: Diffusion Guidance for Investigating Networks - Uncovering Classifier Differences Neuron Visualisations and Visual Counterfactual Explanations Maximilian Augustin, Yannic Neuhaus, Matthias Hein PDF ↗
DiLiGenRT: A Photometric Stereo Dataset with Quantified Roughness and Translucency Heng Guo, Jieji Ren, Feishi Wang, Boxin Shi, Mingjun Ren, Yasuyuki Matsushita PDF ↗
DiPrompT: Disentangled Prompt Tuning for Multiple Latent Domain Generalization in Federated Learning Sikai Bai, Jie Zhang, Song Guo, Shuaicheng Li, Jingcai Guo, Jun Hou, Tao Han, Xiaocheng Lu arXiv ↗ PDF ↗
DiSR-NeRF: Diffusion-Guided View-Consistent Super-Resolution NeRF Jie Long Lee, Chen Li, Gim Hee Lee PDF ↗
DiVAS: Video and Audio Synchronization with Dynamic Frame Rates Clara Fernandez-Labrador, Mertcan Akçay, Eitan Abecassis, Joan Massich, Christopher Schroers PDF ↗
DiaLoc: An Iterative Approach to Embodied Dialog Localization Chao Zhang, Mohan Li, Ignas Budvytis, Stephan Liwicki arXiv ↗ PDF ↗
DifFlow3D: Toward Robust Uncertainty-Aware Scene Flow Estimation with Iterative Diffusion-Based Refinement Jiuming Liu, Guangming Wang, Weicai Ye, Chaokang Jiang, Jinru Han, Zhe Liu, Guofeng Zhang, Dalong Du, Hesheng Wang PDF ↗
Diff-BGM: A Diffusion Model for Video Background Music Generation Sizhe Li, Yiming Qin, Minghang Zheng, Xin Jin, Yang Liu PDF ↗
Diff-Plugin: Revitalizing Details for Diffusion-based Low-level Tasks Yuhao Liu, Zhanghan Ke, Fang Liu, Nanxuan Zhao, Rynson W.H. Lau PDF ↗
DiffAM: Diffusion-based Adversarial Makeup Transfer for Facial Privacy Protection Yuhao Sun, Lingyun Yu, Hongtao Xie, Jiaming Li, Yongdong Zhang arXiv ↗ PDF ↗
DiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language Model Lirui Zhao, Yue Yang, Kaipeng Zhang, Wenqi Shao, Yuxin Zhang, Yu Qiao, Ping Luo, Rongrong Ji arXiv ↗ PDF ↗
DiffAssemble: A Unified Graph-Diffusion Model for 2D and 3D Reassembly Gianluca Scarpellini, Stefano Fiorini, Francesco Giuliari, Pietro Moreiro, Alessio Del Bue arXiv ↗ PDF ↗
DiffAvatar: Simulation-Ready Garment Optimization with Differentiable Simulation Yifei Li, Hsiao-yu Chen, Egor Larionov, Nikolaos Sarafianos, Wojciech Matusik, Tuur Stuyck arXiv ↗ PDF ↗
DiffCast: A Unified Framework via Residual Diffusion for Precipitation Nowcasting Demin Yu, Xutao Li, Yunming Ye, Baoquan Zhang, Chuyao Luo, Kuai Dai, Rui Wang, Xunlai Chen arXiv ↗ PDF ↗
DiffEditor: Boosting Accuracy and Flexibility on Diffusion-based Image Editing Chong Mou, Xintao Wang, Jiechong Song, Ying Shan, Jian Zhang arXiv ↗ PDF ↗
DiffForensics: Leveraging Diffusion Prior to Image Forgery Detection and Localization Zeqin Yu, Jiangqun Ni, Yuzhen Lin, Haoyi Deng, Bin Li PDF ↗
DiffHuman: Probabilistic Photorealistic 3D Reconstruction of Humans Akash Sengupta, Thiemo Alldieck, Nikos Kolotouros, Enric Corona, Andrei Zanfir, Cristian Sminchisescu arXiv ↗ PDF ↗
DiffInDScene: Diffusion-based High-Quality 3D Indoor Scene Generation Xiaoliang Ju, Zhaoyang Huang, Yijin Li, Guofeng Zhang, Yu Qiao, Hongsheng Li arXiv ↗ PDF ↗
DiffLoc: Diffusion Model for Outdoor LiDAR Localization Wen Li, Yuyang Yang, Shangshu Yu, Guosheng Hu, Chenglu Wen, Ming Cheng, Cheng Wang PDF ↗
DiffMOT: A Real-time Diffusion-based Multiple Object Tracker with Non-linear Prediction Weiyi Lv, Yuhang Huang, Ning Zhang, Ruei-Sung Lin, Mei Han, Dan Zeng arXiv ↗ PDF ↗
DiffMorpher: Unleashing the Capability of Diffusion Models for Image Morphing Kaiwen Zhang, Yifan Zhou, Xudong Xu, Bo Dai, Xingang Pan arXiv ↗ PDF ↗
DiffPerformer: Iterative Learning of Consistent Latent Guidance for Diffusion-based Human Video Generation Chenyang Wang, Zerong Zheng, Tao Yu, Xiaoqian Lv, Bineng Zhong, Shengping Zhang, Liqiang Nie PDF ↗
DiffSCI: Zero-Shot Snapshot Compressive Imaging via Iterative Spectral Diffusion Model Zhenghao Pan, Haijin Zeng, Jiezhang Cao, Kai Zhang, Yongyong Chen arXiv ↗ PDF ↗
DiffSHEG: A Diffusion-Based Approach for Real-Time Speech-driven Holistic 3D Expression and Gesture Generation Junming Chen, Yunfei Liu, Jianan Wang, Ailing Zeng, Yu Li, Qifeng Chen arXiv ↗ PDF ↗
DiffSal: Joint Audio and Video Learning for Diffusion Saliency Prediction Junwen Xiong, Peng Zhang, Tao You, Chuanyue Li, Wei Huang, Yufei Zha arXiv ↗ PDF ↗
Differentiable Display Photometric Stereo Seokjun Choi, Seungwoo Yoon, Giljoo Nam, Seungyong Lee, Seung-Hwan Baek arXiv ↗ PDF ↗
Differentiable Information Bottleneck for Deterministic Multi-view Clustering Xiaoqiang Yan, Zhixiang Jin, Fengshou Han, Yangdong Ye arXiv ↗ PDF ↗
Differentiable Micro-Mesh Construction Yishun Dou, Zhong Zheng, Qiaoqiao Jin, Rui Shi, Yuhan Li, Bingbing Ni PDF ↗
Differentiable Neural Surface Refinement for Modeling Transparent Objects Weijian Deng, Dylan Campbell, Chunyi Sun, Shubham Kanitkar, Matthew E. Shaffer, Stephen Gould PDF ↗
Differentiable Point-based Inverse Rendering Hoon-Gyu Chung, Seokjun Choi, Seung-Hwan Baek arXiv ↗ PDF ↗
DiffuScene: Denoising Diffusion Models for Generative Indoor Scene Synthesis Jiapeng Tang, Yinyu Nie, Lev Markhasin, Angela Dai, Justus Thies, Matthias Nießner arXiv ↗ PDF ↗
Diffuse Attend and Segment: Unsupervised Zero-Shot Segmentation using Stable Diffusion Junjiao Tian, Lavisha Aggarwal, Andrea Colaco, Zsolt Kira, Mar Gonzalez-Franco arXiv ↗ PDF ↗
DiffuseMix: Label-Preserving Data Augmentation with Diffusion Models Khawar Islam, Muhammad Zaigham Zaheer, Arif Mahmood, Karthik Nandakumar arXiv ↗ PDF ↗
Diffusion 3D Features (Diff3F): Decorating Untextured Shapes with Distilled Semantic Features Niladri Shekhar Dutt, Sanjeev Muralikrishnan, Niloy J. Mitra arXiv ↗ PDF ↗
Diffusion Model Alignment Using Direct Preference Optimization Bram Wallace, Meihua Dang, Rafael Rafailov, Linqi Zhou, Aaron Lou, Senthil Purushwalkam, Stefano Ermon, Caiming Xiong, Shafiq Joty, Nikhil Naik arXiv ↗ PDF ↗
Diffusion Time-step Curriculum for One Image to 3D Generation Xuanyu Yi, Zike Wu, Qingshan Xu, Pan Zhou, Joo-Hwee Lim, Hanwang Zhang arXiv ↗ PDF ↗
Diffusion-ES: Gradient-free Planning with Diffusion for Autonomous and Instruction-guided Driving Brian Yang, Huangyuan Su, Nikolaos Gkanatsios, Tsung-Wei Ke, Ayush Jain, Jeff Schneider, Katerina Fragkiadaki PDF ↗
Diffusion-FOF: Single-View Clothed Human Reconstruction via Diffusion-Based Fourier Occupancy Field Yuanzhen Li, Fei Luo, Chunxia Xiao PDF ↗
Diffusion-based Blind Text Image Super-Resolution Yuzhe Zhang, Jiawei Zhang, Hao Li, Zhouxia Wang, Luwei Hou, Dongqing Zou, Liheng Bian arXiv ↗ PDF ↗
Diffusion-driven GAN Inversion for Multi-Modal Face Image Generation Jihyun Kim, Changjae Oh, Hoseok Do, Soohyun Kim, Kwanghoon Sohn arXiv ↗ PDF ↗
DiffusionAvatars: Deferred Diffusion for High-fidelity 3D Head Avatars Tobias Kirschstein, Simon Giebenhain, Matthias Nießner PDF ↗
DiffusionGAN3D: Boosting Text-guided 3D Generation and Domain Adaptation by Combining 3D GANs and Diffusion Priors Biwen Lei, Kai Yu, Mengyang Feng, Miaomiao Cui, Xuansong Xie arXiv ↗ PDF ↗
DiffusionLight: Light Probes for Free by Painting a Chrome Ball Pakkapon Phongthawee, Worameth Chinchuthakun, Nontaphat Sinsunthithet, Varun Jampani, Amit Raj, Pramook Khungurn, Supasorn Suwajanakorn arXiv ↗ PDF ↗
DiffusionMTL: Learning Multi-Task Denoising Diffusion Model from Partially Annotated Data Hanrong Ye, Dan Xu arXiv ↗ PDF ↗
DiffusionPoser: Real-time Human Motion Reconstruction From Arbitrary Sparse Sensors Using Autoregressive Diffusion Tom Van Wouwe, Seunghwan Lee, Antoine Falisse, Scott Delp, C. Karen Liu arXiv ↗ PDF ↗
DiffusionRegPose: Enhancing Multi-Person Pose Estimation using a Diffusion-Based End-to-End Regression Approach Dayi Tan, Hansheng Chen, Wei Tian, Lu Xiong PDF ↗
DiffusionTrack: Point Set Diffusion Model for Visual Object Tracking Fei Xie, Zhongdao Wang, Chao Ma PDF ↗
Digital Life Project: Autonomous 3D Characters with Social Intelligence Zhongang Cai, Jianping Jiang, Zhongfei Qing, Xinying Guo, Mingyuan Zhang, Zhengyu Lin, Haiyi Mei, Chen Wei, Ruisi Wang, Wanqi Yin, Liang Pan, Xiangyu Fan, Han Du, Peng Gao, Zhitao Yang, Yang Gao, Jiaqi Li, Tianxiang Ren, Yukun Wei, Xiaogang Wang, Chen Change Loy, Lei Yang, Ziwei Liu arXiv ↗ PDF ↗
Direct2.5: Diverse Text-to-3D Generation via Multi-view 2.5D Diffusion Yuanxun Lu, Jingyang Zhang, Shiwei Li, Tian Fang, David McKinnon, Yanghai Tsin, Long Quan, Xun Cao, Yao Yao PDF ↗
DisCo: Disentangled Control for Realistic Human Dance Generation Tan Wang, Linjie Li, Kevin Lin, Yuanhao Zhai, Chung-Ching Lin, Zhengyuan Yang, Hanwang Zhang, Zicheng Liu, Lijuan Wang arXiv ↗ PDF ↗
Discontinuity-preserving Normal Integration with Auxiliary Edges Hyomin Kim, Yucheol Jung, Seungyong Lee arXiv ↗ PDF ↗
Discover and Mitigate Multiple Biased Subgroups in Image Classifiers Zeliang Zhang, Mingqian Feng, Zhiheng Li, Chenliang Xu arXiv ↗ PDF ↗
Discovering Syntactic Interaction Clues for Human-Object Interaction Detection Jinguo Luo, Weihong Ren, Weibo Jiang, Xi'ai Chen, Qiang Wang, Zhi Han, Honghai Liu PDF ↗
Discriminability-Driven Channel Selection for Out-of-Distribution Detection Yue Yuan, Rundong He, Yicong Dong, Zhongyi Han, Yilong Yin PDF ↗
Discriminative Pattern Calibration Mechanism for Source-Free Domain Adaptation Haifeng Xia, Siyu Xia, Zhengming Ding PDF ↗
Discriminative Probing and Tuning for Text-to-Image Generation Leigang Qu, Wenjie Wang, Yongqi Li, Hanwang Zhang, Liqiang Nie, Tat-Seng Chua arXiv ↗ PDF ↗
Discriminative Sample-Guided and Parameter-Efficient Feature Space Adaptation for Cross-Domain Few-Shot Learning Rashindrie Perera, Saman Halgamuge arXiv ↗ PDF ↗
Disentangled Pre-training for Human-Object Interaction Detection Zhuolong Li, Xingao Li, Changxing Ding, Xiangmin Xu arXiv ↗ PDF ↗
Disentangled Prompt Representation for Domain Generalization De Cheng, Zhipeng Xu, Xinyang Jiang, Nannan Wang, Dongsheng Li, Xinbo Gao PDF ↗
Dispel Darkness for Better Fusion: A Controllable Visual Enhancer based on Cross-modal Conditional Adversarial Learning Hao Zhang, Linfeng Tang, Xinyu Xiang, Xuhui Zuo, Jiayi Ma PDF ↗
Dispersed Structured Light for Hyperspectral 3D Imaging Suhyun Shin, Seokjun Choi, Felix Heide, Seung-Hwan Baek arXiv ↗ PDF ↗
Distilled Datamodel with Reverse Gradient Matching Jingwen Ye, Ruonan Yu, Songhua Liu, Xinchao Wang arXiv ↗ PDF ↗
Distilling CLIP with Dual Guidance for Learning Discriminative Human Body Shape Representation Feng Liu, Minchul Kim, Zhiyuan Ren, Xiaoming Liu PDF ↗
Distilling ODE Solvers of Diffusion Models into Smaller Steps Sanghwan Kim, Hao Tang, Fisher Yu arXiv ↗ PDF ↗
Distilling Semantic Priors from SAM to Efficient Image Restoration Models Quan Zhang, Xiaoyu Liu, Wei Li, Hanting Chen, Junchao Liu, Jie Hu, Zhiwei Xiong, Chun Yuan, Yunhe Wang arXiv ↗ PDF ↗
Distilling Vision-Language Models on Millions of Videos Yue Zhao, Long Zhao, Xingyi Zhou, Jialin Wu, Chun-Te Chu, Hui Miao, Florian Schroff, Hartwig Adam, Ting Liu, Boqing Gong, Philipp Krahenbuhl, Liangzhe Yuan arXiv ↗ PDF ↗
Distribution-aware Knowledge Prototyping for Non-exemplar Lifelong Person Re-identification Kunlun Xu, Xu Zou, Yuxin Peng, Jiahuan Zhou PDF ↗
Distributionally Generative Augmentation for Fair Facial Attribute Classification Fengda Zhang, Qianpei He, Kun Kuang, Jiashuo Liu, Long Chen, Chao Wu, Jun Xiao, Hanwang Zhang arXiv ↗ PDF ↗
DiverGen: Improving Instance Segmentation by Learning Wider Data Distribution with More Diverse Generative Data Chengxiang Fan, Muzhi Zhu, Hao Chen, Yang Liu, Weijia Wu, Huaqi Zhang, Chunhua Shen arXiv ↗ PDF ↗
Diversity-aware Channel Pruning for StyleGAN Compression Jiwoo Chung, Sangeek Hyun, Sang-Heon Shim, Jae-Pil Heo arXiv ↗ PDF ↗
Do Vision and Language Encoders Represent the World Similarly? Mayug Maniparambil, Raiymbek Akshulakov, Yasser Abdelaziz Dahou Djilali, Mohamed El Amine Seddik, Sanath Narayan, Karttikeya Mangalam, Noel E. O'Connor arXiv ↗ PDF ↗
Do You Remember? Dense Video Captioning with Cross-Modal Memory Retrieval Minkuk Kim, Hyeon Bae Kim, Jinyoung Moon, Jinwoo Choi, Seong Tae Kim arXiv ↗ PDF ↗
DocRes: A Generalist Model Toward Unifying Document Image Restoration Tasks Jiaxin Zhang, Dezhi Peng, Chongyu Liu, Peirong Zhang, Lianwen Jin arXiv ↗ PDF ↗
Domain Gap Embeddings for Generative Dataset Augmentation Yinong Oliver Wang, Younjoon Chung, Chen Henry Wu, Fernando De la Torre PDF ↗
Domain Separation Graph Neural Networks for Saliency Object Ranking Zijian Wu, Jun Lu, Jing Han, Lianfa Bai, Yi Zhang, Zhuang Zhao, Siyang Song PDF ↗
Domain-Agnostic Mutual Prompting for Unsupervised Domain Adaptation Zhekai Du, Xinyao Li, Fengling Li, Ke Lu, Lei Zhu, Jingjing Li arXiv ↗ PDF ↗
Domain-Rectifying Adapter for Cross-Domain Few-Shot Segmentation Jiapeng Su, Qi Fan, Wenjie Pei, Guangming Lu, Fanglin Chen arXiv ↗ PDF ↗
Domain-Specific Block Selection and Paired-View Pseudo-Labeling for Online Test-Time Adaptation Yeonguk Yu, Sungho Shin, Seunghyeok Back, Mihwan Ko, Sangjun Noh, Kyoobin Lee arXiv ↗ PDF ↗
Don't Look into the Dark: Latent Codes for Pluralistic Image Inpainting Haiwei Chen, Yajie Zhao PDF ↗
Doodle Your 3D: From Abstract Freehand Sketches to Precise 3D Shapes Hmrishav Bandyopadhyay, Subhadeep Koley, Ayan Das, Ayan Kumar Bhunia, Aneeshan Sain, Pinaki Nath Chowdhury, Tao Xiang, Yi-Zhe Song arXiv ↗ PDF ↗
Doubly Abductive Counterfactual Inference for Text-based Image Editing Xue Song, Jiequan Cui, Hanwang Zhang, Jingjing Chen, Richang Hong, Yu-Gang Jiang arXiv ↗ PDF ↗
Dr. Bokeh: DiffeRentiable Occlusion-aware Bokeh Rendering Yichen Sheng, Zixun Yu, Lu Ling, Zhiwen Cao, Xuaner Zhang, Xin Lu, Ke Xian, Haiting Lin, Bedrich Benes PDF ↗
Dr2Net: Dynamic Reversible Dual-Residual Networks for Memory-Efficient Finetuning Chen Zhao, Shuming Liu, Karttikeya Mangalam, Guocheng Qian, Fatimah Zohra, Abdulmohsen Alghannam, Jitendra Malik, Bernard Ghanem PDF ↗
Drag Your Noise: Interactive Point-based Editing via Diffusion Semantic Propagation Haofeng Liu, Chenshu Xu, Yifei Yang, Lihua Zeng, Shengfeng He arXiv ↗ PDF ↗
Draw Step by Step: Reconstructing CAD Construction Sequences from Point Clouds via Multimodal Diffusion. Weijian Ma, Shuaiqi Chen, Yunzhong Lou, Xueyang Li, Xiangdong Zhou PDF ↗
DreamAvatar: Text-and-Shape Guided 3D Human Avatar Generation via Diffusion Models Yukang Cao, Yan-Pei Cao, Kai Han, Ying Shan, Kwan-Yee K. Wong arXiv ↗ PDF ↗
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions Yunhan Yang, Yukun Huang, Xiaoyang Wu, Yuan-Chen Guo, Song-Hai Zhang, Hengshuang Zhao, Tong He, Xihui Liu arXiv ↗ PDF ↗
DreamControl: Control-Based Text-to-3D Generation with 3D Self-Prior Tianyu Huang, Yihan Zeng, Zhilu Zhang, Wan Xu, Hang Xu, Songcen Xu, Rynson W.H. Lau, Wangmeng Zuo arXiv ↗ PDF ↗
DreamMatcher: Appearance Matching Self-Attention for Semantically-Consistent Text-to-Image Personalization Jisu Nam, Heesu Kim, DongJae Lee, Siyoon Jin, Seungryong Kim, Seunggyu Chang arXiv ↗ PDF ↗
DreamSalon: A Staged Diffusion Framework for Preserving Identity-Context in Editable Face Generation Haonan Lin arXiv ↗ PDF ↗
DreamVideo: Composing Your Dream Videos with Customized Subject and Motion Yujie Wei, Shiwei Zhang, Zhiwu Qing, Hangjie Yuan, Zhiheng Liu, Yu Liu, Yingya Zhang, Jingren Zhou, Hongming Shan arXiv ↗ PDF ↗
DriveTrack: A Benchmark for Long-Range Point Tracking in Real-World Videos Arjun Balasingam, Joseph Chandler, Chenning Li, Zhoutong Zhang, Hari Balakrishnan arXiv ↗ PDF ↗
DriveWorld: 4D Pre-trained Scene Understanding via World Models for Autonomous Driving Chen Min, Dawei Zhao, Liang Xiao, Jian Zhao, Xinli Xu, Zheng Zhu, Lei Jin, Jianshu Li, Yulan Guo, Junliang Xing, Liping Jing, Yiming Nie, Bin Dai arXiv ↗ PDF ↗
Driving Everywhere with Large Language Model Policy Adaptation Boyi Li, Yue Wang, Jiageng Mao, Boris Ivanovic, Sushant Veer, Karen Leung, Marco Pavone arXiv ↗ PDF ↗
Driving into the Future: Multiview Visual Forecasting and Planning with World Model for Autonomous Driving Yuqi Wang, Jiawei He, Lue Fan, Hongxin Li, Yuntao Chen, Zhaoxiang Zhang arXiv ↗ PDF ↗
Driving-Video Dehazing with Non-Aligned Regularization for Safety Assistance Junkai Fan, Jiangwei Weng, Kun Wang, Yijun Yang, Jianjun Qian, Jun Li, Jian Yang arXiv ↗ PDF ↗
DrivingGaussian: Composite Gaussian Splatting for Surrounding Dynamic Autonomous Driving Scenes Xiaoyu Zhou, Zhiwei Lin, Xiaojun Shan, Yongtao Wang, Deqing Sun, Ming-Hsuan Yang arXiv ↗ PDF ↗
DuPL: Dual Student with Trustworthy Progressive Learning for Robust Weakly Supervised Semantic Segmentation Yuanchen Wu, Xichen Ye, Kequan Yang, Jide Li, Xiaoqiang Li arXiv ↗ PDF ↗
Dual DETRs for Multi-Label Temporal Action Detection Yuhan Zhu, Guozhen Zhang, Jing Tan, Gangshan Wu, Limin Wang arXiv ↗ PDF ↗
Dual Memory Networks: A Versatile Adaptation Approach for Vision-Language Models Yabin Zhang, Wenjie Zhu, Hui Tang, Zhiyuan Ma, Kaiyang Zhou, Lei Zhang arXiv ↗ PDF ↗
Dual Pose-invariant Embeddings: Learning Category and Object-specific Discriminative Representations for Recognition and Retrieval Rohan Sarkar, Avinash Kak arXiv ↗ PDF ↗
Dual Prior Unfolding for Snapshot Compressive Imaging Jiancheng Zhang, Haijin Zeng, Jiezhang Cao, Yongyong Chen, Dengxiu Yu, Yin-Ping Zhao PDF ↗
Dual Prototype Attention for Unsupervised Video Object Segmentation Suhwan Cho, Minhyeok Lee, Seunghoon Lee, Dogyoon Lee, Heeseung Choi, Ig-Jae Kim, Sangyoun Lee arXiv ↗ PDF ↗