IMPRINT: Generative Object Compositing by Learning Identity-Preserving Representation Yizhi Song, Zhifei Zhang, Zhe Lin, Scott Cohen, Brian Price, Jianming Zhang, Soo Ye Kim, He Zhang, Wei Xiong, Daniel Aliaga arXiv ↗ PDF ↗
IQ-VFI: Implicit Quadratic Motion Estimation for Video Frame Interpolation Mengshun Hu, Kui Jiang, Zhihang Zhong, Zheng Wang, Yinqiang Zheng PDF ↗
IReNe: Instant Recoloring of Neural Radiance Fields Alessio Mazzucchelli, Adrian Garcia-Garcia, Elena Garces, Fernando Rivas-Manzaneque, Francesc Moreno-Noguer, Adrian Penate-Sanchez PDF ↗
Identifying Important Group of Pixels using Interactions Kosuke Sumiyasu, Kazuhiko Kawamoto, Hiroshi Kera arXiv ↗ PDF ↗
Image Restoration by Denoising Diffusion Models with Iteratively Preconditioned Guidance Tomer Garber, Tom Tirer arXiv ↗ PDF ↗
Image Sculpting: Precise Object Editing with 3D Geometry Control Jiraphon Yenphraphai, Xichen Pan, Sainan Liu, Daniele Panozzo, Saining Xie arXiv ↗ PDF ↗
Image-Text Co-Decomposition for Text-Supervised Semantic Segmentation Ji-Jia Wu, Andy Chia-Hao Chang, Chieh-Yu Chuang, Chun-Pei Chen, Yu-Lun Liu, Min-Hung Chen, Hou-Ning Hu, Yung-Yu Chuang, Yen-Yu Lin arXiv ↗ PDF ↗
Image-to-Image Matching via Foundation Models: A New Perspective for Open-Vocabulary Semantic Segmentation Yuan Wang, Rui Sun, Naisong Luo, Yuwen Pan, Tianzhu Zhang arXiv ↗ PDF ↗
Imagine Before Go: Self-Supervised Generative Map for Object Goal Navigation Sixian Zhang, Xinyao Yu, Xinhang Song, Xiaohan Wang, Shuqiang Jiang PDF ↗
Implicit Discriminative Knowledge Learning for Visible-Infrared Person Re-Identification Kaijie Ren, Lei Zhang arXiv ↗ PDF ↗
Improved Implicit Neural Representation with Fourier Reparameterized Training Kexuan Shi, Xingyu Zhou, Shuhang Gu PDF ↗
Improved Visual Grounding through Self-Consistent Explanations Ruozhen He, Paola Cascante-Bonilla, Ziyan Yang, Alexander C. Berg, Vicente Ordonez arXiv ↗ PDF ↗
Improved Zero-Shot Classification by Adapting VLMs with Text Descriptions Oindrila Saha, Grant Van Horn, Subhransu Maji arXiv ↗ PDF ↗
Improving Bird's Eye View Semantic Segmentation by Task Decomposition Tianhao Zhao, Yongcan Chen, Yu Wu, Tianyang Liu, Bo Du, Peilun Xiao, Shi Qiu, Hongda Yang, Guozhen Li, Yi Yang, Yutian Lin PDF ↗
Improving Depth Completion via Depth Feature Upsampling Yufei Wang, Ge Zhang, Shaoqian Wang, Bo Li, Qi Liu, Le Hui, Yuchao Dai PDF ↗
Improving Distant 3D Object Detection Using 2D Box Supervision Zetong Yang, Zhiding Yu, Chris Choy, Renhao Wang, Anima Anandkumar, Jose M. Alvarez arXiv ↗ PDF ↗
Improving Generalization via Meta-Learning on Hard Samples Nishant Jain, Arun S. Suggala, Pradeep Shenoy arXiv ↗ PDF ↗
Improving Generalized Zero-Shot Learning by Exploring the Diverse Semantics from External Class Names Yapeng Li, Yong Luo, Zengmao Wang, Bo Du PDF ↗
Improving Graph Contrastive Learning via Adaptive Positive Sampling Jiaming Zhuo, Feiyang Qin, Can Cui, Kun Fu, Bingxin Niu, Mengzhu Wang, Yuanfang Guo, Chuan Wang, Zhen Wang, Xiaochun Cao, Liang Yang PDF ↗
Improving Image Restoration through Removing Degradations in Textual Representations Jingbo Lin, Zhilu Zhang, Yuxiang Wei, Dongwei Ren, Dongsheng Jiang, Qi Tian, Wangmeng Zuo arXiv ↗ PDF ↗
Improving Out-of-Distribution Generalization in Graphs via Hierarchical Semantic Environments Yinhua Piao, Sangseon Lee, Yijingxiu Lu, Sun Kim arXiv ↗ PDF ↗
Improving Physics-Augmented Continuum Neural Radiance Field-Based Geometry-Agnostic System Identification with Lagrangian Particle Optimization Takuhiro Kaneko PDF ↗
Improving Plasticity in Online Continual Learning via Collaborative Learning Maorong Wang, Nicolas Michel, Ling Xiao, Toshihiko Yamasaki arXiv ↗ PDF ↗
Improving Semantic Correspondence with Viewpoint-Guided Spherical Maps Octave Mariotti, Oisin Mac Aodha, Hakan Bilen arXiv ↗ PDF ↗
Improving Single Domain-Generalized Object Detection: A Focus on Diversification and Alignment Muhammad Sohail Danish, Muhammad Haris Khan, Muhammad Akhtar Munir, M. Saquib Sarfraz, Mohsen Ali arXiv ↗ PDF ↗
Improving Spectral Snapshot Reconstruction with Spectral-Spatial Rectification Jiancheng Zhang, Haijin Zeng, Yongyong Chen, Dengxiu Yu, Yin-Ping Zhao PDF ↗
Improving Subject-Driven Image Synthesis with Subject-Agnostic Guidance Kelvin C.K. Chan, Yang Zhao, Xuhui Jia, Ming-Hsuan Yang, Huisheng Wang arXiv ↗ PDF ↗
Improving Training Efficiency of Diffusion Models via Multi-Stage Framework and Tailored Multi-Decoder Architecture Huijie Zhang, Yifu Lu, Ismail Alkhouri, Saiprasad Ravishankar, Dogyoon Song, Qing Qu PDF ↗
Improving Transferable Targeted Adversarial Attacks with Model Self-Enhancement Han Wu, Guanyan Ou, Weibin Wu, Zibin Zheng PDF ↗
Improving Unsupervised Hierarchical Representation with Reinforcement Learning Ruyi An, Yewen Li, Xu He, Pengjie Gu, Mengchen Zhao, Dong Li, Jianye Hao, Chaojie Wang, Bo An, Mingyuan Zhou PDF ↗
Improving Visual Recognition with Hyperbolical Visual Hierarchy Mapping Hyeongjun Kwon, Jinhyun Jang, Jin Kim, Kwonyoung Kim, Kwanghoon Sohn arXiv ↗ PDF ↗
Improving the Generalization of Segmentation Foundation Model under Distribution Shift via Weakly Supervised Adaptation Haojie Zhang, Yongyi Su, Xun Xu, Kui Jia arXiv ↗ PDF ↗
In Search of a Data Transformation That Accelerates Neural Field Training Junwon Seo, Sangyoon Lee, Kwang In Kim, Jaeho Lee arXiv ↗ PDF ↗
In-N-Out: Faithful 3D GAN Inversion with Volumetric Decomposition for Face Editing Yiran Xu, Zhixin Shu, Cameron Smith, Seoung Wug Oh, Jia-Bin Huang PDF ↗
In-distribution Public Data Synthesis with Diffusion Models for Differentially Private Image Classification Jinseong Park, Yujin Choi, Jaewook Lee PDF ↗
In2SET: Intra-Inter Similarity Exploiting Transformer for Dual-Camera Compressive Hyperspectral Imaging Xin Wang, Lizhi Wang, Xiangtian Ma, Maoqing Zhang, Lin Zhu, Hua Huang arXiv ↗ PDF ↗
InNeRF360: Text-Guided 3D-Consistent Object Inpainting on 360-degree Neural Radiance Fields Dongqing Wang, Tong Zhang, Alaa Abboud, Sabine Süsstrunk arXiv ↗ PDF ↗
InceptionNeXt: When Inception Meets ConvNeXt Weihao Yu, Pan Zhou, Shuicheng Yan, Xinchao Wang arXiv ↗ PDF ↗
Incorporating Geo-Diverse Knowledge into Prompting for Increased Geographical Robustness in Object Recognition Kyle Buettner, Sina Malakouti, Xiang Lorraine Li, Adriana Kovashka arXiv ↗ PDF ↗
Incremental Nuclei Segmentation from Histopathological Images via Future-class Awareness and Compatibility-inspired Distillation Huyong Wang, Huisi Wu, Jing Qin PDF ↗
Incremental Residual Concept Bottleneck Models Chenming Shang, Shiji Zhou, Hengyuan Zhang, Xinzhe Ni, Yujiu Yang, Yuwang Wang arXiv ↗ PDF ↗
InfLoRA: Interference-Free Low-Rank Adaptation for Continual Learning Yan-Shuo Liang, Wu-Jun Li arXiv ↗ PDF ↗
Infer from What You Have Seen Before: Temporally-dependent Classifier for Semi-supervised Video Segmentation Jiafan Zhuang, Zilei Wang, Yixin Zhang, Zhun Fan PDF ↗
Infinigen Indoors: Photorealistic Indoor Scenes using Procedural Generation Alexander Raistrick, Lingjie Mei, Karhan Kayan, David Yan, Yiming Zuo, Beining Han, Hongyu Wen, Meenal Parakh, Stamatis Alexandropoulos, Lahav Lipson, Zeyu Ma, Jia Deng PDF ↗
Infrared Adversarial Car Stickers Xiaopei Zhu, Yuqiu Liu, Zhanhao Hu, Jianmin Li, Xiaolin Hu arXiv ↗ PDF ↗
Infrared Small Target Detection with Scale and Location Sensitivity Qiankun Liu, Rui Liu, Bolun Zheng, Hongkui Wang, Ying Fu arXiv ↗ PDF ↗
InitNO: Boosting Text-to-Image Diffusion Models via Initial Noise Optimization Xiefan Guo, Jinlin Liu, Miaomiao Cui, Jiankai Li, Hongyu Yang, Di Huang arXiv ↗ PDF ↗
Initialization Matters for Adversarial Transfer Learning Andong Hua, Jindong Gu, Zhiyu Xue, Nicholas Carlini, Eric Wong, Yao Qin arXiv ↗ PDF ↗
Ink Dot-Oriented Differentiable Optimization for Neural Image Halftoning Hao Jiang, Bingfeng Zhou, Yadong Mu PDF ↗
Inlier Confidence Calibration for Point Cloud Registration Yongzhe Yuan, Yue Wu, Xiaolong Fan, Maoguo Gong, Qiguang Miao, Wenping Ma PDF ↗
Insights from the Use of Previously Unseen Neural Architecture Search Datasets Rob Geada, David Towers, Matthew Forshaw, Amir Atapour-Abarghouei, A. Stephen McGough arXiv ↗ PDF ↗
InstaGen: Enhancing Object Detection by Training on Synthetic Dataset Chengjian Feng, Yujie Zhong, Zequn Jie, Weidi Xie, Lin Ma arXiv ↗ PDF ↗
Instance Tracking in 3D Scenes from Egocentric Videos Yunhan Zhao, Haoyu Ma, Shu Kong, Charless Fowlkes arXiv ↗ PDF ↗
Instance-Adaptive and Geometric-Aware Keypoint Learning for Category-Level 6D Object Pose Estimation Xiao Lin, Wenfei Yang, Yuan Gao, Tianzhu Zhang arXiv ↗ PDF ↗
Instance-Aware Group Quantization for Vision Transformers Jaehyeon Moon, Dohyung Kim, Junyong Cheon, Bumsub Ham arXiv ↗ PDF ↗
Instance-aware Contrastive Learning for Occluded Human Mesh Reconstruction Mi-Gyeong Gwon, Gi-Mun Um, Won-Sik Cheong, Wonjun Kim PDF ↗
Instance-aware Exploration-Verification-Exploitation for Instance ImageGoal Navigation Xiaohan Lei, Min Wang, Wengang Zhou, Li Li, Houqiang Li arXiv ↗ PDF ↗
Instance-level Expert Knowledge and Aggregate Discriminative Attention for Radiology Report Generation Shenshen Bu, Taiji Li, Yuedong Yang, Zhiming Dai PDF ↗
InstanceDiffusion: Instance-level Control for Image Generation Xudong Wang, Trevor Darrell, Sai Saketh Rambhatla, Rohit Girdhar, Ishan Misra arXiv ↗ PDF ↗
InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning Jing Shi, Wei Xiong, Zhe Lin, Hyun Joon Jung arXiv ↗ PDF ↗
Instantaneous Perception of Moving Objects in 3D Di Liu, Bingbing Zhuang, Dimitris N. Metaxas, Manmohan Chandraker arXiv ↗ PDF ↗
Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D Diffusion Linzhan Mou, Jun-Kun Chen, Yu-Xiong Wang PDF ↗
Instruct-Imagen: Image Generation with Multi-modal Instruction Hexiang Hu, Kelvin C.K. Chan, Yu-Chuan Su, Wenhu Chen, Yandong Li, Kihyuk Sohn, Yang Zhao, Xue Ben, Boqing Gong, William Cohen, Ming-Wei Chang, Xuhui Jia PDF ↗
Instruct-ReID: A Multi-purpose Person Re-identification Task with Instructions Weizhen He, Yiheng Deng, Shixiang Tang, Qihao Chen, Qingsong Xie, Yizhou Wang, Lei Bai, Feng Zhu, Rui Zhao, Wanli Ouyang, Donglian Qi, Yunfeng Yan PDF ↗
InstructDiffusion: A Generalist Modeling Interface for Vision Tasks Zigang Geng, Binxin Yang, Tiankai Hang, Chen Li, Shuyang Gu, Ting Zhang, Jianmin Bao, Zheng Zhang, Houqiang Li, Han Hu, Dong Chen, Baining Guo arXiv ↗ PDF ↗
InstructVideo: Instructing Video Diffusion Models with Human Feedback Hangjie Yuan, Shiwei Zhang, Xiang Wang, Yujie Wei, Tao Feng, Yining Pan, Yingya Zhang, Ziwei Liu, Samuel Albanie, Dong Ni arXiv ↗ PDF ↗
Integrating Efficient Optimal Transport and Functional Maps For Unsupervised Shape Correspondence Learning Tung Le, Khai Nguyen, Shanlin Sun, Nhat Ho, Xiaohui Xie arXiv ↗ PDF ↗
Intelligent Grimm - Open-ended Visual Storytelling via Latent Diffusion Models Chang Liu, Haoning Wu, Yujie Zhong, Xiaoyun Zhang, Yanfeng Wang, Weidi Xie PDF ↗
Intensity-Robust Autofocus for Spike Camera Changqing Su, Zhiyuan Ye, Yongsheng Xiao, You Zhou, Zhen Cheng, Bo Xiong, Zhaofei Yu, Tiejun Huang PDF ↗
Inter-X: Towards Versatile Human-Human Interaction Analysis Liang Xu, Xintao Lv, Yichao Yan, Xin Jin, Shuwen Wu, Congsheng Xu, Yifan Liu, Yizhou Zhou, Fengyun Rao, Xingdong Sheng, Yunhui Liu, Wenjun Zeng, Xiaokang Yang PDF ↗
InterHandGen: Two-Hand Interaction Generation via Cascaded Reverse Diffusion Jihyun Lee, Shunsuke Saito, Giljoo Nam, Minhyuk Sung, Tae-Kyun Kim arXiv ↗ PDF ↗
InteractDiffusion: Interaction Control in Text-to-Image Diffusion Models Jiun Tian Hoe, Xudong Jiang, Chee Seng Chan, Yap-Peng Tan, Weipeng Hu arXiv ↗ PDF ↗
Interactive Continual Learning: Fast and Slow Thinking Biqing Qi, Xinquan Chen, Junqi Gao, Dong Li, Jianxing Liu, Ligang Wu, Bowen Zhou arXiv ↗ PDF ↗
Interactive3D: Create What You Want by Interactive 3D Generation Shaocong Dong, Lihe Ding, Zhanpeng Huang, Zibin Wang, Tianfan Xue, Dan Xu arXiv ↗ PDF ↗
InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks Zhe Chen, Jiannan Wu, Wenhai Wang, Weijie Su, Guo Chen, Sen Xing, Muyan Zhong, Qinglong Zhang, Xizhou Zhu, Lewei Lu, Bin Li, Ping Luo, Tong Lu, Yu Qiao, Jifeng Dai arXiv ↗ PDF ↗
Interpretable Measures of Conceptual Similarity by Complexity-Constrained Descriptive Auto-Encoding Alessandro Achille, Greg Ver Steeg, Tian Yu Liu, Matthew Trager, Carson Klingenberg, Stefano Soatto arXiv ↗ PDF ↗
Intraoperative 2D/3D Image Registration via Differentiable X-ray Rendering Vivek Gopalakrishnan, Neel Dey, Polina Golland PDF ↗
Intriguing Properties of Diffusion Models: An Empirical Study of the Natural Attack Capability in Text-to-Image Generative Models Takami Sato, Justin Yue, Nanze Chen, Ningfei Wang, Qi Alfred Chen arXiv ↗ PDF ↗
Intrinsic Image Diffusion for Indoor Single-view Material Estimation Peter Kocsis, Vincent Sitzmann, Matthias Nießner PDF ↗
IntrinsicAvatar: Physically Based Inverse Rendering of Dynamic Humans from Monocular Videos via Explicit Ray Tracing Shaofei Wang, Bozidar Antic, Andreas Geiger, Siyu Tang arXiv ↗ PDF ↗
Inverse Rendering of Glossy Objects via the Neural Plenoptic Function and Radiance Fields Haoyuan Wang, Wenbo Hu, Lei Zhu, Rynson W.H. Lau arXiv ↗ PDF ↗
Inversion-Free Image Editing with Language-Guided Diffusion Models Sihan Xu, Yidong Huang, Jiayi Pan, Ziqiao Ma, Joyce Chai PDF ↗
Investigating and Mitigating the Side Effects of Noisy Views for Self-Supervised Clustering Algorithms in Practical Multi-View Scenarios Jie Xu, Yazhou Ren, Xiaolong Wang, Lei Feng, Zheng Zhang, Gang Niu, Xiaofeng Zhu arXiv ↗ PDF ↗
Is Ego Status All You Need for Open-Loop End-to-End Autonomous Driving? Zhiqi Li, Zhiding Yu, Shiyi Lan, Jiahan Li, Jan Kautz, Tong Lu, Jose M. Alvarez arXiv ↗ PDF ↗
Is Vanilla MLP in Neural Radiance Field Enough for Few-shot View Synthesis? Hanxin Zhu, Tianyu He, Xin Li, Bingchen Li, Zhibo Chen arXiv ↗ PDF ↗
It's All About Your Sketch: Democratising Sketch Control in Diffusion Models Subhadeep Koley, Ayan Kumar Bhunia, Deeptanshu Sekhri, Aneeshan Sain, Pinaki Nath Chowdhury, Tao Xiang, Yi-Zhe Song PDF ↗
Iterated Learning Improves Compositionality in Large Vision-Language Models Chenhao Zheng, Jieyu Zhang, Aniruddha Kembhavi, Ranjay Krishna arXiv ↗ PDF ↗
JDEC: JPEG Decoding via Enhanced Continuous Cosine Coefficients Woo Kyoung Han, Sunghoon Im, Jaedeok Kim, Kyong Hwan Jin arXiv ↗ PDF ↗
JRDB-PanoTrack: An Open-world Panoptic Segmentation and Tracking Robotic Dataset in Crowded Human Environments Duy Tho Le, Chenhui Gou, Stavya Datta, Hengcan Shi, Ian Reid, Jianfei Cai, Hamid Rezatofighi PDF ↗
JRDB-Social: A Multifaceted Robotic Dataset for Understanding of Context and Dynamics of Human Interactions Within Social Groups Simindokht Jahangard, Zhixi Cai, Shiki Wen, Hamid Rezatofighi PDF ↗
JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation Yu Zeng, Vishal M. Patel, Haochen Wang, Xun Huang, Ting-Chun Wang, Ming-Yu Liu, Yogesh Balaji PDF ↗
JoAPR: Cleaning the Lens of Prompt Learning for Vision-Language Models Yuncheng Guo, Xiaodong Gu PDF ↗
Joint Reconstruction of 3D Human and Object via Contact-Based Refinement Transformer Hyeongjin Nam, Daniel Sungho Jung, Gyeongsik Moon, Kyoung Mu Lee arXiv ↗ PDF ↗
Joint-Task Regularization for Partially Labeled Multi-Task Learning Kento Nishi, Junsik Kim, Wanhua Li, Hanspeter Pfister arXiv ↗ PDF ↗
Joint2Human: High-Quality 3D Human Generation via Compact Spherical Embedding of 3D Joints Muxin Zhang, Qiao Feng, Zhuo Su, Chao Wen, Zhou Xue, Kun Li arXiv ↗ PDF ↗
JointSQ: Joint Sparsification-Quantization for Distributed Learning Weiying Xie, Haowei Li, Jitao Ma, Yunsong Li, Jie Lei, Donglai Liu, Leyuan Fang PDF ↗
Jointly Training and Pruning CNNs via Learnable Agent Guidance and Alignment Alireza Ganjdanesh, Shangqian Gao, Heng Huang arXiv ↗ PDF ↗
Just Add π! Pose Induced Video Transformers for Understanding Activities of Daily Living Dominick Reilly, Srijan Das PDF ↗
KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling Yu Wang, Xin Li, Shengzhao Weng, Gang Zhang, Haixiao Yue, Haocheng Feng, Junyu Han, Errui Ding PDF ↗
KITRO: Refining Human Mesh by 2D Clues and Kinematic-tree Rotation Fengyuan Yang, Kerui Gu, Angela Yao arXiv ↗ PDF ↗
KP-RED: Exploiting Semantic Keypoints for Joint 3D Shape Retrieval and Deformation Ruida Zhang, Chenyangguang Zhang, Yan Di, Fabian Manhardt, Xingyu Liu, Federico Tombari, Xiangyang Ji PDF ↗
KPConvX: Modernizing Kernel Point Convolution with Kernel Attention Hugues Thomas, Yao-Hung Hubert Tsai, Timothy D. Barfoot, Jian Zhang arXiv ↗ PDF ↗
KTPFormer: Kinematics and Trajectory Prior Knowledge-Enhanced Transformer for 3D Human Pose Estimation Jihua Peng, Yanghong Zhou, P. Y. Mok arXiv ↗ PDF ↗
KVQ: Kwai Video Quality Assessment for Short-form Videos Yiting Lu, Xin Li, Yajing Pei, Kun Yuan, Qizhi Xie, Yunpeng Qu, Ming Sun, Chao Zhou, Zhibo Chen arXiv ↗ PDF ↗
Kandinsky Conformal Prediction: Efficient Calibration of Image Segmentation Algorithms Joren Brunekreef, Eric Marcus, Ray Sheombarsing, Jan-Jakob Sonke, Jonas Teuwen arXiv ↗ PDF ↗
Kernel Adaptive Convolution for Scene Text Detection via Distance Map Prediction Jinzhi Zheng, Heng Fan, Libo Zhang PDF ↗
KeyPoint Relative Position Encoding for Face Recognition Minchul Kim, Yiyang Su, Feng Liu, Anil Jain, Xiaoming Liu arXiv ↗ PDF ↗
Know Your Neighbors: Improving Single-View Reconstruction via Spatial Vision-Language Reasoning Rui Li, Tobias Fischer, Mattia Segu, Marc Pollefeys, Luc Van Gool, Federico Tombari arXiv ↗ PDF ↗
Knowledge-Enhanced Dual-stream Zero-shot Composed Image Retrieval Yucheng Suo, Fan Ma, Linchao Zhu, Yi Yang arXiv ↗ PDF ↗
L-MAGIC: Language Model Assisted Generation of Images with Coherence Zhipeng Cai, Matthias Mueller, Reiner Birkl, Diana Wofk, Shao-Yen Tseng, Junda Cheng, Gabriela Ben-Melech Stan, Vasudev Lai, Michael Paulitsch PDF ↗
L2B: Learning to Bootstrap Robust Models for Combating Label Noise Yuyin Zhou, Xianhang Li, Fengze Liu, Qingyue Wei, Xuxi Chen, Lequan Yu, Cihang Xie, Matthew P. Lungren, Lei Xing arXiv ↗ PDF ↗
L4D-Track: Language-to-4D Modeling Towards 6-DoF Tracking and Shape Reconstruction in 3D Point Cloud Stream Jingtao Sun, Yaonan Wang, Mingtao Feng, Yulan Guo, Ajmal Mian, Mike Zheng Shou PDF ↗
LAA-Net: Localized Artifact Attention Network for Quality-Agnostic and Generalizable Deepfake Detection Dat Nguyen, Nesryne Mejri, Inder Pal Singh, Polina Kuleshova, Marcella Astrid, Anis Kacem, Enjie Ghorbel, Djamila Aouada PDF ↗
LAENeRF: Local Appearance Editing for Neural Radiance Fields Lukas Radl, Michael Steiner, Andreas Kurz, Markus Steinberger arXiv ↗ PDF ↗
LAFS: Landmark-based Facial Self-supervised Learning for Face Recognition Zhonglin Sun, Chen Feng, Ioannis Patras, Georgios Tzimiropoulos arXiv ↗ PDF ↗
LAKE-RED: Camouflaged Images Generation by Latent Background Knowledge Retrieval-Augmented Diffusion Pancheng Zhao, Peng Xu, Pengda Qin, Deng-Ping Fan, Zhicheng Zhang, Guoli Jia, Bowen Zhou, Jufeng Yang PDF ↗
LAMP: Learn A Motion Pattern for Few-Shot Video Generation Ruiqi Wu, Liangyu Chen, Tong Yang, Chunle Guo, Chongyi Li, Xiangyu Zhang PDF ↗
LASA: Instance Reconstruction from Real Scans using A Large-scale Aligned Shape Annotation Dataset Haolin Liu, Chongjie Ye, Yinyu Nie, Yingfan He, Xiaoguang Han arXiv ↗ PDF ↗
LASIL: Learner-Aware Supervised Imitation Learning For Long-term Microscopic Traffic Simulation Ke Guo, Zhenwei Miao, Wei Jing, Weiwei Liu, Weizi Li, Dayang Hao, Jia Pan arXiv ↗ PDF ↗
LASO: Language-guided Affordance Segmentation on 3D Object Yicong Li, Na Zhao, Junbin Xiao, Chun Feng, Xiang Wang, Tat-seng Chua PDF ↗
LDP: Language-driven Dual-Pixel Image Defocus Deblurring Network Hao Yang, Liyuan Pan, Yan Yang, Richard Hartley, Miaomiao Liu arXiv ↗ PDF ↗
LEAD: Exploring Logit Space Evolution for Model Selection Zixuan Hu, Xiaotong Li, Shixiang Tang, Jun Liu, Yichun Hu, Ling-Yu Duan PDF ↗
LEAD: Learning Decomposition for Source-free Universal Domain Adaptation Sanqing Qu, Tianpei Zou, Lianghua He, Florian Röhrbein, Alois Knoll, Guang Chen, Changjun Jiang arXiv ↗ PDF ↗
LEAP-VO: Long-term Effective Any Point Tracking for Visual Odometry Weirong Chen, Le Chen, Rui Wang, Marc Pollefeys PDF ↗
LEDITS++: Limitless Image Editing using Text-to-Image Models Manuel Brack, Felix Friedrich, Katharia Kornmeier, Linoy Tsaban, Patrick Schramowski, Kristian Kersting, Apolinario Passos PDF ↗
LEMON: Learning 3D Human-Object Interaction Relation from 2D Images Yuhang Yang, Wei Zhai, Hongchen Luo, Yang Cao, Zheng-Jun Zha arXiv ↗ PDF ↗
LEOD: Label-Efficient Object Detection for Event Cameras Ziyi Wu, Mathias Gehrig, Qing Lyu, Xudong Liu, Igor Gilitschenski arXiv ↗ PDF ↗
LION: Empowering Multimodal Large Language Model with Dual-Level Visual Knowledge Gongwei Chen, Leyang Shen, Rui Shao, Xiang Deng, Liqiang Nie arXiv ↗ PDF ↗
LISA: Reasoning Segmentation via Large Language Model Xin Lai, Zhuotao Tian, Yukang Chen, Yanwei Li, Yuhui Yuan, Shu Liu, Jiaya Jia arXiv ↗ PDF ↗
LL3DA: Visual Interactive Instruction Tuning for Omni-3D Understanding Reasoning and Planning Sijin Chen, Xin Chen, Chi Zhang, Mingsheng Li, Gang Yu, Hao Fei, Hongyuan Zhu, Jiayuan Fan, Tao Chen arXiv ↗ PDF ↗
LLM4SGG: Large Language Models for Weakly Supervised Scene Graph Generation Kibum Kim, Kanghoon Yoon, Jaehyeong Jeon, Yeonjun In, Jinyoung Moon, Donghyun Kim, Chanyoung Park arXiv ↗ PDF ↗
LLMs are Good Sign Language Translators Jia Gong, Lin Geng Foo, Yixuan He, Hossein Rahmani, Jun Liu arXiv ↗ PDF ↗
LLaFS: When Large Language Models Meet Few-Shot Segmentation Lanyun Zhu, Tianrun Chen, Deyi Ji, Jieping Ye, Jun Liu arXiv ↗ PDF ↗
LLaMA-Excitor: General Instruction Tuning via Indirect Feature Interaction Bo Zou, Chao Yang, Yu Qiao, Chengbin Quan, Youjian Zhao PDF ↗
LMDrive: Closed-Loop End-to-End Driving with Large Language Models Hao Shao, Yuxuan Hu, Letian Wang, Guanglu Song, Steven L. Waslander, Yu Liu, Hongsheng Li arXiv ↗ PDF ↗
LOTUS: Evasive and Resilient Backdoor Attacks through Sub-Partitioning Siyuan Cheng, Guanhong Tao, Yingqi Liu, Guangyu Shen, Shengwei An, Shiwei Feng, Xiangzhe Xu, Kaiyuan Zhang, Shiqing Ma, Xiangyu Zhang arXiv ↗ PDF ↗
LP++: A Surprisingly Strong Linear Probe for Few-Shot CLIP Yunshi Huang, Fereshteh Shakeri, Jose Dolz, Malik Boudiaf, Houda Bahig, Ismail Ben Ayed PDF ↗
LPSNet: End-to-End Human Pose and Shape Estimation with Lensless Imaging Haoyang Ge, Qiao Feng, Hailong Jia, Xiongzheng Li, Xiangjun Yin, You Zhou, Jingyu Yang, Kun Li arXiv ↗ PDF ↗
LQMFormer: Language-aware Query Mask Transformer for Referring Image Segmentation Nisarg A. Shah, Vibashan VS, Vishal M. Patel PDF ↗
LSK3DNet: Towards Effective and Efficient 3D Perception with Large Sparse Kernels Tuo Feng, Wenguan Wang, Fan Ma, Yi Yang arXiv ↗ PDF ↗
LTA-PCS: Learnable Task-Agnostic Point Cloud Sampling Jiaheng Liu, Jianhao Li, Kaisiyuan Wang, Hongcheng Guo, Jian Yang, Junran Peng, Ke Xu, Xianglong Liu, Jinyang Guo PDF ↗
LTGC: Long-tail Recognition via Leveraging LLMs-driven Generated Content Qihao Zhao, Yalun Dai, Hao Li, Wei Hu, Fan Zhang, Jun Liu arXiv ↗ PDF ↗
LTM: Lightweight Textured Mesh Extraction and Refinement of Large Unbounded Scenes for Efficient Storage and Real-time Rendering Jaehoon Choi, Rajvi Shah, Qinbo Li, Yipeng Wang, Ayush Saraf, Changil Kim, Jia-Bin Huang, Dinesh Manocha, Suhib Alsisan, Johannes Kopf PDF ↗
LaMPilot: An Open Benchmark Dataset for Autonomous Driving with Language Model Programs Yunsheng Ma, Can Cui, Xu Cao, Wenqian Ye, Peiran Liu, Juanwu Lu, Amr Abdelraouf, Rohit Gupta, Kyungtae Han, Aniket Bera, James M. Rehg, Ziran Wang arXiv ↗ PDF ↗
LaRE^2: Latent Reconstruction Error Based Method for Diffusion-Generated Image Detection Yunpeng Luo, Junlong Du, Ke Yan, Shouhong Ding PDF ↗
Label Propagation for Zero-shot Classification with Vision-Language Models Vladan Stojni?, Yannis Kalantidis, Giorgos Tolias PDF ↗
Label-Efficient Group Robustness via Out-of-Distribution Concept Curation Yiwei Yang, Anthony Z. Liu, Robert Wolfe, Aylin Caliskan, Bill Howe PDF ↗
LaneCPP: Continuous 3D Lane Detection using Physical Priors Maximilian Pittner, Joel Janai, Alexandru P. Condurache PDF ↗
Language Embedded 3D Gaussians for Open-Vocabulary Scene Understanding Jin-Chuan Shi, Miao Wang, Hao-Bin Duan, Shao-Hua Guan arXiv ↗ PDF ↗
Language Model Guided Interpretable Video Action Reasoning Ning Wang, Guangming Zhu, HS Li, Liang Zhang, Syed Afaq Ali Shah, Mohammed Bennamoun arXiv ↗ PDF ↗
Language Models as Black-Box Optimizers for Vision-Language Models Shihong Liu, Samuel Yu, Zhiqiu Lin, Deepak Pathak, Deva Ramanan arXiv ↗ PDF ↗
Language-Driven Anchors for Zero-Shot Adversarial Robustness Xiao Li, Wei Zhang, Yining Liu, Zhanhao Hu, Bo Zhang, Xiaolin Hu arXiv ↗ PDF ↗
Language-aware Visual Semantic Distillation for Video Question Answering Bo Zou, Chao Yang, Yu Qiao, Chengbin Quan, Youjian Zhao PDF ↗
Language-driven All-in-one Adverse Weather Removal Hao Yang, Liyuan Pan, Yan Yang, Wei Liang arXiv ↗ PDF ↗
Language-driven Grasp Detection An Dinh Vuong, Minh Nhat Vu, Baoru Huang, Nghia Nguyen, Hieu Le, Thieu Vo, Anh Nguyen PDF ↗
Language-driven Object Fusion into Neural Radiance Fields with Pose-Conditioned Dataset Updates Ka Chun Shum, Jaeyeon Kim, Binh-Son Hua, Duc Thanh Nguyen, Sai-Kit Yeung arXiv ↗ PDF ↗
Language-guided Image Reflection Separation Haofeng Zhong, Yuchen Hong, Shuchen Weng, Jinxiu Liang, Boxin Shi arXiv ↗ PDF ↗
Language-only Training of Zero-shot Composed Image Retrieval Geonmo Gu, Sanghyuk Chun, Wonjae Kim, Yoohoon Kang, Sangdoo Yun PDF ↗
Laplacian-guided Entropy Model in Neural Codec with Blur-dissipated Synthesis Atefeh Khoshkhahtinat, Ali Zafari, Piyush M. Mehta, Nasser M. Nasrabadi arXiv ↗ PDF ↗
Large Language Models are Good Prompt Learners for Low-Shot Image Classification Zhaoheng Zheng, Jingmin Wei, Xuefeng Hu, Haidong Zhu, Ram Nevatia arXiv ↗ PDF ↗
Latency Correction for Event-guided Deblurring and Frame Interpolation Yixin Yang, Jinxiu Liang, Bohan Yu, Yan Chen, Jimmy S. Ren, Boxin Shi PDF ↗
Layout-Agnostic Scene Text Image Synthesis with Diffusion Models Qilong Zhangli, Jindong Jiang, Di Liu, Licheng Yu, Xiaoliang Dai, Ankit Ramchandani, Guan Pang, Dimitris N. Metaxas, Praveen Krishnan PDF ↗
LayoutFormer: Hierarchical Text Detection Towards Scene Text Understanding Min Liang, Jia-Wei Ma, Xiaobin Zhu, Jingyan Qin, Xu-Cheng Yin PDF ↗
LayoutLLM: Layout Instruction Tuning with Large Language Models for Document Understanding Chuwei Luo, Yufan Shen, Zhaoqing Zhu, Qi Zheng, Zhi Yu, Cong Yao arXiv ↗ PDF ↗
Leak and Learn: An Attacker's Cookbook to Train Using Leaked Data from Federated Learning Joshua C. Zhao, Ahaan Dabholkar, Atul Sharma, Saurabh Bagchi PDF ↗
Learn from View Correlation: An Anchor Enhancement Strategy for Multi-view Clustering Suyuan Liu, Ke Liang, Zhibin Dong, Siwei Wang, Xihong Yang, Sihang Zhou, En Zhu, Xinwang Liu PDF ↗
Learn to Rectify the Bias of CLIP for Unsupervised Semantic Segmentation Jingyun Wang, Guoliang Kang PDF ↗
Learnable Earth Parser: Discovering 3D Prototypes in Aerial Scans Romain Loiseau, Elliot Vincent, Mathieu Aubry, Loic Landrieu arXiv ↗ PDF ↗
Learned Lossless Image Compression based on Bit Plane Slicing Zhe Zhang, Huairui Wang, Zhenzhong Chen, Shan Liu PDF ↗
Learned Representation-Guided Diffusion Models for Large-Image Generation Alexandros Graikos, Srikar Yellapragada, Minh-Quan Le, Saarthak Kapse, Prateek Prasanna, Joel Saltz, Dimitris Samaras arXiv ↗ PDF ↗
Learned Scanpaths Aid Blind Panoramic Video Quality Assessment Kanglong Fan, Wen Wen, Mu Li, Yifan Peng, Kede Ma arXiv ↗ PDF ↗
Learned Trajectory Embedding for Subspace Clustering Yaroslava Lochman, Carl Olsson, Christopher Zach PDF ↗
Learning Background Prompts to Discover Implicit Knowledge for Open Vocabulary Object Detection Jiaming Li, Jiacheng Zhang, Jichang Li, Ge Li, Si Liu, Liang Lin, Guanbin Li PDF ↗
Learning CNN on ViT: A Hybrid Model to Explicitly Class-specific Boundaries for Domain Adaptation Ba Hung Ngo, Nhat-Tuong Do-Tran, Tuan-Ngoc Nguyen, Hae-Gon Jeon, Tae Jong Choi arXiv ↗ PDF ↗
Learning Continual Compatible Representation for Re-indexing Free Lifelong Person Re-identification Zhenyu Cui, Jiahuan Zhou, Xun Wang, Manyu Zhu, Yuxin Peng PDF ↗
Learning Continuous 3D Words for Text-to-Image Generation Ta-Ying Cheng, Matheus Gadelha, Thibault Groueix, Matthew Fisher, Radomir Mech, Andrew Markham, Niki Trigoni arXiv ↗ PDF ↗
Learning Correlation Structures for Vision Transformers Manjin Kim, Paul Hongsuck Seo, Cordelia Schmid, Minsu Cho arXiv ↗ PDF ↗
Learning Coupled Dictionaries from Unpaired Data for Image Super-Resolution Longguang Wang, Juncheng Li, Yingqian Wang, Qingyong Hu, Yulan Guo PDF ↗
Learning Degradation-Independent Representations for Camera ISP Pipelines Yanhui Guo, Fangzhou Luo, Xiaolin Wu arXiv ↗ PDF ↗
Learning Degradation-unaware Representation with Prior-based Latent Transformations for Blind Face Restoration Lianxin Xie, Csbingbing Zheng, Wen Xue, Le Jiang, Cheng Liu, Si Wu, Hau San Wong PDF ↗
Learning Discriminative Dynamics with Label Corruption for Noisy Label Detection Suyeon Kim, Dongha Lee, SeongKu Kang, Sukang Chae, Sanghwan Jang, Hwanjo Yu arXiv ↗ PDF ↗
Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation Siteng Huang, Biao Gong, Yutong Feng, Xi Chen, Yuqian Fu, Yu Liu, Donglin Wang arXiv ↗ PDF ↗
Learning Dynamic Tetrahedra for High-Quality Talking Head Synthesis Zicheng Zhang, Ruobing Zheng, Bonan Li, Congying Han, Tianqi Li, Meng Wang, Tiande Guo, Jingdong Chen, Ziwen Liu, Ming Yang arXiv ↗ PDF ↗
Learning Equi-angular Representations for Online Continual Learning Minhyuk Seo, Hyunseo Koh, Wonje Jeung, Minjae Lee, San Kim, Hankook Lee, Sungjun Cho, Sungik Choi, Hyunwoo Kim, Jonghyun Choi arXiv ↗ PDF ↗
Learning Group Activity Features Through Person Attribute Prediction Chihiro Nakatani, Hiroaki Kawashima, Norimichi Ukita arXiv ↗ PDF ↗
Learning Inclusion Matching for Animation Paint Bucket Colorization Yuekun Dai, Shangchen Zhou, Qinyue Li, Chongyi Li, Chen Change Loy arXiv ↗ PDF ↗
Learning Instance-Aware Correspondences for Robust Multi-Instance Point Cloud Registration in Cluttered Scenes Zhiyuan Yu, Zheng Qin, Lintao Zheng, Kai Xu arXiv ↗ PDF ↗
Learning Intra-view and Cross-view Geometric Knowledge for Stereo Matching Rui Gong, Weide Liu, Zaiwang Gu, Xulei Yang, Jun Cheng arXiv ↗ PDF ↗
Learning Large-Factor EM Image Super-Resolution with Generative Priors Jiateng Shou, Zeyu Xiao, Shiyu Deng, Wei Huang, Peiyao Shi, Ruobing Zhang, Zhiwei Xiong, Feng Wu PDF ↗
Learning Multi-Dimensional Human Preference for Text-to-Image Generation Sixian Zhang, Bohan Wang, Junqiang Wu, Yan Li, Tingting Gao, Di Zhang, Zhongyuan Wang arXiv ↗ PDF ↗
Learning Object State Changes in Videos: An Open-World Perspective Zihui Xue, Kumar Ashutosh, Kristen Grauman arXiv ↗ PDF ↗