‹ June 6 schedule

Oral Session 3

Sat · June 6 · 9:00–10:15 AM · 4 parallel tracks
🏆 Award candidate · ❉ Highlight — tap + Add to put a track or paper on your schedule.
3AGenerative Diffusion ModelingBluebird Ballroom
1
Breaking Semantic Boundaries: Distribution-Guided Semantic Exploration for Creative Generation PDF ↗
Fu Feng, Yucheng Xie, Ruixiao Shi, Xu Yang, Jing Wang, Xin Geng
2
Guiding a Diffusion Model by Swapping Its Tokens PDF ↗
Weijia Zhang, Yuehao Liu, Shanyan Guan, Wu Ran, Yanhao Ge, Wei Li, Chao Ma
3
PixelDiT: Pixel Diffusion Transformers for Image Generation 🏆 Award candidate PDF ↗
Yongsheng Yu, Wei Xiong, Weili Nie, Yichen Sheng, Shiqiu Liu, Jiebo Luo
4
SeaCache: Spectral-Evolution-Aware Cache for Accelerating Diffusion Models 🏆 Award candidate PDF ↗
Jiwoo Chung, Sangeek Hyun, MinKyu Lee, Byeongju Han, Geonho Cha, Dongyoon Wee, Youngjun Hong, Jae-Pil Heo
5
SenCache: Accelerating Diffusion Model Inference via Sensitivity- Aware Caching PDF ↗
Yasaman Haghighi, Alexandre Alahi
6
Streaming Diffusion Model for Fast Infrared and Visible Video Fusion PDF ↗
Jinyuan Liu, Ludan Sun, Tengyu Ma, Chunyan Yang, Zhiying Jiang, Long Ma, Risheng Liu, Xin Fan
3BSpatial UnderstandingFour Seasons Ballroom
1
ComPose: A Unified Completion-Pose Framework for Robust Category-Level Object Pose Estimation 🏆 Award candidate PDF ↗
Huan Ren, Yihan Chen, Chuxin Wang, Nailong Liu, Wenfei Yang, Tianzhu Zhang
2
CoSMo3D: Open-World Promptable 3D Semantic Segmentation through LLM-Guided Canonical Spatial Modeling 🏆 Award candidate PDF ↗
Li Jin, Weikai Chen, Yujie Wang, Yingda Yin, Zeyu Hu, Runze Zhang, Keyang Luo, Shengju Qian, Xin Wang, Xueying Qin
3
GeoViS: Geospatially Rewarded Visual Search for Remote Sensing Visual Grounding 🏆 Award candidate PDF ↗
Peirong Zhang, Yidan Zhang, Luxiao Xu, Jinliang Lin, Zonghao Guo, Fengxiang Wang, Xue Yang, Kaiwen Wei, Lei Wang
4
RobotSeg: A Model and Dataset for Segmenting Robots in Image and Video PDF ↗
Haiyang Mei, Qiming Huang, Hai Ci, Mike Zheng Shou
5
S^2AM3D: Scale-controllable Part Segmentation of 3D Point Clouds PDF ↗
Han Su, Tianyu Huang, Zichen Wan, Xiaohe Wu, Wangmeng Zuo
6
Scalable Multi-View Subspace Clustering with Tensorized Anchor Guidance PDF ↗
Miao Jia, Xingchen Hu, Jiyuan Liu, Siwei Wang, Min Wang, Zijian Chen
3CGenerative EditingMile High Ballroom 1A–2A
1
3D-LATTE: Latent Space 3D Editing from Textual Instructions PDF ↗
Maria Parelli, Michael Oechsle, Michael Niemeyer, Federico Tombari, Andreas Geiger
2
AnchorFlow: Training-Free 3D Editing via Latent Anchor-Aligned Flows PDF ↗
Zhenglin Zhou, Fan Ma, Chengzhuo Gui, Xiaobo Xia, Hehe Fan, Yi Yang, Tat-Seng Chua
3
ChordEdit: One-Step Low-Energy Transport for Image Editing 🏆 Award candidate PDF ↗
Liangsi Lu, Xuhang Chen, Minzhe Guo, Shichu Li, Jingchao Wang, Yang Shi
4
Faithful Contouring: Near-Lossless 3D Voxel Representation Free from Iso-surface PDF ↗
Yihao Luo, Xianglong He, Chuanyu Pan, Yiwen Chen, Jiaqi Wu, Yangguang Li, Wanli Ouyang, Yuanming Hu, Guang Yang, ChoonHwai Yap
5
Native and Compact Structured Latents for 3D Generation 🏆 Award candidate PDF ↗
Jianfeng Xiang, Xiaoxue Chen, Sicheng Xu, Ruicheng Wang, Zelong Lv, Yu Deng, Hongyuan Zhu, Yue Dong, Hao Zhao, Nicholas Jing Yuan, Jiaolong Yang
6
SliderEdit: Continuous Image Editing with Fine-Grained Instruction Control PDF ↗
Arman Zarei, Samyadeep Basu, Mobina Pournemat, Sayan Nag, Ryan A. Rossi, Soheil Feizi
3DMultimodal ModelingMile High Ballroom 3A–4A
1
Differentiable Vector Quantization for Rate-Distortion Optimization of Generative Image Compression 🏆 Award candidate PDF ↗
Shiyin Jiang, Wei Long, Minghao Han, Zhenghao Chen, Ce Zhu, Shuhang Gu
2
FINER: MLLMs Hallucinate under Fine-grained Negative Queries 🏆 Award candidate PDF ↗
Rui Xiao, Sanghwan Kim, Yongqin Xian, Zeynep Akata, Stephan Alaniz
3
MDCS-MoAME: Multi-directional Composite Scanning with Mixture of Attention and Mamba Experts for Cancer Survival Prediction PDF ↗
Linjie Qu, Jin Xiao, Xiangrong Liu, Changming Sun, Hui Cui, Yuqi Fang, Ran Su, Qiangguo Jin, Leyi Wei
4
PAS: A Training-Free Stabilizer for Temporal Encoding in Video LLMs PDF ↗
Bowen Sun, Yujun Cai, Ming-Hsuan Yang, Hang Wu, Yiwei Wang
5
PAVAS: Physics-Aware Video-to-Audio Synthesis PDF ↗
Oh Hyun-Bin, Yuhta Takida, Toshimitsu Uesaka, Tae-Hyun Oh, Yuki Mitsufuji
6
ProPhy: Progressive Physical Alignment for Dynamic World Simulation 🏆 Award candidate PDF ↗
Zijun Wang, Panwen Hu, Jing Wang, Terry Jingchen Zhang, Yuhao Cheng, Long Chen, Yiqiang Yan, Zutao Jiang, Hanhui Li, Xiaodan Liang