arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Computer Vision · 会议 · Computer Vision

2025-11-25 至 2025-11-25 共收录 6
2509.23867 2025-11-25 cs.CV

Sim-DETR: Unlock DETR for Temporal Sentence Grounding

Sim-DETR: 解锁用于时间句子定位的DETR

Jiajin Tang, Zhengxuan Wei, Yuchen Zhu, Cheng Shi, Guanbin Li, Liang Lin, Sibei Yang

机构 * ShanghaiTech University(上海科技大学) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)

AI总结 Sim-DETR通过改进DETR的解码器层,解决了时间句子定位中的查询冲突问题,提升了模型性能。

Comments This work is accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07608 2025-11-25 cs.CV

Faster and Better 3D Splatting via Group Training

更高效且更好的3D点云绘制方法:通过分组训练

Chengbo Wang, Guozheng Ma, Yifei Xue, Yizhen Lao

机构 * Hunan University(湖南大学) Nanyang Technological University(南洋理工大学) Lushan Innovation Lab(庐山创新实验室) Key Laboratory of Digital Culture Smart Design Technology, Minstry of Culture and Tourism(文化与旅游部数字文化智能设计技术重点实验室)

AI总结 本文提出分组训练方法,通过将高斯基本形体分组优化训练效率和渲染质量,实现更高效的3D点云绘制

Comments Accepted to ICCV 2025. Code is available at https://github.com/Chengbo-Wang/3DGS-with-Group-Training

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.09607 2025-11-25 cs.LG cs.RO

Description of Corner Cases in Automated Driving: Goals and Challenges

自动驾驶中角落情况的描述:目标与挑战

Daniel Bogdoll, Jasmin Breitenstein, Florian Heidecker, Maarten Bieshaar, Bernhard Sick, Tim Fingscheidt, J. Marius Zöllner

AI总结 本文探讨了自动驾驶中角落情况的描述目标与挑战,强调了机器可解释描述的重要性及当前研究的不足。

Comments Daniel Bogdoll, Jasmin Breitenstein and Florian Heidecker contributed equally. Accepted for publication at ICCV 2021 ERCVAD Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17888 2025-11-25 cs.CV

MINDiff: Mask-Integrated Negative Attention for Controlling Overfitting in Text-to-Image Personalization

MINDiff: 集成掩码的负关注用于控制文本到图像个性化中的过拟合

Seulgi Jeong, Jaeil Kim

机构 * Kyungpook National University(庆尚国立大学)

AI总结 MINDiff通过在推理过程中引入负关注机制,有效控制文本到图像个性化中的过拟合问题,无需修改模型架构即可提升文本对齐度和主题保真度。

Comments Accepted at ICCV 2025 Personalization in Generative AI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17647 2025-11-25 cs.LG cs.AI

MamTiff-CAD: Multi-Scale Latent Diffusion with Mamba+ for Complex Parametric Sequence

MamTiff-CAD: 多尺度潜在扩散与Mamba+用于复杂参数序列

Liyuan Deng, Yunpeng Bai, Yongkang Dai, Xiaoshui Huang, Hongping Gan, Dongshuo Huang, Hao jiacheng, Yilei Shi

机构 * Northwestern Polytechnical University(西北工业大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) Nanchang University(南昌大学)

AI总结 MamTiff-CAD通过结合Mamba+和Transformer的多尺度潜在扩散模型,有效生成复杂CAD参数序列,实现长序列生成任务的高性能表现。

Comments ICCV 2025 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03931 2025-11-25 cs.CV

MagicMirror: ID-Preserved Video Generation in Video Diffusion Transformers

MagicMirror: 视频扩散变换器中的身份保留视频生成

Yuechen Zhang, Yaoyang Liu, Bin Xia, Bohao Peng, Zexin Yan, Eric Lo, Jiaya Jia

AI总结 MagicMirror通过双分支特征提取器和两阶段训练策略,在视频扩散变换器中实现高质量身份保留视频生成,优于现有方法。

Comments ICCV 2025, It is best viewed in Acrobat. Project Page: https://julianjuaner.github.io/projects/MagicMirror/

详情

展开后加载摘要…

URL PDF HTML 收藏