arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-01-14 至 2026-01-14 共收录 6
2504.15054 2026-01-14 cs.CV

Structure-guided Diffusion Transformer for Low-Light Image Enhancement

结构引导的扩散变换器用于低光照图像增强

Xiangchen Yin, Zhenda Yu, Longtao Jiang, Xin Gao, Xiao Sun, Zhi Liu, Xun Yang

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究院) Anhui University(安徽大学) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动技术学院) State Key Laboratory of Automotive Safety and Energy, Tsinghua University(清华大学汽车安全与能源国家重点实验室) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) Department of Computer and Network Engineering, The University of Electro-Communications(电通大学计算机与网络工程系)

AI总结 本文提出结构引导的扩散变换器框架,通过小波变换和结构增强模块提升低光照图像增强效果,实现SOTA性能。

Comments Accepted by IEEE Transactions on Multimedia (TMM)

Journal ref IEEE Transactions on Multimedia, Vol. 27, pp. 9505 - 9515, 22 September 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08444 2026-01-14 cs.AI

Beyond Linearization: Attributed Table Graphs for Table Reasoning

超越线性化:属性表格图用于表格推理

Yuxiang Wang, Junhao Gan, Shengxiang Gao, Shenghao Ye, Zhengyi Yang, Jianzhong Qi

机构 * The University of Melbourne(墨尔本大学) The University of New South Wales(新南威尔士大学) The University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出TABGR模型,通过属性表格图保留表格结构并提升推理可解释性,实验表明其在表格推理任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08273 2026-01-14 cs.CV cs.AI

HIPPO: Accelerating Video Large Language Models Inference via Holistic-aware Parallel Speculative Decoding

HIPPO:通过整体感知并行推测解码加速视频大语言模型推理

Qitan Lv, Tianyu Liu, Wen Wu, Xuenan Xu, Bowen Zhou, Feng Wu, Chao Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

AI总结 HIPPO通过整体感知并行推测解码框架,有效提升视频大语言模型推理速度,实现高达3.51倍的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16151 2026-01-14 cs.AR cs.CL

Hardwired-Neurons Language Processing Units as General-Purpose Cognitive Substrates

硬连线神经元语言处理单元作为通用认知基质

Yang Liu, Yi Chen, Yongwei Zhao, Yifan Hao, Zifu Zheng, Weihao Kong, Zhangmai Li, Dongchen Jiang, Ruiyang Xia, Zhihong Ma, Zisheng Liu, Zhaoyong Wan, Yunqi Lu, Ximing Liu, Hongrui Guo, Zhihao Yang, Zhe Wang, Tianrui Ma, Mo Zou, Rui Zhang, Ling Li, Xing Hu, Zidong Du, Zhiwei Xu, Qi Guo, Tianshi Chen, Yunji Chen

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学) Institute of Software, CAS(软件研究所,中国科学院) Cambricon Technologies

AI总结 本文提出硬连线神经元语言处理单元,通过金属嵌入技术降低光掩模成本,实现高效能低能耗的语言处理基质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16237 2026-01-14 cs.CL

Align-GRAG: Anchor and Rationale Guided Dual Alignment for Graph Retrieval-Augmented Generation

Align-GRAG: 基于锚点和推理引导的双 Alignment 图检索增强生成

Derong Xu, Pengyue Jia, Xiaopeng Li, Yingyi Zhang, Maolin Wang, Qidong Liu, Xiangyu Zhao, Yichao Wang, Huifeng Guo, Ruiming Tang, Enhong Chen, Tong Xu

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Noah’s Ark Lab, Huawei(华为诺亚实验室)

AI总结 Align-GRAG通过锚点和推理引导的双 Alignment 框架,提升图检索增强生成的准确性与语义对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15016 2026-01-14 cs.CV cs.RO

MSSF: A 4D Radar and Camera Fusion Framework With Multi-Stage Sampling for 3D Object Detection in Autonomous Driving

MSSF: 一种基于4D雷达和摄像头的多阶段采样融合框架用于自动驾驶中的3D目标检测

Hongsi Liu, Jun Liu, Guangfeng Jiang, Xin Jin

机构 * Department of Electronic Engineering and Information Science, University of Science and Technology of China(电子工程与信息科学系,中国科学技术大学) Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究所,东部技术研究所)

AI总结 MSSF通过多阶段采样融合4D雷达和摄像头数据,提升自动驾驶中3D目标检测的精度与鲁棒性。

Comments T-TITS accepted, code avaliable

详情

展开后加载摘要…

URL PDF HTML 收藏