arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-02-03 至 2026-02-03 共收录 33
2602.02458 2026-02-03 cs.LG cs.NI

Conflict-Aware Client Selection for Multi-Server Federated Learning

多服务器联邦学习中的冲突感知客户端选择

Mingwei Hong, Zheng Lin, Zehang Lin, Lin Li, Miao Yang, Xia Du, Zihan Fang, Zhaolu Kang, Dianxin Luan, Shunzhi Zhu

机构 * 1 School of Computer Information Engineering, Xiamen University of Technology, Xiamen, China 2 Department of Electrical Electronic Engineering, The University of Hong Kong, Hong Kong, China 3 Department of Computer Science, City University of Hong Kong, Hong Kong, China 4 School of Software \& Microelectronics, Peking University, Beijing, China 5 Institute for Imaging, Data Communications, University of Edinburgh, UK

AI总结 本文提出RL CRP方法,通过预测冲突风险优化多服务器联邦学习中的客户端选择,减少资源竞争并提升训练效率。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02222 2026-02-03 cs.CV cs.CR

MIRROR: Manifold Ideal Reference ReconstructOR for Generalizable AI-Generated Image Detection

MIRROR:基于流形理想参考的通用AI生成图像检测器

Ruiqi Liu, Manni Cui, Ziheng Qin, Zhiyuan Yan, Ruoxin Chen, Yi Han, Zhiheng Li, Junkai Chen, ZhiJin Chen, Kaiqing Lin, Jialiang Shen, Lubin Weng, Jing Dong, Yan Wang, Shu Wu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, UCAS(北京大学交叉信息学院) Huazhong University of Science and Technology(华中科技大学) Tencent YouTu Lab(腾讯YouTu实验室) Southwest University(西南大学) Peking University(北京大学) The University of Sydney(悉尼大学) Shenzhen University(深圳大学) Tsinghua University(清华大学)

AI总结 MIRROR通过流形理想参考重建器,利用现实先验和残差信号,实现对AI生成图像的高效检测,超越现有方法并接近人类感知极限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01775 2026-02-03 cs.AI cs.LG

Efficient Cross-Architecture Knowledge Transfer for Large-Scale Online User Response Prediction

高效跨架构知识迁移用于大规模在线用户响应预测

Yucheng Wu, Yuekui Yang, Hongzheng Li, Anan Liu, Jian Xiao, Junjie Zhai, Huan Yu, Shaoping Ma, Leye Wang

机构 * Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education \& School of Computer Science, Peking University Beijing China Department of Computer Science Technology, Tsinghua University \& Advertising Engineering Department, CDG, Tencent Corporation Beijing China Advertising Engineering Department, CDG, Tencent Corporation Beijing China Technology, Tsinghua University Beijing China Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education \& School of Computer Science, Peking University Technology, Tsinghua University \& Advertising Engineering Department, CDG, Tencent Corporation Advertising Engineering Department, CDG, Tencent Corporation Technology, Tsinghua University

AI总结 CrossAdapt通过两阶段框架实现高效跨架构知识迁移,提升AUC并降低训练时间,适用于大规模在线用户响应预测。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01675 2026-02-03 cs.AI cs.LG

TRIP-Bench: A Benchmark for Long-Horizon Interactive Agents in Real-World Scenarios

TRIP-Bench:面向现实场景的长周期交互智能体基准

Yuanzhe Shen, Zisu Huang, Zhengyuan Wang, Muzhao Tian, Zhengkang Guo, Chenyang Zhang, Shuaiyu Zhou, Zengjie Hu, Dailin Li, Jingwen Xu, Kaimin Wang, Wenhao Liu, Tianlong Li, Fengpeng Yue, Feng Hong, Cao Liu, Ke Zeng

机构 * Xiaohongshu Inc.(小红书公司) School of Computer Science, Fudan University(复旦大学计算机学院) Dalian University of Technology(大连理工大学) Peking University(北京大学) Wuhan University(武汉大学)

AI总结 TRIP-Bench是一个面向现实场景的长周期交互智能体基准,通过真实旅行规划场景测试多工具推理与约束满足,提出GTPO方法提升智能体鲁棒性与性能。

Comments 40 pages, 6figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01630 2026-02-03 cs.CV

Research on World Models Is Not Merely Injecting World Knowledge into Specific Tasks

世界模型的研究并非仅仅是将世界知识注入特定任务

Bohan Zeng, Kaixin Zhu, Daili Hua, Bozhou Li, Chengzhuo Tong, Yuran Wang, Xinyi Huang, Yifan Dai, Zixiang Zhang, Yifan Yang, Zhou Liu, Hao Liang, Xiaochen Ma, Ruichuan An, Tianyi Bai, Hongcheng Gao, Junbo Niu, Yang Shi, Xinlong Chen, Yue Ding, Minglei Shi, Kai Zeng, Yiwen Tang, Yuanxing Zhang, Pengfei Wan, Xintao Wang, Wentao Zhang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 本文提出统一的世界模型设计规范,强调其应整合交互、感知、符号推理和空间表示,以实现更通用和稳健的世界模型。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01611 2026-02-03 cs.LG

What Do Agents Learn from Trajectory-SFT: Semantics or Interfaces?

轨迹SFT中智能体学习了语义还是接口?

Weizheng Gu, Chengze Li, Zhuohao Yu, Mengyuan Sun, Zhibang Yang, Wei Wang, Hongrui Jia, Shikun Zhang, Wei Ye

机构 * National Engineering Research Center for Software Engineering, Peking University, Beijing, China(软件工程国家工程研究中心,北京大学,北京,中国) Nanjing University, Nanjing, China(南京大学,南京,中国) Tongji University, Shanghai, China(同济大学,上海,中国)

AI总结 本文提出PIPE协议用于评估智能体在轨迹SFT中对接口的依赖性,发现轨迹SFT显著放大了接口捷径,且引入了接口依赖性指标以量化训练时接口的偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01519 2026-02-03 cs.LG cs.AI

You Need an Encoder for Native Position-Independent Caching

你需要为原生位置无关缓存添加编码器

Shiju Zhao, Junhao Hu, Jiaqi Zheng, Guihai Chen

机构 * State Key Laboratory for Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学,中国) School of Computer Science, Peking University, China(计算机学院,北京大学,中国)

AI总结 本文提出原生PIC方法,通过在解码器-only LLMs中引入编码器并训练其支持PIC,开发了COMB缓存系统,显著提升了TTFT和吞吐量,同时保持精度。

Comments 12 pages, 10 figures. Welcome back, Encoder

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18352 2026-02-03 cs.CL cs.AI

Code over Words: Overcoming Semantic Inertia via Code-Grounded Reasoning

基于代码的词:通过代码引导的推理克服语义惯性

Manjie Xu, Isabella Yin, Xinyi Tu, Chi Zhang, Yixin Zhu

机构 * Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) School of Psychological and Cognitive Sciences, Peking University(心理与认知科学学院,北京大学) Tsinghua International School(清华大学国际学校) University of California, Berkeley(加州大学伯克利分校) State Key Lab of General AI, Peking University(通用人工智能国家重点实验室,北京大学) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京行为与心理健康重点实验室,北京大学) Embodied Intelligence Lab, PKU-Wuhan Institute for Artificial Intelligence(具身智能实验室,北京大学-武汉人工智能研究院)

AI总结 通过代码引导的推理(LCV)克服语义惯性,表明表示形式影响模型在动态场景中的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02649 2026-02-03 cs.RO cs.AI

Effective Online 3D Bin Packing with Lookahead Parcels Using Monte Carlo Tree Search

有效在线三维装箱使用蒙特卡洛树搜索和前瞻性包裹

Jiangyi Fang, Bowen Zhou, Haotian Wang, Xin Zhu, Leye Wang

机构 * Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education China(高可信软件技术重点实验室(北京大学)) Faculty of Computing, Harbin Institute of Technology, Harbin, China(计算机学院,哈尔滨工业大学,哈尔滨,中国) JD Logistic, Beijing, China(京东物流,北京,中国) School of Computer Science, Peking University, Beijing, China(计算机科学学院,北京大学,北京,中国)

AI总结 本文提出了一种基于蒙特卡洛树搜索和前瞻性包裹的在线三维装箱方法,通过动态探索先验平衡强化学习策略与稳健随机策略,有效应对物流中的短期分布变化,实现显著的装箱效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18595 2026-02-03 cs.LG

Benchmarking neural surrogates on realistic spatiotemporal multiphysics flows

在现实时空多物理场流中评估神经替代模型

Runze Mao, Rui Zhang, Xuan Bai, Tianhao Wu, Teng Zhang, Zhenyi Chen, Minqi Lin, Bocheng Zeng, Yangchen Xu, Yingxuan Xiang, Haoze Zhang, Shubham Goswami, Pierre A. Dawe, Yifan Xu, Zhenhua An, Mengtao Yan, Xiaoyi Lu, Yi Wang, Rongbo Bai, Haobu Gao, Xiaohang Fang, Han Li, Hao Sun, Zhi X. Chen

机构 * State Key Laboratory for Turbulence and Complex Systems, School of Mechanics and Engineering Science, Peking University(湍流与复杂系统国家重点实验室,力学与工程科学学院,北京大学) Gaoling School of Artificial Intelligence, Renmin University of China(Gallagher人工智能学院,中国人民大学) AI for Science Institute(人工智能科学研究院) University of Calgary(卡尔加里大学) Kyoto University(京都大学) FM Global(FM全球) LandSpace Technology Corporation Ltd.(陆地方向技术有限公司) Aero Engine Academy of China(中国航空发动机学院)

AI总结 REALM通过严谨的基准测试框架评估神经替代模型在现实多物理场流中的表现,揭示了模型在复杂环境中的局限性及改进方向。

Comments 52 pages, 20 figures. Code and data available at https://github.com/deepflame-ai/REALM. Companion website and leaderboard at https://realm-bench.org

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02720 2026-02-03 cs.LG cs.AI

ECGTwin: Personalized ECG Generation Using Controllable Diffusion Model

ECGTwin: 基于可控扩散模型的个性化ECG生成

Yongfan Lai, Bo Liu, Xinyan Guan, Qinghao Zhao, Hongyan Li, Shenda Hong

机构 * State Key Laboratory of General Artificial Intelligence, Beijing, China(一般人工智能国家重点实验室) School of Intelligence Science and Technology, Peking University, Beijing, China(智能科学与技术学院) National Institute of Health Data Science, Peking University, Beijing, China(健康数据科学国家研究院) Department of Cardiology, Peking University People’s Hospital, Beijing, China(心血管内科)

AI总结 ECGTwin通过可控扩散模型实现个性化ECG生成,解决个体特征提取与条件注入难题,提升医疗诊断的精准性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02426 2026-02-03 cs.CL cs.LG

Learning to Evolve: Bayesian-Guided Continual Knowledge Graph Embedding

学习进化:贝叶斯引导的持续知识图谱嵌入

Linyu Li, Zhi Jin, Yuanpeng He, Dongming Jin, Yichi Zhang, Haoran Duan, Xuan Zhang, Zhengwei Tao, Nyima Tash

机构 * Peking University(北京大学) Zhejiang University(浙江大学) Wuhan University(武汉大学) Yunnan University(云南大学) Tibet University(西藏大学)

AI总结 BAKE通过贝叶斯推断和持续聚类方法,有效解决持续知识图谱嵌入中的灾难性遗忘问题,实现对动态数据的持续学习与知识保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24161 2026-02-03 cs.NE cs.LG

Proxy Target: Bridging the Gap Between Discrete Spiking Neural Networks and Continuous Control

代理目标:弥合离散脉冲神经网络与连续控制之间的差距

Zijie Xu, Tong Bu, Zecheng Hao, Jianhao Ding, Zhaofei Yu

机构 * Peking University(北京大学)

AI总结 本文提出代理目标框架,通过引入连续可微动态解决SNN与连续控制算法的兼容性问题,提升SNN在连续控制任务中的性能和稳定性。

Comments Accepted by NeurIPS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15098 2026-02-03 cs.LG cs.AI

CFT-RAG: An Entity Tree Based Retrieval Augmented Generation Algorithm With Cuckoo Filter

CFT-RAG:基于实体树的检索增强生成算法与 cuckoo 过滤器

Zihang Li, Yangdong Ruan, Wenjun Liu, Zhengyang Wang, Tong Yang

机构 * Peking University(北京大学) Beihang University(北航)

AI总结 CFT-RAG通过改进的 cuckoo 过滤器优化树状RAG的实体定位,显著提升检索效率和生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01326 2026-02-03 cs.CL

DreamOn: Diffusion Language Models For Code Infilling Beyond Fixed-size Canvas

DreamOn: 用于代码填充的扩散语言模型超越固定大小画布

Zirui Wu, Lin Zheng, Zhihui Xie, Jiacheng Ye, Jiahui Gao, Shansan Gong, Yansong Feng, Zhenguo Li, Wei Bi, Guorui Zhou, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Kuaishou Technology(快手科技) Huawei Noah Ark Lab(华为诺亚实验室) Peking University(北京大学)

AI总结 DreamOn通过引入动态长度控制机制,解决了扩散语言模型在代码填充中因固定长度限制导致的性能问题,实现了灵活的可变长度生成。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01207 2026-02-03 cs.AI

Not All Preferences Are Created Equal: Stability-Aware and Gradient-Efficient Alignment for Reasoning Models

并非所有偏好都同等重要:面向推理模型的稳定性感知与梯度高效对齐

Hui Wu, Hengyi Cai, Jinman Zhao, Xinran Chen, Ziheng Li, Zhejun Zhao, Shuaiqiang Wang, Yuchen Li, Dawei Yin

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) Baidu Inc.(百度公司) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)

AI总结 SAGE通过动态框架提升推理模型对齐的稳定性与梯度效率,通过信噪比优化和稳定性感知评分函数实现更高效的训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01182 2026-02-03 cs.LG

Analyzing and Improving Diffusion Models for Time-Series Data Imputation: A Proximal Recursion Perspective

分析和改进用于时间序列数据插补的扩散模型:从近端递归的角度

Zhichao Chen, Hao Wang, Fangyikang Wang, Licheng Pan, Zhengnan Li, Yunfei Teng, Haoxuan Li, Zhouchen Lin

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室、智能科学与技术学院、北京大学) Zhejiang University(浙江大学) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Center for Data Science, Peking University(北京大学数据科学中心) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Pazhou Laboratory (Huangpu), Guangzhou, China(黄埔实验室(华南))

AI总结 本文从近端递归角度提出SPIRIT框架,通过引入熵诱导的Bregman分歧和半近端传输正则化,改进扩散模型在时间序列数据插补中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01062 2026-02-03 cs.AI

SetPO: Set-Level Policy Optimization for Diversity-Preserving LLM Reasoning

SetPO:基于集级别的策略优化以保持LLM推理的多样性

Chenyi Li, Yuan Zhang, Bo Wang, Guoqing Ma, Wei Tang, Haoyang Huang, Nan Duan

机构 * Peking University(北京大学) JD Explore Academy, China(京东探索研究院) Beijing Institute of Technology(北京理工大学)

AI总结 SetPO通过集级别策略优化提升LLM推理多样性,通过核化相似性定义目标,验证稀有轨迹对多样性的贡献,实验显示优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00769 2026-02-03 cs.CL cs.AI

Eliciting Trustworthiness Priors of Large Language Models via Economic Games

通过经济游戏 eliciting 大语言模型的信任度先验

Siyu Yan, Lusha Zhu, Jian-Qiao Zhu

机构 * University of Hong Kong(香港大学) The University of Hong Kong(香港大学) Peking University(北京大学) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京大学行为与心理健康重点实验室) IDG/McGovern Institute for Brain Research, Peking University(北京大学脑科学研究院) Peking-Tsinghua Center for Life Sciences, Peking University(北京大学-清华大学生命科学中心) Key Laboratory of Machine Perception, Ministry of Education, China(教育部机器感知重点实验室)

AI总结 通过经济游戏实验,研究如何通过行为博弈论中的信任游戏获取大语言模型的信任度先验,并揭示其与人类信任差异及刻板印象模型的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00726 2026-02-03 cs.HC cs.AI

Augmenting Clinical Decision-Making with an Interactive and Interpretable AI Copilot: A Real-World User Study with Clinicians in Nephrology and Obstetrics

通过交互式和可解释的AI助手增强临床决策:与泌尿科和产科医生的现实世界用户研究

Yinghao Zhu, Dehao Sui, Zixiang Wang, Xuning Hu, Lei Gu, Yifan Qi, Tianchen Wu, Ling Wang, Yuan Wei, Wen Tang, Zhihan Cui, Yasha Wang, Lequan Yu, Ewen M Harrison, Junyi Gao, Liantao Ma

机构 * Peking University(北京大学) University of Hong Kong(香港大学) Hong Kong University of Science and Technology(香港科学与技术大学) Peking University Third Hospital(北京大学第三医院) Affiliated Xuzhou Municipal Hospital of Xuzhou Medical University(徐州医科大学附属徐州市人民医院) University of Edinburgh(爱丁堡大学) Health Data Research UK(英国健康数据研究)

AI总结 AICare通过交互式和可解释的AI助手提升临床决策,通过实验证明其降低认知负荷并增强医生信任

Comments Accepted by ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00717 2026-02-03 cs.LG cs.AI

Deep Time-series Forecasting Needs Kernelized Moment Balancing

深度时间序列预测需要核化矩平衡

Licheng Pan, Hao Wang, Haocheng Yang, Yuqi Li, Qingsong Wen, Xiaoxi Li, Zhichao Chen, Haoxuan Li, Zhixuan Chu, Yuan Lu

机构 * Xiaohongshu Inc.(小红书公司) National University of Singapore(新加坡国立大学) The City University of New York, CUNY(纽约市立大学,CUNY) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室,北京大学) Center for Data Science, Peking University(北京大学数据科学中心) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 本文提出KMB-DF方法,通过核化矩平衡提升深度时间序列预测的准确性,实现更全面的分布平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00619 2026-02-03 cs.CL cs.AI cs.CR cs.LG

Jailbreaking LLMs via Calibration

通过校准劫持大语言模型

Yuxuan Lu, Yongkang Guo, Yuqing Kong

机构 * Department of Computer Science, Peking University, Beijing, China(计算机科学系,北京大学,北京,中国)

AI总结 通过校准劫持大语言模型,提出一种新的聚合框架,提升攻击成功率并降低劫持成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00618 2026-02-03 cs.CV

Tune-Your-Style: Intensity-tunable 3D Style Transfer with Gaussian Splatting

Tune-Your-Style: 可调强度的3D风格迁移与高斯点散布

Yian Zhao, Rushi Ye, Ruochong Zheng, Zesen Cheng, Chaoran Feng, Jiashu Yang, Pengchong Qiao, Chang Liu, Jie Chen

机构 * School of Electronic and Computer Engineering, Peking University, Shenzhen, China(电子与计算机工程学院,北京大学深圳校区) Pengcheng Laboratory, Shenzhen, China(鹏城实验室) AI for Science (AI4S)-Preferred Program, Peking University Shenzhen Graduate School, China(人工智能科学(AI4S)优选计划,北京大学深圳研究生院) Department of Automation and BNRist, Tsinghua University, Beijing, China(自动化系和BNRist,清华大学,北京,中国) Dalian University of Technology, China(大连理工大学)

AI总结 Tune-Your-Style通过可调强度的3D风格迁移方法,实现灵活的内容-风格平衡,提升3D风格迁移的定制性。

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00579 2026-02-03 cs.CV

Bridging Degradation Discrimination and Generation for Universal Image Restoration

弥合退化鉴别与生成以实现通用图像修复

JiaKui Hu, Zhengjian Yao, Lujia Jin, Yanye Lu

机构 * Institute of Medical Technology, Peking University(北京大学医学技术学院) Biomedical Engineering Department, College of Future Technology, Peking University(北京大学未来技术学院生物医学工程系) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心) China Mobile Research Institute(中国移动研究院)

AI总结 本文提出BDG方法,通过多角度多尺度灰度共生矩阵提升退化鉴别与生成能力,实现通用图像修复和超分辨率任务的性能提升。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20327 2026-02-03 cs.CL

CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria

CE-RM:一种通过两阶段回放和统一标准优化的点wise生成奖励模型

Xinyu Hu, Yancheng He, Weixun Wang, Tao Feng, Li Lin, Jiashun Liu, Wenbo Su, Bo Zheng, Xiaojun Wan

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院) Hong Kong University of Science and Technology(香港理工大学) Alibaba Group(阿里巴巴集团)

AI总结 CE-RM通过两阶段回放和统一标准优化,提升生成奖励模型在开放性自然语言生成和强化学习中的表现。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15039 2026-02-03 cs.RO

CADGrasp: Learning Contact and Collision Aware General Dexterous Grasping in Cluttered Scenes

CADGrasp: 学习接触和碰撞感知的通用灵巧抓取在杂乱场景中

Jiyao Zhang, Zhiyuan Ma, Tianhao Wu, Zeyuan Chen, Hao Dong

机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(前沿计算研究中心,计算机学院,北京大学) National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家级重点实验室,计算机学院,北京大学)

AI总结 CADGrasp通过两阶段算法实现接触和碰撞感知的灵巧抓取,利用点云输入预测稀疏IBS表示,并结合占用扩散模型和能量函数优化,提升在杂乱场景中的抓取成功率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23753 2026-02-03 cs.LG cs.CL

Anchored Supervised Fine-Tuning

锚定监督微调

He Zhu, Junyou Su, Peng Lai, Ren Ma, Wenjia Zhang, Linyi Yang, Guanhua Chen

机构 * Southern University of Science and Technology(南方科技大学) Peking University(北京大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 本文提出锚定监督微调(ASFT),通过引入KL正则化解决动态微调(DFT)的稳定性问题,在数学推理、医学知识和代码生成等领域取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21033 2026-02-03 cs.SD cs.AI

SupCLAP: Controlling Optimization Trajectory Drift in Audio-Text Contrastive Learning with Support Vector Regularization

SupCLAP:通过支持向量正则化控制音频-文本对比学习中的优化轨迹漂移

Jiehui Luo, Yuguo Yin, Yuxin Xie, Jinghan Ru, Xianwei Zhuang, Minghua He, Aofan Liu, Zihan Xiong, Dongchao Yang

机构 * Peking University(北京大学) Central Conservatory of Music(中央音乐学院) The Chinese University of Hong Kong(香港中文大学) University of Electronic Science and Technology of China(电子科技大学)

AI总结 SupCLAP通过支持向量正则化有效控制音频-文本对比学习中的优化轨迹漂移,提升多模态学习的稳定性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11250 2026-02-03 cs.CR cs.CV

Environmental Injection Attacks against GUI Agents in Realistic Dynamic Environments

针对现实动态环境中的GUI代理的环境注入攻击

Yitong Zhang, Ximo Li, Liyi Cai, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Computer Science, Peking University(北京大学计算机学院)

AI总结 本文提出Chameleon框架,通过LLM驱动的环境模拟和注意力黑洞机制,有效暴露GUI代理在动态环境中的隐藏漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08870 2026-02-03 cs.CV

SAM2-UNet: Segment Anything 2 Makes Strong Encoder for Natural and Medical Image Segmentation

SAM2-UNet:Segment Anything 2 为自然和医学图像分割构建强大编码器

Xinyu Xiong, Zihuang Wu, Shuangyi Tan, Wenxue Li, Feilong Tang, Ying Chen, Siying Li, Jie Ma, Guanbin Li

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) School of Computer and Information Engineering, Jiangxi Normal University(江西师范大学计算机与信息工程学院) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Tianjin University(天津大学) Monash University(墨尔本大学) Pazhou Lab(琶洲实验室) Smart Hospital Research Institute, Peking University Shenzhen Hospital(北京大学深圳医院智能医院研究所)

AI总结 SAM2-UNet通过结合SAM2的Hiera主干和U型解码器,为自然和医学图像分割提供强大编码器,实现了高效且无需复杂调整的多任务分割性能。

Comments Technical Report

Journal ref Visual Intelligence, Volume 4, article number 2, (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏