arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 4818
2609.03689 2026-09-04 cs.CV 新提交

Semantic-Aware Subgraph State Space Model for WSI Classification in Histopathology

用于组织病理学WSI分类的语义感知子图状态空间模型

Feixing Chen, Hao Lu, Lin Luo, Yan Xu

机构 * National College for Excellent Engineers(卓越工程师学院) Beihang University(北京航空航天大学) School of Biological Science and Medical Engineering(生物与医学工程学院) College of Engineering(工学院) Peking University(北京大学)

AI总结 针对WSI分类中传统方法碎片化语义单元、难建模空间关系的问题,提出SASG-SSM框架,通过SASGs保留空间组织、SG-SSM融合局部与全局信息,在多数据集及少样本场景下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03591 2026-09-04 cs.RO 新提交

Scaling Bimanual Household Manipulation from 1,500 hours of Demonstrations to On-Policy Corrections

从1500小时演示数据及在线策略修正扩展双手机器人家务操作

Jiafeng Xu, Qi Li, Yan Shen, Yiyu Ren, Travis Davies, Shaowen He, Ze Wang, Yifan Yang, Ran Cheng, Hao Dong

机构 * PrimeBot Research Institute(PrimeBot研究院) Swancor Advanced Materials Co., Ltd.(Swancor先进材料有限公司) School of Computer Science, Peking University(北京大学计算机学院) Crobotia

AI总结 本研究发布1500小时双手机器人家务操作演示数据,训练XR-2视觉-语言-动作模型,验证其学习能力与数据集的扩展潜力,开源数据支持相关研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03544 2026-09-04 cs.CV 新提交

SafeRI: Recognition and Intervention for Token-Level Safety Intervention in Large Vision Language Models

SafeRI:大视觉语言模型中令牌级安全干预的识别与干预

Caoyuan Ma, Tian Gu, Wenpu Liu, Weichu Xie, Shuai Dong, Yuqi Xu, Ji Zhao, Ziyue Wang, Wenzheng Chang, Taiqiang Wu, Yongfu Zhu, Wenqi Shao, Zheng Wang, Yinqiang Zheng

机构 * Wuhan University(武汉大学) The University of Tokyo(东京大学) Peking University(北京大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学)

AI总结 针对现有视觉语言模型安全对齐会全局修改模型的问题,提出流式识别与门控LoRA框架,实现按需令牌级安全干预,在多基准上验证了方法的有效性。

Comments Preprint. 13 pages, 4 figures. Main paper with appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03342 2026-09-04 cs.LG 新提交

Gradients Know What Outcomes Don't: Unlocking Reinforcement Learning for LLM Reasoning with Gradient-Aligned Rewards

梯度知晓结果所不知:用梯度对齐奖励解锁大语言模型推理的强化学习

Leqi Zheng, Jinbo Su, Fang Niu, Chaokun Wang, Weiping Wang, Jiajun Zhang, Shannan Yan, Jie Wu, Zhaolu Kang, Rong Fu, Hang Zhang

机构 * Tsinghua University(清华大学) Renmin University of China(中国人民大学) Institute of Information Engineering, CAS(中国科学院信息工程研究所) USTC(中国科学技术大学) The Australian National University(澳大利亚国立大学) Peking University(北京大学) University of Macau(澳门大学)

AI总结 该研究提出梯度对齐奖励(GAR)方法,在策略梯度空间中生成密集推理感知奖励,提升大语言模型在数学等基准上的推理性能,且无需领域特定数据即可迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02954 2026-09-04 cs.CL 新提交

LexIssue: Benchmarking Legal Issue Identification in Chinese Civil Litigation

LexIssue:面向中国民事诉讼的法律问题识别基准测试

Huiyuan Xie, Yuqin Huang, Zhicheng Hao, Yida Cai, Shaochun Wang, Zhenghao Liu, Yuxiao Ye

机构 * Tsinghua University(清华大学) Peking University(北京大学) Modelbest Inc.(模贝斯特公司) Northeastern University(东北大学)

AI总结 本研究构建了LexIssue基准及配套法律知识库,将法律问题识别拆分为生成与分类任务,实验验证检索增强生成可提升相关识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02896 2026-09-04 cs.CL 新提交

PiPMRE: A Pipeline Based on Language Model for Medical Relation Extraction

PiPMRE:一种基于语言模型的医学关系抽取流水线框架

Jiaxin Duan, Fengyu Lu, Junfei Liu

机构 * School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)

AI总结 本研究针对现有医学关系抽取方法的缺陷,提出基于语言模型的PiPMRE流水线框架,经实验验证其在公开数据集上性能优于现有最优方法,少样本场景下也表现出色。

Journal ref Proceedings of the Annual Meeting of the Cognitive Science Society, Vol. 47, No. 0 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02291 2026-09-04 cs.CV cs.AI 版本更新

VoRTeC: Taming Foundation Flow for One-step Real time Video Compression

VoRTeC:驯服基础流模型实现单步实时视频压缩

Yichong Xia, Qinhong Wu, Bin Chen, Jinpeng Wang, Zeyuan Chen, Haoqian Wang

机构 * Shenzhen International Graduate School(深圳国际研究生院) Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peking University(北京大学)

AI总结 该研究针对超低码率视频压缩的模糊伪影、解码延迟与时间一致性问题,提出基于Wan2.1的VoRTeC框架,实现单步解码,比特消耗降58%,解码速度提升3至197倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27141 2026-09-04 cs.CR cs.AI 版本更新

Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM Agents

安全性无法组合:自主大型语言模型智能体的非衰减循环状态

Chenhao Wu, Haoxuan Jia, Yang Liu, Yingguang Yang, Yuhan Lin, Chongyang Zhang, Hao Zheng, Yulin Huang, Jianshen Zhang, Yongzhi Qi, Shang Luo, Kefu Xu, Jifeng Zhu, Bin Chong

机构 * University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学) Supply Chain Tech Team Y, JD.com(京东Y供应链技术团队) Peking University(北京大学) Fudan University(复旦大学) Fullive-AI(Fullive人工智能)

AI总结 该研究发现自主LLM智能体的轨迹级安全保障存在组合性缺陷,提出非衰减循环安全状态的LoopHarness方案,可限制未授权不可逆操作数量,通过Agent-SafetyBench等评估验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23996 2026-09-04 cs.CV 版本更新

Accelerating Masked Image Generation by Learning Controlled Latent Dynamics

通过学习潜在控制动力学加速掩码图像生成

Kaiwen Zhu, Quansheng Zeng, Yuandong Pu, Shuo Cao, Xiaohui Li, Yi Xin, Qi Qin, Jiayang Li, Juncheng Yan, Yu Qiao, Jinjin Gu, Yihao Liu

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Nankai University, Tianjin, China(南开大学) University of Science(科学技术大学) Nanjing University, Nanjing, China(南京大学) The University of Sydney, Sydney, Australia(悉尼大学) Peking University, Beijing, China(北京大学)

AI总结 本文提出MIGM-Shortcut模型,通过学习潜在控制动力学加速掩码图像生成,在保持质量的同时实现文本到图像生成的四倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14048 2026-09-04 cs.RO cs.CV cs.GR 版本更新

ProAct: Harnessing Streaming Motion Generation and Agentic Reasoning for Real-Time Embodied Social Interaction

ProAct:一种双系统框架用于主动具身社交代理

Zeyi Zhang, Zixi Kang, Ruijie Zhao, Yusen Feng, Biao Jiang, Hanyu Ji, Libin Liu

机构 * Peking University(北京大学)

AI总结 ProAct通过双系统框架实现主动具身社交代理,结合低延迟行为系统与慢速认知系统,提升交互的主动性和社会参与度。

Comments SIGGRAPH ASIA 2026 (Journal Track). Project Page: https://proactrobot.github.io/

Journal ref ACM Transactions on Graphics (TOG) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01207 2026-09-04 cs.AI 版本更新

Not All Preferences Deserve Gradients: Understanding Gradient Utility in Offline Reasoning Alignment

并非所有偏好都同等重要:面向推理模型的稳定性感知与梯度高效对齐

Hui Wu, Hengyi Cai, Jinman Zhao, Xinran Chen, Ziheng Li, Zhejun Zhao, Shuaiqiang Wang, Yuchen Li, Dawei Yin

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) Baidu Inc.(百度公司) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)

AI总结 SAGE通过动态框架提升推理模型对齐的稳定性与梯度效率,通过信噪比优化和稳定性感知评分函数实现更高效的训练。

Comments EMNLP Main 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18464 2026-09-04 stat.ML cs.LG 版本更新

Reliable Selection of Heterogeneous Treatment Effect Estimators

可靠选择异质处理效应估计器

Jiayi Guo, Zijun Gao

机构 * Peking University(北京大学) Marshall School of Business, University of Southern California(南加州大学马歇尔商学院)

AI总结 本文提出一种无需真实值的可靠方法,用于在异质处理效应估计中选择最佳估计器,并在多个基准测试中展示了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00669 2026-09-04 cs.CL cs.AI cs.CV cs.LG 版本更新

Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications

大语言模型时代的医学推理:增强技术与应用的系统综述

Zizhan Ma, Wenxuan Wang, Meidan Ding, Shiyi Zheng, Shengyuan Liu, Jie Liu, Jiaming Ji, Linlin Shen, Yixuan Yuan, Wenting Chen

机构 * Renmin University of China(中国人民大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen University(深圳大学) City University of Hong Kong(香港城市大学) Peking University(北京大学) Massachusetts General Hospital and Harvard Medical School(麻省总医院和哈佛医学院)

AI总结 本文对大语言模型时代医学推理的增强技术与应用开展首次系统综述,提出相关技术分类,分析其在多模态数据及临床场景的应用,调查评估基准演变,基于60项研究指出挑战并展望未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02196 2026-09-03 stat.ML cs.AI cs.LG 新提交

Schrödinger Bridges on Lie Group Manifolds for Probabilistic Intrinsic Generation

李群流形上用于概率内在生成的薛定谔桥

Shizhe Zhang, Mingyang Zhao, Lei Ma

机构 * National Biomedical Imaging Center, College of Future Technology, Peking University(北京大学未来技术学院国家生物医学成像中心) State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院数学科学国家重点实验室)

AI总结 该研究针对李群流形提出两种薛定谔桥计算实现方法,用于概率内在生成,在多个李群流形数据集上验证了方法的可行性与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02771 2026-09-03 cs.CL cs.AI cs.LG 新提交

From Reweighting to Rewriting: Unlocking the Intervention Effects of Influential Samples in Training Data Attribution

从重加权到重写:解锁训练数据归因中有影响力样本的干预效应

Yuzhang Luo, Chenpeng Wang, Jianhui Chen, Liangming Pan

机构 * State Key Laboratory of Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室) YiXin-AILab(翼星人工智能实验室) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 该研究针对训练数据归因中影响力样本的干预价值问题,提出影响引导的响应重写方法,实验发现其效果优于传统重加权,为训练数据归因方法的评估提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02546 2026-09-03 cs.RO 新提交

ZETA: A Controlled Study of Zero-Shot Cross-Embodiment VLA Transfer for Tabletop Manipulation

ZETA:面向桌面操作的零样本跨 embodiment VLA 迁移的受控研究

Mi Yan, Wenhao Zhang, Zhiqi Zhang, Yu Peng, Tangxinyu Wang, Lingfei Zhai, Jiayi Su, Shengliang Deng, Lin Peng, Yaowei Liu, Yuxing Chen, Zhiyuan Wei, Jilong Wang, Jiayi Chen, Jiangran Lyu, Zhizheng Zhang, He Wang

机构 * Galbot(智元机器人) CFCS, School of CS, Peking University(北京大学计算机学院CFCS) Peking University(北京大学) Renmin University of China(中国人民大学) Xiamen University Malaysia(马来西亚厦门大学) The University of Hong Kong(香港大学) Beihang University(北京航空航天大学)

AI总结 ZETA研究区分两类零样本跨embodiment VLA迁移,引入含14个目标embodiment的受控基准,发现状态-动作表示等因素可提升迁移性能,为桌面操作场景提供实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02366 2026-09-03 cs.CL cs.AI 新提交

NE-R1: Enhancing Named Entity Recognition Model via Reinforcement Learning

NE-R1:通过强化学习增强命名实体识别模型

Meixuan Chen, Hehan Li, Ruizhi Zhao, Xin Lu, peizhi xu, Liwei Qian, LI Meifang, shuanglong li, Hanmeng Liu, Xin Pei, Yanbiao Ma

机构 * Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Baidu, Inc.(百度公司) Shenzhen University(深圳大学) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)

AI总结 该研究针对NER中长尾与领域实体识别难题,提出NE-R1框架,通过按需检索机制与两阶段训练结合强化学习优化,在多基准上实现F1分数提升,达SOTA性能。

Comments EMNLP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02255 2026-09-03 cs.CV 新提交

T2LSC-Bench: Benchmarking Localized Semantic Control in Text-to-Image Generation

T2LSC-Bench:文本到图像生成中的本地化语义控制基准

Yan Wang, Xinyi Hou, Weiguo Lin, Junjun Si, Siwei Ma

机构 * Communication University of China(中国传媒大学) Huazhong University of Science and Technology(华中科技大学) Peking University(北京大学)

AI总结 该研究提出用于评估文本到图像生成本地化语义控制的基准T2LSC-Bench,发现现有模型存在语义泄漏问题,反泄漏提示可降低泄漏率且不影响渲染准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.01778 2026-09-03 cs.CV 新提交

Allocate Before You Embed: Adaptive Visual Input Allocation for Video Embeddings

先分配再嵌入:面向视频嵌入的自适应视觉输入分配

Song Jin, Zhongtao Jiang, Chenglei Shen, Huanxuan Liao, Haozhe Chi, Zhiwei Wang, Kun Xu, Yong Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) Peking University(北京大学)

AI总结 针对大规模视频检索的视觉输入预算限制问题,提出AllocEmbed框架,通过RDPO学习分配器重分配预算,在多基准任务上实现预算匹配方法中最佳检索性能且可跨主干迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02728 2026-09-03 stat.ML cs.LG math.OC 新提交

Momentum in large-batch training: Polyak enlarges the critical batch size, Nesterov improves data efficiency

Jia-Nan Wang, Zixun Huang, Kairui Li, Lei Wu

机构 * Peking University(北京大学) University of Pennsylvania(宾夕法尼亚大学) AI for Science Institute, Beijing(北京科学智能研究院)

Comments 69 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02746 2026-09-03 physics.chem-ph cond-mat.mtrl-sci cs.AI cs.LG physics.comp-ph 新提交

HiPoly: a hierarchical polymer-native AI framework for property prediction and generative design

HiPoly:用于性能预测与生成式设计的聚合物原生分层AI框架

Ge Sun, Gervasio Zaldivar, Yuan Tian, Gustavo Perez Lemus, Juhae Park, Dasha Safarian, Ming Han, Juan J. de Pablo

机构 * New York University(纽约大学) University of Chicago(芝加哥大学) Peking University(北京大学)

AI总结 HiPoly是基于G2RINS的分层聚合物原生AI框架,可处理完整聚合物描述,实现从配方数据到性能预测、生成式设计及物理验证的端到端工作流,在多组分聚合物热性能预测中达最优精度,能加速可持续聚合物替代物发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.00528 2026-09-03 cs.LG math-ph math.MP physics.chem-ph physics.comp-ph 版本更新

Why Multi-Layer Message Passing Works: Completeness Theory for Graph Neural Network Interatomic Potentials

为什么多层消息传递有效:图神经网络原子间势的完备性理论

Pingbing Ming, Han Wang

机构 * Institute of Computational Mathematics and Scientific/Engineering Computing, AMSS, Chinese Academy of Sciences(中国科学院数学与系统科学研究院计算数学与科学工程计算研究所) Institute of Applied Physics and Computational Mathematics(应用物理与计算数学研究所) College of Engineering, Peking University(北京大学工学院)

AI总结 该研究提出图神经网络原子间势的多层完备性理论,证明超图神经网络是势能面通用近似器,为实际应用的多层消息传递设置提供严格依据,并表明DPA3、CHGNet具备通用近似能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26647 2026-09-03 cs.CV 版本更新

Tissue-Mixture Entropy-Weighted Reconstruction for Partial-Volume-Aware Brain MRI Super-Resolution

组织混合熵加权重建用于部分容积感知的脑部MRI超分辨率

Xiao Tong, Wenyun Yang, Ziheng Zhang, Jingzhi Han, Zhaochu Luo, Jinbo Yang

机构 * Peking University(北京大学) Weihai Institute of Oceanology, Peking University(北京大学威海海洋研究院) Beijing MagnVue Medix Co., Ltd.(北京迈格威医疗科技有限公司)

AI总结 本研究提出AGW-PBR方法,通过组织混合熵加权优化脑部MRI超分辨率,提升了IXI数据集的重建效果,无PVE监督的骨干网络在fastMRI上也表现出色。

Comments 17 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21969 2026-09-03 cs.CL cs.HC cs.LG 版本更新

ToSCA: Leveraging Hierarchical Reinforcement Learning on Temporal and Strategic Abstractions of Conversational Agents

ToSCA:利用对话智能体的时间与策略抽象实现分层强化学习

Xiaoyu Wang, Qingqing Gu, Yue Zhao, Teng Chen, Yuqi Cao, Xiaokai Chen, Hongyan Li, Luo Ji

机构 * Geely AI Lab(吉利AI实验室) Beijing Institute of Technology(北京理工大学) Peking University(北京大学)

AI总结 该研究受人类多层时间抽象启发,提出ToSCA框架,采用两级分层强化学习结合双粒度奖励机制,在两类对话任务中性能优于基线方法。

Comments Accepted by EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05049 2026-09-03 cs.CV 版本更新

OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing

OmniEdit-Bench:基于指令的视频编辑综合基准

Chenxuan Miao, Yutong Feng, Yi Lu, Yunfeng Yan, Donglian Qi, Shiwei Zhang, Yu Liu, Xi Chen, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Peking University(北京大学)

AI总结 针对现有基于指令的视频编辑基准的任务覆盖有限、指标不足的问题,OmniEdit-Bench将编辑任务分解为多维度并提出含惩罚机制的评估框架,实验显示当前IVE模型仍待提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22365 2026-09-03 cs.DM cs.LG 版本更新

Towards Solving the Gilbert-Pollak Conjecture via Large Language Models

通过大语言模型解决吉尔伯特-波拉克猜想

Yisi Ke, Tianyu Huang, Yankai Shu, Di He, Jingchu Gai, Liwei Wang

机构 * School of EECS, Peking University(北京大学电子工程学院) School of Mathematical Sciences, Peking University(北京大学数学科学学院) Center for Machine Learning Research, Peking University(北京大学机器学习研究中心) State Key Laboratory of General Artificial Intelligence, Peking University, Beijing, China(北京大学通用人工智能国家重点实验室) Carnegie Mellon University, Machine Learning Department(卡内基梅隆大学机器学习系)

AI总结 本文提出一种新的AI系统,通过生成受规则约束的几何引理并构建专用函数,以获得更紧的Steiner比下界,展示了大语言模型在高级数学研究中的强大潜力。

Comments Published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13824 2026-09-03 cs.LG 版本更新

Beyond State Consistency: Behavior Consistency in Text-Based World Models

超越状态一致性:文本基础世界模型中的行为一致性

Youling Huang, Guanqiao Chen, Junchi Yao, Lu Wang, Fangkai Yang, Chao Du, ChenZhuo Zhao, Pu Zhao, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * Dalian University of Technology(大连理工大学) MBZUAI Peking University(北京大学) Microsoft(微软)

AI总结 本文提出行为一致性训练方法,通过改进世界模型与真实环境的功能一致性,提升长期对齐效果,实验显示在WebShop和TextWorld中表现优异,同时保持单步预测质量。

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10534 2026-09-03 cs.AI 版本更新

Achieving Olympiad-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning

通过复杂度提升强化学习实现奥lympia级几何大语言模型代理

Haiteng Zhao, Junhao Shen, Yiming Zhang, Songyang Gao, Kuikun Liu, Tianyou Ma, Fan Zheng, Dahua Lin, Wenwei Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) ICMAT Spanish National Research Council(西班牙国家研究委员会ICMAT) The Chinese University of Hong Kong(香港中文大学)

AI总结 InternGeometry通过复杂度提升强化学习实现几何问题求解,仅用13K训练示例解决44个IMO问题,超越平均金牌得主得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13548 2026-09-03 cs.CR cs.AI cs.CL

ForgeDAN: An Evolutionary Framework for Jailbreaking Aligned Large Language Models

Siyang Cheng, Gaotian Liu, Rui Mei, Yilin Wang, Kejia Zhang, Kaishuo Wei, Yuqi Yu, Weiping Wen, Xiaojie Wu, Junhua Liu

机构 * iFLYTEK Security Laboratory(iFLYTEK安全实验室) Anhui SparkShield Intelligent Technology Co., Ltd.(安徽SparkShield智能科技有限公司) Peking University(北京大学) School of Automation, University of Electronic Science and Technology of China(电子科技大学自动化学院) Northwest University(西北大学) University of New South Wales(新南威尔士大学) National Computer Network Emergency Response Technical Team/Coordination Center of China(中国国家计算机网络应急技术处置协调中心)

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.01516 2026-09-02 cs.CV 新提交

DualDiff3D: Dual Structure-Appearance Diffusion Priors for Reliability-Enhanced 3D Gaussian Splatting

DualDiff3D:用于可靠性增强的3D Gaussian Splatting的双结构-外观扩散先验

Qian Wang, Yu Wang, Weiqi Li, Xinhua Cheng, Xiandong Meng, Ronggang Wang, Jian Zhang

机构 * School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) Pengcheng Laboratory(鹏城实验室) Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省超高清沉浸式媒体技术重点实验室)

AI总结 针对输入视图有限时3DGS重建质量差的问题,提出DualDiff3D框架,采用双扩散先验与SAA模块,结合RRO循环提升性能,优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏