arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 1744 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1744 篇

2512.19918 2026-03-27 cs.CV 50%

Widget2Code: From Visual Widgets to UI Code via Multimodal LLMs

Widget2Code: 通过多模态大语言模型从视觉小部件到UI代码

Houston H. Zhang, Tao Zhang, Baoze Lin, Yuanqi Xue, Yincheng Zhu, Huan Liu, Li Gu, Linfeng Ye, Ziqiang Wang, Xinxin Zuo, Yang Wang, Yuanhao Yu, Zhixiang Chi

机构 * McMaster University(麦克马斯特大学) University of Toronto(多伦多大学) University of Waterloo(滑铁卢大学) Concordia University(康考迪亚大学)

专题命中 代码评测 :code generation(abstract)

AI总结 本文提出Widget2Code任务,通过多模态大语言模型提升小部件到UI代码的生成能力,设计了图像-only基准测试和WidgetFactory框架,提升视觉保真度。

Comments CVPR 2026, Code: https://github.com/Djanghao/widget2code

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20449 2026-03-27 physics.flu-dyn 50%

A meshless data-tailored approach to compute statistics from scattered data with adaptive radial basis functions

一种无网格数据定制方法用于从散射数据计算统计量,采用自适应径向基函数

Damien Rigutto, Manuel Ratz, Miguel A. Mendez

专题命中 代码评测 :repository(abstract)

AI总结 本文提出了一种基于自适应径向基函数的无网格方法,通过梯度信息优化数据采样和基函数形状,提升湍流场重建的准确性和物理一致性。

Comments Under review for publication in Experiments in Fluids

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18474 2026-03-25 cs.RO cs.HC 50%

When Robots Say No: The Empathic Ethical Disobedience Benchmark

当机器人说不:共情伦理违抗基准

Dmytro Kuzmenko, Nadiya Shvai

机构 * National University of Kyiv-Mohyla Academy(基輔-莫海拉學院國家大學)

专题命中 代码评测 :repository(abstract)

AI总结 本文提出EED Gym基准,用于评估机器人在安全与社会接受性之间的平衡,探讨拒绝行为对信任的影响,发现解释性拒绝能维持信任,安全RL方法提升鲁棒性但易导致过度谨慎。

Comments Accepted at the ACM/IEEE International Conference on Human-Robot Interaction (HRI 2026). This is a preprint of the author-accepted manuscript

Journal ref Proceedings of the ACM/IEEE International Conference on Human-Robot Interaction (HRI 2026), Edinburgh, UK, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.02831 2026-03-23 cs.CV 50%

Deep Face Restoration: A Survey

深度人脸修复:综述

Tao Wang, Kaihao Zhang, Jiankang Deng, Tong Lu, Wei Liu, Stefanos Zafeiriou

机构 * The State Key Lab for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Australian National University(澳大利亚国立大学) Imperial College London(伦敦帝国理工学院) Tencent(腾讯)

专题命中 代码评测 :repository(abstract)

AI总结 本文综述了基于深度学习的人脸修复方法,分析了问题 formulations、挑战及最新技术,提供了系统评估和开源资源。

Comments Accepted by ACM Computing Surveys, 39 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13479 2026-03-23 cs.AR 50%

Toward Reproducible and Standardized Computer Architecture Simulation with gem5

迈向可重复和标准化的计算机体系结构模拟的gem5

Kunal Pai, Harshil Patel, Erin Le, Noah Krim, Mahyar Samani, Bobby R. Bruce, Jason Lowe-Power

专题命中 代码评测 :repository(abstract)

AI总结 本文通过改进gem5和gem5 Resources,标准化磁盘镜像创建,提供验证过的基础镜像和预注释的基准套件,简化了计算机体系结构模拟的设置流程,提高了可重复性和标准化程度。

Comments Accepted to the 2026 IEEE International Symposium on Performance Analysis of Systems and Software (ISPASS-2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07004 2026-03-10 cs.CR 50%

An Extended Consent-Based Access Control Framework: Pre-Commit Validation and Emergency Access

扩展的基于同意的访问控制框架:预提交验证与紧急访问

Nasif Muslim, Jean-Charles Grégoire

专题命中 代码评测 :repository(abstract)

AI总结 本文提出一种扩展的基于同意的访问控制框架,通过预提交验证和紧急访问机制,提升医疗系统中患者自主权的保障与冲突解决效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12747 2026-03-04 cs.HC 50%

From Guidelines to Practice: Evaluating the Reproducibility of Methods in Computational Social Science

从指南到实践:评估计算社会科学中方法的可重现性

Fakhri Momeni, Sarah Sajid, Johannes Kiesel

专题命中 代码评测 :repository(abstract)

AI总结 本研究评估了计算社会科学中方法的可重现性,发现整理文档和标准化执行环境能显著提高可重现性,同时参与者常依赖AI工具解决技术问题。

Journal ref WebSci2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01475 2026-03-03 cs.CV 50%

WildCross: A Cross-Modal Large Scale Benchmark for Place Recognition and Metric Depth Estimation in Natural Environments

WildCross: 一种用于自然环境中地方识别和度量深度估计的跨模态大规模基准

Joshua Knights, Joseph Reid, Kaushik Roy, David Hall, Mark Cox, Peyman Moghadam

专题命中 代码评测 :repository(abstract)

AI总结 WildCross是一个用于自然环境中地方识别和度量深度估计的跨模态大规模基准,通过提供大规模数据集和实验验证,推动多模态机器人感知技术的发展。

Comments IEEE International Conference on Robotics & Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00702 2026-03-03 cs.CV 50%

Towards Universal Khmer Text Recognition

面向通用柬埔寨文字识别

Marry Kong, Rina Buoy, Sovisal Chenda, Nguonly Taing, Masakazu Iwamura, Koichi Kise

机构 * Techo Startup Center, Ministry of Economy and Finance, Cambodia(技术创业中心、经济财政部、柬埔寨) Osaka Metropolitan University, Japan(大阪 metropolitan 大学、日本)

专题命中 代码评测 :repository(abstract)

AI总结 本文提出了一种通用柬埔寨文字识别框架,通过模态感知自适应特征选择技术提升多模态文本识别性能,并建立了首个全面的基准测试集。

Comments 17 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13261 2026-02-10 cs.CV 50%

Building Egocentric Procedural AI Assistant: Methods, Benchmarks, and Challenges

构建第一人称程序化AI助手:方法、基准和挑战

Junlong Li, Huaiyuan Xu, Sijie Cheng, Kejun Wu, Kim-Hui Yap, Lap-Pui Chau, Yi Wang

机构 * Department of EEE(电子工程系) The Hong Kong Polytechnic University(香港理工大学) RayNeo Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学)

专题命中 代码评测 :repository(abstract)

AI总结 本文提出第一人称程序化AI助手,探讨其核心任务、赋能维度及挑战,通过实验评估现有方法并指明未来研究方向。

Comments Under peer-review

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03632 2026-02-06 astro-ph.CO astro-ph.IM 50%

BLAST: Beyond Limber Angular power Spectra Toolkit. A fast and efficient algorithm for 3x2 pt analysis

BLAST: 超越Limber角功率谱工具包。一种快速且高效的3x2pt分析算法

Sofia Chiarenza, Marco Bonici, Will Percival, Martin White

专题命中 代码评测 :repository(abstract)

AI总结 BLAST是一种基于切比雪夫多项式的高效算法,用于计算角功率谱,无需使用Limber近似,且在精度和速度上优于现有方法。

Comments 15 pages, 10 figures. Accepted for publication in the Open Journal of Astrophysics

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01597 2026-02-03 astro-ph.HE 50%

A Catalogue of Variable Active Galactic Nuclei Based on Multi-Timescale Variability Analysis from Fermi-LAT Data

基于费米-拉特数据多时间尺度变异性分析的变星活动星系核目录

Luana Passos-Reis, Elisabete M. de Gouveia Dal Pino, Tarek Hassan, Santiago Pita, Alberto Domínguez

专题命中 代码评测 :repository(abstract)

AI总结 基于费米-拉特数据多时间尺度变异性分析,构建变星活动星系核目录,揭示FSRQ与BL Lac的变异性差异,为高能喷流研究提供基础。

Comments 4 pages, 1 figure, 1 table. Presented at High Energy Phenomena in Relativistic Outflows IX (HEPRO-IX), 2025

Journal ref PoS(HEPRO-IX)078 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02507 2026-01-30 cs.CV cs.RO 50%

Keeping it Local, Tiny and Real: Automated Report Generation on Edge Computing Devices for Mechatronic-Based Cognitive Systems

保持本地化、小巧和现实:面向机电认知系统的边缘计算设备自动化报告生成

Nicolas Schuler, Lea Dewald, Jürgen Graf

专题命中 代码评测 :repository(abstract)

AI总结 本文提出了一种基于边缘计算设备的自动化报告生成方法,利用本地模型实现多模态传感器数据处理,以提升机电认知系统在不同环境中的评估效率与隐私保护。

Comments 6 pages, 4 figures, 1 table; accepted for MECATRONICS-REM 2025 International Conference, PARIS, FRANCE December 3-5 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04216 2026-01-29 cs.CE physics.comp-ph quant-ph 50%

Quantum-informed simulations for mechanics of materials: DFTB+MBD framework

基于量子信息的材料力学模拟:DFTB+MBD框架

Zhaoxiang Shen, Raúl I. Sosa, Stéphane P. A. Bordas, Alexandre Tkatchenko, Jakub Lengiewicz

专题命中 代码评测 :repository(abstract)

AI总结 本文提出DFTB+MBD框架,用于研究量子效应如何影响材料的机械性能,通过多尺度建模提升材料工程的计算精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12383 2026-01-21 math.OC 50%

An efficient penalty decomposition algorithm for minimization over sparse symmetric sets

一种用于稀疏对称集最小化的高效惩罚分解算法

Ahmad Mousavi, Morteza Kimiaei, Saman Babaie-Kafaki, Vyacheslav Kungurtsev

专题命中 代码评测 :repository(abstract)

AI总结 本文提出了一种高效惩罚分解算法,用于在稀疏对称集上最小化非凸函数,通过两块分解方案和改进的线搜索策略,提升了算法的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11525 2026-01-21 cs.HC 50%

PlotGen-Bench: Evaluating VLMs on Generating Visualization Code from Diverse Plots across Multiple Libraries

PlotGen-Bench: 评估VLMs在从多样化图表生成可视化代码的能力 across 多个库

Yi Zhao, Zhen Yang, Shuaiqi Duan, Wenmeng Yu, Zhe Su, Jibing Gong, Jie Tang

专题命中 代码评测 :code generation(abstract)

AI总结 PlotGen-Bench评估VLMs在多库场景下生成可视化代码的能力,发现开源模型在视觉和语义一致性上表现欠佳,需进一步提升。

Comments 30 pages, 27 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09112 2026-01-15 cs.CY 50%

Seeking Human Security Consensus: A Unified Value Scale for Generative AI Value Safety

寻求人类安全共识:面向生成式AI价值安全的统一价值尺度

Ying He, Baiyang Li, Yule Cao, Huirun Xu, Qiuxian Chen, Shu Chen, Shangsheng Ren

专题命中 代码评测 :repository(abstract)

AI总结 本文提出生成式AI价值安全尺度,通过生命周期视角构建价值安全风险分类和事件库,并通过基准测试揭示模型间价值安全性能差异,强调建立共享安全基础的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00826 2026-01-09 cs.CY 50%

Digital Homunculi and Institutional Design: Breaking Through the Experimentation Bottleneck

数字人偶与制度设计:突破实验瓶颈

Petr Specian

专题命中 代码评测 :repository(abstract)

AI总结 本文提出利用生成式AI驱动的数字人偶方法,通过模拟人类行为生成合成数据,以突破民主研究中的实验瓶颈,提升制度创新的效率与可行性。

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21799 2026-01-01 cs.IR 50%

KG20C & KG20C-QA: Scholarly Knowledge Graph Benchmarks for Link Prediction and Question Answering

KG20C & KG20C-QA:面向链接预测和问答的学术知识图谱基准测试

Hung-Nghiep Tran, Atsuhiro Takasu

专题命中 代码评测 :repository(abstract)

AI总结 本文提出KG20C和KG20C-QA两个学术知识图谱基准测试,用于提升基于学术数据的问答和推理能力。

Comments extracted and extended from author's PhD thesis, "Multi-Relational Embedding for Knowledge Graph Representation and Analysis"

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10927 2025-12-24 cs.CR 50%

VeriFuzzy: A Dynamic Verifiable Fuzzy Search Service for Encrypted Cloud Data

VeriFuzzy:一种动态可验证模糊搜索服务用于加密云数据

Jie Zhang, Xiaohong Li, Man Zheng, Ruitao Feng, Shanshan Xu, Zhe Hou, Guangdong Bai

专题命中 代码评测 :repository(abstract)

AI总结 VeriFuzzy通过整合增强虚拟二叉树、区块链重构验证和双仓库状态管理,实现了高效且安全的动态可验证模糊搜索服务。

Comments 15 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17838 2025-12-22 cs.CV 50%

ReX-MLE: The Autonomous Agent Benchmark for Medical Imaging Challenges

ReX-MLE:医疗影像挑战的自主代理基准

Roshan Kenia, Xiaoman Zhang, Pranav Rajpurkar

机构 * Harvard Medical School(哈佛医学院) Department of Biomedical Informatics(生物医学信息学系)

专题命中 代码评测 :coding agent(abstract)

AI总结 ReX-MLE是一个针对医学影像挑战的自主代理基准,通过评估端到端工作流程,揭示了现有代理在领域知识和工程能力上的不足。

Comments https://github.com/rajpurkarlab/ReX-MLE

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13550 2025-12-16 physics.chem-ph cond-mat.str-el physics.comp-ph 50%

DoNOF 2.0: A modern Open-Source Electronic Structure Program for Natural Orbital Functionals

DoNOF 2.0:一种现代的开源电子结构程序用于自然轨道功能

Juan Felipe Huan Lew-Yee, Ion Mitxelena, Jorge M. del Campo, and Mario Piris

专题命中 代码评测 :repository(abstract)

AI总结 DoNOF 2.0是一款开源电子结构程序,提供改进的优化算法、激发态计算和非线性光学响应评估功能。

Comments 11 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12145 2025-12-16 physics.optics 50%

A Thermal Modeling Toolkit for Continuous-Wave Gaussian Second-Harmonic Generation in KTP Crystal

用于KTP晶体连续波高斯二次谐波生成的热模型工具包

Mostafa M. Rezaee, Mohammad Sabaeian, Alireza Motazedian, Fatemeh Sedaghat Jalil-Abadi, Mohammad Ghadri

专题命中 代码评测 :repository(abstract)

AI总结 该工具包提供了一种用于计算KTP晶体连续波高斯二次谐波生成中温度场的开源有限差分方法,支持多种热传导模型和参数化情景扫描。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11884 2025-12-16 cs.CV 50%

Generalization vs. Specialization: Evaluating Segment Anything Model (SAM3) Zero-Shot Segmentation Against Fine-Tuned YOLO Detectors

泛化与专门化:评估Segment Anything Model(SAM3)零样本分割对精细调优的YOLO检测器

Ranjan Sapkota, Konstantinos I. Roumeliotis, Manoj Karkee, Nikolaos D. Tselikas

机构 * Cornell University, Department of Biological and Environmental Engineering(康奈尔大学生物与环境工程系) University of the Peloponnese, Department of Informatics and Telecommunications(希腊皮埃里亚大学信息与电信系)

专题命中 代码评测 :repository(abstract)

AI总结 本文评估了SAM3在零样本分割中的性能,与微调的YOLO检测器相比,展示了SAM3在遮罩精度上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09913 2025-12-11 cs.CV 50%

NordFKB: a fine-grained benchmark dataset for geospatial AI in Norway

NordFKB:挪威地理空间AI的细粒度基准数据集

Sander Riisøen Jyhne, Aditya Gupta, Ben Worsley, Marianne Andersen, Ivar Oveland, Alexander Salveson Nossum

机构 * Kartverket Kristiansand(挪威地图局克里斯蒂安桑分部) University of Agder(阿格德大学) Norkart Kristiansand(挪威地图公司克里斯蒂安桑分部)

专题命中 代码评测 :repository(abstract)

AI总结 NordFKB为挪威地理空间AI提供细粒度基准数据集,包含高分辨率影像和详细注释,支持语义分割和目标检测的标准化评估。

Comments 8 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04855 2025-12-05 cs.CR 50%

A Novel Trust-Based DDoS Cyberattack Detection Model for Smart Business Environments

面向智能商业环境的一种基于信任的DDoS网络攻击检测模型

Oghenetejiri Okporokpo, Funminiyi Olajide, Nemitari Ajienka, Xiaoqi Ma

专题命中 代码评测 :repository(abstract)

AI总结 本文提出一种基于信任的DDoS检测模型,通过信任评估引擎和中央存储库提升智能商业环境中的检测准确性与适应性。

Comments 22 Pages

Journal ref International Journal of Network Security & Its Applications (IJNSA) Vol.17, No.5/6, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03180 2025-12-04 cs.MA cs.ET 50%

AGENTSAFE: A Unified Framework for Ethical Assurance and Governance in Agentic AI

AGENTSAFE:面向代理AI的统一伦理保障与治理框架

Rafflesia Khan, Declan Joyce, Mansura Habiba

专题命中 代码评测 :repository(abstract)

AI总结 AGENTSAFE提出一个统一的治理框架,通过风险分类转化为可操作的设计、运行时和审计控制,提供可衡量的预部署保障,并通过运行时治理和问责机制建立代理AI生态系统的信任。

Comments 12 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00341 2025-12-02 cs.NE 50%

A Novel Population Initialization Method via Adaptive Experience Transfer for General-Purpose Binary Evolutionary Optimization

一种通过自适应经验迁移的新型通用二进制进化优化群体初始化方法

Zhiyuan Wang, Shengcai Liu, Shaofeng Zhang, Ke Tang

专题命中 代码评测 :repository(abstract)

AI总结 本文提出了一种基于自适应经验迁移的通用二进制优化群体初始化方法,通过少量函数评估生成高质量初始群体,有效提升复杂问题的求解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21130 2025-11-27 math.NA cs.NA 50%

Numerical Performance of the Implicitly Restarted Arnoldi Method in OFP8, Bfloat16, Posit, and Takum Arithmetics

在OFP8、bfloat16、posit和takum算术中隐式重启Arnoldi方法的数值性能

Laslo Hunhold, James Quinlan, Stefan Wesner

专题命中 代码评测 :repository(abstract)

AI总结 本文评估了OFP8、bfloat16、posit和takum算术中隐式重启Arnoldi方法的数值性能,发现takum算术表现优于posit,而bfloat16在float16上表现更优,OFP8则不适合通用计算。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14035 2025-11-24 stat.AP 50%

Waiting for Dabo: A machine learning model for predicting Power 4 college football coaching hire success

等待达博:一个用于预测Power 4大学足球教练聘任成功的机器学习模型

Michael Schuckers, Austin Hayes

专题命中 代码评测 :repository(abstract)

AI总结 本文提出一个机器学习模型,用于预测Power 4大学足球教练聘任的成功,通过分析教练背景、过去表现和学校质量等29个变量,模型准确率达66%,但无法高预测性识别成功聘任。

Comments Version 2025.11.20

详情

展开后加载摘要…

URL PDF HTML 收藏