arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 784 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 784 篇

2608.02994 2026-08-05 physics.optics 新提交 50%

Chiral optics without chiral matter

无手性物质的手性光学

Jingxuan Wei

专题命中 其他LLM :prompting(abstract)

AI总结 该研究打破手性光-物质相互作用需依赖结构手性材料的传统认知,揭示非手性各向异性系统可产生手性光学效应,拓展了手性光学应用的技术路径。

Comments 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00463 2026-08-04 cs.CV cs.MM cs.SD 新提交 50%

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

Scene2Sound:面向3D高斯世界的听觉锚定声景生成

Masaki Yoshida, Ren Togo, Takahiro Ogawa, Miki Haseyama

机构 * Hokkaido University(北海道大学)

专题命中 其他LLM :language model(abstract)

AI总结 Scene2Sound是一个无训练框架,通过听觉锚定和高斯集匹配为3D高斯世界生成空间一致的声景,在保留音频质量的同时解决了现有方法空间不一致的问题,经实验和用户研究验证有效。

Comments 14 pages. Project page: https://masaki-lmd.github.io/scene2sound/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28827 2026-08-03 cs.CY 新提交 50%

Hidden Errors in Big Data: The Case of Property Records

大数据中的隐藏错误:以房产记录为例

Evelyn Smith, Emma Harvey, Jacob Goldin, Daniel E. Ho

专题命中 其他LLM :prompting(abstract)

AI总结 本文审计两个中介房产数据集,发现其存在1-2%售价偏差、12-15%覆盖错误等问题,错报高度一致,会影响财产税累退性估计,凸显开放行政数据的重要性。

Comments To appear in Proceedings of the Ninth AAAI/ACM Conference on AI, Ethics, and Society (AIES-26), Malmö, Sweden, October 12-14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28352 2026-07-31 physics.ed-ph 新提交 50%

Studying Circular Motion with an AI-Generated Smartphone Physics Lab

用AI生成的智能手机物理实验室研究圆周运动

Josep Ll. Suñer, Francisco M. Muñoz-Pérez, Juan C. Castro-Palacio, Juan A. Monsoriu, Martín Monteiro, Cecilia Stari, Arturo C. Martí

专题命中 其他LLM :prompting(abstract)

AI总结 本文通过向AI助手自然语言提示生成无代码定制化浏览器转动实验室,结合旋转平台研究两种圆周运动,并用Tracker视频分析验证测量结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27139 2026-07-30 cs.CV 新提交 50%

SeasonStereo: Robust Dense Stereo Matching for Multi-Date Satellite Imagery via Generative AI

SeasonStereo:基于生成式AI的多日期卫星图像鲁棒密集立体匹配

Álvaro Díaz-Laureano, Roger Marí, Elías Masquil, Pablo Arias, Gabriele Facciolo

机构 * Eurecat(欧罗卡特技术中心) IIE, Facultad de Ingeniería, Universidad de la República(乌拉圭共和国大学工程学院IIE) Universitat Pompeu Fabra(庞培法布拉大学) Université Paris-Saclay(巴黎萨克雷大学) CNRS(法国国家科学研究中心) ENS Paris-Saclay(巴黎萨克雷高等师范学校) Institut Universitaire de France(法国大学研究院)

专题命中 其他LLM :foundation model(abstract)

AI总结 SeasonStereo框架利用带可控季节外观变化的合成图像对训练并结合基础模型零样本几何先验,实现低成本、高精度的多日期卫星图像密集立体匹配,支持大规模三维重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25115 2026-07-29 q-bio.BM 新提交 50%

Persistent Manifold Learning of Protein Properties

蛋白质性质的持久流形学习

Xingjian Xu, Zhe Su, Guo-Wei Wei, Chunmei Wang

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对生物分子结合预测难题,提出持久流形学习框架,利用边界诱导图拉普拉斯算子提取信息,结合相关模型表示与梯度提升决策树,在金属蛋白-配体和蛋白质-蛋白质基准测试中表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23931 2026-07-28 cs.CY 新提交 50%

State-dependent error correlations shape voting thresholds in committees of AI agents

状态依赖误差相关性塑造人工智能代理委员会中的投票阈值

Haifeng Li, Mo Hai

专题命中 其他LLM :language model(abstract)

AI总结 研究人工智能代理委员会投票阈值,结合萨赫 - 斯蒂格利茨筛选与误差依赖性,通过齐次可交换高斯 - copula模型及对大量投票数据的估计,发现考虑依赖关系可提升相关系数、降低损失,改进投票阈值选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23774 2026-07-28 cs.SE 新提交 50%

Semantic-Enhanced Automatic Refinement of Architecture Recovery Results Using LLMs

使用大语言模型进行语义增强的架构恢复结果自动优化

Yiran Zhang, Chengwei Liu, Yuqiang Sun, Zhengzi Xu, Weisong Sun, Wenke Li, Wuxia Jin, Yang Liu

专题命中 其他LLM :LLM(abstract)

AI总结 研究旨在简化架构恢复流程,提出Semref框架结合大语言模型与依赖分析自动优化架构,经在9个项目和10个工具上测试,采用5个指标评估,结果表明该框架提高了恢复架构的准确性。

Comments Accepted by ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23606 2026-07-28 cs.SD eess.AS 新提交 50%

Improving Zero-Shot Phonetic Classification through Language-Agnostic Articulatory Features

通过语言无关的发音特征改进零样本语音分类

Ryo Magoshi, Jaeyoung Lee, Shinsuke Sakai, Tatsuya Kawahara

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究生院) NTT, Inc.(日本电信电话公司)

专题命中 其他LLM :foundation model(abstract)

AI总结 研究针对语音到国际音标转录中标签不准确问题进行零样本语音分类评估,提出基于连续发音特征向量的分类方法,该方法优于离散标记法,且采用最佳时间聚合可提升分类效果,尤其对稀有音素和特定语音分类。

Comments Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20713 2026-07-24 cs.CR cs.SE 新提交 50%

Security Vulnerability Patterns in AI-Generated Code: A Cross-Model Comparative Study

人工智能生成代码中的安全漏洞模式:跨模型比较研究

Shanna M. Kahn, John D. Hastings

专题命中 其他LLM :LLM(abstract)

AI总结 研究基于大语言模型的编码工具生成的自动化脚本安全风险,通过跨模型收集代码并审查漏洞,发现风险与任务类别有关,各模型漏洞情况相似,组织应思考是否不经审查就部署此类自动化代码。

Comments 9 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19513 2026-07-23 math.RA math.RT 新提交 50%

Constructing a complex Lie algebra isomorphic to its complex conjugate but not definable over reals

构建一个同构于其复共轭但不能在实数域上定义的复李代数

Mikhail Borovoi, Willem A. de Graaf, Robert M. Guralnick

专题命中 其他LLM :LLM(abstract)

AI总结 该研究利用特定想法及计算,构建出一个10维复两步幂零李代数,它同构于自身复共轭却无法在实数域定义。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17827 2026-07-21 econ.GN q-fin.EC 新提交 50%

A Gate-and-Menu Theory of Collective Tourism Brand Value

集体旅游品牌价值的门与菜单理论

Johan Fourie

专题命中 其他LLM :language model(abstract)

AI总结 研究集体旅游品牌价值,将目的地建模为门与菜单,用奥曼 - 沙普利核算分配品牌价值,发现分散管理者对门质量维护不足,还通过语言模型测量框架结构并举例说明品牌内污染排序。

Comments 32 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17970 2026-07-21 cs.RO 新提交 50%

MEVION: Low-Cost Open-Source Data Collection System for Powerful and High-Speed Dual-Arm Manipulation

MEVION:用于强大高速双臂操作的低成本开源数据收集系统

Kento Kawaharazuka, Yoshiki Obinata, Hirokazu Ishida, Jihoon Oh, Temma Suzuki, Shintaro Inoue, Keita Yoneda, Ayumu Iwata, Kei Okada

机构 * The University of Tokyo(东京大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 在开发机器人基础模型竞争激烈的背景下,针对ALOHA产生高力和速度能力有限的问题,开发了低成本开源的MEVION双臂机器人数据收集系统,介绍其结构、性能,证明其能为特定任务收集数据及支持相关运动生成。

Comments Accepted to IEEE Robotics and Automation Practice, website: https://haraduka.github.io/mevion-hardware/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16219 2026-07-21 cs.CY 新提交 50%

MDAF: A Multi-Dimensional Annotation Framework for Automated Foreign Policy Analysis

MDAF:一种用于自动外交政策分析的多维注释框架

Songruowen Ma, Songting Ding, Fangyin Zhou, Jörg Friedrichs

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对政府网站外交政策文本未被充分利用的问题,提出MDAF框架,集成大语言模型工作流程,应用于五眼联盟国家与中国相关文本,实现文本识别、信息提取和事件分类自动化,支持跨国比较等,为外交政策分析等做贡献。

Comments 32 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15714 2026-07-20 cs.RO 新提交 50%

AC-VLA: Robust Out-of-Distribution Action Execution via Compositional Learning

AC-VLA:通过组合学习实现稳健的分布外动作执行

Xiaojiang Peng, Kai Peng, Jie Lu, Zheng Lian, Zitong YU, Xiaobo Wang

机构 * Shenzhen Technology University(深圳技术大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Tongji University(同济大学) Great Bay University(大湾区大学)

专题命中 其他LLM :LLM(abstract)

AI总结 研究VLA模型在分布外泛化的问题,提出AC-VLA框架,含组合学习模块和状态条件不对称掩码策略,无需修改架构可集成到VLA主干,在LIBERO和LIBERO-OOD基准测试中,该框架在组合OOD任务上有显著改进,分布内性能良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14588 2026-07-17 cs.HC 新提交 50%

Conversational Tactile Data Interfaces: Co-Designing Accessible Data Experiences with Blind Users Using Refreshable Tactile Displays and Conversational AI

对话式触觉数据接口:使用可刷新触觉显示器和对话式人工智能与盲人用户共同设计无障碍数据体验

Samuel Reinders, Munazza Zaib, Bongshin Lee, Ingrid Zukerman, Matthew Butler, Thien Autran, Sascha Cowley, Francois Jacobs, Lizhen Qu, Kim Marriott

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对盲人或视力低下者数据可视化问题,通过与盲人共同设计师协同设计,创建结合可刷新触觉显示器与对话代理的CTDI(Graphy系统),贡献设计知识与建议,得出分层展示等关键发现。

Comments Accepted to be presented at IEEE VIS 2026 and published in IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14357 2026-07-17 cs.GT cs.MA econ.TH 新提交 50%

When Is Delegated Play Truthful? Within-Range Regret and the Trilemma of Aligned Delegation

委托策略何时是真实的?范围内遗憾与对齐委托的三难困境

Taksch Dube

专题命中 其他LLM :language model(abstract)

AI总结 研究广告商和用户委托代理的最优诚实描述问题,核心方法是基于代理的范围内遗憾,主要贡献是统一特定拍卖自动出价结果、确定语言模型诱导代理假设成立条件,揭示护栏三难困境及生产模型诚实报告存在未认领剩余等情况。

Comments 31 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13930 2026-07-16 nucl-th astro-ph.HE physics.comp-ph 新提交 50%

NNStar: An end-to-end AI agent for nuclear matter and neutron star physics

NNStar:用于核物质和中子星物理的端到端人工智能代理

Yao Ma, Yong-Liang Ma, Jia-Ying Xiong

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对核物质和中子星物理中约束致密物质状态方程需处理大量数据及高维耦合空间微调难的问题,提出NNStar这一端到端人工智能代理,可自动化工作流程,为相关观测分析提供新的AI驱动框架。

Comments 14 pages; comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12647 2026-07-15 eess.AS 新提交 50%

Investigating the Integration of Spatial Information in Foundation-Model-Based Speaker Diarization

研究基于基础模型的说话人聚类中空间信息的整合

Marc Deegen, Adrian Meise, Reinhold Haeb-Umbach

专题命中 其他LLM :foundation model(abstract)

AI总结 研究基于基础模型的说话人聚类中空间信息整合,比较波束形成器与基础模型级联、多通道基础模型、基于提取空间特征对下游网络条件设定三种方法,发现条件设定法性能最佳且能消除相关错误,是有竞争力的方法。

Comments Accepted at IWAENC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11111 2026-07-14 cs.SE 新提交 50%

Know Before Fix: QA-Driven Repository Knowledge Acquisition for Software Issue Resolution

修复前先了解:用于软件问题解决的基于问答的仓库知识获取

Haotian Lin, Silin Chen, Xiaodong Gu, Yuling Shi, Chengxi Pan, Jiaqi Ge, Mengfan Li, Jianghong Huang, Mengchieh Chuang, Beijun Shen, Haibing Guan

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对基于大语言模型的编码代理解决软件问题易因仓库理解不足出错的问题,提出ACQUIRE框架,通过问答驱动在修复前获取仓库知识,经两阶段解耦知识获取与补丁生成,实验证明该框架能提升问题解决准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10736 2026-07-14 cs.CY 新提交 50%

Robo-Reporters: Evaluating Autonomous AI Agents as Algorithmic Gatekeepers in Computational Journalism

机器人记者:评估作为计算新闻学中算法把关人的自主人工智能代理

Obada Kraishan, Kulsawasd Jitkajornwanich, Kerk Kee

专题命中 其他LLM :language model(abstract)

AI总结 研究对比四种人工智能代理架构在新闻任务中的表现,通过200个对照实验,发现架构对任务时长和计算策略有显著影响,多智能体协作准确率最高,整体式架构有特定信息源拒绝率,还揭示了透明度方面差异,为新闻编辑室提供架构选择指导。

Comments 12 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10684 2026-07-14 cs.CV 新提交 50%

HyperBank: A Differentiable Bank of Classical Priors for Few-Shot Spheroid Microscopy Segmentation

HyperBank:用于少样本球体显微镜分割的可微经典先验库

M. Průšek, A. Novozámský, F. Šroubek, T. Volfová, V. Svobodová Pavlíčková, S. Rimpelová

机构 * The Czech Academy of Sciences, Institute of Information Theory and Automation(捷克科学院,信息理论与自动化研究所) Czech Technical University in Prague, Faculty of Nuclear Sciences and Physical Engineering(布拉格捷克技术大学,核科学与物理工程学院) University of Chemistry and Technology Prague, Department of Biochemistry and Microbiology(布拉格化学与技术大学,生物化学与微生物学系) Charles University, Faculty of Science, BIOCEV(查理大学,科学学院,BIOCEV)

专题命中 其他LLM :foundation model(abstract)

AI总结 研究少样本球体分割问题,提出可微经典图像处理算子库HyperBank,通过在支持图像上拟合并在验证图像上评估,发现其在小簇、对比度驱动数据上有竞争力,且能揭示少样本信号分布及受支持集形态学影响。

Comments Accepted for publication in the IEEE Xplore ICIP 2026 Workshop Proceedings, Computational Optical Microscopy Satellite Workshop of the 2026 IEEE International Conference on Image Processing (ICIP), Tampere, Finland

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09900 2026-07-14 cs.SE 新提交 50%

AfterVibe: What Remains When the Conversation Ends

AfterVibe:对话结束后留下了什么

Matteo Paltenghi, Satish Chandra

专题命中 其他LLM :LLM(abstract)

AI总结 AfterVibe框架从vibe编码会话恢复自然语言规范,用语言模型提取规范并经再生测试验证,在72个项目上评估发现其恢复的规范抽象且强,优于人工描述,可迭代加强,意味着规范或成人工审查主要工件和记录来源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08912 2026-07-13 cs.HC 新提交 50%

MemeBuddy: Dialog-Style Audio Representations for Engaging Non-Visual Meme Experiences

MemeBuddy:用于引人入胜的非视觉表情包体验的对话式音频表示

Chirag Bhansali, Vikas Ashok, Hae-Na Lee

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对盲人用户无法充分理解表情包的问题,提出MemeBuddy系统,将表情包建模为对话,结合文本与多模态大语言模型隐含知识生成音频表示。用户研究表明,该方式能提升盲人用户参与度与满意度,且理解能力相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07593 2026-07-09 cs.SE 新提交 50%

What Makes a Good Bug Report for an AI Agent?

什么是适合人工智能代理的优质错误报告?

Lara Khatib, Noble Saji Mathews, Meiyappan Nagappan, Pengyu Nie, Thomas Zimmermann

专题命中 其他LLM :LLM(abstract)

AI总结 研究自动化程序修复代理的优质错误报告,通过统计建模和受控消融分析发现,代理受益于具体可执行且定位好的信息,与人类优质报告有别,如自然语言重现步骤等对代理作用不大,不同模型处理缺失信息方式有差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07013 2026-07-09 cs.GT 新提交 50%

What Semivalues Cannot See: The Information Content of Anonymous Marginal Values

半值无法看到的内容:匿名边际值的信息含量

Matthew Fried

专题命中 其他LLM :prompting(abstract)

AI总结 研究半值族核心结构,通过哈萨尼股息坐标揭示其为协同效应封闭回路,证明了混合差异审计等相关性质,给出不同博弈情况及扰动阈值,n = 5普查展示规则特点,比较经典与随机博弈可见度。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05774 2026-07-08 stat.ME 新提交 50%

AI-Augmented Statistical Network Estimation with Proxy Gene Embeddings

基于代理基因嵌入的人工智能增强统计网络估计

Yan Chen, Weijing Tang, Jin-Hong Du

专题命中 其他LLM :foundation model(abstract)

AI总结 研究利用现代生物医学基础模型提供的代理基因嵌入改善部分观察目标网络的潜在结构恢复,提出PLANE模型,结合两种信息源,经分析得出网络嵌入权重的最优选择,模拟等验证其能提升潜在恢复等效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05883 2026-07-08 cs.RO 新提交 50%

DexTele: A Dual-Arm Dexterous Teleoperation System Based on Motion Retargeting and Adaptive Force Control

DexTele:一种基于运动重定向和自适应力控制的双臂灵巧遥操作系统

Yuanchuan Lai, Qing Gao, Ziyan Liang, Xianfeng Cheng, Junjie Hu, Zhaojie Ju

机构 * School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳)) School of Computing, University of Portsmouth(计算学院,朴茨茅斯大学)

专题命中 其他LLM :language model(abstract)

AI总结 研究针对双臂灵巧遥操作中运动重定向和抓取的挑战,提出DexTele系统,通过视觉运动重定向模块和自适应抓取模块,结合运动图编码器、视觉语言模型等技术,实现多平台精确运动重定向与柔顺抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05253 2026-07-08 cs.CV 新提交 50%

Repurposing CLIP to Localize at Pixel Level

复用CLIP实现像素级定位

Jiaxiang Fang, Shiqiang Ma, Jing Wang, Siyu Chen, Fei Guo, Shengfeng He

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Advanced Technology Center Beijing AI Laboratory(北京人工智能先进技术中心) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院)

专题命中 其他LLM :language model(abstract)

AI总结 针对CLIP全局特征偏差导致难以适配像素级预测的问题,提出CLIPix框架,结合抗噪校正与定位嵌入策略,保留CLIP泛化性,在PASCAL、COCO上取得最优像素级定位性能。

Comments Accepted by IEEE TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05034 2026-07-07 cs.CY 新提交 50%

Understanding Student Perceptions, Mistakes, and Debugging Approaches when Solving Natural Language Programming Tasks

理解学生在解决自然语言编程任务时的认知、错误及调试方法

Victor-Alexandru Pădurean, Kaitlin Riegel, Gweneth Barbre, Musa Blake, Paul Denny, Alkis Gotovos, Juho Leinonen, Stephen MacNeil, James Prather, Adish Singla

专题命中 其他LLM :prompting(abstract)

AI总结 研究新手程序员解决自然语言编程任务时的提示错误、沟通问题及调试策略。通过分析超900名学生尝试解决基于对话的提示问题,发现提示更易且有趣,常见错误是遗漏关键细节,失败时注重澄清意图。

Comments ICER'26 paper

详情

展开后加载摘要…

URL PDF HTML 收藏