arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-31 至 2026-07-31 共收录 343 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 28 篇

2603.19790 2026-07-31 cs.CV 版本更新 78%

Geometric Risk Control for Vision-Language Model OCR

从可信性到可验证性:具有视觉-语言模型的风险控制生成OCR

Weile Gong, Zijian Lu, Mingcai Chen, Yiping Zuo, Xin He, Weibei Fan

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学) China University of Petroleum(中国石油大学) Southeast University(东南大学)

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出通过几何风险控制器减少生成OCR的极端错误风险,利用结构化视图和轻量级筛查实现可靠部署。

Comments 9 pages, 5 figures, Code: https://github.com/phare111/GRC

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21517 2026-07-31 cs.IT cs.AI cs.DM math.CO math.IT 版本更新 77%

Improved lower bounds for the Shannon capacity of odd cycles

奇数圈香农容量的改进下界

Nathaniel Itty, Christopher D. Rosin, Chase Carstensen, Daniel Reichman

机构 * Worcester Polytechnic Institute(沃斯特理工学院)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过与大语言模型迭代交互,在奇数圈\(C_7^{10}\)、\(C_{11}^{6}\)、\(C_{13}^{6}\)中构造独立集,改进了这些图香农容量的已知下界,还改进了几个奇数圈单个强幂独立数的已知下界。

Comments v2: added improvement on lower bound for the Shannon capacity of C15

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27726 2026-07-31 cs.AI cs.CL cs.LG 新提交 75%

Baikal: Structured Search for Deep Research over Data Lakes

Baikal:面向数据湖深度研究的结构化搜索框架

Dhruv Agarwal, Rishitha Guttapalle Mohan, Aarti Kumari, Ashi Sinha, Athulya Anil, Kavitha Srinivas, Horst Samulowitz, Andrew McCallum

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 Baikal是面向数据湖深度研究的结构化搜索框架,通过聚类证据为语义区域并自适应搜索,在HybridQA和TAT-QA数据湖上较基线方法提升报告得分28%和36%,展现了结构化语义探索的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09487 2026-07-31 cs.CL cs.AI cs.LG 版本更新 75%

Metareasoning constraints couple narratives, affect and cognition

内部叙事参数化情感状态

Jakub Onysk, Quentin J. M. Huys

机构 * Applied Computational Psychiatry Lab(应用计算精神病学实验室) Max Planck UCL Centre for Computational Psychiatry and Ageing Research(马克斯·普朗克UCL计算精神病学与衰老研究中心) Queen Square Institute of Neurology and Mental Health(圣夸克广场神经病学与心理健康研究所) Neuroscience Department(神经科学系) Division of Psychiatry(精神病学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过量化参与者内部叙事的大语言模型表示及其子空间,研究了叙事与情感状态之间的关系,发现特定症状的描述性思维能够预测标准化的抑郁评分,并强调保持症状间的协方差对构建效度至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27617 2026-07-31 cs.AI 新提交 74%

Hidden APIs in Language Models: Discovering Reusable Causal Interfaces from Forked Futures

语言模型中的隐藏API:从分叉未来中发现可复用的因果接口

SiYuan Ma, Yiqin Luo, Zhangji, Canran Xiao, Albert Gao, Wei-Hsing Huang, Wei Wang, Qiwei Wu, Xinran Li, Jinfeng Wei, Qixin Zhang

机构 * Nanyang Technological University(南洋理工大学) Southern University of Science and Technology(南方科技大学) Tianjin University(天津大学) Sun Yat-sen University(中山大学) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院) The Hong Kong Polytechnic University(香港理工大学) Shenzhen University(深圳大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :language model(title);分类 cs.AI

AI总结 本研究从分叉未来采样后续操作以比较语言模型隐藏状态,发现共享接口在多模型评估中表现最优,支持测试操作库中存在可复用因果接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27308 2026-07-31 cs.LG q-bio.NC 新提交 74%

ZUNA1.1: A more flexible EEG foundation model for Denoising and Super-resolution

ZUNA1.1:一种更灵活的用于去噪和超分辨率的脑电图(EEG)基础模型

Christopher Warner, Jonas Mago, JR Huml, Beren Millidge

机构 * Zyphra

专题命中 其他LLM :foundation model(title);分类 cs.LG

AI总结 研究推出3.8亿参数的EEG基础模型ZUNA1.1,其灵活性远超原模型ZUNA1,在EEG去噪与重建任务中性能达标且显著优于MNE包的球形样条插值,已以Apache 2.0许可开源发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27529 2026-07-31 cs.LG 新提交 70%

Latent-Kernel Discrete Flow Maps for Few-Step Generation

用于少步生成的隐核离散流图

Mansoor Ahmed, Yue-Tsz Fan, Hemanth Venkateswara, Murray Patterson

专题命中 其他LLM :language model(abstract,abstract_cn);分类 cs.LG

AI总结 提出隐核离散流图(LKF)模型,通过共享隐变量绑定分解组件实现少步生成,在两个文本基准上较似然基线提升困惑度2.1-3.3倍,M=8时优于现有少步采样器

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28576 2026-07-31 cs.CL cs.AI cs.LG 新提交 67%

Sample More, Reflect Less: Self-Refine and Reflexion Lose to Repeated Sampling at Equal Token Cost, from 1.5B to 7B

更多采样,更少反思:在相同 token 成本下,自改进(Self-Refine)和反思(Reflexion)不敌重复采样,模型规模从 15 亿到 70 亿参数

Iliya Mirzaei

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究发现,在相同 token 成本下,自改进、反思等含自我检查的语言模型方法均不敌重复采样,且模型规模增长会使自我检查方法的性能优势减弱,70 亿参数模型上的改写方法仍显著弱于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28550 2026-07-31 cs.CY 新提交 67%

Correcting Mode Collapse in Silicon Sampling with Semantic Similarity Rating

用语义相似度评分修正硅采样中的模式崩溃问题

Oscar Heath, Rohan Alexander

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究针对硅采样中LLMs生成回复的模式崩溃问题,提出语义相似度评分法,通过文本嵌入将LLMs生成的文本回复映射为数值尺度,提升了回复分布保真度且校准参数少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28285 2026-07-31 cs.CV 新提交 67%

Beyond Visual Ambiguity: Guiding Robust Monocular Depth Estimation in Challenging Scenarios via Detailed Long Captions

超越视觉歧义:通过详细长文本引导具有挑战性场景下的鲁棒单目深度估计

Junrui Zhang, Jiaqi Li, Yiran Wang, Liao Shen, Zhiguo Cao

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院)

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 该研究针对单目深度估计的视觉歧义问题,提出CapDepth框架,通过详细长文本引导,在非朗伯表面和恶劣天气下的深度误差较现有最优方法分别降低25.0%和22.0%。

Comments Accepted to ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27275 2026-07-31 cs.CR 版本更新 67%

Prevalence of Security and Privacy Risk-Inducing Usage of AI-based Conversational Agents

基于人工智能的对话式代理的安全与隐私风险诱导使用的普遍性

Kathrin Grosse, Nico Ebert

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究调查3270名英国成年人发现,三分之一每周使用ChatGPT等CA,三分之一常规用户有攻击相关行为,四分之一尝试越狱,多数人不知数据可用于模型训练,建议CA配备AI护栏并提升数据使用透明度。

Comments 10 pages, 3 figures, 5 tables, accepted at IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18866 2026-07-31 econ.EM cs.LG stat.ML 版本更新 57%

Optimizing Regret

优化遗憾值

Irene Aldridge

专题命中 其他LLM :LLM(abstract);分类 cs.LG

AI总结 本文基于成本与决策协方差发展协方差遗憾泛函导数理论,推导线性策略梯度,扩展到约束优化等,得出通用最速下降方向,还给出收敛界及算法,应用于投资组合倾斜与大语言模型分配策略。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28352 2026-07-31 physics.ed-ph 新提交 50%

Studying Circular Motion with an AI-Generated Smartphone Physics Lab

用AI生成的智能手机物理实验室研究圆周运动

Josep Ll. Suñer, Francisco M. Muñoz-Pérez, Juan C. Castro-Palacio, Juan A. Monsoriu, Martín Monteiro, Cecilia Stari, Arturo C. Martí

专题命中 其他LLM :prompting(abstract)

AI总结 本文通过向AI助手自然语言提示生成无代码定制化浏览器转动实验室,结合旋转平台研究两种圆周运动,并用Tracker视频分析验证测量结果。

详情

展开后加载摘要…

URL PDF HTML 收藏