arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5878 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5878 篇

2607.23364 2026-07-28 cs.LG 新提交 57%

On the Impossibility of Unbiased and Length-Invariant Policy Optimization with Outcome Rewards

关于使用结果奖励进行无偏且长度不变的策略优化的不可能性

Fei Ding, Yongkang Zhang, Yuhao Liao, Zijian Zeng, Huiming Yang

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 研究在标准结果奖励+GRPO设置下,无基于长度的加权方案能同时兼具梯度无偏性与长度不变性。通过参数族刻画权衡谱,揭示GRPO和Dr. GRPO各有优劣,处于不可避免的权衡两端,都非完美。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22692 2026-07-28 cs.AI 新提交 57%

Risk Governance for Generative AI Mental Health Support: A Multi-Turn Safety Architecture

生成式人工智能心理健康支持的风险治理:一种多轮安全架构

Anabela C. Areias, Catarina Botelho, António Farinhas, Areti Vassilopoulos, Dora Janela, Xin Tong, Nuno M. Guerreiro, Maya D'Eon, Fabíola Costa, Ricardo Rei

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对大语言模型用于心理健康支持时缺乏风险治理机制的问题,开发了一种多轮安全架构,结合多种方法用于心理健康交互,经测试在多方面表现良好,能改善模型管理风险方式,提供安全部署框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22662 2026-07-28 cs.AI 新提交 57%

CuraWeb: Joint Optimization of Quality, Redundancy, and Diversity for Web-Scale Pretraining Data

CuraWeb:网络规模预训练数据的质量、冗余性和多样性联合优化

Peiguang Li, Yongwei Zhou, Juncheng Diao, Yuchun Fan, Jian Yang, Jianxiao Yang, Zhongda Su, Shuguang Jiao, Xiao Wei, Zhiye Zou, Gan Dong, Zhizhao Zeng, Rongxiang Weng, Jingang Wang, Xunliang Cai

机构 * Meituan(美团)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对开放网络语料库预训练数据优化的局限性,提出质量、冗余性和多样性联合优化范式,结合双轨清理与混合去重,构建CuraWeb语料库,实验证明其在多基准测试中性能显著优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22652 2026-07-28 cs.AI 新提交 57%

KG2Code: Bridging Knowledge Graphs and Large Language Models via Executable Code for Question Answering

KG2Code:通过可执行代码连接知识图谱与大语言模型以进行问答

Yike Wu, Nan Hu, Guilin Qi, Guohui Xiao, Chen Jiang, Xinchun Zou, Yuchen Lu, Songlin Zhai, Yongrui Chen, Yuyang Zhang, Xiaoguang Li, Lifeng Shang, Jiaoyan Chen, Jeff Z. Pan

机构 * Southeast University(东南大学) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(教育部新一代人工智能技术及其交叉应用重点实验室(东南大学)) Huawei Technologies(华为技术有限公司) University of Manchester(曼彻斯特大学) University of Edinburgh(爱丁堡大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对知识图谱问答中现有方法的局限,提出KG2Code方法,将知识图谱转换为代码表示,在此基础上构建KG2Code-QA框架,把KGQA作为代码生成任务,还构建代码语料库,训练后的模型在KGQA任务中表现优异且泛化性强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15845 2026-07-28 cs.AI 版本更新 57%

Knowledge-Centric Agents for Workflow Generation in ComfyUI

用于工作流生成的以知识为中心的智能体

Zhendong Li, Lei Sun, Ruibo Ming, He Zhang, Danda Pani Paudel, Luc Van Gool, Jinjin Gu

机构 * INSAIT(未知机构) Sofia University “St. Kliment Ohridski”(索非亚大学“圣克莱门特·奥赫里德斯基”分校) Adobe Research(Adobe研究院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究视觉创作系统中工作流生成问题,提出以知识为中心的框架,通过知识反转、注入和可逆推理进行工作流生成,实验证明该方法生成的工作流在多样性、结构连贯性和执行成功率上优于现有系统。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11586 2026-07-28 cs.CL cs.CY 57%

Survey Response Generation: Generating Closed-Ended Survey Responses In-Silico with Large Language Models

调查回应生成:利用大语言模型生成闭合式调查回应

Georg Ahnert, Anna-Carolina Haensch, Barbara Plank, Markus Strohmaier

机构 * University of Mannheim(曼海姆大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Maryland, College Park(马里兰大学学院公园分校) GESIS Cologne(科隆社会研究所) CSH Vienna(维也纳认知科学研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文研究了不同调查回应生成方法对模拟调查回应的影响,发现受限生成方法效果最佳,推理输出不总能提升对齐度。

Journal ref ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09907 2026-07-28 cs.HC cs.AI cs.CY 版本更新 57%

How College Students Use AI to Navigate Course Readings: Evidence from an Eight-Week Study

具有AI支持的自主阅读:一项为期八周的学生研究

Yue Fu, Joel Wester, Niels Van Berkel, Alexis Hiniker

机构 * University of Washington(华盛顿大学) University of Copenhagen(哥本哈根大学) Aalborg University(奥胡斯大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究探讨了AI支持下学生自主阅读的认知过程,发现学生在阅读中表现出从理解到推理的认知发展,但受效率驱动,倾向于使用AI生成摘要来筛选阅读内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01232 2026-07-28 cs.DB cs.AI 版本更新 57%

Retrieval-Augmented Generation of Ontologies from Relational Databases

从关系数据库中检索增强生成本体

Nadeen Fathallah, Mojtaba Nayyeri, Athish A Yogi, Ratan Bahadur Thapa, Hans-Michael Tautenhahn, Anton Schnurpel, Steffen Staab

机构 * Institute for Artificial Intelligence, University of Stuttgart(人工智能研究所,斯图加特大学) University of Southampton(南安普顿大学) Universitätsklinikum Leipzig(莱比锡大学医院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究从关系数据库生成语义丰富的OWL2DL本体的问题,提出RIGOR方法,通过大语言模型驱动,从多源检索并迭代生成本体片段,经验证和纠正后集成,实验表明该方法优于基线且无需人工监督。

Comments Accepted in ISWC26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21616 2026-07-27 cs.AI 新提交 57%

Lost in Context: Addressing Context Anxiety in Large Language Models

迷失在上下文中:解决大语言模型中的上下文焦虑

Ifueko Igbinedion, Jillian Ross, Etienne Ricardez, Sertac Karaman, Eric So

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究大语言模型中因过早自我怀疑导致的上下文焦虑,通过系统研究发现其部分源于对完成任务所需tokens估计不准,会致效率损失,还表明模型可学替代策略,性能提升或可通过提高评估与适应自身局限能力实现。

Comments Accepted at ICML 2026. 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21603 2026-07-27 cs.HC cs.AI 新提交 57%

Analyzing Middle School Students' Dialogue and Behaviors during Collaborative AI Chatbot Development Using Ordered Network Analysis

使用有序网络分析来分析中学生在协作式人工智能聊天机器人开发过程中的对话和行为

Shan Zhang, Andres Felipe Zambrano, Xiaoyi Tian, Yukyeong Song, Anthony F. Botelho, Kristy Elizabeth Boyer, Maya Israel, Shiyan Jiang

机构 * University of Florida(佛罗里达大学) University of Pennsylvania(宾夕法尼亚大学) North Carolina State University(北卡罗来纳州立大学) The University of Tennessee(田纳西大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 该研究以有序网络分析方法,考察中学生协作开发AI聊天机器人的互动,刻画协作随时间的组织及互动模式与机器人质量、AI知识成果的关系,揭示高质量机器人与特定序列及互动模式有关,为协作式AI开发提供过程描述并拓展了相关研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09731 2026-07-24 cs.LG 版本更新 57%

Tight Sample Complexity of Transformers

Transformer的紧样本复杂度

Chenxiao Yang, Nathan Srebro, Zhiyuan Li

机构 * Toyota Technological Institute at Chicago(丰田技术研究所芝加哥分校)

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.LG

AI总结 本文刻画了深度L、总参数W的Transformer的VC维,并建立了思维链学习的样本复杂度上下界,揭示了参数与序列长度对学习所需样本量的影响。

Comments in COLT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01885 2026-07-24 cs.CL 版本更新 57%

Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents

代理记忆:为大语言模型代理学习统一的长期和短期记忆管理

Yi Yu, Liuyi Yao, Yuexiang Xie, Qingquan Tan, Jiaqi Feng, Yaliang Li, Libing Wu

机构 * School of Cyber Science and Engineering, Wuhan University(武汉大学计算机科学与工程学院) Alibaba Group(阿里巴巴集团)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出Agentic Memory框架,统一管理大语言模型的长期和短期记忆,通过分步GRPO和三阶段强化学习提升记忆效率与任务表现。

Comments ACL'26 SAC Highlight. The code is available at https://github.com/y1y5/AgeMem

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19699 2026-07-23 cs.CY cs.AI 新提交 57%

Did Alice Do Wrong? Cross-Cultural Differences in Student Perceptions of Generative AI Use in University Computing Education

爱丽丝做错了吗?大学计算机教育中生成式人工智能使用的学生认知的跨文化差异

Brian Harrington, Irina Zlotnikova, Gayathri Nadarajan, Samuel Ekundayo

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究加拿大和韩国大学生对生成式人工智能使用认知的跨文化差异,通过基于场景的调查分析学生对其道德性和规则遵守的判断,发现文化因素影响学生道德推理,强调教育中人工智能整合需文化响应,要制定细致指南并持续跨文化研究。

Journal ref ACM Transactions on Computing Education, Volume 26, Issue 1, Article No.: 15, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19595 2026-07-23 cs.CR cs.CL 新提交 57%

Twin Agent: Context Residual Compression for Privilege Separated Agents

孪生智能体:用于特权分离智能体的上下文残差压缩

Zhanhao Hu, Dennis Jacob, Xiao Huang, Zhaorun Chen, Bo Li, David Wagner

机构 * University of California, Berkeley(加州大学伯克利分校) University of Chicago(芝加哥大学) University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 针对大语言模型智能体易受安全风险问题,提出孪生智能体模式,由探索和安全智能体组成,通过探索智能体传递紧凑提示,减少信息需求,在保持高任务效用的同时防止提示注入攻击,优于其他基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09988 2026-07-23 cs.IR cs.AI 版本更新 57%

An LLM-powered Agentic Recommendation System for Connected TV Content Discovery

一种用于智能电视内容发现的由大语言模型驱动的智能推荐系统

Lei Shi, Di Wang, Harry Tran, Helsing Xu, Yuchen Lu, Dhara Ghodasara, Wilson Chaney, Xueting Liao, Jerry Yu, Huayu Ding, Reza Mirghaderi, David Fan, Qi Guo, Chongguang He, Warren Wang, Warren Deng, Mingze Gao, Shike Mei, Shuo Tang, Zhe Zhang, Jianming He, Abhishek Kumar, Haotian Wu, Hamed Firooz, Li Li

机构 * Meta

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 针对推荐系统整合上下文信号的挑战,提出用于智能电视内容发现的大语言模型驱动的智能推荐系统,利用其推理能力处理多样信号,采用智能架构协调组件,克服大语言模型用于推荐的实际限制。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20170 2026-07-23 cs.CL 版本更新 57%

KoRe: Compact Knowledge Representations for Large Language Models

KoRe: 为大型语言模型设计的紧凑知识表示

Davide Cavicchini, Fausto Giunchiglia, Jacopo Staiano

机构 * University of Trento(特伦托大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出KoRe方法,通过将知识图谱的1跳子图编码为紧凑离散知识标记,并注入到LLM中,从而提升模型的知识推理能力并减少token使用量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20050 2026-07-23 econ.GN cs.AI cs.GT q-fin.EC 版本更新 57%

Information Aggregation with AI Agents

利用AI代理的信息聚合

Spyros Galanis

机构 * Department of Economics, University of Durham(杜伦大学经济学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究通过交易和观察价格波动,探讨大型语言模型能否聚合分散的私人信息,发现信息聚合在信息结构复杂时显著下降,且更智能的AI代理在聚合和盈利方面表现更好。

Comments 62 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18850 2026-07-22 cs.CV cs.AI 新提交 57%

OPD-IAD: From Language Judgment to Industrial Anomaly Detection via On-Policy Self-Distillation

OPD-IAD:通过策略内自蒸馏从语言判断到工业异常检测

Shuimu Chen, Jing Jin, Nan Su, Hongbo Xu, Zebang Cheng, Wenming Yang, Fei Ma, Guijin Wang

机构 * Tsinghua University(清华大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) Shenzhen University(深圳大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究如何利用大型视觉语言模型进行工业异常检测,提出OPD-IAD框架,通过策略内自蒸馏和语言引导视觉锚定,将语言判断转化为像素级异常图,在相关方法中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18302 2026-07-22 cs.LG 新提交 57%

A Better Start for Language Models: Domain-Conditional Position Offsets

语言模型的更好开端:领域条件位置偏移

Ye Qiao

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 研究针对自回归语言模型序列开头冷启动惩罚问题,提出领域条件位置偏移方法,通过添加单个学习向量减少困惑度,在多模型上效果显著,且具有轻量级、可热切换特点,能改善检索重排等,是短域内评分和校准的有效工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18874 2026-07-22 cs.AI 版本更新 57%

Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness

通过研究框架将AI科学家的研究综合与验证外部化

Zijian Wang, Hanqi Li, Ziyue Yang, Zijian Hu, Shenghan Zuo, Yunzhe Zhang, Da Ma, Danyu Luo, Chenrun Wang, Jing Peng, Tiancheng Huang, Sijia Guo, Huayang Wang, Zichen Zhu, Senyu Han, Yilu Cao, Bo Chen, Xin Chen, Kai Yu, Lu Chen

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机学院X-LANCE实验室) Jiangsu Key Lab of Language Computing, Suzhou, China(江苏省语言计算重点实验室) Suzhou Laboratory, Suzhou, China(苏州实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Xcientist框架,将研究综合与实验验证外部化为可检查的合同驱动过程,解决自动研究中的声明漂移问题,并在多个领域验证其有效性。

Comments 66 pages, 15 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27039 2026-07-22 cs.CL 版本更新 57%

Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling

长度值模型:用于令牌级长度建模的可扩展值预训练

Zhen Zhang, Changyi Yang, Zijie Xia, Zhen Yang, Chengzhi Liu, Zhaotiao Weng, Yepeng Liu, Haobo Chen, Jin Pan, Chenyang Zhao, Yuheng Bu, Alkesh Patel, Zhe Gan, Xin Eric Wang

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校) Carnegie Mellon University(卡内基梅隆大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) LMSYS Org(LMSYS组织) Apple Inc.(苹果公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出Length Value Model,通过令牌级建模实现高效的长度预测,提升生成长度的准确性和效率,实验显示其在多个任务中优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04818 2026-07-22 cs.AI 版本更新 57%

LLM-Grounded Explainable AI for Supply Chain Risk Early Warning via Temporal Graph Attention Networks

基于时间图注意力网络的LLM解释性AI用于供应链风险早期预警

Zhiming Xue, Yujue Wang, Menghao Huo

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于时间图注意力网络和大语言模型的框架,用于可解释的供应链风险早期预警,通过结合证据导向的方法提升预测准确性与解释可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01515 2026-07-22 cs.RO cs.LG 版本更新 57%

RAPT: Model-Predictive Out-of-Distribution Detection and Failure Diagnosis for Sim-to-Real Humanoid Deployment

RAPT:面向真实人类机器人的模型预测异常检测与故障诊断

Humphrey Munn, Brendan Tidd, Peter Bohm, Marcus Gallagher, David Howard

机构 * School of Electrical Engineering and Computer Science, University of Queensland(电气工程与计算机科学学院,昆士兰大学) CSIRO Robotics, Data61(CSIRO机器人,Data61)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 RAPT通过模型预测异常检测和故障诊断技术,提升人形机器人在仿真到现实转移中的鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21378 2026-07-22 cs.RO cs.AI 版本更新 57%

RoboInspector: Unveiling the Unreliability of Policy Code for LLM-enabled Robotic Manipulation

RoboInspector:揭示用于基于大语言模型的机器人操作的策略代码的不可靠性

Chenduo Ying, Linkang Du, Peng Cheng, Yuanchao Shu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究基于大语言模型的机器人操作中策略代码不可靠问题,设计RoboInspector从任务复杂性和指令粒度揭示其不可靠性,通过实验识别四种不可靠行为及原因,还引入优化方法,可提高策略代码生成可靠性达35%。

Comments Accepted to ACM Transactions on Intelligent Systems and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17147 2026-07-21 cs.CR cs.CL 新提交 57%

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

SlotGuard:阻止大语言模型代理转录中过度共享私有本地上下文

Haocheng Xia, Yongjoo Park

机构 * Siebel School of Computing(计算机科学系) Data Science, University of Illinois Urbana-Champaign(数据科学,伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究大语言模型代理转录本隐私泄露问题,提出SlotGuard方法,通过重写结构绑定、替换机密值、链接跨轮引用等操作隐藏敏感数据,在保持代理性能的同时大幅降低凭证泄漏率。

Comments ICML 2026 AIWILD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16325 2026-07-21 cs.CV cs.LG 新提交 57%

RegionFM: Interpretable Region-Based Brain MRI Classification Using Foundation Model Embeddings

RegionFM:使用基础模型嵌入进行可解释的基于区域的脑MRI分类

Wei Zhang

机构 * L3S Research Center(L3S研究中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 研究针对脑MRI基础模型预测难解释问题,提出RegionFM框架,将解剖分割与基础模型嵌入结合,通过划分区域、编码嵌入及构建模型组合,用于认知障碍分类评估,在保持性能同时使解释与临床推理更好对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16303 2026-07-21 cs.CV cs.AI 新提交 57%

Med-OPD: Improving Medical Vision-Language Models via Evidence-Aware On-Policy Distillation

Med-OPD:通过证据感知策略蒸馏改进医学视觉语言模型

Yunhang Qian, Jiaquan Yu, Jiawei Liu, Meng Wang, Hongwei Bran Li, Xiaobin Hu

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对医学视觉语言模型依赖语言先验而非视觉证据推理的问题,提出Med-OPD框架,引入医学证据优势信号,在令牌和轨迹级别重新分配蒸馏信号,实验证明该方法能加强模型对关键视觉证据的依赖,提升多模态医学推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16072 2026-07-20 cs.CL 新提交 57%

Frontier Language Models Struggle to Copy: Text Can Be Better Viewed in 2D

前沿语言模型在复制方面存在困难:文本可在二维视角下得到更好理解

Haodong Wen, Yiran Zhang, Yingfa Chen, Kaifeng Lyu

机构 * Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究发现前沿语言模型复制输入字符串存在困难,归因于Transformer架构位置编码问题。为此引入2D-RoPE,将文本组织成二维网格,使复制任务更易学习。实验表明其在复制任务上优势明显,有助于语言建模,鼓励探索二维位置编码潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15942 2026-07-20 cs.CV cs.LG 新提交 57%

More with Less: a Large Scale Remote Sensing VLM with a Simple Recipe

以少胜多:一种简单方法构建的大规模遥感视觉语言模型

Stefan Maria Ailuro, Mario Markov, Mohammad Mahdi, Luc Van Gool, Danda Pani Paudel

机构 * INSAIT, Sofia University “St. Kliment Ohridski”(索非亚大学“圣克莱门特·奥赫里德斯基”信息与自动化研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 研究针对遥感视觉语言模型,质疑架构专业化必要性,提出通用模型经大规模跨数据和任务训练可获好性能。核心方法是用单一语言策略及多任务强化学习框架训练。主要贡献是在多基准测试中取得竞争力结果,证明数据规模更关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10931 2026-07-20 cs.CL 版本更新 57%

It Takes One to Bias Them All: Breaking Bad with One-Shot GRPO

一个样本就能带偏所有:单次GRPO打破对齐

Naihao Deng, Yilun Zhu, Naichen Shi, Clayton Scott, Rada Mihalcea

机构 * University of Michigan(密歇根大学) Northwestern University(西北大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究发现,仅用单个有偏样本进行一步GRPO训练就能诱导大语言模型产生系统性偏见,且刻板印象推理泛化到多种属性、类别和基准测试,揭示了对齐机制的关键脆弱性。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏