arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-24 至 2025-11-24 共收录 115 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 8 篇

2511.17300 2025-11-24 cs.CV 87%

MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement Learning

MolSight: 基于SMILES预训练、多粒度学习和强化学习的光学化学结构识别

Wenrui Zhang, Xinggang Wang, Bin Feng, Wenyu Liu

专题命中 预训练与数据 :pretraining(title);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 MolSight通过SMILES预训练、多粒度学习和强化学习,实现高精度的立体化学结构识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16549 2025-11-24 cs.CL 85%

ReviewGuard: Enhancing Deficient Peer Review Detection via LLM-Driven Data Augmentation

ReviewGuard: 通过LLM驱动的数据增强提升缺陷同行评审检测

Haoxuan Zhang, Ruochi Li, Sarthak Shrestha, Shree Harshini Mamidala, Revanth Putta, Arka Krishan Aggarwal, Ting Xiao, Junhua Ding, Haihua Chen

机构 * University of North Texas(北卡罗来纳州立大学) North Carolina State University(北卡罗来纳州立大学)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ReviewGuard通过LLM驱动的数据增强技术,首次提出检测同行评审中缺陷评审的系统,提升检测性能并为AI治理提供依据。

Comments Accepted as a full paper at the 2025 ACM/IEEE Joint Conference on Digital Libraries (JCDL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15311 2025-11-24 cs.CV 78%

Adapt-As-You-Walk Through the Clouds: Training-Free Online Test-Time Adaptation of 3D Vision-Language Foundation Models

在云中适应:无需训练的在线测试时适应3D视觉-语言基础模型

Mehran Tamjidi, Hamidreza Dastmalchi, Mohammadreza Alimoradijazi, Ali Cheraghian, Aijun An, Morteza Saberi

专题命中 预训练与数据 :foundation model(title,abstract)

AI总结 Uni-Adapter通过动态原型学习和熵加权聚合,在无需重新训练的情况下提升3D VLFMs在不同基准测试中的性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17161 2025-11-24 cs.CL cs.AI 73%

The PLLuM Instruction Corpus

PLLuM指令语料库

Piotr Pęzik, Filip Żarnecki, Konrad Kaczyński, Anna Cichosz, Zuzanna Deckert, Monika Garnys, Izabela Grabarczyk, Wojciech Janowski, Sylwia Karasińska, Aleksandra Kujawiak, Piotr Misztela, Maria Szymańska, Karolina Walkusz, Igor Siek, Maciej Chrabąszcz, Anna Kołos, Agnieszka Karlińska, Karolina Seweryn, Aleksandra Krasnodębska, Paula Betscher, Zofia Cieślińska, Katarzyna Kowol, Artur Wilczek, Maciej Trzciński, Katarzyna Dziewulska, Roman Roszko, Tomasz Bernaś, Jurgita Vaičenonienė, Danuta Roszko, Paweł Levchuk, Paweł Kowalski, Irena Prawdzic-Jankowska, Marek Kozłowski, Sławomir Dadas, Rafał Poświata, Alina Wróblewska, Katarzyna Krasnowska-Kieraś, Maciej Ogrodniczuk, Michał Rudolf, Piotr Rybak, Karolina Saputa, Joanna Wołoszyn, Marcin Oleksy, Bartłomiej Koptyra, Teddy Ferdinan, Stanisław Woźniak, Maciej Piasecki, Paweł Walkowiak, Konrad Wojtasik, Arkadiusz Janz, Przemysław Kazienko, Julia Moska, Jan Kocoń

机构 * University of Lodz(卢兹大学) NASK National Research Institute(国家研究 institute) Institute of Slavic Studies PAS(波兰科学院斯拉夫研究所) National Information Processing Institute(国家信息处理研究所) Institute of Computer Science PAS(波兰科学院计算机科学研究所) Wroclaw Tech(沃拉日县技术大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PLLuM项目构建了首个指令语料库,用于微调大语言模型,分析人工与合成指令数据对语言适应的影响,并发布首个代表性子集供其他模型开发参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17256 2025-11-24 cs.CY cs.CL 70%

Cross-cultural value alignment frameworks for responsible AI governance: Evidence from China-West comparative analysis

跨文化价值观对齐框架用于负责任的AI治理:来自中西方比较分析的证据

Haijiang Liu, Jinguang Gu, Xun Wu, Daniel Hershcovich, Qiaoling Xiao

机构 * Wuhan University of Science and Technology(武汉理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Copenhagen(哥本哈根大学) WUST-Madrid Complutense Institute(武汉理工大学-马德里康普顿斯研究所)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出多层审计平台,评估中西方LLM跨文化价值观对齐,发现中国模型在多语言优化上更优,而西方模型存在美国偏见,Mistral系列在跨文化对齐上表现突出。

Comments Presented on Academic Conference "Technology for Good: Driving Social Impact" (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16567 2025-11-24 cs.CV 67%

POMA-3D: The Point Map Way to 3D Scene Understanding

POMA-3D:点地图方式的3D场景理解

Ye Mao, Weixun Luo, Ranran Huang, Junpeng Jing, Krystian Mikolajczyk

机构 * Imperial College London(伦敦帝国学院)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

AI总结 POMA-3D通过点地图实现3D场景理解,结合自监督学习和多视角对齐策略,提升3D任务表现。

Comments 11 pages, 6 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16912 2025-11-24 cs.LG cs.AI 62%

PepEVOLVE: Position-Aware Dynamic Peptide Optimization via Group-Relative Advantage

PepEVOLVE: 通过组相对优势实现位置感知的动态肽优化

Trieu Nguyen, Hao-Wei Pang, Shasha Feng

机构 * Merck & Co., Inc.(默克公司) University of South Florida(佛罗里达州立大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 PepEVOLVE通过位置感知和动态优化方法,实现多目标肽优化,优于PepINVENT。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16951 2025-11-24 cs.CV 50%

FingerCap: Fine-grained Finger-level Hand Motion Captioning

FingerCap:细粒度指尖级手部动作描述

Xin Shen, Rui Zhu, Lei Shen, Xinyu Wang, Kaihao Zhang, Tianqing Zhu, Shuchen Wu, Chenxi Miao, Weikang Li, Yang Li, Deguo Xia, Jizhou Huang, Xin Yu

机构 * Baidu Inc.(百度公司) The University of Queensland(昆士兰大学) Nanjing University(南京大学) Institute of Computing Technology, CAS(中国科学院计算技术研究所) Peking University(北京大学) Australian National University(澳大利亚国立大学) City University of Macau(澳门城市大学)

专题命中 预训练与数据 :LLM(abstract)

AI总结 FingerCap通过FiGOP技术提升细粒度手部动作描述的准确性,解决视频大语言模型在指尖运动识别中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 7 篇

2511.17053 2025-11-24 cs.CV cs.AI 83%

OmniPT: Unleashing the Potential of Large Vision Language Models for Pedestrian Tracking and Understanding

OmniPT:释放大型视觉语言模型在行人跟踪与理解中的潜力

Teng Fu, Mengyang Zhao, Ke Niu, Kaixin Peng, Bin Li

专题命中 指令微调 :language model(title);foundation model(abstract);SFT(abstract);分类 cs.AI

AI总结 OmniPT 通过结合强化学习和微调方法,提升大型视觉语言模型在行人跟踪和语义理解中的性能。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16709 2025-11-24 cs.CR cs.AI 83%

AutoBackdoor: Automating Backdoor Attacks via LLM Agents

AutoBackdoor: 通过LLM代理自动化后门攻击

Yige Li, Zhe Li, Wei Zhao, Nay Myat Min, Hanxun Huang, Xingjun Ma, Jun Sun

机构 * Singapore Management University(新加坡管理大学) The University of Melbourne(墨尔本大学) Fudan University(复旦大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AutoBackdoor通过LLM代理自动化后门攻击,实现高效触发器生成和毒化数据构建,验证了对抗防御的脆弱性。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27629 2025-11-24 cs.CR cs.AI 79%

Best Practices for Biorisk Evaluations on Open-Weight Bio-Foundation Models

开放权重生物基础模型的生物风险评估最佳实践

Boyi Wei, Zora Che, Nathaniel Li, Udari Madhushani Sehwag, Jasper Götting, Samira Nedungadi, Julian Michael, Summer Yue, Dan Hendrycks, Peter Henderson, Zifan Wang, Seth Donoughe, Mantas Mazeika

机构 * Scale AI SecureBio Center for AI Safety(AI安全中心) Princeton University(普林斯顿大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI

AI总结 本文提出BioRiskEval框架,用于评估开放权重生物基础模型的鲁棒性,揭示现有数据过滤方法的局限性,并强调需进一步研究安全策略。

Comments 17 Pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17255 2025-11-24 cs.CV cs.IR 78%

A Little More Like This: Text-to-Image Retrieval with Vision-Language Models Using Relevance Feedback

略多一些像这个:利用视觉语言模型进行文本到图像检索的相关反馈

Bulat Khaertdinov, Mirela Popa, Nava Tintarev

机构 * Maastricht University(马斯特里赫特大学)

专题命中 指令微调 :language model(title,abstract)

AI总结 本文提出基于相关反馈机制提升视觉语言模型文本到图像检索性能的方法,通过四种反馈策略在Flickr30k和COCO数据集上验证,提升了检索效果并增强了多轮检索的鲁棒性。

Comments Accepted to WACV'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09439 2025-11-24 eess.AS cs.SD 78%

Omni-R1: Do You Really Need Audio to Fine-Tune Your Audio LLM?

Omni-R1:你真的需要音频来微调你的音频大语言模型吗?

Andrew Rouditchenko, Saurabhchand Bhati, Edson Araujo, Samuel Thomas, Hilde Kuehne, Rogerio Feris, James Glass

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Goethe University of Frankfurt(法兰克福歌德大学) IBM Research AI(IBM人工智能研究部) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) Tuebingen AI Center/University of Tuebingen(图宾根人工智能中心/图宾根大学)

专题命中 指令微调 :LLM(title,abstract)

AI总结 Omni-R1通过强化学习方法GRPO微调多模态大语言模型,实现了在音频问答任务上的新SOTA性能,同时发现文本推理能力提升对音频性能有显著贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16991 2025-11-24 cs.LG 57%

TRACE: Time SeRies PArameter EffiCient FinE-tuning

TRACE: 时间序列参数高效微调

Yuze Li, Wei Zhu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) School of Science, University of Hong Kong(香港大学科学学院)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 TRACE提出了一种时间序列参数高效微调方法,通过门控DSIC和重构预测头提升长期预测性能,适用于多种时间序列任务。

Journal ref Neurocomputing, Volume 320, 2025, Article 132098

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17199 2025-11-24 cs.CV 50%

VLA-4D: Embedding 4D Awareness into Vision-Language-Action Models for SpatioTemporally Coherent Robotic Manipulation

VLA-4D: 将4D意识嵌入视觉-语言-动作模型中以实现时空一致的机器人操作

Hanyu Zhou, Chuanhao Ma, Gim Hee Lee

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院)

专题命中 指令微调 :LLM(abstract)

AI总结 VLA-4D通过4D意识增强视觉-语言-动作模型,实现时空一致的机器人操作,提升动作执行的空间平滑性和时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 2 篇

2509.21651 2025-11-24 cs.AI 70%

Can AI Perceive Physical Danger and Intervene?

AI能否感知物理危险并干预?

Abhishek Jindal, Dmitry Kalashnikov, R. Alex Hofer, Oscar Chang, Divya Garikapati, Anirudha Majumdar, Pierre Sermanet, Vikas Sindhwani

机构 * Google DeepMind Robotics(谷歌深Mind机器人技术)

专题命中 后训练与偏好优化 :foundation model(abstract);post-training(abstract);分类 cs.AI

AI总结 本文提出了一种用于评估具身体验AI系统物理安全性的基准测试方法,通过生成逼真图像和视频来测试模型对安全风险的理解和干预能力,并开发了训练后范式以提升模型的安全推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05986 2025-11-24 cs.CL 70%

Fine-Grained Reward Optimization for Machine Translation using Error Severity Mappings

细粒度奖励优化用于机器翻译的误差严重性映射

Miguel Moura Ramos, Tomás Almeida, Daniel Vareta, Filipe Azevedo, Sweta Agrawal, Patrick Fernandes, André F. T. Martins

机构 * Instituto Superior Técnico, Universidade de Lisboa (ELLIS Unit Lisbon)(里斯本大学理工学院(ELLIS单位里斯本)) Instituto de Telecomunicações(电信研究所) Carnegie Mellon University(卡内基梅隆大学) TransPerfect Core contributor(TransPerfect核心贡献者)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出利用细粒度词级奖励和误差严重性映射优化,提升机器翻译质量与训练稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 6 篇

2511.17194 2025-11-24 cs.CR 89%

Steering in the Shadows: Causal Amplification for Activation Space Attacks in Large Language Models

在阴影中引导:大型语言模型中激活空间攻击的因果放大

Zhiyuan Xu, Stanislav Abaimov, Joseph Gardiner, Sana Belguith

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出通过因果放大效应,利用激活空间攻击实现对大型语言模型行为的可控引导,展示了其在安全性和有效性上的贡献。

Comments 31 pages, 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17335 2025-11-24 cs.RO cs.CL cs.CV cs.SD eess.AS 79%

Robot Confirmation Generation and Action Planning Using Long-context Q-Former Integrated with Multimodal LLM

基于长上下文Q-Former与多模态大语言模型的机器人确认生成与动作规划

Chiori Hori, Yoshiki Masuyama, Siddarth Jain, Radu Corcodel, Devesh Jha, Diego Romeres, Jonathan Le Roux

机构 * Mitsubishi Electric Research Laboratories (MERL), Cambridge, MA, USA(三菱电机研究实验室(MERL),马萨诸塞州剑桥市)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.CL

AI总结 本文提出基于长上下文Q-former与多模态大语言模型的机器人确认生成与动作规划方法,通过整合视频上下文信息提升动作规划性能。

Comments Accepted to ASRU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11393 2025-11-24 cs.SE cs.AI cs.CR cs.MA 79%

LLM-Agent-UMF: LLM-based Agent Unified Modeling Framework for Seamless Design of Multi Active/Passive Core-Agent Architectures

LLM-Agent-UMF: 基于大语言模型的代理统一建模框架,用于无缝设计多主动/被动核心代理架构

Amine Ben Hassouna, Hana Chaari, Ines Belhaj

机构 * Mediterranean Institute of Technology(地中海技术研究所) South Mediterranean University(南地中海大学) National School of Computer Science(国家计算机科学学校) University of Manouba(曼努巴大学)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.AI

AI总结 LLM-Agent-UMF提出了一种基于大语言模型的代理统一建模框架,用于设计多主动/被动核心代理架构,解决了现有架构的模块化和术语不一致问题。

Comments 39 pages, 19 figures, 3 tables. Published in Information Fusion, Volume 127, March 2026, 103865. Part of the special issue "Data Fusion Approaches in Data-Centric AI for Developing Trustworthy AI Systems"

Journal ref Information Fusion 127 (2026) 103865

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17190 2025-11-24 cs.CL cs.DB 77%

AutoLink: Autonomous Schema Exploration and Expansion for Scalable Schema Linking in Text-to-SQL at Scale

AutoLink:用于大规模文本到SQL的自主模式探索与扩展

Ziyang Wang, Yuanlei Zheng, Zhenbiao Cao, Xiaojin Zhang, Zhongyu Wei, Pei Fu, Zhenbo Luo, Wei Chen, Xiang Bai

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AutoLink通过自主代理框架实现大规模文本到SQL的模式探索与扩展,提升模式链接的召回率和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00737 2025-11-24 cs.HC cs.AI 70%

How LLMs are Shaping the Future of Virtual Reality

大型语言模型如何塑造虚拟现实的未来

Süeda Özkaya, Santiago Berrezueta-Guzman, Stefan Wagner

机构 * Technical University of Munich(慕尼黑技术大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了大型语言模型如何通过增强叙事生成、NPC互动和个性化来塑造虚拟现实的未来,并提出了多模态AI和伦理保障等未来研究方向。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14004 2025-11-24 cs.RO 50%

Searching in Space and Time: Unified Memory-Action Loops for Open-World Object Retrieval

在空间和时间中搜索:统一的记忆-动作循环用于开放世界物体检索

Taijing Chen, Sateesh Kumar, Junhong Xu, Georgios Pavlakos, Joydeep Biswas, Roberto Martín-Martín

机构 * Department of Computer Science, The University of Texas at Austin(计算机科学系,德克萨斯大学奥斯汀分校)

专题命中 长上下文与记忆 :language model(abstract)

AI总结 STAR框架通过统一记忆查询和具身动作,提升开放世界中时空物体检索的效率与准确性。

Comments https://amrl.cs.utexas.edu/STAR/

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 23 篇

2511.02894 2025-11-24 cs.LG cs.CR 90%

Adaptive and Robust Data Poisoning Detection and Sanitization in Wearable IoT Systems using Large Language Models

基于大语言模型的可适应和鲁棒数据污染检测与净化在可穿戴物联网系统中的应用

W. K. M Mithsara, Ning Yang, Ahmed Imteaj, Hussein Zangoti, Abdur R. Shahid

机构 * Southern Illinois University(辛辛那提大学) Florida Atlantic University(佛罗里达 Atlantic 大学) Jazan University(贾兹安大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出利用大语言模型进行可穿戴物联网系统中的数据污染检测与净化,通过角色扮演和逐步推理策略提升系统安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17052 2025-11-24 cs.CV 89%

PathAgent: Toward Interpretable Analysis of Whole-slide Pathology Images via Large Language Model-based Agentic Reasoning

PathAgent: 通过基于大型语言模型的代理推理实现全切片病理图像的可解释分析

Jingyun Chen, Linghan Cai, Zhikang Wang, Yi Huang, Songhan Jiang, Shenjin Huang, Hongpeng Wang, Yongbing Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Fudan University(复旦大学) Sichuan University(四川大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 PathAgent通过基于大型语言模型的代理推理,实现全切片病理图像的可解释分析,展现出强大的零样本泛化能力和临床应用潜力。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17027 2025-11-24 cs.SE 87%

ReVul-CoT: Towards Effective Software Vulnerability Assessment with Retrieval-Augmented Generation and Chain-of-Thought Prompting

ReVul-CoT:通过检索增强生成与链式推理提示实现有效的软件漏洞评估

Zhijie Chen, Xiang Chen, Ziming Li, Jiacheng Xue, Chaoyang Gao

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 ReVul-CoT通过整合检索增强生成与链式推理提示,提升软件漏洞评估的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16972 2025-11-24 cs.LG 85%

ToC: Tree-of-Claims Search with Multi-Agent Language Models

基于多智能体语言模型的树状主张搜索

Shuyang Yu, Jianan Liang, Hui Hu

机构 * AIGROW

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

AI总结 ToC通过结合多智能体系统和MCTS,提升专利主张优化的准确性和法律稳健性。

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16900 2025-11-24 eess.SY cs.SY 85%

When Motion Learns to Listen: Diffusion-Prior Lyapunov Actor-Critic Framework with LLM Guidance for Stable and Robust AUV Control in Underwater Tasks

当运动学会倾听:带有LLM引导的扩散先验Lyapunov动作-批评者框架用于水下任务中稳定和鲁棒的AUV控制

Jingzehua Xu, Weiyi Liu, Weihang Zhang, Zhuofan Xi, Guanwen Xie, Shuai Zhang, Yi Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种结合扩散模型、Lyapunov批评者和LLM的框架,用于提升水下机器人控制的稳定性与鲁棒性,通过生成-过滤-优化机制实现高效探索和多目标优化。

Comments This paper is currently under review and does not represent the final version. Jingzehua Xu, Weiyi Liu and Weihang Zhang are co-first authors of this paper, with Zhuofan Xi as the second author

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12396 2025-11-24 cs.IR 85%

LLM-CoT Enhanced Graph Neural Recommendation with Harmonized Group Policy Optimization

基于协同群体策略优化的LLM-CoT增强图神经推荐

Hailong Luo, Bin Wu, Hongyong Jia, Qingqing Zhu, Lianlei Shan

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LGHRec通过结合LLM的CoT推理能力与协同群体策略优化,提升图神经推荐系统的信息密度和对比学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17987 2025-11-24 cs.CR cs.AI cs.CV 83%

Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning

通过LLM推理进行文本到图像模型的劫持:Reason2Attack

Chenyu Zhang, Lanjun Wang, Yiwen Ma, Wenhui Li, An-An Liu

专题命中 推理与问题求解 :LLM(title,abstract);post-training(abstract);分类 cs.AI

AI总结 Reason2Attack通过将劫持攻击融入LLM后训练过程,提升生成对抗性提示的推理能力,实现更高效的文本到图像模型攻击

Comments Noted that This paper includes model-generated content that may contain offensive or distressing material

详情

展开后加载摘要…

URL PDF HTML 收藏