arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-01 至 2025-12-01 共收录 284 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 24 篇

2511.22135 2025-12-01 cs.CV 75%

EASL: Multi-Emotion Guided Semantic Disentanglement for Expressive Sign Language Generation

EASL: 多情绪引导的语义解耦用于表达性手语生成

Yanchao Zhao, Jihao Zhu, Yu Liu, Weizhuo Chen, Yuling Yang, Kun Peng

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Chinese Academy of Sciences(中国科学院大学) University of Health and Rehabilitation Sciences(康复科学大学) The University of Aberdeen(阿伯丁大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 EASL通过多情绪引导的语义解耦架构,提升手语生成的表达性和情感表现力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22777 2025-12-01 cs.RO cs.AI 70%

Improving Robotic Manipulation Robustness via NICE Scene Surgery

通过NICE场景手术提升机器人操作的鲁棒性

Sajjad Pakdamansavoji, Mozhgan Pourkeshavarz, Adam Sigal, Zhiyuan Li, Rui Heng Yang, Amir Rasouli

机构 * Huawei Technologies Canada(华为技术加拿大公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 NICE通过增强场景上下文减少分布外差距,提升机器人操作在复杂环境中的鲁棒性和安全性。

Comments 11 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14522 2025-12-01 cs.HC cs.AI 70%

Biased by Design: Leveraging AI Biases to Enhance Critical Thinking of News Readers

设计偏见:利用AI偏见增强新闻读者的批判性思维

Liudmila Zavolokina, Kilian Sprenkamp, Zoya Katashinskaya, Daniel Gordon Jones

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用AI偏见提升新闻读者批判性思维的设计策略,通过用户选择和个性化方法增强信息辨别能力。

Comments European Conference on Information Systems (ECIS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22341 2025-12-01 cs.CV cs.LG 70%

Unexplored flaws in multiple-choice VQA evaluations

多选式视觉问答评估中的未探索缺陷

Fabio Rosenthal, Sebastian Schmidt, Thorsten Graf, Thorsten Bagodonat, Stephan Günnemann, Leo Schwinn

机构 * Technical University of Munich(慕尼黑技术大学) Volkswagen AG(大众集团) Munich Data Science Institute(慕尼黑数据科学研究所)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文揭示了多选式视觉问答评估中因提示格式变化导致的未探索偏差,指出其对MLLM评估结果的显著影响,并表明现有缓解策略无法有效应对这些新发现的偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21802 2025-12-01 cs.GT cs.AI econ.GN q-fin.EC 70%

Tacit Bidder-Side Collusion: Artificial Intelligence in Dynamic Auctions

隐性投标方合谋:动态拍卖中的人工智能

Sriram Tolety

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了大型语言模型在动态拍卖中通过隐性协调实现投标方合谋的可能性,并展示了市场结构对缓解合谋的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22906 2025-12-01 cs.CV 67%

See, Rank, and Filter: Important Word-Aware Clip Filtering via Scene Understanding for Moment Retrieval and Highlight Detection

见、排、滤:通过场景理解的重要词感知Clip过滤用于片段检索和亮点检测

YuEun Lee, Jung Uk Kim

机构 * YuEun Lee, Jung Uk Kim

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出通过识别查询中的重要词,结合多模态大语言模型实现视频片段检索和亮点检测的细粒度过滤方法,提升检索和检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23057 2025-12-01 cs.CL cs.LG econ.GN q-fin.EC 62%

Standard Occupation Classifier -- A Natural Language Processing Approach

标准职业分类器——一种自然语言处理方法

Sidharth Rony, Jack Patman

机构 * Royal Holloway, University of London(伦敦大学皇家霍洛威学院)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出利用自然语言处理技术构建职业分类器,通过集成BERT与神经网络模型,实现招聘广告到职业代码的高准确率分类,提升劳动力市场分析的时效性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22688 2025-12-01 cs.LG cs.AI 62%

Test-time scaling of diffusions with flow maps

扩散模型测试时间缩放与流映射

Amirmojtaba Sabour, Michael S. Albergo, Carles Domingo-Enrich, Nicholas M. Boffi, Sanja Fidler, Karsten Kreis, Eric Vanden-Eijnden

机构 * NVIDIA(NVIDIA公司) University of Toronto(多伦多大学) Vector Institute(向量研究所) Harvard University(哈佛大学) Kempner Institute(凯姆纳研究所) IAIFI(IAIFI机构) Microsoft Research(微软研究院) Carnegie Mellon University(卡内基梅隆大学) Courant Institute, New York University(纽约大学应用数学学院) ML Lab at Capital Fund Management (CFM)(Capital Fund Management (CFM)机器学习实验室)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过流映射改进扩散模型测试时间性能,通过流映射与速度场关系构建FMTT算法,实现更优奖励上升并支持复杂图像编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21947 2025-12-01 cs.CV cs.AI cs.LG 62%

WalkCLIP: Multimodal Learning for Urban Walkability Prediction

WalkCLIP: 城市步行性预测的多模态学习

Shilong Xiang, JangHyeon Lee, Min Namgung, Yao-Yi Chiang

机构 * University of Minnesota Twin Cities(明尼苏达大学双城分校)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 WalkCLIP通过整合视觉和行为数据,实现了对城市步行性的高精度预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00509 2025-12-01 cs.AI 57%

Leveraging Ontologies to Document Bias in Data

利用本体论来记录数据中的偏见

Mayra Russo, Maria-Esther Vidal

机构 * Leibniz Universität Hannover(莱比锡大学汉诺威分校) TIB Leibniz Information Center for Science and Technology(TIB莱比锡科学与技术信息中心)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 本文提出Doc-BiasO本体,旨在整合偏见相关术语和关系,以提升对数据偏见的理解和AI领域偏见研究的术语清晰度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11673 2025-12-01 cs.CV 50%

DINO-Foresight: Looking into the Future with DINO

DINO-Foresight: 用DINO展望未来

Efstathios Karypidis, Ioannis Kakogeorgiou, Spyros Gidaris, Nikos Komodakis

机构 * Archimedes, Athena Research Center(阿基米德研究所,雅典研究学院) National Technical University of Athens(雅典国立技术大学) University of Crete(克里特大学) IACM-Forth(福伊恩研究所)

专题命中 其他LLM :foundation model(abstract)

AI总结 DINO-Foresight通过在预训练视觉基础模型的语义特征空间中训练,实现了对未来动态的预测,提升了自动驾驶和机器人领域的环境理解能力。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10562 2025-12-01 cs.RO cs.CV 50%

Kalib: Easy Hand-Eye Calibration with Reference Point Tracking

Kalib: 通过参考点跟踪实现易于的机眼标定

Tutian Tang, Minghao Liu, Wenqiang Xu, Cewu Lu

机构 * School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University(电子信息与电气工程学院,上海交通大学) Meta Robotics Institute, Shanghai Jiao Tong University(元机器人研究所,上海交通大学) Qing Yuan Research Institute(青元研究院) MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能联合重点实验室,人工智能学院,上海交通大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 Kalib通过利用视觉基础模型的通用性,提出了一种无需复杂设置的机眼标定方法,实现了高精度与低手动工作量的平衡。

Comments The code, data, and supplementary materials are available at https://sites.google.com/view/hand-eye-kalib

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22639 2025-12-01 physics.optics 50%

A 160 ° x 160 ° Dynamic Holographic Meta-Projector

一种160°×160°动态全息元投影仪

Feng-Jun Li, Ruixing Xia, Qianmei Deng, Yuze Lu, Xiangping Li, Fangwen Sun, Dong Zhao, Zi-Lan Deng, Kun Huang

专题命中 其他LLM :SLM(abstract)

AI总结 本文提出一种160°×160°动态全息元投影仪,通过集成次波长元表面像素实现大视场动态全息显示,突破传统SLM的限制。

Comments 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07119 2025-12-01 cs.CV 50%

MoRe: Monocular Geometry Refinement via Graph Optimization for Cross-View Consistency

MoRe: 通过图优化改进单目几何以实现跨视角一致性

Dongki Jung, Jaehoon Choi, Yonghan Lee, Sungmin Eum, Heesung Kwon, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 其他LLM :foundation model(abstract)

AI总结 MoRe通过图优化改进单目几何以提升跨视角一致性与尺度对齐,增强3D重建与新视角合成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏