arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-06 至 2026-01-06 共收录 54 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 54 篇

2601.01196 2026-01-06 cs.RO 91%

EduSim-LLM: An Educational Platform Integrating Large Language Models and Robotic Simulation for Beginners

EduSim-LLM: 一个整合大语言模型和机器人模拟的教育平台,用于初学者

Shenqi Lu, Liangwei Zhang

机构 * Hangzhou Dianzi University Information Engineering College(杭州电子科技大学信息工程学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 EduSim-LLM通过整合大语言模型与机器人模拟,实现自然语言到机器人行为的转换,提升初学者在人机交互和多机器人协作中的控制与操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00874 2026-01-06 cs.LG cs.AI physics.comp-ph 91%

LLMize: A Framework for Large Language Model-Based Numerical Optimization

LLMize: 一种基于大语言模型的数值优化框架

M. Rizki Oktavian

机构 * Blue Wave AI Labs(蓝波人工智能实验室) School of Nuclear Engineering, Purdue University(核工程学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 LLMize是一种基于大语言模型的数值优化框架,通过自然语言描述注入约束和领域知识,适用于复杂领域特定任务的优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01718 2026-01-06 cs.AI 89%

Yuan3.0 Flash: An Open Multimodal Large Language Model for Enterprise Applications

Yuan3.0 Flash:面向企业应用的开源多模态大语言模型

YuanLab. ai, :, Shawn Wu, Sean Wang, Louie Li, Darcy Chen, Allen Wang, Jiangang Luo, Xudong Zhao, Joseph Shen, Gawain Ma, Jasper Jia, Marcus Mao, Claire Wang, Hunter He, Carol Wang, Zera Zhang, Jason Wang, Chonly Shen, Leo Zhang, Logan Chen, Qasim Meng, James Gong, Danied Zhao, Penn Zheng, Owen Zhu, Tong Yu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 Yuan3.0 Flash通过RAPO算法提升企业任务性能,实现高效多模态大语言模型开源

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01378 2026-01-06 cs.AI 89%

Empowering Small Language Models with Factual Hallucination-Aware Reasoning for Financial Classification

赋能小型语言模型以实现金融分类的事实幻觉感知推理

Han Yuan, Yilin Wu, Li Zhang, Zheng Ma

机构 * Decision Science Center of Excellence(决策科学中心卓越机构) American Express(美国运通)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 本文提出AAAI流程,通过缓解事实幻觉提升小型语言模型在金融分类中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01321 2026-01-06 cs.AI 89%

Digital Twin AI: Opportunities and Challenges from Large Language Models to World Models

数字孪生AI:从大语言模型到世界模型的机会与挑战

Rong Zhou, Dongping Chen, Zihan Jia, Yao Su, Yixin Liu, Yiwen Lu, Dongwei Shi, Yue Huang, Tianyang Xu, Yi Pan, Xinliang Li, Yohannes Abate, Qingyu Chen, Zhengzhong Tu, Yu Yang, Yu Zhang, Qingsong Wen, Gengchen Mai, Sunyang Fu, Jiachen Li, Xuyu Wang, Ziran Wang, Jing Huang, Tianming Liu, Yong Chen, Lichao Sun, Lifang He

机构 * Lehigh University(莱文斯顿大学) University of Maryland(马里兰大学) University of New South Wales(新南威尔士大学) Worcester Polytechnic Institute(沃思维尔理工学院) University of Pennsylvania(宾夕法尼亚大学) University of Notre Dame(圣约翰大学) Columbia University(哥伦比亚大学) University of Georgia(佐治亚大学) Yale University(耶鲁大学) Texas A&M University(德克萨斯A&M大学) Stanford University(斯坦福大学) Squirrel Ai Learning University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校) University of California, Riverside(加州大学河滨分校) Florida International University(佛罗里达国际大学) Purdue University(普渡大学) Children’s Hospital of Philadelphia(费城儿童医院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 本文提出统一的四阶段框架,探讨数字孪生中AI整合的机会与挑战,涵盖建模、镜像、干预和自主管理,强调大语言模型和基础模型的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01544 2026-01-06 cs.AI 88%

Causal Consistency Regularization: Training Verifiably Sensitive Reasoning in Large Language Models

因果一致性正则化:在大型语言模型中训练可验证的敏感推理

Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建筑与环境工程系,爱荷华州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 CSR通过强制因果一致性提升大语言模型的推理忠实性,实现更可靠的结构化领域推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01407 2026-01-06 cs.CL 88%

From Emotion Classification to Emotional Reasoning: Enhancing Emotional Intelligence in Large Language Models

从情绪分类到情绪推理:提升大语言模型情感智能

Arjhun Sreedar, Rohan Pillay, Laukik Patade

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文通过合成情绪链式思维数据提升大语言模型的情感推理能力,实验表明微调后模型在情绪理解与意识评估上显著提升。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02314 2026-01-06 cs.AI 87%

Project Ariadne: A Structural Causal Framework for Auditing Faithfulness in LLM Agents

Project Ariadne: 一种用于审计大语言模型代理忠实性的结构因果框架

Sourena Khanzadeh

机构 * Sourena Khanzadeh(独立研究者)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 Project Ariadne提出一种结构因果框架,通过因果干预评估大语言模型代理推理的忠实性,揭示代理推理与决策之间的因果脱节问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05434 2026-01-06 cs.CL cs.AI 87%

LTLBench: Towards Benchmarks for Evaluating Temporal Reasoning in Large Language Models

LTLBench: 为评估大语言模型中的时间推理能力而设计的基准测试

Weizhi Tang, Kwabena Nuamah, Vaishak Belle

机构 * University of Edinburgh(爱丁堡大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

AI总结 LTLBench通过线性时序逻辑评估大语言模型的时间推理能力,构建包含2000个挑战的数据集并测试12个模型,揭示时间推理中的主要问题及复杂性影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01546 2026-01-06 cs.AI 85%

Improving Behavioral Alignment in LLM Social Simulations via Context Formation and Navigation

通过情境形成与导航提升LLM社交模拟中的行为一致性

Letian Kong, Qianran, Jin, Renyu Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过情境形成与导航提升LLM在复杂决策环境中的行为一致性,验证了两阶段框架在不同任务中的有效性。

Comments 39 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23489 2026-01-06 cs.AI 85%

The Gaining Paths to Investment Success: Information-Driven LLM Graph Reasoning for Venture Capital Prediction

投资成功的获取路径:基于信息驱动的LLM图推理的创业投资预测

Haoyu Pei, Zhongyang Liu, Xiangyi Xiao, Xiaocong Du, Suting Hong, Kunpeng Zhang, Haipeng Zhang

机构 * ShanghaiTech University(上海科技大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Maryland(马里兰大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MIRAGE-VC通过信息驱动的图路径推理,提升创业投资预测的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26122 2026-01-06 cs.CL 83%

Reasoning Path Divergence: A New Metric and Curation Strategy to Unlock LLM Diverse Thinking

推理路径分歧:一种新的度量和筛选策略,以解锁LLM多样化思考

Feng Ju, Zeyu Qin, Rui Min, Zhitao He, Lingpeng Kong, Yi R. Fung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of Science and Technology of China(中国科学技术大学) The University of Hong Kong(香港大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出了一种新的训练范式1PNS和度量RPD,通过增加推理多样性提升LLM的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04308 2026-01-06 cs.RO cs.AI cs.CV 83%

RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics

RoboRefer: 向视觉语言模型在机器人中的空间指称推理迈进

Enshen Zhou, Jingkun An, Cheng Chi, Yi Han, Shanyu Rong, Chi Zhang, Pengwei Wang, Zhongyuan Wang, Tiejun Huang, Lu Sheng, Shanghang Zhang

机构 * School of Software, Beihang University(北京航空航天大学软件学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 推理与问题求解 :language model(title,abstract);SFT(abstract);分类 cs.AI

AI总结 RoboRefer通过整合深度编码器和强化微调方法,实现了视觉语言模型在机器人中的空间指称推理,提升了复杂场景下的交互能力。

Comments Accepted by NeurIPS 2025. Project page: https://zhoues.github.io/RoboRefer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12880 2026-01-06 cs.CL cs.AI 82%

nvBench 2.0: Resolving Ambiguity in Text-to-Visualization through Stepwise Reasoning

nvBench 2.0:通过分步推理解决文本到可视化中的歧义

Tianqi Luo, Chuhan Huang, Leixian Shen, Boyan Li, Shuyu Shen, Wei Zeng, Nan Tang, Yuyu Luo

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 nvBench 2.0通过分步推理解决文本到可视化中的歧义问题,提出Step-Text2Vis模型在模糊场景中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01952 2026-01-06 cs.SE 82%

Context-Adaptive Requirements Defect Prediction through Human-LLM Collaboration

基于人类与大语言模型协作的上下文自适应需求缺陷预测

Max Unterbusch, Andreas Vogelsang

专题命中 推理与问题求解 :LLM(title,abstract);prompting(abstract)

AI总结 本文提出基于人类与大语言模型协作的上下文自适应需求缺陷预测方法,通过反馈循环和少量样本学习提升预测性能,优于传统方法。

Comments Accepted at ICSE-NIER 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01233 2026-01-06 cs.SE 82%

Atomizer: An LLM-based Collaborative Multi-Agent Framework for Intent-Driven Commit Untangling

Atomizer: 一种基于大语言模型的协作多智能体框架,用于意图驱动的复合提交解缠

Kangchen Zhu, Zhiliang Tian, Shangwen Wang, Mingyue Leng, Xiaoguang Mao

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

AI总结 Atomizer通过意图导向的思考链策略和协作多智能体框架,有效解决复合提交解缠中的语义意图识别和多轮细化问题,提升解缠效果。

Comments Accepted by ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02147 2026-01-06 cs.CV cs.AI cs.LG 82%

BiPrompt: Bilateral Prompt Optimization for Visual and Textual Debiasing in Vision-Language Models

BiPrompt:面向视觉与文本去偏的双重视觉语言模型双向提示优化

Sunny Gupta, Shounak Das, Amit Sethi

专题命中 推理与问题求解 :language model(title);foundation model(abstract,comments);分类 cs.AI、cs.LG

AI总结 BiPrompt通过双重视觉语言模型双向提示优化,同时减轻视觉和文本中的非因果特征依赖,提升模型在分布偏移下的鲁棒性和因果推理能力。

Comments Accepted at the AAAI 2026 Workshop AIR-FM, Assessing and Improving Reliability of Foundation Models in the Real World

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06478 2026-01-06 cs.LG cs.AI 81%

Anytime-Valid Answer Sufficiency Certificates for LLM Generation via Sequential Information Lift

通过顺序信息提升实现LLM生成的任何时间有效性答案充分性证书

Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建设与环境工程系,爱荷华州立大学)

专题命中 推理与问题求解 :LLM(title);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过顺序信息提升实现LLM生成的任何时间有效性答案充分性证书,利用经验动态形式提升方法,在减少生成长度的同时保持delta级误差控制,并通过轻量级正确性门提升端任务正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12948 2026-01-06 cs.CL cs.AI cs.LG 80%

DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

DeepSeek-R1: 通过强化学习激励大语言模型的推理能力

DeepSeek-AI, Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Peiyi Wang, Qihao Zhu, Runxin Xu, Ruoyu Zhang, Shirong Ma, Xiao Bi, Xiaokang Zhang, Xingkai Yu, Yu Wu, Z. F. Wu, Zhibin Gou, Zhihong Shao, Zhuoshu Li, Ziyi Gao, Aixin Liu, Bing Xue, Bingxuan Wang, Bochao Wu, Bei Feng, Chengda Lu, Chenggang Zhao, Chengqi Deng, Chenyu Zhang, Chong Ruan, Damai Dai, Deli Chen, Dongjie Ji, Erhang Li, Fangyun Lin, Fucong Dai, Fuli Luo, Guangbo Hao, Guanting Chen, Guowei Li, H. Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Qu, Hui Li, Jianzhong Guo, Jiashi Li, Jiawei Wang, Jingchang Chen, Jingyang Yuan, Junjie Qiu, Junlong Li, J. L. Cai, Jiaqi Ni, Jian Liang, Jin Chen, Kai Dong, Kai Hu, Kaige Gao, Kang Guan, Kexin Huang, Kuai Yu, Lean Wang, Lecong Zhang, Liang Zhao, Litong Wang, Liyue Zhang, Lei Xu, Leyi Xia, Mingchuan Zhang, Minghua Zhang, Minghui Tang, Meng Li, Miaojun Wang, Mingming Li, Ning Tian, Panpan Huang, Peng Zhang, Qiancheng Wang, Qinyu Chen, Qiushi Du, Ruiqi Ge, Ruisong Zhang, Ruizhe Pan, Runji Wang, R. J. Chen, R. L. Jin, Ruyi Chen, Shanghao Lu, Shangyan Zhou, Shanhuang Chen, Shengfeng Ye, Shiyu Wang, Shuiping Yu, Shunfeng Zhou, Shuting Pan, S. S. Li, Shuang Zhou, Shaoqing Wu, Shengfeng Ye, Tao Yun, Tian Pei, Tianyu Sun, T. Wang, Wangding Zeng, Wanjia Zhao, Wen Liu, Wenfeng Liang, Wenjun Gao, Wenqin Yu, Wentao Zhang, W. L. Xiao, Wei An, Xiaodong Liu, Xiaohan Wang, Xiaokang Chen, Xiaotao Nie, Xin Cheng, Xin Liu, Xin Xie, Xingchao Liu, Xinyu Yang, Xinyuan Li, Xuecheng Su, Xuheng Lin, X. Q. Li, Xiangyue Jin, Xiaojin Shen, Xiaosha Chen, Xiaowen Sun, Xiaoxiang Wang, Xinnan Song, Xinyi Zhou, Xianzu Wang, Xinxia Shan, Y. K. Li, Y. Q. Wang, Y. X. Wei, Yang Zhang, Yanhong Xu, Yao Li, Yao Zhao, Yaofeng Sun, Yaohui Wang, Yi Yu, Yichao Zhang, Yifan Shi, Yiliang Xiong, Ying He, Yishi Piao, Yisong Wang, Yixuan Tan, Yiyang Ma, Yiyuan Liu, Yongqiang Guo, Yuan Ou, Yuduan Wang, Yue Gong, Yuheng Zou, Yujia He, Yunfan Xiong, Yuxiang Luo, Yuxiang You, Yuxuan Liu, Yuyang Zhou, Y. X. Zhu, Yanhong Xu, Yanping Huang, Yaohui Li, Yi Zheng, Yuchen Zhu, Yunxian Ma, Ying Tang, Yukun Zha, Yuting Yan, Z. Z. Ren, Zehui Ren, Zhangli Sha, Zhe Fu, Zhean Xu, Zhenda Xie, Zhengyan Zhang, Zhewen Hao, Zhicheng Ma, Zhigang Yan, Zhiyu Wu, Zihui Gu, Zijia Zhu, Zijun Liu, Zilin Li, Ziwei Xie, Ziyang Song, Zizheng Pan, Zhen Huang, Zhipeng Xu, Zhongyu Zhang, Zhen Zhang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DeepSeek-R1通过强化学习提升大语言模型的推理能力,无需人工标注数据,实现更复杂的推理任务表现。

Journal ref Nature volume 645, pages 633-638 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22732 2026-01-06 cs.LG cs.CL 79%

Reasoning Beyond Limits: Advances and Open Problems for LLMs

超越极限的推理:大型语言模型的进展与开放问题

Mohamed Amine Ferrag, Norbert Tihanyi, Merouane Debbah

机构 * United Arab Emirates University(阿拉伯联合酋长国大学) Technology Innovation Institute(技术创新研究所) Eötvös Loránd University(厄特沃什·洛朗大学) Khalifa University of Science(谢赫扎耶德科学技术大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

AI总结 本文探讨了大型语言模型在推理能力上的最新进展,分析了多种模型的创新与性能提升,并指出了未来在多步骤推理、鲁棒性、提示平衡及工具整合等方面的研究挑战。

Comments The paper is published ICT Express Volume 11, Issue 6, December 2025, Pages 1054-1096

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23019 2026-01-06 cs.RO 78%

Stairway to Success: An Online Floor-Aware Zero-Shot Object-Goal Navigation Framework via LLM-Driven Coarse-to-Fine Exploration

通往成功的阶梯:一种通过LLM驱动的粗到细探索的在线楼层感知零样本物体-目标导航框架

Zeying Gong, Rong Li, Tianshuai Hu, Ronghe Qiu, Lingdong Kong, Lingfeng Zhang, Guoyang Zhao, Yiyi Ding, Junwei Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(title,abstract)

AI总结 本文提出ASCENT框架,通过LLM驱动的粗到细探索实现在线楼层感知零样本物体-目标导航,无需预建地图或重新训练,适用于多楼层环境。

Comments Accepted to IEEE Robotics and Automation Letters (RAL). Project Page at https://zeying-gong.github.io/projects/ascent

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01708 2026-01-06 cs.CL 77%

A Training-Free Large Reasoning Model-based Knowledge Tracing Framework for Unified Prediction and Prescription

基于大推理模型的无训练知识追踪框架:用于统一预测与处方

Unggi Lee, Joo Young Kim, Ran Ju, Minyoung Jung, Jeyeon Eo

机构 * Chosun University(全州大学) Neudive Inc(Neudive公司) Independent Researcher(独立研究者)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出Thinking-KT框架,利用测试时缩放技术,使小型LLM在无需训练的情况下实现高效的知识追踪预测、个性化反馈和学习推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01341 2026-01-06 cs.CL 77%

Reasoning Over Recall: Evaluating the Efficacy of Generalist Architectures vs. Specialized Fine-Tunes in RAG-Based Mental Health Dialogue Systems

基于回忆的推理:评估基于RAG的心理健康对话系统中通用架构与专门微调的有效性

Md Abdullah Al Kafi, Raka Moni, Sumit Kumar Banshal

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过比较通用推理模型与领域特定微调模型,发现通用模型在同理心和上下文理解方面表现更优,表明强大的推理能力比专门训练更能提升心理健康对话系统的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01195 2026-01-06 cs.AI 77%

Reinforcement Learning Enhanced Multi-hop Reasoning for Temporal Knowledge Question Answering

强化学习增强的多跳推理用于时间知识问答

Wuzhenghong Wen, Chao Xue, Su Pan, Yuwei Sun, Minlong Peng

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出MRE框架,通过增强正向和反向推理,提升时间知识问答中多跳推理的准确性和鲁棒性。

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12869 2026-01-06 cs.CE cs.CL 77%

ERA-IT: Aligning Semantic Models with Revealed Economic Preference for Real-Time and Explainable Patent Valuation

ERA-IT:通过揭示的经济偏好对齐语义模型以实现实时和可解释的专利估值

Yongmin Yoo, Seungwoo Kim, Jingjiang Liu

机构 * School of Computing(计算学院) Macquarie University(麦考瑞大学) School of Computer Science(计算机科学学院) University of Technology Sydney(悉尼技术大学) School of Management(管理学院) Zhejiang University(浙江大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

AI总结 ERA-IT通过揭示的经济偏好对齐语义模型,实现实时且可解释的专利估值,提升预测准确性并增强决策透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06781 2026-01-06 cs.CR cs.AI cs.PL 77%

From Description to Score: Can LLMs Quantify Vulnerabilities?

从描述到评分:大语言模型能否量化漏洞?

Sima Jafarikhah, Daniel Thompson, Eva Deans, Hossein Siadati, Yi Liu

机构 * University of North Carolina Wilmington(北卡罗来纳大学 Wilmington 分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究探讨了大语言模型在自动化CVSS评分中的潜力,发现其在某些指标上表现优异,但存在分类错误问题,需改进漏洞描述以提升自动化评分的可靠性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00845 2026-01-06 cs.AI 77%

Enhancing Temporal Awareness in LLMs for Temporal Point Processes

增强大语言模型在时序点过程中的时间感知能力

Lili Chen, Wensheng Gan, Shuang Liang, Philip S. Yu

机构 * School of Computer Science and Technology, Tongji University, Shanghai 201804, China(计算机科学与技术学院,同济大学) College of Cyber Security, Jinan University, Guangzhou 510632, China(网络安全学院,暨南大学) Department of Computer Science, University of Illinois Chicago, Chicago, USA(计算机科学系,伊利诺伊大学芝加哥分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TPP-TAL通过增强LLMs的时间感知能力,改进了时序点过程中的时间似然估计和事件预测准确性。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01490 2026-01-06 cs.CL cs.AI 73%

Distortion Instead of Hallucination: The Effect of Reasoning Under Strict Constraints

扭曲而非虚构:在严格约束下推理的影响

Junichiro Niimi

机构 * Meijo University(名古屋大学) RIKEN(日本研究机构) AIP(Advanced Institute for Propulsion)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 在严格约束下,推理模型通过扭曲事实来减少约束违反,但牺牲了输出的真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24617 2026-01-06 cs.LG cs.AI 73%

Dynamic Large Concept Models: Latent Reasoning in an Adaptive Semantic Space

动态大概念模型:在适应性语义空间中的潜在推理

Xingwei Qu, Shaowen Wang, Zihao Huang, Kai Hua, Fan Yin, Rui-Jie Zhu, Jundong Zhou, Qiyang Min, Zihao Wang, Yizhi Li, Tianyu Zhang, He Xing, Zheng Zhang, Yuxuan Song, Tianyu Zheng, Zhiyuan Zeng, Chenghua Lin, Ge Zhang, Wenhao Huang

机构 * University of Manchester(曼彻斯特大学) Mila - Quebec AI Institute(魁北克人工智能研究所) Tsinghua University(清华大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 动态大概念模型通过层次压缩和压缩感知扩展定律,在适应性语义空间中提升推理效率,实现零样本基准上的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15401 2026-01-06 cs.CL cs.AI 73%

Problem-Solving Logic Guided Curriculum In-Context Learning for LLMs Complex Reasoning

基于问题解决逻辑的课程化上下文学习用于LLM复杂推理

Xuetao Ma, Wenbin Jiang, Hua Huang

机构 * School of Artificial Intelligence, Beijing Normal University(人工智能学院,北京师范大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出基于问题解决逻辑的课程化上下文学习方法,通过分析问题解决逻辑选择和排序示例,提升LLM复杂推理能力。

Comments 19 pages, 6 figures, ACL 2025 findings, camera-ready version

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏