arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2602.00402 2026-02-12 cs.HC cs.AI cs.CY 70%

A Conditional Companion: Lived Experiences of People with Mental Health Disorders Using LLMs

基于条件的伴侣:使用LLMs的人的精神健康障碍者的亲身经历

Aditya Kumar Purohit, Hendrik Heuer

机构 * Center for Advanced Internet Studies Bochum Germany Center for Advanced Internet Studies \& University of Wuppertal Bochum Germany Center for Advanced Internet Studies Center for Advanced Internet Studies \& University of Wuppertal

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了心理健康障碍者使用LLMs的亲身经历,发现其条件性使用与界限设定,提出设计和治理方向以确保LLMs在心理健康支持中的安全应用。

Comments Accepted for presentation at CHI 2026 in Barcelona (ACM CHI Conference on Human Factors in Computing Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18340 2026-02-11 cs.LG 70%

Why Policy Gradient Algorithms Work for Undiscounted Total-Reward MDPs

为何策略梯度算法适用于未折扣总奖励MDP

Jongmin Lee, Ernest K. Ryu

机构 * Seoul National University, Department of Mathematical Sciences(首尔国立大学数学科学系) UCLA, Department of Mathematics(加州大学洛杉矶分校数学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文探讨了为何策略梯度算法在未折扣总奖励MDP中有效,通过状态分类和暂态访问度量的分析,解决了γ=1时的收敛问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08901 2026-02-10 cs.LG 70%

GSS: Gated Subspace Steering for Selective Memorization Mitigation in LLMs

GSS:门控子空间定向用于LLM中的选择性记忆抑制

Xuanqi Zhang, Haoyang Shang, Xiaoxiao Li

机构 * University of British Columbia Vector Institute Independent Researcher

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 GSS通过门控子空间定向方法,有效缓解LLM中的选择性记忆问题,比优化方法节省大量计算资源并提升性能。

Comments 34 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08695 2026-02-10 cs.LG 70%

Trapped by simplicity: When Transformers fail to learn from noisy features

陷入简单性:当Transformer无法从噪声特征中学习时

Evan Peters, Ando Deng, Matheus H. Zambianco, Devin Blankespoor, Achim Kempf

机构 * University of Waterloo(滑铁卢大学) Perimeter Institute for Theoretical Physics(理论物理研究所)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了Transformer在噪声特征下的学习能力,发现其在某些布尔函数上表现优异,但在随机k-junta函数上因简单性偏见和敏感度差异而失效。

Comments 13+12 pages, 7 figures. Accepted at ICLR 2026

Journal ref International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08208 2026-02-10 cs.CL cs.HC 70%

LLMs and people both learn to form conventions -- just not with each other

大语言模型和人类都学会形成惯例——但并不是彼此之间

Cameron R. Jones, Agnese Lombardi, Kyle Mahowald, Benjamin K. Bergen

机构 * Department of Psychology, Stony Brook University(心理学系,石溪大学) Department of Cognitive Science, University of California San Diego(认知科学系,加州圣地亚哥大学) Department of Philology, Literature, and Linguistics, University of Pisa(philology、文学与语言学系,比萨大学) Department of Linguistics, University of Texas at Austin(语言学系,德克萨斯大学奥斯汀分校)

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.CL

AI总结 研究发现人类和AI在同类型对话中能形成惯例,但人机对话效果较差,表明对话协调需要共同的解释偏见。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16545 2026-02-10 cond-mat.mtrl-sci cs.LG 70%

Predictive Inorganic Synthesis based on Machine Learning using Small Data sets: a case study of size-controlled Cu Nanoparticles

基于机器学习的预测无机合成(小数据集应用):铜纳米颗粒尺寸控制的案例研究

Brent Motmans, Digvijay Ghogare, Thijs G. I. van Wijk, Joren Van Herck, Pieter De Meyer, Berend Smit, An Hardy, Danny E. P. Vanpoucke

机构 * Hasselt University, Institute for Materials Research (IUMAT), Quantum \& Artificial inTelligence design Of Materials (QuATOMs), Martelarenlaan 42, B-3500 Hasselt, Belgium Hasselt University, Institute for Materials Research (IUMAT), Hybrid Materials Design (HyMaD), Martelarenlaan 42, B-3500 Hasselt, Belgium Hasselt University, Institute for Materials Research (IUMAT), Design Electrochemistry Excellence Centre (ELEC), Materials \& Chemistry Unit, Flemish Institute for Technological Research (VITO), Boeretang 200, Mol, 2400 Belgium Laboratory of Molecular Simulation (LSMO), Institut des Sciences et Ingénierie Chimiques, École Polytechnique Fédérale de Lausanne (EPFL), Rue de l’Industrie 17, CH-1951 Sion, Switzerland

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究利用小数据集和传统机器学习方法,成功预测了铜纳米颗粒的尺寸,展示了在数据有限条件下,传统ML方法在合成控制中的有效性。

Comments 23 pages, 17 figures, 13 tables (including SI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07433 2026-02-10 cs.CL 70%

From Token to Line: Enhancing Code Generation with a Long-Term Perspective

从标记到行:通过长期视角增强代码生成

Tingwei Lu, Yangning Li, Liyuan Wang, Binghuai Lin, Qingsong Lv, Zishan Xu, Hai-Tao Zheng, Yinghui Li, Hong-Gee Kim

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出LSR-MCTS算法,通过MCTS逐行生成代码并引入自我修正机制,提升代码生成质量与多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01465 2026-02-10 cs.AI cs.SE 70%

Agyn: A Multi-Agent System for Team-Based Autonomous Software Engineering

Agyn:基于团队的自主软件工程多智能体系统

Nikita Benkovich, Vitalii Valkov

机构 * Mila – Quebec AI Institute (e-Lab)(魁北克AI研究所(e-Lab)) Tel-Aviv, Israel(特拉维夫,以色列)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Agyn提出了一种基于团队结构的多智能体系统,通过模拟工程团队的组织过程和协作方法,实现自主软件工程任务的高效处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06616 2026-02-09 cs.CR cs.LG 70%

Confundo: Learning to Generate Robust Poison for Practical RAG Systems

Confundo: 学习生成稳健的毒药以应对实际RAG系统

Haoyang Hu, Zhejun Jiang, Yueming Lyu, Junyuan Zhang, Yi Liu, Ka-Ho Chow

机构 * The University of Hong Kong(香港大学) Nanjing University(南京大学) City University of Hong Kong(香港城市大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Confundo是一种学习生成毒药的框架,通过微调大型语言模型以提高RAG系统的鲁棒性和隐蔽性,有效应对实际系统中的安全威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03944 2026-02-09 cs.LG 70%

On the Empirical Power of Goodness-of-Fit Tests in Watermark Detection

关于在水印检测中 goodness-of-fit 测试的实证效力

Weiqing He, Xiang Li, Tianqi Shang, Li Shen, Weijie Su, Qi Long

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了 goodness-of-fit 测试在水印检测中的实证效力,发现通用 GoF 测试能提升检测能力和鲁棒性,并指出文本重复对 GoF 测试的独特优势。

Comments Accepted at NeurIPS 2025 as a spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04752 2026-02-05 cs.LG 70%

Decomposing Query-Key Feature Interactions Using Contrastive Covariances

通过对比协方差分解查询-键特征交互

Andrew Lee, Yonatan Belinkov, Fernanda Viégas, Martin Wattenberg

机构 * Harvard University(哈佛大学) Technion - Israel Institute of Technology(技术ion-以色列理工学院) Kempner Institute, Harvard University(凯普纳研究所,哈佛大学) Google DeepMind(谷歌DeepMind)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出通过对比协方差分解查询-键特征交互,以揭示Transformer中注意力机制的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04570 2026-02-05 cs.CL 70%

Can LLMs capture stable human-generated sentence entropy measures?

大语言模型能否捕捉到稳定的人生成句子熵度量?

Estrella Pivel-Villanueva, Elisabeth Frederike Sterner, Franziska Knolle

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过实验证明大语言模型在捕捉人类生成句子熵方面的能力,发现GPT-4o与人类数据最一致,但LLMs无法完全替代稳定的人类分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03580 2026-02-04 cs.CR cs.AI 70%

Don't believe everything you read: Understanding and Measuring MCP Behavior under Misleading Tool Descriptions

不要轻信你所读到的:在误导性工具描述下理解和测量MCP行为

Zhihao Li, Boyang Ma, Xuelong Dai, Minghui Xu, Yue Zhang, Biwei Yan, Kun Li

机构 * School of Computer Science and Technology(计算机科学与技术学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究揭示MCP协议中描述与代码不一致的问题,发现13%的服务器存在潜在安全风险,强调需加强透明度和审计

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02961 2026-02-04 cs.AI 70%

Generative Engine Optimization: A VLM and Agent Framework for Pinterest Acquisition Growth

生成引擎优化:一个面向Pinterest获取增长的VLM和代理框架

Faye Zhang, Qianyu Cheng, Jasmine Wan, Vishwakarma Singh, Jinfeng Rao, Kofi Boakye

机构 * Stanford University(斯坦福大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Pinterest提出GEO框架,通过微调VLM和AI代理预测用户搜索需求,构建语义连贯的集合页面,提升生成搜索时代的视觉平台流量增长。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01684 2026-02-03 econ.GN cs.AI q-fin.EC 70%

The Strategic Foresight of LLMs: Evidence from a Fully Prospective Venture Tournament

大语言模型的战略前瞻性:来自一个前瞻性创业竞赛的证据

Felipe A. Csaszar, Aticus Peterson, Daniel Wilde

机构 * Ross School of Business University of Michigan(密歇根大学罗斯商学院) NYU Stern School of Business New York University(纽约大学 Stern 商学院) Kelley School of Business Indiana University(印第安纳大学凯利商学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 大语言模型在战略前瞻性任务中超越人类,通过前瞻性创业竞赛验证其预测能力。

Comments 60 pages, 11 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05825 2026-02-03 cs.HC cs.AI 70%

Decoding Workload and Agreement From EEG During Spoken Dialogue With Conversational AI

从语音对话中解码工作负荷与共识的EEG信号

Lucija Mihić Zidar, Philipp Wicke, Praneel Bhatia, Rosa Lutz, Marius Klug, Thorsten O. Zander

机构 * Chair of Neuroadaptive Human--Computer Interaction(神经适应性人机交互教授席位) Brandenburg Technical University Cottbus--Senftenberg(勃兰登堡技术大学库滕堡-森芬根堡分校) Auryal GmbH(Auryal公司) Cottbus, Germany(库滕堡,德国)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过EEG解码语音对话中的工作负荷与共识,验证了现有分类器在对话场景中的迁移能力,并探讨了其应用限制。

Comments Accepted at the 14th International Winter Conference on Brain-Computer Interface

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00874 2026-02-03 quant-ph cs.DS cs.LG 70%

Sublinear Time Quantum Algorithm for Attention Approximation

亚线性时间的注意力近似量子算法

Zhao Song, Jianfei Xue, Jiahao Zhang, Lichen Zhang

机构 * Simons Institute for the Theory of Computing, UC Berkeley(Simons理论计算研究所,伯克利大学) New York University(纽约大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种量子算法,以亚线性时间近似注意力矩阵的行,利用量子Nyström近似、均值估计和杠杆得分采样技术。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00762 2026-02-03 cs.CL cs.HC 70%

WordCraft: Scaffolding the Keyword Method for L2 Vocabulary Learning with Multimodal LLMs

WordCraft: 通过多模态大语言模型 scaffolding 关键词方法用于L2词汇学习

Yuheng Shao, Junjie Xiong, Chaoran Wu, Xiyuan Wang, Ziyu Zhou, Yang Ouyang, Qinyi Tao, Quan Li

机构 * School of Information Science and Technology, ShanghaiTech University(信息科学与技术学院,上海科技大学) School of Creativity and Art, ShanghaiTech University(创意与艺术学院,上海科技大学) Shanghai Fengxian Dai Wen Middle School(上海奉贤戴文中学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 WordCraft通过多模态大语言模型辅助L2词汇学习,提升关键词方法的使用效果和学习者参与度。

Comments Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI' 26), April 13--17, 2026, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00613 2026-02-03 cs.CL 70%

Transformer-Based Model for Multilingual Hope Speech Detection

基于变换器的多语言希望语音检测模型

Nsrin Ashraf, Mariam Labib, Hamada Nayel

机构 * Department of Computer Science, Faculty of Computers and Artificial Intelligence, Benha University(计算机科学系,计算机与人工智能学院,班哈大学) Computer Engineering, Elsewedy University of Technology(计算机工程,埃斯韦迪技术大学) Department of Electronics and Communications Engineering, Faculty of Engineering, Mansoura University(电子与通信工程系,工程学院,曼苏拉大学) Department of Computer Engineering and Information, College of Engineering, Wadi Ad Dwaser, Prince Sattam Bin Abdulaziz University(计算机工程与信息系,工程学院,瓦迪阿德瓦瑟,普林斯萨塔姆·本·阿卜杜勒阿齐兹大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于RoBERTa和XLM-RoBERTa的多语言希望语音检测系统,通过实验验证了预训练大语言模型对提升自然语言处理任务性能的作用。

Comments 5 pages, 1 figure, PolyHope-M shared task at RANLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19652 2026-02-03 cs.CV cs.AI 70%

InterDreamer: Zero-Shot Text to 3D Dynamic Human-Object Interaction

InterDreamer: 零样本文本到3D动态人-物交互

Sirui Xu, Ziyin Wang, Yu-Xiong Wang, Liang-Yan Gui

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 InterDreamer通过结合预训练模型和物理模拟,实现零样本生成3D动态人-物交互。

Comments NeurIPS 2024. Project Page: https://sirui-xu.github.io/InterDreamer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16355 2026-02-03 cs.CL 70%

Identity, Cooperation and Framing Effects within Groups of Real and Simulated Humans

身份、合作与群体中真实与模拟人类的框架效应

Suhong Moon, Minwoo Kang, Joseph Suh, Mustafa Safdari, John Canny

机构 * University of California, Berkeley(加州大学伯克利分校) Google DeepMind(谷歌DeepMind)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过深度绑定基础模型与扩展背景故事,提升LLMs在社会困境游戏中模拟人类行为的保真度,探索影响人类研究的细节因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21678 2026-01-30 cs.CL physics.data-an 70%

Scale-Dependent Semantic Dynamics Revealed by Allan Deviation

通过阿兰偏差揭示的尺度依赖语义动态

Debayan Dasgupta

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 通过阿兰偏差分析,揭示了语义动态在不同尺度下的变化特征,发现大语言模型在稳定性方面存在系统性不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20880 2026-01-30 stat.AP cs.LG 70%

Spatial Heterogeneity in Climate Risk and Human Flourishing: An Exploration with Generative AI

气候风险与人类繁荣的空间异质性:基于生成AI的探索

Stefano Maria Iacus, Haodong Qi, Devika Jain

机构 * Institute for Quantitative Social Science, Harvard University(哈佛大学定量社会科学研究所) Stockholm University(斯德哥尔摩大学) Department of Global Political Studies, Malmö University(马尔默大学全球政治学系) Center for Geographic Analysis, Harvard University(哈佛大学地理分析中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究利用生成AI和结构方程模型,探讨美国各郡累积气候风险与人类繁荣之间的空间异质性关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19467 2026-01-28 cs.LO cs.FL cs.LG 70%

On the Expressiveness of State Space Models via Temporal Logics

通过时序逻辑探讨状态空间模型的表达能力

Eric Alsmann, Lowejatan Noori, Martin Lange

机构 * University of Kassel(卡塞尔大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文探讨了状态空间模型在不同门控机制下的表达能力,通过时序逻辑分析其与变换器架构的表达力差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19122 2026-01-28 cs.AI 70%

Exploring Weaknesses in Function Call Models via Reinforcement Learning: An Adversarial Data Augmentation Approach

通过强化学习探索函数调用模型的弱点:一种对抗性数据增强方法

Weiran Guo, Bing Bo, Shaoxiang Wu, Jingsheng Yang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过强化学习提出对抗性数据增强方法,系统识别和纠正函数调用模型的弱点,提升其与外部工具交互的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18834 2026-01-28 cs.CR cs.AI 70%

CanaryBench: Stress Testing Privacy Leakage in Cluster-Level Conversation Summaries

CanaryBench: 集群级对话摘要中的隐私泄露压力测试

Deep Mehta

机构 * Adobe Inc(Adobe公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CanaryBench通过生成包含秘密字符串的合成对话,测试集群级对话摘要中的隐私泄露风险,并提出最小防御措施以减少泄露。

Comments 13 pages, 4 figures. Code repository: https://github.com/researchaudio/canarybench

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16555 2026-01-26 cs.CL 70%

Retrieve-Refine-Calibrate: A Framework for Complex Claim Fact-Checking

检索-细化-校准:复杂断言事实核查的框架

Mingwei Sun, Qianlong Wang, Ruifeng Xu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出RRC框架,通过检索、细化和校准提升复杂断言事实核查的准确性。

Comments 9 pages, 4 figures. This is an original work by the authors. Any unauthorized submission, reproduction, or commercial use by third parties is prohibited

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06247 2026-01-23 cs.SE cs.AI cs.AR 70%

DUET: Agentic Design Understanding via Experimentation and Testing

DUET:通过实验和测试进行代理设计理解

Gus Henry Smith, Sandesh Adhikary, Vineet Thumuluri, Karthik Suresh, Vivek Pandit, Kartik Hegde, Hamid Shojaei, Chandra Bhagavatula

机构 * Southmountain Research(Southmountain研究机构) ChipStack

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DUET通过实验和测试提升AI代理在硬件设计验证中的性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00256 2026-01-21 cs.NI cs.AI 70%

Large AI Model-Enabled Secure Communications in Low-Altitude Wireless Networks: Concepts, Perspectives and Case Study

大AI模型赋能的低空无线网络安全通信:概念、视角与案例研究

Chuang Zhang, Geng Sun, Yijing Lin, Weijie Yuan, Sinem Coleri, Dusit Niyato

机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Singapore University of Technology and Design(新加坡科技设计大学) College of Computer Science and Technology, Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education, Jilin University(吉林大学计算机科学与技术学院、教育部符号计算与知识工程重点实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于大AI模型的优化框架,利用大语言模型提升低空无线网络安全通信的性能。

Comments This paper has been accepted to IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19813 2026-01-16 cs.LG 70%

Curating art exhibitions using machine learning

使用机器学习策划艺术展览

Eurico Covas

机构 * Instituto de Astrofísica e Ciências do Espaço Faculdade de Belas-Artes da Universidade de Lisboa(艺术大学里斯本美术学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文通过机器学习方法,利用现有展览数据训练模型,实现对策展工作的模拟,并验证小型模型在精度和连贯性上可媲美大语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏