Let Models Speak Ciphers: Multiagent Debate through Embeddings
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ICLR 2024
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ICLR 2024
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)
Comments The manuscript is submitted to IEEE International Geoscience and Remote Sensing Symposium(IGARSS2024). Looking forward to seeing you in July!
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments arXiv v2: add appendix
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments AAAI 2024
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to NeurIPS 2023 (spotlight). Project website: https://swiftsage.github.io
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 23 pages, 37th Conference on Neural Information Processing Systems (NeurIPS 2023)
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 19 pages, 11 figures
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Project Page: https://codi-2.github.io/
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments NeurIPS 2023. 10 pages, 7 figures, 4 tables (33 pages, 14 figures, 15 tables including references and appendices)
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Published at NeurIPS 2023
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments technical report, add code link. arXiv admin note: text overlap with arXiv:2305.11206 by other authors
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments For few-shot examples and prompts, see https://github.com/anthropics/DecompositionFaithfulnessPaper
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 22 pages (9 figures, 18 tables)
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Shortened version with additional results from CODEX and GPT-3. The authors contributed equally. Work done when Aman Madaan was a student researcher at Google Research, Brain Team
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments https://socraticmodels.github.io/
延迟、平台期或崩溃:评估系统性验证错误对RLVR的影响
机构 * ETH Zurich(苏黎世联邦理工学院) ; Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)
专题命中 推理与问题求解 :LLM(abstract_cn,comments);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本研究探究系统性验证错误对RLVR的影响,发现系统性误报会引发次优平台期或性能崩溃,验证器质量需结合错误模式而非仅样本级错误率评估。
Comments COLM 2026. Code: https://github.com/eth-sri/llm-verifier-noise
PolyMATH:一个具有挑战性的多模态数学推理基准
机构 * Arizona State University(亚利桑那州立大学) ; Georgia Institute of Technology(佐治亚理工学院)
专题命中 推理与问题求解 :language model(abstract,comments);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI
AI总结 PolyMATH基准通过5000张高质量图像评估多模态大语言模型的推理能力,揭示其在空间关系和抽象推理上的不足,指出模型无法真正理解视觉信息,存在逻辑错误风险。
Comments Accepted in Neural Information Processing Systems (NeurIPS 2025) Workshop: Foundations of Reasoning in Language Models
机构 * Emory University(埃默里大学) ; Indian Institute of Technology Roorkee(印度理工学院罗里克分校) ; Cairo University(开罗大学) ; Mila - Quebec AI Institute(魁北克人工智能研究所) ; Polytechnique Montréal(蒙特利尔理工学院) ; Amazon(亚马逊)
专题命中 推理与问题求解 :language model(abstract,comments);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI
Comments Accepted at main track of the Second Conference on Language Modeling (COLM 2025)
机构 * Department of Neurology University of California San Francisco(神经病学系,加州大学旧金山分校)
专题命中 推理与问题求解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Comments 12 pages, 5 figures. Code available at: https://github.com/MDFahimAnjum/llm-planning-with-reasoning
专题命中 推理与问题求解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Comments LLM;RAG;MCTS
专题命中 推理与问题求解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Comments COLM 2024 / ICLR 2024 Workshop on LLM Agents
专题命中 推理与问题求解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Comments LLM+KG
专题命中 推理与问题求解 :LLM(title,comments);分类 cs.AI、cs.LG;large language model(comments);language model(comments)
Comments Attribute Extraction, PDF files, Bert Embedding, Hashtag, Large Language Model (LLM), Text and Images