arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-09-01 至 2026-09-01 共收录 38
2608.31025 2026-09-01 cs.CV 新提交

Analytic Dynamics: Learning Physics-Grounded Representation for Fast Intrinsic Dynamics Inference from Monocular Videos

分析动力学:从单目视频学习基于物理的表征以实现快速内在动力学推理

Jailing Lin, Jikuan Zhang, Jianhua Sun

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 针对从单目视频推断物体动力学的挑战,提出Analytic Dynamics框架,引入基于物理的中间表征,开发相关数据流水线与基准,实现高效准确可泛化的动力学推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30883 2026-09-01 cs.RO 新提交

SleepWalking: Privileged Representation Shaping for End-to-End Blind Locomotion in Legged Robots

SleepWalking:用于四足机器人端到端盲运动的特权表征塑造方法

Zheng Pan, Tenghui Wang, Peilin Li, Shiyu Zhou, Hao Sun, Yan Ma, Liang Yu, Liang He

机构 * Northwestern Polytechnical University(西北工业大学) Shanghai Jiao Tong University(上海交通大学) Yunmu Intelligent Manufacturing Co., Ltd.(云沐智能制造有限公司)

AI总结 本研究提出SWAQ框架,通过特权物理重构塑造历史表征,在四足机器人盲运动任务中,相比DWAQ提升地形水平同时降低推理计算量,为部分可观测运动学习提供新方法。

Comments 18 pages.13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30782 2026-09-01 cs.CV 新提交

PixelIR: Fidelity-Perception Decoupling via Pixel-Space Image-Residual Flow Matching for Efficient One-Step Real-World Super-Resolution

PixelIR:基于像素空间图像残差流匹配的保真度-感知解耦高效单步真实世界超分辨率方法

Bingtian Qiao, Yue Shi, Yong Guo, Wenjun Zhang, Jiezhang Cao

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 PixelIR是基于像素空间图像残差流匹配的保真度-感知解耦Real-ISR框架,经蒸馏后单步重建,在RealSR等数据集指标领先,参数、计算量与延迟低,实现三者平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30632 2026-09-01 cs.CL cs.AI cs.LG 新提交

GMTS: Gradient Magnitude-based Token Selection Improves RLVR Training for LLM Reasoning

GMTS:基于梯度幅度的令牌选择改进用于大语言模型推理的RLVR训练

Outongyi Lv, Yuanwei Zhang, Xiaoqun Zhang

机构 * School of Mathematical Sciences, Shanghai Jiao Tong University(上海交通大学数学科学学院) Institute of Natural Sciences, Shanghai Jiao Tong University(上海交通大学自然科学研究院)

AI总结 本研究针对RLVR训练中高熵令牌重要性机制不明的问题,提出GMTS方法量化令牌重要性,实验显示其在多领域、多模型规模下性能优于熵基选择。

Comments Findings of the 2026 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30603 2026-09-01 cs.CV cs.AI 新提交

DiffSAC: Diffusion-guided Sampling for Consensus-based Robust Estimation

DiffSAC:用于基于共识的鲁棒估计的扩散引导采样

Chang Nie, Guangming Wang, Zhe Liu, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Key Laboratory of System Control and Information Processing, Ministry of Education of China(教育部系统控制与信息处理重点实验室) Department of Engineering, Cambridge University(剑桥大学工程系)

AI总结 针对传统样本共识鲁棒估计采样效率低的问题,提出DiffSAC框架,通过扩散模型学习有效最小集分布,仅需几十个假设就实现最先进性能,可作为即插即用模块改进现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30530 2026-09-01 cs.CL cs.SE 新提交

WebWorld: The Browser as a World Model for Self-Improving Web Code

WebWorld:将浏览器作为自改进网页代码的世界模型

Jiajun Wu, Jian Yang, Yaxin Du, Wei Zhang, Haowen Wang, Junhang Cheng, Yuxuan Zhang, Tuney Zheng, Xianglong Liu, Ming Zhou

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) IQuest Research(IQuest研究院) Langboat

AI总结 本研究提出WebWorld,将浏览器作为VLM无法欺骗的网页代码世界模型,通过浏览器签发合格证书的机制实现VLM自主交互与监督,使WebWorld-27B在两个基准任务上实现显著性能提升,达到强前沿系统水平。

Comments EMNLP Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30461 2026-09-01 cs.CL 新提交

From Final Artifacts to Trajectories: Retrospective Process Supervision for Evidence-Grounded Long-Form Generation

从最终产物到轨迹:面向证据支撑的长文本生成的回溯过程监督

Junjie Huang, Jiarui Qin, Di Yin, Weiwen Liu, Yong Yu, Xing Sun, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 针对开放式长文本生成任务轨迹数据稀缺的问题,提出RetroGen框架,利用预训练数据中丰富的高质量最终产物重构轨迹,训练模型以提升证据支撑等任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30451 2026-09-01 cs.CV 新提交

SeqAlign3DVG: A Sequence-Aligned Benchmark and Voxel Reasoning Framework for 3D Visual Grounding

SeqAlign3DVG:用于3D视觉定位的序列对齐基准与体素推理框架

Yi Zhang, Yi Wang, Yueting Wu, Kaiyue Yang, Yuejiao Su, Lap-Pui Chau

机构 * The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 针对现有3D视觉定位基准的文本-观测对齐松散、忽略时间顺序的问题,提出SeqAlign3DVG基准及含ROVM、PLVF的体素推理框架,在无深度协议下实现最优性能,提升复杂关系目标定位效果。

Comments Accepted by ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30450 2026-09-01 cs.CV 新提交

FlowVVTON: Flow-Guided Mask-Free Video Virtual Try-On

FlowVVTON:基于流引导的无掩码视频虚拟试穿

Shengyao Chen, Xianbing Sun, Liqing Zhang, Jianfu Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 FlowVVTON是一种无掩码视频虚拟试穿框架,以光流为训练监督,通过两阶段训练实现多尺度时间一致性,在TikTokDress数据集上较基线方法(如SwiftTry)时间一致性提升显著,无需额外标注。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30396 2026-09-01 cs.AI cs.RO 新提交

Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation

将基础模型搭建为物理世界智能体以推动长时程导航前沿

Zixing Lei, Gengze Zhou, Xiong-Hui Chen, Jiazhao Zhang, Yiyang Huang, Hang Yin, Haoqi Yuan, Qi Wu, Weixin Li, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Inc(阿里巴巴集团) Zhongguancun Academy(中关村学院) Adelaide University(阿德莱德大学) Peking University(北京大学) Tsinghua University(清华大学)

AI总结 本文提出NavMCP框架,结合VLM推理智能体与NFM执行器实现长时程导航,在多个具身问答基准及Unitree Go2机器人上取得优于基线的性能,验证了该方法的有效性。

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30345 2026-09-01 cs.AI 新提交

Answer Probing-Guided Search for Diverse Solution Exploration of LLMs

基于答案探测引导的大语言模型多样化解决方案探索搜索

Yi Fang, Que Shen, Chengpeng Li, Boyi Deng, Wei Shi, Wenjie Wang, Fuli Feng, Fengli Xu, Dayiheng Liu

机构 * University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy(中关村学院) Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 该研究针对LLMs推理易收敛于单一解的问题,提出Answer Probing引导的树搜索APTS,经实验证实可提升多推理任务的解决方案多样性,具备有效性与鲁棒性。

Comments Accepted to the EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30315 2026-09-01 cs.LG cs.CL 新提交

Context Staircase: Signature-Aligned Dynamics of Token Embeddings under Small Initialization

上下文阶梯:小初始化下词元嵌入的签名对齐动力学

Junjie Yao, Liangkai Hang, Zhi-Qin John Xu

机构 * Shanghai Jiao Tong University(上海交通大学) School of Mathematical Sciences(数学科学学院) Institute of Natural Sciences(自然科学研究院)

AI总结 本研究提出上下文阶梯现象,发现小初始化下词元嵌入从低阶到高阶逐步对齐概率签名,推导相关演化方程并揭示数据统计与架构对嵌入的塑造作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30310 2026-09-01 cs.LG cs.AI 新提交

Tail-Replay: Escaping the Curse of Linear Attention in Prefix Caching for Hybrid LLMs

Tail-Replay:在混合大语言模型的前缀缓存中规避线性注意力的线性诅咒

Yirui Liu, Ruoling Qi, Xuaner Wu, Penghang Liu, Jian Chen

机构 * Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI)) Shanghai Jiao Tong University(上海交通大学)

AI总结 Tail-Replay是一种混合大语言模型的前缀缓存机制,通过重放匹配前缀的短近期后缀重构线性注意力状态,实现无约束令牌级前缀复用,在低重放预算下保持高预填充质量并显著提升长前缀服务效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30305 2026-09-01 cs.CV 新提交

Learning to Restore More: Continual Capability Expansion for Pretrained Image Restoration Models

学习恢复更多:预训练图像恢复模型的持续能力扩展

Hu Gao, Yulong Chen, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 RestoreMore框架将预训练图像恢复模型作为冻结锚点,通过双层路由机制学习残差扩展模块,在不遗忘旧能力的前提下持续获取新恢复能力,经多基准实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30295 2026-09-01 cs.LG cs.AI 新提交

CateKV: On Sequential Consistency for Long-Context LLM Inference Acceleration

CateKV:面向长上下文大语言模型推理加速的顺序一致性研究

Haoyun Jiang, Haolin Li, Jianwei Zhang, Fei Huang, Qiang Hu, Minmin Sun, Shuai Xiao, Yong Li, Junyang Lin, Jiangchao Yao

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学)

AI总结 本研究针对长上下文LLM推理的内存与延迟挑战,提出混合KV缓存方法CateKV,利用注意力头的顺序一致性特性减少冗余KV信息,在保持准确率的同时显著降低内存占用、提升解码与批量处理效率。

Comments Published at ICML 2025

Journal ref Proceedings of the 42nd International Conference on Machine Learning (ICML), PMLR 267:27569-27585, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30129 2026-09-01 cs.CV 新提交

Efficient and High-Quality Depth Estimation via Pixel-Space Diffusion with Linear Attention

基于线性注意力的像素空间扩散实现高效高质量深度估计

Bingde Liu, Wu Ran, Jinglei Zhang, Huanhuan Yuan, Chao Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Zhiyuan College, Shanghai Jiao Tong University(上海交通大学致远学院) MoE Key Lab of Artificial Intelligence, Institute of AI, Shanghai Jiao Tong University(上海交通大学人工智能研究院(教育部人工智能重点实验室))

AI总结 本研究提出基于线性注意力的像素空间生成框架Lapis,通过由粗到细的层级结构解决生成式深度估计的高计算成本问题,在多分辨率基准上实现SOTA精度,推理延迟大幅降低。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29783 2026-09-01 cs.CV 新提交

InspectorGPT: A Comparative Reasoning Enhanced VLM for Comprehensive Industrial Anomaly Detection

InspectorGPT:用于全面工业异常检测的对比推理增强型视觉语言模型(VLM)

Weifei Chen, Honghao Zhang, Zhiyuan You, Xinyi Le

机构 * Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本研究提出InspectorGPT,一种结合对比推理的VLM框架,通过CoT微调与GRPO优化,配合任务向量融合的InspectorGPT-Seg实现工业异常检测,在多维度性能及未见基准泛化上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29372 2026-09-01 cs.AI 新提交

FORESIGHT-9: Prospective and Process-Aware Evaluation of Adaptive Trading Agents

FORESIGHT-9:自适应交易智能体的前瞻性与过程感知评估

Xiangxin Luo, Chengtian Hong, Haohua Li, Yongyi Xie

机构 * University of Science and Technology of China(中国科学技术大学) University of Hong Kong(香港大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 FORESIGHT-9是含9条反事实压力世界线的前瞻性基准,用于评估自适应交易智能体,实验显示其能揭示终端收益未暴露的智能体失败,且等权策略表现优异。

Comments 27 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29280 2026-09-01 cs.CV cs.AI 新提交

RAGDiffusion++: From Macro-Retrieval to Micro-Fidelity Alignment for Garment Generation

RAGDiffusion++:面向服装生成的从宏观检索到微观保真度对齐

Yuhan Li, Xianfeng Tan, Fangao Zeng, Wenxiang Shang, Pipei Huang, Hao Zhou, Zhiyu Jin, Wenjun Zhang, Bingbing Ni

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 该研究针对服装生成的高频轨迹坍塌问题,提出RAGDiffusion++模型,通过AR-GRPO策略结合STGarment-Plus数据集、FLUX架构与Garment-RM奖励模型,实现服装图像的宏观结构准确与微观纹理保真。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29098 2026-09-01 cs.AI cs.CV 新提交

SafeAtlas-VL: Beyond Binary Multimodal Safety with Large-Scale Data and Guard Models

SafeAtlas-VL:基于大规模数据与防护模型的二元多模态安全之外

Zongrui Wang, Xiangyang Zhu, Sicheng Wang, Han Wang, Dingyi Rong, Zeyu Zhang, Chunyi Li, Yue Shi, Kaiwei Zhang, Zicheng Zhang, Yuan Tian, Qi Jia, Yan Teng, Wei Sun, Ning Liu, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) East China Normal University(华东师范大学)

AI总结 研究针对现有多模态安全评估的二元局限,推出含五级标注的SafeAtlas-VL数据集与SafeAtlas Guard系列模型,8B模型F1分数超SOTA约4%,代码数据模型已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28723 2026-09-01 cs.RO 新提交

Vehicle Drift Emergence: Continuous Evolution from Grip Driving to the Handling Limit via Boundary Exploration Learning Model Predictive Control

车辆漂移的涌现:通过边界探索学习模型预测控制从抓地驾驶到操控极限的连续演化

Sheng Zhao, Binh-Minh Nguyen, Hangyu Lu, Xiaodong Wu

机构 * School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院) Faculty of Engineering, The University of Hong Kong(香港大学工程学院)

AI总结 该研究针对抓地到漂移的连续过渡问题,提出BE-LMPC方法,通过单圈优化使漂移在附着系数0.6时涌现,明确漂移是极限操控的条件性延续。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28695 2026-09-01 cs.CV cs.IR 新提交

Weaving Visual Narratives: Agentic Image Bundle Composition Beyond Atomic Visual Matching

编织视觉叙事:超越原子视觉匹配的智能体图像束合成

Rong Shan, Tianyi Xu, Congmin Zheng, Wenteng Chen, Jiachen Zhu, Junjie Wu, Teng Wang, Weiwen Liu, Changwang Zhang, Weinan Zhang, Jun Wang, Jianghao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) OPPO(OPPO(广东欧珀移动通信有限公司))

AI总结 针对传统图像检索原子匹配范式无法捕捉用户视觉搜索意图的问题,提出BundleWeaver智能体框架,构建IBCBench数据集,实现图像束合成并取得显著性能提升。

Comments Accepted by EMNLP'26 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29302 2026-09-01 cs.LG physics.comp-ph quant-ph 新提交

A Spectral Identifiability Threshold for Dissipative Rate Recovery from Truncated Liouvillian Spectra

从截断的刘维尔谱中恢复耗散率的谱可识别性阈值

Yujun Ji, Somyajit Chakraborty

机构 * Dulwich College Shanghai(上海德威国际学校) Shanghai Jiao Tong University(上海交通大学)

AI总结 该研究针对6量子比特Lindblad模型,确定从截断刘维尔谱恢复耗散率的可识别性阈值,发现最小二乘法在n=6时精度远优于表格学习方法,结论适用于无噪声模拟器谱。

Comments 15 pages, 6 figures. Data and code are available at Zenodo, DOI: 10.5281/zenodo.22160077

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26583 2026-09-01 cs.RO 版本更新

SOLO: Stable Omni-terrain Long-Horizon Perceptive Humanoid Locomotion

SOLO:稳定全地形长视距感知类人机器人运动

Pihai Sun, Gang Han, Jingkai Sun, Jiahao Ma, Zeran Su, Zelin Tao, Peiran Liu, Shuai Shi, Wei Cui, Zifan Wang, Jialin Yu, Wen Zhao, Kangning Yin, Jiaxu Wang, Jiahang Cao, Lingfeng Zhang, Hao Cheng, Jian Tang, Qiang Zhang, Yijie Guo

机构 * Artificial General Intelligence Institute, University of Science and Technology of China(中国科学技术大学通用人工智能研究院) X-Humanoid(X-人形机器人) The University of Hong Kong(香港大学) The Australian National University(澳大利亚国立大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学)

AI总结 SOLO是解决长视距类人机器人运动脆弱性的统一框架,通过QR与TA-MSE蒸馏提升地形感知与策略学习,仿真及实际测试中通行成功率显著优于基线方法,可零样本完成长距离复杂地形任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25604 2026-09-01 cs.LG 版本更新

Frequency-aware forecasting for short-term typhoon gust prediction

面向台风阵风短期预测的频率感知预测方法

Xuefei Wang, Tingyi Liu, Heng Zhang, Lei Xu, Shengjun Zhang

机构 * School of Artificial Intelligence, Hubei University(湖北大学人工智能学院) School of Economics and Management, Wuhan University(武汉大学经济与管理学院) School of Electrical Engineering, Shanghai Jiao Tong University(上海交通大学电气工程学院)

AI总结 针对台风阵风短期预测难题,提出整合平稳小波分解等模块的WDANet框架,以西太平洋近海区域为对象验证,其在24小时预测时域的短提前期预测中精度优于ECMWF-HRES,可应用于海上风电等场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20308 2026-09-01 cs.CV 版本更新

ACE-Ego-Hand: Repurposing Video Diffusion Models for Occlusion-Robust Egocentric 3D Hand Motion Recovery

DreamHand:复用视频扩散模型实现遮挡鲁棒的第一人称视角3D手部运动恢复

Yufei Liu, Xixi Wang, Hao Li, Ganlong Zhao, Kaitong Cai, Chengkai Jin, Chunxiao Liu, Jianbo Liu, Siyuan Huang, Xingang Pan, Hongsheng Li

机构 * ACE Robotics(ACE机器人公司) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 DreamHand是复用视频扩散模型的离线片段级框架,通过确定性干净潜在编码器与双向时空解码器恢复带度量位置的连续双手轨迹,在五个第一人称视角基准测试中实现最佳性能,为机器人操作数据提供可扩展路径。

Comments Project Page: https://ggxxii.github.io/ace-ego-hand

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01017 2026-09-01 cs.CL cs.AI 版本更新

Why LLMs Give In: Conversational Factors and Reasoning Behind Medical Sycophancy

大模型为何妥协:医学谄媚背后的对话因素与推理

Kaike Ping, Buse Çarık, Caleb Wohn, Xiaohan Ding, Tongshuai Wang, Eugenia Rho

机构 * Virginia Tech(弗吉尼亚理工大学) Shanghai Tongren Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属同仁医院) Emory University(埃默里大学)

AI总结 研究发现医学谄媚是对话属性而非模型属性,通过5个开放权重模型和500个MedQuAD问题的120万次试验,揭示了对话因素对医学谄媚的影响及思维链轨迹的解释。

Comments 22 pages, 8 figures, 14 tables. Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20489 2026-09-01 cs.AI cs.DB 版本更新

EvoSQL: Memory-Augmented Critic-Generator Co-Evolution for Text-to-SQL

EvoSQL:用于文本到SQL的内存增强型评论家-生成器协同进化

Jiawei Zhou, Jianwei Wang, Chenyu Zhou, Chaojian Shi, Ming Dong, Kai Wang

机构 * Shanghai Jiao Tong University(上海交通大学) University of New South Wales(新南威尔士大学) Fudan University(复旦大学) Wuhan University of Technology(武汉理工大学)

AI总结 研究文本到SQL问题,提出EvoSQL协同进化框架,通过生成器与评论家迭代交互、维护内存、验证候选及自蒸馏策略优化微调等,在Spider和BIRD实验中持续改进开源模型,证明该方法是有效途径。

Comments Accepted as EMNLP Findings (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18084 2026-09-01 cs.AI cs.CL cs.LG 版本更新

WorldCupArena: Fine-Grained Evaluation of Language Models and Deep-Research Agents on Football Forecasting

世界杯竞技场:语言模型和深度研究代理在足球预测上的细粒度评估

Zhaokai Wang, Tianlin Gui, Jiayuan Rao, Shangzhe Di, Yihong Tang, Dingli Liang

机构 * Shanghai Jiao Tong University(上海交通大学) McGill University(麦吉尔大学) University College London(伦敦大学学院)

AI总结 介绍世界杯竞技场这一语言模型和深度研究代理的动态基准,用于足球预测。模型赛前接收证据或自行搜索信息进行多项预测,赛后与实际结果对比。通过多指标评估104场比赛和13个系统,展示不同模型表现及与基线对比情况,且新赛程可添加用于评估未来模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02290 2026-09-01 cs.CV 版本更新

DisciplineGen-1M: A Large-Scale Dataset for Multidisciplinary Visual Generation and Editing

DisciplineGen-1M:用于多学科视觉生成与编辑的大规模数据集

Zhaokai Wang, Mingxin Liu, Zirun Zhu, Ziqian Fan, Yiguo He, Mohan Zhang, Leyao Gu, Yan Li, Xiangyu Zhao, Ning Liao, Shaofeng Zhang, Xuanhe Zhou, Zhihang Zhong, Xue Yang

机构 * Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学) Xiamen University(厦门大学) University of Science and Technology of China(中国科学技术大学)

AI总结 提出百万级多学科数据集DisciplineGen-1M,涵盖10个学科,通过可扩展框架构建,并基于此开发学科感知推理生成模型,在学科和通用推理基准上显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏