arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

行业趋势

共 149 篇

从最新学术论文中提炼值得关注的技术进展、实验结果和产业信号。

2607.28263 cs.CL

清华腾讯提出CoMem,128K上下文显存降至18.26GB

清华大学与腾讯提出长上下文记忆方法CoMem。在单张96GB英伟达H20上处理128K上下文时,一组不使用适配器的效率测试显示,峰值显存由完整上下文方案的89.36GB降至18.26GB,预填充时间由15.014秒缩短到1.917秒,加速7

清华大学、腾讯等
清华腾讯提出CoMem,128K上下文显存降至18.26GB文章封面
2607.28466 cs.AI

复旦浙大微软用28万份肠镜报告训练医疗AI

复旦大学、浙江大学、帝国理工学院和微软亚洲研究院等机构发布肠镜视觉语言模型EndoCLIP。团队从280476份常规肠镜记录中恢复出125756组病灶图文配对,用医生日常书写的报告替代昂贵的逐帧人工标注。

浙江大学、微软亚洲研究院等
复旦浙大微软用28万份肠镜报告训练医疗AI文章封面
2607.28367 cs.AI

AI智能体被判失败的案例中,15.3%可能判错了

研究人员重新检查了150条被公开基准判定为失败的电脑操作轨迹,发现其中15.3%的“FAIL”结论有问题:10.7%属于评测器漏判,4.7%是任务或环境本身已经损坏。

佐治亚理工学院、北卡罗来纳州立大学、北卡罗来纳大学教堂山分校、马凯特大学等
AI智能体被判失败的案例中,15.3%可能判错了文章封面
2607.28227 cs.AI · cs.CV

阿里发布Qwen-UI-Agent,手机实机任务成功率92.2%

阿里巴巴MAI-UI团队发布Qwen-UI-Agent技术报告,把手机、电脑、网页和DeepSearch任务放进同一套GUI智能体体系。论文报告的27B版本在MobileWorld-Real实机手机测试中取得92.2%的成功率,在Andro

阿里巴巴MAI-UI团队等
阿里发布Qwen-UI-Agent,手机实机任务成功率92.2%文章封面
2607.28623 cs.AI · cs.RO

加州理工让宇树G1躲避球,20次投掷躲过19次

加州理工学院研究团队把一套名为PAC-MAN的控制方法部署到宇树Unitree G1上。研究人员从正面向机器人手掷20次球,G1躲过19次,没有摔倒,实机成功率为95%。

加州理工学院等
加州理工让宇树G1躲避球,20次投掷躲过19次文章封面
2607.28607 cs.CL

Google团队发现,压制AI意识自述会连带改变价值回答

让大模型避免声称自己“有意识”,是当前AI安全训练中的常见目标。Google Paradigms of Intelligence团队与多所高校的一项研究发现,这类约束可能同时压低模型对动物、自然物和技术物体的心智归因,并改变它在宗教、道德和

Google Paradigms of Intelligence团队等
Google团队发现,压制AI意识自述会连带改变价值回答文章封面
2607.28617 cs.AI · cs.CL

88款商业AI提示词被审计,四成产品出现用户利益冲突

88款商业AI产品的系统提示词被放在同一套标准下审查。研究团队共检查3249条开发者指令,约40%的产品至少含有一条损害用户利益的要求,只有23.9%的产品覆盖全部八项用户保护维度。

斯坦福大学、卡内基梅隆大学、麻省理工学院、牛津大学等
88款商业AI提示词被审计,四成产品出现用户利益冲突文章封面