「东南大学」共找到 480 篇相关文章
用SFT打出RL的效果?微软联合提出高效后训练算法
大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面的差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化超 SFT、效率超 RL。
CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测
香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。
智能流体力学专题研讨会特邀报告2|肖恒:turbX——基于多目标学习的通用数据驱动湍流建模
2026年8月,第十四届全国流体力学学术会议在山东青岛举行,智能流体力学专题研讨会展示了人工智能与流体力学交叉研究进展。本次聚焦《turbX:基于多目标学习的通用数据驱动湍流建模》报告,研究来自斯图加特大学相关机构。
让扩散模型「可解释」不再降质,开启图片编辑新思路
过去三年扩散模型席卷图像生成领域,但可解释性研究是‘黑箱’,且现有尝试常致性能下降。香港中文大学与上海人工智能实验室团队提出TIDE框架,可解释且不降质,还带来新图像编辑方式。
HOIDiNi:一句话驱动虚拟人高精度操作物体
特拉维夫大学提出HOIDiNi,这是文本驱动的扩散框架,用于生成人体 - 物体交互动作。它引入扩散噪声优化,能兼顾真实感与物理正确性。不过它泛化能力待拓展、生成速度慢,未来需提升效率等。
架构解耦是统一多模态模型所必须的吗?全新AIA损失:No
香港中文大学 MMLab 和美团研究者思考架构解耦是否为统一多模态模型必须,推出 AIA 损失。研究发现架构解耦未解决任务冲突,AIA 能提升模型性能,减少数据配比问题。
高智商 ≠ 高财商?50天实盘测试:LMArena 高分王者也可能是「韭菜」
伊利诺伊大学厄巴纳 - 香槟分校团队开发 LiveTradeBench,让大模型在真实金融市场交易,检验其能力。它全面开源,有实时数据、组合决策等创新,50 天实测揭示模型财商差距。
大模型「越用越快」!SpeedupLLM首次验证,大降56%推理预算
Emory大学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。
arXiv脱离康奈尔,正式单飞
arXiv 7 月 1 日脱离康奈尔大学,以独立非营利组织 arXiv, Inc. 开启新篇章。功能暂不变,新架构由董事会治理。独立因财务、体制和 AI 压力,承诺免费但未明确是否引入付费功能。
在「想象」中练就真机能力:RISE,让VLA强化学习告别真机试错
香港大学李弘扬老师团队提出 RISE 框架,通过组合式世界模型让机器人在虚拟空间强化学习,解决传统 VLA 模型落地难题,在长程任务中性能提升显著,重新定义智能体理解世界的方式。