「虚拟实验室」共找到 628 篇相关文章
邱锡鹏老师团队发布VehicleWorld:让智能汽车真“智能”
邱锡鹏老师团队发布论文,构建高度仿真的智能座舱虚拟环境VehicleWorld,并提出基于状态的函数调用(SFC)方法。实验显示,SFC大幅提升任务执行准确率和效率,还构建了Vehicle Benchmark进行评估。
一图看透全球大模型!新智元十周年钜献,2025 ASI前沿趋势报告37页首发
新智元十周年峰会发布《2025新智元ASI前沿趋势报告》与《2025新智元ASI产业图谱》,预测2027达ASI临界,智能体全面爆发。报告展示全球大模型格局,中国开源模型表现亮眼,还揭晓了创新大奖。
告别复杂提示词!蚂蚁新方式让AI自动理解你的个性化需求
蚂蚁通用人工智能研究中心自然语言处理实验室提出AlignXplore方法,通过强化学习让AI从用户行为归纳偏好并动态更新。该方法训练分两阶段,支持流式偏好推断,实验表现优异,是大模型个性化新尝试。
面对无解问题大模型竟会崩溃?港中文&华为联合提出首个大模型推理可靠性评估基准
港中文和华为诺亚实验室联合提出ReliableMath基准,探究大模型推理可靠性。提出评估准则,构建含可解与不可解问题的ReliableMath数据集,实验揭示大模型缺陷,还提出提高可靠性的对齐策略。
苹果庞若鸣也被小扎挖走!Meta AI天团开会直接用中文吧
Meta超级AI实验室内部交流可用中文,苹果基础模型团队负责人庞若鸣被其挖走。Meta还从OpenAI和Anthropic各挖一人。目前其AI天团14人名单中9个是华人,苹果AI进展堪忧。
提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交
大语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。
低延时、可交互的音频驱动肖像视频生成框架LLIA
美团提出新型音频驱动肖像视频生成框架LLIA,是低延迟、可实时交互的虚拟形象生成技术。它提出四项核心技术,引入三大核心模块,构建超100小时数据集,在多方面有出色表现。
Veo 3逼真脱口秀爆火全网,网友:彻底超越恐怖谷!Sora已被完爆
Veo 3生成的脱口秀视频全网爆火,人物、场景真实,声音和嘴型能对上,已超越恐怖谷。它或让人类进入‘模糊时代’,还会颠覆游戏、电影、广告等行业,未来AI生成内容或远超非AI内容。
拿到DeepMind、Meta等多家Offer后,她把机器学习求职面试的真相写了出来
牛津大学博士生Silvia Sapora把机器学习求职面试经历原原本本写在博客中。她分享面试准备技巧、心态与谈判策略,提醒一次面试表现不定义研究者价值,该文对求职者或许比题库更有用。
让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务
手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。