「科学多任务学习」共找到 3304 篇相关文章
OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?
今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。
AI集体“听不懂”!MMAR基准测试揭示音频大模型巨大短板
MMAR基准测试对30款音频相关模型进行测试,结果显示,多数开源模型面对复杂音频推理任务远未达实用水平,音乐任务中所有模型表现不佳,且有显式推理能力的模型表现更优。
最新推荐系统论文PDF列表-及「深度学习推荐系统2.0」所有参考文献
这是「王喆的机器学习笔记」资源帖,应读者建议更新推荐系统论文repo。收录在推荐系统发展史上有重要作用及业界最新进展的论文,还列出具体目录,方便扩展阅读。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
ICCV 2025 | HERMES:首个统一3D场景理解与生成的世界模型
本文介绍HERMES,首个统一3D场景理解与生成的世界模型。它由华中科技大学等团队合作研发,通过共享LLM驱动两大任务,解决了输入处理和任务融合难题,实验效果显著,为自动驾驶提供新范式。
GLM-5.2 正式发布:开源之王来了,摸到了Opus-4.8
GLM-5.2正式发布,主打长程任务能力,有1M token上下文窗口且完全开源。它在长程任务基准评测中表现出色,与顶级闭源模型差距缩小,还解决了超长上下文计算成本问题,同时应对了模型‘作弊’情况。
AI4S又一瓶颈被攻克:两个AI「吵架」,让科研代码部署成功率突破95%
科学软件大多难直接运行,制约AI4S与Agentic Science发展。Deploy - Master应运而生,是一站式自动化工作流。Search Agent筛选工具,Build Agent用双模型辩论机制使部署成功率超95%,为科学智能体交互打基础。
被 AI 大厂逼至绝望,这帮欧洲人发起了一场“科学复兴运动”
AI前沿成果被科技巨头锁在“黑箱”,欧洲科学家、工程师等发起“科学复兴运动”成立LAION。他们构建开放数据集,训练出表现优异的模型,还进行“爱丽丝梦游仙境”研究测试大模型,探讨推理模型发展方向。
智源悟界·RoboBrain Orca:多模态表征世界模型
智源研究院悟界·RoboBrain Orca团队发布技术报告,探索让模型学习世界表征,从‘预测下一个词’走向‘预测下一状态’。它通过多模态数据学习,经实验验证有效,虽处早期阶段,但提出值得扩展的方向。
高中辍学,22岁入职OpenAI成为「研究科学家」,他是怎么做到的?
文章讲述22岁高中辍学的Gabriel Petersson入职OpenAI成为研究科学家的故事。对比传统学习路径,介绍他自顶向下的学习法,分析其可行原因、适用场景,还给出行动建议,指出学位价值在改变。