多任务能力」共找到 7314 篇相关文章

算法论文8

迈向原生全模态AI智能体:人大&小红书发布OmniGAIA新基准

中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。

PaperAgent
新闻资讯8

Agent取代App、机器人“盲区”、RAG成本失控……2026 奇点智能技术大会首批议题发布

4月17 - 18日,CSDN与奇点智能研究院联合主办的「2026奇点智能技术大会」将在上海举行。大会首次剧透部分核心议题,覆盖AI全生命周期各层面,位技术专家将分享实战经验与前沿探索。

AI科技大本营
算法论文8

训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD

清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在任务表现佳,降本增效,有新范式。

量子位
开源动态8

Qwen3-VL-Embedding系列上新:探索统一模态表征与排序

2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理模态输入,在任务达业界领先,还介绍了特性、评测及使用方法。

通义千问Qwen
新闻资讯8

2025最大AI赢家的凡尔赛年度总结,哈萨比斯Jeff Dean联手执笔

谷歌由Jeff Dean和哈萨比斯牵头完成2025年AI年度总结与趋势展望报告。报告梳理八大研究方向,展示谷歌在模型能力、产品集成、创造力赋能等领域进展,强调安全责任与开放合作。

量子位
产品应用7

Claude Skills|将 Agent 变为领域专家

今年10月,Anthropic推出Claude Skills能力,可在Claude产品使用。它是向Agent注入内部知识的标准化方案,与MCP可协同工作,还介绍了实现Agent Skills的方法及主动式智能导购AI助手构建。

阿里云开发者
新闻资讯8

真机RL!最强VLA模型π*0.6来了,机器人在办公室开起咖啡厅

美国具身智能创业公司PI发布最新机器人基础模型π*0.6,新方法大幅提升具身智能成功率与处理效率。其开发的Recap方法从经验数据获训练信号,使模型能执行项真实世界应用。

机器之心
算法论文8

AI又封神了!华人新作直出憨豆+《猫和老鼠》,平行宇宙对上戏了

新智元报道,阿联酋MBZUAI团队论文提出CCE和CCA机制,解决AI让不同风格角色同框时的“风格错乱”问题。让憨豆、汤姆等角色自然互动,模型在角色任务指标上领先,或重写虚构边界。

新智元
推荐文章8

为什么说开发者参与鸿蒙生态共建是“恰逢其时”?

文章指出开发者参与鸿蒙生态共建恰逢其时。当前人均设备,鸿蒙打破旧规则,生态加速生长。HarmonyOS开发者技术分论坛展示新机遇,介绍其开发能力、适配方案等,还阐述生态开放性与开源精神。

InfoQ
新闻资讯8

前端危!Gemini 3内测结果获网友一致好评,“有史以来最强前端开发模型”

谷歌下一代旗舰模型Gemini 3未发布便走红,内测结果显示它擅长前端、SVG矢量图生成,模态能力更强。网友实测其在编程、绘图等方面表现出色,疑似谷歌内部文件显示发布时间为10月22日。

量子位