多任务能力」共找到 7228 篇相关文章

开源动态8

首个面向科学任务、真实交互、自动评估的模态智能体评测环境,ScienceBoard来了

ScienceBoard是首个面向科学任务、真实交互、自动评估的模态智能体评测环境。它集成领域科研软件,构建科研任务集合,评估智能体在科学任务上的表现,发现现有模型在科研工作流中远未成熟。

机器之心
开源动态7

单Agent时代结束,AI们开始组团上班

月之暗面发布并开源K2.6,重点升级代码能力Agent协作的“Agent集群”能力。K2.6在Artificial Analysis上取得全球开源第一,实测能并行交付格式成果,还展现出强大的全栈应用开发能力

量子位
算法论文7

ICCV2025 | 视图生成新范式-利用自回归模型探索视图生成

本文介绍自回归生成视图图像方法 MVAR,能从先前视图提取引导信息增强一致性,拉近与基于扩散方法的图像质量差距。解决了模态条件控制和数据有限问题,展示出强指令遵从与视角一致性。

机器之心
产品应用7

10个Agent一键组队:并行智能体协作,端到端交付从24h缩减到4h!

过去写代码靠程序员手动输入,即便有Copilot等工具,仍需人主导。并行代理出现后,程序员可调用个AI并行工作,将端到端交付时间从24h缩减到4h,思维方式也需转变,对工程师能力要求也有变化。

新智元
新闻资讯7

微软最新揭秘:「话痨实习生」AI助手,到底能帮人类做什么?

基于20万微软Copilot使用数据的研究指出,AI能支持研究、写作和沟通任务,但无法完全胜任单一职业所有任务。Copilot执行任务为解释型,写作和信息收集任务满意度高,语言和创作类职业受影响大。

新智元
推荐文章7

LLM遇上表格:4类表示、5大任务、3大机会

文章指出LLM处理表格有任务单一、输入复杂易崩、表示不统一痛点,介绍4种表格输入表示法、5大任务,还发现任务复杂度、输入复杂度及表示统一方面存在新研究机会。

PaperAgent
开源动态8

社区供稿 | 开源模态大模型新突破,书生·万象3.5发布,通用能力、推理能力与部署效率全面升级

2025年8月26日上海AI实验室开源发布书生·万象InternVL3.5,通过创新技术实现推理、部署和通用能力全面升级。它有种尺寸模型,项性能领先,还加强了智能体核心能力,应用场景广泛。

Hugging Face
开源动态7

DeepSeek开源,Agent能力大升级,剧透2026!

DeepSeek昨晚更新并开源V3.2正式版及长思考增强版V3.2-Speciale,亮点是Agent能力进化。一年来它未增模型规模,靠架构优化等提升性能、降低成本,坚持自我路线很稳,V3.2继续提升能力

探索AGI
推荐文章7

Anthropic的智能体,真的有必要吗?

作者曾质疑智能体系统,看了Anthropic对「Claude Research」的说明后有了改观。介绍了智能体系统定义、性能提升、代价,还阐述构建方法、评估方式,公开三个核心提示词及协作模式。

AGI Hunt
开源动态8

谷歌AI Agent刚开源!任务智能体+MCP+谷歌搜索,狂揽9000颗星

今天凌晨,谷歌在官网开源AI Agent框架Gemini CLI,将Gemini大模型融入终端。它能调用视频和图像模型,集成MCP、谷歌搜索等功能,还集成超强编码助手,刚开源就在Github超9000颗星。

AIGC开放社区