多任务能力」共找到 7228 篇相关文章

产品应用8

松下发布模态大模型,文本、图像、音频随意切换

模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发模态大模型OmniFlow,采用模块化设计、模态引导机制,实验显示其在任务中有卓越表现。

AIGC开放社区
新闻资讯7

继火爆全网的MCP后,Anthropic 推出全新整合功能,Claude再添连接利器

继MCP后,Anthropic推出全新Integrations功能,使Claude能与各种工具和应用无缝连接,提升协作能力,其研究能力也得到增强,新功能在部分计划测试,将惠及更用户,助力高效完成任务

AI寒武纪
推荐文章8

直播预约 | Evaluation论文分享@ICML&ACL2025

2025年6月11日20:00将直播分享Evaluation论文。位嘉宾参与,涉及SyncPL奖励建模、文本事实一致性验证、大模型评测方法等领域论文,涵盖模型优化、基准测试等内容。

深度学习自然语言处理
算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
开源动态8

又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了

Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务模态等方面全面提升。

AIGC开放社区
推荐文章7

独立自主梦太,是国产化的最大阻碍

我国虽建立完整工业体系,但 IT 领域差距大。国产基础组件百花齐放,给上层应用适配带来灾难。美国在基础能力上近乎垄断,大投入保持领先。国内小投入难出好产品,应整合市场。

AI与安全
产品应用8

Spec 退场,skills 上位:Codex 团队的产品方法论变了

文章介绍了OpenAI Codex团队产品方法论的变化,从重视spec转向skills,开发从“描述过程”转向“组织能力”。还谈及Codex app开发、团队协作等,指出模型变强后工作模式转变,职业边界模糊,团队招人看重主动性。

InfoQ
算法论文8

GraphRAG,这次被G-Reasoner统一了

大语言模型在知识密集型任务中存在局限,GraphRAG 也有迁移难题。G - Reasoner 提出统一框架,含 QuadGraph、GFM、LLM 增强推理模块,在性能、泛化、效率上全面领先现有方法。

PaperAgent
开源动态8

功能强到离谱!开源 3D AI 桌面伴侣来了,可直接部署到B站直播间等平台!

开源项目 Super Agent Party 颠覆对‘桌宠’认知,它是 AI 智能体平台,有知识库、联网等能力,可部署到平台。具备无缝能力增强等核心功能,提供种安装选项,应用场景丰富。

开源星探
算法论文8

GPT-5.4 仅 11.36%!当大规模工具生态变成迷宫,LLM Agent 还能完成长程规划吗?

PlanBench-XL 来自 UIUC 团队,将 LLM Agent 放入零售 API 世界,评测其长程规划能力。它考虑真实工具环境挑战,含 327 个任务等,发现数模型规划难、恢复差等问题,并给出改进启示。

深度学习自然语言处理