多任务能力」共找到 7228 篇相关文章

新闻资讯7

顶模 Fable 5.1发布,到底强了少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和图像任务表现优,用户更偏好其生成图像。

AIGC开放社区
推荐文章8

游戏研发中的 AI 转型:网易 Agent 系统与知识工程实践

本文整理自网易游戏高级技术经理林香鑫分享,其团队通过代码知识谱图构建、 agent RAG 召回等技术打造超级助手,在业务场景落地效果好。还介绍知识工程、 Agent 赋能代码编写、AI 审查等实践及未来展望。

AI前线
产品应用7

从聊天窗口到 Agent 控制台:一次 AI 编程协作范式的转移

作者分享了从单 Agent 协作到 Agent 协作的编程范式转变。当前主流 AI 开发为单 Agent 协作,效率低,作者设计了 Mexus 工具,解决 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。

阿里云开发者
算法论文8

告别通用具身模型崇拜:具身智能走向异构策略编排

当VLA、WAM等机器人控制策略在各自任务中表现出色,如何为子任务匹配合适策略成完成复杂长时序任务关键。RoboHarness解决异构策略协同难题,通过协同调用策略提升成功率。

机器之心
开源动态8

开源白嫖!微软这个开源 Agent,让 AI 帮你点按钮、填表格、跑步流程(还可跨设备)

微软开源智能自动化框架 UFO,主线是 UFO³(Galaxy 设备编排)+ UFO²(Windows 桌面 AgentOS)。能将任务拆分执行,解决跨应用、步骤甚至跨设备任务难题,有种功能亮点。

小华同学ai
新闻资讯7

直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?

为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。

深度学习自然语言处理
推荐文章8

Anthropic:这样构建Agent,性能提升90%!

Anthropic分享从0到1构建智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货,涵盖架构设计、Prompt工程等。智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务

探索AGI
算法论文8

都在卷「让大模型循环几遍」,这个7B模型LoopCoder v2说:循环 1 次就够了

一项新研究表明,7B小模型LoopCoder v2在正常计算外循环一次,就能在SWE - bench Verified基准上大幅提分。继续增加循环次数,性能反而下降。研究还算了‘收益 - 成本’账,给出选择循环次数的诊断方法。

AIGC开放社区
开源动态8

Qwen3-ASR开源:够稳定,能流式,语言!

今日正式开源Qwen3-ASR系列模型,含两个语音识别与一个语音强制对齐模型,支持语种。依托创新技术实现精准稳定识别,1.7B模型场景达SOTA,0.6B兼顾性能效率,强制对齐模型精度超传统模型。

千问Qwen