多任务操作」共找到 5615 篇相关文章

算法论文8

从Debugger到Developer : 低代码时代新基准NoCode-bench,SWE-Bench作者力荐

浙江大学牵头联合机构推出全新评估基准NoCode - bench,直面自然语言驱动功能添加任务,发现当前最佳LLM成功率仅两成。它构建严谨,任务挑战大,指明AI软件开发改进方向,且已开源。

机器之心
产品应用8

WorkSwarm:引领办公智能体新范式,让AI从一个助手,进化为一支与你并肩作战的团队

办公智能体成热门赛道,openJiuwen推出WorkSwarm蜂群办公智能体,将智能体协作引入个人办公场景。它有单Agent和集群两种模式,能自主组队、共享成果等,还支持平台,openJiuwen社区也在招募开发者。

InfoQ
7

苹果画的饼谷歌率先搞定!Gemini全面进驻全家桶,连鼠标都AI上了

在Android Show独立发布会上,谷歌推出诸新品,核心是将Gemini嵌入安卓底层,还带来AI鼠标光标、Googlebook等。Gemini能跨应用执行任务,Googlebook为其量身打造,谷歌这波操作像把苹果画的饼烙好端上桌。

量子位
新闻资讯8

ChatGPT「群聊」功能正式开启内测

OpenAI正式在部分地区试点ChatGPT群聊,覆盖移动端和网页端。该功能可用于生活娱乐、工作学习等场景,由GPT - 5.1 Auto模型驱动,操作简单,还考虑了隐私与控制。

AI寒武纪
产品应用8

X爆火Overleaf科研辅助神奇PaperDebugger

当下学术写作借助大语言模型辅助时,流程繁琐且上下文易丢失。新加坡国立大学团队推出的 PaperDebugger 是基于插件的智能体系统,寄生在 Overleaf 编辑器内,可完成任务,解决现有工具不足。

深度学习自然语言处理
开源动态8

开源Agent新标杆:通义WebSailor榜夺魁,挑战OpenAI高难度Agent基准BrowseComp

信息爆炸时代,传统搜索引擎难满足需求,开源Web Agent在极端复杂任务表现不佳。阿里巴巴通义实验室推出WebSailor,通过创新数据构造和训练方法,在BrowseComp等挑战上取得突破,缩小与顶级封闭系统差距。

机器之心
算法论文8

ETT:打破原生模态学习视觉瓶颈,重塑视觉tokenizer优化范式

本文由机构联合完成,针对传统视觉 tokenization 方法优化与下游任务训练割裂问题,提出 ETT 调优方法。它实现联合优化,在模态理解、生成、重构任务表现出色,虽有局限但带来新突破。

机器之心
算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇样性,刷新项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在基准提升准确率,还将在模型上增益,代码即将开源。

量子位
推荐文章7

Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!

近期Anthropic分享构建智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用步骤搜索动态查找信息。

PaperAgent
开源动态8

Chain-of-Agents: OPPO推出通用智能体模型新范式,榜单SOTA,模型代码数据全开源

OPPO个性化AI实验室团队推出智能体推理范式CoA及模型AFM,解决传统智能体系统通信效率低等问题。AFM在近20项测试中刷新记录,降低推理成本,还介绍了架构、数据构建等,也指出待探索方向。

机器之心