长任务智能体」共找到 5286 篇相关文章

开源动态8

谷歌北大联手学术版Banana爆火,论文图表100%精确生成

谷歌与北大联手推出学术版PaperBanana,能100%精确生成论文图表,美观度和逻辑清晰度超原版。它由5个智能体分工协作,经实验在各维度超越传统基线方法,已在GitHub获上千star。

量子位
算法论文8

博士学位答辩PPT分享 | Scalable Operation-aware Aerodynamic Design

杨奥博博士毕业于香港科大,期研究多学科优化方法在飞行器等设计中的应用。其博士论文提出可扩展的、基于任务感知的气动设计框架,贯通关键环节,形成一体化方法体系,有多项创新成果。

力学与人工智能
算法论文8

Transformer已死?DeepMind正在押注另一条AGI路线

谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。

新智元
新闻资讯7

实锤了,Meta 正式收购 Manus

近日,Manus 官网官宣“加入 Meta”。Manus 致力于打造通用 AI Agent,能处理复杂任务。这是笔待完成交易,未披露条款。Meta 在 AI 落地应用缺具象答案,收购它或是选已跑通逻辑的产品融入底层。

MacTalk
算法论文8

图像编辑缺训练数据?直接从视频中取材,仅用1%训练数据实现近SOTA效果

百度研究人员提出将图像编辑视为退化的时间过程,Video4Edit利用视频预训练模型知识迁移,仅用主流编辑模型约1%监督数据,在图像编辑任务达近SOTA效果,解决数据稀缺与权衡难题。

量子位
产品应用7

把 Nano Banana/Gemini 3 Pro 榨干!这几点你必须知道

Gemini 3 放出 Pro 和 Nano Banana Pro 两条线,前者主打上下文、多模态推理,后者专攻像素级生成。文章提炼精髓,给出“通用 + 像素”双模实战笔记,介绍两者使用要点及创意场景实测。

PaperAgent
产品应用7

AI+直播的新玩法! StreamDiffusionV2让创意零延迟

生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。

带你学AI
新闻资讯8

马斯克“巨硬计划”新动作曝光!从0建起算力集群,6个月完成OpenAI&甲骨文15个月的工作

马斯克“巨硬计划”新动作曝光,6个月从0建起算力集群,完成200MW供电规模。“巨硬”将基于Grok构建多智能体系统,自动化完成软件开发。Colossus II为此提供算力,马斯克亲自督战。

量子位
产品应用7

Claude Code 里那些奇奇怪怪的词是什么?

作者用Claude Code调查其处理任务时冒出怪词的原因,发现这些词存于`UK5`对象,有88个动词 -ing 形式,硬编码在客户端。词中有常规、怪词、造词、俚语等,增添幽默。

AGI Hunt
新闻资讯7

OpenAI新Agent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先

昨日凌晨,OpenAI推出ChatGPT Agent新功能,标志其踏入“智能体人工智能”领域。虽官方称该功能性能先进,但实际效果有局限。海外网友对比发现,它被中国24人初创团队产品Genspark等碾压。

InfoQ