「代理任务」共找到 2140 篇相关文章
ICML 2025 Spotlight | 快手、南开联合提出模块化双工注意力机制,显著提升多模态大模型情感理解能力!
情智兼备是人工智能发展方向,但多模态情感数据语义复杂,建模跨模态关联是挑战。快手可灵团队与南开提出模块化双工注意力范式,构建‘摩达’模型,在多任务测试中性能提升,成果被 ICML 2025 收录。
√N并行+84倍计算加速!英伟达港大全新图像注意力:空间结构都保留
英伟达、港大等研究人员提出新型视觉注意力机制GSPN,通过线性扫描和稳定性 - 上下文条件处理图像空间结构,降低计算复杂度至√N量级,在多视觉任务达先进水平,生成16K图像加速超84倍。
马斯克的 Grok Bot 正在吞掉电脑,买 Mac mini 的事可以先缓缓
重度使用 Codex 大半年,电脑不堪重负,Agent 任务增多让本地电脑成瓶颈。Grok Bot 将 Agent 工作搬到云端,配云电脑,解决本地硬件难题,还为 Bot 分配独立屏幕,实现人机电脑分工。
大模型公司不搞浏览器搞Agent,实测找到原因了
文章实测阶跃星辰桌面Agent小跃,它能操作命令行,可自然语言驱动计算机功能,有悬浮球形态,能联网、搜索、处理表格等,还支持复用操作、定时任务,但也存在速度慢等不足。
一篇120页AI4Research(科学研究AI)最新系统性综述
为填补AI在科学研究应用缺乏全面综述的空白,提出AI4Research调查。其主流流程和分类分五个关键领域,各领域细分任务,凸显AI在研究中多样角色,还介绍多学科应用。
The Batch: 968 | Muse Code 想获取你的数据
Meta推出Muse Code编码框架及Muse Spark 1.2模型,有不同输入输出、功能和性能表现。提供不同档位价格,贡献者档位低价但数据用于训练。测试显示其单任务成本低,Meta此举或为获取编码训练数据。
真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????
文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持多模型,有任务流程和多Agent协作功能,还分析适用人群并给出启动方法。
Hyperagents:AI学会如何自我改进
近日,Meta发布Hyperagents论文引关注。它尝试解决AI能否自我改进改进方式的问题,核心创新是‘元认知自我修改’,实验在多领域表现出色,还涌现元级别改进且能跨领域转移,但有安全风险。
英伟达世界模型再进化,一个模型驱动所有机器人!机器人的GPT时刻真正到来
英伟达GEAR实验室提出DreamZero,是基于预训练视频扩散骨干网络的世界动作模型,有140亿参数,能让机器人通过文本提示完成未见任务。它解决了传统模型问题,在多方面表现出色,代码已开源。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。