写任务」共找到 2560 篇相关文章

开源动态8

谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元
产品应用7

死磕即梦48小时,我发现了AI公众号封面的懒人密码

作者与即梦Agent死磕48小时,分享AI公众号封面制作经验。介绍垫图法、两个提示词模板,测试提示词反推、语义理解等功能,指出不足,认为即梦像AI作图界拼多多,瑕不掩瑜。

AI产品自由
推荐文章7

Tool-Integrated RL 会是 Agents 应用突破 「基模能力限制」 的关键吗?

文章聚焦AI & Robotics业内要事,探讨Tool - Integrated RL能否助Agents突破「基模能力限制」,还涉及Copilots填产业落地鸿沟、生成式AI重塑软件开发等话题,完整版通讯含多项解读与要事速递。

机器之心
新闻资讯8

海淀105款大模型背后:看这些AI玩家如何抢占内容生产制高点

在北京海淀文化沙龙上,大家探讨AI如何重塑内容生产。海淀有105款备案大模型,占全国五分之一。快手可灵月入超1亿,AI音乐大模型让创作大众化,投资人捕捉到AIGC创业潮,新的内容生产秩序正被改

量子位
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
算法论文8

VerlTool重塑Agentic RL的训练生态

当前LLM像‘缸中的大脑’,缺乏与外界互动能力。新范式ARLT兴起,但构建训练框架面临诸多挑战。VerlTool作为统一、模块化、高效的开源框架应运而生,解决难题,在多任务实验表现出色,推动LLM向智能体转变。

深度学习自然语言处理
算法论文8

港科广×腾讯联手打造《我的世界》神操作,400张截图就能让AI挖矿通关,成本降至5%|EMNLP 2025

港科广与腾讯联合团队提出VistaWise框架,将“跨模态知识图谱+轻量化视觉微调”引入开放世界智能体。实验显示其在“获取钻石”任务表现出色,成果被EMNLP 2025主会录用。该框架以低成本、跨模态为突破口。

量子位
新闻资讯8

波士顿动力 | 人形机器人Atlas ,最新研究进展!

世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。

AINLPer
推荐文章8

在WAIC耳朵听出茧子的「智能体」,是时候系统学一下了

今年世界人工智能大会上,智能体成主角,AI厂商纷纷布局。文章指出人们对AI大模型期望转变,介绍智能体底层逻辑,涵盖工具使用、推理模型、ReAct框架等,还对比先前尝试,探讨智能体能力层次与未来发展。

机器之心
产品应用8

央企出手,让选大模型更容易了!中国移动发布MoMA聚合服务引擎

7月26日,中国移动在世界人工智能大会发布MoMA多模型与智能体聚合及服务引擎。它汇聚优质模型与智能体,为复杂任务提供方案,解决调度、意图理解、成本收益平衡等难题,还应用于灵犀智能体2.0。

量子位