任务设计」共找到 3084 篇相关文章

推荐文章8

创业者闭门探讨:Make for Agent ,其实还是 Make for Human

极客公园组织「Make for Agent」主题闭门 Meetup,探讨 Agent 产品做法。交流聚焦 Agent IM、身份、人类介入、商业模式等问题,指出 Agent 需责任型通信、独立身份,产品设计要兼顾人和 Agent 需求,核心是责任设计

Founder Park
产品应用8

国产新模王Qwen3.7-Max,海外开发者已经沸腾了

阿里通义千问团队发布的 Qwen3.7-Max,或为面向 Agent 时代的旗舰模型。它能自主跑 35 小时、完成 1158 次工具调用,内核优化不掉线,多项评测领先,应用场景丰富,已上线且兼容主流框架。

AIGC开放社区
算法论文8

全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点

2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。

机器之心
算法论文8

行为记忆+认知记忆,中科大MemWeaver重构LLM个性化记忆

论文MemWeaver被The Web Conference 2026接收,它聚焦用户从隐式到显式文本交互时个性化生成的升级问题。提出将用户历史升级为层次化记忆,构建行为与认知双记忆模块,主实验表现优,消融实验验证其结构设计关键。

PaperAgent
算法论文8

上海AI Lab新研究:SFT能泛化,只要满足这三个条件

上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。

量子位
开源动态7

英伟达力荐,小团队两个月开源一款「光速级」智能体推理引擎

智能体时代算力需求庞大,LightSeek Foundation 小团队 2 个月打造大模型推理引擎 TokenSpeed,有 TensorRT LLM 性能、vLLM 易用性,受英伟达力荐且已开源,为智能体负载提供近「光速级」推理能力。

机器之心
算法论文8

ICLR 2026 | 救命,手机Live Photo重选封面终于不糊了

vivo 蓝图实验室与南开大学联合发布研究,被 ICLR 2026 接收。该研究定义了 Live Photo 重选封面帧修复任务,提出 LiveMoments 方案,利用原始封面帧作参考提升画质,实验表现优,应用场景广。

机器之心
算法论文8

Monet:赋予多模态大模型如人类一般的抽象视觉思考能力

文章介绍了Monet模型,它实现了训练MLLM直接在连续隐空间思考的方法,内化视觉思考能力。还阐述了多模态模型隐式推理训练的难点,提出SFT+RL训练框架,构建数据集,经测试,Monet提升了视觉推理能力。

机器之心
开源动态7

用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源

browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成图让LLM理解视频,有完整流水线和设计原则,还给出使用方法。

AI寒武纪
新闻资讯8

不卷AlphaFold,OpenAI首个生命科学模型杀出,单项超越95%专家

OpenAI发布首款生命科学模型系列GPT - Rosalind,在RNA预测任务上超越95%人类专家。它针对科研工作流优化,还推出插件连接多数据库和工具,与药企巨头合作,和AlphaFold是互补关系。

新智元