「任务设计」共找到 3084 篇相关文章
Qwen3.8-Max:编程与办公,全面跃升
今日正式发布Qwen3.8-Max,下周将开源其及Qwen3.8 - 27B模型权重。它参数达2.4万亿,在多方面全面提升。开发者可通过千问AI平台获API服务,性价比高。在编程、办公等场景表现出色,用户反馈良好。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
用Codex做跨境电商:第二章
本章探讨为何选Codex承载跨境电商工作方法。它将多种功能置于同一工作环境,适合跨境卖家沉淀业务资产。Codex不仅能写代码,还能围绕项目完成读材料、写产出、受控执行等任务。
正式开源!motion-anything:免费版 Figma Motion + 无水印动效视频工坊来了
Open Design团队开源motion-anything,这是一款开源动效引擎,让动效活在真实网页上,可随时编辑。自带庞大动效生态,支持多种触发和动法,有视频工坊且无水印导出,还解决了动效领域四大痛点。
ICML 2026获奖论文揭晓:黄高团队获杰出论文,A3C算法获时间检验奖
ICML 2026公布最佳论文奖项,共10篇获奖,涵盖杰出论文奖、杰出立场论文奖等。此次评选严格,经多轮筛选。获奖论文涉及扩散式大语言模型、扩散模型采样算法等多个领域。
黄仁勋:Prompt正在过时,Loop才是新范式
黄仁勋称Prompt正在过时,Loop才是新范式。Loop指设计系统让AI自动下指令、验收,不合格重来。Claude Code和OpenAI Codex已围绕Loop落地产品,还给出了实操指南及发展历程。
豆包 2.1 Pro:属于普通人的代码能力
作者分享用AI写代码的经历,指出豆包2.1 Pro强化Coding Agent端到端交付能力,成本低。还展示用它做的多个案例,如歇后语扭蛋机、文件整理工具等,认为其能解决日常问题,降低Coding门槛。
The Batch: 950 |反数据中心运动持续升温
全美反对新建数据中心的声音不断扩大,人群通过立法表达不满,部分案例还出现暴力行为。反对理由包括电价、能耗等问题,约640亿美元项目被阻或延迟,新一代数据中心正采用更环保设计。
大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力
现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。