「任务酒馆模式」共找到 2765 篇相关文章
强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升
人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。
养虾时代终结?免部署、7×24小时在线、自进化的“赛博骡子”来了!
全球首个自进化个人AI——MuleRun(骡子快跑)正式发布,免部署、7×24小时在线、可自主进化。它适配个体需求、实现群体智慧共享,能完成多类任务,还保障安全、提供售后。
2026 年,万物皆 Coding Agent 的平台工程新范式(A2A / ACP / MCP / Skill)
过去 DevOps 工具链复杂,如今 AI 重塑其为 Coding Agent。借助 A2A、ACP、MCP 和 Skill,可构建 Agent 网络。文章分析平台工程演进,介绍相关协议,对比编排模式,还给出 Routa 编排架构实践参考。
天选Windows打工AI来了!实测完Claude Cowork国产版:超顶
硅谷Claude Cowork出圈后,国产昆仑万维Skywork桌面版登场。它支持模型自由切换、海量Skills集成,实测任务完成率高、速度快、有自纠错机制,依托上下文能力升级,是国产AI创新力量的展示。
NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet单步生图FID进入1.0时代!
北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单步扩散模型蒸馏方法,在多项任务达最佳性能,还能用于文本到 3D 生成。
ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与可移动物体交互动作生成新框架
北大团队在ACMMM 2025发布InteractMove,首次提出含可移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据集与创新框架,在多指标领先,代码与模型已开源。
奥特曼砍掉GPT-4o引爆AI「戒断反应」,马斯克官宣Grok 4全球免费!
奥特曼在发布GPT - 5时砍掉旧模型引网友不满,他认为要防止用户对AI成瘾,让产品利大于弊;马斯克则官宣Grok 4全球免费,用热辣模式等吸引用户,形成上瘾曲线。
复旦提出自适应Reasoning方法ARM,“能屈能伸”
复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。
上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”
上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。