人在循环中」共找到 8829 篇相关文章

新闻资讯8

腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案

腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,提示词中学习经验就能提升模型性能。实验显示,该方法数学推理和网页搜索任务上效果显著,成本远低于传统方法。

量子位
产品应用7

一分钟的奇迹与幻觉:实测世界模型Happy Oyster

4月16日阿里发布世界模型Happy Oyster,支持多模态输入与音视频联合生成。实测显示,它场景构建、渲染上有优势,可替代部分传统引擎工作,但存一致性不足问题,现阶段更适合改造游戏开发流程。

AI科技评论
算法论文8

强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”

大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,性能、泛化等多方面表现出色。

机器之心
新闻资讯8

画质重生,第一!腾讯TEG香农实验室斩获CVPR 2025 UGC Video Enhancement 冠军

CVPR NTIRE是计算机图像恢复与增强领域有影响力的赛事。NTIRE 2025 UGC Video Enhancement中,腾讯TEG香农实验室团队自研算法夺冠,成果落地提升视频清晰度。团队还参加实时赛道获佳绩,且做了硬件推理优化。

腾讯技术工程
算法论文8

让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

手机GUI Agent长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型评测基准取得佳绩。

量子位
推荐文章7

AI最大的礼物,是让你能廉价地失败100次

文章指出AI最大的礼物不是让成功,而是让能廉价地失败。AI让开发成本降低、心力节省,增加了尝试机会。但们需发布产品获取反馈,构建可演化系统,让失败为后续铺路。

花叔
新闻资讯7

DeepSeek多模态真的来了?识图模式已开始小范围灰度

4月29日,DeepSeek多模态团队负责陈小康X发布动态暗示多模态进展。部分用户DeepSeek官方App灰度到“识图模式”,这是其主线产品首次有图像理解能力模式,此前多模态才有流失,官方未说明开放细节。

DeepTech深科技
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型

上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且多领域表现出色。

AIGC开放社区
算法论文8

Apple发布新SOTA Manzano:混合Tokenizer破解多模态统一难题,理解与生成双翼齐飞

多模态AI前景广,但现有模型理解和生成任务上存性能冲突。苹果提出Manzano模型,用混合视觉标记器降低任务冲突,结构简单可扩展,多基准测试达SoTA水平,还展示图像编辑潜力。

深度学习自然语言处理
算法论文8

抛弃预定义Tool,首次提出通过动态工具生成的Agentic多模态Reasoning,破31%涨幅

视觉推理任务中,传统多模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 推理中实时生成、执行并迭代 Python 工具,多类任务中显著提升性能,实现范式跃迁。

深度学习自然语言处理