后训练方案」共找到 4393 篇相关文章

开源动态8

震撼发布!最大人体动作数据集 MotionMillion 正式登场

上海交通大学研究团队构建高效标注流程,发布最大人体动作数据集MotionMillion,含超2000小时、200万条文本 - 动作配对数据。还推出评测体系MotionMillion - Eval,训练70亿参数动作生成大模型,刷新SOTA。

带你学AI
算法论文8

一篇LLM × DATA技术最新系统性综述

上交大、清华等联合发表综述,探讨LLM与数据管理双向关系,分析LLM不同阶段数据管理技术与挑战并给出方案,还讨论了LLM在数据管理任务中的应用进展,为研究和实践提供指导。

PaperAgent
产品应用8

巧妙!一个传统技术让国产视觉基础模型直接上大分

格灵深瞳的Glint - MVT视觉基础模型表现出色,线性探测准确率高于CLIP等,下游任务效果佳。其引入间隔Softmax损失函数,结合虚拟类别构造等优化方案提升性能,团队专注视觉研发,务实开放。

量子位
开源动态7

开源版Suno来了:本地跑AI音乐生成,免费、无限、完全属于你

ACE - Step UI开源项目改变AI音乐生成现状,提供本地方案。它是完整音乐工作站,虽生成质量与Suno有差距,但在费用、隐私等方面优势明显,预示AI音乐生成开源生态崛起。

AI Reading Hub
算法论文8

模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26

华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。

量子位
新闻资讯7

OpenAI 内部访谈流出:新 Agent 强到让我们害怕,已接近“自我进化”的边缘!

红杉资本访谈 OpenAI 打造新款 ChatGPT Agent 的核心成员。介绍 Agent 结合多工具、共享状态,能执行复杂任务。还谈及起源、训练方法、应用场景,以及安全挑战和未来规划等。

探索AGI
算法论文8

任务级奖励提升App Agent思考力,淘天提出Mobile-R1,3B模型可超32B

现有Mobile/APP Agent依赖动作级奖励,难应对变化环境。淘天集团团队提出Mobile-R1框架,采用三阶段训练,结合任务级奖励,实验显示其表现超基准,团队还计划开源资源。

量子位
新闻资讯7

她拒了贝索斯,离开黄仁勋,只为回答一个问题:AI能学会物理世界吗?

近日,AI初创公司Accelerated Understanding亮相,由Anima Anandkumar夫妇创立。它未随主流,目标是训练模拟物理现象的通用AI模型。该模型处理数据规模大,公司想解决AI验证瓶颈,产品面向科研工程机构。

DeepTech深科技
新闻资讯7

全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走

谷歌DeepMind的政治哲学家Iason Gabriel入职9年,发明的对齐框架影响Gemini训练决策。在AGI承诺与AI现实伤害间,他追问AI伦理。但技术部署快,6700亿美元涌入赛道,伦理红线被踩。

新智元
开源动态7

代码暴减99.9%!独立开发者仅用500行代码做出安全版OpenClaw,GitHub星数狂飙

近日,独立开发者 gavrielc 制作的开源 AI 助手 NanoClaw 火了。它核心代码仅约 500 行,实现 OpenClaw 同等核心功能。相比原版 Clawdbot 代码量大减,还解决了 OpenClaw 安全架构问题,是其安全替代方案

AI前线