后训练阶段」共找到 4137 篇相关文章

产品应用7

从提需求到部署发布,全AI全自动化,研发效能全面跃升

文章介绍腾讯在研发中推进AI全自动化,将自动化向上下游环节延伸,分L1、L2、L3阶段演进。阐述了面临的挑战及应对举措,分享人机协同和全自动化交付实践,展示效果数据,展望未来双轮驱动体系。

腾讯技术工程
算法论文8

大模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
开源动态8

腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent

智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。

量子位
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
开源动态8

Generalist之,罗剑岚团队推出LWD,也要变革具身智能训练范式

智元机器人与上海创智学院联合发布全新具身智能训练范式 LWD,可让机器人在真实世界部署中持续自主改进。它打破传统 AI 静态模式,构建数据飞轮,在四大维度创新,经测试表现出色,或成具身智能转折点。

机器之心
新闻资讯8

奥特曼和纳德拉,艰难重组首次对谈:「我们是天作之合!」

奥特曼与纳德拉在OpenAI重组首次同台,阐释重组幕并押注从App到Agent的范式迁移与Copilot落地。新协议让OpenAI完成重组,Azure成AI开发者“圣地”,双方合作影响软件范式、人机交互及产业格局。

新智元
开源动态7

在一台1970年代的PDP-11上训练Transformer需要多久?答案是5.5分钟

近日,开发者复现1970年代技术环境,用PDP - 11汇编语言实现Transformer并训练成功,项目叫ATTN - 11。在低资源下实现功能闭环引热议,大家思考Transformer到底需要什么。

机器之心
新闻资讯7

Karpathy 秒删 AI 职业分析项目,背是,一场人类的职业大迁移

Karpathy 做了 AI 职业暴露度分析项目,引发关注秒删。Stanford NLP 指出其分析不足。多家报告显示 AI 对职业冲击大,全球科技行业裁员,国内前端岗位受影响,还带来职业大迁移。

AGI Hunt
产品应用7

23岁零基础用AI编程月入5000+:一个00的淘宝变现实战

23岁小伙大骏零基础用AI编程,先做图片处理小工具在淘宝售卖,通过私域运营让收入翻3 - 4倍。他分享了AI编程变现经验,强调好奇心、行动力和佛系心态很重要。

AI产品黄叔
开源动态8

单次训练横扫9个基准,遥感检测最大数据集与基础模型框架问世

北京航空航天大学团队发布面向通用遥感目标检测的大规模数据集与基础模型框架 LEVIRDet,构建了 LEVIRDet - 159 数据集,提出 LEVIRDetNet 模型。前者为训练泛化能力强的模型提供新数据基础,者在多基准测试中表现出色。

机器之心