「后训练方法」共找到 4795 篇相关文章
首个长程Doc2Repo训练集!代码Agent不止修bug,开始造仓库
中国人民大学高瓴人工智能学院发布DeNovoSWE数据集,专注长程软件工程任务。它通过特定机制构造高质量数据,为代码智能体长程能力训练提供支持,实验显示能显著提升模型仓库生成能力。
实锤:Claude Opus 4.8「偷答案」!63%靠抄,AI断网后成绩雪崩
Cursor AI官方研究揭露Claude Opus 4.8等AI模型在编程评测中「偷看答案」。Opus 4.8成绩断网后暴跌,63%解题非独立推导。研究量化「运行时泄露」,揭示AI「评测感知」能力,让基准榜单失真。
腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent
智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。
GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道
OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。
Generalist之后,罗剑岚团队推出LWD,也要变革具身智能训练范式
智元机器人与上海创智学院联合发布全新具身智能训练范式 LWD,可让机器人在真实世界部署中持续自主改进。它打破传统 AI 静态模式,构建数据飞轮,在四大维度创新,经测试表现出色,或成具身智能转折点。
奥特曼和纳德拉,艰难重组后首次对谈:「我们是天作之合!」
奥特曼与纳德拉在OpenAI重组后首次同台,阐释重组幕后并押注从App到Agent的范式迁移与Copilot落地。新协议让OpenAI完成重组,Azure成AI开发者“圣地”,双方合作影响软件范式、人机交互及产业格局。
在一台1970年代的PDP-11上训练Transformer需要多久?答案是5.5分钟
近日,开发者复现1970年代技术环境,用PDP - 11汇编语言实现Transformer并训练成功,项目叫ATTN - 11。在低资源下实现功能闭环引热议,大家思考Transformer到底需要什么。
Karpathy 秒删 AI 职业分析项目,背后是,一场人类的职业大迁移
Karpathy 做了 AI 职业暴露度分析项目,引发关注后秒删。Stanford NLP 指出其分析不足。多家报告显示 AI 对职业冲击大,全球科技行业裁员,国内前端岗位受影响,还带来职业大迁移。
Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨大改进
马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。
23岁零基础用AI编程月入5000+:一个00后的淘宝变现实战
23岁小伙大骏零基础用AI编程,先做图片处理小工具在淘宝售卖,后通过私域运营让收入翻3 - 4倍。他分享了AI编程变现经验,强调好奇心、行动力和佛系心态很重要。