「后训练方案」共找到 4393 篇相关文章
模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum
本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。
1周半写64个PR、完成30%项目重构:一家成熟SaaS公司把Agent塞进研发全流程后
Calendly作为成熟SaaS公司,分享Agentic Engineering实践,让Agent嵌入研发全流程。如一周半生成64个PR,完成30%项目重构。还探讨了瓶颈转移、对工程师的影响等,强调判断力和规则的重要性。
1周半写64个PR、完成30%项目重构:一家成熟SaaS公司把Agent塞进研发全流程后
Calendly公开Agentic Engineering实践,Agent嵌入研发全流程,如审查需求、写代码、测试等。一周半内,Agent为IAM团队生成64个PR,完成30%项目重构。研发瓶颈从写代码转为判断力,强调好需求与护栏重要性。
Meta被骂跑偏后摊牌!Alex Wang回应新团队目标:个人Agent全球化部署,Manus已在应用上开路
Meta超级人工智能实验室(MSL)负责人Alexandr Wang发声,称其任务是推动超级智能技术突破并做成产品推向数十亿用户,要把个人Agent全球化部署,还谈到与研究和产品平衡、Meta的AI思路等问题。
基础模型又一关键拼图,腾讯混元发布训练新范式「无相」:引入功能性记忆,打破静态权重枷锁
腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能性记忆,实时生成个性化参数。应用于图形编辑基模效果好,在图像编辑任务表现优秀,还对未来AI架构提出多方面展望。
用人类脑电波教 AI 开车,这位清华 90 后学者直言隐式信号里藏着 AGI 的关键 | 万有引力
清华大学龚江涛团队用人类驾驶员脑电波教会自动驾驶模型“思考”,成果E³AD发表于NeurIPS 2025。龚江涛从计算机转向人机交互,在多段科研经历中积累经验,探索将人类“直觉”赋予AI。
政企研联手发力!N 个实战案例!企业数智化转型的石景山企业专属方案重磅登场 | Q推荐
全球人工智能开发与应用大会暨石景山数智化转型峰会(AICon 北京站)将于 2025 年 12 月 19 - 20 日在北京石景山举行。大会围绕企业数智化转型与 AI 实战落地,设项目启动会、全国性论坛和行业峰会,助企业明确转型路径。
Ilya最新证词:谋划一年、52页黑材料、阅后即焚邮件,以及与宿敌Anthropic的合并
Ilya在马斯克起诉Sam Altman案中的62页证词曝光,围绕罢免Altman事件展开。涉及Ilya写的52页秘密备忘录、对Altman的指控、董事会决策情况,还有与Anthropic的合并谈判及Ilya财务利益审查。
写代码写出26亿身家、“淘宝第一个程序员”多隆离职后重出江湖,加入老同事创企,“杀入”AI赛道!
技术大牛多隆离开效力25年的阿里,于8月6日加入贝联珠贯,投身AI赛道。他曾是“淘宝第一个程序员”,一路走到阿里P11、成为合伙人,身家达26亿。此次他将和老同事毕玄用AI Agent改写运维服务格局。
项目在GitHub上已获得约3600+star,探秘 ChatDoctor:LLaMA 微调后的 AI 医生,真能在线问诊?
现代医疗资源不均、问诊效率低,ChatDoctor应运而生。它基于LLaMA微调,有医学对话微调等亮点,技术优势多,适用于在线问诊等场景,与同类对比优势明显,开源助力医疗对话模型发展。