「后训练系统」共找到 5097 篇相关文章
又要取代程序员了?这锅轮到 AI 背了
文章指出‘AI会取代程序员’论调有误,代码是负债,系统设计才是核心资产。回顾NoCode、云计算等变革,技术未取代人,而是重塑岗位。AI辅助开发也如此,暴露软件工程中设计系统才是AI难取代的能力。
最高能效比!他又死磕“存算一体”2年,拿出全新端边大模型AI芯片
后摩智能CEO吴强在今年WAIC期间发布业界能效比最高的存算一体端边大模型AI芯片后摩漫界®M50。它搭载第二代存算一体技术,全栈自研实现软硬件协同优化,还配套系列产品,构建端边智能新生态。
The Batch: 873 | 通过自监督学习实现更好得图像处理
Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。
李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界
李飞飞创办的 World Labs 发布多模态世界模型 Atlas,可原生处理多类型数据,有世界生成、重建和模拟等能力。还介绍其研发历程、技术特点,以及 World Labs 收购、融资等情况。
小红书提出社交大模型RedOne 2.0:兼听、敏行
在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。
看完快手这场沙龙,我对生成式推荐的判断变了
作者参加快手技术沙龙,认为生成式推荐正重构推荐系统底座。快手在生成式推荐领域体系化演进,如OneReason让推荐系统学会思考,Pool - Rec解决算力问题,OneSearch V2和GR4AD用于场景实践,还举办LLM - Rec挑战赛。
世界模型和具身大脑最新突破:90%生成数据,VLA性能暴涨300%|开源
国产世界模型玩家获突破,VLA模型性能涨300%,90%训练数据由世界模型生成。极佳视界开源GigaWorld - 0及训练框架,在多方面优化,经对比性能领先,还验证其生成数据对具身任务的提升作用。
《DeepSeek掘金》背后的故事——从行业寒冬到AI春潮,用腾讯IMA知识库重构价值
本文讲述《DeepSeek掘金》成书背后的故事。从行业寒冬到AI春潮,编委们因DeepSeek迎来职业转机。面对出版市场乱象,用腾讯IMA知识库完成创作,还打造四位一体学习方案,致敬梁文锋与DeepSeek理想主义。
MIRIX重塑AI多模态长期记忆:超Gemini 410%,节省99.9%内存,APP同步上线
UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中超越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启大模型从对话生成到长期记忆驱动心智的新周期。
通向L3的正确范式?理想i8全球首发VLA高阶辅助驾驶,我们帮你试了试
本周二,理想全新纯电SUV理想i8上市,其搭载的VLA辅助驾驶系统受关注。理想发现端到端数据驱动升级有局限,VLA架构改进让系统有思维、沟通等能力,还带来平顺性等提升,且研发各方面能力强。