「后训练技术」共找到 5958 篇相关文章
陈天桥邓亚峰联手破解大模型记忆难题!4个月打造SOTA系统,悬赏8万美元发起全球记忆挑战赛
今年全球AI圈聚焦大模型记忆技术。陈天桥和邓亚峰带队的EverMind推出世界级长期记忆系统EverMemOS,发布即SOTA。其模拟人脑记忆机制,开源且上线云服务,还发起8万美元记忆起源大赛。
【倒计时一周】AI眼镜芯生态沙龙:从芯片到整机的协同创新
当智能手机创新遇瓶颈,AI眼镜成新风口。当前市场高速增长,但面临技术、成本、场景和产业链协同等难题。本次沙龙旨在凝聚产业链共识,解决发展难题,共探产业未来,为各方提供合作契机。
微软 Agentic 组织:下一代 AI 系统
微软研究院提出全新推理范式AsyncThink,让LLM从单打独斗进化成带团队的项目经理。它把并发控制转为纯文本协议,经两阶段训练,实验中全方位碾压传统方法,还具跨领域泛化能力。
如何在24GB显存里,塞下一个万亿参数的巨兽?KTransformers入选顶会SOSP
清华大学与趋境科技联合研发的KTransformers系统,可让消费级显卡跑万亿级参数模型,其论文入选SOSP 2025。该系统解决MoE模型本地部署难题,技术创新多,还与SGLang合作,提升硬件利用率。
2篇最新152页论文,RL+LLM被彻底讲透了!
今天分享2篇2025最新RL×LLM的技术综述,分别聚焦“RL在LLM全生命周期的打法”和“RL如何炼成大推理模型”,梳理玩法、组件、算法演进等内容,还给出开源模型、数据等盘点。
必看!SEO、AEO、GEO、AAO是什么,如何做,实际应用举例,适合谁做及如何协作?
文章由白杨SEO撰写,介绍SEO、AEO、GEO、AAO概念、做法、应用及适用企业,强调它们是互补的搜索营销手段,还介绍了AI搜索优化GEO第二期训练营相关信息。
刚刚,清华团队用27M参数击败o3-mini!或将改变AI发展方向
清华大学研究团队发布论文,展示Hierarchical Reasoning Model(HRM)。该模型仅27M参数、1000个训练样本,在推理任务上击败OpenAI的o3 - mini - high,或改变AI发展方向。
奥特曼反击挖走4人!Meta华人科学家在列,马斯克也躺枪
被挖走8人后,OpenAI反击。总裁称4人将加入,有Meta华裔科学家Angela Fan,还有3人来自马斯克旗下公司。此次有两名华人加入Scaling团队,OpenAI将加速使命惠及大众。
从文心开源谈起,论大模型发展新生态
6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现预训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。
“我的新爱好:眼睁睁看着Copilot慢慢逼疯微软程序员”
近日,Reddit上关于GitHub Copilot的风波引发开发者关注。微软发布Copilot Agent,虽称其擅长开发任务,但在GitHub实践中表现不佳,引发开发者不满,也反映出技术理想与现实落地的差距。