元学习」共找到 1997 篇相关文章

开源动态8

阿里通义的视觉RAG革命!VRAG-RL:基于强化学习的视觉感知RAG框架,性能飙升30%

阿里巴巴通义实验室推出VRAG - RL,融合视觉感知、多模态推理与强化学习,已在GitHub开源。它破解传统RAG处理视觉数据难题,通过创新机制提升性能,在多数据集表现出色,还将向更拟人化和低幻觉方向发展。

开源星探
算法论文8

字节Seed新作:模型合并如何改变大模型预训练范式

字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究。

机器之心
新闻资讯7

独家|RoboScience 机器科学完成10亿融资,资金将用于强化 VLOA 大模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿A轮融资,将深化VLOA大模型技术,推进自研机器人本体工程化与量产。其VLOA大模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
算法论文8

突破高分辨率图像推理瓶颈,复旦联合南洋理工提出基于视觉Grounding的多轮强化学习框架MGPO

先进多模态大模型处理高分辨率图像有瓶颈,复旦和南洋理工研究者提出基于视觉Grounding的多轮强化学习方法MGPO,能让模型精准推理,还可使模型从答案反馈中涌现视觉定位能力,避免依赖昂贵标注。

机器之心
开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美,复现DeepSeek的强化学习

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营
新闻资讯7

独家|红杉领投,智旗下具身数据平台业务觅蜂科技获数亿融资

AI科技评论独家获悉,智机器人旗下具身智能数据平台觅蜂科技完成数亿种子轮与天使轮融资,由红杉中国领投,多家资本跟投。此次融资用于技术研发等,觅蜂已布局全类型数据,还将建立数据联盟。

AI科技评论
新闻资讯8

国产手机卖到1万6!华为新旗舰,搭载麒麟9030

华为年度旗舰Mate 80系列和折叠屏旗舰Mate X7携全新麒麟9030系列芯片亮相。首发鸿蒙6操作系统,小艺进化成智能体。Mate 80系列首发第二代红枫影像,Mate X7影像模组升级。价格上,Mate 80系列起售4699,Mate X7高配达15999

量子位
算法论文7

小扎「梦之队」首批论文上线!LLM自举进化,单步性能狂飙22%

Meta超级实验室MSL新论文探索用强化学习微调大语言模型。提出探索迭代(ExIt)法,基于RL自动课程学习,训练仅需单步任务,模型学会多步自我改进。在MLE - bench上,ExIt相对GRPO提升约22%。

新智元
新闻资讯8

通用Agent是伪命题?昆仑万维方汉现场拆解:垂直推理才是胜负手|新智十年峰会

在新智十周年峰会上,昆仑万维董事长方汉分享公司转型故事与多模态AGI见解。他认为通用Agent非万能,垂类推理数据是关键,还提出AI商业落地逻辑,展示多款产品成果。

新智元
新闻资讯7

独家|地平线前高管牛建伟成立叮当动力,专注空间智能,获地平线领投数千万投资

《AI科技评论》独家消息,前地平线智能座舱产品线总经理牛建伟创立叮当动力,专注空间大模型的通用具身智能,获地平线领投数千万种子轮融资。牛建伟经验丰富,团队提出独特解决方案,产品聚焦多场景。

AI科技评论