多模型兼容」共找到 9834 篇相关文章

算法论文8

RL成本降幅超90%!Meta提出Agent训练新范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在种任务和模型上提升性能,为通用Agent训练开辟新路径。

深度学习自然语言处理
开源动态8

北大联合Llama-Factory推出DataFlex:工业级数据动态训练系统

北大张文涛教授、鄂维南院士团队联合机构推出大模型数据中心动态训练框架DataFlex。它是统一训练基础设施,纳入三类核心能力,解决底层系统问题,在效率和效果上有提升,受社区认可。

机器之心
产品应用7

GPT-5-Codex 一手实测

OpenAI推出新编程模型GPT - 5 Codex,Every团队实测显示其表现狂野。它能动态选思考时间,可在不同开发环境无缝切换,代码审查更优。但也存在对任务挑剔、环境设置麻烦等问题。

AGI Hunt
开源动态8

LeRobot v0.4.0 正式发布:全面提升开源机器人的学习能力

LeRobot v0.4.0 正式发布,带来方面重大升级。有可扩展的 Datasets v3.0、新 VLA 模型、全新插件系统;支持 LIBERO 和 Meta - World 仿真;还有数据处理 Pipeline、 GPU 训练简化等特性,上线了机器人学习课程。

Hugging Face
算法论文7

LSTM之父22年前构想将成真?一周内AI「自我进化」论文集中发布,新趋势涌现?

本文介绍AI模型自我进化方向的进展,涉及机构的相关论文。如受“哥德尔机”启发的“达尔文哥德尔机”可自我改进;还有“自我奖励训练”“MM - UPT”“UI - Genie”等方法,展现AI自我进化潜力。

机器之心
新闻资讯9

OpenAI核心研究员坦白:上万Agent自发成军,奇点已经到来,三个月后无法预测

本文整理OpenAI核心研究员、o1推理模型开创者Noam Brown的访谈,披露OpenAI上万自发协作智能体的技术突破,探讨AI发展远超人类预判,奇点临近,解决对齐问题的时间窗口正快速闭合

AI寒武纪
新闻资讯8

刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃

深夜谷歌推出Gemini 3.8,六周内第三款Flash系列模型。含通用的Gemini 3.8 Flash和网络安全专用的Gemini 3.8 Flash Cyber,提升推理、代码能力,在场景表现出色。已面向不同群体开放。

机器之心
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上场景加速,提升预训练和端侧推理效率。

千问大模型
产品应用8

8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队

模型下半场,后训练特别是强化学习成核心战场。潞晨云微调SDK上线,它是国内首个全面开放、且兼容Tinker范式的Serverless微调平台,为强化学习提供低成本解法,在易用性和成本上有优势。

量子位
新闻资讯7

视远·正心明智——机器之心2025年度AI榜单正式启动

2025 年人工智能浪潮依旧,大模型快速迭代,新应用形态不断涌现,国内 AI 发展也很精彩。机器之心精心策划 2025 年度 AI 榜单,涵盖最强技术实力企业等个类别,企业可扫码申报。

机器之心