统一混合训练框架」共找到 2655 篇相关文章

开源动态8

开源模型首次物理奥赛IPhO夺金!上海AI Lab 235B模型击败GPT-5和Grok-4

上海AI Lab的P1 - 235B - A22B在国际物理奥林匹克竞赛夺金,在HiPhO基准测试获12金1银,超越GPT - 5等闭源模型。团队构建HiPhO基准测试,用多阶段强化学习训练模型,开发PhysicsMinions系统提升推理能力。

量子位
开源动态8

社区供稿 | 阿里国际Ovis2.5重磅发布:以小博大,刷新开源模型性能新高度

阿里国际发布多模态大模型Ovis2.5,在OpenCompass综合得分提升,保持SOTA水平。它在原生分辨率视觉感知等三方面突破,有9B和2B两版本,代码、模型等资源已开源,技术原理涉及架构、训练与数据。

Hugging Face
新闻资讯8

MiniMax M2 发布即爆,拿下开源模型第一名

10月27日,MiniMax发布新一代文本大模型M2及由其驱动的MiniMax Agent。M2是专家混合模型,参数达230B但激活仅10B。它在开源模型评测中夺冠,能低成本、高速度支撑工作流,开发者评价高。

MacTalk
新闻资讯8

72小时AI生存挑战,发生了什么?

五源发起72小时AI生存挑战,7位不同背景参与者在封闭空间,仅用AI工具和100元资金生存并创造。有人训练AI朋友,有人创作作品。过程中暴露诸多问题,也让大家看到AI能力边界与未来可能。

五源资本 5Y Capital
新闻资讯8

GPT-5核心推手闪电跳槽,Anthropic CEO高调炫耀员工留存碾压OpenAI,“AI第一公司”光环崩塌?

OpenAI后训练负责人、GPT - 5核心推手Max Schwarzer跳槽至Anthropic,此前也有多位技术领袖离开。OpenAI在商业版图扩张与伦理争议并存下,正从参数军备赛转向体验护城河,同时加速商业与政治布局,但面临人才流失等问题。

AI前线
算法论文8

具身智能奇点已至!超越π*0.6,极佳视界自我进化VLA大模型拿下世界第一

极佳视界具身大模型 GigaBrain-0.5M*依托世界模型实现自我进化,在多真实任务近 100% 成功,超 π*0.6 成 SOTA。其提出基于世界模型的强化学习范式,用超万小时数据训练,推动通用具身智能发展。

新智元
开源动态8

美团开源全模态,比肩顶级闭源模型,开源新SOTA

美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。

AIGC开放社区
算法论文7

AI 的“思维链”推理是海市蜃楼吗?

亚利桑那州立大学论文《大语言模型的思维链推理是海市蜃楼吗?》认为思维链推理在数据分布偏移时易出错,可能只是对训练数据模式的记忆。作者 Sean Goedecke 认为该论文结论不合理,从推理与语言、模型规模等方面提出反对意见。

宝玉AI
推荐文章8

AI Coding 之后,如何让 Agent 进入企业研发全链路?得物推荐的 Harness 实践

得物资深技术专家白忠魏在AICon大会分享实践。团队目标是将AI Coding扩展为全链路方法,介绍了PDCA循环、全链路前提、七阶段护栏等探索,还提及用知识体系和混合Agent架构解决问题,已有阶段性成果。

InfoQ
产品应用7

旅行 AI 告别只会做规划的平庸时代,飞猪帮帮决定让 Agent 做履约

8月10日,飞猪推出新一代旅行AI“飞猪帮帮”,能力覆盖旅行全生命周期。它将用户需求分为“帮我想、帮我订、帮我办”,利用Qwen模型后训练,结合多种校验手段,让AI从提供信息到进入履约环节。

特工宇宙