中高端制造业」共找到 2675 篇相关文章

算法论文8

告别多奖励跷跷板:Flow-OPD将多教师OPD带入图像生成

国科学技术大学等机构团队提出Flow - OPD,这是首个将OPD引入流匹配模型的统一多任务后训练框架。它解决了流匹配模型后训练对齐多任务的梯度冲突等问题,效果良好,未来有多个拓展方向。

机器之心
产品应用8

GLM-5正式发布,744B参数,对标Claude

GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。

AI工程化
开源动态8

阿里智能体多轮推理超越GPT-4o,开源模型也能做Deep Research

通义实验室推出自主信息检索智能体WebDancer,其通过系统化训练范式为构建智能体提供路径,也为在开源模型上复现Deep Research系统提供指导。它在多数据集测试表现出色,团队还对其未来应用做了展望。

量子位
新闻资讯7

让GPT-4.1「头皮发麻的考试」!OpenAI给大模型上强度,AI能赢吗?

OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试表现出色,未来 AI 能力上限充满可能。

新智元
新闻资讯8

击败PI!星动纪元登顶具身奥林匹克,狂揽三项全球冠军

在具身灵巧操作奥林匹克赛事Benjie’s Olympics国具身智能公司星动纪元斩获三项全球第一,超越美国明星公司PI。其自研VLA具身模型优势显著,且已在多领域落地应用。

量子位
产品应用8

捅破具身智能天花板!极佳视界新VLA大模型登场,复杂长时程任务近100%成功率

极佳视界推出GigaBrain-0.5M*VLA大模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比,任务成功率提升30%,长时程任务近100%成功,还具备高效准确的价值预测能力。

量子位
算法论文8

700万参数击败DeepSeek R1等,三星一人独作爆火,用递归颠覆大模型推理

今年6月Sapient Intelligence提出的HRM影响大模型推理结构,四个月后三星研究员Alexia Jolicoeur - Martineau推出TRM,700万参数模型在推理基准测试超越参数多10000倍的模型,还介绍了TRM原理、改进及实验结果。

机器之心
算法论文8

数据蒸馏的双重突破:从几何保真到对抗鲁棒

深度学习,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。

深度学习自然语言处理
新闻资讯8

刚刚,奥特曼首曝:AI取代CEO后,我想去当农民!

OpenAI 奥特曼在与 Mathias Döpfner 对话分享对 AI 看法,称 AI 取代工作后想当农民,还谈到 AI 超越人类智慧、OpenAI 关键决策、人类灭绝风险、新闻业未来等话题。

新智元
算法论文7

Megatron 1F1B流水线并行的负载不均衡问题研究

文章分析Megatron 1F1B流水线并行负载不均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致不同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。

GiantPandaLLM