上纬新材」共找到 5156 篇相关文章

开源动态7

Qwen3小升级即SOTA,开源大模型王座快变中国内部赛了

开源大模型进入中国时间,Kimi K2风头正盛时,Qwen3迎来升级,235B总参数量仅为Kimi K2四分之一,基准测试性能却超它。Qwen官方不再用混合思维模式,模型仅支持非思考模式,此次是小更,大招在后头。

量子位
推荐文章8

拒绝视频生成,深度跃迁提出具身基座模型全路线

深度跃迁发布世界动作模型 DELE - w0.5,放弃基于视频生成模型的路线,训练时联合学习动作与未来世界表征,推理时移除该表征分支。在真机实验中表现超基线,具跨背景泛化能力,为世界模型提供思路。

机器之心
新闻资讯7

在今天,投后管理的战略价值与退出路径规划在何处 | 甲子引力

在「甲子光年」2025甲子引力年终盛典,澳银资本胡艳等多位投资界人士,结合案例探讨投后管理战略价值与退出路径规划。大家分享投后增值案例、应对挑战方法,还讨论了衡量投后价值及退出规划等问题。

甲子光年
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
算法论文8

3D重建的惊人进展:多所世界名校联合发布论文,告诉你AI在3D世界的研究现状

多所世界名校联合发布调查研究论文,回顾用于3D重建和视图合成的前馈技术并分类,研究关键任务及应用。前馈模型打破每场景优化魔咒,带来速度和泛化能力的提升,解锁应用,但也面临挑战。

AIGC开放社区
算法论文8

只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题

阿里高德提出Tree - GRPO方法解决智能体RL难题。它以智能体步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。

机器之心
开源动态8

DeepDiver-V2来了,华为最开源原生多智能体系统,“团战”深度研究效果惊人

华为发布DeepDiver-V2原生多智能体系统,采用“团队作战”模式,在复杂知识问答和长文报告生成表现出色。它以Planner为中心协调多个Executor,有智能任务分解等优势,训练也有机制,昇腾NPU集群加速。

量子位
产品应用8

百度造了个“AI星舰”?或成业界最完备的企业级AI平台

在2025百度云智大会,百度智能云千帆企业级AI开发平台发布4.0版本,核心聚焦Agent。它一站式提供开发所需能力,解决模型选型、数据盘活等难题,还有RFT工具链降精调门槛,“白盒化”助问题诊断。

InfoQ
新闻资讯8

JoyInside 创大赛现场,我看到 AI 硬件长出了灵魂

作者曾对多数AI硬件失望,认为其有硬件没灵魂。但在观猹和京东联合举办的JoyInside创大赛,20强产品让其改观。大赛基于京东JoyAI大模型,缩短产品市周期,前三名产品各有亮点,还呈现场景垂直化和交互方式改变趋势。

特工宇宙
产品应用8

阿里云Tair KVCache仿真分析:高精度的计算和缓存模拟设计与实现

阿里云Tair KVCache团队推出Tair - KVCache - HiSim,这是面向分布式多级KVCache管理的高保真LLM推理仿真分析工具。它能在通用CPU高精度预测性能,支撑计算选型、存储规划和调度协同等决策,还介绍了其架构、组件、验证及性能评估等内容。

阿里云开发者