码上飞」共找到 2158 篇相关文章

算法论文7

小扎「梦之队」首批论文线!LLM自举进化,单步性能狂飙22%

Meta超级实验室MSL新论文探索用强化学习微调大语言模型。提出探索迭代(ExIt)法,基于RL自动课程学习,训练仅需单步任务,模型学会多步自我改进。在MLE - bench,ExIt相对GRPO提升约22%。

新智元
8

520,遇见国产「新模王」Qwen3.7-Max!

在2026阿里云峰会,阿里推出全新一代千问旗舰模型Qwen3.7 - Max。它在各类测评中成绩亮眼,性能直逼全球最强模型,还针对Agent优化。阿里全栈AI体系助力模型高频迭代,千问深耕开源社区,志在成为智能体时代基础设施。

机器之心
算法论文8

27M参数战胜GPT-4!脑启发的分层Reasoning引擎如何重塑LLM

当前大语言模型(LLM)核心架构存在根本性缺陷,受大脑分层处理和多时间尺度启发,本文提出仅2700万参数的分层推理模型(HRM),免预训练与CoT标注,单次前向传播解决复杂任务,在ARC - AGI超越GPT - 4等LLM。

深度学习自然语言处理
产品应用7

AI 应用开发的破局之路:字节跳动 Eino 框架实践

在 InfoQ 举办的 QCon 全球软件开发大会,字节跳动沈桐介绍 Eino 框架在组件抽象和业务编排的创新实践。该框架以大模型为基础,解决应用开发中节点、信息流转和沉淀框架的问题,还给出开发实例,展望了未来重点方向。

InfoQ
开源动态8

超级麦吉:职场人 Vibe Working 的开源 LLM OS

文章介绍了开源项目超级麦吉,它是为职场人打造的 LLM OS,采用三层结构设计,有专业功能和完整产品矩阵。与闭源软件对比,其开源诚意足,虽有颜色和邀请机制等小问题,但助力职场人向 Vibe Worker 转型。

AGI Hunt
新闻资讯7

在今天,投后管理的战略价值与退出路径规划在何处 | 甲子引力

在「甲子光年」2025甲子引力年终盛典,澳银资本胡艳等多位投资界人士,结合案例探讨投后管理战略价值与退出路径规划。大家分享投后增值案例、应对挑战方法,还讨论了衡量投后价值及退出规划等问题。

甲子光年
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
产品应用7

500万次围观,1X把「世界模型」真正用在了机器人NEO身

1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖大规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务表现不错,但精细操作有挑战。

机器之心
新闻资讯8

JoyInside 创新大赛现场,我看到 AI 硬件长出了灵魂

作者曾对多数AI硬件失望,认为其有硬件没灵魂。但在观猹和京东联合举办的JoyInside创新大赛,20强产品让其改观。大赛基于京东JoyAI大模型,缩短产品市周期,前三名产品各有亮点,还呈现场景垂直化和交互方式改变趋势。

特工宇宙
产品应用8

阿里云Tair KVCache仿真分析:高精度的计算和缓存模拟设计与实现

阿里云Tair KVCache团队推出Tair - KVCache - HiSim,这是面向分布式多级KVCache管理的高保真LLM推理仿真分析工具。它能在通用CPU高精度预测性能,支撑计算选型、存储规划和调度协同等决策,还介绍了其架构、组件、验证及性能评估等内容。

阿里云开发者