阿里云栖大会」共找到 5403 篇相关文章

开源动态8

告别模型“失忆”!人开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已开源。

PaperAgent
算法论文8

ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力

阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。

机器之心
产品应用8

捅破具身智能天花板!极佳视界新VLA模型登场,复杂长时程任务近100%成功率

极佳视界推出GigaBrain-0.5M*VLA模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比中,任务成功率提升30%,长时程任务近100%成功,还具备高效准确的价值预测能力。

量子位
算法论文8

68页论文再锤模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩

《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被量静默弃用等,研究团队给出改进建议,官方也进行了回应。

量子位
新闻资讯7

全球首个 IPO 模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆港股

12月30日,智谱华章启动港股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20港元计,募资约43亿港元,市值超511亿港元。70%募资用于模型研发,还引入多家基石投资者。

InfoQ
算法论文7

AIAA J | 西工翟凯宇、李楠等:膨胀拐角影响下入射激波/边界层干扰的标度律分析

高超声速进气道肩部区域的激波 - 膨胀波 - 边界层干扰影响,传统标度律有误差。本研究结合实验与理论,研究膨胀拐角影响下的入射激波/边界层干扰,提出改进标度律,还构建混合监测框架实现准确预测。

力学与人工智能
新闻资讯8

百川开源医疗模型 M3,王小川:今年会发布两款 ToC 产品,正在做硬件

1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗模型Baichuan - M3,评测成绩突出。王小川表示今年会发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。

Founder Park
新闻资讯8

2026崇礼论坛成功举办,俞敏洪、周鸿祎、沙宝亮等近百位咖共话AI新风向|甲子光年

2026年1月23 - 25日,2026崇礼论坛在张家口崇礼区太舞小镇举办,俞敏洪、周鸿祎等近百位咖共话AI。设四专场论坛探讨技术落地、商业闭环等问题,还启动了“崇礼企业家联盟”。

甲子光年
算法论文8

模型能“原地”改参数了!字节Seed&北新论文:测试时推理无需加层重训练

字节Seed和北研究团队提出In - Place TTT方案,让模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位
开源动态8

阿里开源长文本深度思考模型!渐进式强化学习破解长文本训练难题,登HuggingFace热榜

阿里开源长文本深度思考模型QwenLong - L1,登上HuggingFace热门论文第二。它解决了长文本强化学习训练难题,通过渐进式上下文扩展训练,在多基准测试中表现出色,还探讨了SFT和RL作用。

量子位