康奈尔大学」共找到 5280 篇相关文章

算法论文8

知识图谱推理新sota,兼顾性能+效率!中科新作 | NeurIPS'25

知识图谱推理应用广泛,但现有方法面临推理效率低、表达能力不足等挑战。中科团队提出DuetGraph,采用双阶段粗到细推理框架与双通路全局 - 局部特征融合模型,平衡推理精度与效率,缓解过平滑问题。

新智元
新闻资讯7

“像把象塞进冰箱一样困难”,端侧模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
开源动态8

最鲁棒的MLLM!港科开源「退化感知推理新范式」 | AAAI'26

多模态语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元
算法论文7

模型在具身推理上「翻车」了?4496 道题全面揭示短板

美国东北等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。

机器之心
算法论文8

告别数据「噪音」,UCSD模型推理新方法DreamPRM充当「信号放器」,登顶MathVista测评榜

DreamPRM由加州圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态模型集成,提升推理能力,实验效果显著。

机器之心
算法论文8

10行代码,AIME24/25提高15%!揭秘模型强化习熵机制

来自多机构的研究者揭示模型强化习中熵变化机制。发现策略熵在训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分数据集上性能提升显著。

机器之心
新闻资讯7

Claude灾难级宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷

4月6日Claude新功能Ultraplan上线就遭遇规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗,Anthropic太急,产品稳定性堪忧。

新智元
开源动态7

SGLang × RoleBasedGroup(RBG):打通模型推理PD分离架构规模化落地的“最后一公里”

PD分离架构对模型推理部署意义重,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。

InfoQ
产品应用8

网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 模型推理加速架构

网易游戏打造 Tmax AI 机器习平台,但模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。

AI前线
新闻资讯8

模型七连发,外国人馋透了!阿里云栖会全栈升级够狠

阿里在2025云栖会全栈升级,发布七款通义新模型,从基础模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心