中科大」共找到 6820 篇相关文章

开源动态8

最鲁棒的MLLM!港开源「退化感知推理新范式」 | AAAI'26

多模态语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元
算法论文8

告别数据「噪音」,UCSD模型推理新方法DreamPRM充当「信号放器」,登顶MathVista测评榜

DreamPRM由加州学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态模型集成,提升推理能力,实验效果显著。

机器之心
新闻资讯7

Claude灾难级宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷

4月6日Claude新功能Ultraplan上线就遭遇规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗,Anthropic太急,产品稳定性堪忧。

新智元
开源动态7

SGLang × RoleBasedGroup(RBG):打通模型推理PD分离架构规模化落地的“最后一公里”

PD分离架构对模型推理部署意义重,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。

InfoQ
算法论文8

模型智能体不止能写代码,还能被训练成白帽黑客

Amazon AWS AI的Q Developer团队发布两项训练网络安全模型的新方法Cyber - Zero和CTF - Dojo。前者不依赖真实环境生成训练数据,后者构建实战环境让模型学发现漏洞,二者结合为AI白帽黑客成长提供路径。

机器之心
算法论文8

所有模型,都学物理学:北物理系一篇研究,震撼了AI圈

等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给模型画像,让 AI 研究提升到‘物理学’高度。

机器之心
产品应用8

网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 模型推理加速架构

网易游戏打造 Tmax AI 机器学习平台,但模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。

AI前线
新闻资讯8

模型七连发,外国人馋透了!阿里云栖会全栈升级够狠

阿里在2025云栖会全栈升级,发布七款通义新模型,从基础模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心
算法论文8

首次!AI智能体破解「纳什均衡」,模型学会博弈论|Cell子刊

多所高校研究团队开发出PrimeNash语言模型智能体框架,能自动推导纳什均衡闭式解析解并生成证明。它模拟人类研路径,分三模块求解,经经典博弈验证,还在碳市场博弈展现应用潜力。

新智元
算法论文8

ACL 2025 | GALLa:给代码模型装上“透视眼”,看懂程序的“骨架”!

蚂蚁集团与上海交合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。

PaperAgent