阿里云栖大会」共找到 5391 篇相关文章

新闻资讯8

对话智源王仲远:机器人的小脑可能会“合体”,但不是今天

今年智源会上,智源研究院推出“悟界”系列模型,如Emu3、Brainμ、RoboOS2.0、RoboBrain2.0和OpenComplex2。智源研究院长王仲远称模型技术未到尽头,介绍了模型特点及发展趋势,如机器人小脑融合需时间。

AI前线
算法论文8

告别单一模型依赖!北航等机构发布综述:语言模型集成(LLM Ensemble)

北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三集成范式。

PaperAgent
开源动态8

阿里刚刚开源了一款影视级配音项目,口型同步、音色转换都不是事!

阿里通义实验室语音团队联合中科发布多模态电影配音模型Fun - CineForge,开源模型并构建中文电视剧配音数据集。它能处理多种场景,有视频理解等亮点,还给出制作数据集步骤。

开源星探
新闻资讯8

头部互联网企业交锋,AI时代可观测边界出现了吗?

InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代可观测新边界。嘉宾们认为AI与可观测技术双向赋能,传统算法与模型互补,未来有望实现半自治运维,还分享了数据治理等经验。

InfoQ
算法论文8

ICLR 2026|多模态模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。

机器之心
算法论文8

模型学会拖进度条看视频了!阿里新研究让视频推理告别脑补,实现证据链思考 | ICLR 2026

阿里巴巴未来生活实验室团队解决多模态模型视频推理难题,推出ReWatch数据集和ReWatch - R1模型。数据集克服现有训练数据痛点,模型用SFT + RL范式及创新奖励机制,实验成绩SOTA。

量子位
开源动态8

开源打破“AI黑箱”!集结全球咖,GOSIM Paris 2026带你看懂Agent时代变局

GOSIM Paris 2026在巴黎举办,是面向开发者的开源AI技术会。会由GOSIM主办,CSDN等联合打造,聚焦AI能力落地应用。首日Keynote多位咖探讨AI相关问题,还有三论坛、工作坊、Hackathon等活动。

AI科技大本营
算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里与清华研究发现,训练语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
开源动态8

社区供稿 | 阿里国际Ovis2.5重磅发布:以小博,刷新开源模型性能新高度

阿里国际发布多模态模型Ovis2.5,在OpenCompass综合得分提升,保持SOTA水平。它在原生分辨率视觉感知等三方面突破,有9B和2B两版本,代码、模型等资源已开源,技术原理涉及架构、训练与数据。

Hugging Face
新闻资讯7

厂都在卷千亿模型,这家深圳企业却专啃“最后一公里”

在CITE 2026上,佑泰创始人张希立分享企业战略。佑泰与厂不同,走差异化路径,聚焦算力落地“毛细血管”,产品覆盖多应用方向,还将转型提供完整算力服务,积极布局信创,面对成本压力坚守契约。

芯师爷