大厂自研」共找到 5829 篇相关文章

算法论文8

ICLR 2026|多模态模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。

机器之心
算法论文8

扩散语言模型真的会比回归好?理论分析结果可能恰恰相反

北京学和蚂蚁集团研究表明,扩散语言模型虽理论上有并行生成优势,但实践中在某些任务推理成本更高。研究通过实验对比,分析了扩散与回归模型在不同评估指标下的效率,指出选择模型要视任务需求。

机器之心
新闻资讯7

一夜之间,DeepSeek V4 Pro和Grok 4.6把全球模型推入了新的斩杀线。

DeepSeek V4 Pro和Grok 4.6在两小时内发布,逼近Claude Fable 5体验。作者分享常用AI组合,分析两模型优缺点,指出它们撕开模型不可能三角,形成新斩杀线,让夹在中间的模型难受。

数字生命卡兹克
算法论文7

Google 新论文离谱到家了,0延迟0成本通用,提升模型准确率最简单的方法。

Google新论文提出简单提升模型准确率的方法,即重复提示词,把完全一致的输入连续发2次。主流模型适用,经70项benchmark测试,0场景效果倒退,47个场景准确率提升,且几乎不增延迟、成本。

探索AGI
推荐文章8

阿里云CIO首次系统复盘:模型落地的RIDE方法论与RaaS实践突破

阿里云智能集团 CIO 蒋林泉分享模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。

InfoQ
开源动态8

AI秒懂短视频,快手模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
算法论文8

上交 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合研的LoPA - Dist分布式推理系统,显著提升扩散语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
算法论文8

VLA模型做长任务总断片?同济KC-VLA用关键帧链给治好了

VLA模型记性是短板,处理非马尔可夫任务常束手无策。同济学等提出KC - VLA框架,用关键帧链接赋予机器人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。

PaperAgent
新闻资讯7

对话西工徐韬:昇腾生态如何为AI创新装上涡轮增压?|甲子光年

本文讲述西工徐韬团队与昇腾平台深度合作的故事。他们从算子研究攻坚底层技术,开发抑郁症初筛等系统。昇腾还助力教学,让学生实践操作。未来,更多人将参与国产AI源头创新。

甲子光年
产品应用7

养虾时代终结?免部署、7×24小时在线、进化的“赛博骡子”来了!

全球首个进化个人AI——MuleRun(骡子快跑)正式发布,免部署、7×24小时在线、可主进化。它适配个体需求、实现群体智慧共享,能完成多类任务,还保障安全、提供售后。

量子位