亿嘉和」共找到 6923 篇相关文章

算法论文8

ICLR 2026|多模态大模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态大模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文大学阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。

机器之心
推荐文章7

Dify、n8n、Coze、Fastgpt、Ragflow到底该怎么选?超详细指南~

文章对比了Dify、Coze、n8n、FastGPTRAGFlow五个主流平台,从功能、使用体验、应用场景等方面详细分析其特点,给出选择建议,还提醒考虑预算、技术能力等要素,帮读者选合适平台。

开源星探
产品应用8

字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?

文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码试用链接。

CourseAI
算法论文8

NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了

大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率推理速度。

机器之心
开源动态8

微软开源智能呼叫中心,完全替代人工客服

微软开源基于AzureOpenAI GPT的智能呼叫中心解决方案,可完全替代人工客服。它功能强大,支持多语言、实时流式对话等,还能定制。文章详细介绍了部署步骤、高级用法等内容。

GitHubStore
算法论文8

NeurIPS 2025 Best Paper | 扩散模型不为人知的“时间差”:为什么先学会创作,后学会抄袭?

深度学习中,扩散模型能生成新图像且抗过拟合。巴黎高师博科尼大学研究团队论文指出,这源于隐含的动力学正则化,训练分两阶段,数据量增加会拉开‘泛化窗口’,还给出数学解释。

深度学习自然语言处理
算法论文8

CVPR 2025 | 多模态统一学习新范式来了,数据、模型、代码全部开源

中国人民大学、清华腾讯合作的CVPR 2025论文指出,当前多模态学习范式有缺陷。为此提出新范式,构建AV - UIE数据集、Crab框架,实现任务互助,在多任务上超垂类专家模型,数据、模型、代码开源。

机器之心
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性视频质量。

AI科技评论
新闻资讯7

Claude断供OpenAI,AI编程竞争再升级

Anthropic撤销OpenAI员工对Claude的访问权,称其违反服务条款。此前OpenAI用Claude辅助GPT - 5开发安全测试,Anthropic CEO抨击OpenAIMeta,社交平台对此事讨论热烈。

量子位
新闻资讯7

中美安全公司经营对比及原因分析

国内网络安全上市公司财报多显示亏损,而美国同类公司增长与盈利能力强。分析指出,差距源于市场国际化、产品能力人的因素。国内市场内卷,产品竞争力弱,部分公司决策态度存在问题。

AI与安全