多空交战」共找到 4167 篇相关文章

算法论文8

UIUC提出隐式监督新范式:无需标注/RM即可全面提升模态Reasoning的感知能力

大型模态模型在复杂模态推理中面临挑战,67%错误源于视觉感知缺陷。为此,UIUC提出PAPO,通过隐式感知损失提升模型感知能力,无需额外标注,在模态基准上表现优异,还解决了KL黑客问题。

深度学习自然语言处理
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
产品应用7

Proactor AI:首个自主行动的AI 智能体,无需唤醒,就能主动识别对面是个骗子

Proactor AI v1.0发布,号称是世界首个「自主行动」的AI队友。它能感知、思考并自主行动,如识别骗局。还提供主动式AI服务,应用场景广泛,用户反响热烈,带来人机交互范式转变。

AGI Hunt
算法论文8

集成20+先进算法,优于GPT-4o,自主因果分析智能体来了

加利福尼亚大学圣迭戈分校研究团队提出自主因果分析智能体 Causal - Copilot,集成超 20 种算法。它解决因果分析使用门槛高、预训练模型有局限等问题,性能优于 GPT - 4o ,已开源邀全球研究者参与。

机器之心
算法论文8

大模型时代,通用视觉模型将何去何从?

过去通用视觉模型(VGM)是研究热点,想实现‘视觉模型大一统’。但大语言模型发展使研究热点转移,视觉‘独立性’被重新定义。清华鲁继文团队综述梳理其进展,探讨现状、挑战与应用潜力。

机器之心
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
开源动态8

媲美DeepSeek!腾讯开源新版混元模型:AI Agent强化,超30种智能体指令

腾讯开源混元大模型最新版本Hunyuan - A13B,为专家混合模型,有800亿参数,130亿激活。支持快慢思考模式,针对AI Agent强化,设计超30种智能体指令。测试成绩超DeepSeek - R1等,架构和训练有优化。

AIGC开放社区
开源动态8

谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强模态模型

本周五凌晨,谷歌正式发布、开源全新端侧模态大模型 Gemma 3n。它有模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在方面实现质量提升。

机器之心
新闻资讯8

刚刚,何恺明官宣入职谷歌DeepMind!

AI大神何恺明正式入职谷歌DeepMind担任杰出科学家,同时保留MIT终身副教授身份。他因提出ResNet名震江湖,研究成果且获奖无数,今年也成果不断,将助力DeepMind的AGI目标。

新智元
算法论文8

ACL 2025 | 指令遵循不能仅靠常识?GuideBench 揭示大模型如何“踩雷”领域指南规则

这篇ACL 2025主会论文聚焦提升智能体指南规则遵循能力。提出评估基准GuideBench,涵盖7类1272个任务。实验显示数主流大模型指令遵循能力不佳,尤其数学推理挑战大,为模型迭代提供评估基准。

深度学习自然语言处理