港科大(广州)」共找到 5072 篇相关文章

算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态模型

多模态语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。

深度学习自然语言处理
开源动态8

阿里云通义点金发布DianJin-R1金融领域推理模型,32B模型荣膺榜首

阿里云通义点金团队与苏州学合作推出DianJin-R1金融领域推理模型,介绍其开源数据集与模型、基于通义点金平台的数据合成,展示了其在性能测试中的优异表现,推动金融科技智能化进程。

机器之心
算法论文7

Nature重磅研究:模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?

《自然》研究表明,语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使脑‘变懒’。需按需调节使用。

AIGC开放社区
算法论文8

Meta&UIUC发现:无需标注,Agent复杂的工具使用和搜索能力,是可以“无中生有”的

Meta和UIUC研究发现,无需标注,Agent复杂工具使用和搜索能力可“无中生有”。论文Dr. Zero让模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。

深度学习自然语言处理
算法论文8

ICLR 2026 | 别再让模型“想太多”了!最新研究揭示 LLM 推理效率的关键瓶颈

语言模型推理计算成本失控,存在过度与思考不足问题。研究揭示推理失衡是根源,提出BAM模型及Plan - and - Budget框架,实验显示其能提升准确率与效率,转向‘推理价值’范式。

机器之心
新闻资讯8

清华2年前预言,正成为全球共识!Meta等三AI机构已得出同一结论

全球三家AI研究机构结论曲线斜率几乎重合,而中国面壁智能和清华联合团队两年前提出的“密度定律”与它们一致。该定律改写行业假设,如推理成本下降、端侧智能爆发临近、模型策略反转等。

新智元
开源动态8

阿里又上新!开源 7B 文生图模型,专治图中文字,效果媲美 20B+ 模型!

阿里 AIDC - AI 团队开源 7B 参数文生图模型 Ovis - Image,主打图中文字生成。它文本渲染能力强,在权威榜单成绩好,媲美 20B + 模型,官方还提供使用方法,是设计类刚需模型。

开源星探
算法论文8

智能体如何学会「想象」?深度解析世界模型嵌入具身系统的三技术范式

长期以来具身智能系统缺预测力,世界模型让智能体有了‘想象’未来的能力。中科等机构团队综述将现有研究划分为模块化、顺序、统一三架构集成范式,并指出未来研究方向。

机器之心
开源动态8

Qwen3家族训练秘籍公开:思考/非思考融进一个模型,模型蒸馏带动小模型

Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。

量子位
开源动态8

英伟达新架构引爆全模态模型革命,9B模型开源下载即破万

英伟达推出全模态模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。

新智元