实验评测」共找到 1865 篇相关文章

开源动态8

图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025

360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。

AI科技大本营
算法论文7

机器人从炫技 Demo 走向上岗,两篇 ICML 顶会论文拆解背后的智能底座

在WRC世界机器人大会上,云蝶科技发布RoboForge系统级具身大脑和WING任务型本体。其科研团队两项成果POLIA与Strat-Reasoner发表于ICML 2026,从视觉证据和他者意图两方面,为理解具身大脑技术提供切口。

AI科技评论
产品应用8

半价干翻Fable 5?Opus 5实测炸场,网友:差点从椅子上摔下来

Anthropic新模型Opus 5登场,多项评测中追平或反超Fable 5,价格仅为一半。网友实测表现出色,还具备硬核自检流程,性价比高。另外,Claude Code提示词删减八成,成绩未降。

量子位
算法论文8

ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

强化学习获取高质量样本成本高、风险大,现有基于扩散模型的样本增强方法有局限。浙江理工大学马啸讲师和南京大学李武军教授课题组提出 EMCES,将情景记忆机制引入可控扩散模型,提升下游强化学习算法表现,论文已被 ICML2026 录用。

机器之心
新闻资讯8

拖更三年,北大校友翁荔最新长文刷屏!

前OpenAI副总裁Lilian Weng发布拖更三年的长文《Scaling Laws, Carefully》,指出AI行业依赖的Scaling Laws远比想象脆弱。OpenAI和DeepMind对算力分配结论相反,且Chinchilla方法论也有问题,同时数据快用完,经典公式前提在崩塌。

新智元
算法论文8

从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代

快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。

机器之心
算法论文8

ICLR 2026 | 救命,手机Live Photo重选封面终于不糊了

vivo 蓝图实验室与南开大学联合发布研究,被 ICLR 2026 接收。该研究定义了 Live Photo 重选封面帧修复任务,提出 LiveMoments 方案,利用原始封面帧作参考提升画质,实验表现优,应用场景广。

机器之心
新闻资讯8

在ICLR 2026主会之前,我们和30多位入选者聊了聊最前沿的AI细节

4月14日,智源社区、DeepTech联合举办ICLR 2026预讲会。会议聚焦顶会核心精华,三十余位论文作者分享AI Agent、大语言模型等热门领域成果,展示解决大模型痛点的研究。

DeepTech深科技
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
新闻资讯7

AI 时代的人们,正在两极分化

文章指出人们对AI的认知正出现巨大裂缝,Karpathy将人分为两拨,一拨用免费版ChatGPT后认为AI不过如此,另一拨花高价订阅前沿模型感受其惊人进步。不同用户群体使用的AI能力代差大,还提及使用时长维度。

AGI Hunt