DeepGen 1.0」共找到 2391 篇相关文章

算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
算法论文7

SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%

文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。

CourseAI
新闻资讯7

AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退

Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。

新智元
新闻资讯7

好你个智谱,模型价格搞双标:中国一套外国一套

网友发现智谱Max计划国内外价格差异大,中国469元(约68美元),西方160美元,引发热议。Hugging Face产品负责人力挺GLM - 5.1,而Claude被曝性能下滑、成本增加。

量子位
新闻资讯7

图像模型今夜变天?谷歌刚刚泄露了「Nano Banana Pro」这张王牌

谷歌DeepMind CEO置顶「预告」,传言中的Nano Banana Pro登场在即。它基于Gemini 3.0 Pro级引擎,速度、画质大幅升级,懂界面排版,创作力强,有望让图像模型迈进「专业级时代」。

新智元
开源动态8

“DeepSeek 时刻” 一周年

本文回顾 2025 年 1 月 “DeepSeek 时刻” 后中国开源 AI 社区转折,分析其对全球开源生态的重塑。指出 DeepSeek R1 降低三门槛,推动战略转变,全球也积极应对新开源热潮。

Hugging Face
新闻资讯7

Artificial Analysis:DeepSeek成为世界前二AGI实验室

模型与API独立分析公司Artificial Analysis对DeepSeek R1-0528评估显示,其一举超越xAI、Meta等,与谷歌并列全球第二大人工智能实验室,在多方面性能提升,缩小了开源与闭源模型差距。

AI寒武纪
产品应用8

华为曝光两大黑科技!打破推理延迟魔咒,大模型从此「秒回」

华为通过FusionSpec和OptiQuant两大技术创新,对MoE模型进行推理优化。FusionSpec依托昇腾特点,将投机推理框架耗时降至1ms;OptiQuant支持灵活量化,为大模型推理提供高性价比。

新智元
开源动态7

龙虾也能养龙虾!UCSD发布AIBuildAI智能体,MLE-Bench榜单第一

加州大学圣地亚哥分校团队推出AIBuildAI智能体,用户用自然语言描述任务,它就能自动完成AI模型开发。在OpenAI MLE - Bench测试中,其以63.1%获奖率居首,性能媲美人类专家。

新智元
新闻资讯8

谷歌与OpenAI对狙,Gemini主打极速性价比,GPT优化对话温度

谷歌与OpenAI对狙,谷歌发布Gemini 3.1 Flash - Lite,主打规模化性价比,专为高频场景设计,成本低、速度快;OpenAI上线GPT - 5.3 Instant,优化对话体验,减少拒答、增强联网搜索等。

AIGC开放社区