大模型3.0」共找到 9992 篇相关文章

新闻资讯7

模型终于通关《宝可梦蓝》!网友:Gemini 2.5 Pro酷爆了

Gemini 2.5 Pro在直播中通关《宝可梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝可梦对模型的挑战,谷歌将继续探索,网友提议用通关宝可梦测试模型

量子位
算法论文8

强化学习+模型记忆:Mem-α,让智能体第一次学会“如何记忆”

语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。

机器之心
开源动态8

刚刚!Qwen3深夜升级,碾压Kimi K2和DeepSeek V3

通义千问更新旗舰版Qwen3模型,推出Qwen3 - 235B - A22B - Instruct - 2507 - FP8。新模型通用能力显著提升,在多测评中超Kimi - K2等模型,还增强多语言覆盖等性能,已在魔搭和Hugging Face开源。

新智元
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对AI应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

PaperAgent
开源动态8

英伟达开源9B参数小模型,比Qwen3快6倍

英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝部分数据。

量子位
算法论文8

模型“边看边改”,视觉分割准确率直接上涨9% | ICML 2026

复旦、创智联合推出RSAgent,让多模态模型通过多轮工具调用生成准确掩码,解决视觉分割难题。该工作入选ICML 2026,实验显示其在多个测试集上表现领先,还展示了从‘看图问答’到‘视觉行动’的路径。

量子位
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

由中国电子商会归口,智合标准中心组织起草的《人工智能模型私有化部署技术实施与评价指南》团体标准立项,正征集起草单位和个人。该标准可解决企业部署难题,由多元主体联合起草,参与有重要价值。

PaperAgent
产品应用8

“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感

5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率超95%,还发布实时绘画板功能,后续将推原生多模态模型

AI科技大本营
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI政策频出,企业对AI应用需求攀升,倾向私有化部署,但行业面临技术错配等问题。国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

AI工程化
算法论文8

清华上交满分论文证明:强化学习并不能让模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让模型更会思考,推理能力上限仍由基础模型决定。

AI工程化