大模型预训练」共找到 9479 篇相关文章

新闻资讯7

征集全国首部AI模型私有化部署标准起草单位和个人!

智合标准中心组织起草国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》,已正式立项并征集起草单位和个人。该标准能解决企业部署痛点,有全流程覆盖等亮点。

AI工程化
新闻资讯7

阿里千问模型换将,32岁林俊旸官宣告别

阿里巴巴高级算法专家、通义千问模型负责人林俊旸宣布告别千问团队,此前一晚千问团队刚推出Qwen3.5轻量化模型且获马斯克点赞。此外,Qwen3.5核心贡献者Kaixin Li和通义实验室科学家Binyuan Hui也发文告别,几人去向未明。

量子位
新闻资讯7

模型终于通关《宝可梦蓝》!网友:Gemini 2.5 Pro酷爆了

Gemini 2.5 Pro在直播中通关《宝可梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝可梦对模型的挑战,谷歌将继续探索,网友提议用通关宝可梦测试模型

量子位
算法论文8

强化学习+模型记忆:Mem-α,让智能体第一次学会“如何记忆”

语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。

机器之心
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对AI应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

PaperAgent
算法论文8

人格向量:模型性格的数学解码与精准操控

语言模型在应用中会出现危险行为偏移与训练引发的非预期偏移,传统方法难监控干预。本文发现人格特质在线性方向表现为“角色向量”,实现提前预测、实时监控和主动控制,为AI安全提供数学框架。

深度学习自然语言处理
算法论文8

模型“边看边改”,视觉分割准确率直接上涨9% | ICML 2026

复旦、创智联合推出RSAgent,让多模态模型通过多轮工具调用生成准确掩码,解决视觉分割难题。该工作入选ICML 2026,实验显示其在多个测试集上表现领先,还展示了从‘看图问答’到‘视觉行动’的路径。

量子位
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

由中国电子商会归口,智合标准中心组织起草的《人工智能模型私有化部署技术实施与评价指南》团体标准立项,正征集起草单位和个人。该标准可解决企业部署难题,由多元主体联合起草,参与有重要价值。

PaperAgent
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI政策频出,企业对AI应用需求攀升,倾向私有化部署,但行业面临技术错配等问题。国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

AI工程化
新闻资讯7

突发!OpenAI停止强化学习训练两周

OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。

机器之心