「大模型预训练」共找到 9650 篇相关文章

推荐文章8

AI 基础知识从0.1到0.2——用“房价预测”入门机器学习全流程

文章以“房价预测”为例,介绍算法工程师开发模型全流程,包括需求分析、数据收集、划分数据集等十步。详细讲解各步骤操作,如用均方误差衡量模型效果,还提及多种模型及调优方法,助开发者入门机器学习。

阿里云开发者
7

2027年实现AGI?计算物理学家怒怼:纯属无稽之谈!

知名博主Scott Alexander领衔的项目称AI将在2027年达超人智能。但计算物理学家经研究指出,该预测模型漏洞百出,如数学错误、曲线选择无依据、图表与模型不符等,即便新模型改进部分问题,多数批判仍成立。

AGI Hunt
算法论文8

全球首个,连续时间具身世界模型!任意帧率自由生成

来自清华AIR与UC Berkeley BAIR的团队提出全球首个连续时间具身世界模型ODEWorld。它学习世界在每个时刻的变化方向与速度,能任意帧率自由生成,统一了离散模型分散的生成能力。

新智元
推荐文章7

精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事

文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是在合适时间将合适上下文装入合适模型。

腾讯技术工程
推荐文章7

2026数据中心趋势报告:从芯片到工地全球数据中心十大演变

Soben报告展示2026数据中心产业图景,涉及速度、技工、选址等十大趋势与三大区域市场。如速度决定营收,蓝领技工需求旺,边缘数据中心竞争烈,还提及了能源、冷却、芯片等方面情况。

AIGC开放社区
算法论文8

何恺明组三位本科生领衔!持续聚焦Flow模型,突破归一化流生成效率瓶颈

何恺明团队新作聚焦Flow模型,提出双向归一化流(BiFlow)框架,解耦前向与逆向过程,打破传统归一化流生成模型效率低下问题。三位一作是本科生,实验显示其速度和质量表现出色。

量子位
产品应用7

Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流

Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。

InfoQ
新闻资讯7

马斯克:Optimus 将成为有史以来最大的产品,比第二大10倍!

马斯克演讲称Optimus将成有史以来最大产品,比第二大产品大10倍,还展示其家务能力。网友反应多样,有技术疑问、应用幻想,也有价格质疑,Tesla股东很兴奋,激起全网讨论。

AGI Hunt
算法论文8

CVPR 2025 | 多模态统一学习新范式来了,数据、模型、代码全部开源

中国人民大学、清华和腾讯合作的CVPR 2025论文指出,当前多模态学习范式有缺陷。为此提出新范式,构建AV - UIE数据集、Crab框架,实现任务互助,在多任务上超垂类专家模型,数据、模型、代码开源。

机器之心
推荐文章7

对话鹿明CTO丁琰:数据会反向决定模型,甚至影响硬件形态 | GAIR 2025

本文是对鹿明CTO丁琰的访谈。丁琰博士最早将UMI落地实践,其数采方案「FastUMI」受青睐。他认为UMI是完整体系,数据会反向影响多方面。还对比多种数采方式,介绍FastUMI改进及Pro版优势。

AI科技评论