两阶段训练法」共找到 3094 篇相关文章

新闻资讯8

中国人能飞!杭州发布全球首款站姿载人飞行器

杭州酷飞发布站姿个人飞行器Urban、坐姿个人飞行器Dream及自研NA80飞控系统。产品操作简便,已获海外近百台定金订单,还构建了安全防护体系并补齐保险。款飞行器定位不同,核心是自研飞控。

量子位
新闻资讯8

断崖第一!深度机智Z-WM再夺WorldArena冠军

2026年5月深度机智成立一周年,其Z - WM在WorldArena Track 2夺冠,领先30.5分。该公司围绕人类第一视角数据构建完整技术体系,其成果表明生成数据可用于具身智能模型训练,具身智能竞争重心正迁移。

机器之心
推荐文章8

3年、1万人,快手技术团队首次系统披露AI研发范式升级历程

快手首次系统性披露自2023年以来的AI研发范式升级历程。其研发效能演进分三阶段,从平台化到智能化,虽遇个人提效难传导至组织提效的问题,最终仍找到提升需求端到端交付效率的路径。

InfoQ
开源动态8

杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源

杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在多基准测试表现优,成本低于对手,还能提升办公生产力。

AIGC开放社区
产品应用8

你急它不急:GPT-5先判断,再决定「速答」还是「深想」

OpenAI副总裁Jerry Tworek透露,GPT - 5能判断问题难度,分配思考时间,决定何时停下。它升级了推理能力,有了时间感,采用受控思考机制,提升了复杂任务准确率,减少幻觉。其进化历经o1、o3到GPT - 5阶段

新智元
算法论文7

2篇论文,最新上下文工程技术一次性讲透!

上下文工程技术持续火热,文章分享10月篇相关论文。ACE让模型给自己写「战术板」,在多任务表现优;SA - ICL让LLM先搭框架再做题,在化学/物理准确率提升显著,还对二者做了横向对比。

CourseAI
新闻资讯8

中国AI芯片迎「华为时刻」

国内AI芯片市场正经历变革,“去英伟达化”成热词。科技巨头推动自研,9月国产芯片捷报频传,性能追赶超越英伟达。这既因地缘政治致供应链风险,也是AI从训练到推理转变下的必然选择。

芯师爷
产品应用8

全新 AI 消息模型:Apache RocketMQ 如何让 AI 应用拥抱事件驱动架构?

AIGC浪潮下,大语言模型重塑应用开发范式,开发者构建AI应用面临诸多挑战,需可靠高效的异步通信机制。Apache RocketMQ在AI时代演进,有轻量化通信与智能化资源调度大创新,还介绍了多场景实践。

InfoQ
算法论文8

推理速度飙升5倍,苹果提出全新Multi-Token生成框架!

自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。

PaperAgent
新闻资讯7

The Batch: 846 | 好模型做出坏选择

研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。

DeeplearningAI