后训练阶段」共找到 4137 篇相关文章

新闻资讯7

Physical Intelligence联创最新访谈:机器人尚未进入可预测的Scaling阶段

2024年末PI实验室测试,机器人表现有惊喜也有“语义上说得通的错误”。联创Levine在访谈中认为,机器人未到可预测Scaling阶段,还在确定规模化技术路径,也谈到数据、泛化、可靠性等问题。

DeepTech深科技
新闻资讯7

老黄再收95华人才俊!4亿美元收购AI初创公司

英伟达老黄以超4亿美元收购95华人王尚创立的AI初创公司CentML,员工全部打包带回。该公司能整合软硬件资源,可增强英伟达CUDA工具链。此前老黄已收购多家相关初创公司揽人才。

量子位
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
推荐文章7

Thinking Machines 发布第二篇博文:用模块化流形让训练更加稳定高效

Thinking Machines实验室发布第二篇Connectionism研究文章,提出模块化流形理论框架,通过在权重矩阵施加流形约束让神经网络训练更稳定高效。文章从几何角度思考优化问题,提出流形Muon优化器,还探讨了模块化流形扩展到大型网络的方法。

AGI Hunt
新闻资讯7

奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报

OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。

量子位
新闻资讯7

直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?

为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。

深度学习自然语言处理
新闻资讯7

独家发布 Qclaw 24 小时,OPC 们涌入观猹,等一个邀请码

腾讯发布桌面 Agent 工具 QClaw 热度飙升,逼近字节豆包。因其可通过微信调用,安装门槛低。观猹成 AI 产品冷启动首选平台,还衍生出龙虾到家服务,观猹员真实评价助产品迭代。

特工宇宙
算法论文8

大象秒变挖掘机!三维变形新突破,无需额外训练 | CVPR'26

南京大学与北京大学提出MorphAny3D,无需额外训练即可让三维生成模型实现跨类别平滑变形。它通过创新注意力机制融合源与目标特征,精准控制结构与时序,效果远超传统方法,代码已开源。

新智元
新闻资讯7

离开OpenAI和Google,两位大模型核心负责人决定卷下一代架构

曾是OpenAI的「强化学习最大主义者」Jerry Tworek,与谷歌Gemini预训练负责人Rohan Anil,共同创办Core Automation。他们探讨当前AI路线问题,认为下一代架构要能持续学习,还计划打造自动化AI实验室。

机器之心
算法论文8

超低标注需求,实现医学图像分割!UCSD提出三阶段框架GenSeg

GenSeg用AI生成高质量医学图像及对应分割标注,在仅有几十张样本时也能训练出媲美传统深度模型的分割系统,显著降低医生手工标注负担。它是通用、与模型无关的框架,可集成到现有分割模型。

新智元