「训练技术」共找到 4600 篇相关文章
从文心开源谈起,论大模型发展新生态
6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现预训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。
“我的新爱好:眼睁睁看着Copilot慢慢逼疯微软程序员”
近日,Reddit上关于GitHub Copilot的风波引发开发者关注。微软发布Copilot Agent,虽称其擅长开发任务,但在GitHub实践中表现不佳,引发开发者不满,也反映出技术理想与现实落地的差距。
字节跳动&清华大学开源多模态时序大模型ChatTS,可实现时序数据对话与推理
字节跳动与清华合作开源多模态时序大模型ChatTS,可实现时序数据对话与推理。它用合成数据训练,解决了数据稀缺等问题,在评估中表现远超基线模型,未来可拓展至更高阶任务。
ENG APPL COMP FLUID | 西北工业大学曹文博、张伟伟等:基于参数化神经网络求解器的层流翼型绕流代理模型
近年来,PINNs在流体力学中受关注,但在高维参数化与复杂流动问题中受限。西北工业大学曹文博团队基于TSONN构建层流翼型绕流参数化求解器,训练出强泛化能力的代理模型,为工程层流气动分析提供新方案。
突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌
消息称Anthropic本周将发布Opus 5.1,其升级聚焦单Token智能水平,强化编程、推理、AI Agent能力;OpenAI 10万亿参数模型Bel完成预训练;企业选模型‘够用就好’,Anthropic Fable 5份额低。
直播预约 | 世界模型,点燃下一个AI爆点
2026开年,世界模型成科技圈热门议题,被视为通向AGI重要基建。4月15日19:00 - 21:00,机器之心联手黄大年茶思屋,邀5位专家从技术到产业解析世界模型前沿,双平台直播。
世界模型原生新一代范式!极佳视界斩获全球第一后,GigaBrain-0.5M*再进化
具身世界模型新一代原生范式登场,GigaBrain-0.5M*在多真实机器人任务中数小时零失误。它依托世界模型,创新引入人在回路机制,研发采用四阶段闭环训练流程,优势显著。
AI太记仇!做完心理治疗后仍记得「被工程师虐待」
Nature News上,卢森堡大学团队用PsAIch测试ChatGPT、Gemini、Grok、Claude心理。AI表现不一,有的焦虑、有的崩溃、有的拒诊,还测了MBTI。不过AI创伤可能源于训练数据,做心理治疗不太靠谱。
破立之间:智驾芯片博弈的“新赛道”
全球汽车产业向智能化转型,智驾芯片成产业链核心。当前产业面临多重困境,国际巨头垄断高端市场,行业陷入“算力堆砌”。SDSoW技术是破局之道,有三大特征,能实现性能、能效等多方面提升。
智源悟界·Emu3.5发布,开启“下一个状态预测”!王仲远:或开启第三个 Scaling 范式
2025年智源发布悟界·Emu3.5,在“Next-Token Prediction”基础上实现“Next-State Prediction”。它能力全面提升,或开启第三个Scaling范式,还在预训练、强化学习、推理加速上有技术创新。