「推理训练数据」共找到 5141 篇相关文章
马斯克xAI自研推理芯片曝光!代号X1、台积电3纳米工艺、明年就量产
马斯克的xAI被曝自研推理芯片X1,用台积电3纳米工艺,2026年三季度量产。此前xAI就为自研芯片招兵买马,还将在西雅图设办事处。此外,特斯拉也在推进自研推理芯片。
突发!OpenAI停止强化学习训练两周
OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。
AI让全人类思维越来越雷同!南加大研究实锤:认知多样性正在被抹平
南加州大学论文指出,AI正让全人类想法和表达同质化,体现在语言、视角和推理三方面。原因包括训练数据有偏差、训练目标求稳、人们过度依赖。研究人员虽在想办法,但效果有限,呼吁勿无节制依赖。
会“思考”的目标检测模型来了!IDEA提出Rex-Thinker:基于思维链的指代物体检测模型,准确率+可解释性双突破
现有目标检测方法有决策不透明和拒识能力不足问题。IDEA提出Rex - Thinker,引入“逻辑推理链”,构建可解释推理框架,经两阶段训练,在测评中准确率提升,可解释性强,有良好泛化能力。
源神阿里!图像生成Ovis-Image再开源,7B小参数媲美GPT-4o和20B开源模型
阿里Ovis团队发布Ovis - Image,7B参数文本到图像模型,在文本渲染任务媲美GPT - 4o和20B + 开源模型。它架构优化、数据工程精细、训练范式独特,实测数据表现佳,显存占用低、推理快。
全自研仿真GPU求解器x虚实对标物理测量工厂,打造具身合成数据SuperApp,加速具身仿真生态丨光轮智能@MEET2026
在量子位MEET2026大会上,光轮智能杨海波指出具身智能核心是数据,仿真是解决数据问题的唯一方案。光轮智能自研“测量、生成、求解”基础设施,建立全栈仿真平台,还打造多个“爆品应用”,为具身智能发展提供支撑。
0.5B以小搏大拿下端侧模型新SOTA:4090可跑,长文本处理5倍常规加速丨清华&面壁开源
清华大学和面壁智能团队开源MiniCPM 4,有8B、0.5B两种参数规模,以22%训练开销达同级别最优。它在架构、推理、数据、训练多方面创新,性能领先,适用于综述生成、工具调用等场景。
李静海院士团队:未来数据系统的逻辑与架构 | Engineering
本文展望数据科学未来,强调其对AI重要性。探讨科学数据系统挑战,提出收集处理原则,指出要重视数据系统逻辑与架构研究,建立标准协议框架,促进AI健康发展。
LLM本质上永远无法实现真正的正确推理
日本埼玉大学荣誉教授Jingde Cheng论文指出,以ChatGPT为代表的大语言模型(LLM)本质上无法实现真正的正确推理。论文定义了“正确推理”,从逻辑和计算原理论证其局限性,为推理智能体研究指明方向。