「预训练范式」共找到 2907 篇相关文章
00后投身具身智能创业,剑指机器人界「Model 3」!已推出21个自由度灵巧手
具身智能创业公司灵初智能推出自研灵巧手,每只手21个自由度,操作能力强。其目标是将机器人整机价格打到17000美元,走‘Model 3式的产业破局之路’,还提出分层端到端算法解决训练难题。
对噢!为什么LMs就不能直接输出答案+confidence呢?
当前语言模型在复杂问答任务中存在校准退化问题,本文提出RLCR方法,将概率校准融入RL训练目标,重构奖励函数,在多个数据集实验中显著降低校准误差,不损失准确性,为高风险场景AI部署奠基。
2026年最火的AI机遇,为什么是「OPC」?
2025年末北京颁发首个OPC服务计划,中关村AI北纬社区打造OPC先行示范高地。OPC以一人带AI Agent跑通公司全流程,2026年将因边际成本崩塌、交互范式转移而爆发,文中还拆解5个顶级OPC样本并给出工具栈。
机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代
2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。
前端工程化演进之路:从手工作坊到AI驱动的智能化开发
本文回顾前端开发从jQuery到AI的变革,剖析工程化演进、性能优化进化,展示AI与前端深度融合新范式。还预测未来趋势,为开发者提供成长路径指导,强调工程化、性能优化、AI应用及持续学习的重要性。
每个人的AI科学助手!全球首个通用科学智能体来了,全网资源+1.7亿学术文献让科研效率狂飙
全球首个通用科研智能体SciMaster在WAIC亮相,由上海交大与深势科技共同发布。它能结合全网资源和1.7亿科学文献,有深度调研等功能,免费且可用于工作生活多方面,还将重塑科研范式。
全球首次,Transformer「混血」速度狂飙65倍!英伟达已下注
康奈尔、CMU等机构研究者提出「混合体」Eso - LM,融合自回归和离散扩散模型范式。它引入KV缓存机制,推理速度相比标准MDM提升65倍,在速度与质量平衡上超越BD3 - LM,引发AI领域关注,英伟达或押注此方向。
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。
代码生成要变天了?被质疑架空后,Yann LeCun携320亿参数开源世界模型“杀回来了”
在新一代代码生成模型不断涌现的当下,Meta FAIR CodeGen团队由Yann LeCun领导发布了代码世界模型CWM。它有320亿参数,创新训练方式使它不仅会写代码,还能模拟执行,性能测试表现不俗,在圈内引发热议。
张小珺采访了Kimi杨植麟,Agent泛化的临界点来了。
张小珺采访Kimi杨植麟,杨分享技术见解。如Scaling Law遇瓶颈,应提升Token效率;Adam与Muon对比,Muon学习效率高;模型公司下场做一方Agent产品,垂直整合模式上限高;还谈及长上下文、Agent训练及管理方式等问题。