「训练推理」共找到 3569 篇相关文章
AI无师自通,搞定所有家务!π0.5突破泛化极限,UC伯克利系出品
具身智能最大挑战是泛化能力,美国具身智能公司Physical Intelligence推出π0.5 VLA模型,通过异构任务协同训练实现泛化,可在全新家中执行各种家务,虽有不足但向广泛泛化物理智能迈进。
DeepSeek-OCR 2再进化,对图像理解已经像人一样逻辑推理了
DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图像理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。
95后,边改造业务边发AI顶会论文,是怎样的体验?
当下AI人才竞争激烈,企业各出奇招。今年5月京东技术沙龙零售专场,技术团队分享成果。几位95后青年专家讲述成长历程,如洛川解决CTR模型训练瓶颈,谦屹发表多篇顶会论文。京东还推出人才计划吸引人才。
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。
GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026
本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在多基准任务上超越基线算法。
一年磨一剑,今年最炸机器人Demo来了!1亿美元种子轮团队出手,单个模型解锁单手打蛋解魔方弹钢琴
Genesis AI发布机器人基础模型GENE - 26.5,让机器人可自主完成烹饪、实验室操作等复杂任务。该团队全栈自研,从硬件、数据、模型到训练评估都有独特方案,曾获1.05亿美元种子轮。
不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?
文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求大。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。
1400亿,他带走AI芯片独角兽的核心班底
平安夜英伟达官宣200亿美元与AI芯片初创公司Groq交易,后澄清是技术许可协议。英伟达获技术授权并整合产品,Groq核心团队加入,其继续独立运营,这或为“人才收购”,剑指AI推理市场。
为什么 AI 喜欢用破折号
文章探讨AI爱用破折号的原因。AI常用“delve”源于非洲导师打分偏好,但破折号并非如此。作者发现这一现象在GPT - 4后凸显,原因或为AI公司用旧书训练,使AI继承旧时代写作风格。
我为马斯克扮演机器人!擎天柱背后竟是最贵「演员团」
外媒揭秘特斯拉擎天柱靠人工数据训练。在实验室,员工重复日常动作,由摄像机记录。工作体力消耗大,要求严格,团队曾超百人,还裁掉部分人员。虽马斯克看好,但实际仍在靠人力蹒跚学步。