「自回归动作世界模型」共找到 1401 篇相关文章
AI正在掏空大脑,思想沦为残废!未来只分AI的「主人」和「奴隶」
全世界为AI疯狂,它虽提供“认知捷径”,但长此以往并非好事。Section公司CEO Greg Shove分享使用AI经历,指出未来知识工作者将分化为“AI驾驶员”与“AI乘客”,并给出成为AI主人的方法。
OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官
Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。
训练数据爆减至1/1200!清华&生数发布国产视频具身基座模型,高效泛化复杂物理操作达SOTA水平
清华大学与生数科技联合研发Vidar模型,首次让通用视频大模型长出‘手脚’,实现从虚拟到真实世界物理执行的跨越。它降低数据门槛,突破跨本体泛化困境,为服务机器人应用奠定基础。
AI 基础知识从0.1到0.2——用“房价预测”入门机器学习全流程
文章以“房价预测”为例,介绍算法工程师开发模型全流程,包括需求分析、数据收集、划分数据集等十步。详细讲解各步骤操作,如用均方误差衡量模型效果,还提及多种模型及调优方法,助开发者入门机器学习。
Proactor AI:首个自主行动的AI 智能体,无需唤醒,就能主动识别对面是个骗子
Proactor AI v1.0发布,号称是世界首个「自主行动」的AI队友。它能感知、思考并自主行动,如识别骗局。还提供主动式AI服务,应用场景广泛,用户反响热烈,带来人机交互范式转变。
⼤模型是万能的吗?探索机器学习+⼤模型在某出海投资业务的应⽤
本文基于公共云大客户出海投资业务案例,探讨用AI大模型结合机器学习算法构建投资预算预测与分配系统。历经三版方案迭代,从纯大模型到引入机器学习算法,目前项目处于落地阶段,有望实现多方共赢。
DeepSeek-V3-0526 闪现后秒删!
Unsloth文档页面惊现DeepSeek新模型DeepSeek-V3-0526后秒删。该模型性能佳,团队还准备了技术描述。Daniel Han预测其可能端午节前发布,社区对此反应热烈,大家期待DeepSeek下一步动作。
Veo 3逼真脱口秀爆火全网,网友:彻底超越恐怖谷!Sora已被完爆
Veo 3生成的脱口秀视频全网爆火,人物、场景真实,声音和嘴型能对上,已超越恐怖谷。它或让人类进入‘模糊时代’,还会颠覆游戏、电影、广告等行业,未来AI生成内容或远超非AI内容。
AI开始玩乐高了?我拼一小时的乐高,它几秒就搭好,LegoGPT开源了!
卡内基梅隆大学提出LegoGPT,是首个依文本提示生成物理稳定乐高积木模型的方法。构建了StableText2Lego数据集,训练自回归大模型生成设计,还开发纹理生成法,设计能手动或机器人组装。
苹果新作:内化视觉思考,推理提速 5 倍
Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。