泛化推理能力」共找到 4722 篇相关文章

产品应用8

阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型

5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。

InfoQ
新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 大模型与本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA大模型技术,推进自研机器人本体工程化与量产。其VLOA大模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
产品应用8

ChatGPT Images 2.0震撼发布!碾压谷歌Nano Banana,设计真要完了

北京时间凌晨3点,OpenAI发布ChatGPT Images 2.0,是先进模型,能处理复杂视觉任务。它精度控制力高、多语言能力强,风格表达成熟,支持多种宽高比,有现实世界理解能力等,已向相关用户开放,但也有局限性。

机器之心
开源动态8

刚刚,最佳VLA模型GigaBrain-0开源:世界模型驱动10倍数据,真机碾压SOTA

近日,极佳视界与湖北人形机器人创新中心联合发布端到端VLA具身基础模型GigaBrain - 0,这是国内首个用世界模型生成数据实现真机泛化的模型,后续将全面开源,能完成复杂操作,实验成功率超SOTA方法。

新智元
开源动态8

Yann LeCun放出憋了20年的大招:Meta开源V-JEPA 2世界模型

Meta发布V-JEPA 2世界模型,参数高达10亿,推理速度比英伟达Cosmos快30倍。它基于Vision Transformer架构,是Yann LeCun倡导多年的JEPA路线成果,仅需62小时机器人数据训练就能执行任务,打脸质疑者。

AGI Hunt
推荐文章7

对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限

AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。

InfoQ
开源动态8

一夜之间,AI终获「永久记忆」!最难考试99%刷爆SOTA,全网直呼疯狂

新智元报道,Supermemory团队推出超级记忆系统ASMR,在AI记忆界最难考试LongMemEval中刷到99%准确率。它抛弃传统模式,采用多Agent并行推理,4月初将开源代码。此外,其背后的Supermemory引擎功能强大,能让AI真正拥有记忆。

新智元
开源动态8

OpenClaw 能“边用边训”了:智能体强化学习训练框架 AReaL v1.0 稳定版发布

3月4日,蚂蚁集团联合清华发布开源强化学习训练框架AReaL v1.0稳定版,主打‘Agent一键接入RL训练’。它解决现有智能体框架接入训练成本高、缺乏持续进化能力的问题,还推出原生训练引擎Archon,集成AI辅助开发体系。

InfoQ
新闻资讯7

刚刚,OpenAI Astra核心架构爆出:大模型第三条Scaling法则诞生

The Information记者爆料OpenAI即将推出的Astra模型采用“recurrent depth”新推理方法,该技术能降本提效,但引发AI安全与可观测性担忧。清华与字节论文解决了循环模型“算力不公平”问题,并给出Scaling Law。

AI寒武纪
产品应用7

Kimi K3设计榜登顶焚诀公开:就藏在思维链里

Kimi K3在Design Arena单次生成前端榜单中夺冠。它做前端设计审美一流,靠独特思维链反复迭代优化方案,还具备强大数据索引能力。不过上线48小时因算力不足叫停新订阅。

量子位