「语言探索」共找到 1759 篇相关文章
离谱……面壁让 AI 写了个训练框架,然后它自己训出了最强的 1B 模型:MiniCPM5-1B
面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。
WWW'26 | 跨任务自适应的Multi-Agent协作新范式
大型语言模型驱动的多智能体系统成解决复杂任务重要范式,但智能体协作存在关键问题。Griffith和西北农林科技大学团队提出OFA - MAS,将多智能体拓扑设计从one - for - one推向one - for - all,实验效果佳。
DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude
DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。
0人类数据,让机器臂自学拧灯泡:MIT初创要打造机器人界的AlphaZero
Eka Robotics 发布机械臂视频,其能自主拧灯泡、抓取物品。该公司提出 VFA 模型,不依赖人类数据,让机器人在仿真环境自主探索。创始人期望实现超人级灵巧操作,算法还展现泛化和自主发明策略能力。
ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展
大语言模型强大但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。
龙虾冲浪终于不迷路了!网页智能体新框架Avenir-Web开源即SOTA
伦敦大学学院等团队推出开源框架Avenir - Web,解决现有Web Agent在复杂网页操作中的难题。它采用模块化设计,包含经验模仿规划等模块,在ONLINE - MIND2WEB测试中表现出色,已开源供开发者探索。
游戏行业不缺AI工具,缺什么?腾讯游戏用一场大赛给出答案
游戏行业虽有 AI 工具,但存在结构性错配,缺复合型人才。腾讯 2026 游戏创作大赛升级为开放式孵化接口,开放 AI 工具,设共创赛区,还提供经验传承、奖金及资源对接等,探索人才培养与行业发展。
重磅开源!240亿参数力压Nano Banana 2
4月初,京东探索研究院开源JoyAI - Image - Edit图像模型。它是业内首个将「空间智能」写进底层的开源一体化图像模型,能让模型「理解空间,编辑空间」,在电商和具身智能场景极具价值。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
编程智能体的核心组件【译】(重发,补图)
文章围绕编程智能体展开,先厘清大语言模型、推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能体六大核心组件,还对比了与 OpenClaw 的区别。