模型能力提升」共找到 9790 篇相关文章

开源动态8

突破具身智能任务规划边界,刷新具身大脑多榜单SOTA,中兴EmbodiedBrain模型让具身大脑学会「复杂规划」

当前主流大语言模型在具身任务场景面临瓶颈,中兴星云大脑团队推出具身视觉 - 语言基础模型 EmbodiedBrain,构建全流程创新框架,在架构、数据训练、评估体系等方面有突破,还将开源成果推动生态发展。

机器之心
算法论文8

机器人学会“脑补”触感,叠衣服端茶水成功率暴涨90%

近年来,人形机器人研发从行走转向复杂操控,但处理精细家务表现逊色。卡内基梅隆大学联合博世人工智能中心团队提出 HTD 模型,让机器人预判触觉,在 5 项任务上成功率提升 90.9%,部分代码开源。

DeepTech深科技
算法论文8

Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”

来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力

量子位
产品应用7

Deepseek 正式发布 V3.1:混合推理,Agent能力大幅提高,token消耗减半

Deepseek正式发布Deepseek V3.1,采用混合推理,支持双模式切换,上下文扩展到128k,API支持Claude Code调用。工具与Agent能力提升,思考效率更高,token消耗减半,官方渠道全面升级,9月6号起调整价格。

AI寒武纪
算法论文8

VDC+VBench双榜第一!强化学习打磨的国产视频大模型,超越Sora、Pika

复旦大学等机构将强化学习引入视频生成领域。提出的Cockatiel方法在VDC榜单夺冠,IPO方法在VBench登顶,超越Sora、Pika等模型,优化后视频生成效果在多方面显著提升

机器之心
产品应用7

Target 公司借助生成式 AI 推荐将“加入购物车”互动率提升 11%

Target公司为应对零售目录中配套产品组合复杂挑战,部署基于生成式AI的配件推荐系统GRAM。它用大模型分析产品数据,结合人工审核,A/B测试显示提升了互动率和转化率,已全面投入生产。

InfoQ
产品应用8

突破遥操瓶颈!全新无本体数据世界动作模型Noe-0发布

穹彻智能发布世界动作模型 Noe - 0,全链路采用无本体采集数据。其数据来自真实环境,配合 World Action Model 架构和 AI - Native 数据基础设施,跑通从真实世界经验到机器人能力转化的完整链路,是具身智能的里程碑。

机器之心
新闻资讯7

扒一扒Meta全新大模型Muse Spark里藏着的PDR技术

Meta发布闭源大模型Muse Spark及‘沉思模式’,背后藏PDR推理技术。该技术通过‘并行起草+精炼’突破性能瓶颈,对比传统长CoT范式优势明显,在AIME竞赛题目测试中准确率显著提升

PaperAgent
开源动态8

斩获3K+ star,再见传统开发!这款开源AI后台开发框架让效率提升300%

ruoyi - ai是基于ruoyi - plus开发的开源AI平台,集成前沿模型,有聊天、绘画等全栈AI能力,具多模态交互和企业级部署支持,核心功能丰富,技术架构优,有实战成效,与同类有差异。

小华同学ai
算法论文8

SPIRAL:零和游戏自对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心