性能跑分」共找到 2665 篇相关文章

算法论文8

用“因果规划”解决多智能体协作中的任务依赖难题|港科广&腾讯

港科广和腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界多智能体系统。该方法含全局因果任务图,框架“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。

量子位
算法论文8

混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。

量子位
开源动态8

北大、字节跳动联手发布SWE-Swiss:一把修复代码Bug的「瑞士军刀」,完整配方直指开源SOTA

北大、字节跳动等联合研究提出SWE - Swiss配方,用于训练解决软件工程问题的AI模型。32B参数的SWE - Swiss - 32B在SWE - bench Verified上准确率达60.2%,各训练环节效果显著,模型和数据将开源。

机器之心
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

全球首个人形机器人通用视觉感知系统,Humanoid Occupancy建立多模态环境理解新范式

北京人形机器人创新中心推出 Humanoid Occupancy 感知系统,创新性融合多模态传感器信息,构建通用感知框架。它以语义占用表征为核心,有全编码和适配融合优势,经实验验证性能优,推动机器人迈向通用感知时代。

机器之心
开源动态8

革命性突破!Windows-MCP 开源:AI 助手直接操控实体电脑,告别按键精灵!

在AI驱动的桌面自动化领域,传统工具部署复杂且性能受限。最近GitHub开源的Windows - MCP工具,能让AI助手与Windows UI原生交互,可进行点击、输入等操作,支持Windows 7 - 11,无需传统计算机视觉技术。

开源星探
产品应用7

如何用AI Coding和Claude Code提升开发效率?看我的全流程复盘

作者享用AI Coding和Claude Code提升开发效率的经验。先谈AI Coding,如Prompt工程心得、划任务边界等;后讲Claude Code使用,包括安装、指令、构建项目规则等,还提及它在多场景的应用。

阿里云开发者
推荐文章7

8种LLM架构设计大比拼:从 DeepSeek-V3 到 Kimi K2,究竟有啥不同

文章对比了8种LLM架构设计,如DeepSeek-V3、OLMo 2等。介绍各模型关键技术,像DeepSeek-V3的多头潜在注意力和混合专家架构,还析不同设计对性能、效率的影响,助读者了解LLM架构差异。

CourseAI
开源动态8

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。

InfoQ
算法论文8

用动作块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA

如今强化学习在多领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利校研究者提出Q - chunking方法,将动作块引入基于时序差的强化学习,解决探索效率和值传播问题,实验表现优异。

机器之心