编程竞赛基准」共找到 2040 篇相关文章

算法论文8

AAAI 2026 Oral | 拒绝「一刀切」!AdaMCoT:让大模型学会「看题下菜碟」,动态选择最佳思考语言

多语言大模型面临语言选择难题,现有跨语言推理方法存在缺陷。新加坡研究团队推出AdaMCoT框架,通过自适应路由机制动态选语言推理,提升跨语言事实推理准确性与一致性,效果超越传统方法。

机器之心
算法论文8

Meta通过简单算术解锁LLM SoTA性能

大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。

深度学习自然语言处理
产品应用7

AI出码率70%+的背后:高德团队如何实现AI研发效率的量化与优化

文章围绕建立统一数据采集和指标体系,搭建AI统一数据采集能力,定义AI出码率等核心指标,构建AI效率研发指标体系,还介绍了数据采集方案、指标计算等,实现数据驱动闭环。

阿里云开发者
算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。

机器之心
新闻资讯7

忘掉大模型,微软实证:小模型才是Agentic AI的未来!

过去两年大模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B小模型学会‘写代码→跑结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。

PaperAgent
新闻资讯8

吴恩达:不理解计算机的工作原理,你不可能单靠 Vibe Coding 就走向卓越,基础知识依然至关重要

吴恩达指出懂AI的开发者供不应求,但计算机专业应届生失业率上升,因大学课程未跟上时代。他面试看重借助AI助手开发、运用AI基础模块构建应用等能力,强调基础知识仍重要。

宝玉AI
算法论文8

科研智能体「漫游指南」—助你构建领域专属科研智能体

该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。

机器之心
推荐文章8

入职OpenAI啦!这是我的AI Research面试指南

作者分享入职OpenAI的面试经历、经验与建议。涵盖身心调适、通用建议、各环节应对技巧等,如提前准备、与朋友模拟、注意设备和细节等,助读者应对AI Research面试。

深度学习自然语言处理
算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心
新闻资讯7

GPT-5的所有传言,以及,Sora 2?

OpenAI今晚1点举办直播,GPT - 5将亮相。发布前关键信息汇总,包括直播时长变长、GitHub泄露四个版本、三档定价策略、突破人类基准测试等,还或同步发布Sora 2。

AGI Hunt