代码能力评测」共找到 4850 篇相关文章

新闻资讯8

谷歌Pixel发布汇总:硬件与软件全面AI化,那谁你就学叭

谷歌2025年硬件发布会展示众多AI能力,如Gemini驱动的健康教练、拍摄指导、智能大屏设备等。Pixel 10手机搭载芯片可本地运行模型,还有多项实用AI功能,凸显硬件与软件全面AI化趋势。

歸藏的AI工具箱
算法论文8

AI修Bug新SOTA:SWE-Bench Lite60.33%修复率,像人一样能积累经验,中科院软件所出品

ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复率达60.3%居首。

量子位
新闻资讯8

吴恩达:产品经理才是 AI 时代的最大瓶颈

吴恩达指出,AI编程助手使写代码变快,‘决定做什么’成新瓶颈,即‘产品管理瓶颈’,产品经理比程序员更稀缺。他强调用户同理心和心智模型,认为软件开发正从技术驱动转向价值驱动。

AGI Hunt
开源动态7

谷歌又来砸饭碗!免费AI Agent发布,程序员狂喜

昨天谷歌发布免费开源的AI Agent Gemini CLI,可在电脑终端运行。它定位为开源AI Agent,能理解任务、制定计划和调用工具。免费额度慷慨,能力不限于编码,上手简单,但刚发布存在不稳定情况。

探索AGI
开源动态8

月之暗面刚开源多模态Kimi-2506:智能体、视觉理解,重磅大升级

国内月之暗面平台对开源多模态模型Kimi-VL-A3B-Thinking升级到2506版本。该版本性能、视觉理解等能力提升,支持更高分辨率,在多领域表现出色,还介绍了模型组成与优化器改进。

AIGC开放社区
新闻资讯8

AI中场,谷歌和百度的爆发式加速

AI大战第三年,谷歌和百度火力全开。谷歌Gemini能力出众,谷歌全家桶变身通用Agent;百度40天连发四款新模型,智能云增速惊人。全栈模式展现超强弹性,AI产业导向“全优生”式胜利。

远川科技评论
产品应用8

终于不用羡慕老外了!美团竟然做出了类似V0&Bolt的AI编程神器

美团推出零代码应用生成工具NoCode,类似V0&Bolt。它功能强大,能生成复杂网页应用,支持提示词生成、自动优化、快速部署等,还自带数据库服务,免费且无需邀请,为国内Vibe Coding带来曙光。

歸藏的AI工具箱
开源动态8

智元机器人发布并开源首个机器人动作序列驱动的世界模型

智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,解决具身智能演进制约,提升策略模型筛选与训练效率。

InfoQ
算法论文8

Agentic AI的第三种范式来了,16家机构提出「伴身智能体」

16家海内外高校与科研机构的22位研究者提出ComBodied Agents新范式,它围绕人的长期状态与主体性构建。论文给出闭环技术框架与评测标准,还提到研究难点与风险,也为产品实践提供指导。

机器之心
算法论文8

华为 IJCAI 2026 论文盘点:从「规模密度」转向「设计密度」

IJCAI 2026将召开,AI算力成本高,参数扩张边际收益低,技术创新逻辑转向‘用得更省’。华为四篇被收录论文,用精巧架构和训练策略,在四方向展现系统化工程能力,提供技术转型路径。

AI科技评论