编程竞赛基准」共找到 2037 篇相关文章

新闻资讯8

52天73次产品级更新,个个爆款太神了,AI原生组织的进化恐怖如斯

2月1日到3月23日,Anthropic在52天内进行73次产品级发布,Claude Code和Cowork表现亮眼。其核心是把AI当基础设施,实现商业化且推动公司高估值,给传统组织带来冲击,AI赛道成组织进化竞赛

鲸选AI
推荐文章8

吴恩达来信:如何突破产品管理瓶颈

吴恩达指出编程助手带来“产品管理瓶颈”,即决定构建什么成难题。具备用户同理心的产品经理很关键,可凭直觉决策。还介绍通过多种策略获取用户反馈,强调用数据构建用户心理模型做决策。

DeeplearningAI
7

Cursor SDK正式发布,“cursor” inside!

四月最后一天,Cursor正式发布TypeScript SDK,将智能代理运行时打包成可编程组件,跳出编程工具定义。它提供完整开发套件,支持双模部署,已有公司用其做三件事,还包含关键部分,Composer模型开放有战略价值。

AI工程化
开源动态8

分割一切、3D重建一切还不够,Meta开源SAM Audio分割一切声音

Meta 深夜放出音频分割模型 SAM Audio,可通过多模态提示分离任意声音。其核心 PE - AV 推动性能领先,还发布评测模型、基准等,整合进新平台,虽有局限但为音频 AI 带来新可能。

机器之心
开源动态8

GitHub一周2000星!国产统一图像生成模型神器升级,理解质量双up,还学会了“反思”

智源研究院发布国产开源统一图像生成模型OmniGen 2.0版本。它增强理解与生成能力,打通多模态生态。玩法简单,技术有创新,还引入反思机制和新基准,推理效率提升,且将全面开源。

量子位
开源动态8

智源新出OmniGen2开源神器,一键解锁AI绘图「哆啦 A 梦」任意门

2024年9月智源研究院发布统一图像生成模型OmniGen,获社区好评。近期OmniGen升级为OmniGen2,增强多方面能力且全面开源。它采用新架构与策略,有反思机制,玩法丰富,还推出新基准优化部署。

机器之心
算法论文8

警告:你的Agent可能无法"解决"真实世界的视觉问题

文章提出 AgentVista 评测基准,含 209 道任务,横跨 7 大领域 25 个子方向。评测 14 个主流模型,最强的 Gemini - 3 - Pro 准确率仅 27.27%,揭示多模态 Agent 在视觉理解、工具调用等方面挑战大。

深度学习自然语言处理
新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
新闻资讯7

Node.js之父:手写代码已死

Node.js之父Ryan Dahl和Redis之父Salvatore Sanfilippo都认为人类手写代码时代落幕,AI编程已广泛应用。不过,大佬们强调程序员不会失业,他们的工作会从写代码转为提需求。

量子位
新闻资讯7

GPT-5.2来了…

OpenAI推出GPT - 5.2系列,是适合专业知识工作的模型。它在专业工作表现、编程能力、可靠性与安全性等多方面有提升,定价公布,已向付费用户逐步推出,此次更新重在夯实基础。

AI工程化